Una beta que duró 48 horas
DeepSeek puso V4.1 Flash a disposición general el 10 de septiembre, dos días después de abrir un punto de acceso en beta cuyo cierre estaba fijado para esa misma fecha. La compañía había llamado al modelo de prueba deepseek-v4.1-flash-expires-on-0910, de modo que la fecha de apagado se publicó antes que el modelo.
En su registro de cambios, DeepSeek describe V4.1 Flash como el modelo más pequeño de una nueva familia de arquitectura, con comprensión visual multimodal nativa integrada en el modelo base y no añadida después. La empresa afirma que el diseño busca un techo de capacidad más alto, inferencia más rápida, mayor rendimiento y la posibilidad de escalar a modelos mayores, lo que dice tanto de lo que viene como de lo que se ha publicado.
Qué sustituye a qué
Dos nombres de modelo desaparecen dentro del nuevo. Las peticiones a deepseek-v4-flash y deepseek-v4-flash-vision-exp se redirigen ahora a V4.1 Flash. El punto de acceso experimental de visión es la señal más clara: la comprensión de imágenes ya no es una rama lateral de la línea Flash.

El cambio mayor está en la parte alta de la gama. DeepSeek dice que, a partir del 14 de septiembre, las peticiones a deepseek-v4-pro también se redirigirán a V4.1 Flash y se facturarán al precio de Flash, retirando V4 Pro hasta que llegue un futuro V4.1 Pro. Quienes eligieron Pro por su capacidad recibirán un modelo más pequeño hasta que aparezca ese relevo, y la compañía no ha dicho cuándo será.
Precios y contexto
La página de precios de DeepSeek indica para V4.1 Flash una ventana de contexto de un millón de tokens. Fuera de hora punta, la entrada cuesta 0,15 dólares por millón de tokens cuando falla la caché y 0,003 cuando acierta, con la salida a 0,60 dólares por millón. En hora punta las tarifas se duplican: 0,30, 0,006 y 1,20. DeepSeek define la hora punta como 01:00–04:00 y 06:00–10:00 UTC en días laborables, y cobra la tarifa reducida el resto del tiempo.

La empresa afirma que los precios se han reducido con el lanzamiento, sin publicar una tabla comparativa. La tarifa de acierto de caché es la cifra que destaca: a 0,003 dólares por millón de tokens fuera de hora punta, repetir el inicio de un prompt no cuesta casi nada, que es la forma de un precio pensado para bucles de agentes y documentos largos más que para conversaciones sueltas.
Qué vigilar
DeepSeek no ha publicado resultados de referencia para V4.1 Flash junto con el lanzamiento, y las cifras que circulan de la ventana de beta son mediciones de rendimiento hechas por usuarios, no puntuaciones de capacidad. Hay dos cosas que conviene seguir: si las evaluaciones independientes confirman la afirmación sobre la arquitectura, y cuándo aparece V4.1 Pro, porque hasta entonces el modelo público más capaz de la compañía es uno de gama Flash.