Lo que se ofrece

DeepSeek ha abierto una beta limitada de V4.1 Flash, que describe como un modelo intermedio construido sobre una arquitectura nueva con soporte nativo para entrada multimodal, según TechNode. Los desarrolladores acceden cambiando el nombre del modelo a deepseek-v4.1-flash-expires-on-0910, un identificador que declara su propia caducidad. El endpoint se apaga el 10 de septiembre.

Los precios de la beta coinciden con las tarifas del V4 Flash existente, y cada cuenta está limitada a 20 peticiones simultáneas. La afirmación de DeepSeek sobre el modelo es el trío habitual: más rendimiento, generación más rápida, menor coste.

La afirmación sobre la arquitectura

Esta es la parte que merece atención. DeepSeek dice que V4.1 Flash es el mayor cambio de arquitectura en la línea V4 desde que esa serie se lanzó en abril de 2026, y que texto, imagen y voz se procesan de forma nativa en los mismos pesos en lugar de mediante un componente de visión añadido. Su oferta multimodal anterior, V4-Flash-Vision-Exp, publicada en agosto, acoplaba la visión a la línea Flash desde fuera.

Ventana de terminal de desarrollo con código en un monitor
Cada cuenta está limitada a 20 peticiones simultáneas durante la beta. Imagen ilustrativa. Godfrey Atima · pexels · Pexels License

La compañía no ha publicado una descripción de la arquitectura, ni un informe técnico, ni resultados de referencia. Una ventana de dos días con un tope de 20 peticiones simultáneas no basta para una evaluación independiente, y DeepSeek no ha dicho que vaya a permitir una antes de que el modelo esté disponible de forma general.

Las cifras de velocidad, con una advertencia

Las cifras de rendimiento publicadas varían mucho y ninguna procede de DeepSeek. Los medios que han cubierto la beta citan mediciones de desarrolladores que van desde unos 300 tokens por segundo hasta picos por encima de 500, tomadas con distintos prompts y bajo distinta carga. No son comparables entre sí y no deben leerse como una especificación.

Escritorio de oficina con un portátil y un cuaderno
DeepSeek no ha publicado ningún informe técnico del modelo. Imagen ilustrativa. Sora Shimazaki · pexels · Pexels License

Por qué hacer una beta así

Un endpoint público de 48 horas es una prueba de carga con público. Da a DeepSeek patrones de tráfico reales sobre una arquitectura nueva sin comprometerse con disponibilidad, precios ni soporte, y genera justo la conversación entre desarrolladores que una prueba interna silenciosa no produciría. El coste es que de ahí no sale nada verificable.

Dónde encaja en la línea

La serie V4 de DeepSeek se reparte entre Flash, el nivel barato y rápido, y Pro, el nivel de razonamiento que pasó a disponibilidad general en agosto con tres niveles de esfuerzo de pensamiento y precios de hora punta y valle. Meter primero una arquitectura nueva en la ranura de Flash es el orden de menor riesgo: Flash soporta el tráfico de volumen, así que revela pronto los problemas de rendimiento y estabilidad, y un modelo Flash decepcionante cuesta menos reputación que uno Pro.

También significa que la pregunta interesante —si la arquitectura aguanta en trazas largas de razonamiento y no solo en respuestas cortas— no es la que responde esta beta.

Qué vigilar

Lo concreto es qué sustituye al endpoint después del 10 de septiembre: si V4.1 Flash vuelve como modelo de producción con nombre propio, precios publicados e informe técnico, o si el cambio de arquitectura aterriza en silencio dentro de un nombre de modelo ya existente. Lo segundo encajaría con la forma en que DeepSeek ha lanzado antes.