La empresa china DeepSeek ha lanzado el modelo DeepSeek V4.1 Flash, que presenta como el modelo más pequeño de una nueva familia arquitectónica diseñada para aumentar la velocidad de inferencia y ampliar la capacidad de procesamiento de tareas, con la posibilidad de escalar posteriormente a modelos más grandes. El modelo incorpora comprensión visual multimodal integrada, lo que le permite trabajar con imágenes además de tareas de texto.
V4.1 Flash llega después del modelo experimental V4 Flash Vision Exp, que DeepSeek presentó en agosto para admitir entradas visuales. Sin embargo, la empresa afirma que las capacidades multimodales forman parte integral de la arquitectura en la nueva versión, en lugar de constituir un experimento separado dentro de la línea de modelos anterior.
Mayor rendimiento según las pruebas de DeepSeek
Según los resultados de pruebas publicados por DeepSeek, V4.1 Flash obtuvo una puntuación de 90,9 en GPQA Diamond, 90,6 en Terminal-Bench 2.1 y 74,2 en DeepSWE v1.1. La empresa también anunció una clasificación de 3471 para el modelo en Codeforces.
DeepSeek afirma que el modelo supera a DeepSeek V4 Pro en varios indicadores, entre ellos el rendimiento, el coste, la velocidad y el tiempo total necesario para completar las tareas. El material no incluye cifras detalladas para comparar precios o tiempos, y los resultados mencionados proceden de la propia empresa; por ello, deben considerarse afirmaciones de rendimiento que requieren una verificación independiente antes de adoptarse como referencia general.
Cambio de nombres de modelos y redirección de solicitudes
Con el lanzamiento de V4.1 Flash, DeepSeek dejará de ofrecer V4 Flash y V4 Flash Vision Exp. Los nombres de los modelos antiguos se redirigirán temporalmente a V4.1 Flash para mantener la compatibilidad con las aplicaciones existentes. Los desarrolladores que quieran acceder al modelo Flash más reciente a través de la interfaz de programación pueden utilizar el nombre de modelo deepseek-flash.
La empresa también planea retirar gradualmente V4 Pro. A partir del 14 de septiembre a las 12:00, hora de Pekín, las solicitudes enviadas mediante deepseek-v4-pro se transferirán a V4.1 Flash hasta el lanzamiento de V4.1 Pro, y el coste se calculará según los precios de V4.1 Flash. El material no indica el importe de los nuevos precios, pero señala que DeepSeek redujo los precios de la interfaz de programación de la serie Flash con el lanzamiento del modelo.
¿Qué cambia en la práctica?
Para los desarrolladores, el anuncio no se limita a añadir un modelo nuevo, sino que incluye una reorganización de la vía de acceso a los modelos de DeepSeek. Depender de nombres antiguos puede hacer que se ejecute V4.1 Flash en lugar del modelo original, un cambio importante al comparar resultados o supervisar el coste y el rendimiento en aplicaciones de producción. En cambio, el nombre deepseek-flash ofrece una vía para acceder a la versión más reciente de la categoría Flash sin vincularse al nombre de una versión específica.
La estructura del anuncio también revela el interés de DeepSeek por modelos más rápidos y menos costosos, manteniendo un nivel de rendimiento dirigido a la categoría de modelos más grandes. La empresa afirma que V4.1 Flash es el miembro más pequeño de la nueva arquitectura, lo que deja abierta la posibilidad de lanzar modelos más grandes, incluido V4.1 Pro, dentro de la misma familia. Sin embargo, el material no especifica la fecha ni las características de estas versiones.
El lanzamiento se produce en un momento en que informes de Reuters indican que DeepSeek, con sede en Hangzhou, ha comenzado a prepararse para una oferta pública inicial en el mercado STAR de la Bolsa de Shanghái. Según la fuente, la empresa podría destinar la nueva financiación a infraestructura informática, desarrollo de modelos y retención de empleados con experiencia. El texto no ofrece detalles confirmados sobre el calendario ni las condiciones de la oferta.