DeepSeek amplió el alcance de su competencia en herramientas de inteligencia artificial para desarrolladores con el lanzamiento de la versión oficial del modelo DeepSeek-V4-Pro-0813, junto con la presentación de DeepSeek Harness v0.1 como vista previa para desarrolladores y proyecto de código abierto bajo licencia MIT. Harness ofrece a los desarrolladores un marco personalizable para crear agentes de programación que interactúan con repositorios, archivos, comandos de shell y flujos de trabajo de largo plazo, en lugar de limitarse a utilizar el modelo por sí solo.
V4-Pro está disponible actualmente a través de la interfaz web de DeepSeek, la aplicación móvil y la API. La empresa añadió compatibilidad nativa con la OpenAI Responses API, además de la integración con Codex, y el modelo también está disponible en el modo «Expert Mode» del sitio web y la aplicación. Los usuarios de la API no necesitan cambiar el identificador del modelo, ya que deepseek-v4-pro ahora apunta a la versión más reciente de V4-Pro.
Un marco de agentes reemplazable
DeepSeek describe el proyecto Harness, también conocido como dsh, como un marco de código abierto basado en Cordis, un marco que depende de extensiones componibles. La empresa resume su filosofía con la frase «todo es una extensión», ya que se pueden reemplazar los modelos, las herramientas, las habilidades, las sesiones, los entornos aislados, los sistemas de archivos, los bucles de ejecución, la coordinación y las interfaces de usuario.
En su estado actual, Harness admite la inspección de repositorios, la modificación de archivos, la ejecución de comandos de shell, la búsqueda en archivos y en la web, la elaboración de planes, la invocación de habilidades, la delegación de tareas a subagentes y la aplicación de políticas de aprobación. DeepSeek afirma que el modo Standard funciona como un agente de programación completo, con una interfaz web local que permite elegir el espacio de trabajo y aprobar operaciones sensibles.
El código está disponible en GitHub y la interfaz puede ejecutarse mediante npm con el comando npx @deepseek-ai/dsh web; DeepSeek también ofrece instrucciones para compilarlo desde el código fuente. Sin embargo, el repositorio describe explícitamente el programa como una «vista previa para desarrolladores» y advierte de que podrían producirse cambios incompatibles, por lo que la empresa todavía no lo presenta como una plataforma de producción estable. Harness tampoco es un sustituto completo de la experiencia de Claude Code o Codex, sino un marco abierto y neutral respecto a los modelos, centrado en ensamblar la infraestructura que rodea al agente.
V4-Pro se centra en las tareas de los agentes
El lanzamiento del 13 de agosto representa la transición de V4-Pro de la fase de vista previa a la versión oficial, y no la primera aparición de la familia V4, que DeepSeek presentó en abril. La línea está compuesta por V4-Pro, con 1,6 billones de parámetros, de los cuales 49.000 millones se activan por token, y V4-Flash, con 284.000 millones de parámetros, de los cuales se activan 13.000 millones. Ambos modelos admiten una ventana de contexto de hasta un millón de tokens.
DeepSeek afirma que la nueva versión ofrece grandes mejoras en las capacidades de los agentes, especialmente en entornos de producción, y admite llamadas a herramientas, salida JSON, Responses API y una API con formato Anthropic tanto para V4-Pro como para V4-Flash. La empresa también añadió niveles claros para controlar el esfuerzo de razonamiento: Non-think para tareas rutinarias rápidas, Think High para problemas y planificación más complejos, y Think Max para tareas que necesitan un razonamiento intensivo.
Según las cifras anunciadas por DeepSeek, V4-Pro-0813 obtuvo resultados de 87,9 en Terminal Bench 2.1, 74,1 en Toolathlon-Verified, 71,1 en DSBench-FullStack y 67,2 en DSBench-Hard. La empresa aclara que algunos resultados de tareas de Code Agent se probaron utilizando Harness en el «modo mínimo», lo que significa que miden el modelo dentro de un entorno de ejecución para agentes y no constituyen una medición independiente del modelo por sí solo.
Nuevos precios de la API según los horarios de uso
Junto con el lanzamiento, DeepSeek anunció el abandono de la tarifa unificada para la API a partir del 16 de agosto a las 16:00, hora UTC. Los periodos de máxima demanda serán de 01:00 a 04:00 UTC y de 06:00 a 10:00 UTC, mientras que el resto de las horas se clasificará como fuera de las horas punta; los precios fuera de las horas punta serán la mitad de los nuevos precios en hora punta.
El precio de V4-Pro por cada millón de tokens de entrada no almacenados en caché aumenta de los 0,435 dólares actuales a 0,66 dólares fuera de las horas punta y 1,32 dólares durante ellas, mientras que el precio de salida pasa de 0,87 dólares a 1,98 dólares y 3,96 dólares, respectivamente. En cuanto a V4-Flash, su entrada aumenta de 0,14 dólares a 0,22 dólares fuera de las horas punta y 0,44 dólares durante ellas, y su salida pasa de 0,28 dólares a 0,66 dólares y 1,32 dólares.
Los precios de los tokens almacenados en caché también aumentan: el precio de V4-Pro pasa de 0,003625 dólares por cada millón de tokens a 0,022 dólares fuera de las horas punta y 0,044 dólares durante ellas, mientras que el de V4-Flash aumenta de 0,0028 dólares a 0,007 dólares y 0,014 dólares. Al calcular un millón de tokens de entrada no almacenados en caché y un millón de tokens de salida, el coste de V4-Pro aumenta de los 1,305 dólares actuales a 2,64 dólares fuera de las horas punta y 5,28 dólares durante ellas, aunque el coste real varía según las proporciones de almacenamiento en caché y de salida.
Los nuevos lanzamientos sitúan a DeepSeek en competencia directa por la capa de ejecución de los agentes de programación, no solo por la calidad de los modelos y el precio de los tokens. Al mismo tiempo, la primera vista previa de Harness y los aumentos de la API implican que los equipos deberán evaluar la estabilidad del marco, el comportamiento de la caché y la programación de tareas, además de considerar la opción de ejecutar los pesos abiertos en su propia infraestructura al calcular el coste total.