A DeepSeek ampliou o alcance de sua concorrência nas ferramentas de inteligência artificial para desenvolvedores ao lançar a versão oficial do modelo DeepSeek-V4-Pro-0813, simultaneamente à disponibilização do DeepSeek Harness v0.1 como uma prévia para desenvolvedores e um projeto de código aberto sob a licença MIT. O Harness oferece aos desenvolvedores uma estrutura personalizável para criar agentes de programação que interagem com repositórios, arquivos, comandos shell e fluxos de trabalho de longo prazo, em vez de se limitarem a usar o próprio modelo.
O V4-Pro está atualmente disponível pela interface web da DeepSeek, pelo aplicativo móvel e pela API. A empresa adicionou suporte nativo à OpenAI Responses API, além da integração com o Codex, e o modelo também passou a estar disponível no modo “Expert Mode” no site e no aplicativo. Os usuários da API não precisam alterar o identificador do modelo, pois deepseek-v4-pro agora aponta para a versão mais recente do V4-Pro.
Uma estrutura de agentes substituível
A DeepSeek descreve o projeto Harness, também conhecido como dsh, como uma estrutura de código aberto construída sobre o Cordis, uma estrutura baseada em extensões combináveis. A empresa resume sua filosofia com a frase “tudo é uma extensão”, permitindo substituir modelos, ferramentas, habilidades, sessões, ambientes isolados, sistemas de arquivos, loops de execução, coordenação e interfaces de usuário.
Em seu estado atual, o Harness oferece suporte à inspeção de repositórios, edição de arquivos, execução de comandos shell, pesquisa em arquivos e na web, elaboração de planos, chamada de habilidades, delegação de tarefas a subagentes e aplicação de políticas de aprovação. A DeepSeek afirma que o modo Standard funciona como um agente de programação completo, com uma interface web local que permite selecionar o espaço de trabalho e aprovar operações sensíveis.
O código está disponível no GitHub, e a interface pode ser executada via npm usando o comando npx @deepseek-ai/dsh web; a DeepSeek também fornece instruções para compilação a partir do código-fonte. No entanto, o repositório descreve explicitamente o software como uma “prévia para desenvolvedores” e alerta para a possibilidade de mudanças incompatíveis, portanto a empresa ainda não o apresenta como uma plataforma de produção estável. Além disso, o Harness não é uma alternativa completa à experiência do Claude Code ou do Codex, mas sim uma estrutura aberta e neutra em relação aos modelos, concentrada na composição da infraestrutura ao redor do agente.
O V4-Pro se concentra em tarefas de agentes
O lançamento de 13 de agosto representa a transição do V4-Pro da fase de prévia para a versão oficial, e não a primeira aparição da família V4, apresentada pela DeepSeek em abril. A linha é composta pelo V4-Pro, com 1,6 trilhão de parâmetros, dos quais 49 bilhões são ativados por token, e pelo V4-Flash, com 284 bilhões de parâmetros, dos quais 13 bilhões são ativados. Os dois modelos oferecem uma janela de contexto de até um milhão de tokens.
A DeepSeek afirma que a nova versão oferece grandes melhorias nas capacidades dos agentes, especialmente em ambientes de produção, e oferece suporte à chamada de ferramentas, à saída em JSON, à Responses API e a uma API com formato Anthropic tanto para o V4-Pro quanto para o V4-Flash. A empresa também adicionou níveis claros para controlar o esforço de inferência: Non-think para tarefas rotineiras rápidas, Think High para problemas e planejamento mais complexos, e Think Max para tarefas que exigem raciocínio intensivo.
Segundo números divulgados pela DeepSeek, o V4-Pro-0813 registrou resultados de 87,9 no Terminal Bench 2.1, 74,1 no Toolathlon-Verified, 71,1 no DSBench-FullStack e 67,2 no DSBench-Hard. A empresa esclarece que alguns resultados de tarefas de Code Agent foram testados usando o Harness no “modo mínimo”, o que significa que medem o modelo dentro de um ambiente de execução de agente, e não constituem uma medição independente apenas do modelo.
Novos preços da API conforme os horários de uso
Simultaneamente ao lançamento, a DeepSeek anunciou o abandono do preço unificado da API a partir de 16 de agosto, às 16:00 no horário UTC. Os períodos de pico ocorrerão das 01:00 às 04:00 UTC e das 06:00 às 10:00 UTC, enquanto as demais horas serão classificadas como fora de pico; os preços fora de pico serão metade dos novos preços de pico.
O preço do V4-Pro por milhão de tokens de entrada não armazenados em cache sobe de US$ 0,435 atualmente para US$ 0,66 fora do pico e US$ 1,32 durante o pico, enquanto o preço da saída sobe de US$ 0,87 para US$ 1,98 e US$ 3,96, respectivamente. Já o V4-Flash tem o preço de entrada elevado de US$ 0,14 para US$ 0,22 fora do pico e US$ 0,44 no pico, e o preço de saída sobe de US$ 0,28 para US$ 0,66 e US$ 1,32.
Os preços dos tokens armazenados em cache também aumentam: o preço do V4-Pro sobe de US$ 0,003625 por milhão de tokens para US$ 0,022 fora do pico e US$ 0,044 no pico, enquanto o preço do V4-Flash sobe de US$ 0,0028 para US$ 0,007 e US$ 0,014. Considerando um milhão de tokens de entrada não armazenados em cache e um milhão de tokens de saída, o custo do V4-Pro sobe de US$ 1,305 atualmente para US$ 2,64 fora do pico e US$ 5,28 durante o pico, com o custo efetivo variando conforme as proporções de armazenamento em cache e de saída.
Os novos lançamentos colocam a DeepSeek em concorrência direta pela camada de execução de agentes de programação, e não apenas pela qualidade dos modelos e pelos preços dos tokens. Por outro lado, a prévia inicial do Harness e os aumentos da API significam que as equipes terão de avaliar a estabilidade da estrutura, o comportamento do armazenamento em cache e o agendamento de tarefas, além da opção de executar os pesos abertos em sua própria infraestrutura ao calcular o custo total.