A Anthropic anunciou a disponibilização dos modelos Claude Fable 5.1 e Claude Mythos 5.1, com foco em programação, tarefas intensivas em informação e resolução de problemas de longo prazo. Os dois modelos utilizam a mesma arquitetura básica, mas o Mythos 5.1 vem com restrições de segurança mais flexíveis e só está disponível para usuários e instituições verificados nas áreas de segurança cibernética e ciências da vida.
O Fable 5.1 é destinado ao uso geral, enquanto o Mythos 5.1 representa a versão voltada a atividades especializadas que podem precisar de um escopo mais amplo de testes ou operações técnicas. A Anthropic afirma que o novo modelo mantém os mesmos preços dos tokens de entrada e saída do Fable 5: 10 dólares por milhão de tokens de entrada e 50 dólares por milhão de tokens de saída pela API. Em contrapartida, a empresa reduziu em 75% o preço da leitura de tokens do cache, para 0,25 dólar por milhão de tokens.
Redução do custo de tarefas agentivas
Segundo a Anthropic, essas mudanças proporcionam aos usuários uma economia de aproximadamente 25% em cargas de trabalho comuns em comparação com o Fable 5, podendo chegar a cerca de 45% em tarefas agentivas que envolvem muitas chamadas de ferramentas e contextos longos. A empresa afirma que o Fable 5.1 consegue, ao utilizar níveis baixos ou médios de capacidade computacional, alcançar desempenho semelhante ou superior ao do Fable 5. Por padrão, o modelo opera em nível alto no Claude Code e em nível médio no Claude Cowork e no Claude.ai.
Melhores resultados em programação e pesquisa
Os testes apresentados pela Anthropic mostraram uma melhora clara em algumas áreas. O Fable 5.1 obteve 52,6% no teste Terminal-Bench-Science 0.1, em comparação com 24,7% do Fable 5. No teste de programação Terminal-Bench 4.0, o Fable 5.1 obteve 55,8%, enquanto o Mythos 5.1 alcançou 60,9%, contra cerca de 42% do Fable 5.
A empresa apresenta exemplos de tarefas de longo prazo, incluindo a descoberta, pelo Fable 5.1, de um erro raro de programação nos sistemas da empresa de investimentos Millennium, que ocorria aproximadamente uma vez a cada milhão de execuções. O modelo também utilizou imagens de radar coletadas pela missão Magellan da NASA para criar um mapa de elevação de alta resolução cobrindo cerca de um terço do planeta Vênus. No campo da biologia computacional, o Mythos 5.1 ajudou a otimizar unidades de processamento gráfico para sete modelos de aprendizado profundo de código aberto, acelerando alguns modelos em até 2,5 vezes.
Novas restrições para combater a destilação de modelos
O Fable 5.1 inclui mecanismos de combate à destilação de modelos, um processo de coleta em larga escala das saídas de um modelo avançado para treinar outro modelo. A Anthropic afirma que essas operações podem depender de milhares de contas falsas para transferir as capacidades de modelos avançados para sistemas que não aplicam os mesmos controles de segurança.
Com a mudança, as novas contas da Claude API não permitirão que o usuário modifique manualmente o contexto anterior da conversa mantendo os registros anteriores de raciocínio do modelo em uma conversa de várias rodadas. A Anthropic afirma que essa medida fecha uma das formas de destilação de modelos documentadas publicamente. A empresa havia anunciado anteriormente a descoberta de operações que envolviam cerca de 24 mil contas falsas e mais de 1,6 milhão de interações com o Claude, associando-as à DeepSeek, à Moonshot AI e à MiniMax. A nova restrição se aplica atualmente apenas a contas novas, com possibilidade de expansão para todas as contas em versões futuras.
O que muda na prática?
O principal valor do anúncio não se limita aos nomes dos dois modelos, mas reúne a redução do custo de uso agentivo e o controle mais rigoroso sobre a forma de acesso ao contexto anterior. Isso pode beneficiar desenvolvedores que gerenciam muitas tarefas longas com numerosas chamadas, mas, ao mesmo tempo, acrescenta uma restrição aos métodos de teste ou gerenciamento de conversas pela API. Além disso, os resultados de desempenho apresentados são números fornecidos pela própria Anthropic e, portanto, o material não esclarece até que ponto eles são comparáveis fora dos testes mencionados.
O Fable 5.1 está disponível pela plataforma Claude e pelos serviços da Amazon Web Services, Google Cloud e Microsoft Azure, além da Claude API com o identificador claude-fable-5-1. Já a disponibilidade do Mythos 5.1 está limitada a usuários de segurança cibernética e ciências da vida que passem pelo Cyber Verification Program ou pelo Life Sciences Verification Program. O programa de ciências da vida foi desenvolvido em colaboração com o governo dos Estados Unidos, enquanto o produto Claude Security, destinado a examinar bases de código em busca de vulnerabilidades, passou a ser compatível com o Mythos 5.1.