Anthropic объявила о доступности моделей Claude Fable 5.1 и Claude Mythos 5.1, ориентированных на программирование, информационно насыщенные задачи и долгосрочное решение проблем. Обе модели используют одну и ту же базовую архитектуру, однако Mythos 5.1 имеет более гибкие ограничения безопасности и доступна только проверенным пользователям и организациям в областях кибербезопасности и наук о жизни.
Fable 5.1 предназначена для общего использования, тогда как Mythos 5.1 представляет собой версию для специализированных рабочих задач, которым может потребоваться более широкий спектр испытаний или технических операций. Anthropic заявляет, что новая модель сохраняет те же цены на входные и выходные токены, что и Fable 5: 10 долларов за миллион входных токенов и 50 долларов за миллион выходных токенов через API. При этом компания снизила цену чтения токенов из кэш-памяти на 75% — до 0,25 доллара за миллион токенов.
Снижение стоимости агентских задач
По данным Anthropic, эти изменения дают пользователям экономию около 25% при обычных рабочих нагрузках по сравнению с Fable 5, а в агентских задачах, включающих многочисленные вызовы инструментов и длинные контексты, экономия может достигать примерно 45%. Компания утверждает, что Fable 5.1 при использовании низкого или среднего уровня вычислительной мощности способна обеспечивать производительность, сопоставимую с Fable 5 или превосходящую её. По умолчанию модель работает на высоком уровне в Claude Code и на среднем уровне в Claude Cowork и Claude.ai.
Лучшие результаты в программировании и исследованиях
Представленные Anthropic испытания показали заметное улучшение в некоторых областях. Fable 5.1 набрала 52,6% в тесте Terminal-Bench-Science 0.1 по сравнению с 24,7% у Fable 5. В тесте Terminal-Bench 4.0 на программирование Fable 5.1 набрала 55,8%, тогда как Mythos 5.1 достигла 60,9%, против примерно 42% у Fable 5.
Компания приводит примеры долгосрочных задач. В частности, Fable 5.1 обнаружила редкую программную ошибку в системах инвестиционной компании Millennium, которая возникала примерно один раз на миллион запусков. Кроме того, модель использовала радиолокационные снимки, собранные миссией NASA Magellan, чтобы создать высокоточное картографическое покрытие высот, охватывающее около трети планеты Венера. В области вычислительной биологии Mythos 5.1 помогла оптимизировать графические процессоры для семи моделей глубокого обучения с открытым исходным кодом, ускорив некоторые модели до 2,5 раза.
Новые ограничения для противодействия дистилляции моделей
Fable 5.1 включает механизмы противодействия дистилляции моделей — процесса широкомасштабного сбора результатов передовой модели для обучения другой модели. Anthropic заявляет, что такие операции могут опираться на тысячи фиктивных аккаунтов для переноса возможностей передовых моделей в системы, которые не применяют те же меры безопасности.
Согласно изменению, новые аккаунты Claude API больше не позволят пользователю вручную изменять предыдущий контекст беседы с сохранением прежних записей рассуждений модели в многораундовом диалоге. Anthropic заявляет, что эта мера закрывает один из публично задокументированных способов дистилляции моделей. Ранее компания сообщала об обнаружении операций, в которых участвовали около 24 тысяч фиктивных аккаунтов и более 1,6 миллиона взаимодействий с Claude, и связывала их с DeepSeek, Moonshot AI и MiniMax. Новое ограничение пока применяется только к новым аккаунтам; в будущем оно может быть распространено на все аккаунты.
Что меняется на практике?
Главная ценность объявления заключается не только в названиях двух моделей, но и в сочетании снижения стоимости агентского использования с усилением контроля над способом доступа к предыдущему контексту. Это может помочь разработчикам, управляющим длительными задачами с большим количеством вызовов, но одновременно добавляет ограничение для методов тестирования или управления беседами через API. Кроме того, приведённые показатели производительности являются данными, представленными самой Anthropic, поэтому материал не поясняет, насколько они сопоставимы за пределами упомянутых тестов.
Fable 5.1 доступна через платформу Claude, сервисы Amazon Web Services, Google Cloud и Microsoft Azure, а также через Claude API с идентификатором claude-fable-5-1. Доступ к Mythos 5.1 ограничен пользователями из сфер кибербезопасности и наук о жизни, которые проходят Cyber Verification Program или Life Sciences Verification Program. Программа для наук о жизни была разработана совместно с правительством США, а продукт Claude Security, предназначенный для проверки баз кода на наличие уязвимостей, теперь поддерживает Mythos 5.1.