Anthropic은 프로그래밍, 정보 집약적 작업 및 장기 문제 해결에 초점을 맞춘 Claude Fable 5.1과 Claude Mythos 5.1 모델을 제공한다고 발표했다. 두 모델은 동일한 기반 아키텍처를 사용하지만, Mythos 5.1은 더 유연한 안전 제한을 적용하며 사이버 보안 및 생명과학 분야에서 검증된 사용자와 기관만 이용할 수 있다.
Fable 5.1은 일반적인 사용을 대상으로 하는 반면, Mythos 5.1은 더 광범위한 테스트나 기술 작업이 필요할 수 있는 전문 업무용 버전이다. Anthropic에 따르면 새 모델은 Fable 5와 동일한 입력 및 출력 토큰 가격을 유지하며, API에서 입력 토큰 100만 개당 10달러, 출력 토큰 100만 개당 50달러가 부과된다. 반면 회사는 캐시에서 토큰을 읽는 가격을 75% 인하해 토큰 100만 개당 0.25달러로 낮췄다.
에이전트 작업 비용 절감
Anthropic에 따르면 이러한 변경으로 일반적인 워크로드에서 Fable 5에 비해 약 25%를 절약할 수 있으며, 여러 도구 호출과 긴 컨텍스트가 포함된 에이전트 작업에서는 절감 폭이 약 45%에 이를 수 있다. 회사는 Fable 5.1이 낮거나 중간 수준의 컴퓨팅 능력을 사용할 때 Fable 5와 비슷하거나 더 높은 성능을 낼 수 있다고 밝혔다. 이 모델은 Claude Code에서 기본적으로 높은 수준으로, Claude Cowork와 Claude.ai에서는 중간 수준으로 작동한다.
프로그래밍 및 연구에서 향상된 결과
Anthropic이 제시한 테스트에서 일부 분야의 성능이 뚜렷하게 향상된 것으로 나타났다. Fable 5.1은 Terminal-Bench-Science 0.1 테스트에서 52.6%를 기록해 Fable 5의 24.7%를 웃돌았다. 프로그래밍을 평가하는 Terminal-Bench 4.0 테스트에서는 Fable 5.1이 55.8%, Mythos 5.1이 60.9%를 기록했으며, Fable 5는 약 42%였다.
회사는 장기 작업의 사례로 Millennium 투자회사의 시스템에서 드물게 발생하는 프로그래밍 오류를 Fable 5.1이 발견한 일을 들었다. 이 오류는 약 100만 회 실행마다 한 번 나타났다. 또한 이 모델은 NASA의 Magellan 임무가 수집한 레이더 이미지를 사용해 금성 표면의 약 3분의 1을 포괄하는 고해상도 고도 지도를 제작했다. 계산 생물학 분야에서는 Mythos 5.1이 7개의 오픈 소스 딥러닝 모델에서 그래픽 처리 장치 처리 단위를 최적화하는 데 도움을 주었으며, 일부 모델의 속도를 최대 2.5배 높였다.
모델 증류 대응을 위한 새로운 제한
Fable 5.1에는 모델 증류를 방지하기 위한 메커니즘이 포함되어 있다. 모델 증류는 고급 모델의 출력을 대규모로 수집해 다른 모델을 훈련하는 과정이다. Anthropic은 이러한 작업이 수천 개의 가짜 계정에 의존해 고급 모델의 능력을 동일한 안전 통제를 적용하지 않는 시스템으로 이전할 수 있다고 밝혔다.
변경 사항에 따라 새로운 Claude API 계정에서는 다중 라운드 대화에서 모델의 이전 사고 기록을 유지한 채 사용자가 이전 대화 컨텍스트를 수동으로 수정하는 것이 허용되지 않는다. Anthropic은 이 조치가 공개적으로 문서화된 모델 증류 방법 중 하나를 차단한다고 밝혔다. 회사는 앞서 약 2만 4,000개의 가짜 계정과 Claude와의 160만 건 이상의 상호작용이 포함된 작업을 발견했다고 발표했으며, 이를 DeepSeek, Moonshot AI 및 MiniMax와 연관 지었다. 새로운 제한은 현재 새로운 계정에만 적용되며, 향후 버전에서 모든 계정으로 확대될 가능성이 있다.
실제로 무엇이 달라지는가?
이번 발표의 가장 큰 가치는 단순히 두 모델의 이름에 있지 않다. 에이전트 사용 비용을 낮추는 동시에 이전 컨텍스트에 접근하는 방식을 더욱 엄격하게 통제하는 데 있다. 이는 호출이 많은 장기 작업을 관리하는 개발자에게 도움이 될 수 있지만, API를 통한 대화 테스트나 관리 방식에는 새로운 제한을 추가한다. 또한 제시된 성능 결과는 Anthropic이 직접 제공한 수치이므로, 언급된 테스트 외부에서 비교 가능한 정도는 이 자료만으로는 알 수 없다.
Fable 5.1은 Claude 플랫폼과 Amazon Web Services, Google Cloud 및 Microsoft Azure의 서비스, 그리고 claude-fable-5-1 식별자를 사용하는 Claude API를 통해 제공된다. Mythos 5.1은 Cyber Verification Program 또는 Life Sciences Verification Program을 통과한 사이버 보안 및 생명과학 사용자만 이용할 수 있다. 생명과학 프로그램은 미국 정부와 협력해 개발되었으며, 취약점을 찾기 위해 코드베이스를 검사하는 제품인 Claude Security는 Mythos 5.1의 지원을 받게 되었다.