최신 보도, 해설 및 관련 기술 스토리를 확인하세요.
Anthropic은 2025년 12월부터 2026년 8월까지 Claude 모델이 재래식 무기 관련 소프트웨어 개발, 첩보·영향력 행사·감시·사기 활동, 그리고 AI 모델을 무단으로 모방하려는 시도에 사용됐다고 밝혔다. 회사는 이러한 활동과 연관된 계정을 비활성화하고 정보를 공공 및 민간 기관과 공유했다고 전했다.
DeepSeek가 멀티모달 모델 V4.1 Flash를 출시했으며, V4 Pro보다 성능·속도·비용 측면에서 우수하다고 밝혔다. 또한 이전 모델에 대한 일부 요청을 점진적으로 V4.1 Flash로 전환하기 시작했다. 이번 출시는 API 가격 인하와 함께 이 아키텍처를 향후 확대하려는 회사의 방향성을 보여준다.
CISA, NSA, FBI는 6개 중국 인공지능 기업이 2024년 말부터 수십억 개의 토큰과 수백만 건의 요청을 통해 미국 첨단 모델의 출력물을 광범위하게 추출하는 작업을 수행했다고 밝혔다. 기관들은 API 오용 모니터링을 개선하고 이러한 캠페인의 지표를 기업 간에 공유할 것을 권고했다.
ITmedia는 대규모 언어 모델을 로컬에서 실행하는 데 대한 관심이 높아지는 현상이 단순히 클라우드 서비스 의존에 대한 우려만으로 설명되지 않으며, 오픈 웨이트 모델, 하드웨어, 소프트웨어라는 세 요소의 성숙에 따른 것이라고 본다. 이 연재의 첫 번째 부분은 모델의 발전에 초점을 맞추며, DeepSeek와 Qwen을 비롯한 중국 모델들이 부상하고 있음을 다룬다.
Anthropic은 프로그래밍, 과학 연구 및 장기 작업을 위한 Claude Fable 5.1과 Claude Mythos 5.1 모델을 출시했으며, 캐시 읽기 비용을 75% 인하하고 전문 검증 프로그램을 통과한 사용자에게 Mythos 버전을 제공한다. 또한 모델 증류 공격에 대응하기 위해 API 계정에 새로운 제한을 적용했다.