중국 기업 DeepSeek가 새로운 아키텍처 제품군에서 가장 작은 모델이라고 소개한 DeepSeek V4.1 Flash를 출시했다. 이 아키텍처는 추론 속도를 높이고 작업 처리 능력을 확대하도록 설계됐으며, 향후 더 큰 모델로 확장할 수 있다. 이 모델에는 통합된 멀티모달 시각 이해 기능이 포함되어 있어 텍스트 작업과 함께 이미지를 처리할 수 있다.
V4.1 Flash는 DeepSeek가 시각 입력을 지원하기 위해 8월에 공개한 실험 모델 V4 Flash Vision Exp 이후에 출시됐다. 그러나 회사는 새로운 버전에서 멀티모달 기능이 이전 모델 라인업의 별도 실험이 아니라 아키텍처 자체에 본질적으로 통합됐다고 밝혔다.
DeepSeek 테스트에 따른 향상된 성능
DeepSeek가 공개한 테스트 결과에 따르면 V4.1 Flash는 GPQA Diamond에서 90.9점, Terminal-Bench 2.1에서 90.6점, DeepSWE v1.1에서 74.2점을 기록했다. 또한 회사는 이 모델이 Codeforces에서 3471점의 등급을 받았다고 밝혔다.
DeepSeek는 이 모델이 성능, 비용, 속도, 작업 완료에 필요한 총시간을 포함한 여러 지표에서 DeepSeek V4 Pro를 능가한다고 말한다. 자료에는 가격이나 소요 시간에 대한 구체적인 비교 수치가 포함되어 있지 않으며, 언급된 결과도 회사 자체가 발표한 것이므로 일반적인 기준으로 채택하기 전에 독립적인 검증이 필요한 성능 주장으로 봐야 한다.
모델명 변경 및 요청 전환
V4.1 Flash 출시와 함께 DeepSeek는 V4 Flash와 V4 Flash Vision Exp의 제공을 중단한다. 기존 애플리케이션과의 호환성을 유지하기 위해 이전 모델명은 일시적으로 V4.1 Flash로 연결된다. API를 통해 최신 Flash 모델에 접근하려는 개발자는 모델명 deepseek-flash를 사용할 수 있다.
회사는 V4 Pro도 단계적으로 폐기할 계획이다. 베이징 시간 9월 14일 12:00부터 deepseek-v4-pro를 통해 전송되는 요청은 V4.1 Pro가 출시될 때까지 V4.1 Flash로 전환되며, 비용은 V4.1 Flash 가격에 따라 계산된다. 자료는 새로운 가격의 금액을 언급하지 않았지만, DeepSeek가 모델 출시와 함께 Flash 시리즈의 API 가격을 인하했다고 밝혔다.
실제로 무엇이 달라지는가?
개발자들에게 이번 발표는 단순히 새 모델이 추가되는 데 그치지 않고 DeepSeek 모델에 접근하는 경로가 재편된다는 의미를 갖는다. 기존 모델명에 의존할 경우 원래 모델 대신 V4.1 Flash가 실행될 수 있으며, 이는 프로덕션 애플리케이션에서 결과를 비교하거나 비용과 성능을 모니터링할 때 중요한 변화다. 반면 deepseek-flash라는 이름을 사용하면 특정 버전명에 묶이지 않고 Flash 제품군의 최신 버전에 접근할 수 있다.
또한 이번 발표의 구조는 더 빠르고 저렴한 모델에 집중하면서도 더 큰 모델 제품군을 겨냥한 수준의 성능을 유지하려는 DeepSeek의 방향을 보여준다. 회사는 V4.1 Flash가 새로운 아키텍처에서 가장 작은 구성원이라고 밝혔으며, 이에 따라 V4.1 Pro를 포함한 더 큰 모델이 같은 제품군에 추가될 가능성이 있다. 그러나 이러한 버전의 출시 시기와 사양은 자료에서 정해지지 않았다.
이번 출시는 Reuters 보도에 따르면 항저우에 본사를 둔 DeepSeek가 상하이증권거래소 산하 STAR 시장에서 기업공개를 준비하기 시작한 시점에 이뤄졌다. 소식통이 전한 내용에 따르면 회사는 신규 자금을 컴퓨팅 인프라, 모델 개발, 숙련 인력 유지에 사용할 가능성이 있다. 본문은 일정이나 공모 조건에 관한 확정적인 세부 사항을 제시하지 않는다.