DeepSeek는 DeepSeek-V4-Pro-0813 모델의 공식 버전을 출시하고, 개발자 프리뷰이자 MIT 라이선스의 오픈 소스 프로젝트로 DeepSeek Harness v0.1을 공개하면서 개발자용 인공지능 도구 경쟁의 범위를 넓혔다. Harness는 개발자에게 모델 자체를 사용하는 데 그치지 않고 저장소, 파일, 셸 명령 및 장기 워크플로를 처리하는 프로그래밍 에이전트를 구축할 수 있는 맞춤형 프레임워크를 제공한다.
V4-Pro는 현재 DeepSeek 웹 인터페이스와 모바일 앱, API를 통해 이용할 수 있다. 회사는 OpenAI Responses API에 대한 기본 지원을 추가했으며, Codex와의 통합도 지원한다. 또한 모델은 웹사이트와 앱에서 “Expert Mode”로 이용할 수 있게 됐다. API 사용자는 모델 식별자를 변경할 필요가 없으며, 이제 deepseek-v4-pro가 V4-Pro의 최신 버전을 가리킨다.
교체 가능한 에이전트 프레임워크
DeepSeek는 Harness 프로젝트를 dsh라고도 부르며, 이를 조합 가능한 플러그인에 기반한 프레임워크인 Cordis 위에 구축된 오픈 소스 프레임워크라고 설명한다. 회사는 “모든 것이 플러그인”이라는 문구로 그 철학을 요약하며, 모델, 도구, 기술, 세션, 격리된 환경, 파일 시스템, 실행 루프, 조정 방식 및 사용자 인터페이스를 교체할 수 있다고 밝혔다.
현재 Harness는 저장소 검사, 파일 수정, 셸 명령 실행, 파일 및 웹 검색, 계획 수립, 기술 호출, 하위 에이전트에 대한 작업 위임, 승인 정책 적용을 지원한다. DeepSeek는 Standard 모드가 완전한 프로그래밍 에이전트로 작동하며, 작업 공간을 선택하고 민감한 작업을 승인할 수 있는 로컬 웹 인터페이스를 제공한다고 밝혔다.
코드는 GitHub에서 제공되며, npx @deepseek-ai/dsh web 명령을 사용해 npm으로 인터페이스를 실행할 수 있다. DeepSeek는 소스에서 빌드하는 방법도 제공한다. 그러나 저장소는 이 프로그램을 명시적으로 “개발자 프리뷰”라고 설명하고 호환성을 깨뜨리는 변경이 발생할 수 있다고 경고한다. 따라서 회사는 아직 이를 안정적인 프로덕션 플랫폼으로 제공하지 않는다. 또한 Harness는 Claude Code나 Codex 경험을 완전히 대체하는 제품이 아니라, 에이전트를 둘러싼 구조의 조합에 초점을 둔 개방형 모델 중립 프레임워크다.
에이전트 작업에 초점을 맞춘 V4-Pro
8월 13일 출시는 V4-Pro가 프리뷰 단계에서 공식 버전으로 전환된 것을 의미하며, DeepSeek가 4월에 선보인 V4 제품군의 최초 공개는 아니다. 제품군은 1조 6천억 개의 파라미터를 보유하고 이 중 토큰당 490억 개가 활성화되는 V4-Pro와, 2,840억 개의 파라미터를 보유하고 이 중 130억 개가 활성화되는 V4-Flash로 구성된다. 두 모델 모두 최대 100만 토큰의 컨텍스트 창을 지원한다.
DeepSeek는 새 버전이 특히 프로덕션 환경에서 에이전트 역량을 크게 개선했으며, V4-Pro와 V4-Flash 모두에서 도구 호출, JSON 출력, Responses API 및 Anthropic 형식의 API를 지원한다고 밝혔다. 또한 회사는 추론 노력 제어를 위한 명확한 수준을 추가했다. Non-think는 빠른 일상 작업용이고, Think High는 더 복잡한 문제와 계획 수립용이며, Think Max는 집중적인 추론이 필요한 작업용이다.
DeepSeek가 발표한 수치에 따르면 V4-Pro-0813은 Terminal Bench 2.1에서 87.9, Toolathlon-Verified에서 74.1, DSBench-FullStack에서 71.1, DSBench-Hard에서 67.2를 기록했다. 회사는 일부 Code Agent 작업 결과가 Harness의 “최소 모드”를 사용해 테스트됐다고 설명한다. 이는 에이전트 실행 환경 안에서 모델을 측정한 결과이며, 모델만을 독립적으로 측정한 결과가 아니라는 뜻이다.
사용 시간대별 새로운 API 가격
출시와 동시에 DeepSeek는 UTC 기준 8월 16일 16:00부터 API의 통합 요금제를 폐지한다고 발표했다. 피크 시간대는 UTC 01:00~04:00 및 06:00~10:00이며, 나머지 시간은 비피크 시간대로 분류된다. 비피크 시간대 가격은 새로운 피크 시간대 가격의 절반이다.
V4-Pro의 캐시되지 않은 입력 100만 토큰당 가격은 현재 0.435달러에서 비피크 시간대 0.66달러, 피크 시간대 1.32달러로 오른다. 출력 가격은 0.87달러에서 각각 1.98달러와 3.96달러로 인상된다. V4-Flash의 경우 입력 가격은 0.14달러에서 비피크 시간대 0.22달러, 피크 시간대 0.44달러로 오르고, 출력 가격은 0.28달러에서 각각 0.66달러와 1.32달러로 인상된다.
캐시된 토큰 가격도 인상된다. V4-Pro는 100만 토큰당 0.003625달러에서 비피크 시간대 0.022달러, 피크 시간대 0.044달러로 오른다. V4-Flash는 0.0028달러에서 각각 0.007달러와 0.014달러로 인상된다. 캐시되지 않은 입력 100만 토큰과 출력 100만 토큰을 기준으로 계산하면 V4-Pro 비용은 현재 1.305달러에서 비피크 시간대 2.64달러, 피크 시간대 5.28달러로 오른다. 실제 비용은 캐시 및 출력 비율에 따라 달라진다.
새로운 출시 제품들은 DeepSeek를 모델 품질과 토큰 가격뿐 아니라 프로그래밍 에이전트 실행 계층에서도 직접적인 경쟁에 뛰어들게 한다. 반면 Harness의 초기 프리뷰와 API 가격 인상으로 인해 각 팀은 총비용을 계산할 때 프레임워크의 안정성, 캐시 동작 및 작업 일정 관리뿐 아니라 자체 인프라에서 오픈 가중치를 실행하는 선택지도 평가해야 한다.
뉴스 출처
VentureBeat Startups & Funding
원문 보기 ↗