구글은 2026년 8월 13일 Gemini 3.7 Flash를 출시했다. 이 모델은 집중적인 일상 사용을 위해 설계된 구글의 새로운 모델로, 프로그래밍, 에이전트 기반 워크플로 및 기업 지식 작업에 중점을 둔다. 이번 출시는 Gemini 3.6 Flash 출시 후 불과 3주 만에 이루어졌으며, 구글은 업데이트 속도가 개발자 피드백과 알고리즘 개선에 따른 것이라고 밝혔다.
구글은 API를 통한 모델 사용 가격을 한시적으로 50% 인하한다. 이에 따라 2026년 12월 31일까지 입력 100만 토큰당 약 0.75달러, 출력 100만 토큰당 3.75달러가 부과된다. 2027년 1월 1일부터는 입력 가격이 1.50달러, 출력 가격이 7.50달러로 인상된다. 한편 준비 기간 동안 컨텍스트 캐싱 비용은 100만 토큰당 0.075달러이며, 이후 0.15달러로 인상된다.
다단계 작업 실행에 초점
구글은 Gemini 3.7 Flash를 프로그래밍과 에이전트를 위한 자사의 현재까지 “가장 똑똑한 업무용 모델”이라고 설명한다. 회사에 따르면 이 모델은 장애물에 대응하고, 필요할 때 의도를 명확히 질문하며, 지시를 더욱 정확하게 따르는 능력이 향상됐다. 또한 다단계 작업을 계획하고 도구 호출을 실행할 때 “더욱 신중하게 사고한다”고 구글은 밝혔다.
이러한 개선은 프로그래밍 에이전트와 비즈니스 에이전트에서 반복적인 시도와 사람의 개입을 줄이는 것을 목표로 한다. 기업 개발 환경에서 이 모델은 불필요한 수정, 오류 복구 및 복잡한 계획 실행을 더욱 높은 신뢰성으로 수행하는 데 도움을 줄 수 있다. 여러 문서와 애플리케이션에서 작동하는 에이전트에도 마찬가지로 적용되며, 잘못된 도구 호출이나 지시에 대한 부정확한 해석은 워크플로를 중단시킬 수 있다.
Google DeepMind는 새 버전이 오류 수정과 문제 해결, 더 적은 프롬프트로 더욱 완성도 높은 웹 및 애플리케이션 레이아웃 생성, 실제 비즈니스 워크플로에서의 추론 및 정확성 측면에서 발전을 이뤘다고 밝혔다.
프로그래밍 성능은 크게 향상됐지만 전반적인 우위는 없어
구글의 테스트에 따르면 Gemini 3.7 Flash는 생산 코드 품질을 측정하는 FrontierCode 1.1 Main 테스트에서 43.6%를 기록해 3.6 버전의 34.4%를 앞섰다. 또한 구글의 표에 따르면 Claude Sonnet 5의 42.7%와 GPT-5.6 Terra의 41.3%를 소폭 넘어섰다.
장기 프로그래밍 작업을 평가하는 DeepSWE v1.1 테스트에서 이 모델은 이전 모델의 49.0%보다 높은 65.3%를 기록했지만, 69.6%를 기록한 GPT-5.6 Terra에는 뒤처졌다. 웹 개발에서는 Code Arena에서 1588 Elo를 받아 Gemini 3.6 Flash의 1538점, Claude Sonnet 5의 1541점, GPT-5.6 Terra의 1523점을 앞섰다.
결과가 모든 분야에서 전반적인 우위를 보여주는 것은 아니다. 이 모델은 Terminal-bench 2.1에서 85.8%를 기록해 GPT-5.6 Terra의 87.4%에 뒤졌으며, Terra는 Terminal-bench 3.0과 OSWorld-2.0에서도 더 높은 성능을 보였다. 데스크톱 및 멀티모달 작업을 평가하는 Agent's Last Exam에서는 Claude Sonnet 5가 33.3%의 성공률로 1위를 차지했고, Gemini 3.7 Flash는 26.3%를 기록했다.
기업용 활용과 경쟁력 있는 가격
발표된 개선 사항은 비즈니스 자동화와 문서 이해로도 확장된다. 구글의 데이터에 따르면 Gemini 3.7 Flash는 AutomationBench에서 30.4%를 기록했다. 이는 이전 버전의 17.0%, GPT-5.6 Terra의 23.6%, Claude Sonnet 5의 10.7%보다 높은 수치다. 또한 복잡한 PDF 파일 이해를 평가하는 GDP.PDF 테스트에서 34.0%를 기록해 Gemini 3.6 Flash의 22.0%, Claude Sonnet 5의 28.0%, GPT-5.6 Terra의 24.7%를 앞섰다.
구글은 Google AI Pro 및 Ultra 구독자에게 자사의 개인용 인공지능 에이전트인 Spark를 통해 이 모델을 제공한다. 여기에는 지식 작업과 Google Workspace 도구 사용 개선이 포함되며, 파일 취합, 이메일 작성, 상태 문서 업데이트 등의 작업을 수행할 수 있다. 기업에는 Gemini Enterprise Agent Platform과 Gemini Enterprise를 통해 제공된다.
에이전트의 자율 실행을 둘러싼 경쟁에서 한시적으로 인하된 가격이 주목받는 이유는 단일 요청이 긴 모델 호출, 추론 토큰 및 도구 상호작용의 연쇄를 생성할 수 있기 때문이다. 기사에서는 토큰 가격 인하가 최종 비용 감소를 반드시 의미하지는 않는다고 설명한다. 모델에 반복적인 시도가 필요할 수 있기 때문이다. 따라서 실제 기준은 토큰 100만 개당 가격 자체가 아니라 작업을 성공적으로 완료하는 데 드는 비용이 될 것이다.
모델의 이용 가능 범위와 출시 맥락
개발자는 Google AI Studio의 Gemini API와 Android Studio, 그리고 구글의 Antigravity 환경을 통해 Gemini 3.7 Flash에 접근할 수 있다. 기업에는 Gemini Enterprise Agent Platform과 Gemini Enterprise를 통해 제공되며, 지원 국가의 Google AI Pro 또는 Ultra 구독자는 Spark를 통해 이용할 수 있다. 구글은 화학·생물학·방사선·핵 관련 위험과 사이버 공격에서의 모델 악용을 다루는 업데이트된 안전장치도 도입했다고 밝혔다.
이번 출시는 구글이 Gemini 3.5 Pro의 제공 시점을 발표하지 않은 가운데 이루어졌다. 기사에 따르면 Gemini 3.5 Pro는 파트너 테스트 단계에 머물러 있으며, Gemini 3.1 Pro는 회사가 제공한 최신 일반용 Pro 모델로 남아 있다. 이에 따라 Gemini 3.7 Flash는 구글의 고속 모델 라인을 강화하지만, 선도 모델을 둘러싼 경쟁을 결정짓지는 못한다.
개발팀 입장에서는 성능 향상과 한시적인 가격 인하가 자체 저장소, 프롬프트, 도구 구성 및 고유한 실패 사례에서 이 모델을 테스트한 뒤 실제 운영 애플리케이션을 이전할 유인을 제공한다. 2027년 1월 가격이 표준 수준으로 돌아간 뒤에도 경제적 이점이 지속될지는 모델이 실제 작업을 더 적은 시도로 안정적으로 완료할 수 있는 능력에 달려 있다.
뉴스 출처
VentureBeat Startups & Funding
원문 보기 ↗