최신 보도, 해설 및 관련 기술 스토리를 확인하세요.
Google은 Gemini API와 Google AI Studio를 통해 개발자에게 Gemini 3.8 Live, Gemini 3.8 Live Extended Thinking 및 Gemini 3.5 Transcribe를 제공한다고 발표했습니다. 이 모델들은 대화를 이어가고 작업을 수행할 수 있는 음성 에이전트 구축과 85개 이상의 언어에서 낮은 오류율로 음성을 텍스트로 변환하는 기능을 목표로 합니다.
Google은 2026년 8월 발표한 여러 인공지능 업데이트를 돌아보며 Gemini 3.7 Flash와 Gemini 3.5 Transcribe부터 Pixel 11 기기 및 검색·생산성 도구에 Gemini를 통합한 내용까지 소개했다. 회사에 따르면 Gemini 앱은 월간 사용자 10억 명을 넘어섰으며, 프로그래밍·교육·미디어 생성·기상 예측 등으로 활용 범위가 확대되고 있다.
Google은 실시간 전사와 녹음 파일을 대상으로 주파수 처리, 텍스트 서식 지정, 화자 인식을 지원하는 음성-텍스트 변환 모델 Gemini 3.5 Transcribe를 발표했다. 이 모델은 Gemini API와 Google의 개발자 및 기업용 플랫폼을 통해 공개 프리뷰로 제공되며, Google 애플리케이션에 단계적으로 통합된다.