製品

Gemini 3.5 Transcribe

最新の報道、解説、関連するテクノロジーストーリーを確認できます。

最新の報道

CN
Google،リアルタイム音声アプリ構築向けにGeminiの新モデルを発表

Google،リアルタイム音声アプリ構築向けにGeminiの新モデルを発表

Googleは、Gemini APIとGoogle AI Studioを通じて、Gemini 3.8 Live、Gemini 3.8 Live Extended Thinking、Gemini 3.5 Transcribeを開発者向けに提供開始した。これらのモデルは、会話を追跡してタスクを実行できる音声エージェントの構築に加え、85以上の言語で低い誤り率による音声テキスト変換を対象としている。

CN
Google、8月のAIアップデートの成果を紹介:新モデルとGeminiの拡大

Google、8月のAIアップデートの成果を紹介:新モデルとGeminiの拡大

Googleは、2026年8月に発表したAIアップデートの数々を紹介した。Gemini 3.7 FlashやGemini 3.5 Transcribeから、Pixel 11デバイスや検索・生産性向けツールへのGeminiの統合までが含まれる。同社によると、Geminiアプリの月間ユーザー数は10億人を超え、利用分野はプログラミング、教育、メディア生成、気象予測にまで広がっている。

CN
Google、複数言語のリアルタイム音声文字起こし向けにGemini 3.5 Transcribeをリリース

Google、複数言語のリアルタイム音声文字起こし向けにGemini 3.5 Transcribeをリリース

GoogleはGemini 3.5 Transcribeを発表した。これは、リアルタイムの文字起こしや録音ファイルを対象とする音声テキスト変換モデルで、音声周波数の処理、テキストの整形、話者認識に対応する。Gemini APIおよびGoogleの開発者・企業向けプラットフォームを通じてパブリックプレビューで提供され、Googleのアプリケーションにも段階的に統合される。