最新の報道、解説、関連するテクノロジーストーリーを確認できます。
GoogleはGemini 3.5 Transcribeを発表した。これは、リアルタイムの文字起こしや録音ファイルを対象とする音声テキスト変換モデルで、音声周波数の処理、テキストの整形、話者認識に対応する。Gemini APIおよびGoogleの開発者・企業向けプラットフォームを通じてパブリックプレビューで提供され、Googleのアプリケーションにも段階的に統合される。