关注最新报道、解读和相关科技故事。
Google宣布通过Gemini API和Google AI Studio向开发者提供Gemini 3.8 Live、Gemini 3.8 Live Extended Thinking和Gemini 3.5 Transcribe。 这些模型旨在构建能够跟进对话并执行任务的语音代理,同时以较低错误率将超过85种语言的语音转换为文本。
Google 回顾了其在 2026 年 8 月宣布的一系列人工智能更新,从 Gemini 3.7 Flash 和 Gemini 3.5 Transcribe,到将 Gemini 集成到 Pixel 11 设备以及搜索和生产力工具中。该公司表示,Gemini 应用的月活跃用户已超过 10 亿,使用场景也扩展到编程、教育、媒体生成和天气预报等领域。
Google宣布推出Gemini 3.5 Transcribe,这是一款面向实时转写和录音文件的语音转文本模型,支持频率处理、文本格式化和说话人识别。该模型通过Gemini API以及Google面向开发者和企业的平台提供公开预览,并逐步集成到Google应用中。