Google宣布推出Gemini 3.7 Flash,这是Flash系列的最新模型,重点面向编程、智能代理和复杂工作流程。该公司表示,新模型在软件工程、网页开发和知识任务方面实现了显著改进,并且距离Gemini 3.6 Flash发布仅三周。这些改进源于开发者反馈和算法创新,Google称这些创新也将使未来的模型受益。
Gemini 3.7 Flash的初始价格为每百万输入令牌0.75美元、每百万输出令牌3.75美元,持续至2026年底。自2027年1月1日起,价格将上涨至每百万输入令牌1.50美元、每百万输出令牌7.50美元。
编程与网页开发方面的改进
据Google称,新模型在调试和问题解决等编程任务上取得了相较Gemini 3.6 Flash的进步,首次尝试的准确率更高,生成可用于生产环境的代码的能力也更强。在公司提到的测试中,Gemini 3.7 Flash在FrontierCode 1.1 Main中得分为43.6%,而前代模型为34.4%;在DeepSWE v1.1中则为65.3%,而前代模型为49.0%。
在网页开发方面,该模型能够使用更少的提示创建更易用的界面和功能完整的应用。在用户界面生成任务中,无论参考对象是屏幕截图、图像还是完整的设计系统,模型都表现出更高的参考设计遵循度。该模型在Arena.ai旗下WebDev Arena的Elo评测中获得1588分,而Gemini 3.6 Flash为1538分。
更出色的知识与工作流程性能
Google表示,Gemini 3.7 Flash在金融、法律和生命科学等知识密集型领域提供了更好的推理能力和准确率。在用于处理复杂文档的GDP.pdf测试中,该模型得分为34.0%,而前代模型为22.0%。在AutomationBench中,模型得分为30.4%,而前代模型为17.0%;该评测用于衡量完成现实业务任务的能力。
在开发者体验方面,该公司表示,该模型能够更好地适应障碍,并在需要时请求澄清意图,同时更准确地遵循指令。它还会在多步骤规划和工具调用方面投入更多精力,这可能减少工程工作流程中对人工监督和重复尝试的需求。
可用性及其在Gemini Spark中的使用
Gemini Spark已开始使用Gemini 3.7 Flash,该服务面向160多个国家和地区的Google AI Pro与Ultra订阅者提供。Google此前在I/O大会上介绍Spark时,将其称为一种全天候运行、根据用户指示执行操作的个人AI代理。据该公司称,模型更新有助于Spark更高效地完成知识工作,同时改进Google Workspace应用工具的使用,以及复杂多技能任务的输出准确性。
开发者可以通过Google Antigravity,或通过Google AI Studio和Android Studio中的Gemini API体验该模型;企业则可以通过Gemini Enterprise Agent Platform和Gemini Enterprise应用使用该模型。个人用户可在受支持国家和地区的Google AI Pro与Ultra订阅者所使用的Gemini应用中,通过Spark访问该模型。
安全控制
Gemini 3.7 Flash推出时包含针对化学、生物、放射性和核领域滥用,以及网络滥用的防护控制更新;Google将继续改进这些控制措施的覆盖范围和稳健性。该公司表示,更多详细信息请参阅模型卡。