人工智能

Google推出Gemini 3.7 Flash,提升编程与智能代理能力

Google推出Gemini 3.7 Flash,称其为目前在编程和代理构建方面最强大的Flash系列模型,并改进了网页开发和知识工作流程,初始价格相当于原Gemini 3.6 Flash成本的一半。该模型面向开发者和企业提供,并已开始用于面向符合条件订阅者的Gemini Spark代理。

2026-08-13
1 分钟阅读
11 浏览量
فريق تحرير certi.news
Google推出Gemini 3.7 Flash,提升编程与智能代理能力

Google宣布推出Gemini 3.7 Flash,这是Flash系列的最新模型,重点面向编程、智能代理和复杂工作流程。该公司表示,新模型在软件工程、网页开发和知识任务方面实现了显著改进,并且距离Gemini 3.6 Flash发布仅三周。这些改进源于开发者反馈和算法创新,Google称这些创新也将使未来的模型受益。

Gemini 3.7 Flash的初始价格为每百万输入令牌0.75美元、每百万输出令牌3.75美元,持续至2026年底。自2027年1月1日起,价格将上涨至每百万输入令牌1.50美元、每百万输出令牌7.50美元。

编程与网页开发方面的改进

据Google称,新模型在调试和问题解决等编程任务上取得了相较Gemini 3.6 Flash的进步,首次尝试的准确率更高,生成可用于生产环境的代码的能力也更强。在公司提到的测试中,Gemini 3.7 Flash在FrontierCode 1.1 Main中得分为43.6%,而前代模型为34.4%;在DeepSWE v1.1中则为65.3%,而前代模型为49.0%。

在网页开发方面,该模型能够使用更少的提示创建更易用的界面和功能完整的应用。在用户界面生成任务中,无论参考对象是屏幕截图、图像还是完整的设计系统,模型都表现出更高的参考设计遵循度。该模型在Arena.ai旗下WebDev Arena的Elo评测中获得1588分,而Gemini 3.6 Flash为1538分。

更出色的知识与工作流程性能

Google表示,Gemini 3.7 Flash在金融、法律和生命科学等知识密集型领域提供了更好的推理能力和准确率。在用于处理复杂文档的GDP.pdf测试中,该模型得分为34.0%,而前代模型为22.0%。在AutomationBench中,模型得分为30.4%,而前代模型为17.0%;该评测用于衡量完成现实业务任务的能力。

在开发者体验方面,该公司表示,该模型能够更好地适应障碍,并在需要时请求澄清意图,同时更准确地遵循指令。它还会在多步骤规划和工具调用方面投入更多精力,这可能减少工程工作流程中对人工监督和重复尝试的需求。

可用性及其在Gemini Spark中的使用

Gemini Spark已开始使用Gemini 3.7 Flash,该服务面向160多个国家和地区的Google AI Pro与Ultra订阅者提供。Google此前在I/O大会上介绍Spark时,将其称为一种全天候运行、根据用户指示执行操作的个人AI代理。据该公司称,模型更新有助于Spark更高效地完成知识工作,同时改进Google Workspace应用工具的使用,以及复杂多技能任务的输出准确性。

开发者可以通过Google Antigravity,或通过Google AI Studio和Android Studio中的Gemini API体验该模型;企业则可以通过Gemini Enterprise Agent Platform和Gemini Enterprise应用使用该模型。个人用户可在受支持国家和地区的Google AI Pro与Ultra订阅者所使用的Gemini应用中,通过Spark访问该模型。

安全控制

Gemini 3.7 Flash推出时包含针对化学、生物、放射性和核领域滥用,以及网络滥用的防护控制更新;Google将继续改进这些控制措施的覆盖范围和稳健性。该公司表示,更多详细信息请参阅模型卡。

新闻来源
Google Official News
查看原始来源 ↗
ف
作者

فريق تحرير certi.news

同一分类

你可能还喜欢

查看所有新闻