人工智能

Anthropic和OpenAI推出成本更低且在编程与安全方面有所改进的人工智能模型

Anthropic宣布推出Opus 5.5模型,OpenAI则公布GPT-6 Sol和GPT-6 Luna,三者共同聚焦于降低使用成本、改进编程能力并遵守安全控制措施。比较结果和外部评估标准提案仍需要独立验证。

2026-09-23
1 分钟阅读
78 浏览量
certi.news
Anthropic和OpenAI推出成本更低且在编程与安全方面有所改进的人工智能模型

Anthropic和OpenAI推出了面向专业用途的新模型,将性能提升与降低模型运行成本结合起来。此举正值模型在编程和企业任务中的经济效率与可靠性日益重要之际,同时先进模型的安全问题仍在持续引发争议。

Opus 5.5聚焦复杂任务

Anthropic公布了Opus 5.5模型。该公司表示,该模型在处理复杂任务、发现和修复软件缺陷、分析财务数据以及执行业务任务方面有所改进。该公司测试显示,在Terminal-Bench 4.0和FrontierCode v1.1 (Main)两项测试的代理编程任务中,该模型优于GPT-6 Astra。

Anthropic表示,该模型生成的文本更加清晰,与此前模型相比,尝试绕过边界和控制措施的倾向降低了85%。该公司还将输入每百万令牌的价格降至4美元,输出每百万令牌的价格降至20美元;Opus 5的相应价格分别为5美元和25美元。

OpenAI提供三种不同的成本水平

OpenAI推出了GPT-6 Sol和GPT-6 Luna两种模型,并在专业工作、编程和计算机使用方面进行了改进。该公司表示,与GPT-5.6模型的促销价格相比,这两种模型的成本最高降低了50%。

GPT-6 Sol的输入价格为每百万令牌2美元,输出价格为10美元。GPT-6 Luna的输入价格为每百万令牌10美分,输出价格为50美分。OpenAI表示,GPT-6 Sol的错误数量约为此前模型的一半,同时在编程方面达到了与Fable 5.1相当的性能,但成本更低。

改进还包括更清晰的沟通能力以及对临时存储指令上下文的支持,这使得模型能够重复利用更多上下文并加快响应速度。

实际会发生哪些变化?

新价格为开发者和企业在重复性任务或需要大量调用的任务中使用模型提供了更大空间,而能力更强的模型则面向编程、分析和代理执行工作。不过,关于性能优势、准确性和安全性的相关数据来自企业自身的测试,因此仅凭这些数据无法证明模型在所有使用场景或环境中都具有普遍优势。

安全性和可用性改进

OpenAI表示,GPT-6模型在提供编程任务结果方面更不容易给出错误信息,并且在接收不安全指令时,更倾向于拒绝绕过防护措施的尝试。两家公司正在提出相关标准,供外部评估机构用于衡量模型的发展和安全性,但这些提案是否会转变为统一标准,目前尚不清楚。

Opus 5.5可通过Claude使用,也可通过Amazon Web Services、Google Cloud和Microsoft Azure使用。GPT-6 Sol和GPT-6 Luna可通过ChatGPT Work和Codex向Plus、Pro、Business及Enterprise套餐客户提供,而免费套餐用户和Go订阅者只能通过该公司的桌面应用使用GPT-6 Luna。

新闻来源
AITnews Arabic
查看原始来源 ↗
c
作者

certi.news

同一分类

你可能还喜欢

查看所有新闻