中国公司DeepSeek推出了DeepSeek V4.1 Flash模型。该模型被定位为全新架构系列中规模最小的模型,旨在提升推理速度、增强任务处理能力,并可在未来扩展为更大的模型。该模型集成了多模态视觉理解能力,能够处理图像以及文本任务。
V4.1 Flash是在DeepSeek于8月推出、用于支持视觉输入的实验性模型V4 Flash Vision Exp之后发布的。不过,公司表示,在新版本中,多模态能力已经成为架构的原生组成部分,而不再是此前模型系列中的独立实验。
根据DeepSeek测试结果,性能更高
根据DeepSeek发布的测试结果,V4.1 Flash在GPQA Diamond中获得90.9分,在Terminal-Bench 2.1中获得90.6分,在DeepSWE v1.1中获得74.2分。公司还宣布该模型在Codeforces中的评级为3471。
DeepSeek表示,该模型在多项指标上超越DeepSeek V4 Pro,包括性能、成本、速度以及完成任务所需的总时间。材料没有提供价格或耗时方面的详细对比数据,而且上述结果由公司自行发布,因此在将其作为通用标准采用之前,应将其视为需要独立验证的性能声明。
更改模型名称并重新定向请求
随着V4.1 Flash的推出,DeepSeek将停止提供V4 Flash和V4 Flash Vision Exp。旧模型名称将在一段时间内暂时指向V4.1 Flash,以保持与现有应用的兼容性。希望通过API访问最新Flash模型的开发者,可以使用模型名称deepseek-flash。
公司还计划逐步停止使用V4 Pro。自9月14日北京时间12:00起,通过deepseek-v4-pro发送的请求将被转至V4.1 Flash,直至V4.1 Pro发布,费用将按照V4.1 Flash的定价计算。材料没有说明新的具体价格,但指出DeepSeek在发布该模型的同时下调了Flash系列API的价格。
实际会发生什么变化?
对开发者而言,此次公告不仅意味着新增一个模型,还包括对DeepSeek模型访问路径的重新组织。继续使用旧名称可能会运行V4.1 Flash,而不是原始模型;在生产应用中进行结果比较或监测成本和性能时,这是一个重要变化。另一方面,deepseek-flash这一名称提供了访问Flash系列最新版本的途径,无需绑定到特定版本名称。
公告的架构也显示出DeepSeek对更快、成本更低模型的重视,同时保持其面向更大规模模型的性能水平。公司表示,V4.1 Flash是新架构中规模最小的成员,这意味着未来可能会推出包括V4.1 Pro在内的更大模型,并将其纳入同一系列。不过,材料没有确定这些版本的发布时间和规格。
此次发布之际,路透社的报道显示,总部位于杭州的DeepSeek已开始为在上海证券交易所科创板进行首次公开募股做准备。据消息来源称,公司可能计划将新融资用于计算基础设施、模型开发以及留住有经验的员工。文本没有提供有关时间表或发行条件的确定细节。