公司

DeepSeek

关注最新报道、解读和相关科技故事。

最新报道

CN
Anthropic发现Claude模型被用于开发常规武器以及开展影响行动和欺诈

Anthropic发现Claude模型被用于开发常规武器以及开展影响行动和欺诈

Anthropic表示,2025年12月至2026年8月期间,Claude模型被用于开发常规武器软件,以及开展间谍、影响、监控和欺诈行动,此外还被用于未经授权仿制人工智能模型的尝试。该公司称已停用与这些活动有关的账户,并与公共和私营机构共享了相关信息。

CN
DeepSeek推出V4.1 Flash,作为新架构系列的首个模型

DeepSeek推出V4.1 Flash,作为新架构系列的首个模型

DeepSeek推出了多模态V4.1 Flash模型,并称其在性能、速度和成本方面优于V4 Pro,同时开始逐步将部分此前模型的请求转交给该模型。此次发布还伴随着API价格下调,以及公司未来扩大这一架构的计划。

CN
美国机构指控六家中国公司从先进人工智能模型中提取数十亿个令牌

美国机构指控六家中国公司从先进人工智能模型中提取数十亿个令牌

CISA、NSA和FBI表示,六家中国人工智能公司自2024年底以来,通过数十亿个令牌和数百万次请求,对美国先进模型的输出实施了大规模提取行动。这些机构建议加强对API滥用的监测,并在企业之间共享相关行动的指标。

CN
推动本地语言模型崛起的三个因素:模型、硬件和软件的成熟

推动本地语言模型崛起的三个因素:模型、硬件和软件的成熟

ITmedia认为,人们日益关注在本地运行大型语言模型,并不仅仅是因为对依赖云服务的担忧,更是因为三个要素日趋成熟:开放权重模型、硬件以及软件。该系列第一部分聚焦于模型的发展,其中DeepSeek、Qwen及其他中国模型日益受到关注。

CN
Anthropic推出Claude Fable 5.1和Mythos 5.1,降低代理成本并加强模型保护

Anthropic推出Claude Fable 5.1和Mythos 5.1,降低代理成本并加强模型保护

Anthropic推出Claude Fable 5.1和Claude Mythos 5.1,用于编程、科学研究和长期任务,同时将缓存读取成本降低75%,并向通过专业验证项目的用户开放Mythos版本。该公司还对API账户实施了新限制,以应对模型蒸馏攻击。