Китайская компания DeepSeek запустила модель DeepSeek V4.1 Flash, которую представляет как самую компактную модель в семействе новой архитектуры, разработанной для повышения скорости вывода и расширения возможностей обработки задач, с перспективой дальнейшего масштабирования до более крупных моделей. Модель включает встроенное мультимодальное визуальное понимание, что позволяет ей работать с изображениями наряду с текстовыми задачами.
V4.1 Flash выходит после экспериментальной модели V4 Flash Vision Exp, которую DeepSeek представила в августе для поддержки визуальных входных данных. Однако компания утверждает, что в новой версии мультимодальные возможности стали неотъемлемой частью архитектуры, а не отдельным экспериментом в рамках прежней линейки моделей.
Более высокая производительность согласно тестам DeepSeek
Согласно результатам тестов, опубликованным DeepSeek, V4.1 Flash набрала 90,9 балла в GPQA Diamond, 90,6 — в Terminal-Bench 2.1 и 74,2 — в DeepSWE v1.1. Компания также объявила рейтинг модели 3471 в Codeforces.
DeepSeek утверждает, что модель превосходит DeepSeek V4 Pro по ряду показателей, включая производительность, стоимость, скорость и общее время, необходимое для выполнения задач. В материале не приводятся подробные цифры для сравнения цен или временных показателей, а указанные результаты опубликованы самой компанией, поэтому их следует рассматривать как заявления о производительности, требующие независимой проверки, прежде чем использовать их в качестве общего стандарта.
Изменение названий моделей и перенаправление запросов
С запуском V4.1 Flash DeepSeek прекратит предоставлять V4 Flash и V4 Flash Vision Exp. Старые названия моделей временно будут перенаправлять запросы на V4.1 Flash для сохранения совместимости с существующими приложениями. Разработчики, желающие получить доступ к новейшей модели Flash через API, могут использовать название модели deepseek-flash.
Компания также планирует постепенно вывести из эксплуатации V4 Pro. Начиная с 14 сентября в 12:00 по пекинскому времени, запросы, отправленные через deepseek-v4-pro, будут перенаправляться на V4.1 Flash до запуска V4.1 Pro, причём стоимость будет рассчитываться по тарифам V4.1 Flash. В материале не указана величина новых цен, однако отмечается, что с запуском модели DeepSeek снизила цены на API для линейки Flash.
Что меняется на практике?
Для разработчиков объявление означает не только добавление новой модели, но и реорганизацию способов доступа к моделям DeepSeek. Использование старых названий может привести к запуску V4.1 Flash вместо исходной модели, что важно учитывать при сравнении результатов или отслеживании стоимости и производительности в производственных приложениях. В то же время название deepseek-flash предоставляет способ доступа к последней версии категории Flash без привязки к конкретному названию версии.
Структура объявления также свидетельствует о том, что DeepSeek делает ставку на более быстрые и менее дорогие модели, сохраняя при этом уровень производительности, с которым компания рассчитывает конкурировать с более крупными моделями. Компания заявляет, что V4.1 Flash является младшим участником новой архитектуры, что оставляет возможность выпуска более крупных моделей, включая V4.1 Pro, в рамках того же семейства. Однако сроки выхода и характеристики этих версий в материале не уточняются.
Запуск происходит в период, когда, согласно сообщениям Reuters, базирующаяся в Ханчжоу DeepSeek начала подготовку к первичному публичному размещению акций на рынке STAR Шанхайской фондовой биржи. По данным источника, компания может намереваться использовать новое финансирование для развития вычислительной инфраструктуры, разработки моделей и удержания опытных сотрудников. В тексте не приводятся подтверждённые подробности о сроках или условиях размещения.