Официальная версия DeepSeek-V4-Flash, представляющая собой легковесную модель с 304 миллиардами параметров, была выпущена компанией DeepSeek 2 августа. Эта версия демонстрирует значительное превосходство над предварительной версией V4-Pro после минимальной донастройки и достигает уровня производительности, сравнимого с Claude Opus-4.8.
Веса модели были открыты для сообщества, и она немедленно заняла второе место в трендах HuggingFace, уступая лишь Kimi K3. Согласно бенчмаркам сообщества, модель показала показатель производительности 82.7 при стоимости всего 0.14 доллара США за миллион входных токенов и 0.28 доллара США за миллион выходных токенов, что обеспечивает соотношение цены и качества, значительно лучше, чем у ведущих закрытых моделей.
Независимое тестирование на платформе VulcanBench вывело DeepSeek-V4-Flash на первое место, обойдя Claude Fable 5. Этот релиз получил широкое признание в отрасли как «третий момент DeepSeek», следуя за DeepSeek-R1, который спровоцировал первый глобальный пересмотр цен на ИИ в январе 2025 года, а также циклом выпуска K3, изменившим ландшафт открытых весов.
Официальная версия V4-Flash была проанализирована с использованием новой структуры DeepSeek Harness — инструментария, разработанного для структурированной оценки задач программной инженерии агентов. Фреймворк Harness предоставляет стандартизированные интерфейсы для проверки следования контракту инструмента, связывания доказательств с выводами и рабочих процессов верификации, что указывает на расширение деятельности DeepSeek за пределы простого выпуска моделей в сферу инфраструктуры ИИ-кодирования.
Методология тестирования, использованная для подтверждения производительности V4-Flash, также базировалась на DeepSeek Harness, что говорит о разработке компанией слоя оркестрации агентов и оценки, который мог бы лечь в основу будущего продукта DeepSeek Code. Рынок ИИ-кодирования может претерпеть фундаментальные изменения, если DeepSeek объединит возможности модели класса V4 с открытым фреймворком оценки и агрессивным ценообразованием.
Кроме того, релиз подтвердил, что официальная версия DeepSeek-V4-Pro находится в разработке. Учитывая, что легковесный вариант Flash уже приближается к производительности передовых закрытых систем, ожидается, что полная модель Pro значительно повысит показатели возможностей. DeepSeek пока не объявила сроков выпуска официальной версии V4-Pro. Компания продолжает свою стратегию открытия весов при сохранении конкурентоспособного ценообразования, что сделало DeepSeek ориентиром для китайской экосистемы ИИ с открытым исходным кодом и ценовым якорем на мировом рынке API.
Этот третий момент DeepSeek отражает ускоряющийся темп выпуска китайских моделей с открытыми весами. Kimi K3 с 2.8 триллионами параметров устанавливает потолок масштаба для открытого исходного кода, MiniMax H3 представил генерацию с полным модальным функционалом по цене в треть от конкурентов, а теперь DeepSeek-V4-Flash демонстрирует, что модель с 304 миллиардами параметров, прошедшая дисциплинированное обучение, способна приблизиться к передовой производительности. Схождение открытых весов, инструментов Harness и агрессивного ценообразования усиливает конкурентное давление на поставщиков закрытых решений и меняет подход разработчиков к выбору поставщиков моделей. Официальная версия DeepSeek-V4-Flash с открытыми весами и фреймворком Harness может ознаменовать переход DeepSeek от исследовательской лаборатории к полноценному игроку в сфере ИИ-инфраструктуры, при этом ИИ-кодирование позиционируется как следующее поле битвы, где сходятся возможности модели, инфраструктура оценки и пользовательский опыт разработчика.