Модель DeepSeek V4-Flash стала лидером еженедельного рейтинга OpenRouter, обработав 7,1 триллиона токенов. Кроме того, девять китайских моделей вошли в десятку мировых лидеров. Общее глобальное еженедельное использование токенов искусственного интеллекта превысило отметку в 56,8 триллиона.
Согласно данным OpenRouter, DeepSeek V4-Flash заняла первое место по объему вызовов моделей всего через четыре дня после запуска бета-версии публичного API 31 июля. За неделю с 28 июля по 3 августа модель обработала 7,1 триллиона токенов. Места с двух по пятый также заняли китайские продукты: Xiaomi MiMo-V2.5 с 5,4 триллиона токенов, Tencent Hy3 с 4,89 триллиона, DeepSeek V4-Pro с 3,1 триллиона и Zhipu GLM-5.2 с 2,87 триллиона. Модель DeepSeek V4-Flash 0731 самостоятельно поднялась на восьмое место, обработав 2,33 триллиона токенов. Только за 3 августа версия 0731 зарегистрировала 1,02 триллиона токенов, обогнав ранее доминировавшую версию 0423.
Общий мировой объем еженедельных вызовов моделей ИИ достиг 56,8 триллиона токенов. Еженедельный объем вызовов китайских моделей составил 28,13 триллиона, что превысило объемы США четырнадцатую неделю подряд. Китайские модели занимают девять из десяти лучших мест. Официальная версия V4-Flash использует ту же архитектуру, что и предварительная версия: MoE, 284 миллиарда общих параметров, из которых активировано 13 миллиардов, с контекстом в 1 миллион токенов. Изменения коснулись только пост-тренировки: официальная версия V4-Flash получила оценку 25,2 в тесте Agent ultimate, приближаясь к показателю Claude Opus-4.8 на уровне 25,7, что значительно выше, чем у предварительной версии V4-Pro, которая показала 15,8.
Ценообразование практически не имеет себе равных: 0,14 доллара США за миллион входных токенов и 0,28 доллара США за миллион выходных токенов. При взвешенном тестировании по задачам V4-Flash стоит 3 цента за задачу, Kimi K3 — 86 центов, GPT-5.6 Sol — 1,86 доллара США, а Claude Fable 5 — 3,15 доллара США. Эксплуатационные расходы составляют менее одного процента от флагманского продукта Anthropic Claude Fable 5. В социальной сети X разработчики писали, что Маск должен лично опробовать V4 Flash, сравнивая его с магией. Пользователи затем заметили, что Илон Маск действительно подписался на официальный аккаунт DeepSeek. Почти половина трафика DeepSeek поступает от разработчиков из США и Европы, и многие проекты автоматизации агентов переключили модели по умолчанию на DeepSeek. Основатели нескольких зарубежных стартапов в области ИИ публично отметили, что после полного перехода на DeepSeek ежемесячные затраты на инференс снизились на 60–85 процентов.
Отраслевой анализ указывает на то, что DeepSeek установила четкую границу на мировом рынке разработчиков. Эта граница представляет собой не просто порог производительности, а баланс между ценой и качеством. Модели, предлагающие схожий уровень возможностей, но имеющие значительно более высокую цену, будут постоянно терять средних разработчиков; продукты, которые слабее DeepSeek по производительности, но дороже, столкнутся с быстрым сужением своего пространства для выживания. OpenAI также ощутила давление: GPT-5.6 Luna снизила цены на 80 процентов в течение трех недель после выпуска. От публичной бета-версии API 31 июля до попадания в топ мирового объема вызовов 3 августа DeepSeek V4-Flash потребовалось меньше недели.