Компания DeepSeek сделала свою модель V4 Pro общедоступной, представив релиз под названием DeepSeek-V4-Pro-0813 на своей странице с ценами. Флагманский уровень модели оснащен окном контекста объемом 1 миллион токенов и максимальным выводом в 384 тысячи токенов, по умолчанию используя режим мышления, но при этом предоставляя конечную точку без режима мышления для запросов, чувствительных к задержкам.
Сочетание ввода в 1 миллион токенов и вывода в 384 тысячи токенов позволяет в рамках одного обращения обрабатывать и генерировать значительно больший объем материала по сравнению с предыдущим поколением, что особенно актуально для работы с большими кодовыми базами, обширными корпусами документов и многоэтапными агентами.
DeepSeek также интегрировала функции, которые ожидают от нее большинство разработчиков агентов: структурированный вывод в формате JSON, поддержку вызовов инструментов, Responses API и совместимость с Anthropic-API. Кроме того, реализована бета-поддержка продолжения с префиксом разговора и завершения FIM, причем FIM ограничен режимом без мышления.
На уровне сервиса предлагаются конечные точки, совместимые как с OpenAI, так и с Anthropic, что дает командам, уже использующим любой из этих стандартов, возможность переключиться без необходимости перестраивать свою инфраструктуру.
Ценообразование отражает намеренное разделение уровней. Модель Pro стоит 0,025 юаня за миллион токенов при попадании в кэш, 3 юаня за промахи в кэше на входе и 6 юаней на выходе. В отличие от этого, модель Flash имеет цену 0,02, 1 и 2 юаня соответственно, что делает Pro примерно в три раза дороже Flash при промахах в кэше на входе и выходе.
Различия также подчеркиваются ограничениями параллелизма: Flash поддерживает 2500 одновременных запросов, тогда как Pro ограничен 500. Это соотношение указывает на более четкую структуру продукта для семейства V4. Flash ориентирован на высокочастотный трафик с высокой пропускной способностью, где доминирует стоимость, в то время как Pro концентрирует мощность на более тяжелых задачах рассуждения, кодировании с длинным контекстом и рабочих процессах агентов, где модель имеет больший запас производительности для использования.
При этом абсолютная цена Pro остается умеренной по стандартам передовых моделей, что позволяет DeepSeek компенсировать расходы после недавнего объявления о повышении цен, оставаясь при этом дешевле большинства зарубежных конкурентов. Таким образом, линейка V4 представляет собой двухдорожечное предложение: недорогой уровень Flash с высокой пропускной способностью для масштабирования и более мощный уровень Pro, нацеленный на задачи кодирования и использования агентов.


