DeepSeek V4 Pro 0813: где модель выигрывает по цене, а где проигрывает по возможностям
DeepSeek V4 Pro 0813 дешевле конкурентов в 11–34 раза, но не поддерживает заполнение пропусков кода в режиме рассуждений по умолчанию. Модель подходит для задач с длинным контекстом, но требует ручного переключения режимов и не бьёт рекорды по качеству.
DeepSeek V4 Pro 0813: дешевле, но не лучше
12 августа 2026 года DeepSeek выпустила V4 Pro 0813 — без анонсов, без пресс-релизов, только обновлённая API-документация. Такой подход не случаен: компания смещает фокус с громких заявлений на ценовую политику и доступность.
Что скрывается за гибридным вниманием
V4 Pro 0813 — MoE-модель с 1,6 трлн параметров, но при обработке токена активируются только 49 млрд. Контекстное окно — 1 млн токенов, максимальный вывод — 384 тыс. токенов. В основе лежит гибридный механизм внимания: Compressed Sparse Attention и Heavily Compressed Attention.
Модель работает в двух режимах:
- Рассуждения — включён по умолчанию, дороже и медленнее, но подходит для задач, где важна детализация.
- Не-рассуждательный — быстрее, но не поддерживает FIM Completion (заполнение пропусков кода). Если разработчик не отключит режим вручную, модель проигнорирует запрос на анализ пропусков и вернёт обычный ответ.
Цена как оружие: дешевле в 11–34 раза
Главное отличие V4 Pro 0813 от конкурентов — цены.
- Входные токены: $0,435 за 1 млн (кеш-попадание: $0,003625; в пиковые часы: до $0,44).
- Выходные токены: $0,87 за 1 млн (кеш-попадание: $0,007; в пиковые часы: до $0,88).
- Лимит запросов: 500 одновременных на аккаунт (у V4 Flash — 2500).
Для сравнения, Grok 4.6 от xAI предлагает входные токены до 200 тыс. по $2/1M, свыше — $4/1M, выходные — $6 или $12/1M. Claude Fable 5 упоминается как эталон в сравнениях, но без раскрытия методики и бенчмарков.
DeepSeek предупреждает о предстоящем росте цен, что выглядит как тактика давления на конкурентов (OpenAI, Anthropic) в преддверии IPO.
Бенчмарки: рост на бумаге
По данным DeepSeek, результаты выросли:
- Terminal-Bench 2.1: с 72,1% до 87,9%.
- CyberGym (кибербезопасность): с 52,7% до 83,3%.
- DeepSWE (программирование): с 12,8% до 62,7%.
- NL2Repo: 61,5% (рост на 49,9 п.п. с июля).
Но без независимых подтверждений эти цифры вызывают вопросы. В метаданрах Artificial Analysis значится 284 млрд параметров для V4 Pro — это характеристика V4 Flash, а не Pro.
Где модель спотыкается: микро-сцена
Разработчик пытается провести код-ревью пяти файлов в репозитории:
- Включается дефолтный режим рассуждений. Модель генерирует ответ, но пропускает несоответствие в валидации поля
user_id. - Приходится вручную переключаться в не-рассуждательный режим, чтобы воспользоваться FIM Completion.
- Но FIM Completion не работает в режиме рассуждений, и модель возвращает обычный ответ без анализа пропусков.
- Итог: задача решается, но ценой дополнительных токенов, времени и ручной работы.
Другое ограничение — лимит в 500 одновременных запросов. Для увеличения лимита требуется отдельный запрос.
Когда V4 Pro 0813 действительно выгодна
Модель не бьёт рекорды по качеству, но выигрывает по цене для задач с длинным контекстом и агентных систем.
Пример: анализ 300-страничного документа. V4 Pro 0813 с контекстом в 1 млн токенов значительно дешевле конкурентов, даже если качество ответа чуть ниже. Это же касается автоматизации рабочих процессов, где важна скорость и стоимость, а не идеальная точность.
Но для сложных рассуждений (например, юридический анализ или сложные математические задачи) модель уступает конкурентам. Здесь Grok 4.6 или Claude Fable 5 могут показать лучшие результаты, пусть и за более высокую цену.
Что не заменит V4 Pro 0813
У модели есть два принципиальных ограничения:
- Режим рассуждений по умолчанию увеличивает латентность и стоимость. Для задач, где важна скорость, приходится вручную переключаться в не-рассуждательный режим — а это дополнительные токены и время.
- FIM Completion работает только в не-рассуждательном режиме. Для разработчиков это означает, что модель не подходит для задач, где критично заполнение пропусков кода или исправление ошибок в больших файлах.
Итог: не прорыв, но сдвиг
DeepSeek V4 Pro 0813 не переворачивает рынок. Она не бьёт рекорды по качеству, а её бенчмарки требуют независимой проверки. Но модель резко снижает порог входа для разработчиков и компаний, которым нужны длинные контексты и агентные системы. Цена здесь — главный триггер, а не инновации.
DeepSeek использует тактику тихого захвата рынка: сначала занижает цены, чтобы привлечь пользователей, а позже поднимет тарифы. Если разработчики привыкнут к модели сейчас, они будут готовы платить больше завтра.
Если ваша задача требует FIM Completion или высокой скорости — V4 Pro 0813 не подходит. Переключитесь на V4 Flash или конкурентов.