DeepSeek V4-Flash-0731: как 76-кратная разница в цене меняет экономику агентных задач
DeepSeek V4-Flash-0731 вышла в публичную бета-версию API 31 июля 2026 года с архитектурой MoE, контекстным окном 1M+ токенов и ценой ввода $0,14 за 1M токенов. При типичной агентной нагрузке модель обходится в $0,0096 за запуск против $0,7324 у Claude Opus 4.8, но уступает в задачах с vision и comp…
DeepSeek V4-Flash-0731: модель, бенчмарки, цены и границы применимости
DeepSeek обновила V4-Flash-0731 до статуса публичной бета-версии API 31 июля 2026 года. Модель сохранила архитектуру MoE с 284 млрд общих параметров и 13 млрд активных на токен, контекстное окно 1 048 576 токенов и максимальный вывод 384K токенов. Теперь она доступна в официальном API без миграции для пользователей, уже использующих deepseek-v4-flash.
Что показали бенчмарки
DeepSeek заявляет о значительном росте на ключевых тестах:
- DeepSWE: с 7,3 до 54,4 (+7,4 раза),
- TerminalBench 2.1: с 61,8 до 82,7,
- AutomationBench (Public): с 10,8 до 25,1,
- Cybergym: с 38,7 до 76,7.
На остальных бенчмарках (Agents' Last Exam, Toolathlon-Verified, NL2Repo) прирост скромнее, но модель стабильно приближается к Opus 4.8. Медианное качество составляет 92% от лидера, с разбросом от 78% (NL2Repo) до 98% (TerminalBench 2.1).
О чём не говорят цифры
DeepSeek тестировала модель на собственном «upcoming» harness с минимальными параметрами (topp=0.95, temperature=1.0). Условия тестирования Opus 4.8 не опубликованы, поэтому сравнение может быть неравным. Внутренние бенчмарки (DSBench-FullStack, DSBench-Hard) не включены в публичные отчёты.
Цена: где выигрыш очевиден
Стоимость на 1 августа 2026 года:
- DeepSeek V4 Flash:
- Ввод: $0,14 за 1M токенов,
- Вывод: $0,28 за 1M токенов,
- Кеширование: $0,0028 за 1M токенов (2% от ввода).
- Claude Opus 4.8:
- Ввод: $5,00 за 1M токенов,
- Вывод: $25,00 за 1M токенов,
- Кеширование: $0,50 за 1M токенов (10% от ввода).
При типичной агентной нагрузке (20 шагов, 1M токенов ввода, 300K токенов вывода, 90% кэш-хитов) DeepSeek обходится в $0,0096 за запуск против $0,7324 у Anthropic. Разрыв в 76 раз.
Но кэширование не бесплатное. DeepSeek анонсировала двойные тарифы в пиковые часы (9:00–12:00 и 14:00–18:00 по Пекину), хотя дата вступления не названа. Пока не ясно, как это повлияет на реальные нагрузки.
Где модель проигрывает
У V4-Flash-0731 есть два принципиальных ограничения:
- Только текст: модель не поддерживает vision (изображения, файлы) и computer use (работа с интерфейсами ПК). Для задач с экранами, графиками или вёрсткой Opus 4.8 остаётся единственным выбором.
- Слабые места в бенчмарках: на NL2Repo (генерация изменений в репозиториях по текстовому описанию) результат всего 78% от Opus 4.8. В 10–20% случаев сгенерированный код требует ручной доработки, что съедает часть экономии.
Что это меняет на практике
Для команд, работающих с текстовыми данными и длинными контекстами, V4-Flash-0731 становится экономически обоснованной заменой Opus 4.8. Пример:
- DevOps-команда автоматизирует рефакторинг в 50 репозиториях. Каждый агентный запуск включает загрузку репозитория (1M токенов ввода), генерацию изменений (300K токенов вывода) и 20 шагов с кэш-хитами.
- На Opus 4.8: ~$0,73 за запуск.
- На DeepSeek: ~$0,01 за запуск.
Но часть сэкономленных средств уходит на правку некорректных изменений (15% случаев).
Что дальше
DeepSeek обещает выход V4-Pro «как можно скорее» (ожидается в начале августа 2026 года). Пока что V4-Flash-0731 — это модель для массового применения в текстовых задачах с низкой ценой и высокими лимитами. Если ваш пайплайн завязан на текстовые данные и вы готовы мириться с ручными доработками в 10–20% случаев, DeepSeek уже сегодня может сэкономить сотни долларов в месяц. Если нужна поддержка изображений или работа с интерфейсами — пока лучше остаться на Opus 4.8.