DeepSeek V4 вышла в релиз и впервые считает деньги по часам
DeepSeek перевела V4 из превью в GA: 1M контекста стандартом, вывод от $0,87 за млн токенов и первая в индустрии тарификация по времени суток. Разбираем детали.

«Убийца цен» впервые поставил счётчик на собственные вычисления. 19 июля DeepSeek перевела V4 из трёхмесячного превью в общедоступный релиз — и главной новостью GA оказалась не модель, а тарифная сетка: DeepSeek первой в индустрии ввела цены, зависящие от времени суток.
Сама V4 знакома рынку с 24 апреля, когда вышла превью-версией сразу с открытыми весами. Линейка из двух моделей осталась прежней: флагманская V4-Pro и лёгкая V4-Flash. К релизу компания докрутила агентные задачи, математику и кодогенерацию, а миллион токенов контекста стал стандартом для всей линейки. Старые эндпоинты deepseek-chat и deepseek-reasoner доживают последние дни — их отключат 24 июля.
Что внутри
| Параметр | V4-Pro | V4-Flash |
|---|---|---|
| Всего параметров (MoE) | 1,6 трлн | 284 млрд |
| Активных на токен | 49 млрд | 13 млрд |
| Контекст | 1M токенов | 1M токенов |
| Макс. вывод | 384K | 384K |
| Режимы | Thinking / Non-Thinking | Thinking / Non-Thinking |
Архитектурно V4 — это MoE с фирменным разреженным вниманием DSA и потокенным сжатием: по сравнению с V3 параметры выросли в 2,4 раза, контекст — в 8 раз, а стоимость инференса, по независимым оценкам, упала на порядок. Веса обеих моделей лежат на Hugging Face под MIT, API совместим и с OpenAI, и с Anthropic-протоколом — V4 напрямую подключается к Claude Code. Отдельный штрих к геополитике: превью было оптимизировано под Huawei Ascend, а не Nvidia, и, по данным Reuters, DeepSeek уже разрабатывает собственный инференс-чип.
Тариф «пик — не пик»
Теперь главное. В пиковые часы — с 9:00 до 12:00 и с 14:00 до 18:00 по Пекину — вывод стоит вдвое дороже базовой ставки:
| Модель | Ввод (cache miss) | Ввод (cache hit) | Вывод не в пик | Вывод в пик |
|---|---|---|---|---|
| V4-Pro | $0,435 / 1M | $0,0036 / 1M | $0,87 / 1M | $1,74 / 1M |
| V4-Flash | $0,14 / 1M | $0,0028 / 1M | $0,28 / 1M | $0,56 / 1M |
Даже в пик это демпинг: вывод Fable 5 стоит $50 за миллион токенов — в 29–57 раз дороже V4-Pro в зависимости от времени суток, GPT-5.5 — $30, Opus 4.8 — $25. А кеш-хит у Pro в 138 раз дешевле кеш-хита Opus 4.8. Агентным командам, которые жгут токены строго в рабочие часы, придётся пересчитать бюджеты, зато ночные батчи и кеширование делают V4 практически бесплатной.
Реакция сообщества на новшество показательная: «легендарный убийца цен впервые поставил счётчик на свои вычисления». Если модель, у которой инференс и так стоил копейки, начинает выравнивать нагрузку тарифами — значит, спрос упирается в железо. На фоне паузы подписок у Moonshot это выглядит как симптом всей китайской индустрии.
Сильна в коде, слаба в марафоне
По бенчмаркам превью-версии (независимых замеров GA пока нет) V4-Pro-Max набирает 80,6% на SWE-bench Verified — лучший результат среди открытых моделей, вровень с Gemini 3.1 Pro, хотя и далеко от 95% у Fable 5. Исследователь-математик в треде на Hacker News описывал доказательства уровня PhD от V4 Pro как «очень впечатляющие, почти полные» и называл модель «огромным шагом вперёд для open-weight».
Есть и тревожный звонок: на contamination-free бенчмарке DeepSWE у V4-Pro всего 8% против 70% у GPT-5.5 — аудиторы yage.ai трактуют это как реальную слабость в длинных агентных задачах, а не артефакт замера. Разработчики в сети сходятся на похожем: уровень близок к Opus 4.8, но на ту же задачу V4 нужно больше итераций, чем Fable 5, и Kimi K3 она, скорее всего, не догонит. Зато будет заметно дешевле — а это ровно та ниша, которую DeepSeek выбрала с самого начала.
GA-релиз лёг в плотную обойму китайских анонсов: Kimi K3 на 2,8 трлн 16 июля, превью Qwen3.8 на 2,4 трлн 19-го, теперь V4. По свежей оценке британского AISI, открытые модели отстают от закрытого фронтира уже лишь на 4–7 месяцев — ещё весной разрыв оценивали в 6–10. DeepSeek завершает свой анонс фразой «добро пожаловать в эру экономичного контекста в 1M токенов» — и, судя по ценам конкурентов, эта эра пока наступает только у китайских лабораторий.


