GPT-5 без VPN

Aijora.ru — без ограничений

Попробовать бесплатно
Все новости
deepseekрелизapiценыкитай

DeepSeek V4 вышла в релиз и впервые считает деньги по часам

DeepSeek перевела V4 из превью в GA: 1M контекста стандартом, вывод от $0,87 за млн токенов и первая в индустрии тарификация по времени суток. Разбираем детали.

Влад МакаровВлад Макаровпроверил и опубликовал
6 мин чтения
DeepSeek V4 вышла в релиз и впервые считает деньги по часам

«Убийца цен» впервые поставил счётчик на собственные вычисления. 19 июля DeepSeek перевела V4 из трёхмесячного превью в общедоступный релиз — и главной новостью GA оказалась не модель, а тарифная сетка: DeepSeek первой в индустрии ввела цены, зависящие от времени суток.

Сама V4 знакома рынку с 24 апреля, когда вышла превью-версией сразу с открытыми весами. Линейка из двух моделей осталась прежней: флагманская V4-Pro и лёгкая V4-Flash. К релизу компания докрутила агентные задачи, математику и кодогенерацию, а миллион токенов контекста стал стандартом для всей линейки. Старые эндпоинты deepseek-chat и deepseek-reasoner доживают последние дни — их отключат 24 июля.

Что внутри

ПараметрV4-ProV4-Flash
Всего параметров (MoE)1,6 трлн284 млрд
Активных на токен49 млрд13 млрд
Контекст1M токенов1M токенов
Макс. вывод384K384K
РежимыThinking / Non-ThinkingThinking / Non-Thinking

Архитектурно V4 — это MoE с фирменным разреженным вниманием DSA и потокенным сжатием: по сравнению с V3 параметры выросли в 2,4 раза, контекст — в 8 раз, а стоимость инференса, по независимым оценкам, упала на порядок. Веса обеих моделей лежат на Hugging Face под MIT, API совместим и с OpenAI, и с Anthropic-протоколом — V4 напрямую подключается к Claude Code. Отдельный штрих к геополитике: превью было оптимизировано под Huawei Ascend, а не Nvidia, и, по данным Reuters, DeepSeek уже разрабатывает собственный инференс-чип.

Тариф «пик — не пик»

Теперь главное. В пиковые часы — с 9:00 до 12:00 и с 14:00 до 18:00 по Пекину — вывод стоит вдвое дороже базовой ставки:

МодельВвод (cache miss)Ввод (cache hit)Вывод не в пикВывод в пик
V4-Pro$0,435 / 1M$0,0036 / 1M$0,87 / 1M$1,74 / 1M
V4-Flash$0,14 / 1M$0,0028 / 1M$0,28 / 1M$0,56 / 1M

Даже в пик это демпинг: вывод Fable 5 стоит $50 за миллион токенов — в 29–57 раз дороже V4-Pro в зависимости от времени суток, GPT-5.5 — $30, Opus 4.8 — $25. А кеш-хит у Pro в 138 раз дешевле кеш-хита Opus 4.8. Агентным командам, которые жгут токены строго в рабочие часы, придётся пересчитать бюджеты, зато ночные батчи и кеширование делают V4 практически бесплатной.

Реакция сообщества на новшество показательная: «легендарный убийца цен впервые поставил счётчик на свои вычисления». Если модель, у которой инференс и так стоил копейки, начинает выравнивать нагрузку тарифами — значит, спрос упирается в железо. На фоне паузы подписок у Moonshot это выглядит как симптом всей китайской индустрии.

Сильна в коде, слаба в марафоне

По бенчмаркам превью-версии (независимых замеров GA пока нет) V4-Pro-Max набирает 80,6% на SWE-bench Verified — лучший результат среди открытых моделей, вровень с Gemini 3.1 Pro, хотя и далеко от 95% у Fable 5. Исследователь-математик в треде на Hacker News описывал доказательства уровня PhD от V4 Pro как «очень впечатляющие, почти полные» и называл модель «огромным шагом вперёд для open-weight».

Есть и тревожный звонок: на contamination-free бенчмарке DeepSWE у V4-Pro всего 8% против 70% у GPT-5.5 — аудиторы yage.ai трактуют это как реальную слабость в длинных агентных задачах, а не артефакт замера. Разработчики в сети сходятся на похожем: уровень близок к Opus 4.8, но на ту же задачу V4 нужно больше итераций, чем Fable 5, и Kimi K3 она, скорее всего, не догонит. Зато будет заметно дешевле — а это ровно та ниша, которую DeepSeek выбрала с самого начала.

GA-релиз лёг в плотную обойму китайских анонсов: Kimi K3 на 2,8 трлн 16 июля, превью Qwen3.8 на 2,4 трлн 19-го, теперь V4. По свежей оценке британского AISI, открытые модели отстают от закрытого фронтира уже лишь на 4–7 месяцев — ещё весной разрыв оценивали в 6–10. DeepSeek завершает свой анонс фразой «добро пожаловать в эру экономичного контекста в 1M токенов» — и, судя по ценам конкурентов, эта эра пока наступает только у китайских лабораторий.

Похожие новости

Листайте вниз

для загрузки следующей статьи