Qwen 4 анонсирован: четыре модели и ни одной цифры
Alibaba показала Qwen 4 Max, Plus, Flash и 27B на конференции Apsara — без дат, цен и бенчмарков. Зато с планами на модели в 5-10 триллионов параметров.

Ханчжоу, 22 сентября, сцена конференции Apsara. Команда Qwen впервые произносит вслух четыре новых имени: Qwen 4 Max, Qwen 4 Plus, Qwen 4 Flash и Qwen 4 27B. Зал аплодирует, тред на r/LocalLLaMA взлетает до 1355 апвоутов и 351 комментария, отдельный пост про Qwen4-27B собирает ещё 940. А теперь самое интересное: ни у одной из четырёх моделей нет ни даты релиза, ни цены, ни контекстного окна, ни единого бенчмарка. Модели ещё тренируются.
Alibaba показала финишную ленту до того, как перерезала её. И всё же этот анонс стоит разобрать внимательно — в нём больше содержания, чем кажется на первый взгляд.
Что именно показали
Структура семейства повторяет привычную иерархию Qwen: Max — флагман, нацеленный на конкуренцию с топовыми моделями других лабораторий; Plus — сбалансированный средний уровень, исторически самый мультимодальный; Flash — быстрый и дешёвый для высоконагруженных сценариев; 27B — открытые веса для локального запуска. По словам представителей команды, семейство построено на архитектуре нового поколения и заточено в первую очередь под агентные задачи и работу с инструментами, а не под чат.
| Модель | Позиционирование | Публичные характеристики |
|---|---|---|
| Qwen 4 Max | Флагман против топов рынка | Нет |
| Qwen 4 Plus | Средний уровень, мультимодальность | Нет |
| Qwen 4 Flash | Низкая задержка, большие объёмы | Нет |
| Qwen 4 27B | Открытые веса, локальный запуск | Нет |
Для сообщества локальных моделей главная строчка здесь — последняя. 27B — единственный класс в семействе, который стабильно выходит под открытыми весами, и опыт поколения Qwen 3.8 показывает, что происходит дальше: за считанные дни после публикации весов появляются MLX-конверсии, квантизации и файнтюны. Анонс 27B — это фактически обещание целой экосистемы.
Архитектуру уже можно потрогать
Самое ценное в анонсе — то, что часть архитектуры Qwen 4 уже лежит в открытом доступе под другим именем. Qwen3.8-Flash-Next, открытый в конце августа, прямо назван в модельной карточке превью архитектуры следующего поколения: 125 миллиардов основных параметров плюс 51 миллиард n-gram эмбеддингов, около 6 миллиардов активных на шаг инференса, нативный контекст 262 тысячи токенов с расширением к миллиону.
Внутри — три ключевые техники: разреженное внимание QSA, гейтированные остаточные связи и те самые n-gram эмбеддинги, отдельное хранилище параметров, к которому модель обращается по запросу вместо плотных вычислений. Alibaba заявляла, что обучение Flash-Next обошлось примерно на 90% дешевле, чем у Qwen3.7-Plus. Если Qwen 4 наследует этот дизайн, следствие будет не архитектурным, а экономическим: семейство, которое учится в десять раз дешевле, можно и продавать агрессивно дешевле. А агрессивные цены от Alibaba — главный двигатель экономики открытых моделей последних двух лет.
Откуда взялись «10 триллионов параметров»
В заголовках вокруг анонса гуляет цифра «5-10 триллионов параметров» — и её важно поставить на место. Это не характеристика Qwen 4. Цель озвучил CEO Alibaba Эдди Ву, и относится она к следующим поколениям — Qwen 4.5 и Qwen 5, о чём пишет Reuters. Ву вообще не скупился на масштаб: сравнил эпоху AI с промышленной революцией и предсказал, что машины со временем будут генерировать «в тысячу с лишним раз больше мышления, чем всё человечество вместе», против менее чем 3% сегодня.
Под такие модели нужно железо, которого у Alibaba пока нет. Поэтому вместе с роадмапом подразделение T-Head показало ускоритель Zhenwu V900: втрое быстрее предшественника M890, 216 ГБ памяти, 1200 ГБ/с межчиповой пропускной способности, масштабирование до кластеров в 500 тысяч чипов. Массовое производство — первый квартал 2027 года. То есть чип под Qwen 5 тоже пока существует только на слайдах. Рынок, впрочем, поверил: акции Alibaba выросли на 5,1% за сессию.
Что запускать, пока Qwen 4 тренируется
Реальная точка отсчёта для всей этой родословной — Qwen3.8-Max, доступный с 3 августа: MoE на 2,4 триллиона параметров с 95 миллиардами активных, миллион токенов контекста, $2 за миллион входных и $6 за миллион выходных токенов, веса опубликованы 12 августа. Именно его результаты Qwen 4 Max придётся перебивать — и это проверяемые опубликованные цифры, а не цель из презентации.
Итог анонса честнее всего сформулировать так: Qwen 4 — настоящий анонс, но не настоящий продукт. Роадмап подтверждён, архитектурное превью лежит на Hugging Face, стартовая планка известна. Не хватает только всего, что нужно для решения о миграции: цены, даты и хотя бы одного бенчмарка. Планировать переход стоит на Qwen3.8-Max — а на Qwen 4 переходить тогда, когда у него появится эндпоинт.


