Google выпал из топ-15 — и ответил не флагманом, а рабочей лошадкой
Вирусный тред зафиксировал: в топ-15 llm-stats нет ни одной модели Google. Через сутки вышел Gemini 3.6 Flash — дешевле и экономнее, но не флагман.

20 июля пользователь r/LocalLLaMA выложил скриншот сводного рейтинга llm-stats.com с коротким наблюдением в заголовке: «Google полностью исчез из топ-15». Тред собрал больше тысячи апвоутов — и было отчего. В первой пятнадцатке не осталось ни одной модели Google: список делят между собой OpenAI, Anthropic, китайские Kimi K3, GLM-5.2, Qwen и ByteDance, а также Meta с Muse Spark. Компания, которая ещё зимой доминировала в аренах эпохой Gemini 3 Pro, выпала из таблицы целиком.
А ровно через сутки, 21 июля, Google ответила. Но ответ оказался неожиданным.
Что на самом деле в рейтинге
Сначала честная оговорка, без которой история превращается в кликбейт. Скриншот из треда — это композитный индекс llm-stats.com, где Google действительно отсутствует в топ-15. Но на самой arena.ai (бывшая LMArena, экс-LMSys) Google не испарился: в текстовой арене gemini-3-pro держит 10-е место. А вот где Google выбит начисто — это кодинг: в WebDev Arena в топ-10 нет ни одной его модели, там правят Kimi K3, Claude Fable 5, GPT-5.6 Sol и китайский GLM-5.2.
То есть картина не «Google рухнул везде», а «Google провалился в кодинге и сполз в общем зачёте». Для компании, которая годами задавала темп, это всё равно тревожный сигнал — просто менее апокалиптический, чем звучит заголовок.
Ответ, которого ждали, — но не тот
21 июля Google выпустила сразу три модели: Gemini 3.6 Flash, 3.5 Flash-Lite и специализированную 3.5 Flash Cyber для кибербезопасности. Флагманской 3.5 Pro среди них не было — её снова не показали.
Gemini 3.6 Flash — это «рабочая лошадка» для агентных нагрузок, и вся её презентация построена вокруг не рекордов, а экономики. Улучшения по бенчмаркам относительно 3.5 Flash есть, местами заметные:
| Бенчмарк | 3.5 Flash | 3.6 Flash |
|---|---|---|
| DeepSWE (кодинг) | 37% | 49% |
| MLE-Bench | 49,7% | 63,9% |
| OSWorld-Verified | 78,4% | 83,0% |
| Цена (вход / выход за 1M) | $1,50 / $9,00 | $1,50 / $7,50 |
Помимо снижения цены на выходные токены, модель тратит их на 17% меньше при той же задаче (по индексу Artificial Analysis), а на кодинговом DeepSWE — до 65% меньше. Google прямо утверждает: в пересчёте на задачу 3.6 Flash дешевле, чем GPT-5.6 Terra Max, Kimi K3 и Qwen 3.7 Max. Модель уже доступна в API, Antigravity, приложении Gemini и — в тот же день — в GitHub Copilot.
Младшая 3.5 Flash-Lite добивает по скорости (350 токенов в секунду, $0,30/$2,50), а 3.5 Flash Cyber отдаётся только правительствам и партнёрам через систему CodeMender.
Где же 3.5 Pro
Вот это — главный неудобный вопрос. Флагман Gemini 3.5 Pro анонсировали на майской конференции I/O и обещали на июнь. С тех пор релиз сорвали трижды; официально Google говорит лишь, что модель «тестируется с партнёрами и выйдет, когда будет готова». По сообщениям СМИ, причина проволочек — как раз кодинг: модель не дотягивала до конкурентов. Ars Technica, разбирая свежие Flash-релизы, назвала улучшения «маргинальными» и подчеркнула в заголовке главное — 3.5 Pro всё ещё нет.
Параллельно Google объявила, что запустила самый амбициозный на сегодня pre-training ран — Gemini 4. Сроков, разумеется, нет.
Смена стратегии или отступление
В треде r/LocalLLaMA версии разошлись. Кто-то считает, что Google сознательно уходит в on-device инференс для своих продуктов — «но эту битву может выиграть Apple». Кто-то видит внутреннюю политику: «погрязли, никто ничего не шипит». Один комментатор, представившийся акционером, отреагировал спокойно: «и хорошо — пусть лаборатории жгут деньги инвесторов, бизнес Google — это облако и инференс».
В этом, пожалуй, и есть ключ. Ставка Gemini 3.6 Flash на цену и экономию токенов — не про то, чтобы возглавить арену. Это про то, чтобы захватить массовый агентный инференс, где решает не первая строчка лидерборда, а стоимость миллиона задач. Google, похоже, меняет вопрос, на который отвечает: не «чья модель умнее», а «на чём дешевле гонять агентов в проде». Сработает ли этот разворот — станет ясно, когда (и если) выйдет 3.5 Pro и покажет, осталась ли у Google заявка на верх таблицы вообще.

