GPT-5 год спустя: лучшая модель мира проигрывает бесплатным
В августе 2025 GPT-5 была вершиной AI. Сегодня открытая Kimi K3 обходит её на GPQA, а OpenAI выпустила шесть поколений следом. Считаем срок жизни фронтир-модели.

7 августа 2025 года. Сэм Альтман представляет GPT-5 — модель, которую OpenAI готовила годами и продавала публике как «команду PhD-экспертов в кармане». Запуск освещают все мировые СМИ, конкуренты нервно сверяют бенчмарки, компании выстраиваются в очередь за API.
Прошло неполных двенадцать месяцев. На этой неделе тред в r/singularity с двумя тысячами апвоутов констатирует то, что в индустрии уже никого не удивляет: GPT-5 сегодня уступает моделям, которые раздают бесплатно.
Проверяем по цифрам
Это не риторическое преувеличение — достаточно открыть таблицы бенчмарков. На GPQA Diamond, тесте экспертных знаний уровня PhD, GPT-5 в максимальном режиме рассуждений набирала 87% — год назад это был выдающийся результат. Открытая Kimi K3 от Moonshot AI, чьи веса с воскресенья лежат в свободном доступе на Hugging Face, показывает 93,5%. Шесть с половиной процентных пунктов на тесте, где каждый пункт над отметкой 85% даётся кровью, — это разрыв не поколения, а эпохи.
Ещё показательнее то, чего в результатах GPT-5 просто нет. Индустрия за год перешла на агентные бенчмарки — BrowseComp для веб-навигации, OSWorld для управления компьютером, GDPval для реальных рабочих задач. Современные модели меряются именно ими; GPT-5 в этих таблицах отсутствует как класс — она проектировалась для другой эры, когда моделям ещё не доверяли компьютер целиком.
Сама OpenAI проголосовала за устаревание своей звезды быстрее всех: после GPT-5 компания выпустила 5.1 в ноябре, 5.2 в декабре, затем 5.3, 5.4, флагманскую 5.5 в апреле — и, наконец, линейку 5.6 из трёх моделей. Шесть поколений за двенадцать месяцев. В нашем каталоге сейчас четыре десятка моделей OpenAI, и GPT-5 в нём выглядит так же архаично, как GPT-4 выглядела к моменту её собственного релиза, — только цикл сжался с двух лет до одного.
Срок годности: около шести месяцев
История GPT-5 позволяет впервые честно измерить срок жизни фронтир-модели. На вершине общих рейтингов она продержалась примерно три месяца — до осенних релизов Google и Anthropic. Ещё через полгода её догнали открытые модели. Через год она перестала попадать в сравнения вообще.
И это, судя по всему, не аномалия, а новая норма. Стэнфордский AI Index оценивает разрыв между лучшими американскими и китайскими моделями в 2,7% — при таком темпе догоняющих любое лидерство тает за месяцы. Альтман, отвечая на подобные подсчёты, предпочитает смотреть вперёд: «Следующие шесть месяцев будут ощущаться как последние два года прогресса». Для владельцев моделей это обещание, для их бухгалтерий — угроза: миллиарды, вложенные в тренировку, должны окупиться до того, как модель станет музейным экспонатом. У GPT-5 на это был примерно год.
Что из этого следует
Для пользователей и бизнеса из этой истории вытекают три практических вывода, и все они неудобны для вендоров.
Во-первых, привязываться к конкретной модели бессмысленно — переплата за вчерашний фронтир сегодня ничем не оправдана, когда открытая альтернатива догоняет за полгода и работает на своём железе. Во-вторых, цены на интеллект уровня «лучшая модель прошлого года» стремятся к нулю: то, что в августе 2025-го стоило десятки долларов за миллион токенов, сегодня можно получить бесплатно в весах с Hugging Face. Наконец, главной валютой становится не качество модели, а скорость её замены в вашей инфраструктуре: выигрывает не тот, кто выбрал лучшую модель, а тот, кто дешевле всех переключается на следующую.
Есть в этом и отрезвляющий фон для всей отрасли. Из бенчмарков нашего каталога видно: сегодняшние герои — Fable 5, Opus 5, Kimi K3, Qwen 3.8 Max — пройдут ровно тот же путь. Через год кто-то напишет тред о том, как лучшая модель июля 2026-го проигрывает бесплатным. И судя по темпу, который обещает Альтман, ждать придётся даже меньше года.


