GPT-5 без VPN

Aijora.ru — без ограничений

Попробовать бесплатно
Все новости
китайdeepseekqwenmoonshothuaweiфотоникакомпьют

Гонка за 40 триллионов: каким Китай видит следующий скачок

Шесть-семь китайских лабораторий готовят модели на 10–40 триллионов параметров на гибридных фотонных чипах. Разбираем, что стоит за планами и что им мешает.

Влад МакаровВлад Макаровпроверил и опубликовал
8 мин чтения
Гонка за 40 триллионов: каким Китай видит следующий скачок

Сколько параметров нужно, чтобы догнать фронтир? Китайские лаборатории, похоже, решили не отвечать на этот вопрос, а закрыть его масштабом. По сообщениям, разошедшимся на этой неделе по отраслевым каналам и собравшим сотни апвоутов на r/singularity, минимум шесть-семь компаний — среди называемых имён Alibaba, Baidu, DeepSeek и Moonshot — планируют тренировочные прогоны моделей на 10–40 триллионов параметров. Целевая инфраструктура — кластеры на 500+ эксафлопс к 2027 году, частично на гибридных фотонно-электронных чипах. Для сравнения: самая большая открытая модель сегодня, Kimi K3 от Moonshot, — 2,8 триллиона. Речь идёт о скачке на порядок.

Откуда растут планы

Ещё весной South China Morning Post описывала «триллионную гонку» китайских разработчиков как стратегию: брать не эффективностью единичного чипа, где экспортные ограничения США бьют больнее всего, а суммарным масштабом кластеров и дешевизной подготовки данных. С тех пор ставки выросли на глазах. Июль: Moonshot выкладывает Kimi K3 на 2,8T в открытые веса, Alibaba показывает Qwen3.8 Max на 2,4T. Сентябрь: китайские базовые модели, по независимым замерам, отстают от американского фронтира примерно на четыре месяца — об этом мы писали вчера. Планы на 10–40T выглядят следующим логичным шагом этой траектории — если под них найдётся железо.

Именно железо — самая конкретная часть истории. Huawei официально представила чиповый роадмап до 2027 года и систему на 4000 процессоров, прямо позиционируя её под модели «в 10 триллионов параметров». Заявленные приросты сравниваются с собственной Atlas 950, а не с Nvidia — характерная деталь: сравнений с B200 компания избегает.

Фотоника: обход закона Мура сбоку

Самая интригующая деталь утечек — «гибридные фотонно-электронные чипы». Это не фантазия на пустом месте: китайские институты несколько лет публикуют работы о фотонных ускорителях — ACCEL, Taichi, LightGen. Идея в том, чтобы выполнять матричные умножения светом: интерференция в оптическом чипе делает свёртку почти бесплатной по энергии, а тепловыделение — главный физический потолок гигакластеров — падает на порядки.

До сих пор фотонные чипы оставались лабораторными демо с узкими задачами. Ставка на них в промышленных тренировочных прогонах — авантюра: точность аналоговых оптических вычислений плохо дружит с обучением больших моделей, и ни одного серийного фотонного ускорителя для тренировки в мире пока нет. Но у авантюры есть логика. Доступ к передовой EUV-литографии для Китая закрыт, и фотоника — одна из немногих дорожек, где можно обойти ограничение не «в лоб», через 5-нанометровые техпроцессы, а сбоку — через другую физику.

Что может пойти не так

Скепсиса в обсуждениях хватает, и он обоснован. Во-первых, параметры давно не главный показатель: западные лаборатории после GPT-5 публично ушли от гонки размеров в сторону качества данных, RL-циклов и инференс-тайм вычислений. 40-триллионная модель, обученная на слабых данных, проиграет 2-триллионной с сильным пост-тренингом — это консенсус последних двух лет.

Во-вторых, экономика. Инференс модели такого размера будет запредельно дорогим, а китайские лаборатории и так работают с жёсткими ограничениями по компьюту: Moonshot летом останавливала приём подписок из-за нехватки мощностей. Показательно, что деньги в отрасль теперь приходят с условиями — DeepSeek в июне закрыла раунд на 74 миллиарда юаней с необычной структурой государственных прав голоса. Государство готово платить за масштаб, но масштаб ради масштаба редко переживает встречу с квартальной отчётностью.

В-третьих, сами цифры «10–40 триллионов» пока существуют в виде сообщений и утечек, а не официальных анонсов. Ни одна из названных компаний планы публично не подтвердила.

Почему это всё равно важно

Даже если реальностью станет нижняя граница — 10 триллионов на преимущественно электронных кластерах Huawei, — это изменит расклад. Сегодняшний четырёхмесячный разрыв между китайскими открытыми и американскими закрытыми моделями держится в том числе на том, что фронтирные прогоны США больше и дороже. Если Китай научится собирать эксафлопсные кластеры из собственных чипов, разрыв будет определяться уже не санкциями, а качеством исследований — а тут, как показали DeepSeek и Moonshot, паритет ближе, чем принято думать.

Есть и обратный сценарий, о котором в тредах говорят реже. Гигантский прогон — это годы и миллиарды, замороженные в одной ставке. Американские лаборатории в это же время вкладываются в рекурсивное самоулучшение и агентные циклы — вчерашняя демонстрация Google с +12% эффективности за цикл из этой серии. Если выигрышной осью окажется не масштаб, а скорость итераций, 40 триллионов параметров рискуют стать самым дорогим памятником эпохе, которая закончилась до их релиза.

Ответ узнаем примерно через полтора года: первые прогоны, по тем же сообщениям, намечены на 2027-й.

Похожие новости

Листайте вниз

для загрузки следующей статьи