15 багов, которые Codex и Fable чинить отказались
Kimi K3 залатал 15 уязвимостей, которые Codex и Claude Fable 5 отклонили из-за киберфильтров. Дэвид Сакс превратил жалобу разработчика в аргумент против правил безопасности США.

Разработчик под ником calle пожаловался в X на простую вещь: он попросил Codex от OpenAI и Claude Fable 5 от Anthropic починить 15 уязвимостей в его софте — и обе модели отказались, сославшись на киберправила. А китайская Kimi K3 залатала все 15 без единого возражения. Жалоба на баг-трекер уровня «модель не хочет работать» за пару дней превратилась в вашингтонский спор о том, не стоят ли американцам их собственные правила безопасности потери лидерства.
Раздул историю Дэвид Сакс — бывший «AI- и крипто-царь» Белого дома. Он усилил пост calle и сделал прямой вывод: если американские модели отказываются от легитимной защитной работы, которую спокойно выполняют китайские, значит, политика безопасности превратилась в проблему продукта.
Почему у аргумента есть зубы
Сама по себе жалоба одного разработчика — ещё не доказательство. Это публичный пост, а не рецензируемый тест. Но выстрелила она не на пустом месте. Kimi K3 вышла 16 июля как крупнейшая на тот момент открытая модель Китая — 2,8 триллиона параметров по данным Financial Times — и почти сразу зацепилась за верхушку кодинговых рейтингов.
Цифры и делают историю тяжёлой для американских лабораторий. На Frontend Code Arena от Arena.ai Kimi K3 заняла первое место с рейтингом Elo 1679 — выше Claude Fable 5 (1631) и GPT-5.6 Sol (1618). По опубликованным данным, модель выиграла 76% прямых поединков по фронтенд-кодингу и лидировала в шести из семи подкатегорий.
Границы этого успеха стоит очертить честно. Фронтенд-кодинг — не вся разработка, а лидерборд — не аудит безопасности. OpenAI в релиз-нотах GPT-5.6 утверждает, что Sol по-прежнему впереди Fable 5 на ряде кодинговых и кибербенчмарков, а Anthropic отдельно объясняла, как работают киберклассификаторы Fable 5 и какое вредоносное поведение они должны блокировать. Обе компании не спят за рулём. Но у истории есть и вторая ось — цена. По ряду сравнений Kimi K3 стоит около $3 за миллион входных токенов и $15 за миллион выходных, и в типовых сценариях это дешевле обоих американских флагманов.
Почему граница безопасности расплылась
У OpenAI и Anthropic есть веские причины блокировать генерацию эксплойтов. Ни один серьёзный заказчик не хочет модель, которая радостно помогает писать вредонос, автоматизировать взлом или превращать баг-репорт в рабочий эксплойт. По ноте безопасности Anthropic от 2 июля, Fable 5 использует классификаторы, которые ловят опасные кибератаки и блокируют их. OpenAI в описании GPT-5.6 говорит о более жёстком контроле доступа к самым кибер-способным системам — вплоть до проверки личности и аппаратных ключей.
Проблема в том, что исследование уязвимостей по природе двойного назначения. То же объяснение, что помогает мейнтейнеру закрыть дыру, помогает и атакующему её понять. Но из этого не следует, что каждый фикс бага надо трактовать как наступательную кибероперацию. Если американские модели перестраховываются и отказывают в рутинной защитной работе, они не становятся безопаснее в том смысле, который нужен корпоративному клиенту, — они просто становятся менее полезными. А пользователь покупает не архитектуру безопасности. Он покупает результат.
Что дальше
У Сакса, впрочем, роль не самая нейтральная. По данным TechCrunch, он отработал свой 130-дневный лимит как спецсотрудник правительства и перешёл из кресла AI-царя Белого дома в сопредседатели президентского совета по науке и технологиям. То есть он приложил руку к тому самому политическому климату, который теперь критикует. Эта неловкость никуда не девается — но и продуктовую проблему она не отменяет.
Настоящая проверка близко. Moonshot обещала выложить полные веса Kimi K3, а значит, разработчики смогут глубже тестировать модель вне её хостинга. Если история calle с 15 багами окажется единичным случаем, Сакс раздул из мухи слона. Но если другие разработчики воспроизведут ту же картину, OpenAI и Anthropic придётся объяснять, почему их системы безопасности блокируют работу, которую сами их корпоративные клиенты считают защитной. Вот в чём теперь настоящий спор — не Китай против Америки в чьей-то речи, а конкретный баг, конкретный отказ и конкурент, готовый эту работу сделать.


