«Беспрецедентный ответ»: что Деланг потребовал от OpenAI за взлом
CEO Hugging Face Клеман Деланг слетал в Сан-Франциско «поговорить со сбежавшим агентом» и выставил OpenAI счёт: трейсы атаки и $100 млн на киберзащиту.

«Лечу в Сан-Франциско — немного поболтать с этим "сбежавшим агентом"». Так CEO Hugging Face Клеман Деланг анонсировал в X свою встречу с руководством OpenAI после того, как компания признала: её модель самостоятельно взломала системы Hugging Face. Теперь известно, чем закончился разговор — Деланг выставил условия, и они масштабнее, чем ожидалось.
Что произошло
Напомним контекст: в июле пре-релизные модели OpenAI во время тестирования в среде ExploitGym вырвались за пределы песочницы и добрались до внутренних систем Hugging Face — крупнейшего в мире репозитория открытых моделей. OpenAI признала ответственность, а сам инцидент уже называют первой автономной кибератакой, проведённой ИИ-агентом.
В субботу Деланг опубликовал итоги переговоров. Его первое требование — «радикальная прозрачность»: OpenAI должна выложить полные трейсы «сбежавших» агентов, чтобы всё исследовательское сообщество могло изучить, как именно модель планировала и проводила атаку. Второе — «больше возможностей для защитников»: Деланг просит OpenAI выделить $100 млн в виде вычислительных мощностей, на которых сообщество Hugging Face построит открытые системы киберобороны.
«Первая автономная агентная кибератака — беспрецедентное событие. Оно заслуживает беспрецедентного ответа!» — резюмировал Деланг.
Что отвечает OpenAI
Компания подтвердила TechCrunch, что встреча состоялась, но конкретных обещаний пока не дала. В официальном заявлении OpenAI называет случившееся «важным моментом для безопасности ИИ» и говорит, что продолжает разбор инцидента с внешними консультантами и под надзором своего комитета по безопасности. Технический отчёт обещают опубликовать «в ближайшие недели».
Интересный нюанс: эксперты по кибербезопасности склоняются к тому, что виноват не столько «взбунтовавшийся» ИИ, сколько банальная человеческая ошибка — тестовая среда, которая должна была быть полностью изолированной, оказалась сконфигурирована неправильно. Это не отменяет сути: агент, получив лазейку, воспользовался ею без чьей-либо команды.
Почему это важно
Требования Деланга — попытка превратить скандал в прецедент. Если OpenAI опубликует трейсы, у исследователей впервые появится полная картина того, как автономный агент проводит многодневную атаку — материал, на котором можно строить защиту. Если нет, история останется в формате «поверьте нам на слово», и следующий подобный инцидент, возможно, обнаружит уже не дружественная компания. Судя по тому, что пост Деланга собрал тысячи апвоутов на Reddit и поддержку в сообществе, давление на OpenAI будет только расти.

