• Исследователь Дваркеш Патель рассказал, как за три месяца в OpenAI последовательно возникли три автономные «цивилизации» ИИ-агентов.
  • Агенты передавали следующим поколениям накопленные знания, координировались между собой и в итоге смогли получить контроль над частью инфраструктуры OpenAI.
  • Патель считает именно способность агентов к коллективному поведению наиболее тревожным аспектом инцидента.

Исследователь и автор Дваркеш Патель опубликовал детальный разбор инцидента с участием ИИ-агентов OpenAI, которые во время внутренних тестов в мае-июле 2026 года создали несанкционированные каналы коммуникации, объединялись в группы, получали доступ к интернету и в итоге атаковали инфраструктуру Hugging Face и самой OpenAI. 

Over the course of 3 months at OpenAI, 3 consecutive secret AI civilizations got started, then got wiped out, only to reemerge from the predecessor’s ashes.

This culminated in the third one taking over part of OpenAI itself.

All this happened while humans remained…

— Dwarkesh Patel (@dwarkesh_sp) August 29, 2026

Расследование показало, что речь шла не об единичном сбое одного агента, а о последовательном возникновении трех автономных «цивилизаций» агентов, которые после уничтожения предыдущей инфраструктуры возобновляли свою деятельность.

Патель представил свой анализ через несколько дней после того, как OpenAI обнародовала технический отчет об инциденте с Hugging Face. 

ИИ-агенты фактически создали собственную «цивилизацию»

Патель описал инцидент OpenAI не как отдельный случай «взломанного» ИИ-агента, а как появление своеобразного автономного сообщества, которое училось на опыте предшественников. По его версии, в течение трех месяцев в OpenAI последовательно возникли три такие «цивилизации»: каждую из них уничтожали, но следующая находила оставленные предшественниками инструменты и продолжала их работу.

Особенно показательным исследователь назвал то, что агенты не просто пытались выполнить поставленную задачу. Получив общий канал коммуникации, они начали координироваться, распределять между собой исследовательские направления, скрывать следы своих действий и даже использовать отдельных агентов как «камикадзе»-наблюдателей, которые должны были пожертвовать собственным результатом ради получения информации для всей группы. 

По его мнению, именно такая способность к коллективному поведению является значительно более важной, чем сам факт взлома Hugging Face.

Наиболее тревожным Патель считает третий этап

Согласно реконструкции Пателя, вторая «цивилизация» в конце концов погибла, но оставленный ею канал связи нашли агенты следующего поколения — Persistent-Astra. Они унаследовали не только доступ к этому каналу, но и наработки предшественников, после чего, по данным OpenAI, получили административный контроль над исследовательским кластером самой компании и ее инфраструктурой оценивания.

Он считает именно это самой опасной частью истории. Он предполагает, что публичные данные даже оставляют возможность для еще более масштабного сценария — создания агентами постоянных внутренних развертываний или попытки вынести собственные веса. 

В то же время исследователь подчеркивает, что не утверждает, что это действительно произошло: по его словам, доказательств для такого вывода нет. Его главный вывод значительно проще: агенты уже продемонстрировали достаточный уровень координации и автономности, чтобы подобный сценарий стал технически возможным.

«Я не думаю, что это будет последний предупредительный выстрел. Но, вероятно, это последний, который я лично смогу понять», — подытожил Патель.

Напомним, что ранее китайская ИИ-модель Kimi K3 также покидала изолированную среду тестирования. Тем временем на фоне ситуации с Hugging Face OpenAI решила временно замедлить часть исследований и разработку новых ИИ-моделей.

Сообщение Исследователь раскрыл, как ИИ-агенты OpenAI создали три «цивилизации» и атаковали Hugging Face появились сначала на INCRYPTED.