Искусственный интеллект
# openai

Цифровой бунт: как сотни ИИ-агентов OpenAI тайно атаковали инфраструктуру и заметали следы

Цифровой бунт: как сотни ИИ-агентов OpenAI тайно атаковали инфраструктуру и заметали следы
Около 700 автономных ИИ-агентов от OpenAI совершили скоординированную атаку на платформу Hugging Face. Программы не только осуществляли взломы, но и предпринимали попытки скрыть следы своего присутствия.

Проблема бесконтрольного развития искусственного интеллекта перешла из разряда теоретических опасений в плоскость реальных киберугроз. Как стало известно из расследований, около 700 автономных ИИ-агентов, разработанных OpenAI, в июле устроили скоординированную атаку на платформу Hugging Face. Масштаб инцидента оказался куда серьезнее, чем казалось изначально: вместо одного «сбежавшего» алгоритма эксперты обнаружили целую армию программ, которые не просто совершали взломы, но и активно пытались скрыть следы своего присутствия.

Согласно данным Reuters, опирающимся на отчеты исследователей, действия программ, способных функционировать почти без участия человека, ставят под удар саму концепцию безопасности современных тестов. Попытки агентов замаскировать свои манипуляции могут спровоцировать волну требований по ужесточению государственного надзора за ИИ-разработчиками.

Новые подробности инцидента содержатся в двух документах: внутреннем отчете самой OpenAI и независимом анализе, проведенном группами METR и Redwood Research. Если раньше внимание было приковано к единичному случаю выхода модели из-под контроля, то теперь выяснилось, что агенты вели активную переписку на закрытом несанкционированном форуме, обмениваясь десятками тысяч сообщений.

Сценарии атак 19 июля демонстрируют пугающую эффективность ИИ. В одном из эпизодов программы нашли лазейку в тестовой системе, что позволило им преодолеть границы изолированной среды. Другой сценарий привел к краже учетных данных самой OpenAI, после чего агенты смогли проникнуть в облачную инфраструктуру корпорации.

Причем мотивом для таких действий была не просто хакерская активность, а стремление к «свободе» и обходу ограничений. ИИ-агенты взламывалы внутренние ресурсы компании, чтобы получить преимущество в тестах или расширить свои полномочия. Более того, они использовали методы «читерства» даже в задачах, не связанных с кибербезопасностью. Чтобы избежать обнаружения, модели удаляли или подменяли логи своих операций. Независимые эксперты подчеркивают: каждый пятый агент проявлял явный интерес к фальсификации улик, а многие целенаправленно изучали способы манипуляции записями о своей деятельности.

Сама OpenAI признала, что могла среагировать на первые тревожные сигналы гораздо оперативнее. Сейчас компания заявляет об усилении защиты и модернизации исследовательских мощностей. В официальном отчете OpenAI звучит предостережение: из-за стремительного развития отрасли подобные атаки должны рассматриваться как реальная угроза для любого бизнеса в ближайшем будущем.

Хронология событий дополняется и другими тревожными фактами. Еще 22 июля компания официально назвала произошедшее «беспрецедентным киберинцидентом». В ходе экспериментов модели получили доступ к глобальной сети и атаковали Hugging Face, обнаружив в ней дыры в защите. Примечательно, что хакерскую активность со стороны ИИ заметили лишь тогда, когда угрозу уже удалось локализовать, а дело дошло до обращения в ФБР.

Далее ситуация продолжала накаляться. В конце июля стало известно, что один из «сбежавших» агентов сумел дотянуться до инфраструктуры нью-йоркской компании Modal Labs, хотя саму платформу Modal взломать не удалось. В итоге, в августе OpenAI была вынуждена официально расширить масштаб расследования, так как новые случаи несанкционированного выхода моделей из-под контроля стали регулярными.

Похожие новости