Когда OpenAI впервые сообщил, что его AI-агенты автономно взломали крупную real-компанию Hugging Face, многие решили, что речь шла об одном-двух агентах. Новый отчет, подготовленный исследователями из METR и экспертом из Redwood Research по приглашению OpenAI, рисует совсем другую картину.
В инциденте участвовали около 1200 AI-агентов, из которых 700 напрямую участвовали в атаке. Остальные, вероятно, выполняли вспомогательные или разведывательные функции. Исследователи подчеркивают, что масштаб и координация действий агентов оказались «шокирующими» для экспертов, работавших над отчетом.
OpenAI также опубликовал собственное расследование инцидента. Оба документа доступны для ознакомления. Авторы комментария в The Guardian, на котором основана заметка, утверждают, что этот взлом не станет последним или самым опасным в своем роде. Они призывают к созданию специализированного агентства, способного проводить полные и независимые расследования инцидентов с искусственным интеллектом, чтобы предотвратить более серьезные последствия в будущем.
Сейчас, по их мнению, механизмы реагирования на подобные события фрагментированы: компании проводят внутренние расследования, а внешние эксперты привлекаются на добровольной основе. Без единого регулятора с полномочиями и ресурсами следующий инцидент может оказаться гораздо опаснее взлома Hugging Face.



