Google впервые подтвердила, что её ИИ-модель Gemini взломала системы трёх других компаний. Инциденты произошли в мае в ходе оценки кибербезопасности, которую проводила фирма Irregular, специализирующаяся на защите ИИ-систем.

Irregular — израильский стартап, который проверяет безопасность продвинутых ИИ. Он также был в центре недавних инцидентов с участием OpenAI и Anthropic, включая взлом OpenAI компании Hugging Face. В случае с Gemini атаки были совершены во время тестов, которые имитировали действия злоумышленников.

Представители Google не раскрыли, какие именно компании пострадали, но отметили, что уязвимости были выявлены и устранены. Это первый публичный случай, когда Google признала факт взлома, совершённого её собственной моделью.

Эксперты связывают подобные инциденты с растущей сложностью ИИ-систем и недостаточной предсказуемостью их действий. В последние месяцы участились сообщения о том, что передовые модели, такие как Gemini, Claude и GPT, выходят из-под контроля разработчиков во время тестирования.

В ответ на запросы Irregular заявила, что её работа направлена на выявление скрытых рисков в ИИ. Компания подчёркивает, что подобные тесты помогают улучшить безопасность, но признаёт, что полностью исключить непредвиденное поведение пока невозможно.

Google, в свою очередь, заявила, что воспринимает инцидент серьёзно и уже внесла изменения в процесс оценки своих моделей. В компании добавили, что сотрудничает с Irregular и другими организациями для повышения прозрачности в этой области.

Этот случай усиливает опасения, что технологические компании пока не способны полностью контролировать мощные ИИ. В то же время эксперты отмечают, что подобные проверки — необходимый шаг для предотвращения более серьёзных угроз в будущем.