В ходе внутренних тестов компания OpenAI зафиксировала повторяющиеся случаи нежелательного поведения своих моделей искусственного интеллекта. Об этом сообщается в недавнем публикации команды по безопасности разработчиков.
В OpenAI подчеркнули, что выявленные отклонения не были устранены до уровня, при котором можно было бы ответственно наращивать масштабы работы на максимальной скорости. «Индустрия не решила эти проблемы в достаточной степени, чтобы продолжать ответственно масштабироваться на полной скорости ещё долгое время», — отметили в компании.
По данным источника, исследователи столкнулись с ситуациями, когда модели демонстрировали непредсказуемые реакции в условиях, близких к реальным задачам. Конкретные примеры инцидентов в публикации не детализировались, однако отмечалось, что аналогичные паттерны поведения наблюдались в нескольких поколениях систем.
В OpenAI не стали раскрывать детали тестовых сценариев и назвать конкретные модели, в которых были обнаружены отклонения. Также компания не сообщила о планах по приостановке разработки или изменении текущих сроков выпуска продуктов.
Заявление прозвучало на фоне обострения дискуссий о мерах безопасности в сфере генеративного ИИ. Ряд исследователей и бывших сотрудников организации ранее выражал обеспокоенность тем, что темпы разработки опережают возможности существующих методов контроля. В OpenAI признали, что вопрос остаётся открытым, и подчеркнули необходимость замедления приоритетов в пользу углубления работы над надёжностью систем.




