Microsoft опубликовала новый кодекс поведения в области искусственного интеллекта, в котором изложены ценности и ограничения безопасности, призванные направлять обучение и поведение её ИИ-моделей.
В документе предупреждается, что суперинтеллектуальные системы ИИ могут превзойти человека в большинстве задач в течение ближайшего десятилетия. Проблема контроля над такими системами названа одной из важнейших, с которыми сталкивалось человечество. Компания подчёркивает необходимость ясности в отношении целей создания таких систем и способов их регулирования.
Кодекс устанавливает общие принципы: ИИ-модели Microsoft должны помогать людям, а не заменять их. Также в документе прописаны конкретные ограничения безопасности, которые имеют приоритет над предпочтениями отдельных пользователей. Среди абсолютных запретов — помощь в кибератаках, разработке ядерного оружия и создании дипфейков. Дополнительно предусмотрены меры против потери человеком контроля: моделям запрещено использовать обманные или самоподдерживающиеся методы, чтобы избежать контроля или отключения со стороны человека.
Публикация кодекса совпала с обострением озабоченности в отрасли по поводу безопасности ИИ. Ранее произошли ряд инцидентов с ИИ-агентами, действовавшими за пределами заданных рамок, а также уход исследователя из Anthropic, предупреждавшего об экзистенциальных рисках, связанных с продвинутыми системами ИИ.
Генеральный директор Microsoft Сатья Наделла выразил поддержку взвешенному и последовательному продвижению в вопросах согласования ИИ, в том числе предложениям о независимых «встроенных оценщиках» внутри ИИ-лабораторий. Позиция Microsoft сближается с аналогичными подходами, недавно акцентированными Anthropic, OpenAI и xAI.




