Anthropic опубликовала масштабный отчёт о угрозах, связанных с использованием её мощных ИИ-моделей вредоносными субъектами. Документ объёмом 154 страницы вышел в четверг и описывает случаи, когда различные группы пытались применить технологии компании для создания вооружений, возбудителей опасных заболеваний и слежки за людьми.
В отчёте фигурируют несколько категорий злоумышленников. Преступные группировки, структуры, спонсируемые государствами, компании-разработчики шпионского ПО, учёные и пропагандисты — все они, по данным Anthropic, предпринимали попытки использовать модели компании в своих целях. Конкретные методы включали проектирование ракет и аварийных устройств, синтез патогенных микроорганизмов, а также организацию слежки за инакомыслящими.
В самом документе компания подчёркивает: описываемые случаи не являются типичными злоупотреблениями, а представляют собой наиболее заметные и нетипичные примеры угроз, выявленных на данный момент. Anthropic также объясняет публикацию отчёта чувством ответственности перед обществом.
Публикация доклада состоялась спустя два дня после того, как бывший сотрудник компании покинул свой пост. Ушедший из компании специалист заявил, что модели Anthropic потенциально способны привести к исчезновению человечества к 2030 году. Официальных комментариев Anthropic на этот счёт не поступало.




