Американские спецслужбы выдвинули обвинения против китайских разработчиков искусственного интеллекта. Национальное агентство безопасности (NSA), Агентство кибербезопасности и защиты инфраструктуры (CISA) и Федеральное бюро расследований (ФБР) совместно заявили, что компании DeepSeek, Moonshot и ряд других китайских AI-стартапов участвуют в систематическом «дистиллировании» передовых американских моделей ИИ.

Термин «дистилляция» (distillation) в контексте машинного обучения означает процесс, при котором меньшая и более простая модель обучается на выходах большой и сложной модели. В результате модель-ученик способна воспроизводить поведение оригинальной модели с близкой точностью, но требует значительно меньше вычислительных ресурсов. По версии американских властей, китайские компании используют эту технику для копирования закрытых алгоритмов и архитектур, разработанных американскими лабораториями.

В заявлении NSA, CISA и ФБР говорится, что речь идёт не об отдельных случаях, а о кампаниях промышленного масштаба. Китайские организации якобы массово собирают выходные данные американских frontier-моделей (передовых моделей ИИ, таких как GPT-4, Claude, Gemini) и на их основе обучают собственные аналоги. Это позволяет им сокращать время и затраты на исследования, избегая лицензионных отчислений и обходя экспортные ограничения.

Представители ведомств подчеркнули, что подобные действия могут угрожать национальной безопасности США. Дело в том, что frontier-модели часто содержат уникальные наработки в области безопасности, обработки естественного языка и генерации контента. Их копирование, по мнению властей, не только подрывает конкурентоспособность американских компаний, но и потенциально даёт Китаю доступ к технологиям, которые могут быть использованы в военных или разведывательных целях.

DeepSeek и Moonshot — две наиболее заметные китайские компании в области больших языковых моделей. DeepSeek известен своей открытой моделью DeepSeek-V2, которая по некоторым тестам приближается к GPT-4, но при этом требует меньше ресурсов. Moonshot (полное название — Moonshot AI) разрабатывает модель Kimi, ориентированную на обработку длинных текстов. Обе компании получали значительные инвестиции от китайских венчурных фондов и государственных структур.

Ранее США уже вводили ограничения на экспорт передовых чипов для ИИ в Китай, а также требовали от американских компаний лицензирования передачи технологий. Однако новые обвинения указывают на то, что Вашингтон видит проблему не только в поставках «железа», но и в несанкционированном использовании софта и алгоритмов.

Китайские власти и представители компаний пока официально не ответили на обвинения. Однако в прошлом Пекин неоднократно заявлял, что обвинения в шпионаже и краже технологий безосновательны и являются частью кампании по сдерживанию развития китайской технологической отрасли.

Это не первый случай, когда американские регуляторы заявляют о массовом копировании AI-моделей. В начале 2024 года Министерство торговли США проводило расследование в отношении нескольких китайских стартапов, подозреваемых в нарушении авторских прав при обучении нейросетей. Однако совместное заявление NSA, CISA и ФБР — самый серьёзный сигнал на данный момент.

Эксперты отмечают, что доказать «дистилляцию» сложно: выходы моделей не всегда уникальны, и сходство может объясняться использованием одних и тех же открытых датасетов. Тем не менее, масштаб обвинений говорит о том, что у американских спецслужб, вероятно, есть внутренние данные или технические индикаторы, указывающие на системный характер заимствований.

В ближайшие недели можно ожидать новых заявлений от Министерства юстиции США и, возможно, введение дополнительных санкций против китайских компаний в секторе ИИ.