Как Китай выкачивает интеллект из американских ИИ?

Американские Агентство национальной безопасности (NSA), Агентство по кибербезопасности и защите инфраструктуры (CISA) и Федеральное бюро расследований (FBI) описали промышленную добычу возможностей закрытых моделей как угрозу интеллектуальной собственности и национальной безопасности. Обычная дистилляция знаний применяется в исследованиях законно, но расследуемые кампании ведомства называют агрессивными, адресными и вредоносными: их цель — извлечь закрытые функции, доступ к которым ограничен владельцами моделей.
Как Китай выкачивает интеллект из американских ИИ?
Изображение носит иллюстративный характер

В бюллетене названы китайские DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun и . По оценке ведомств, с конца 2024 года они могли получить миллиарды токенов за миллионы запросов и обменов, возможно, с одобрения или при поддержке правительства Китая. Мишенями стали Claude компании Anthropic, GPT компании OpenAI, Gemini компании Google и Grok компании SpaceXAI. Американские передовые модели официально недоступны в Китае, поэтому разработчики обходят географические ограничения через внешние серверы и серый рынок посредников, рекламируемых на Taobao и Xianyu.
StepFun, как утверждается, с конца 2025-го до начала 2026 года собирала данные Claude Opus 4.1, Claude Opus 4.5, Claude Sonnet 4.5, Claude Haiku 4.5, GPT-5 Mini, GPT-5 Pro, GPT-5.1, GPT-5.1 Codex и GPT-5.2. Материал предназначался для улучшения программирования и агентных функций модели Step 4. к середине 2026 года якобы извлекла миллиарды токенов из GPT-5.5 и Claude Opus 4.8, чтобы развить у собственной модели рассуждение по цепочке мыслей.
Ещё один эпизод за конец 2025 года сохранился повреждённым: в нём читаются лишь «5 Pro» и Gemini 3 Pro, а также фраза о снижении расходов на обучение передовой модели. Название компании и начало перечня утрачены, поэтому приписывать этот случай кому-либо нельзя. Такая оговорка существенна: даже в предупреждении спецслужб обвинения остаются обвинениями, а испорченный фрагмент не превращается в доказанный факт.
Сбор ведётся через API, удалённые облака и сторонние агрегаторы, скрывающие сведения о пользователях. В ход идут VPN, замаскированные учётные записи, автоматические агенты, прокси, похищенные данные доступа, мошеннические аккаунты и разные продуктовые каналы. Если один путь блокируют, система переключается на другой. Команды массово покупают премиальные подписки, делят их между разработчиками, распределяют запросы по множеству площадок и выбирают сильнейшие закрытые функции нескольких моделей. Ведомства считают такой доступ несанкционированным и нарушающим условия поставщиков.
Особый интерес представляет извлечение рассуждений по цепочке мыслей, или CoT. Кампании снабжены системами оценки качества, распознают защитные меры и проверяют, насколько точно полученные ответы воспроизводят нужное поведение. Выгода вполне практична: сокращаются сроки разработки, дешевеет обучение передовой модели, появляются развитые рассуждения и агентные навыки. Вместо самостоятельного прохождения дорогого цикла компания может собрать удачные свойства нескольких американских систем.
Ранее в феврале Anthropic сообщила о промышленных кампаниях DeepSeek, Moonshot AI и MiniMax, которые, по версии компании, незаконно извлекали возможности Claude для улучшения собственных продуктов. На этой неделе Google Threat Intelligence Group (GTIG) зафиксировала новый всплеск атак на модели Google. Отдельные кампании превысили 100 миллионов запросов и охватывали понимание изображений и звука, а также генерацию изображений и видео.
По данным GTIG, прокси-инфраструктура автоматизирует запросы и перебрасывает их между тысячами скомпрометированных реквизитов и поддельных аккаунтов. Источник растворяется в потоке внешне нормальной активности, а стандартные ограничения перестают работать. NSA, CISA и FBI советуют незаметно изменять ответы на подозрительные запросы дистилляции, внедрять комплексное обнаружение и сопоставлять события между владельцами моделей, облачными платформами и API-агрегаторами. Иначе одна кампания выглядит как множество несвязанных клиентов.
Вице-президент Arctic Wolf по лабораториям, исследованию угроз и разведке Исмаэль Валенсуэла называет происходящее «злоупотреблением законным доступом». По его словам, распределённое уклонение напоминает массовую подстановку учётных данных и платёжное мошенничество, а противостоять ему можно лишь согласованно: противник хорошо обеспечен и технически подготовлен. Скопированные рассуждения и агентные функции способны питать наступательные кибероперации, кампании влияния и автономные инструменты, которые защитникам трудно отличить от легальных платформ.
Риск касается и компаний, предоставляющих клиентам либо партнёрам доступ к моделям. Их API-ключи и служебные аккаунты становятся товаром для посредников, а запросы с действительными реквизитами проходят как обычные. В результате промышленная дистилляция позволяет воспроизводить передовые американские возможности без затрат и правовых ограничений, возложенных на их создателей, а дальнейшее вредоносное применение такого заимствованного интеллекта всё хуже поддаётся распознаванию.


Новое на сайте

Ссылка