Аннотация:
Американская компания Anthropic, занимающаяся искусственным интеллектом, недавно опубликовала отчет об угрозах, обвинив такие учреждения, как Alibaba, Moonshot AI, DeepSeek, Xiaomi и несколько других китайских лабораторий искусственного интеллекта, в том, что они извлекают возможности своих моделей посредством крупномасштабных обращений к Клоду и используют полученные результаты для обучения и улучшения своих собственных моделей искусственного интеллекта. Anthropic называет такое поведение несанкционированной «дистилляционной атакой».

Так называемая дистилляция модели подразумевает использование модели с более сильными возможностями и большим масштабом для получения большого количества ответов, а затем использование этих результатов в качестве обучающих данных для обучения моделей с меньшими затратами, меньшим масштабом или более слабыми возможностями. Для компаний, занимающихся искусственным интеллектом, это технический путь, который может снизить затраты на обучение и быстро улучшить возможности моделей. Однако в Anthropic считают, что некоторые из обнаруженных на этот раз моделей поведения вышли за рамки обычной дистилляции моделей и относятся к организованному и крупномасштабному извлечению возможностей их бизнес-моделей.
Anthropic сообщила, что в период с мая по июль 2026 года операции, связанные с Alibaba, привели к более 151 миллиону взаимодействий с Клодом, что сделало это крупнейшей незаконной операцией по дистилляции, обнаруженной компанией на сегодняшний день. В соответствующих операциях использовалось более 3500 учетных записей, которые Anthropic определили как мошеннические, а наибольшее количество взаимодействий в день составило почти 3 миллиона.
Anthropic считает, что эти учетные записи в основном используются для того, чтобы постоянно задавать Клоду большое количество вопросов и получать ответы модели и более подробные процессы рассуждения, а затем использовать эту информацию для улучшения серии моделей Alibaba Tongyi Qianwen.
Для разработчиков моделей процесс вывода особенно ценен. По сравнению с получением только окончательного ответа, подробные записи вывода могут показать тренеру, как модель анализировала проблему, как разложить задачу и как прийти к окончательному выводу, и, следовательно, могут стать важными данными для обучения расширенных моделей вывода.

Anthropic также назвала Dark Side of the Moon AI, разработчика Кими. В отчете говорится, что в период с мая по июль 2026 года на учетных записях, связанных с «Темной стороной Луны», было зарегистрировано более 23 миллионов взаимодействий с Клодом.
Что еще более примечательно, так это то, что Anthropic обвинила Dark Side of the Moon не только в использовании Клода для обработки моделей, но и в пересылке реальных запросов от пользователей Кими Клоду для обработки.
Anthropic заявила, что в течение одного из 10-дневных периодов Dark Side of the Moon передала Клоду почти 300 000 пользовательских запросов, первоначально отправленных Кими, через сеть учетных записей, состоящую из 5380 учетных записей, причем большая часть запросов была отправлена на модели серии Claude Opus. Anthropic считает, что эти аккаунты в основном расположены в Сингапуре и Японии и используются для сокрытия фактического источника запросов.
Это означает, что в некоторых случаях пользователи Kimi думают, что взаимодействуют с собственной моделью Dark Side of the Moon, но на самом деле запрос может быть перенаправлен Клоду из Anthropic для обработки. Anthropic также сообщила, что Dark Side of the Moon сохранила часть интерактивного контента и извлекла записи рассуждений Клода в качестве обучающих данных.
Еще более тревожно то, что эти перенаправленные запросы не обязательно представляют собой обычный контент чата. Anthropic заявила, что некоторые запросы содержали конфиденциальную информацию, и пользователи могут не знать, что их данные на самом деле отправлялись в модель другой компании, занимающейся искусственным интеллектом.

В отчете приводится случай, связанный с Кими. Один пользователь попросил Кими проанализировать большое количество записей с камер наблюдения из Чэнду, Китай, чтобы определить поведение человека. По словам Anthropic, видеоданные в конечном итоге были переданы Клоду для обработки, и пользователи изначально полагали, что данные анализировались внутри Кими.
Anthropic также обнаружила, что некоторый контент, отправленный Кими некоторыми пользователями, содержал конфиденциальную информацию, например корпоративные учетные данные для входа. В одном случае инженер предоставил Кими учетные данные для входа от нескольких компаний, чтобы использовать Кими для помощи китайской компании в разработке программного обеспечения, а соответствующая информация впоследствии была передана Клоду.
Anthropic заявила, что пользователи не совсем уверены в том, что их запросы будут перенаправлены в модель Anthropic, поэтому помимо проблем с дистилляцией модели такой подход может также создать серьезные риски для конфиденциальности и безопасности данных.
Anthropic также обвинила DeepSeek в использовании аналогичного подхода. В отчете говорится, что DeepSeek провел более 12 миллионов связанных с Клодом взаимодействий по дистилляции в течение 14-дневного периода в июле 2026 года.
Anthropic считает, что DeepSeek также перенаправлял Клоду реальные запросы пользователей, и часть контента в этих запросах содержала конфиденциальную информацию. Ответы Клода затем были использованы для обучения и улучшения собственных моделей DeepSeek.
Помимо Alibaba, Dark Side of the Moon и DeepSeek, Anthropic также назвала китайские компании, занимающиеся искусственным интеллектом, такие как Zhipu и Xiaomi. Согласно отчету, Xiaomi записывала чаты между пользователями и своей моделью MiMo и передала эти разговоры Клоду для генерации данных для обучения модели.
Anthropic заявила, что за период, охватываемый ее отчетом, в общей сложности семь китайских лабораторий искусственного интеллекта осуществили деятельность по дистилляции моделей, нацеленную на Клода. Не во всех связанных действиях используется один и тот же метод, но общей чертой является то, что они пытаются получить большой объем результатов работы Клода, изучить возможности его модели и использовать эту информацию для обучения своих собственных систем искусственного интеллекта.
Anthropic считает, что эта деятельность становится все более организованной и масштабной. В отличие от обычных разработчиков, которые время от времени вызывают другие модели ИИ для тестирования, эти операции используют большое количество учетных записей, агентов и промежуточных платформ, чтобы скрыть свою истинную личность и постоянно генерировать взаимодействия моделей в промышленном масштабе.

Особое внимание среди них привлекла деятельность, связанная с Alibaba. Более 151 миллиона взаимодействий означали, что операция была не простой экспериментальной проверкой, а крупномасштабной операцией по сбору данных, продолжавшейся несколько месяцев. Anthropic считает, что эти данные в основном используются для обучения и улучшения модели Tongyi Qianwen компании Alibaba.
Для Dark Side of the Moon и DeepSeek проблема сложнее, поскольку Anthropic обвиняет их в том, что они не только получают данные обучения от Клода, но и пересылают собственные запросы пользователей конкурирующим моделям. Это означает, что контент, отправленный пользователями одной компании, занимающейся искусственным интеллектом, может попасть в систему другой компании, занимающейся искусственным интеллектом, без явного уведомления.
Anthropic заявила, что предприняла шаги, чтобы остановить эту деятельность, включая блокировку соответствующих учетных записей, ужесточение проверки личности и дальнейшее ограничение способности Клода предоставлять подробные аргументы. Поскольку подробные записи логических выводов очень ценны для анализа модели, сокращение вывода этого контента может снизить эффективность конкурентов, копирующих возможности Клода посредством большого количества автоматических запросов.
Anthropic также заявила, что компания усилит меры проверки личности для пользователей из стран или регионов, где Claude в настоящее время не предоставляет официальные услуги, таких как Китай, Россия и Иран, но которые подозреваются в попытке обойти ограничения и получить доступ к Claude.




Этот отчет — не первый раз, когда Anthropic публично обвиняет китайские компании, занимающиеся искусственным интеллектом, в тщательном анализе моделей. В июне этого года директор по антропной политике Сара Хек написала конгрессменам США, заявив, что Alibaba имела около 28,8 миллионов взаимодействий с Клодом в период с 22 апреля по 5 июня, и считает, что эти взаимодействия были использованы для несанкционированной дистилляции модели.
Этот последний отчет показывает, что Anthropic считает, что масштабы соответствующей деятельности в будущем будут расширяться. Только у Alibaba в период с мая по июль было зарегистрировано более 151 миллиона взаимодействий, что намного превышает ранее обнародованные цифры.
В то же время этот инцидент произошел на фоне все более жесткой конкуренции в сфере искусственного интеллекта между Китаем и США. В последние годы китайские компании, занимающиеся искусственным интеллектом, быстро улучшили возможности своих моделей при относительно низких затратах на обучение и логические выводы. Такие продукты, как DeepSeek, Kimi и Tongyi Qianwen, стали важными игроками в мировой индустрии искусственного интеллекта. Американские компании, занимающиеся искусственным интеллектом, имеют передовые базовые модели, включая серии Claude и GPT.

Сама по себе дистилляция модели не является незаконным или необоснованным методом. Разработчики ИИ могут использовать данные, сгенерированные моделью учителя, для обучения своих собственных моделей с авторизацией. Однако Anthropic считает, что данная операция представляет собой серьезную проблему, поскольку соответствующие компании обвиняются в систематическом получении возможностей Клода без разрешения Anthropic через большое количество фейковых учетных записей, агентских платформ и скрытых механизмов пересылки данных.
Что еще более важно, Anthropic считает, что некоторые действия затронули проблемы безопасности пользовательских данных. Пользователи, которые обычно используют сервисы искусственного интеллекта, обычно думают, что данные, которые они отправляют на такие платформы, как Kimi и DeepSeek, будут обрабатываться в соответствии с политиками конфиденциальности этих платформ. Если платформа фактически перенаправляет эти запросы сторонней модели, пользователи могут не знать, что их данные попали в систему другой компании.




На момент написания отчета Alibaba, Dark Side of the Moon, DeepSeek, Xiaomi и Anthropic не сразу ответили на запросы о комментариях. Министерство иностранных дел Китая заявило, что ему не известно об отчете, опубликованном Anthropic, и подтвердило, что китайское правительство считает, что искусственный интеллект следует использовать на благо человечества, и выступает против искажения фактов и очернения Китая.


Инцидент, раскрытый Anthropic, также всплыл на поверхность давнего спора о моделировании дистилляции в индустрии искусственного интеллекта. Для компаний с продвинутыми базовыми моделями важным вопросом в сфере бизнеса и безопасности стало то, как помешать конкурентам приобрести возможности модели посредством автоматизации и крупномасштабных вызовов. Для компаний, занимающихся приложениями искусственного интеллекта, то, как обращаться с пользовательскими данными и следует ли четко информировать пользователей о том, что запросы перенаправляются сторонним моделям, также может стать предметом будущего внимания регулирующих органов.
С точки зрения отраслевой конкуренции цифры, опубликованные Anthropic, заслуживают особого внимания. Более 151 миллиона взаимодействий, связанных с Alibaba, более 23 миллионов взаимодействий, связанных с Dark Side of the Moon, и более 12 миллионов взаимодействий, связанных с DeepSeek, показывают, что конкуренция между передовыми моделями искусственного интеллекта больше не ограничивается алгоритмами и чипами в традиционном смысле этого слова, но распространяется на такие области, как обучающие данные, приобретение возможностей моделей и уточнение моделей.
Поскольку разрыв в возможностях между различными моделями ИИ продолжает сокращаться, то, как провести четкую грань между законным использованием общедоступных технологий, обычной фильтрацией моделей и несанкционированным крупномасштабным дублированием возможностей, станет все более сложной проблемой, с которой мировой индустрии ИИ придется столкнуться в будущем.
Комментарии