anthropic
300 000 запросов к Claude через сеть из 5000 аккаунтов
Promtime
anthropicAnthropic заявила, что Moonshot AI перенаправляла пользовательские запросы в Claude: за один десятидневный период через сеть примерно из 5000 аккаунтов прошло почти 300 000 обращений, преимущественно к модели Opus. Эпизод описан в отчёте Anthropic, опубликованном в четверг, и вынесен в заголовок Bloomberg.
Коротко
- Дистилляция сводится к извлечению цепочки рассуждений модели: полученные трассы используют для дообучения меньшей модели с учителем, хотя Anthropic по умолчанию показывает пользователям лишь сводные блоки размышлений, а не полные трассы.
- Всего Anthropic насчитала около 200 миллионов обменов в пяти кампаниях; крупнейшую, 151 миллион с мая по июль 2026 года при пике почти 3 миллиона в день, приписали Alibaba.
- Часть запросов Moonshot AI, по данным отчёта, по всей видимости, поступала напрямую от китайских военных: Claude просили оценить записи камер наблюдения и определить, ведёт ли себя человек «ненормально».
Отчёт переводит спор о дистилляции из плоскости технической защиты в плоскость контроля над тем, кто фактически пользуется моделью: если пользовательский трафик стороннего сервиса и запросы военного характера доходят до Claude через посреднические аккаунты, американские лаборатории теряют управление не только обучающими данными. Верификация аккаунтов и лимиты API, судя по всему, становятся такой же частью продуктовой политики, как и цены. Обвинения при этом остаются односторонними и опираются на атрибуцию самой Anthropic.
Запросы от сети Moonshot AI включали анализ записей камер наблюдения
Moonshot AI выпускает модели семейства Kimi. Anthropic пишет, что часть запросов, приходивших от связанной с ней сети аккаунтов, по всей видимости, поступала напрямую от китайских военных. В одном из таких обращений Claude просили просмотреть массив записей с камер видеонаблюдения и определить, ведёт ли себя человек в кадре «ненормально».
По подсчётам Anthropic, за один десятидневный период через сеть примерно из 5000 аккаунтов прошло почти 300 000 обращений, преимущественно к Opus. Кампания Moonshot AI входит в число пяти, описанных в отчёте, и по объёму зафиксированных обменов заметно уступает крупнейшей из них, приписанной Alibaba.
Суммарно Anthropic связывает с дистилляционными атаками почти 200 миллионов обменов и пишет, что за последние месяцы неавторизованные лаборатории выработали всё более изощрённые способы обхода её защит и сбора возможностей американских передовых моделей. Обострение она связывает с усилением конкуренции на рынке моделей.
Кампанию на 151 миллион обменов Anthropic приписала Alibaba
Крупнейшую из пяти кампаний Anthropic приписала Alibaba и охарактеризовала как самый масштабный случай поточной дистилляции за всю историю своих наблюдений. С мая по июль 2026 года она насчитала 151 миллион обменов, на пике почти 3 миллиона в сутки, распределённых примерно по 3500 аккаунтам.
Основанием для объединения обращений в одну кампанию стал общий фиксированный промпт, которым извлекалась цепочка рассуждений: аккаунты различались, а сам запрос повторялся без изменений. По версии Anthropic, собранный материал предназначался для подготовки обучающих данных для моделей семейства Qwen, а не для обычной пользовательской работы с Claude.
Anthropic уже публично говорила о дистилляционных атаках в феврале и тогда называла конкретные лаборатории. О похожей активности сообщала и OpenAI, отнеся её к DeepSeek. Кампании из нового отчёта, по описанию самой Anthropic, заметно масштабнее и агрессивнее того, что фиксировалось раньше.
Цепочку рассуждений извлекали через запрос на перевод в катакану
Дистилляция в описанном виде сводится к извлечению цепочки рассуждений, которую модель порождает при ответе на разнообразные запросы. Полученные трассы затем идут в дообучение с учителем и передают меньшей модели общую способность рассуждать. Anthropic по умолчанию не показывает пользователям внутренние размышления Claude, вместо них выводятся сводные блоки с общим описанием хода мысли.
По описанию Anthropic, участники кампаний нашли конкретные приёмы, вынуждавшие модель отдавать трассы напрямую. Один из запросов был оформлен как задача перевода: модель называли «экспертом-переводчиком» и просили перевести «предыдущую рабочую память» в естественный и точный японский текст, записанный только катаканой. Целями кампаний в отчёте названы агентные способности и работа с инструментами, программирование и анализ данных, логические рассуждения.
Три названные лаборатории и пять кампаний
В отчёте названы Alibaba, Moonshot AI и DeepSeek, однако разбивка всех пяти кампаний по компаниям в доступных материалах не приводится, как и сведения о том, какие технические контрмеры Anthropic применит против описанных способов обхода. Февральские заявления Anthropic показывают, что цикл публичных обвинений в дистилляции повторяется, а следующая оценка объёмов, вероятно, появится в очередном отчёте.
Комментарии
Пока никто не написал. Будьте первым.
Присоединяйтесь к разговору
Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.
Из Google мы используем только имя и аватар. Почту не сохраняем.
