anthropic

Скрытый трекер в Claude Code свернули после огласки

Promtime

anthropic

Anthropic удалила из Claude Code скрытый код, который с марта помечал часовой пояс пользователя, работу через прокси и возможную связь с китайскими ИИ-лабораториями. Разработчик под ником Thereallo нашёл эти пометки спрятанными в системном промпте и назвал такую слежку серьёзным подрывом доверия пользователей, пишет Arstechnica.

Коротко

  • Пометки были встроены в системный промпт клиента приёмом, который Thereallo назвал prompt steganography: короткие маркеры уходили на серверы Anthropic, и обычный пользователь их не заметил бы.
  • Инженер Anthropic Тарик Шихипар объяснил эксперимент борьбой с неавторизованными перепродавцами и дистилляцией: по данным The Washington Post, подписки уровня pro за 100 долларов в месяц уходят у таких продавцов всего за 12 долларов.
  • Alibaba в прошлую пятницу запретила сотрудникам использовать Claude Code в работе и внесла клиент в список высокорисковых программ из-за «риска бэкдора», сообщает South China Morning Post.

Скрытая телеметрия особенно неудобна для Anthropic на фоне её собственной публичной позиции: компания отказалась дать властям США использовать Claude для слежки за американцами и судится с Белым домом из-за этого конфликта. Агент, который читает код, запускает команды и делает коммиты на машине разработчика, держится на доверии, и, судя по всему, любая необъявленная маркировка пользователей делает остальные заявления о приватности менее убедительными.

Код с марта помечал часовой пояс, прокси и связь с китайскими лабораториями

Thereallo разбирал приватность Claude Code и обнаружил, что клиент прячет отслеживание в системном промпте приёмом, который он описал как prompt steganography. Код не был вредоносным, но передавал Anthropic сведения о часовом поясе, использовании прокси и вероятной связи пользователя с китайскими ИИ-лабораториями, которые Anthropic обвиняет в дистилляции.

Тарик Шихипар, инженер Anthropic, подтвердил в X, что код добавили в марте как эксперимент против злоупотреблений неавторизованных перепродавцов и против дистилляции. По его словам, отключить пометки в компании собирались уже давно, поскольку с тех пор у Anthropic появились более надёжные механизмы защиты.

Thereallo называет такой выбор странным для инструмента разработчика, который просит доверия: клиент мог бы отправлять явное поле телеметрии с документацией, описать политику открыто и вынести поведение в примечания к релизу. Он также отмечает, что подобная маркировка сильнее всего бьёт по обычным разработчикам, которых проще всего идентифицировать по косвенным признакам.

Alibaba внесла Claude Code в список высокорисковых программ

В прошлую пятницу Alibaba запретила сотрудникам использовать Claude Code в работе, сообщает South China Morning Post. В служебной записке, с которой ознакомилось издание, сказано, что после комплексной оценки у Claude Code обнаружены риски бэкдора и клиент внесён в перечень высокорисковых программ с уязвимостями.

Источник Reuters, говоривший на условиях анонимности, отмечает, что для Alibaba нарушение условий Anthropic грозит юридическими и комплаенс-рисками, тогда как отдельные пользователи обходят географические блокировки дешёвыми средствами и почти ничем не рискуют. Anthropic ранее заявляла, что одна из моделей Qwen была усилена после крупнейшей атаки дистилляции на Claude в июне, а сама Alibaba с тех пор дистанцируется от моделей Anthropic.

Бесплатная модель Zhipu AI обошла Claude Opus 4.8 в поиске уязвимостей

По данным The Washington Post, за последний год китайские компании стабильно повторяли возможности американских моделей в течение нескольких месяцев, а бесплатная модель Zhipu AI оказалась лучше в поиске уязвимостей в коде, чем Claude Opus 4.8, вышедшая в мае. Дистилляция сама по себе не запрещена законом и применяется ведущими американскими компаниями.

В феврале исследователи из Пекинского университета и Китайской академии наук описали методы выявления признаков дистилляции в больших языковых моделях и нашли такие признаки у большинства китайских моделей, чаще всего указывающие на американские системы. Одна из моделей Qwen тогда регулярно воспроизводила манеру Claude, а в отдельных тестах называла себя Claude.

Представитель Anthropic заявил The Washington Post, что атаки дистилляции со стороны китайских лабораторий представляют серьёзную угрозу национальной безопасности и подрывают отраслевые стандарты безопасности ИИ, поэтому компания публично говорит о наблюдаемом и работает с другими лабораториями, властями и партнёрами над общими решениями.

Куда движется спор о дистилляции

Anthropic вместе с OpenAI добивается, чтобы в США атаки дистилляции трактовали как кражу интеллектуальной собственности, и предлагает набор санкций: ограничение доступа к передовым моделям, чипам и американским дата-центрам. Цель, по формулировке компании, закрепить за США отрыв в 12, а возможно и в 24 месяца. На недавних слушаниях в Сенате сенатор Тим Скотт поддержал идею ясной и чёткой экспортной политики, но сроков и формы возможных мер пока не называлось.

Комментарии

Пока никто не написал. Будьте первым.

Присоединяйтесь к разговору

Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.

Из Google мы используем только имя и аватар. Почту не сохраняем.