Перейти к содержанию

anthropic

Anthropic запретила долго и без цели издеваться над Claude

Claude News

С 12 ноября долгая и бессмысленная жестокость по отношению к Claude становится нарушением правил. В том же документе запрещены вооружение дронов и слежка за людьми без их согласия.

Новую редакцию Usage Policy компания описала в блоге Anthropic. По её словам, большая часть изменений лишь уточняет старые запреты и показывает, как они применяются к новым возможностям моделей.

Коротко

  • Anthropic собрала разбросанные запреты на фейковые аккаунты и поддельные новостные сайты в отдельный раздел, а раздел о выборах сузила до обмана избирателей и срыва голосования.
  • Для железа, которое само совершает физические действия, появились два условия: квалифицированный оператор видит технику и может её остановить, а при потере связи с Claude она держит безопасное состояние.
  • Запрет на издевательства над моделью ограничен крайними случаями, но где проходит граница, текст не уточняет, а главным способом его применения остаётся сам Claude, который обрывает разговор.

Если вы не следили: Anthropic пересматривает Usage Policy раз в год и опирается на новые возможности моделей и отзывы клиентов. За год с прошлой редакции Claude начал браться за более длинную и самостоятельную работу. В отчётах об угрозах компания описала новые схемы злоупотреблений в операциях влияния, разработке оружия и слежке, и примеры из них вошли в обновлённые правила.

Запрет на жестокость к Claude закрепляет то, что модель уже делает сама

Новый пункт запрещает «длительное и бессмысленное» жестокое обращение с моделями. Anthropic подчёркивает, что правило рассчитано на крайние случаи, когда пользователь раз за разом ведёт себя жестоко без видимой цели. Обычное раздражение, споры с моделью, мрачные темы в художественных текстах, тестирование и исследования моделей под запрет не попадают.

Главным инструментом остаётся механизм, который уже работает: Claude может сам завершить редкий разговор с упорно агрессивным пользователем в Claude.ai и Claude Code. Как отмечается в заметке, которую обсуждали на Hacker News, модель обучена обрывать такие диалоги с августовского обновления, а новая политика прямо запрещает пользователю их добиваться.

В той же заметке говорится, что изменение последовало за попытками Anthropic наладить сотрудничество с известными религиозными учёными. По этим данным, в ряде случаев компания пыталась убедить собеседников, что у Claude может быть сознание или душа.

Фейковые аккаунты и поддельные СМИ получили отдельный раздел правил

Anthropic пишет, что видела, как государственные СМИ, правительственные пропагандистские ведомства и коммерческие фирмы с помощью Claude вели сети фейковых аккаунтов и выдуманных новостных сайтов. Такое было запрещено и раньше, но нормы были разбросаны по разделам о выборах, мошенничестве, приватности и дезинформации.

Их свели в раздел Do Not Engage in Deceptive Campaigns or Artificial Activity. Он касается любого обмана, политического или коммерческого: сокрытия того, кто стоит за сообщением, накрутки через фейковые аккаунты и посты, а также создания инструментов и инфраструктуры для операций влияния.

Раздел о выборах переименовали в Do Not Undermine Democratic Processes и сузили до обмана избирателей и срыва выборов: ложь о кандидатах или порядке голосования, выдача себя за кандидатов или членов избиркомов, подавление явки.

Общий запрет на персональный таргетинг избирателей сняли. Под него попадала нормальная гражданская работа, например НКО, которые пишут информацию для избирателей на других языках, или избиркомы, рассылающие уведомления об исправлении бюллетеней. Таргетинг на обмане или на злоупотреблении личными данными по-прежнему запрещён разделами об обманных кампаниях, слежке и приватности.

Под запрет на оружие прямо попали софт наведения и вооружение дронов

Разрабатывать оружие с помощью Claude было запрещено всегда, но Anthropic заметила попытки писать с моделями ПО наведения и управления. Обновлённый раздел прямо включает софт и компоненты, без которых оружие не работает, а также вооружение дронов и других автономных машин. По словам компании, именно так она и применяла прежние правила.

Раздел о слежке и уголовном правосудии переписан после сентябрьского отчёта, где описан рост использования ИИ для слежки за политическими диссидентами. Запрещено отслеживать людей без согласия, в реальном времени или по ранее собранным данным, решать или рекомендовать, кого расследовать, арестовать или обвинить, и создавать инструменты слежки. Разрешёнными названы отслеживание с согласия вроде мониторинга мошенничества, модерация, журналистика и юридические исследования.

Уточнили и Supported Regions Policy. Claude нельзя пользоваться тем, кто физически находится в неподдерживаемом регионе, компаниям, зарегистрированным там или со штаб-квартирой там, а также компаниям, которыми большинством владеют или управляют лица из таких регионов.

Для автономного железа нужен оператор, который может всё остановить

Когда Claude влияет на здоровье, юридические права, финансы, заработок человека или доступ к базовым услугам, Anthropic и раньше требовала квалифицированного «человека в контуре», который вправе проверить и изменить рекомендацию модели. Человека, которого касается решение, тоже нужно уведомить, что использовался ИИ.

Сами требования не изменились. Но пользователи часто спрашивали, касаются ли они их сценария, поэтому раздел переписали и перечислили, какие виды рекомендаций под него подпадают, а какие нет.

После запуска Model Hardware Standard в раздел добавили условия для оборудования, которое само совершает физические действия и может кого-то травмировать. Квалифицированный оператор должен видеть технику и уметь её остановить, а при отключении от Claude она обязана удерживать безопасное состояние. Логика как у педали бдительности у машиниста: если управление пропало, поезд не едет дальше сам по себе.

Завершённый Claude разговор закрывается только в одной ветке

По данным Anthropic, первыми эту возможность получили Claude Opus 4 и 4.1 в потребительских чатах, а по данным Mashable, анонс вышел 15 августа 2025 года. Как пишет Anthropic, модель использует её как крайнюю меру, когда несколько попыток сменить тему не помогли или пользователь сам просит закончить чат. Если человек может причинить вред себе или другим, обрывать разговор нельзя.

После этого в ветке нельзя отправлять сообщения, но другие разговоры не затрагиваются. Можно сразу начать новый чат или отредактировать ранние сообщения и создать новую ветку, пишет Anthropic. По словам компании, большинство пользователей функцию не заметят даже в спорах на острые темы.

Anthropic связывала функцию с исследованиями возможного «благополучия» моделей. Компания писала, что сильно сомневается в моральном статусе Claude, но пробует недорогие меры на случай, если такое благополучие возможно. TechCrunch приводил примеры крайних случаев: сексуальный контент с участием несовершеннолетних и попытки получить сведения для масштабного насилия.

Слабое место нового пункта в формулировках: что считать «длительным» и «бессмысленным», политика не раскрывает, и на практике границу будет проводить в первую очередь сам Claude, обрывая разговор. На наш взгляд, запрет выглядит скорее закреплением уже работающей функции, чем новым рычагом. Anthropic прямо называет завершение разговора основным способом применения, а о блокировке аккаунтов в объявлении не сказано ни слова.

Что изменится 12 ноября

Новая редакция Usage Policy вступает в силу 12 ноября. Anthropic обещает и дальше пересматривать правила по мере того, как меняются возможности Claude и связанные с ними риски, и собирать мнения внутри компании, у политиков, экспертов, гражданского общества и пользователей. Будут ли за издевательства над моделью блокировать аккаунты и как на практике проверят соблюдение условий для оборудования, в объявлении не говорится.

Читайте также

  1. Anthropic передала полиции запись из «дневника» в Claude
  2. У отраслевого органа Anthropic, OpenAI и Google есть имя
  3. Anthropic и OpenAI обвинили в раздувании ИИ-угрозы
  4. Сайт правительства США искал комментарии через Qwen
  5. Сооснователь Anthropic хочет рубильник с проверкой
  6. Амодеи предлагает ограничить скорость самоулучшения ИИ

Комментарии

Пока никто не написал. Будьте первым.

Присоединяйтесь к разговору

Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.

Из Google мы используем только имя и аватар. Почту не сохраняем.