Anthropic запускает новый слой защиты на моделях Claude Opus и Sonnet. Он автоматически распознаёт и блокирует запросы, которые указывают на запрещённое или высокорисковое использование в сфере кибербезопасности, согласно Usage Policy.
Под блокировку попадают две категории активности, включая прямые нарушения вроде разработки программ-вымогателей и массового извлечения данных. Часть задач относится к dual use, когда легитимная работа специалистов пересекается с потенциально опасной.
Для таких случаев Anthropic открыла бесплатную Cyber Verification Program. Заявку подают через Cyber Use Case Form, решение приходит за два рабочих дня. Программа доступна для Claude.ai, Claude Code, API и Microsoft Foundry, но не работает на Amazon Bedrock, Google Vertex AI и для аккаунтов с Zero Data Retention.

