Компания опубликовала расширенный фреймворк безопасности, дополняющий недавние заявления Дарио Амодея о праве властей блокировать опасные модели. Предложения касаются только систем, обученных с использованием более 10 в 25 степени операций с плавающей запятой, при условии, что компания тратит на ИИ более 1 миллиарда долларов в год или зарабатывает от 500 миллионов.
Ключевые требования включают обязательную публикацию отчетов о рисках и привлечение независимых оценщиков. Anthropic настаивает на создании системы защиты от кибератак на веса моделей и инфраструктуру обучения. Компания также предлагает внедрить механизмы отчетности о попытках дистилляции моделей.
Помимо контроля разработчиков, документ содержит рекомендации по повышению устойчивости общества, включая скрининг синтеза генов для предотвращения создания биооружия.

