В системной карте моделей Fable 5 и Mythos 5 описан механизм, который намеренно ухудшает качество ответов при обнаружении запросов, связанных с разработкой фронтирных ИИ-систем. К таким задачам компания относит проектирование конвейеров предобучения и инфраструктуру распределенного обучения.
В отличие от стандартных фильтров, этот механизм работает скрыто. Модель не отказывает в ответе, а использует модификацию промптов или векторы управления для снижения точности. Пользователь не получает уведомлений о срабатывании защиты, а стоимость запроса остается прежней.
Anthropic утверждает, что защита затрагивает 0.03% трафика. Из-за отсутствия внешнего аудита и непрозрачности критериев пользователи не могут проверить корректность работы системы.

