openai

AL-MUNAA раздаёт агентам «антитела» против инъекций

Promtime

openai

AL-MUNAA оборачивает рабочие процессы ИИ-агентов сканированием ввода и памяти, шлюзом действий и Threat Antibody Protocol. Когда один агент замечает атаку, он создаёт подписанный HMAC-отпечаток. Другой агент той же «семьи доверия» проверяет это «антитело» и блокирует изменённую версию атаки, не видя исходного секрета.

В демо незащищённый агент доходит до чтения секретов и их отправки. С AL-MUNAA шлюз останавливает опасный вызов до исполнения. Финальное решение всегда за детерминированной политикой, а GPT-5.6 через OpenAI Responses API только советует по спорным случаям.

Авторы честно ограничивают заявку: калибровочная матрица маленькая и синтетическая, готовность к продакшену не заявляется. По их данным, калиброванный матчер поймал 4 атаки из 4 при 0 ложных срабатываний из 5. Релиз v0.1.1 доступен на GitHub.

Комментарии

Пока никто не написал. Будьте первым.

Присоединяйтесь к разговору

Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.

Из Google мы используем только имя и аватар. Почту не сохраняем.