Agentic AI Governance: как дать агенту автономию и не пустить инъекцию в банковский перевод

Автономия агента — не тумблер, а градация по риску. Архитектура policy-gated action loop, HITL для необратимого и kill-switch как штатный режим.

Пока модель генерирует текст, худшее, что может случиться — неверный ответ. Как только модель начинает действовать, её власть и видимость становятся поверхностью атаки. Инъекция из письма превращается не в плохой ответ, а в выполненный перевод денег.

Continue reading “Agentic AI Governance: как дать агенту автономию и не пустить инъекцию в банковский перевод”