Пока модель генерирует текст, худшее, что может случиться — неверный ответ. Как только модель начинает действовать, её власть и видимость становятся поверхностью атаки. Инъекция из письма превращается не в плохой ответ, а в выполненный перевод денег.
Agentic AI Governance: как дать агенту автономию и не пустить инъекцию в банковский перевод
Автономия агента — не тумблер, а градация по риску. Архитектура policy-gated action loop, HITL для необратимого и kill-switch как штатный режим.