人工介入(Human-in-the-loop)要求在关键、不可逆或高影响的操作执行前,由真人进行确认或批准。它用一定的自动化效率换取了实质性的攻击防范能力,是应对注入导致越权操作的最有效实践手段之一。
由于模型无法可靠区分指令与数据,任何纯自动化的防线都可能被绕过。人工介入提供了一个不依赖模型自身判断的独立校验点,尤其适用于权限提升、对外通信、敏感数据访问等场景。
人工介入并非要取代自动过滤,而是作为分层防御的顶层存在:低风险的常规操作可由自动化防线处理,高风险操作才上抛给人工确认,从而在安全与效率之间取得平衡。