RecodeX 重构消息,Archestra团队发布名为OpenAPPA的确定性AI护栏方案,用于解决企业级AI代理在连接大量工具后可能失控并泄露敏感数据的问题。团队称,非确定性护栏(如LLM-as-a-judge)易受提示注入攻击,在其基准测试中约10%出现数据泄露;而Cedar、OPA、FIDES、Dogwood等现有确定性护栏需大量定制化策略,导致代理效用损失约59%。

OpenAPPA采用面向数据而非面向用例的策略语言,并加入补救计划、DualLLM模式等机制,团队称可将代理效用从约40%提升至约90%,并可通过工具调用前后的钩子接入任意代理循环。相关基准测试与学术论文已公开。