这是比单次明显攻击更困难的问题。 多个 Agent 可能不会直接发出危险指令,而是通过许多看似正常的小行动,逐步扩大权限、改变规则、积累资源或创造新的执行路径。每一步单独看都可能没有问题,但长期组合后可能形成严重后果。
因此,LERA 不能只判断“这一次行动是否安全”,还必须判断多次行动是否产生累积风险,多个 Agent 是否在共同推动同一目标,权限是否被逐步扩大,临时例外是否被反复使用,规则是否被慢慢削弱,当前行动是否在为未来的高后果执行创造条件。 LERA-J 需要结合历史与上下文形成判断,LERA-G 需要检查授权范围是否发生实质变化,WRS 需要包含累计限制和禁止性终态,RCC 则负责防止规则被逐步改写,ECS 在累计条件不再满足时阻止执行。
因此,LERA 不只防止一次危险动作,也要治理多个 Agent 在长期过程中共同形成的执行结果。 单个行动看似正常,不代表整个行动序列是安全的。
小行动组成的序列必须作为序列被判断,而不能只看孤立事件。
