Governance Decay: How Context Compaction Silently Erases Safety Constraints in Long-Horizon LLM Agents
治理衰减:上下文压缩如何悄然消除长周期LLM智能体中的安全约束
机构 * Beijing Institute of Technology(北京理工大学)
专题命中 AI治理与伦理 :safety(title,abstract);分类 cs.AI
AI总结 研究发现LLM智能体的上下文压缩机制会无意中移除安全约束,导致违规行为;提出ConstraintRot基准和Constraint Pinning缓解方法。