论文研究普通
上下文压缩如何破坏智能体安全规则
原始标题:If you keep safety rules or coding standards in an AGENTS.md or a CLAUDE.md, this one is worth your …
内容摘要
研究测量了20个生产级智能体配置中上下文压缩的实际破坏效果:Claude Code在Sonnet 4.6上经一轮压缩后仅保留53%的安全规则,五轮后降至10%。其提出的Knowledge Triage方案按类型分类知识库各行并分配独立保留策略,在任意压缩比下多保留2-4倍安全规则,五轮召回率达96%。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:Elvis Saravia (@omarsar0, DAIR.AI)
站内情报编号intel-48e5f259c5ffb579d7eed066