上下文退化诊断
定位并缓解长上下文中的注意力丢失、污染、干扰、混淆与冲突。
技能主要提供诊断、过滤、隔离和截断建议,没有凭据访问、外部写入或破坏性默认操作,权限风险较低;但未明确敏感数据处理、用户确认、回滚边界或完整数据流,且来源归因主要停留在作者和概括性研究引用,因此扣分。
SKILL.md、参考文档和脚本在概念上基本一致,并提供异常模式和恢复建议;但脚本使用random.random导致结果不确定,注意力仅为模拟值,部分示例依赖未定义函数,且未见覆盖该技能关键路径的专门测试,因此按静态上限保守扣分。
触发条件、非适用范围、五类退化模式和四桶缓解框架较清楚,适合长上下文代理诊断;但输入输出契约、模型边界、中文使用说明和中国大陆网络环境适配未明确,且若干阈值具有较强泛化表述,因此扣分。
文档分层较好,包含激活条件、详细主题、实践框架、示例、陷阱、集成关系、脚本和版本日期;但安装依赖、脚本使用方式、已知限制、变更记录及维护责任不完整,引用路径和实际发布结构也存在描述不一致风险,因此未给满分。
技能提供可直接采用的诊断流程、恢复步骤和示例代码,能完成核心的概念指导;但脚本输出依赖启发式和随机模拟,无法可靠代表真实模型注意力或毒化状态,实际生产使用仍需较多验证和改造,因此按静态上限给中等分数。
存在参考文档、脚本、仓库级CI和若干研究名称,提供了一定可审计材料;但提供的CI未覆盖该技能脚本关键路径,未见该技能专门测试、固定输出或多来源逐条证据,且引用缺少可核验的内联出处,因此扣分。
- 脚本的注意力分布是随机模拟,不应被当作真实模型注意力测量结果。
- 默认只分析前1000个分词,但可能使用更长上下文中的关键位置,可能导致诊断失真。
- 毒化检测主要依赖关键词和简单冲突模式,误报和漏报风险较高。
- SKILL.md中的研究结论和阈值需要针对具体模型、任务和版本重新基准测试。
- 发布者身份未通过FollowSkills企业注册表验证,维护责任和更新路径应另行确认。
这个 Skill 能做什么,适合哪些场景?
这是一个用于诊断和缓解 Agent 上下文退化的通用 Agent Skill。它覆盖 lost-in-the-middle、上下文污染、上下文干扰、任务混淆和信息冲突五类模式,并提供检测信号、恢复流程与架构应对策略。建议将上下文退化视为可测量的工程问题,通过基准测试、上下文整理、压缩和任务隔离控制风险。它适合需要可靠处理长对话、检索内容和工具输出的 Agent 系统。
它根据 Agent 输出质量下降、错误工具调用、忽略已提供信息、任务要求混杂或相互矛盾等信号,帮助识别具体的上下文退化模式;指导用户把关键信息放在上下文开头或结尾、过滤无关文档、追踪声明来源、移除污染内容、标注冲突并设定来源优先级;同时提供 Write、Select、Compress、Isolate 四类缓解策略,以及渐进式上下文测试和提前压缩的设计建议。
- Agent 在长对话中开始忽略早先指令或与上下文中的事实矛盾时,用它排查 lost-in-the-middle。
- 检索文档或工具输出进入上下文后,Agent 持续引用错误事实时,用它定位并恢复上下文污染。
- RAG 系统加载大量候选文档后相关任务表现下降时,用它设计相关性过滤和即时检索。
- 同一会话切换多个目标后,Agent 混用约束或调用错误工具时,用它规划任务隔离和上下文重置。
- 不同版本或来源提供相互矛盾但各自合理的信息时,用它建立冲突标注和来源优先级。
- 需要为生产 Agent 找到上下文退化阈值时,用它设计逐步增大上下文的测试方案。
这个 Skill 有哪些优点和局限?
- 覆盖五种明确区分的上下文退化模式,并为每种模式提供检测信号和恢复建议。
- 提供可执行的上下文布局、来源追踪、相关性过滤、冲突处理和任务隔离思路。
- 包含模型阈值、干扰文档和 needle-in-a-haystack 测试局限等实际工程注意事项。
- 技能正文仅使用通用 Agent Skills 指令,没有平台专属前置字段。
- 提供的 SKILL.md 本身没有自动化诊断脚本、监控实现或测试套件。
- 部分经验阈值依赖模型版本和具体任务,不能直接视为通用保证,需要自行重新基准测试。
- 正文引用了仓库内的 patterns.md 和外部研究,但采用该技能时这些材料是否同步可用取决于安装方式。
- 它主要负责诊断和缓解决策;压缩、文件外置、评估和多 Agent 隔离的具体实现由相邻技能负责。
如何安装这个 Skill?
从仓库中复制整个技能目录,而不是只复制 SKILL.md:
mkdir -p .codex/skills
cp -R skills/context-degradation .codex/skills/
也可以复制到 .claude/skills/ 或 .agents/skills/。仓库说明要求保留目录结构,以支持相对 references/ 路径。
如何使用这个 Skill?
在支持 Agent Skills 的客户端中,让 Agent 处理与长上下文退化相关的任务,例如:
“分析这个 Agent 在长对话中忽略早期事实的原因,判断是否属于 lost-in-the-middle,并提出检测和缓解方案。”
当任务涉及上下文机制基础、已确认退化后的 token 优化、摘要压缩或文件系统外置时,应转交仓库中对应的相邻技能。