开发与工程 context-offloadingdynamic-discoveryplan-persistencemulti-agent-handofffilesystem-memoryterminal-logs

文件系统上下文工程

将大型、持久或共享的代理上下文移入文件,按需检索以减少上下文压力。

FollowSkills 评估 · FSRS-2.0
不推荐
45/ 100 五分制 2.3 / 5
信任安全9 / 25 · 1.8/5

文档明确提示清理、竞态、路径和自修改风险,并建议隔离目录、验证和保留策略;但示例包含无确认的文件写入/删除、自修改持久化,以及参考代码中的 shell=True 任意命令执行,缺少权限边界、用户确认、敏感数据策略和回滚,因此扣分。

可靠稳定7 / 20 · 1.8/5

SKILL.md、参考实现和 scripts/filesystem_context.py 提供了可理解的核心路径,但覆盖范围不一致,错误处理、并发安全、文件大小与路径失败反馈有限,且没有针对该技能关键路径的专门测试;静态校准下不超过10分,因此扣分。

适用触发10 / 15 · 3.3/5

触发条件、适用场景和与相邻技能的边界描述较清楚,覆盖 scratchpad、计划持久化和多代理文件协作;但依赖宿主 filesystem 工具能力,未明确输入输出契约、非适用环境及中文支持,故未给满分。

规范维护9 / 15 · 3.0/5

文档结构清晰,包含渐进披露、模式、示例、Gotchas、参考资料、版本、更新时间、作者和 MIT 许可;但维护责任、变更记录、依赖安装和更新路径不完整,且部分外部资源仅以名称列出,故扣分。

有效结果6 / 15 · 2.0/5

该技能为文件卸载、计划保存和工具输出处理提供了可直接改造的 Python 实现,能覆盖核心场景;但完整 SKILL.md 中的多代理、动态加载、终端和自修改模式并未全部落实到配套脚本,且仍需集成、权限设计和验证,静态上限为7分,因此扣分。

证据核验4 / 10 · 2.0/5

存在配套源码、示例和仓库级 CI/验证流程,但 CI 未显示覆盖 filesystem-context 的专门测试,外部研究和效果指标缺少本技能级别的可复核证据;仅达到有限可审计证据,静态上限为5分,故扣分。

证据充分度: 评估于 2026年7月20日 审查版本 c578e85e40fe
使用前请注意
  • 参考实现中的 TerminalCapture 使用 shell=True,若接收不可信命令输入可能造成命令注入;调用前必须限制命令来源和权限。
  • scratch cleanup 会删除过期文件,且示例写入相对路径;应增加用户确认、目录隔离、敏感数据排除、保留策略和可恢复备份。
  • 配套脚本只实现部分文档模式,未见该技能专门测试;部署前应补充边界、并发、路径失败和数据完整性测试。
查看完整评分方法 →

这个 Skill 能做什么,适合哪些场景?

这是一个面向文件后备上下文管理的 Agent Skill,适用于暂存工具输出、保存长期计划、共享多代理发现结果以及管理终端日志。它建议通过目录、文件、grep、glob 和分段读取实现动态上下文发现,而不是把所有信息持续放在提示词中。内容还覆盖文件组织、清理策略、并发写入、路径失效和自修改风险。该 Skill 适合需要跨多轮任务保存或选择性读取上下文的代理系统。

指导代理将大型工具输出、计划、子代理发现结果、终端日志和学习到的偏好写入文件;使用目录列表、glob、grep 和带范围的文件读取来发现并提取相关内容;建议以摘要和文件引用替代完整输出;提供 YAML、JSONL 和 Markdown 等结构化存储示例,并说明清理、隔离、文件存在性检查和格式校验策略。

  1. 正在构建长时间运行代理的工程师,需要把计划和中间状态保存到文件以便跨轮次恢复。
  2. 运行搜索、数据库查询或终端任务的开发者,需要把超过约 2000 个 token 的输出卸载到文件并按需检索。
  3. 设计多代理系统的团队,需要通过独立工作区文件传递研究结果,减少多跳消息压缩造成的信息损失。
  4. 维护代理技能或指令库的开发者,需要只在任务相关时动态加载完整技能内容。
  5. 需要管理临时日志和暂存文件的操作者,希望通过保留期限或数量策略控制目录增长。

这个 Skill 有哪些优点和局限?

优点
  • 覆盖工具输出卸载、计划持久化、子代理文件通信、动态技能加载和日志持久化等具体模式。
  • 提供结构化文件示例、检索方法、目录组织建议以及并发和清理方面的风险提示。
  • 内容强调按需发现,适合上下文窗口有限的长流程代理。
  • Skill 只使用 name 和 description 前置元数据,未显示平台专属扩展,便于兼容 Agent Skills 客户端。
局限
  • 主体以说明和 Python 伪代码为主,未提供可直接运行的实现或测试套件。
  • 依赖宿主具备文件系统和相应搜索、读取能力;裸模型 API 需要调用方补充这些能力。
  • 文件共享仍需自行处理并发写入、过期引用、格式漂移和临时文件无限增长等问题。
  • 自修改偏好文件被明确视为实验性模式,需要额外校验和定期复核。

如何安装这个 Skill?

将仓库中的 skills/filesystem-context 整个目录复制到目标 Agent Skills 目录,而不是只复制 SKILL.md。例如:

mkdir -p .codex/skills
cp -R skills/filesystem-context .codex/skills/

README 还给出了 .claude/skills/、.cursor/skills/ 和 .agents/skills/ 的对应目录。该仓库也可作为 Claude Code 插件市场或 Open Plugins 插件目录使用,但这些方式会安装或发现整个技能集合。

如何使用这个 Skill?

在需要文件后备上下文时使用,例如:"请把大型工具输出写入 scratch 文件,只返回摘要和路径,并用 grep 和分段读取按需检索;同时把当前计划保存为结构化文件。"

Skill 的激活场景包括工具输出过大、任务跨越多轮、多个代理需要共享状态,以及日志或终端输出需要选择性查询。具体运行时工具由宿主提供;文档没有规定一个独立的可执行安装程序。

这个 Skill 与同类方案有什么区别?

README 将上下文工程与提示词工程区分开:提示词工程主要关注指令编写,而本 Skill 关注系统提示、工具输出、历史消息和检索内容的整体管理。

常见问题

这个 Skill 会自动创建和维护文件吗?
文档提供了写入 scratch 文件、计划文件和代理工作区的模式与伪代码,但没有提供一个独立的自动化运行时;实际写入和读取需要宿主工具支持。
是否需要网络或特定第三方依赖?
文档没有为该 Skill 指定网络服务或第三方依赖。它要求文件系统能力,并示例使用目录列表、glob、grep、read_file 和 shell/Python 风格操作。
它适合所有代理任务吗?
不适合单轮且上下文足够的小任务,因为文件 I/O 会增加开销;它主要面向大型输出、跨轮次状态、多代理共享和可选择检索的日志。

同仓库的其他 Skills

均来自 muratcankoylan/Agent-Skills-for-Context-Engineering

开发与工程

上下文工程与智能体系统指南

帮助团队设计、优化和评估具备可靠上下文管理能力的生产级智能体系统。

开发与工程

潜在简报

通过任务引导的 KV 缓存压缩,在可控运行时高效共享编排器与工作器之间的上下文状态。

开发与工程

多智能体架构模式

帮助你设计具备上下文隔离、协调协议和可靠交接机制的多智能体系统。

开发与工程

上下文退化诊断

定位并缓解长上下文中的注意力丢失、污染、干扰、混淆与冲突。

开发与工程

上下文压缩策略

在长期代理会话中压缩上下文,同时保留文件变更、决策和后续行动。

开发与工程

长程智能体提示设计

为长期自主运行和并行多智能体任务设计可验证、抗近似交付的启动提示。

开发与工程

上下文工程基础

用注意力预算和上下文质量原则,理解并设计更可靠的智能体上下文。

开发与工程

项目级智能体开发方法论

帮助你判断是否该用大语言模型,并设计可迭代、可解析、可控成本的智能体项目流水线。

开发与工程

BDI 心智状态建模

把 RDF 上下文转化为可解释的信念、愿望与意图链。

开发与工程

Agent 评估方法

为智能体流水线建立可重复的评估、回归检测与质量门禁。

开发与工程

自我改进循环

让智能体系统在受控评估中迭代自身的上下文、工作流与代码。

开发与工程

持久语义记忆架构

帮助智能体设计可扩展、可检索且能处理时间变化的持久记忆系统。

开发与工程

上下文效率优化

通过缓存、遮蔽、压缩与分区降低上下文成本,同时保护回答质量。

开发与工程

Agent Skill 蓝图模板

为上下文工程技能提供可复用的结构、边界和质量检查框架。

开发与工程

推理轨迹优化器

通过分析智能体的推理轨迹,定位上下文、工具和指令问题,并迭代优化提示词。

开发与工程

高级 LLM 评测

为 LLM 输出构建可审计、可校准并能缓解评测偏差的自动化评估流程。

开发与工程

智能体工具设计指南

帮助你设计清晰、可路由、可恢复的智能体工具接口。

开发与工程

自主智能体控制台

为自主智能体设计可控、可恢复、可审计的运行框架。

开发与工程

严谨研究代理

为多步骤研究建立验证、故障恢复与来源追踪流程。

效率与协作

数字大脑个人操作系统

用结构化文件和 AI 管理内容、关系、知识与目标。

相关 Skills