开发与工程 background-codingremote-sandboxeswarm-poolssession-isolationmultiplayer-collaborationgithub-authenticationwebsocket-streaming

托管智能体基础设施

为后台编码智能体设计远程沙箱、低延迟启动和多人协作运行环境。

FollowSkills 评估 · FSRS-2.0
已阻断
33/ 100 五分制 1.7 / 5
信任安全3 / 25 · 0.6/5

文档提到沙箱隔离、资源限制、令牌分层、快照和用户归属,但示例使用 shell 字符串插值传递令牌和用户身份,包含将用户 GitHub token 放入可访问对象,以及默认执行 `git reset --hard origin/main`。缺少明确的用户确认、可靠的秘密不落盘/不进命令行措施、回滚保护和权限最小化验证;该破坏性同步默认无同意或恢复流程,触及红线,因此状态为 blocked。

可靠稳定4 / 20 · 1.0/5

架构说明覆盖生命周期、暖池、同步、快照和异常概念,但脚本大量关键方法为 `pass`,示例中的 Modal、API 和客户端代码存在未定义组件、未处理失败和竞态问题。文档声明为伪代码,静态材料不足以证明关键路径可运行,按静态上限保守扣分。

适用触发9 / 15 · 3.0/5

激活条件、非适用边界及 hosted runtime 与相邻技能的职责划分较清晰,覆盖后台编码、远程沙箱、多客户端和多人协作。但输入输出契约、平台/网络环境、中文使用和非海外依赖适配说明不足,触发精度与边界证据有限。

规范维护8 / 15 · 2.7/5

目录结构、分层说明、清单、示例、故障点、引用、许可证、创建/更新日期和版本号均有提供,且有相邻技能说明。扣分原因是维护责任和更新路径不明确,参考文件与示例代码的完成度界限、依赖版本和安全配置假设未充分说明;根 README 的技能数量描述也不一致。

有效结果5 / 15 · 1.7/5

内容能为 hosted-agent 架构设计提供可直接借鉴的组件划分、生命周期清单和实现模式,示例覆盖面较广。但脚本不可直接运行,多个基础设施方法未实现,安全与一致性缺陷需要大量工程补全;静态阅读无法确认代表性结果,因此仅给予接近核心任务完成水平的分数。

证据核验4 / 10 · 2.0/5

技能包含引用、代码示例、元数据和仓库 CI/测试信号,但这些 CI 主要验证研究者系统和其他示例,并未覆盖本技能的关键路径;没有针对 sandbox_manager.py 的提交测试或第三方执行记录。可审计材料存在,但复现覆盖薄弱,按静态上限不超过 5 分。

证据充分度: 评估于 2026年7月20日 审查版本 c578e85e40fe
使用前请注意
  • 不要直接采用示例中的 `git reset --hard`;应隔离未提交状态、获得明确授权并保留可恢复快照。
  • 不要把令牌拼接进 shell 命令或长期保存在用户身份对象中;应使用短期令牌、受限权限、屏蔽日志和安全注入机制。
  • 脚本中的 `pass` 方法、竞态、异常处理和依赖接口必须在部署前实现并测试。
  • 仓库未提供该技能关键路径的专门测试或第三方运行证据。
查看完整评分方法 →

这个 Skill 能做什么,适合哪些场景?

该技能面向运行在远程沙箱而非本地设备上的托管或后台智能体。它覆盖沙箱生命周期、预构建镜像、预热池、快照恢复、会话状态隔离、实时流式传输和多人协作。内容还讨论服务器优先的智能体框架、自生成子会话、GitHub 用户身份提交以及 Slack、Web 和 Chrome 扩展客户端。适合正在构建生产级远程编码智能体基础设施的工程团队;不适合只设计智能体拓扑、工具契约或本地文件状态管理的任务。

提供一套设计指南和检查清单,帮助规划远程沙箱的创建、同步、读写限制、快照、恢复、超时和销毁流程;设计包含代码仓库、依赖、构建结果和缓存的预构建环境镜像与预热池;规划 API 层的会话隔离、WebSocket 实时事件、跨客户端同步和多人作者信息;说明如何在沙箱中配置 Git 身份、推送分支,并由 API 使用用户 GitHub 令牌创建 PR。SKILL.md 本身不提供可直接运行的实现代码。

  1. 为需要独立于用户设备运行的后台编码智能体设计远程执行环境。
  2. 为高并发代码仓库构建预构建镜像和预热沙箱池,以降低冷启动等待。
  3. 为 Slack、Web、Chrome 扩展或 VS Code 等多个客户端提供共享的智能体会话状态。
  4. 实现允许智能体启动并行子会话、查询其状态并继续主任务的系统。
  5. 设计多人实时调试、代码审查或团队协作会话,并保留用户归属信息。
  6. 构建通过用户 GitHub 身份创建分支和 PR、同时保持沙箱权限最小化的工作流。

这个 Skill 有哪些优点和局限?

优点
  • 覆盖从沙箱基础设施到 API、客户端、认证和多人协作的完整运行时边界。
  • 提供具体的预构建镜像、预热、快照、读写同步和输出提取模式。
  • 明确指出冷启动、令牌过期、状态丢失、成本失控和 Git 配置缺失等故障风险。
  • 强调用户身份提交和 PR 审计轨迹,适合需要人工审核的编码工作流。
局限
  • 内容以设计原则和伪代码式流程为主,不包含可直接部署的沙箱或 API 实现。
  • 需要自行选择和集成远程沙箱、GitHub 认证、数据库、WebSocket 和客户端技术。
  • SKILL.md 未提供测试套件或经过验证的具体平台实现。
  • 部分建议依赖高并发、多人协作和后台执行等较复杂的基础设施需求。

如何安装这个 Skill?

先克隆仓库:

git clone https://github.com/muratcankoylan/Agent-Skills-for-Context-Engineering.git

skills/hosted-agents 整个目录复制到目标客户端的技能目录,例如:

mkdir -p .codex/skills
cp -R Agent-Skills-for-Context-Engineering/skills/hosted-agents .codex/skills

也可以复制到项目的 .claude/skills/.cursor/skills/。必须保留目录结构,不要只复制 SKILL.md 文件。

如何使用这个 Skill?

在需要设计远程或后台编码智能体时触发,例如:"设计一个带预热沙箱池、会话快照、实时流式传输和用户 GitHub PR 的后台编码智能体系统。" 使用前应明确沙箱生命周期、镜像重建策略、读写同步、会话隔离、认证归属、输出提取以及预算和销毁策略。该技能主要提供架构指导;具体沙箱供应商、API 实现和工具契约需要另行设计。

这个 Skill 与同类方案有什么区别?

技能将本方案与本地执行约束进行对比,并提及 Modal Sandboxes、Cloudflare Durable Objects、Ramp 的后台智能体基础设施以及 OpenCode 作为外部参考;它没有提供系统化的产品对比或选型结论。

常见问题

这个技能是否包含可直接运行的托管智能体?
不包含。它提供架构模式、设计清单、流程示例和故障注意事项,具体实现需要自行开发。
是否必须使用 Modal?
不必须。Modal Sandboxes 只是外部参考之一,正文描述的是可迁移的远程沙箱设计模式。
它如何处理 GitHub 权限?
建议在沙箱中推送变更,再由 API 使用用户的 GitHub 令牌创建 PR,并通过 Webhook 接收 PR 事件。
这个技能适合本地单用户编码助手吗?
通常不适合。它主要针对远程沙箱、后台执行、并发会话、多客户端和多人协作基础设施。

同仓库的其他 Skills

均来自 muratcankoylan/Agent-Skills-for-Context-Engineering

开发与工程

多智能体架构模式

帮助你设计具备上下文隔离、协调协议和可靠交接机制的多智能体系统。

开发与工程

自我改进循环

让智能体系统在受控评估中迭代自身的上下文、工作流与代码。

开发与工程

长程智能体提示设计

为长期自主运行和并行多智能体任务设计可验证、抗近似交付的启动提示。

开发与工程

高级 LLM 评测

为 LLM 输出构建可审计、可校准并能缓解评测偏差的自动化评估流程。

开发与工程

上下文工程基础

用注意力预算和上下文质量原则,理解并设计更可靠的智能体上下文。

开发与工程

潜在简报

通过任务引导的 KV 缓存压缩,在可控运行时高效共享编排器与工作器之间的上下文状态。

开发与工程

持久语义记忆架构

帮助智能体设计可扩展、可检索且能处理时间变化的持久记忆系统。

开发与工程

上下文退化诊断

定位并缓解长上下文中的注意力丢失、污染、干扰、混淆与冲突。

开发与工程

智能体工具设计指南

帮助你设计清晰、可路由、可恢复的智能体工具接口。

开发与工程

上下文压缩策略

在长期代理会话中压缩上下文,同时保留文件变更、决策和后续行动。

开发与工程

项目级智能体开发方法论

帮助你判断是否该用大语言模型,并设计可迭代、可解析、可控成本的智能体项目流水线。

开发与工程

BDI 心智状态建模

把 RDF 上下文转化为可解释的信念、愿望与意图链。

开发与工程

自主智能体控制台

为自主智能体设计可控、可恢复、可审计的运行框架。

开发与工程

Agent 评估方法

为智能体流水线建立可重复的评估、回归检测与质量门禁。

开发与工程

严谨研究代理

为多步骤研究建立验证、故障恢复与来源追踪流程。

开发与工程

文件系统上下文工程

将大型、持久或共享的代理上下文移入文件,按需检索以减少上下文压力。

开发与工程

上下文效率优化

通过缓存、遮蔽、压缩与分区降低上下文成本,同时保护回答质量。

开发与工程

上下文工程与智能体系统指南

帮助团队设计、优化和评估具备可靠上下文管理能力的生产级智能体系统。

开发与工程

Agent Skill 蓝图模板

为上下文工程技能提供可复用的结构、边界和质量检查框架。

效率与协作

数字大脑个人操作系统

用结构化文件和 AI 管理内容、关系、知识与目标。

相关 Skills