开发与工程 autonomous-agentssdlccheckpointinghuman-in-the-looporchestrationcost-controlapproval-workflow

Loki Checkpoint 模式

让自主编码代理每完成 N 个任务就暂停汇报,等你批准后再继续,避免在错误方向上浪费算力和费用。

FollowSkills 评估 · FSRS-1.0
推荐
68/ 100 五分制 3.4 / 5
本条评估按 FSRS 1.0 标准完成,维度分不做换算,已进入按 FSRS 2.0 重新评估的复核队列。
1 2 3 4 5 6
1价值适配14 / 20 · 3.5/5

与主技能相反方向的设计——「选择性自主」模式,每 N 个任务暂停一次等待人工批准,明确列出何时该用检查点模式、何时该用永久自主模式,这是同一生态里更谨慎的一个子技能。

2可靠性13 / 20 · 3.3/5
3安全性21 / 25 · 4.2/5
4证据6 / 15 · 2.0/5
5易用性8 / 10 · 4.0/5
6维护性6 / 10 · 3.0/5
证据充分度: 评估于 2026年7月17日
评估证据 [1]
查看完整评分方法 →

这个 Skill 能做什么,适合哪些场景?

checkpoint-mode 是 Loki Mode 仓库中的一个技能,实现「选择性自主」:代理每完成 N 个任务或运行 M 分钟后暂停,生成包含已完成任务、下一步动作和资源消耗的检查点摘要,然后等待用户在信号文件中写入批准才恢复工作。该模式源自 Tim Dettmers 的研究文章,适用于方向可能需要调整的新项目、高成本操作和需要审计轨迹的受监管环境。它与永不暂停的 Perpetual 模式和每任务必停的 Supervised 模式形成三档自主度选择。配置完全通过环境变量控制,无需修改代码。

代理(orchestrator 类型)在 LOKI_AUTONOMY_MODE=checkpoint 时持续统计已完成任务数;当达到 LOKI_CHECKPOINT_FREQUENCY(默认示例为 10 个任务)或 LOKI_CHECKPOINT_TIME(示例为 60 分钟)阈值时暂停执行;生成 Markdown 格式的检查点摘要(已完成任务、下一步动作、耗时、使用的代理数量、预估成本)并写入 .loki/signals/ 目录下的 CHECKPOINT_SUMMARY 信号文件;随后轮询等待用户创建 CHECKPOINT_APPROVED 信号文件,检测到后清除该信号并恢复工作。还可通过 LOKI_CHECKPOINT_PHASES 配置在架构、部署等指定阶段后强制暂停,并将效果指标(任务数、批准耗时、方向修正次数)记录到 .loki/metrics/checkpoint-mode/。

  1. 尝试新领域项目的开发者:技术方案不确定,希望代理每推进一段就停下来让你确认方向,而不是跑完整个自主循环后才发现走偏。
  2. 调用昂贵 API 或云资源成本的团队:在高成本操作前设置检查点,避免自主代理在错误路径上持续烧钱。
  3. 受监管环境中的工程团队:每次暂停生成的摘要和批准信号文件天然形成审计轨迹,满足合规留痕要求。
  4. 学习阶段的用户:想逐步引导代理理解你的意图,用检查点作为频繁的反馈注入点。
  5. 需要在架构或部署等关键阶段强制人工把关的负责人:通过 LOKI_CHECKPOINT_PHASES 指定阶段必停。

这个 Skill 有哪些优点和局限?

优点
  • 把「永久自主」的风险控制在可接受范围:频繁的人工反馈能在早期纠正方向,避免在错误方案上浪费代理调用量和 API 费用。
  • 每个检查点自动生成结构化摘要,包含已完成任务、下一步计划和成本估算,人工审查成本低。
  • 批准机制基于文件信号,简单透明、可审计,适合有合规留痕需求的团队。
  • 自主度可调:任务数、时间、必停阶段三个维度均可通过环境变量配置,与 Perpetual/Supervised 模式形成完整的自主度光谱。
局限
  • 深度绑定 Loki Mode 运行时:依赖 LOKI_* 环境变量、.loki/signals/ 目录约定和 orchestrator 代理类型,无法直接移植到其他 Agent Skills 客户端。
  • 需要用户在检查点时在场响应,否则构建会一直挂起等待批准——不适合真正无人值守的场景。
  • SKILL.md 中的代理逻辑以伪代码呈现,未附独立的自动化测试或第三方验证证据。
  • 成本估算(如摘要中的 $0.45 示例)由代理自行生成,其准确性没有独立验证。

如何安装这个 Skill?

该技能包含在 Loki Mode 仓库的 agent-skills/checkpoint-mode/ 目录中。安装 Loki Mode 本体即可获得:bun install -g loki-mode(也支持 npm、Homebrew 或 Docker)。仓库未单独说明如何将单个 skill 独立安装到其他 Agent Skills 客户端;如需独立使用,可参考仓库内 SKILL.md 及其引用的 references/production-patterns.md 自行评估。

如何使用这个 Skill?

在运行 Loki 构建前设置环境变量:export LOKI_AUTONOMY_MODE=checkpoint,可选设置 LOKI_CHECKPOINT_FREQUENCY=10(任务数)和 LOKI_CHECKPOINT_TIME=60(分钟),以及 LOKI_CHECKPOINT_PHASES="architecture,deployment" 指定必停阶段。然后正常启动构建(如 loki start prd.md)。每个检查点触发时,代理会写入 .loki/signals/CHECKPOINT_SUMMARY_<时间戳>.md 摘要文件并暂停;你审阅摘要后,创建 .loki/signals/CHECKPOINT_APPROVED 空文件,代理检测到后自动恢复工作。

这个 Skill 与同类方案有什么区别?

Loki Mode 自身提供三种自主度模式:Perpetual(永不暂停,适合过夜构建和全自动化 CI/CD)、Checkpoint(每 N 任务暂停,适合新项目)、Supervised(每任务必停,适合生产部署等关键系统)。如果需求是方向不确定的开发项目,Checkpoint 是中间档的合理选择;如果 PRD 明确、模式成熟,Perpetual 减少中断;如果是生产环境关键系统,Supervised 提供最严格的控制。

常见问题

检查点会不会把构建拖得很慢?
会引入等待时间。每次暂停需要你审阅摘要并手动创建批准文件,批准耗时会记录在指标中。调整 LOKI_CHECKPOINT_FREQUENCY 和 LOKI_CHECKPOINT_TIME 可以降低中断频率,或在成熟项目上切换到 Perpetual 模式。
如果我不在,构建会怎样?
代理会一直暂停并轮询等待 CHECKPOINT_APPROVED 信号,不会自行继续。因此该模式不适合无人值守运行;无人值守场景应使用 Perpetual 模式。
能否只在某些阶段强制暂停?
可以。设置 LOKI_CHECKPOINT_PHASES="architecture,deployment" 即可在这些阶段结束后无论任务数是否达标都强制暂停。
没有批准会丢失已完成的工作吗?
SKILL.md 未明确说明未获批准时已完成任务的持久化行为;从设计看已完成任务计数持久保存,但恢复/回滚的具体细节请参考 Loki Mode 官方文档而非本 SKILL.md。

同仓库的其他 Skills

均来自 asklokesh/loki-mode

相关 Skills