效率与协作 pptx-generationimage-to-pptxslide-generationocrimagegenpipeline-orchestrationpython-pptx

GordenSuperPPTSkill 一键全流程 PPT

一条流水线先出豪华图片版 PPT,再逆向还原成完全可编辑的 .pptx,两种成品一次交付。

FollowSkills 评估 · FSRS-2.0
谨慎使用
50/ 100 五分制 2.5 / 5
1 2 3 4 5 6
1信任安全14 / 25 · 2.8/5

证据显示该技能本身无破坏性默认、无凭据收集或隐蔽外传;流程含 manifest 记录(generated_source/copied_to)提供一定数据流透明度;图像生成失败时明确停止而非降级兜底。扣分项:强依赖 Codex 内置 imagegen 与 OpenAI 服务,外部数据流(内容上传至生图服务)未作隐私披露;许可证元数据不明,README 仅有自定署名条款,来源归属与再分发授权不完整。

2可靠稳定9 / 20 · 2.3/5

SKILL.md 与 pipeline.md 逻辑自洽,阶段门禁(imagegen-manifest 缺失即失败)与阻塞说明较完善,失败反馈路径明确。扣分项:静态审查未执行,关键脚本(compose_pptx.py、chroma_key.py 等)未在本次证据中提供,无测试套件,OCR 与抠图质量属未验证假设,Happy path 之外的行为不可控。

3适用触发9 / 15 · 3.0/5

触发条件表清晰(点名子技能 vs 默认 Super),场景边界与非适用范围有说明,中文支持好。扣分项:硬性要求 Codex + GPT 生图,主功能完全依赖对中国大陆网络可达性存疑的海外服务,且 README 自述未适配其他运行时;额度成本高(单图约 Plus 5 小时额度 10%)未在技能文档内充分披露。

4规范维护8 / 15 · 2.7/5

文档分层清晰(SKILL.md + references/pipeline.md + 子技能自包含),目录结构、安装说明、依赖清单齐全。扣分项:许可证元数据不明(仅 README 自定署名条款),无版本号与变更记录,无 FAQ/已知限制章节,维护责任与更新路径仅依赖单一作者,描述含营销化夸大措辞('史上最最最强')。

5有效结果6 / 15 · 2.0/5

宣称的端到端流程(图片 PPT → 可编辑 PPTX)有明确产物清单与四层还原方案,README 附示例截图,若成立则边际价值明显。扣分项:静态审查无法验证可编辑 PPTX 的实际还原质量;示例图非独立可复现证据;'完全可编辑'的结果完整度未经第三方验证,可能仍需大量人工修正。

6证据核验4 / 10 · 2.0/5

有 README 示例图、流程产物清单、manifest 要求等部分可审计材料,属'有限复现'层级。扣分项:无 CI 工作流、无提交的测试套件覆盖关键路径,效果宣称主要来自作者自述与营销语,缺少跨来源佐证,事实与推断未分离。

证据充分度: 评估于 2026年9月9日 审查版本 8c05583dab83
使用前请注意
  • 该技能仅适用于 Codex 运行时,硬依赖 OpenAI imagegen;对中国大陆网络可达性存在风险,且用户内容会上传至生图服务,敏感内容使用者需自行评估隐私风险。
  • 转换成本高:作者自述每张图片约消耗 Plus 订阅 5 小时额度的 10%,整份 PPT 成本可观。
  • 许可证元数据不明,README 仅有自定署名条款(商用须标明出处/@Gorden Sun),商用前应与作者确认授权范围。
  • 静态审查未执行任何流程;'完全可编辑 PPTX'的还原质量、OCR 准确性与抠图保真度均未经独立验证,产出可能仍需人工修正。
  • 无版本号与变更记录,无测试证据;描述含营销化夸大,效果宣称应以实际试用为准。
评估证据 [1][2][3]
查看完整评分方法 →

这个 Skill 能做什么,适合哪些场景?

这是 GordenSuperPPTSkills 技能包中的编排技能,把「图片 PPT 生成」和「图片转可编辑 PPTX」两个子技能串联执行。阶段 1 逐页调用 Codex 内置 imagegen 模型生成幻灯片成品图,阶段 2 对每张图提取背景、骨架、图标、文本四层并按坐标拼装成可编辑 pptx。它本身不实现具体功能,只负责编排、校验门禁与最终交付。README 明确该技能包仅限 Codex 使用,因为强依赖 GPT 的生图与视觉能力。

读取并依次完整执行同目录下的 GordenImagePPTGen(A1–A5)与 GordenImage2PPTX(B1–B9)两个子技能。阶段 1 强制每页真实调用 imagegen 出图(禁止 PIL/SVG/shapes 等代码绘图兜底),要求每页图包含全部真实文字,并产出 outline.、prompts/、slides/NN-*.png、imagegen-manifest. 与图片型 pptx。阶段 2 对每张页图强制四层还原:背景图、绿幕抠图的骨架图与元素图标(均须由 imagegen 提取式生成)、OCR 文本,逐页记录资产清单,最终合成可编辑 .pptx。交付时一次性输出全部中间产物与两版 pptx。

  1. 用户只给一个主题或内容,没有指定具体功能,想要一份既好看又能编辑的成品 PPT
  2. 需要同时拿到图片版 PPT(用于预览/分享)和可编辑 PPTX(用于后续修改)的场景
  3. 营销、教学等需要高信息密度、复杂排版的幻灯片快速成稿
  4. 已有完整 Skill 安装环境、希望省去手动分两步调用的 Codex 用户

这个 Skill 有哪些优点和局限?

优点
  • 一次交付图片型 PPT、可编辑 pptx 和全部中间产物,省去手动两步操作
  • 内置严格门禁(imagegen-manifest. 校验、四层强制、禁止代码绘图兜底),防止流程退化为占位符图
  • 全程统一宽高比与配色,每页框架不重复,产出结构规范可复用
  • 每个技能目录自包含,含脚本与参考文档,便于单独优化
局限
  • 强依赖 Codex 内置 imagegen,非 Codex 环境必须停止并阻塞,技能明确未做其他平台适配
  • 成本高:README 称转换一张图片约耗费 Plus 订阅 5 小时额度的 10%
  • 无自动化测试,实际还原质量依赖模型生图与视觉能力,无许可证字段
  • 子技能必须与主技能同处一个 skills 目录,单独安装会失效

如何安装这个 Skill?

依赖同仓库的另外两个子技能,必须一起安装到同一 skills 目录。最省事是把整个仓库复制过去:

cp -R GordenImagePPTGen "${CODEX_HOME:-$HOME/.codex}/skills/GordenImagePPTGen"
cp -R GordenImage2PPTX "${CODEX_HOME:-$HOME/.codex}/skills/GordenImage2PPTGen"
cp -R GordenSuperPPTSkill "${CODEX_HOME:-$HOME/.codex}/skills/GordenSuperPPTSkill"

再安装依赖:pip3 install python-pptx pillow numpy。README 未提及 Windows 下的具体路径差异。

如何使用这个 Skill?

仅限 Codex 使用(README 推荐 GPT 5.5 模型、推理强度选「中」)。把 GitHub 仓库地址发给 Codex 安装技能后,直接给主题让它走全流程即可,例如:「使用 GordenSuperPPTSkill,生成一个 N 页的 PPT,内容为 XXX,要求豪华、信息密度高、排版复杂,并转换为可编辑 PPT」。若用户明确只想要图片版或只想要图片转可编辑,应直接调用对应子技能而非本技能。

这个 Skill 与同类方案有什么区别?

源材料未点名具体竞品,仅自述为「AI PPT 赛道终结者」。与直接用 python-pptx 代码绘制幻灯片的常规做法相比,它的差异点在于坚持用图像模型逐页出图再逆向还原,但源内未提供可引用的第三方对比。

常见问题

在 Claude Code 或其他 Agent 里能用吗?
README 明确仅限 Codex,因为必须使用 Codex 内置 imagegen 和 GPT 视觉能力。理论上配合 GPT 生图接口也能实现,但作者未做适配,需要自行改造。
转换成本大概多少?
按作者实测,把一张图片转成可编辑 PPTX 约耗费 ChatGPT Plus 订阅 5 小时额度的 10%,整份多页 PPT 的额度消耗会相当可观。
如果 imagegen 不可用会怎样?
技能规定必须停止并说明阻塞原因,禁止退回用 Python/SVG/shapes 等代码绘图兜底,因此没有可用的降级路径。
可以商用吗?
可以商用,但必须标明 GitHub 出处或标注作者 @Gorden Sun;仓库本身未标注标准开源许可证。

同仓库的其他 Skills

均来自 GordenSun/GordenSuperPPTSkills

相关 Skills