GordenSuperPPTSkill 一键全流程 PPT
一条流水线先出豪华图片版 PPT,再逆向还原成完全可编辑的 .pptx,两种成品一次交付。
证据显示该技能本身无破坏性默认、无凭据收集或隐蔽外传;流程含 manifest 记录(generated_source/copied_to)提供一定数据流透明度;图像生成失败时明确停止而非降级兜底。扣分项:强依赖 Codex 内置 imagegen 与 OpenAI 服务,外部数据流(内容上传至生图服务)未作隐私披露;许可证元数据不明,README 仅有自定署名条款,来源归属与再分发授权不完整。
SKILL.md 与 pipeline.md 逻辑自洽,阶段门禁(imagegen-manifest 缺失即失败)与阻塞说明较完善,失败反馈路径明确。扣分项:静态审查未执行,关键脚本(compose_pptx.py、chroma_key.py 等)未在本次证据中提供,无测试套件,OCR 与抠图质量属未验证假设,Happy path 之外的行为不可控。
触发条件表清晰(点名子技能 vs 默认 Super),场景边界与非适用范围有说明,中文支持好。扣分项:硬性要求 Codex + GPT 生图,主功能完全依赖对中国大陆网络可达性存疑的海外服务,且 README 自述未适配其他运行时;额度成本高(单图约 Plus 5 小时额度 10%)未在技能文档内充分披露。
文档分层清晰(SKILL.md + references/pipeline.md + 子技能自包含),目录结构、安装说明、依赖清单齐全。扣分项:许可证元数据不明(仅 README 自定署名条款),无版本号与变更记录,无 FAQ/已知限制章节,维护责任与更新路径仅依赖单一作者,描述含营销化夸大措辞('史上最最最强')。
宣称的端到端流程(图片 PPT → 可编辑 PPTX)有明确产物清单与四层还原方案,README 附示例截图,若成立则边际价值明显。扣分项:静态审查无法验证可编辑 PPTX 的实际还原质量;示例图非独立可复现证据;'完全可编辑'的结果完整度未经第三方验证,可能仍需大量人工修正。
有 README 示例图、流程产物清单、manifest 要求等部分可审计材料,属'有限复现'层级。扣分项:无 CI 工作流、无提交的测试套件覆盖关键路径,效果宣称主要来自作者自述与营销语,缺少跨来源佐证,事实与推断未分离。
- 该技能仅适用于 Codex 运行时,硬依赖 OpenAI imagegen;对中国大陆网络可达性存在风险,且用户内容会上传至生图服务,敏感内容使用者需自行评估隐私风险。
- 转换成本高:作者自述每张图片约消耗 Plus 订阅 5 小时额度的 10%,整份 PPT 成本可观。
- 许可证元数据不明,README 仅有自定署名条款(商用须标明出处/@Gorden Sun),商用前应与作者确认授权范围。
- 静态审查未执行任何流程;'完全可编辑 PPTX'的还原质量、OCR 准确性与抠图保真度均未经独立验证,产出可能仍需人工修正。
- 无版本号与变更记录,无测试证据;描述含营销化夸大,效果宣称应以实际试用为准。
这个 Skill 能做什么,适合哪些场景?
这是 GordenSuperPPTSkills 技能包中的编排技能,把「图片 PPT 生成」和「图片转可编辑 PPTX」两个子技能串联执行。阶段 1 逐页调用 Codex 内置 imagegen 模型生成幻灯片成品图,阶段 2 对每张图提取背景、骨架、图标、文本四层并按坐标拼装成可编辑 pptx。它本身不实现具体功能,只负责编排、校验门禁与最终交付。README 明确该技能包仅限 Codex 使用,因为强依赖 GPT 的生图与视觉能力。
读取并依次完整执行同目录下的 GordenImagePPTGen(A1–A5)与 GordenImage2PPTX(B1–B9)两个子技能。阶段 1 强制每页真实调用 imagegen 出图(禁止 PIL/SVG/shapes 等代码绘图兜底),要求每页图包含全部真实文字,并产出 outline.、prompts/、slides/NN-*.png、imagegen-manifest. 与图片型 pptx。阶段 2 对每张页图强制四层还原:背景图、绿幕抠图的骨架图与元素图标(均须由 imagegen 提取式生成)、OCR 文本,逐页记录资产清单,最终合成可编辑 .pptx。交付时一次性输出全部中间产物与两版 pptx。
- 用户只给一个主题或内容,没有指定具体功能,想要一份既好看又能编辑的成品 PPT
- 需要同时拿到图片版 PPT(用于预览/分享)和可编辑 PPTX(用于后续修改)的场景
- 营销、教学等需要高信息密度、复杂排版的幻灯片快速成稿
- 已有完整 Skill 安装环境、希望省去手动分两步调用的 Codex 用户
这个 Skill 有哪些优点和局限?
- 一次交付图片型 PPT、可编辑 pptx 和全部中间产物,省去手动两步操作
- 内置严格门禁(imagegen-manifest. 校验、四层强制、禁止代码绘图兜底),防止流程退化为占位符图
- 全程统一宽高比与配色,每页框架不重复,产出结构规范可复用
- 每个技能目录自包含,含脚本与参考文档,便于单独优化
- 强依赖 Codex 内置 imagegen,非 Codex 环境必须停止并阻塞,技能明确未做其他平台适配
- 成本高:README 称转换一张图片约耗费 Plus 订阅 5 小时额度的 10%
- 无自动化测试,实际还原质量依赖模型生图与视觉能力,无许可证字段
- 子技能必须与主技能同处一个 skills 目录,单独安装会失效
如何安装这个 Skill?
依赖同仓库的另外两个子技能,必须一起安装到同一 skills 目录。最省事是把整个仓库复制过去:
cp -R GordenImagePPTGen "${CODEX_HOME:-$HOME/.codex}/skills/GordenImagePPTGen"
cp -R GordenImage2PPTX "${CODEX_HOME:-$HOME/.codex}/skills/GordenImage2PPTGen"
cp -R GordenSuperPPTSkill "${CODEX_HOME:-$HOME/.codex}/skills/GordenSuperPPTSkill"
再安装依赖:pip3 install python-pptx pillow numpy。README 未提及 Windows 下的具体路径差异。
如何使用这个 Skill?
仅限 Codex 使用(README 推荐 GPT 5.5 模型、推理强度选「中」)。把 GitHub 仓库地址发给 Codex 安装技能后,直接给主题让它走全流程即可,例如:「使用 GordenSuperPPTSkill,生成一个 N 页的 PPT,内容为 XXX,要求豪华、信息密度高、排版复杂,并转换为可编辑 PPT」。若用户明确只想要图片版或只想要图片转可编辑,应直接调用对应子技能而非本技能。
这个 Skill 与同类方案有什么区别?
源材料未点名具体竞品,仅自述为「AI PPT 赛道终结者」。与直接用 python-pptx 代码绘制幻灯片的常规做法相比,它的差异点在于坚持用图像模型逐页出图再逆向还原,但源内未提供可引用的第三方对比。