Gorden 图片PPT生成
把一个主题直接变成信息密度高、排版复杂、每页一张图的豪华PPT,并可衔接转换为完全可编辑的PPTX。
技能无恶意行为迹象:数据零编造铁律、禁止伪造内容、要求 imagegen-manifest. 留存生成证据、出图前需向用户确认风格/受众/页数,均属正向安全设计。扣分项:无正式 license 元数据(README 仅有口头授权声明)、发布者身份未验证、对 $CODEX_HOME 目录读写与外部图像生成服务的完整数据流未作系统披露、无回滚/清理机制说明。
工作流(A1–A5)自洽清晰,compose_pptx.py 对缺文件、非法 hex、缺 Pillow 等有明确报错(_die/stderr),manifest 验收机制可防止静默失败。扣分项:静态评审无法执行复现,无任何提交的测试覆盖关键路径;核心依赖(Codex 内置 imagegen / GPT 生图)不可用时虽要求停止并说明,但重试与失败反馈仍主要依赖运行时行为。
场景定位清晰(主题→图片型 PPT),明确声明能力边界(只产出图片型 PPT、imagegen 不可用即失败),触发条件在 description 中写明。扣分项:README 明言仅限 Codex 使用,强依赖 GPT 生图与 GPT 视觉能力,对中国大陆用户可达性与替代后端适配不足;跨运行时支持仅为理论描述,未做专门适配。
文档分层良好(SKILL.md → references 指南/runtime 笔记 → 脚本),有输出目录约定、参数 schema 与范例,可读性高。扣分项:无版本号/变更日志,license 元数据缺失(仅 README 口头约定商用须署名),维护责任与更新路径不明确,部分规则(如绿幕约束)引用尚未评审的 GordenImage2PPTX 细节形成隐含依赖。
核心任务(生成含真实文字的图片型 PPT 并合成 .pptx)设计合理,提示词体系与 QA 铁律细致,A5 脚本可直接产出图片型 pptx,边际价值明确(对比手动排版)。扣分项:静态评审无法验证出图质量与文字渲染正确率,图片型输出对后续编辑天然受限,效果展示截图不可独立核验,成本(大量生图额度)收益比未量化。
仓库内含源码、参考图库、README 效果截图与明确目录结构,manifest 机制本身要求留存生成证据,属可审计的一手材料。扣分项:无第三方独立复现证据、无 CI/测试工作流覆盖本技能关键路径,'史上最强'等营销语言与可验证结论未分离,效果声明仅靠作者截图。
- 本技能强依赖 Codex 内置 imagegen 与 GPT 生图/视觉能力,其他运行时未经适配,海外服务可达性可能影响大陆用户使用。
- 静态评审未执行代码:出图文字渲染正确率、合成的 pptx 可用性均未经独立验证,使用前请先小规模试跑并检查 imagegen-manifest.。
- license 元数据缺失,仅有 README 口头授权(商用须署名);使用前请确认授权条款符合你的合规要求。
- 图片型 PPT 每页为整幅位图,若需可编辑 pptx 必须依赖尚未评审的 GordenImage2PPTX 技能,存在链路耦合风险。
- 生图耗额度较高(README 自述单图转换约耗 Plus 5 小时额度 10%),大规模使用前请评估成本。
这个 Skill 能做什么,适合哪些场景?
GordenImagePPTGen 是 GordenSuperPPTSkills 技能包中的第一个技能,负责「图片型PPT」的生成:输入一个主题或已有内容,它先设计逐页大纲,再为每页写出含全部真实文字的出图提示词,调用 GPT 的图像生成能力(Codex 内置 imagegen)逐页出图,最后用 compose_pptx.py 把每张图合成为全幅图片型 .pptx。该技能刻意禁止用代码绘制幻灯片图,并要求逐页记录 imagegen-manifest. 作为验收证据。它只产出图片型PPT;若需要可编辑PPTX,需配合技能包中的 GordenImage2PPTX。作者声明技能仅针对 Codex 适配,理论上其他具备生图接口的运行时也能实现但未经适配。
读取用户的主题/内容后,按五步流程执行:A1 确认风格、受众、页数、语言;A2 生成逐页结构化大纲 outline.,为每页指派不重复的复杂框架(Bento、漏斗、多层架构等)并统一配色;A3 为每页写出自包含的出图提示词(含全部 verbatim 文字、hex 颜色、版式);A4 逐页调用图像生成模型出图,复制到输出目录并写 imagegen-manifest.;A5 运行 scripts/compose_pptx.py,按 deck. 把每页 PNG 合成为全幅图片型 .pptx。默认 16:9、11–20 页,要求每页约 20+ 信息点、数据零编造、语言跟随用户。
- 需要快速产出一份视觉豪华、信息密度高的汇报或路演PPT,且接受每页为整张图片形式的用户
- 已有真实数据或内容素材,希望AI严格按素材出图、不允许编造数据的场景
- 在 Codex 中工作、希望后续用 GordenImage2PPTX 把图片PPT再还原成可编辑PPTX的用户
- 需要指定中文以外语言、或指定 3:2 等非默认比例的幻灯片制作者
- 想要每页使用不同复杂框架(如莫比乌斯环、同心雷达、鱼骨图)的知识分享/培训材料作者
这个 Skill 有哪些优点和局限?
- 出图前强制写厚内容:每页约 20+ 信息点、每页不重复的复杂框架,明确反对简单排版
- 数据零编造、文字 verbatim 写进提示词,产出的不是空模板而是含全部真实文字的成品
- 工程约束严谨:imagegen-manifest. 逐页留证,禁止代码绘图和占位符,失败即停止而非兜底
- 支持任意风格(科技商务、卡通、水墨等)与非 16:9 比例,提示词自包含、单页可复现重出
- README 明确「仅限Codex使用」,其他平台未做适配;imagegen 不可用时技能直接失败
- 产出为图片型PPT,页面文字不可编辑,必须依赖下游 GordenImage2PPTX 才能改文字
- 生成的图片中文字可能有错字,SKILL.md 只承诺转可编辑后可手动修改
- 仓库未标注开源许可证,仅 README 中说明署名条件下可商用;无测试套件或第三方评测证据
- 为避免下游绿幕抠图冲突要求少用绿色,配色上有额外限制
如何安装这个 Skill?
这是三技能合集仓库中的一个技能。在 Codex 中,可把仓库地址发给 Codex 让其安装,或手动复制:cp -R GordenImagePPTGen "${CODEX_HOME:-$HOME/.codex}/skills/GordenImagePPTGen"。依赖:pip3 install python-pptx pillow(README 中合集依赖还包括 numpy)。许可证信息未在仓库标注,README 仅说明可商用但必须标明 GitHub 出处或作者 @Gorden Sun。
如何使用这个 Skill?
仅限 Codex 使用(README 声明需 GPT 生图与视觉能力,模型建议 GPT 5.5、推理强度中)。示例提示词:「使用GordenImagePPTGen技能,生成一个N页的PPT,内容为XXX,要求PPT要求豪华、信息密度高、排版复杂」。若还需可编辑PPTX,之后用 GordenImage2PPTX;要一键全流程则用 GordenSuperPPTSkill。图片转可编辑PPTX较费额度(README 称转换一张图约耗 Plus 订阅 5 小时额度的 10%),但该成本属于下游技能,本技能本身的额度消耗未在文档中说明。