图片版PPT工作流
用「Codex 整理每页内容 → GPT Image 2 逐页出图 → 组装成 PPT」的方式做演示材料:视觉效果好、适合分享与培训,但图片里的文字不可编辑——领导要反复改数字和说法时,必须退回”可编辑文字 + AI 只做插画背景”的版本。
简介
图片版 PPT 工作流是指:不直接在 PowerPoint / 幻灯片软件里排版,而是让 AI 先把每一页的内容整理好,再调用图像生成模型逐页产出整页图片,最后把这些图片组装成一份 PPT。
产品经理简谙在 2026-09-21-woshipm-pm-ai-tools-skills 中明确表示”做 PPT,我反而很喜欢 GPT Image 出图再组合的方式”,并把它作为 Codex 的一个主要使用场景(Codex 负责内容与调度,GPT Image 2 负责出图)。它之所以成立,是因为它把 PPT 制作里最耗时的两件事——文案组织和版式设计——分别交给了擅长文本的模型和擅长视觉的模型。
这个工作流和 Codex 在 PPT 场景的既有用法一致:Codex 的优势是能同时处理文本生成与图片生成,这是纯对话式工具难以做到的;而 GPT Image 2 在版式一致性、中文文字渲染和多图连续生成上的能力,是”整页出图”这条路线的技术前提。
关键信息
- 类型:方法论 / 工作流
- 参与工具:Codex(内容整理与调度)+ GPT Image 2(逐页出图)
- 适用产出:分享、培训、概念介绍类材料
- 核心限制:图片版 PPT 的文字不能直接编辑
- 来源:2026-09-21-woshipm-pm-ai-tools-skills
核心特性
1. 三段式流程:先内容,再图片,最后组装
作者给出的流程是:让 Codex 先整理每页的内容 → 再调用 GPT Image 生成图片 → 最后组装成 PPT。注意顺序不能颠倒——先用文本模型把”每页讲什么”定下来,再用图像模型把”每页长什么样”做出来。跳过第一步直接出图,得到的是好看但没有信息结构的页面。
2. 分段确认:先大纲,再封面和一两页正文,风格确认后才继续
作者的操作纪律是”先确认大纲,再做封面和一两页正文,风格没问题了再继续”。这与 AI前端生成 里”不要让 AI 一步到位、每一步验证方向正确再继续”的原则是同一套方法论在不同产出物上的应用——风格一旦在 20 页上跑偏,返工成本是逐页重出。
3. 留痕:每页文案、提示词和图片都留着
“每页文案、提示词和图片都留着,后面改哪页就处理哪页。“这句话解决的是运维问题:图片版 PPT 的修改粒度是”页”,只要每页的文案与提示词还有记录,改一页就是重跑一页,而不是整份重做。这条习惯对长文档尤其重要。
4. 可编辑性是这条路线唯一的结构性代价
作者对适用边界说得非常明确:图片版 PPT 的文字不能直接编辑。她给出的分流判断是:
- 分享内容已经定了、不需要再改 → 图片版没问题;
- 如果领导会反复改数字、换说法 → 必须保留可编辑的文字和图表,只让 AI 做插画、背景。
理由是那句很具体的成本账:“不然领导改一句话,你就要重出一张图,也挺折腾。“这条判断把”视觉效果”和”可维护性”的取舍量化成了一个可当场回答的问题——这份材料会被谁改几次?
5. 与”AI 直出前端不好看”共享同一个视觉短板,但结论相反
有意思的是,同一篇素材里作者对 Codex 直出的前端评价极低(“大圆角、大卡片、卡片里面套卡片,一眼 AI”),却对 GPT Image 2 出的 PPT 页评价很高。差别不在工具,而在产出物的类型:PPT 页是需要视觉冲击力的静态版面,图像模型天然适合;前端页面需要真实组件与可交互性,整图不可用。这也解释了为什么前端场景的正解是”先出 UI 图再照着实现”,而 PPT 场景可以直接用图。
不同素材中的观点
- 2026-09-21-woshipm-pm-ai-tools-skills(简谙,2026-09-21):提出本文流程与适用边界——Codex 整理内容 + GPT Image 出图 + 组装;分段确认(大纲 → 封面与一两页正文 → 全量);每页文案/提示词/图片留痕;并给出可编辑性代价的分流规则(内容已定用图片版,领导会改则只让 AI 做插画背景)。
- 2026-05-09-codex-visual-style-ppt:早期素材已记录 Codex + 视觉风格 Skill 做 PPT 的组合(多宫格 → 逐页放大的两段式策略),本篇在其基础上补上了”什么时候不该用图片版”的边界判断。
- 2026-08-04-woshipm-ai-wanghong-handwritten-ppt:从”网红手写风 PPT”的角度验证了同一件事——整页出图能获得 PowerPoint 排版难以复制的视觉风格,代价同样是文字不可编辑。
实用信息
- 适用场景:团队分享、内部培训、概念介绍、评审前的氛围稿;讲者本人使用、内容基本定稿的场合
- 基本用法:
- 让 Codex 整理每页文案(先把”讲什么”定死)
- 确认大纲
- 用 GPT Image 2 先出封面 + 一两页正文,确认视觉风格
- 风格通过后批量出剩余页,逐页组装成 PPT
- 保存每页的文案、提示词与图片,后续按页修改
- 注意事项:图片版 PPT 文字不可编辑——若汇报对象会反复改数字/说法,改为”可编辑文字 + AI 只出插画与背景”;不要把整页图直接用于需要交互或精确对齐的场合