Appearance
image2+Codex做PPT:先出视觉方向再转可编辑文件
不是一键完美,而是把流程拆开——image2负责视觉,Codex负责落地,人负责判断。
做PPT最烦的,很多时候不是不会打开软件。而是你明明看到一个很好看的模板,真正用起来却发现很尴尬。
更麻烦的是,现在很多AI工具能生成PPT图片,看起来很漂亮,但它本质上还是一张图——能看,不能改。
所以我最近试了一个更现实的办法:用image2先做PPT图片,再用Codex把它整理成可编辑PPT。
第一步:准备参考图和文案
先准备两个东西:
- 参考模板:可以是PPT截图,也可以是某种风格描述
- 脚本文案:主题是什么、一共几页、每页讲什么
不要只丢一句"帮我做PPT"。最好提前写清楚:
请根据这份文案,做一套6页项目复盘PPT。风格参考我上传的模板图,整体像公司汇报,颜色简洁,标题清楚,每页信息不要太满。image2的作用,就是先把"我想要这种感觉"变成一整套PPT图片。这一步的重点不是可编辑,而是先把方向做出来。
第二步:用Codex整理文件
把image2生成的PPT图片下载下来,交给Codex整理:
请把刚刚下载的图片整理到一个文件夹里,文件夹命名为:今天日期+PPT主题。每一张图片按照页面小标题重命名。比如:
- 文件夹名:2026-06-20-image2+Codex可编辑PPT流程
- 图片名:01_项目背景.png / 02_解决方案.png
第三步:Codex转可编辑PPT
把整理好的图片和提示词文档发给Codex:
根据文档生成ppt。重点是让Codex尝试识别页面结构,把标题、图片区域重新搭出来,这样你后面就能改标题、换内容。
Codex图片转PPT提示词(可直接复制)
请把我提供的PPT截图/PNG图片/PDF页面/原始PPT,重建成真正可编辑的PPTX。
核心要求:
最终每一页PPT只允许有两类可见内容:
1. 图片层:一张由GPT image2/生成式重绘/inpainting生成的"无字完整底图PNG"。
2. 文字层:所有文字、数字、标签重新打成PPT可编辑文本框。
处理步骤:
第一步:生成无字完整底图
- 读取每一页原图
- 识别所有文字和数字区域
- 使用GPT image2把文字从原图中去除
- 生成一张完整的"无字完整底图PNG"
第二步:重建可编辑文字层
- 根据原图OCR识别结果,提取所有文字
- 在PPT中重新创建可编辑文本框
第三步:生成PPTX
- 底层:一张铺满整页的无字完整底图PNG
- 上层:可编辑文字文本框
最终交付:
1. 一个可编辑PPTX
2. assets文件夹(每页一张无字完整底图PNG)
3. reference文件夹(原始参考图)适用场景
| 场景 | 说明 |
|---|---|
| 看到好看模板想做成自己的 | 先image2出图,再Codex还原 |
| 公司有固定汇报风格 | 上传参考图,让AI按风格走 |
| 有一份文案想快速出初稿 | 让AI先出视觉方向,再调细节 |
| 先做视觉方向再改 | 图片版本确认后再转可编辑 |
小结
这套方法最有意思的地方,不是"AI一键帮我做完PPT"。
而是它把做PPT的流程拆开了:
- image2负责出视觉方向
- Codex负责整理文件、分析页面、生成可编辑PPT
- 人负责判断内容能不能用,再修改和收尾
它不是一键完美。但它能帮你跳过最难开始的那一步。
关键词:image2, Codex, PPT制作, 可编辑PPT, AI PPT
