Skip to content

image2+Codex做PPT:先出视觉方向再转可编辑文件

2026年6月20日

image2+Codex做PPT:先出视觉方向再转可编辑文件

不是一键完美,而是把流程拆开——image2负责视觉,Codex负责落地,人负责判断。

做PPT最烦的,很多时候不是不会打开软件。而是你明明看到一个很好看的模板,真正用起来却发现很尴尬。

更麻烦的是,现在很多AI工具能生成PPT图片,看起来很漂亮,但它本质上还是一张图——能看,不能改。

所以我最近试了一个更现实的办法:用image2先做PPT图片,再用Codex把它整理成可编辑PPT。


第一步:准备参考图和文案

先准备两个东西:

  1. 参考模板:可以是PPT截图,也可以是某种风格描述
  2. 脚本文案:主题是什么、一共几页、每页讲什么

不要只丢一句"帮我做PPT"。最好提前写清楚:

请根据这份文案,做一套6页项目复盘PPT。风格参考我上传的模板图,整体像公司汇报,颜色简洁,标题清楚,每页信息不要太满。

image2的作用,就是先把"我想要这种感觉"变成一整套PPT图片。这一步的重点不是可编辑,而是先把方向做出来

第二步:用Codex整理文件

把image2生成的PPT图片下载下来,交给Codex整理:

请把刚刚下载的图片整理到一个文件夹里,文件夹命名为:今天日期+PPT主题。每一张图片按照页面小标题重命名。

比如:

  • 文件夹名:2026-06-20-image2+Codex可编辑PPT流程
  • 图片名:01_项目背景.png / 02_解决方案.png

第三步:Codex转可编辑PPT

把整理好的图片和提示词文档发给Codex:

根据文档生成ppt。

重点是让Codex尝试识别页面结构,把标题、图片区域重新搭出来,这样你后面就能改标题、换内容。


Codex图片转PPT提示词(可直接复制)

请把我提供的PPT截图/PNG图片/PDF页面/原始PPT,重建成真正可编辑的PPTX。

核心要求:
最终每一页PPT只允许有两类可见内容:
1. 图片层:一张由GPT image2/生成式重绘/inpainting生成的"无字完整底图PNG"。
2. 文字层:所有文字、数字、标签重新打成PPT可编辑文本框。

处理步骤:
第一步:生成无字完整底图
- 读取每一页原图
- 识别所有文字和数字区域
- 使用GPT image2把文字从原图中去除
- 生成一张完整的"无字完整底图PNG"

第二步:重建可编辑文字层
- 根据原图OCR识别结果,提取所有文字
- 在PPT中重新创建可编辑文本框

第三步:生成PPTX
- 底层:一张铺满整页的无字完整底图PNG
- 上层:可编辑文字文本框

最终交付:
1. 一个可编辑PPTX
2. assets文件夹(每页一张无字完整底图PNG)
3. reference文件夹(原始参考图)

适用场景

场景说明
看到好看模板想做成自己的先image2出图,再Codex还原
公司有固定汇报风格上传参考图,让AI按风格走
有一份文案想快速出初稿让AI先出视觉方向,再调细节
先做视觉方向再改图片版本确认后再转可编辑

小结

这套方法最有意思的地方,不是"AI一键帮我做完PPT"。

而是它把做PPT的流程拆开了:

  • image2负责出视觉方向
  • Codex负责整理文件、分析页面、生成可编辑PPT
  • 负责判断内容能不能用,再修改和收尾

它不是一键完美。但它能帮你跳过最难开始的那一步。


关键词:image2, Codex, PPT制作, 可编辑PPT, AI PPT

不要孤军奋战啦!

加入微信群一起学习交流 AI

与大神一起使用 OpenClaw、Hermes、Claude Code、Seedance 2.0、GPT-Image-2 等

微信公众号

扫码关注微信公众号
私信 "加群",将自动获取微信群二维码

探索 AI 世界,掌握智能未来