GPT / Codex 做 PPT:避坑与验收清单
素材:全部 10 篇 GPT/Codex 笔记的翻车点合集
一、提示词层面的坑
- 别只写一句”帮我做个 XX 的 PPT” —— AI 不知道几页、什么风格、给谁看、重点是啥,只能瞎猜。要逐页指定。
- 配色一定要写进提示词 —— GPT 不会自己思考统一配色。第一版翻车、第二版成功,差的就是提示词里那几句话。
- 提示词别写泛话 —— “modern Chinese presentation style""navy-blue line icon”模型听不懂,只会按默认理解出图。要写死:粗线条、单一颜色 073b8e、不是 web icon、不是手绘。
- 提示词只解决”要什么”,不解决”像不像” —— 想对标参考图,光改提示词到不了,要上”测量+回退”的工程。
二、四层结构层面的坑
- 只做前 3 层 = 永远差一档 —— 文字图标都能编辑了,但不像参考图,因为漏了第 4 层(排版规范)。
- 素材是素材的事,排版是排版的事 —— 图标人物单独看都好,拼到 PPT 上还差一档,根因是排版没单独定规则(字号字重、卡片大小、间距、对齐、圆角线宽)。
- 要生图就让它真生图,别让它偷懒裁图 —— 素材要透明 PNG、每个图标是独立对象、文字不能生成在图片里。
三、人物插图的坑(已知难点)
- 带人物插图的页最难做像,最差差距到 0.31(其他页 ~0.18)。
- 想照参考图生”一模一样”的人:可能顺手多生条波浪、人脸身体色块太大,分数反而更差,常常要回退。
- 纯生图 ≠ 像素级一致:模型每次生的人都不一样。“素材全用生图”和”跟参考图一模一样”有时打架。
- 接受不了不一致 → 走描摹/矢量化路线(更像,但不算纯新生成)。
四、工具/平台的坑
- 网页版 ChatGPT 不支持自定义技能 —— gen-ppt 这类技能调不了,要用 Codex。
- Codex Skills 还是 alpha —— 需 0.65.0-alpha.9 以上,可能踩坑。
- 图表数据靠编 —— AI 做 PPT 通病,数字”太整”多半是占位假数据,关键数据必须自己复核。
- 生成耗时 —— Thinking 模式一版 20–40 分钟,心理有数。
五、交付前验收清单(导出 PPTX 后逐页对照参考图)
导出后生成 3×3 接触表预览,逐页对照参考图检查:
- 1. 文字位置是否接近参考图
- 2. 元素大小是否接近
- 3. 主体内容是否过空(白底页内容是否集中在上中部)
- 4. 关键数字是否足够突出(够大、加粗)
- 5. 图片/图标是否可单独选中
- 6. 所有文字是否可编辑
任一页出现:主体偏小、文字偏轻、元素偏散、上下留白过大、图标/插图位置偏离明显 → 继续调,不要直接交付。
六、心法
- AI 不是不能做 PPT,AI 不能做的是”既好看又能编辑”的 PPT——不是模型不够强,是你没把活拆清楚。
- 不一定第 1 版就像,但分四层做,起码不会改到第 4 版还在原地打转。
- 图表能画,数据靠编——关键数字自己复核再交付。