GPT / Codex 做 PPT:避坑与验收清单

素材:全部 10 篇 GPT/Codex 笔记的翻车点合集


一、提示词层面的坑

  • 别只写一句”帮我做个 XX 的 PPT” —— AI 不知道几页、什么风格、给谁看、重点是啥,只能瞎猜。要逐页指定。
  • 配色一定要写进提示词 —— GPT 不会自己思考统一配色。第一版翻车、第二版成功,差的就是提示词里那几句话。
  • 提示词别写泛话 —— “modern Chinese presentation style""navy-blue line icon”模型听不懂,只会按默认理解出图。要写死:粗线条、单一颜色 073b8e、不是 web icon、不是手绘。
  • 提示词只解决”要什么”,不解决”像不像” —— 想对标参考图,光改提示词到不了,要上”测量+回退”的工程。

二、四层结构层面的坑

  • 只做前 3 层 = 永远差一档 —— 文字图标都能编辑了,但不像参考图,因为漏了第 4 层(排版规范)。
  • 素材是素材的事,排版是排版的事 —— 图标人物单独看都好,拼到 PPT 上还差一档,根因是排版没单独定规则(字号字重、卡片大小、间距、对齐、圆角线宽)。
  • 要生图就让它真生图,别让它偷懒裁图 —— 素材要透明 PNG、每个图标是独立对象、文字不能生成在图片里。

三、人物插图的坑(已知难点)

  • 带人物插图的页最难做像,最差差距到 0.31(其他页 ~0.18)。
  • 想照参考图生”一模一样”的人:可能顺手多生条波浪、人脸身体色块太大,分数反而更差,常常要回退。
  • 纯生图 ≠ 像素级一致:模型每次生的人都不一样。“素材全用生图”和”跟参考图一模一样”有时打架。
  • 接受不了不一致 → 走描摹/矢量化路线(更像,但不算纯新生成)。

四、工具/平台的坑

  • 网页版 ChatGPT 不支持自定义技能 —— gen-ppt 这类技能调不了,要用 Codex。
  • Codex Skills 还是 alpha —— 需 0.65.0-alpha.9 以上,可能踩坑。
  • 图表数据靠编 —— AI 做 PPT 通病,数字”太整”多半是占位假数据,关键数据必须自己复核。
  • 生成耗时 —— Thinking 模式一版 20–40 分钟,心理有数。

五、交付前验收清单(导出 PPTX 后逐页对照参考图)

导出后生成 3×3 接触表预览,逐页对照参考图检查:

  • 1. 文字位置是否接近参考图
  • 2. 元素大小是否接近
  • 3. 主体内容是否过空(白底页内容是否集中在上中部)
  • 4. 关键数字是否足够突出(够大、加粗)
  • 5. 图片/图标是否可单独选中
  • 6. 所有文字是否可编辑

任一页出现:主体偏小、文字偏轻、元素偏散、上下留白过大、图标/插图位置偏离明显 → 继续调,不要直接交付。

六、心法

  • AI 不是不能做 PPT,AI 不能做的是”既好看又能编辑”的 PPT——不是模型不够强,是你没把活拆清楚。
  • 不一定第 1 版就像,但分四层做,起码不会改到第 4 版还在原地打转。
  • 图表能画,数据靠编——关键数字自己复核再交付。