
很多人第一次用AI做PPT,都会下达同一种指令:给我做一份十页、科技感、关于某个主题的幻灯片。几分钟后文件确实出来了,但页面像模板拼装,文字密密麻麻,配图与观点若即若离,真到汇报前还是得从头返工。
问题不在于AI不会生成文件,而在于PPT并不是文章分页。真正能用的幻灯片同时需要三样东西:贯穿全篇的逻辑、每页恰当的视觉表达,以及后续可以修改的数据、文字和版式。把这三件事塞进一次生成,模型很容易顾此失彼。

第1张:一句话成品为什么翻车
更稳的办法,是把PPT当成一个可以编排的工程项目。先定义主题、受众、使用场景、页数和风格,再把整份材料拆成页面标题、核心观点、正文、图示、图片素材、讲稿和布局建议。每一项都有明确输入和输出,出错时也知道该改哪一环。
在这条生产线上,Codex首先扮演策划和项目执行助手。它不急着交付PPT,而是先生成整份演示的结构,再为每一页写“施工图”:这一页要证明什么,正文最多讲哪三点,适合流程图、对比图还是场景图,需要什么PNG素材,演讲时又该补充什么。

第2张:把PPT当成工程项目
这一步真正解决的是内容与视觉混在一起的问题。比如一页要解释从Prompt到Agent的升级,Codex可以先写清三阶段关系,再指定使用演进箭头图,并说明素材需要哪些节点、哪里留白。观点先站稳,视觉才不会沦为随手装饰。
接下来由GPT Image 2负责视觉素材,但不要让它直接画完整页面。它更适合生成封面主视觉、概念插图、流程背景、架构元素和统一风格的图标。标题、数据和大段正文仍应保留为PPT原生元素,否则看起来再漂亮,也只是一张难以修改的大图。

第3张:Codex先画页面施工图
最后,Presentation插件读取页面规格,把标题、正文、形状、图表和PNG素材装配成真正可编辑的PowerPoint。领导临时改标题、团队更新数字、客户要求删减页面时,都能继续调整。可编辑不是附加项,而是企业材料能够进入实际协作流程的门票。

第4张:图片模型只负责视觉
想象一份面向管理层的研发转型汇报:Codex先安排从现状、问题到方案和行动计划的主线;GPT Image 2生成演进关系和系统协作场景;插件再把关键指标做成可修改图表。第二天数据更新,只替换数字和图表,不必重新生成整套页面。这才是生产线相较“一键成片”真正节省时间的地方。
如果要落地,可以固定成五步:先明确任务规格;再让Codex生成全篇大纲;接着生成逐页规格和图片提示词;然后用GPT Image 2逐项生产素材;最后由Presentation插件装配,并由人完成审校。AI负责高耗时的结构、素材和机械排版,人负责判断与责任。

第5张:终点是可编辑PPT
这套方法也有几条边界。每页只讲一个观点,正文尽量不超过三点;图片中少放文字,关键数据一定使用原生文本;整套素材统一比例、色彩和质感;涉及政策、客户、财务或技术参数时,必须回到可靠来源逐项核验。
它追求的也不是第一版就达到满分。更现实的节奏,是让AI快速产出结构完整、视觉统一的七十分初稿,再由人通过取舍、校准和润色推到八十五分甚至九十分。把时间留给判断,比把时间耗在重复搬运和对齐上更划算。

第6张:五步跑通生产线
当流程跑通后,团队还可以继续沉淀自己的模板、页面结构、提示词和行业素材库。下一次不必从零开始,而是在已有资产上迭代。AI做PPT真正重要的变化,不是替人点几下按钮,而是把依赖个人手艺的劳动,变成可以复用、审查和协作的生产系统。

第7张:人负责最后的判断