AIPPT 系列 · 生成对比·AI 高效办公指南
想要AI做的PPT好看也不难
从人为约束到模型自带审美,第四套 NotebookLM 到底强在哪?
多模态信息图完成度
前面几篇用人为约束把 AI 做的 PPT 一步步提上来,这一篇看第四条路——多模态整页生成,以及它和 skill 路线的本质差别。
还是同一份 AI 主题 10 页大纲,用 NotebookLM 跑出来的效果如下。
NotebookLM 生成 · 共 9 页 · 点击可放大
配色是蓝灰底加陶土色点缀,专业里带一点温度。配图明显重了,等轴测金字塔、流程图、尺寸标注线,一页里能同时摊开概念和结构。布局左右对打、模块嵌套,已经完全看不出大标题下面三条 bullet 的老样子。整套翻下来,更像一本能拿去讲的信息图册,而不是一叠还在靠文字硬撑的幻灯片。
先和 dashi-ppt 比。冷白底、墨字、亮绿强调,排版稳,完成度已经像成品。短板是主体仍是文字,图多半靠色块和卡片撑版面,插画叙事没跟上,好看在排版,不在看图说话。
再看 ppt-master。它专门补配图,概念几乎都能画成图,深蓝加橙,信息密度高。但工序仍是两步,先为每页生成插画,再把图和字写进 SVG 页面,图和文拼在同一页,还不是整页就是一张信息图。WorkBuddy 和这类靠提示词约束或模板组件的 skill,多半也落在同一类里。
NotebookLM 这条不一样。以第 3 页为例。
从左至右:dashi-ppt · ppt-master · NotebookLM 第3页
左边带尺寸线的等轴测金字塔,右边输入到输出的工作方式图,标题和注解都嵌在画面里,不太像先排版再塞图,更像整页一次性画出来。所以第一篇才说,完成度和丰富度明显高于前三套,已经接近能拿去讲的信息图册。大纲从头到尾就一份,不是第四套大纲写得更细,差别只在生成方式,一个主要在写和排,一个把一页当成完整画面来生成。
到这里可以回头看一看。前几篇靠的是人做约束这条路,提示词、页面组件、设计规格,把模型和版式卡住,好看才稳。这条路有效,第三套、ppt-master 都是证据;但要做到第四套那种整页信息图感,只靠人把 DESIGN 写得更长,往往仍差一口气。
第四套亮出来的是另一条路,背后是多模态模型。它会写字,也会把一页当画面来看、来生成。有大脑,也有眼睛;训练里见过大量排版和信息图,等于上过审美课。疏密、对齐、图示长什么样,不必你把色值面积全写进提示词,生成时自己就带着分寸。
这和第一套网页对话差得很远。第一套多半是会写要点的大脑,眼睛和审美不够,出来就空、薄。第四套是大脑、眼睛、审美课一起上,同一份大纲,完成度能明显高出一截。
多模态换来的是审美和完成度,代价也很清楚。
一是文字难改。字焊在图里,改标题、换数字,常常只能整页重画,不能像挪文本框那样顺手。同事也很难像改 PowerPoint 那样直接动手。能讲、能投屏,不等于能当可编辑稿在流程里传来传去。
二是动效基本没有。画出来的是静帧,翻页可以,页内动画和交互基本指望不上。前面说浏览器、代码路排版和动效好控,对照就在这里,代码路还能动,整页生图路多半不能。
所以它适合的场景很具体。要图示清楚、内训分享先出一版能投的画面、信息图册那种完成度,很顺畅;要领导改字、数字会变、密表、可编辑 pptx,就很别扭。好看和能改,又不是一回事。
一路试下来,好看大致靠两股力量。
一股是人做约束,提示词、STORY / DESIGN、技能页面、SVG 工序。模型主要在写和排,中间往往是代码或网页。
另一股是模型自带审美,多模态整页生成,画面一次成型。NotebookLM 是这组案例里,最先把这股力量用足的一版。
这两股力量并不互相取代。没有约束会飘;只有约束、模型不会看页面,又容易停在能翻页却不耐看。第四套的意义,是证明 PPT 要好看,除了人把规矩卡死,还可以换上被训练过审美的多模态模型,它有大脑,也有眼睛。