PPT skill用得不爽?我死磕了这4个环节
- 2026-09-23 12:57:44
ORIGIN
01 我为什么动手
现在开源的做 PPT 的 skill,说实话,已经不少了。但我自己一个个用下来,发现有几个老毛病,几乎没人解决好:只会把字排好看,不管你站着讲顺不顺。
图形全是装饰,看着有图,其实还是满屏的字做了艺术化的排版,看着很爽,但信息一股脑全糊在页面上。更麻烦的是,做错了,自动检查还告诉你没问题。

测试作品截图:看起来完整,观看与阅读仍需要逐项处理。
我原来在大媒体做视觉传播,后来在互联网大厂做企业文化。这两份工作有一项核心任务:做 PPT。我对这种表达形式,可以说到了某种病态的偏执。一页稿子的行距、一根箭头的粗细,我都能盯着看半天。
所以我干脆动手,综合几个开源 skill,加入自己这些年对“表达”的理解,做了一个坏猫版的 PPT skill,叫 badcat-slide。不管你是职场人士、商业决策者、艺术从业者、教育工作者,只要你要站着讲东西,我相信它都能帮上忙。

作品封面:用“活人感”作为单一视觉焦点,先让听众记住主题。
那位说了:现在 PPT skill 都烂大街了,你这个有什么了不起?别急,听我慢慢讲。我不跟你比功能清单,就讲四个我死磕的点。每一个背后,都有一次真实的翻车。
它做出来的是一个独立的网页文件,用浏览器就能放,也方便把文件发给别人。选择网页,是因为它能实现我想要的很多效果。

作品页面:插图配合三个短问题,再落到一句判断。
比如按一下出一条内容,点击查看细节,拖动滑杆比较前后变化。同一份文件,讲完还能打印成 PDF,发给没到场的人。
NARRATIVE
02 表达结构化
先说第一个,也是我认为 PPT 最灵魂的东西:结构化表达。
很多人做 PPT,会把材料扔给 AI,说一句“帮我做份 PPT”,然后等它出页面。但在排版之前,还有个更影响表达的问题没想清楚:这些材料到底该怎么组织?
是先把结论亮出来,还是从一个案例带进去?听众需要先理解背景,还是已经知道问题,只等你拿方案?这些判断,会直接改变整份 PPT 的演示顺序和表达骨架。

结论先行的页面形式:先突出一个关键数字,再补充背景。数字来自原案例。
我在 skill 里加了一步,叫“小模型推大模型”。这里的“小模型”,指的是叙事的思维模型。
里面放了 19 个叙事框架,包括 SCQA、4MAT、AIDA、黄金圈。但使用时,你不用先学这些名字。
它会问几个简短的问题,了解你要讲给谁听、希望讲完达到什么目的,再把适合的框架写成几份通俗的章节提纲,让你挑。

资料装满就发车,至于听众去哪儿,导航没开。
选定以后,大模型才按这个思路整理材料。不管你交给它的是一份文档,还是好几份资料,都要重新拆分、安排顺序,组织成一条能讲下去的线。

叙事页面:用历史节点组织案例,把材料串成一条讲述线;横轴用于排列事件。
我还特意加了一条规则,不许直接拿原文档的目录当演讲骨架。文档可以前后翻,可以跳着查。台下的听众得跟着你一句一句听。原来的目录即使适合阅读,也得重新判断,照这个顺序讲,听众能不能听明白。
VISUALIZATION
03 信息可视化
第二个,信息可视化。
有一页 PPT,我印象特别深。它讲的是“三次转向,窗口越来越短”,配了一条时间线。我量了一下,三个间隔都是 405 像素。
嘴上说越来越短,图上却一样长。观众看这张图,怎么能看出变化?偏偏自动检查也是全绿。

事故案例原页:文字说窗口在变短,时间线的三个间隔却相等。
我还统计过四份实际生成的 PPT,结构图和真正的数据图,用量大约是 3 比 1。AI 很爱画框框,把文字装进漂亮卡片,再连上箭头。有些结构确实需要这样画,但很多页面只是把列表换了个外壳,内容仍然要逐个读完。

数据图页面:把不同方案的交付量放在横条图中比较。数字沿用原作品内容。
于是,我给 skill 补了 27 个可以直接使用的图形组件,流程链、金字塔、时间线、华夫图、漏斗图都有。选图时也有一条明确要求,能用图把关系讲清楚的材料,就不要直接列成几条文字。

华夫图页面:用格子的数量区分入选与废弃比例。数字沿用原作品内容。
但光有组件还不够,图形本身得表达信息。四个一样大的格子,只能让人知道有四步。如果其中一步风险更高,图上就要有相应的强调。
如果时间间隔在缩短,节点之间的距离就应该跟着缩短。
我希望观众还没读完字,就已经看出了哪部分更重要、哪里发生了变化。像那条时间线,至少要让人看见,留给你的时间确实越来越少了。
INTERACTION
04 元素交互化
第三个,元素交互化。
PPT 分两种。一种给人讲的,一种给人看的。
给人看的 PPT,信息可以铺得完整一些,读者能停下来细看,也能往回翻。可你站在台上讲的时候,整页内容一下全出来,观众很容易先去读屏幕。等他读完,你可能已经讲到别处了。
所以演讲时,讲到哪里,画面就展开到哪里。这也是我做元素交互的主要原因。
skill 里集成了 12 种交互组件。按一下,出现一条新内容。

重点标注页面:将字段与右侧解释一一对应,让读者顺着标注找到重点。
需要补充的细节,点开卡片再看。比较前后变化,可以拖动滑杆。

原始录屏转动图:点开细节,拖动比较。
这些组件用多少、放在哪里,要看这份 PPT 怎么用。演讲模式下,展开内容的节奏由讲者控制。阅读模式下,就让读者自己点开感兴趣的部分。
我不希望观众忙着读屏幕,页面能配合你,这场演讲才会顺。

原始录屏转动图:内容随讲述逐条展开。
INSPECTION
05 体检自动化
第四,体检自动化。
这个 skill 不信自己的手艺,只信体检的结果。
现在每做完一份 PPT,可以用一条命令启动检查。它会在浏览器里把每一页实际渲染出来,再去看文字有没有溢出、面板有没有重叠、字体有没有正常加载。
字体就有个容易漏掉的坑。服务器返回成功,不代表字体真的下载下来了。页面照样能打开,原本的宋体却可能变成了黑体,版面也跟着变了。

字体对照素材:同一页内容,使用宋体。

字体对照素材:同一页内容,替换为黑体。
除此之外,检查还会看一行字是不是太长,是不是连着七八页都没有图,讲稿有没有一直重复屏幕上的文字。
其中六项指标,每次都会打印具体数字,合格也照样显示。这样连续做几份,就能看出文字是不是越来越多、页面是不是越来越挤,不必等到超标才发现。
真的超了,报告也得告诉我去哪里改。比如哪一页最严重、有几段内容需要处理,而不是只丢给我一个“不合格”。
这个 skill 有条哲学:每条检查背后,都是一次我经历的真实翻车。把失败的经历写进 skill,它就不会一路开绿灯,让失误轻易溜过去。

一键生成省下的时间,刚好够逐页返工。
OPEN SOURCE
06 关于开源
最后,这个 badcat-slide,现在还在我的电脑里,我打算再用几轮、改几轮,然后开源到 GitHub。
如果你现在就想试,可以直接联系我,我会无偿分享。也欢迎把用着不顺的地方、做坏的页面发给我。前面这些改进就是这么来的,有具体问题,我才知道还该往哪里改。
AUTHOR
坏猫
AI商业视频解决方案专家
微格AIGC工作室创始人
广州市新闻工作者协会AI战略总顾问
香港GIS2025AIGC大赛评委
如果你觉得今天这篇有收获,欢迎点赞、在看、转发三连,我们下篇见