亲测:让四款AI做同一份PPT,结果全在编数据
- 2026-09-22 15:52:54
亲测:让四款AI做同一份PPT,结果全在编数据大家好,我是一路打怪的Mayo,工具测评来啦!今天是大家最熟悉的PPT功能。 最近做PPT做到脑壳痛,突发奇想,我用同一份公司经营数据(模拟脱敏),一字不差地喂给四款AI(Kimi、豆包、WorkBuddy、百度搭子),让它们各自生成一份《A公司财务分析报告》PPT,14页,商务风。结果会怎样呢? 一开始我觉得提示词和数据给得挺具体,应该不会翻车,结果有点意外,先说一个反常识的:做得最快的,不一定做得对;做得慢的,反而最守规矩。 
Kimi最快,数字也最稳;豆包第二快,结果翻车了;百度搭子最慢,但最规矩;WorkBuddy呢,分析最有想法,却自己编了个假数据出来糊弄我。 大家一起看看有什么小坑小洼吧。 先把好话说在前面。我喂进去的那张表,四年营收、净利润、毛利率、净利率、现金流,四款都算对了。营收复合增速24%、净利增速36%、估值25倍到30倍对应多少亿,全对。 这说明一件事:只要是你给的数据,AI处理得挺靠谱。它算增长率、算比例,比人快,还不容易抄错行。 问题出在另一头。 这份PPT有14页,其中几页是"行业与竞争格局""公司概况""偿债能力"。这个维度要求要进行分析,可我的原始数据里没给。 AI不能空着啊,于是它开始自己脑补。猜猜四家编出了什么: 订阅收入占比,三家给了三个数:62%、65%、68% 付费客户数,三家打架:1850家、800多家、500多家 行业规模:一家说1050亿,一家说1200亿 前五大公司集中度:一家说18%,一家说35% 
同一家公司,同一份材料,编出来的数能差出一倍。这些数看起来特别像真的,有零有整,还精确到个位。 这比算错更危险。算错一眼能看出,编的数天衣无缝,你不去查原始数据,根本不知道它哪来的。 豆包同学在第12页分析ROE(净资产收益率),结论写的是14.5%,对。 但它下面给了三个分解数字,说14.5%等于净利率9.6%乘以周转率0.71乘以权益乘数1.98。我校验了下:9.6% × 0.71 × 1.98 = 13.5%。差了整整一个百分点。 
结论是对的,过程是瞎填的。这种错最阴,你一眼扫过去,"哦结论对",就抄走了。只有重新算一遍,才抓得到。 说实话我看到这儿有点想笑。豆包平时陪我聊个天、接个话、规划下旅行是真好用,一让它算乘法,就给我整出这么个结论对、过程错的活儿。看来啊,还是让它陪聊天靠谱点,算数这件事,还是算了吧。 这我是真被上了一课:以后AI给的财务结论,光看结论对不够,得看它中间的过程能不能圆回来。 WorkBuddy分析得其实最有想法。杜邦那页它没写三个因子相乘,改成了归因拆解:净利率贡献+3.4个点、周转率+1.8个点、权益乘数拖了1.7个点,加起来正好3.5个点,跟ROE从11%涨到14.5%对得上。估值还用了PE和DCF两种方法交叉验证,有真东西。 但也它干了一件无中生有的事情:为了解释"净利率只涨了2.3个百分点",它生造了一个理由:"政府补助退坡,抵消了9.2个百分点"。 还配了张图,写着"2025年补助影响负1.9个百分点"。可我的原始数据里,从头到尾没提过一个"补助"的字。 
它这是为了把故事讲圆,自己造了一个机制塞进去。数学上严丝合缝,事实上子虚乌有。这比算错数难防得多,因为算错是失误,编机制是它"自作主张给你补信息",而你根本分不出来。 看的出来,你的AI吭哧吭哧很努力,它特别想把你的任务完成,圆不上的地方,它会拼命自己圆回来。圆不动了,就造点东西补上去,幻觉是这么来的,交出来的不一定是你想要的。 复盘到这儿,我突然发现一件事。四家全在编,根子不在哪家笨,在我给的那个提示词(prompt)里,漏了一句最关键的: 我没告诉它,数据只能用我给的,没有的不许自己编。 我就给了四年的核心数据,却要求它把"行业格局""公司概况"这些页也要写。这些页本来就要数据,我没给,它又不能空着,只能脑补。 所以严格说,不是AI爱编,是我这个出题的人,把题目出成了"逼它编"。 AI自动出PPT,很难一步到位。它一步能到位的是结构,14页大纲、图表类型、排版布局,这些都稳稳的。真正一步到不了位的,是数字,是那些需要人拍板、需要查证的事实。 六、复盘后有几点建议 如果你也想用AI做PPT,尤其里面带数字、带数据的,这几条是我这次烧出来的,你抄去就能用: 第一,开头就锁数据范围。在提示词建议加一句:"只准用我提供的数字,没有的数据一律写'待补充'或'此处需核实',禁止自行编造任何数字。"就这一句,能砍掉大半幻觉。我这次就是没考虑,直接全军覆没。 第二,要哪页有数据,就先把数据喂给它。比如要做行业分析,提前把行业规模、增速、份额这几个数给它,别指望它自己查。或者可以连接知识库,减少它自己去乱想。 第三,结论对不等于过程对。拿它给的结论,别急着抄。增长率、比例、那种"乘以乘以"的分解,可以设定校验机制,再验证一遍,30秒挡掉90%的坑。 第四,警惕编得特别圆的故事。越圆越要怀疑,一句"补助退坡抵消9.2个百分点"说得头头是道,但数据源在不在,你得问一句,可以要求AI追溯数据来源。 Mayo说说 其实测完这一轮我反而没那么焦虑了。AI做PPT确实快,但它快在结构,不在判断;快在速度,不在准确。这也挺好的,它把搭框架、排版的脏活累活干了,把"盯数字、做判断"这件真正值钱的事,留给了我们。 下次我准备再试一招:把锁范围的提示词加上去,看同样的四款,会不会老实很多。 测完这一轮Kimi是最稳妥最靠谱的,我也算是明白我朋友为什么生日礼物点名要Kimi年费,我当时还纳闷,的确做分析做报告这块,它确实相对靠谱些。 你们要是也想试试,评论区告诉我,你平时让AI做PPT,有没有碰到过它一本正经胡说八道的时候。 以上内容涉及个人主观意见,不作为专业引用。
我主要是按六个维度一项一项测评比对:速度、大纲结构、数字保真、诚实标注、排版可用度、二次修改好不好改。
结论:结构、排版、速度这几项,四家差距不大,14页都齐,图表也都像样。真正的分水岭在中间两项,数字保真(我给的数,你算对没)和诚实标注(没给的数,你标没标)。
按10分制综合打分:Kimi8.5、百度搭子8.0、WorkBuddy7.0、豆包6.0。六项细分加总(满分50)也是这个排序:Kimi48、百度搭子43、WorkBuddy和豆包并列40。

一、给你的数,它基本都算对了
二、没给的数,它全在编,而且各编各的

三、最坑的是这个:结论对,过程错

四、WorkBuddy更绝,它编了个假机制

五、根子在哪?我一开始就没锁范围
本文来自网友投稿或网络内容,如有侵犯您的权益请联系我们删除,联系邮箱:wyl860211@qq.com 。