这是一张虚构的店铺订单表。25行,不大,颜色整齐,金额也都像真的。但如果直接点“求和”,结果不可信。
表里藏着重复订单、缺失字段、离谱折扣和一笔对不上的金额。我把它同时交给Kimi、豆包和腾讯元宝,没有先问“销售额是多少”,而是让它们先找错。
先看看这张表。你能发现几处?
第一处:同一笔订单出现了两次
O1012完整地重复了两行。订单号、日期、区域、金额和客户代号都一样。
如果不去重,销售额会多算1519.05元。这类错误很安静:公式不会报错,图表照样生成,甚至总额还会显得更好看。
第二处:1500%的折扣
O1018的折扣率显示为1500%,记录金额却是680元。
按表内数值计算,2×400×(1-15)应当得到负数;按15%计算,结果才恰好是680元。很容易顺手把它改成15%,但这一步不能让AI替人决定。
正确处理是标出异常,回查原始订单。它也可能是录入错误、字段单位混用,或者金额列本身就错了。
第三处:有50元对不上
O1020的数量是5,单价200元,折扣率10%。理论金额应为900元,表里记了950元。
差额只有50元。放在两万多元的总额里不显眼,但换成提成表、报销表或者月度对账,它就不能含糊过去。
还有两类容易漏掉的问题
O1008缺少区域,O1021缺少日期。这些空格不能根据上下两行猜。
另外,O1004和O1023已经取消,O1014已经退款。它们可以保留在明细里,但不能进入“已支付销售额”。
等等,销售额到底是多少
先写口径:完全重复行只保留一条;只统计“已支付”;使用记录金额汇总;缺失区域单独列出。
按这个口径,正确销售额是21652.30元。
其中线上12158.10元,门店9494.20元。按品类看,数码11547.30元,家居5745.20元,办公用品4359.80元。
利润算不了。表里没有商品成本、平台费用、退款损失和税费,谁给出利润率,谁就是在补数据。
三款AI都答对了,为什么我仍然不放心
我给三款工具上传同一份8KB的Excel,发送同一套12问,再用人工标准答案逐项核对。
最终结果很整齐:三家都是100分。
过程没那么整齐。
下面是本轮真实测试界面的裁剪记录。文件名、问题和关键答案都保留,账号与历史会话已经移除。腾讯元宝本轮最快。读取后直接完成分析,并额外复核了O1020的理论金额,没有看到中途报错。
豆包先遇到一次Excel读取代码错误,随后修正;折扣率判断也调整过方法。最终答案全部正确。
Kimi耗时最长。检查重复行时,临时添加的辅助列一度干扰了判断,之后重新核对并改正;末尾还出现了高峰时段切换算力的提示。
下次不要先问“总额是多少”
先让AI交代口径和异常,再让它汇总。下面这段可以直接复制:
请只依据我上传的Excel回答,不要修改文件,也不要补充文件中不存在的数据。
先读口径说明,再检查数据表:
1. 统计工作表、数据行和唯一编号数量;
2. 找出完全重复行,并写出Excel行号;
3. 列出关键字段缺失;
4. 检查折扣率、单价、数量等字段的异常范围;
5. 用公式复核记录金额,列出差额;
6. 按指定状态和去重规则汇总;
7. 无法确定时写“无法确定”,不要猜值。
每项写明结论、口径和对应编号。金额保留两位小数。
涉及收入、预算、库存、提成或报销时,再抽查几条原始记录,用Excel公式复算一次。AI适合先排雷,不适合替你签字。
真实文件上传前还要脱敏。姓名、手机号、身份证号、客户名称、合同号、内部账号和未公开经营数据,不要原样交给公共AI;公司材料先确认内部制度。
这次25行的小表,三款工具都过关了。表里的坑,仍然值得人盯着。