AI 时代,Word、PPT、Excel已逐渐退去,Markdown、JSON、HTML正闪亮登场
- 2026-09-21 13:00:07

你有没有遇到过这种场景:让 AI 帮你改一份 PPT,结果它把排版全改乱了;让 AI 读一份三十页的 Word 合同,它开始「一本正经地胡说八道」;让 AI 处理一张 Excel 报表,格式一言难尽,公式全部消失。
很多人第一反应是:「AI 还不够聪明。」
但如果换个角度看:问题也许不在 AI,而在 Word、PPT、Excel 这三种格式本身——它们生来就不是给机器读的。
这篇文章想聊清楚一件事:AI 时代,到底该用什么格式做事,为什么,以及普通人今天就能用上的三步工作流。
一、Word / PPT / Excel,到底哪里得罪了 AI
这三个格式统称 OOXML(Office Open XML),本质上是一个改了后缀名的压缩包——把文件后缀从 .docx改成 .zip,解压出来就能看到一堆 XML 文件。问题就出在这堆 XML 里。
结构藏得太深,AI 读起来费劲。开源办公套件 LibreOffice 背后的非营利组织 The Document Foundation 做过一次实测:把莎士比亚《哈姆雷特》全文(5,566 行)分别存成开放文档格式 .odt和 Word 格式 .docx,再看它们内部的 XML 代码量。结果是:.odt只多出约 1,200 行,而 .docx直接飙到 60,245 行——是原文的 10 倍还多。
原因是 OOXML 几乎放弃了「复用样式」这种基本设计:每一段、甚至每一个空行,都要重新声明一遍命名空间、段落 ID、样式引用;表格里的每一个单元格都要把边框、边距、字体样式完整地再写一遍,而不是像开放格式那样引用一个共享样式。这不是技术上的必要复杂度,而是结构被拆得七零八落、埋在样板代码里——人眼看不出来,AI 解析起来却要多啃十倍的「噪音」。

图 1:Word 文档的隐藏代码量,是原文的 10 倍
版本、厂商、字体、排版的兼容问题,随时可能出错。同一份 .docx,在 Word、WPS、Pages、Google Docs 里打开,字体替换、行距、分页都可能对不上;PPT 换一台电脑放映,字体缺失、图片错位是家常便饭。这些「看似小事」的兼容问题,恰恰是 AI 自动生成、自动编辑这类文件时最容易「翻车」的地方。
AI 处理这些文件,通常更费 token,也更容易读错。一份 PDF 文件里,60%~70% 的字节是不承载任何语义的二进制结构,但这些内容依然要被计入模型的输入 token;换算成纯文本或 Markdown 后,同样的内容通常只需要原来 5%~10% 的 token。行业内的格式转换服务商 MDisBetter 按 GPT-4 定价和约 4 字符/token 的比例估算过几类常见文档,结论都指向同一个方向:同一份内容,格式越「重」,AI 读它的成本越高。

图 2:转成 Markdown 后,AI 读同一份文件能省多少 token
(这份数据来自一家专注格式转换的行业博客,不是严格的学术测评,不同工具、不同文档的实际数字会有出入,但方向和数量级是站得住的——这也是为什么它值得被写进这篇文章,而不是被略过。)
二、AI 真正的「母语」,其实只有三种
反过来想:AI 自己更擅长、更愿意用的格式是什么?答案出奇地朴素——就是这篇文章标题里提到的三个:
Markdown(.md)—— 人读文档。打开 ChatGPT、Claude、Gemini 或者任何一个主流对话式 AI,你会发现它们默认输出的都是 Markdown:标题用 # ,列表用 - ,加粗用 ** 。原因很简单:Markdown 语法轻、结构清晰、人和机器都能一眼看懂层级关系,几乎不需要额外开销去「猜」文档结构。需要大纲、草稿、结构化内容的时候,优先让 AI 直接用 Markdown 输出,比让它先套一个 Word 模板要顺畅得多。
JSON(.json)—— 机器传结构化数据。这两年 AI 应用能变得越来越「靠谱」,一个关键推手就是 JSON。2024 年 8 月,OpenAI 上线了「结构化输出」(Structured Outputs)功能:在此之前,让模型稳定按照给定的 JSON Schema 输出,复杂任务上的合规率不到 40%;用上新功能后,官方测评里这个数字被拉到了 100%。Anthropic 的 Claude 也提供了对应的结构化输出与工具调用能力。换句话说,JSON 已经成了人和程序、程序和程序之间「对齐格式」的事实标准——数据交换、接口调用、程序配置,都是它的主场。
HTML(.html)—— 网页骨架。需要网页、需要可以直接打开展示的东西时,HTML 比 PPT 更合适:它天然支持交互、可以直接发布,不用担心「在另一台电脑上打开字体全变了」的问题,AI 生成和修改起来也更直接——毕竟网页本来就是文本,不是压缩包里锁着的二进制。
三、新手怎么做:先用 AI 原生格式打磨,最后一步才转 Office
把上面的道理落到具体动作上,其实就是一个简单的工作流:
关键在最后一句:Word/PPT/Excel 不是被抛弃了,而是被「挪到了工作流的最后一步」——它们仍然是分发给同事、客户、甲方最稳妥的格式,只是不该再是你和 AI 打磨内容时的默认格式。先在 Markdown 里改十遍逻辑,比在 Word 里改十遍格式,要快得多,也让 AI 靠谱得多。

图 3:先用 AI 原生格式打磨内容,最后一步才转 Office
写在最后
这场「格式的战争」背后,其实是两种设计哲学的差异:Office 三件套是为「人在软件里手动排版」设计的,结构和样式深度耦合、层层嵌套;而 Markdown、JSON、HTML 是为「文本可以被任何程序直接理解」设计的,结构清晰、开放、可读。AI 的加入只是把这个差异第一次摆到了台面上——过去我们忍受 Word 的臃肿,是因为没有别的选择;现在多了一个每天都要和它打交道的「新同事」,而这个同事,更喜欢读轻装上阵的文本。
下次打开 AI 对话框之前,不妨先问自己一句:这次要做的东西,究竟是要给人看,还是要给机器传,还是要发布到网上?答案会告诉你,该用哪种格式。
参考资料
1. The Document Foundation Community Blog, The artificial complexity of OOXML files (the DOCX case)
2. The Document Foundation Community Blog, The artificial complexity of OOXML files (the PPTX case)
3. The Document Foundation Community Blog, The artificial complexity of OOXML files (the XLSX case)
4. MDisBetter, Markdown vs PDF for AI: Token Usage Comparison
5. OpenAI, Introducing Structured Outputs in the API(2024 年 8 月 6 日)
6. Claude Platform Docs, Structured outputs
7. 腾讯云开发者社区, markdown 为什么AI都用它