想让 AI 分析一份报表,很多人的第一反应是导出成 PDF 再上传。结果往往是表格的列对不上、多栏文字顺序全乱、公式只剩计算后的数值。问题不在 AI 不够聪明,而在 PDF 的设计目标本就是「固定外观」而非「保留结构」。

MakeUseOf 撰稿人 Oluwademilade Afolabi 的判断标准很简单:导出为 PDF 之前文件是什么格式,就传什么格式。他实测了以下六种。
一、CSV:只有一张干净表格时
- 确认第一行是清晰的列标题,后面每行代表一条记录。
- 删掉空行分隔符和多余的装饰行。
- 上传后可要求 AI 汇总各列、找趋势和异常值、做计算或生成图表。
他上传一份小额支出记录,AI 准确标出那笔偏高的 290 美元 CloudHost 付款,以及两条重复的 8.75 美元 City Cafe 记录。同样内容若拆散在 PDF 好几页里,结果就没这么可靠。
二、XLSX:多张工作表要留在一起时
PDF 会抹掉工作表边界,还会把公式压缩成显示结果,XLSX 则能保住表与表的关系。要点是把重要数据放在普通单元格里,工作表命名清楚,不要混入无关表格、空行分隔或「数值写在图片里」的做法。图表数值很关键时,把背后的源单元格一并提供。
三、JSON:信息是嵌套结构时
应用导出、接口返回、配置文件、浏览器记录、诊断日志,往往是对象套对象,扁平表格装不下。他的测试文件里有两台设备、位置对象、带时间戳的读数以及一条报错,AI 顺着设备列表追进读数,定位到第二台设备的超时问题。
非程序员同样能用:让 AI 解释陌生字段结构、比较对象、列出缺失字段,或把选定属性转成表格。上传前务必校验文件,少一个逗号就会让解析失败。
四、DOCX:要改的是文字而非版面时
适合抽取标题层级、调整章节顺序、精简段落、比较草稿、调整语气。但批注、修订记录和嵌入对象未必能被完整读取。OpenAI 现行说明提到,文档和演示文稿里嵌入的图片不受支持,关键图片建议单独再传。
五、PPTX:要看的是演示逻辑时
幻灯片的真正结构在于页序、信息密度、重复观点以及从问题到结论的推进。他用一份四页运营复盘测试,让 AI 列出页标题、找出重复建议、评估论证是否递进,结果准确指出「账单覆盖率」这条建议在第三页和最后一页各出现一次。据此他把第三页改放支撑证据,最后一页只留结论。
六、PNG:内容只存在于屏幕上时
报错弹窗、设置页面、软件界面、图表、票据这类只有截图的内容,直接传 PNG 更好。他用一张模拟的云同步报错截图测试,AI 读出了错误代码、最近一次成功同步时间和诊断 ID,连底部小号版本号都识别出来。
先裁掉无关区域、保证标签清晰可提高识别率。但小号文字、旋转内容、复杂图表和靠颜色区分的折线,可靠性都会下降。
结论
六种格式指向同一条原则:保留结构而非外观。OpenAI 文档还列出 XLS、TSV、TXT、XML、YAML、MD 等。
来源:MakeUseOf







