用人工智能辅助评标正成为采购领域的现实操作,但它带来的法律风险也开始浮出水面。美国一家国防承包商指控陆军在总额约 4.5 亿美元的合同授标中不当使用了人工智能,导致自家方案被错误压低,目前已把官司打到了联邦索赔法院。

一桩围绕”幻觉”的授标争议
涉事企业 Trax International 要求法院指令陆军重新评审白沙导弹靶场任务支援服务合同的投标,理由是该部门在决定授标时”误用了人工智能”。据其 7 月底提交的文件,陆军使用的人工智能多次出现幻觉,制造出”Trax 方案弱于竞争对手 Southwest Range Services”的虚假印象——而后者的中标价约为 4.5 亿美元。
文件还指出,陆军此前向政府问责局提交的记录,并未说明给 Southwest Range Services 方案列出的优势究竟是来自授标甄选评估委员会(SSEB)的人员,还是来自人工智能工具。陆军后来承认,对 Trax 方案认定的一项”弱点”在记录中并无支撑,而这一错误弱点”典型地来自人工智能幻觉——它编造了指向 Trax 提案的虚假引用,评估委员会竟无人核对”。考虑到 Southwest Range Services 方案存在约 2940 万美元的溢价,Trax 认为移除该弱点”有可能改变授标结果”。政府问责局曾在 5 月驳回过 Trax 的投标抗议,陆军则拒绝对诉讼置评。
并非孤例
Trax 并不是第一家公开质疑政府机构”用人工智能评标”的承包商。Salient CRGT 曾指控国防部某下属机构不当使用人工智能而非人工来评审投标;政府问责局认定该指控被放弃,并于 2026 年 1 月 5 日予以驳回。
律所 Burr & Forman 的合伙人戴维·蒂姆预测,随着生成式人工智能在采购中”不受约束、不披露”地使用不断产生错误,未来会有更多投标抗议出现。但他也指出难点:如果机构不把人工智能的使用标注为”高影响”级别,承包商将很难举证政府确属误用。
规则缺口与合规警示
美国《联邦采购条例》要求评审必须由人工评估者做出独立、留痕的判断。一旦机构使用未公开的”影子人工智能”,承包商便拿不到可供质疑的记录。蒂姆建议,机构应正确将生成式人工智能采购工具标注为”高影响”,并对用例做测试、培训和负向影响管理;承包商则应在澄清会上主动追问人工智能被用于评标的程度。
这起案件的意义超出美国本土:它提醒所有把人工智能引入评标、尽调等高风险决策的采购方——模型的幻觉与偏差若未经人工复核留痕,不仅可能扭曲结果,还会在争议发生时让”由谁决策”变得说不清。无论如何,最终判断权保留在人手里、关键结论留下可核查的记录,是用人工智能评标不可省略的底线。