AI 诈骗首次被单列:8.93 亿美元与 3 秒克隆的声音

美国联邦调查局(FBI)在 2026 年 4 月 6 日发布的《2025 年互联网犯罪报告》中,第一次为人工智能单独设立了一个章节。这份报告已经连续发布近 25 年,此前从未出现过这样的分类调整。变化本身就是结论:借助生成式 AI 实施的诈骗,已经从零星案例变成了需要单独统计的常规犯罪类型。

数字:22364 起投诉,近 8.93 亿美元损失

报告显示,FBI 下属的互联网犯罪投诉中心(IC3)在 2025 年共收到 1008597 起投诉,高于 2024 年的 859532 起,平均每天接近 3000 起。全年网络相关犯罪造成的报告损失接近 210 亿美元。

其中与人工智能相关的投诉为 22364 起,报告损失接近 8.93 亿美元。这个数字在整体规模中占比不高,但增长方向明确。IC3 在报告中写道,AI 生成的合成内容“越来越难以识别,也越来越容易制作”,这让犯罪者有机会对个人、企业和金融机构实施成功率更高的欺诈。

其他分类同样值得参照:加密货币相关投诉 181565 起,损失超过 110 亿美元;投资类欺诈占全部诈骗损失的近 49%;商务邮件欺诈(BEC)损失至少 30 亿美元;假冒技术支持损失 21 亿美元;情感与信任类诈骗损失 9.293 亿美元。年龄超过 60 岁的受害者报告损失约 77 亿美元,比 2024 年上升 37%。

FBI 刑事与网络分部行动主管何塞·佩雷斯(Jose A. Perez)在报告中表示:“对自己的网络安全、社交媒体足迹和电子交互保持警惕,从未像今天这样重要。”

三秒音频就够:声音不再是身份凭证

AI 诈骗中最具威胁性的形态是声音克隆。过去伪造一个人的声音需要大量录音和专业设备,如今从社交平台视频、语音留言或公开演讲中截取几秒音频就足够。有研究指出,仅用三秒录音生成的克隆语音,相似度可达到 85% 左右。

犯罪流程高度模板化:伪造一通紧急电话——绑架、被捕、车祸、突发疾病,用克隆的亲人声音打消对方的怀疑,再要求通过难以追回的渠道立刻转账,例如电汇、礼品卡、支付应用或加密货币。FBI 在 2026 年 6 月 2 日再次就此类假绑架电话发出专门提醒。

美国得克萨斯州休斯敦地区的一起案件展示了这套手法的效果。受害者黛博拉·德尔马斯特罗(Deborah Del Mastro)接到电话,对方称绑架了她的女儿,随后她听到女儿惊慌求救的声音,勒索金额为 2 万美元。她先电汇了 5000 美元,之后才确认女儿一直安全,电话里的声音由软件生成。她向当地电视台 KPRC 表示,这笔钱没能追回。

企业层面的风险更大。除了模仿家人,同一套技术模仿公司高管同样有效。2024 年,工程咨询公司奥雅纳(Arup)在一次伪造的视频会议中被骗走约 2500 万美元;更早的 2019 年,一家德国企业因一通伪造的高管电话损失约 24 万美元。任何依赖“听声音确认身份”的流程——电话核实付款、口头重置密码、语音批准转账——在语音可被秒级伪造之后,实际上已经不再具备验证效力。

FBI 的建议只有两个字:慢一步

FBI 把核心建议浓缩为一句口号:“Take a Beat”,意为停一拍再行动。抵抗对方制造的紧迫感,在交出钱款或个人信息之前先评估情况。

结合各方给出的具体做法,可以归纳为几条可立即执行的操作:

  • 挂断,用自己手机里存的号码回拨。真正的紧急情况经得住一次 30 秒的回拨核实,而诈骗方只能控制来电,控制不了对方的真实号码。
  • 提前和家人、同事约定一个只在紧急时使用的口令。克隆语音能复刻音色和语调,但无法知道一个从未被录下来的秘密。
  • 把语音从审批流程里去掉。付款确认和密码重置改用无法被伪造的渠道,例如回拨已登记号码或第二重验证因子。
  • 减少可被采集的素材。公开发布的视频、语音消息都可能成为训练素材,账号隐私设置值得重新检查一遍。
  • 遇到可疑情况立即联系银行或支付机构,并向当地公安机关报案。中国用户可通过国家反诈中心 App 举报可疑来电和链接,也建议开启该应用的来电预警功能。

值得注意的是,报告中的数字几乎必然低于真实规模。FBI 明确指出,很多受害者从未报案。这也解释了为什么监管机构强调的重点不是识别技术,而是流程:当合成内容的质量超过普通人的辨别能力时,唯一可靠的防线是核实机制,而不是判断力。