A20 Pro 实测:iPhone 18 Pro 本地跑 270 亿参数

苹果在 iPhone 18 Pro 系列上搭载的 A20 Pro 芯片,首次采用双 16 核神经网络引擎配置,在 Apple Silicon 发展史上是头一回。该神经网络引擎专为人工智能运算负载设计,官方称其性能超过此前所有移动端 SoC。最新演示显示,一台 iPhone 18 Pro 在本地运行 270 亿(27B)参数规模的大模型时,生成词元的速度可达 iPhone 17 Pro 的两倍。

A20 Pro 芯片端侧 AI 实测

iPhone 18 Pro 与 iPhone 18 Pro Max 均配备 12GB、96 位位宽的 LPDDR5X 内存,内存带宽较上一代 iPhone 17 Pro 系列有明显提升,达到 115.2GB/s。配合双 16 核神经网络引擎,手机本地 AI 推理性能被推上新的台阶。开发者 Adrien Grondin 在 iPhone 18 Pro 上运行 Bonsai-27B 模型,直观展示了这一提升:模型生词速度相当惊人。

不过,能在离线状态下跑通 270 亿参数模型,也伴随着现实取舍。初代 Bonsai 采用 1 比特量化,4GB 内存设备即可流畅运行,8GB 乃至 12GB 内存的手机更是毫无压力;但采用 2 比特量化的 Bonsai 2 体积过大,无法完整装入 iPhone 18 Pro 的本地内存,反而会造成性能下降。这也点出了智能手机本地运行大模型的普遍困境:量化越激进,精度损失越大;要保住效果,就对内存容量提出更高要求。

在双 16 核神经网络引擎与高带宽统一内存的支撑下,iPhone 18 Pro 运行 Bonsai-27B 可保持高速、不卡顿,峰值吞吐甚至超过芯片内 7 核 GPU 在神经网络专用任务下的表现。对于希望进一步加大本地模型参数量的用户而言,后续机型的内存规格仍是关键变量。