苹果在 iPhone 18 Pro 系列上搭载的 A20 Pro 芯片,首次采用双 16 核神经网络引擎配置,在 Apple Silicon 发展史上是头一回。该神经网络引擎专为人工智能运算负载设计,官方称其性能超过此前所有移动端 SoC。最新演示显示,一台 iPhone 18 Pro 在本地运行 270 亿(27B)参数规模的大模型时,生成词元的速度可达 iPhone 17 Pro 的两倍。

iPhone 18 Pro 与 iPhone 18 Pro Max 均配备 12GB、96 位位宽的 LPDDR5X 内存,内存带宽较上一代 iPhone 17 Pro 系列有明显提升,达到 115.2GB/s。配合双 16 核神经网络引擎,手机本地 AI 推理性能被推上新的台阶。开发者 Adrien Grondin 在 iPhone 18 Pro 上运行 Bonsai-27B 模型,直观展示了这一提升:模型生词速度相当惊人。
不过,能在离线状态下跑通 270 亿参数模型,也伴随着现实取舍。初代 Bonsai 采用 1 比特量化,4GB 内存设备即可流畅运行,8GB 乃至 12GB 内存的手机更是毫无压力;但采用 2 比特量化的 Bonsai 2 体积过大,无法完整装入 iPhone 18 Pro 的本地内存,反而会造成性能下降。这也点出了智能手机本地运行大模型的普遍困境:量化越激进,精度损失越大;要保住效果,就对内存容量提出更高要求。
在双 16 核神经网络引擎与高带宽统一内存的支撑下,iPhone 18 Pro 运行 Bonsai-27B 可保持高速、不卡顿,峰值吞吐甚至超过芯片内 7 核 GPU 在神经网络专用任务下的表现。对于希望进一步加大本地模型参数量的用户而言,后续机型的内存规格仍是关键变量。







