iPhone 18 Pro 实测:本地跑通 270 亿参数大模型

# iPhone 18 Pro 实测:本地跑通 270 亿参数大模型

苹果在 iPhone 18 Pro 系列中搭载的 A20 Pro 芯片,首次在苹果自研芯片发展史上配备了双 16 核神经网络引擎。这套神经网络引擎专为人工智能运算负载设计,官方称其性能超过此前所有手机芯片。最新的实测演示显示,一台 iPhone 18 Pro 在本地运行 270 亿参数规模的大模型时,生成速度可达 iPhone 17 Pro 的两倍。

双 16 核神经网络引擎首登场

iPhone 18 Pro 与 iPhone 18 Pro Max 均配备 12GB、96 位位宽的 LPDDR5X 内存,内存带宽相比上一代 iPhone 17 Pro 系列有明显提升。内存规格升级,叠加双 16 核神经网络引擎,将手机端本地人工智能性能推上了新台阶。

开发者阿德里安·格龙丁(Adrien Grondin)在 iPhone 18 Pro 上运行名为 Bonsai-27B 的模型,直观展示了这一提升:模型生成词元的速度相当惊人。在此基础上,该机统一内存的带宽可达 115.2GB/s;双 16 核神经网络引擎在神经网络专用任务下的峰值吞吐性能,甚至超过了芯片内部 7 核图形处理器。

本地跑 270 亿参数,速度翻倍

对手机而言,能够离线运行体量更大的 270 亿参数模型,本身是一次重大进步。初代 Bonsai 是一款 1 比特量化模型,4GB 内存的设备就能轻松运行;在 8GB 乃至 12GB 内存的手机上运行更为流畅。借助 A20 Pro 的大内存与高带宽,运行 Bonsai-27B 可以保持高速,不出现降速卡顿。

大模型的取舍:内存仍是瓶颈

不过,本地运行大模型仍需面对现实取舍。有观点认为,既然 Bonsai 2 已经发布,是否还有必要继续使用初代版本。答案并不乐观:采用 2 比特量化版本的 Bonsai 2 体积过大,无法完整装入 iPhone 18 Pro 的本地内存,反而会造成性能下降。

这也反映出智能手机本地运行人工智能模型的普遍困境——参数规模与内存容量之间的平衡。业界普遍期待,后续机型能够进一步加大内存规格,让设备可以支持参数量更大、复杂度更高的大模型。