在近日举行的 Jamf 用户大会(JNUC)上,苹果公司展示了一张端侧 AI 推理能力对比图表,首次系统性公开从 iPhone、iPad 到 Mac Studio 集群的完整硬件梯队的本地大模型上限。这张图表由开发者 @aaronp613 在 X 平台披露,揭示了苹果统一内存架构在设备端 AI 推理中的核心作用。

图表按设备定位列出了可承载的最大激活参数规模:
iPhone 与 iPad:最高 140 亿参数,配备 16GB 统一内存、76GB/s 内存带宽,主要覆盖 Siri、文字润色、图片处理等轻量端侧任务。
MacBook Air:最高 350 亿参数,32GB 统一内存、153GB/s 带宽,面向中等 AI 负载与移动办公场景。
Mac mini:最高 700 亿参数,64GB 统一内存、307GB/s 带宽,适合运行更强的本地模型与隐私敏感任务。
MacBook Pro:最高 1,200 亿参数,128GB 统一内存、614GB/s 带宽,定位专业级大型模型与重度创作开发。
Mac Studio:最高 4,800 亿参数,512GB 统一内存、1.2TB/s 带宽,承担高强度 AI 推理及影视、科研算力。
Mac Studio 集群:最高 1.6 万亿参数,2TB 统一内存、1.2TB/s 带宽,面向集群级超大模型本地训练与推理。
苹果的方案依托统一内存架构,内存容量与带宽直接决定硬件可加载模型的参数量。设备定位越高,本地 AI 能力越强,这意味着越高端的设备越能在不依赖云端的情况下运行更大规模的模型,在隐私与离线场景中具备明显优势。







