苹果 M5 Ultra Mac Studio 评测:本地 AI 算力怪兽

评测集中出炉

在苹果全新 M5 Ultra Mac Studio 于 9 月 22 日正式发售前夕,多家媒体提前放出评测。这台机器与同步亮相的 M6 Mac mini 一起,成为专业用户关注的焦点。科技媒体 9to5Mac 汇总了首批评测观点,核心结论高度一致:M5 Ultra Mac Studio 是一台为本地人工智能任务而生的”算力怪兽”。

本地跑大模型成为现实

知名评测人 Federico Viticci 在 MacStories 上用顶配版(256GB 内存)进行了数天测试。他的结论是:这台机器是运行本地 AI 智能体的”梦想设备”,可以在不额外支付云端算力费用的情况下,用本地模型驱动个人助手。他还把新机与搭载 M3 Ultra、512GB 内存的上一代,以及一台配备 RTX 5090 的台式机做了对比,认为苹果的统一内存架构从根本上改变了人们对本地模型能力的认知。

在视频博主实测中,满配版本(36 核 CPU、80 核 GPU、256GB 内存)成功在本地完整运行参数规模达 156GB 的 DeepSeek v4 Flash 模型,并用它几分钟时间做出了一款小游戏。另有评测者指出,256GB 版本上表现最佳的模型是 Qwen 3.8 Flash Next。

速度提升显著

Viticci 给出的量化数据颇具说服力:M5 Ultra 的提示词处理速度平均比 M3 Ultra 快约 150%,接近 2.5 倍。在 6.5 万 token 的提示词下,M3 Ultra 需要 59.7 秒才输出首个 token,M5 Ultra 仅需 24.4 秒;当上下文拉长到 26 万 token 时,两者分别为 246 秒和 104 秒。生成速度方面,Flash-Next 在短提示词下可超过每秒 100 token,即便上下文堆到 64K 至 256K,仍有每秒 60 至 85 token。

与独立显卡的取舍

相比 RTX 5090,M5 Ultra 在提示词处理上仍落后约 25%,生成速度也稳定落后,原因在于内存带宽(1.79 TB/s 对 1.2 TB/s)。不过 5090 仅有 32GB 显存,要处理 256K 上下文只能开启 8-bit 注意力缓存,一旦通过 PCIe 借用系统内存,生成速度会骤降到每秒 1.5 至 4.6 token。Mac 的统一内存池则不会出现溢出问题。

价格与定位

顶配版本(256GB 内存、4TB 存储)售价 12,299 美元;M5 Ultra 版本起售价 5,499 美元,512GB 内存版本预计 10 月底上市。在中国市场,M5 Ultra 版本起售价 42,999 元,M5 Max 版本起售价 19,999 元,顶配(256GB 内存、2TB 存储)售价 90,499 元。

苹果称 M5 Ultra 的 AI 性能较 M3 Ultra 最高提升 4.3 倍,较 M1 Ultra 提升 9.8 倍,内存带宽达 1.2 TB/s,可本地运行 700 亿参数级别的大模型。Geekbench 显示其 Metal GPU 得分最高 360,019 分,较 M3 Ultra 快 56.2%。

Tom’s Guide 评价其为迄今评测过的最强电脑:紧凑、凉快且安静,配备 6 个雷雳 5 接口。Viticci 也坦言,如果只是为了每月花 20 美元使用云端 Claude,这套本地方案并不值得折腾,它仍属于最前沿那一档。