英伟达在 8 月 25 日宣布,SpaceX 旗下的人工智能业务 SpaceXAI 将部署 Vera CPU,以加速其下一代智能体 AI 应用。这是英伟达首款专为 AI 智能体设计的中央处理器,标志着算力竞争从”比模型”转向”比编排”。
Vera 为何而生
传统意义上,CPU 在 AI 系统里只负责辅助工作;但智能体 AI 不同——它要反复调用工具、执行代码、处理数据,并在多次模型调用之间运行仿真。这些工作高度依赖 CPU。英伟达把 Vera 定位为”专为 AI 智能体打造的 CPU”,用来加速模型推理周边的 CPU 密集型任务。
据英伟达介绍,相比 x86 架构 CPU,Vera 在智能体 AI、强化学习与数据处理等多种负载下,任务完成速度最高可提升 1.8 倍。早期交付信息显示,Vera 集成 88 颗英伟达专门设计的 Olympus 核心,提供 1.2 TB/s 的内存带宽,单核性能提升 50%。
SpaceXAI 怎么用
SpaceXAI 前身是埃隆·马斯克创立的独立公司 xAI,现为 SpaceX 旗下部门。按照英伟达的说法,SpaceXAI 计划在 Vera Rubin 平台上扩展其聊天机器人 Grok 背后的基础设施,并借助第一代 Starmind 卫星,把优化后的 Vera Rubin NVL72 方案延伸到太空。
随着 SpaceXAI 的算力规模向吉瓦级扩张,Vera Rubin 提供了一套可统一扩展的架构,支撑其下一代”AI 工厂”——这也是 SpaceXAI 计划超越地面数据中心、迈向轨道计算的基础。英伟达超大规模与高性能计算副总裁伊恩·巴克(Ian Buck)表示,Vera 为 AI 智能体提供了实时行动所需的 CPU 性能,SpaceXAI 正将这一架构从大型 AI 工厂推向轨道计算的新前沿。
更大的棋盘:智能体基础设施
同一天,英伟达还公布了面向交互式推理的 Groq 3 LPX 全面投产,以及 Vera Rubin NVL72 在真实智能体负载下的新测试结果:基于 SemiAnalysis 的 AgentX 负载、采用 DeepSeek V4 Pro 模型,Vera Rubin 每兆瓦吞吐量最高达到上一代 GB300 NVL72 的 30 倍,每 Token 成本最高降低 35 倍。
这些数据指向一个趋势:当 AI 从”一问一答”走向”多步自主”——一次任务可能循环数百甚至数千个步骤——上下文管理与低延迟 Token 生成,正成为新的算力瓶颈。Vera 与 Groq 3 LPX 的组合,正是英伟达围绕智能体 AI 补齐的”最后一公里”。








