IBM 近日推出 Granite 系列开源权重大语言模型的新版本 Granite 4.2,主打”可下载、可自托管”的本地部署路线,面向企业与开发者提供不需依赖云端按 token 计费的使用方式。
新版本提供 30 亿(3B)、80 亿(8B)与 300 亿(30B)三种参数规模,采用 decoder-only(仅解码器)架构,原生支持 128,000 个 token 的上下文窗口。其中 8B 与 30B 两款(3B 除外)额外经过了”智能体强化学习”阶段,强化了调用终端、检索网页、使用外部工具等能力;3B 版本同样支持工具调用,但训练侧重略有不同。

IBM 在发布说明中称,”Granite 4.2 是 Granite 语言模型家族中聚焦推理的版本”。这里的”推理”并非人类意义上的理解,而是指功能性推理——通过链式思维(chain-of-thought)将中间结果在多步计算中向前传递。对用户而言,这意味着部分场景下回答更严谨准确,但通常响应更慢、算力开销更高。
这一发布契合当下行业趋势。近来围绕 Anthropic、OpenAI 等前沿云端模型的算力与成本压力讨论不断,个人开发者与企业都在探索本地模型作为更便宜的替代方案;也带动了”模型路由器”类工具的兴起——这类工具负责解读用户请求,并将其分发给规模匹配的模型,以平衡性能、速度与成本。Granite 系列很少因”最快”或”最激进”登上头条,相较英伟达 Nemotron 等同类本地企业模型,其卖点更偏向”可预期的稳定部署”,这也契合 IBM 当下的产品定位。
开源权重模型同样受到爱好者、AI 研究者与个人开发者的欢迎:他们可以在本地硬件上自由试验,无需为每次调用支付 token 费用。







