讯飞星火 X2.5 发布:2930 亿参数,全国产算力限时五折

9 月 7 日,科大讯飞正式发布星火 X2.5 大模型。该模型采用 MoE(混合专家)架构,总参数规模达 2930 亿,单次推理激活 300 亿参数,重点提升了代码生成与智能体能力,数学推理、语言理解等通用能力也持续增强。目前,星火 X2.5 已上线讯飞开放平台。

全国产算力全流程训练

星火 X2.5 的一个鲜明标签是全程依托国产算力完成训练与推理。科大讯飞表示,模型全面适配国内软硬件生态,并针对国产平台持续优化超长序列的训练与推理效率。在当前算力供应存在不确定性的背景下,全栈国产化意味着模型训练和交付能力不受外部供应链波动影响,这也是星火系列区别于多数国产大模型的核心特征。

模型支持 256K 超长上下文窗口,可处理长文档解析、长代码库理解等任务。在能力侧重上,X2.5 重点强化了代码生成的可靠性与规范性,并增强了多轮交互的稳定性,面向智能体(Agent)开发场景进行了专门优化。

限时五折:输入 1.6 元、输出 6 元

定价方面,星火 X2.5 当前提供限时五折优惠:每百万 Token 输入费用 1.6 元,缓存命中输入 0.24 元,输出 6 元;对应原价分别为 3.2 元、0.48 元和 12 元。与大模型 API 常见的”低价引流后回调”不同,这一价格直接对标主流开源模型 API,对企业用户批量调用具有一定吸引力。

两款端侧模型已开源

除基座模型外,科大讯飞此前已开源星火 X2.5-4B 和 1.7B 两款轻量级端侧模型。两款模型均支持最长 100 万 Token 的上下文长度,可本地部署于长文档处理、代码辅助、数据分析等场景,适合对数据隐私和离线可用性有要求的政企用户。

从端侧 100 万 Token 上下文到云端 2930 亿参数基座,星火 X2.5 形成了覆盖云端推理、本地部署和终端侧运行的完整产品矩阵。对于关注国产算力生态和混合部署方案的开发者与企业而言,这款模型提供了除开源通用模型之外的另一个选择。