<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>星辰大模型 &#8211; mylogs.cn</title>
	<atom:link href="https://mylogs.cn/tag/%e6%98%9f%e8%be%b0%e5%a4%a7%e6%a8%a1%e5%9e%8b/feed/" rel="self" type="application/rss+xml" />
	<link>https://mylogs.cn</link>
	<description>发现、记录、分享</description>
	<lastBuildDate>Tue, 29 Sep 2026 16:26:59 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	
	<item>
		<title>中国电信开源 Xing4.0-29B：全栈国产训出的智能体模型</title>
		<link>https://mylogs.cn/%e4%b8%ad%e5%9b%bd%e7%94%b5%e4%bf%a1%e5%bc%80%e6%ba%90-xing4-0-29b%ef%bc%9a%e5%85%a8%e6%a0%88%e5%9b%bd%e4%ba%a7%e8%ae%ad%e5%87%ba%e7%9a%84%e6%99%ba%e8%83%bd%e4%bd%93%e6%a8%a1%e5%9e%8b/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Sat, 19 Sep 2026 11:12:08 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[MoE]]></category>
		<category><![CDATA[Xing4.0]]></category>
		<category><![CDATA[中国电信]]></category>
		<category><![CDATA[开源大模型]]></category>
		<category><![CDATA[昇腾]]></category>
		<category><![CDATA[星辰大模型]]></category>
		<category><![CDATA[智能体]]></category>
		<guid isPermaLink="false">https://mylogs.cn/%e4%b8%ad%e5%9b%bd%e7%94%b5%e4%bf%a1%e5%bc%80%e6%ba%90-xing4-0-29b%ef%bc%9a%e5%85%a8%e6%a0%88%e5%9b%bd%e4%ba%a7%e8%ae%ad%e5%87%ba%e7%9a%84%e6%99%ba%e8%83%bd%e4%bd%93%e6%a8%a1%e5%9e%8b/</guid>

					<description><![CDATA[中国电信于 9 月 17 日通过旗下中电信人工智能科技有限公司发布新一代星辰大模型 Xing4.0-29B-A [&#8230;]]]></description>
										<content:encoded><![CDATA[<p class="wp-block-paragraph">中国电信于 9 月 17 日通过旗下中电信<a href="https://mylogs.cn/chatgpt-pro-%e9%87%8d%e5%bc%80-200-%e7%be%8e%e5%85%83%e6%a1%a3%ef%bc%9aapi-%e4%bb%b7%e5%80%bc%e8%bf%91%e7%bf%bb%e5%80%8d/"><a href="https://mylogs.cn/%e8%85%be%e8%ae%af%e5%86%85%e6%b5%8b-ai-%e6%b8%b8%e6%88%8f%e6%90%ad%e5%ad%90%e9%b9%85%e6%ac%a1%e5%85%83%ef%bc%9a%e6%95%b0%e5%ad%97%e4%ba%ba%e9%99%aa%e4%bd%a0%e5%bc%80%e9%bb%91/">人工智能</a></a>科技有限公司发布新一代星辰大模型 Xing4.0-29B-A4B，并同步在多个开源社区开放权重。这款模型定位为面向智能体时代的轻量级代码智能体大模型，强调在国产<a href="https://mylogs.cn/ai-%e6%99%ba%e8%83%bd%e4%bd%93%e5%bc%95%e7%88%86%e9%9c%80%e6%b1%82%ef%bc%9a%e6%9c%8d%e5%8a%a1%e5%99%a8-cpu-%e4%ba%a4%e4%bb%98%e8%a6%81%e7%ad%89-30-%e5%91%a8/">算力</a>与国产框架上完成从训练到部署的全链路打通。</p>
<p class="wp-block-paragraph"><img decoding="async" style="max-width:100%;height:auto" src="https://mylogs.cn/wp-content/uploads/2026/09/ithome530_header.webp" alt="中国电信星辰大模型 Xing4.0-29B-A4B 开源" title="图片来源：IT之家" /></p>
<h2 class="wp-block-heading">29B 总参数，每次只激活 4B</h2>
<p class="wp-block-paragraph">Xing4.0-29B-A4B 采用 MoE（混合专家）架构，总参数量为 290 亿，单次推理仅激活 40 亿参数，并采用 mHC、MLA、MTP 组合架构与 64 个路由专家加 1 个共享专家的设计。原生支持 256K 上下文，可扩展至 512K，能够一次性装入长文档、长代码与复杂任务。</p>
<p class="wp-block-paragraph">官方称，该模型是国内首个基于国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型。其训练运行在昇腾 910C 集群之上，配合 MindSpore 与 MindFormers 框架，从训练芯片到推理部署实现全栈国产。据厂商披露，通过细粒度 MoE 通信优化、选择性重计算等协同优化，整体训练吞吐较开箱状态提升约 96%——这一数字为官方口径，尚无第三方复现。</p>
<h2 class="wp-block-heading">智能体能力进入第一梯队</h2>
<p class="wp-block-paragraph">在 SuperCLUE 评测中，Xing4.0-29B-A4B 的智能体能力得分为 93.52，位列第 3 名，与两款头部 Qwen 模型的差距均不足 1 分。模型面向复杂任务理解、任务规划、工具调用与自主执行做了针对性优化，可根据目标自主规划路径、调用工具并完成多步骤任务，应用于代码开发、数据分析、办公自动化与生活服务等场景。</p>
<p class="wp-block-paragraph">轻量化是该模型的核心卖点。通过 4-bit 量化，显存占用降至 15GB，较 FP16 节省约 75%，RTX 3090、RTX 4090 这类 24GB 消费级显卡即可本地运行长上下文任务，降低了开发者在轻量硬件上做 Agent 开发与上手部署的门槛。</p>
<h2 class="wp-block-heading">开源生态全面兼容</h2>
<p class="wp-block-paragraph">Xing4.0-29B-A4B 以 Apache-2.0 许可开源，已上线 HuggingFace、GitHub、魔搭社区、Gitee 与魔乐等平台。在生态适配上，微调侧支持 LLaMA-Factory 与 MindFormers，推理部署侧支持 SGLang、vLLM、KTransformers，并针对 OpenCode、<a href="https://mylogs.cn/claude-opus-5-5-%e7%a0%b4%e6%8a%98%e5%8f%b7%e7%94%a8%e9%87%8f%e9%99%8d-95%ef%bc%8c%e6%96%87%e9%a3%8e%e6%9b%b4%e5%85%8b%e5%88%b6/">Claude</a> Code、OpenClaw、Hermes 等主流智能体框架做了定向适配与格式对齐，开发者无需更换现有工具链即可试用。</p>
<p class="wp-block-paragraph">从产业视角看，这款模型的价值不只在跑分，而在于把&#8221;在国产芯片上把模型训出来&#8221;的工程路径连同工具链一并开放，为信创、政务、金融等对数据不出域与供应链可控有要求的场景，提供了一条可单机私有化部署的基座选项。其定位并非对标千亿级旗舰模型，而是以&#8221;够用、可控、便宜&#8221;切入智能体落地的刚需市场。</p>]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
