<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>中电信人工智能 &#8211; mylogs.cn</title>
	<atom:link href="https://mylogs.cn/tag/%e4%b8%ad%e7%94%b5%e4%bf%a1%e4%ba%ba%e5%b7%a5%e6%99%ba%e8%83%bd/feed/" rel="self" type="application/rss+xml" />
	<link>https://mylogs.cn</link>
	<description>发现、记录、分享</description>
	<lastBuildDate>Tue, 29 Sep 2026 16:55:30 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	
	<item>
		<title>星辰 Xing4.0-29B 开源：29B 大模型激活仅 4B</title>
		<link>https://mylogs.cn/%e6%98%9f%e8%be%b0-xing4-0-29b-%e5%bc%80%e6%ba%90%ef%bc%9a29b-%e5%a4%a7%e6%a8%a1%e5%9e%8b%e6%bf%80%e6%b4%bb%e4%bb%85-4b/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Sun, 20 Sep 2026 05:13:15 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[MoE 大模型]]></category>
		<category><![CDATA[中电信人工智能]]></category>
		<category><![CDATA[代码智能体大模型]]></category>
		<category><![CDATA[华为昇腾]]></category>
		<category><![CDATA[开源大模型]]></category>
		<category><![CDATA[昇思 MindSpore]]></category>
		<category><![CDATA[星辰 Xing4.0-29B]]></category>
		<guid isPermaLink="false">https://mylogs.cn/%e6%98%9f%e8%be%b0-xing4-0-29b-%e5%bc%80%e6%ba%90%ef%bc%9a29b-%e5%a4%a7%e6%a8%a1%e5%9e%8b%e6%bf%80%e6%b4%bb%e4%bb%85-4b/</guid>

					<description><![CDATA[中国电信人工智能科技有限公司于 9 月 17 日正式发布新一代星辰大模型 Xing4.0-29B-A4B。该模 [&#8230;]]]></description>
										<content:encoded><![CDATA[<p class="wp-block-paragraph">中国电信<a href="https://mylogs.cn/chatgpt-pro-%e9%87%8d%e5%bc%80-200-%e7%be%8e%e5%85%83%e6%a1%a3%ef%bc%9aapi-%e4%bb%b7%e5%80%bc%e8%bf%91%e7%bf%bb%e5%80%8d/"><a href="https://mylogs.cn/%e8%85%be%e8%ae%af%e5%86%85%e6%b5%8b-ai-%e6%b8%b8%e6%88%8f%e6%90%ad%e5%ad%90%e9%b9%85%e6%ac%a1%e5%85%83%ef%bc%9a%e6%95%b0%e5%ad%97%e4%ba%ba%e9%99%aa%e4%bd%a0%e5%bc%80%e9%bb%91/">人工智能</a></a>科技有限公司于 9 月 17 日正式发布新一代星辰大模型 Xing4.0-29B-A4B。该模型聚焦复杂任务理解、任务规划、工具调用与自主执行等能力，支持长上下文处理，可应用于代码开发、数据分析、办公自动化及生活服务等场景，定位为面向智能体时代的轻量级代码智能体大模型。</p>
<figure data-wp-context="{&quot;imageId&quot;:&quot;6abfb2f10ac42&quot;}" data-wp-interactive="core/image" data-wp-key="6abfb2f10ac42" class="wp-block-image wp-lightbox-container"><img decoding="async" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/09/ithome_xing429b_a4b_header.webp" alt="星辰 Xing4.0-29B 模型概念图" style="max-width:100%;height:auto" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption>图片来源：IT之家</figcaption></figure>
<h2 class="wp-block-heading">架构：29B 总参数，仅激活 4B</h2>
<p class="wp-block-paragraph">Xing4.0-29B-A4B 采用混合专家（MoE）架构，总参数 29B，每令牌仅激活约 4B 参数，由 64 个路由专家加 1 个共享专家组成，每令牌选择 4 个路由专家参与计算。模型原生支持 256K 上下文，并可扩展至 512K。在评测表现上，其在 SWE-bench Verified 上取得 75.0 分，接近 Qwen3.6-35B-A3B 的 76.0 分，并超过 Gemma4-26B-A4B 的 53.0 分；在 Terminal-Bench 2.1 上取得 57.5 分，同样高于 Qwen3.6-35B-A3B 的 51.5 分；在 SuperCLUE 智能体能力评测中以 93.52 分位列第三。</p>
<h2 class="wp-block-heading">全栈国产训练链路</h2>
<p class="wp-block-paragraph">据介绍，该模型是国内首个基于昇腾 Atlas 900 A3 SuperPoD 液冷超节点与昇思 MindSpore 框架完成训练的百亿参数大模型。在昇腾超节点集群上，通过多层次软硬件协同优化，训练吞吐较开箱性能提升约 96%。经过 4 比特量化后，模型显存占用可降至 15GB，使用 RTX 3090、RTX 4090 等 24GB 显存的消费级显卡即可本地运行长上下文任务。</p>
<h2 class="wp-block-heading">开源与生态适配</h2>
<p class="wp-block-paragraph">Xing4.0-29B-A4B 以 Apache 2.0 协议开源，权重已上线 GitHub、HuggingFace、Gitee、魔搭与魔乐五个开源社区。在工具链方面，模型兼容 SGLang、vLLM、KTransformers 等推理框架，并支持 LLaMA-Factory 与 MindFormers 微调；同时针对 OpenCode、<a href="https://mylogs.cn/claude-opus-5-5-%e7%a0%b4%e6%8a%98%e5%8f%b7%e7%94%a8%e9%87%8f%e9%99%8d-95%ef%bc%8c%e6%96%87%e9%a3%8e%e6%9b%b4%e5%85%8b%e5%88%b6/">Claude</a> Code、OpenClaw、Hermes 等开发工具做了定向适配，开发者可将其无缝接入现有工作流。<a href="https://mylogs.cn/%e9%b8%bf%e8%92%99-7-%e8%b6%85%e7%a9%ba%e9%97%b4%e5%ad%98%e5%82%a8%e6%89%a9%e5%ae%b9%ef%bc%9a1tb-%e6%9c%ba%e5%9e%8b%e6%9c%80%e5%a4%9a%e8%85%be-109gb/"><a href="https://mylogs.cn/%e5%be%ae%e4%bf%a1%e9%b8%bf%e8%92%99%e7%89%88-8-0-22-34-%e5%b0%9d%e9%b2%9c%ef%bc%9a%e8%bf%99%e4%ba%9b%e6%96%b0%e5%8a%9f%e8%83%bd%e5%80%bc%e5%be%97%e5%85%b3%e6%b3%a8/"><a href="https://mylogs.cn/%e5%8d%8e%e4%b8%ba-watch-gt-6-%e6%8e%a8%e9%b8%bf%e8%92%99-7-%e5%85%ac%e6%b5%8b%ef%bc%9a%e5%85%89%e7%a9%b9%e8%a1%a8%e7%9b%98%e9%a2%86%e8%a1%94-12-%e9%a1%b9%e6%96%b0%e7%89%b9%e6%80%a7/"><a href="https://mylogs.cn/harmonyos-7%e6%ad%a3%e5%bc%8f%e7%89%88%e6%8e%a8%e9%80%81%ef%bc%9amate-80%e7%ad%89%e9%a6%96%e6%89%b9%e6%9c%ba%e5%9e%8b%e5%8f%af%e5%8d%87/">华为</a></a></a></a>方面表示，昇腾目前已支持 40 余个业界头部模型完成原生训练。</p>]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>星辰 Xing4.0-29B 发布：全栈国产代码智能体大模型</title>
		<link>https://mylogs.cn/%e6%98%9f%e8%be%b0-xing4-0-29b-%e5%8f%91%e5%b8%83%ef%bc%9a%e5%85%a8%e6%a0%88%e5%9b%bd%e4%ba%a7%e4%bb%a3%e7%a0%81%e6%99%ba%e8%83%bd%e4%bd%93%e5%a4%a7%e6%a8%a1%e5%9e%8b/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Sun, 20 Sep 2026 03:02:19 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[MoE 大模型]]></category>
		<category><![CDATA[中电信人工智能]]></category>
		<category><![CDATA[代码智能体大模型]]></category>
		<category><![CDATA[华为昇腾]]></category>
		<category><![CDATA[开源大模型]]></category>
		<category><![CDATA[昇思 MindSpore]]></category>
		<category><![CDATA[星辰 Xing4.0-29B]]></category>
		<guid isPermaLink="false">https://mylogs.cn/%e6%98%9f%e8%be%b0-xing4-0-29b-%e5%8f%91%e5%b8%83%ef%bc%9a%e5%85%a8%e6%a0%88%e5%9b%bd%e4%ba%a7%e4%bb%a3%e7%a0%81%e6%99%ba%e8%83%bd%e4%bd%93%e5%a4%a7%e6%a8%a1%e5%9e%8b/</guid>

					<description><![CDATA[中电信人工智能科技有限公司于 9 月 17 日正式发布新一代星辰大模型 Xing4.0-29B-A4B。据 I [&#8230;]]]></description>
										<content:encoded><![CDATA[<p class="wp-block-paragraph"><img decoding="async" style="max-width:100%;height:auto" src="https://mylogs.cn/wp-content/uploads/2026/09/ithome_xing4_29b_header.webp" alt="星辰 Xing4.0-29B 发布" title="图片来源：IT之家" /></p>
<p class="wp-block-paragraph">中电信<a href="https://mylogs.cn/chatgpt-pro-%e9%87%8d%e5%bc%80-200-%e7%be%8e%e5%85%83%e6%a1%a3%ef%bc%9aapi-%e4%bb%b7%e5%80%bc%e8%bf%91%e7%bf%bb%e5%80%8d/"><a href="https://mylogs.cn/%e8%85%be%e8%ae%af%e5%86%85%e6%b5%8b-ai-%e6%b8%b8%e6%88%8f%e6%90%ad%e5%ad%90%e9%b9%85%e6%ac%a1%e5%85%83%ef%bc%9a%e6%95%b0%e5%ad%97%e4%ba%ba%e9%99%aa%e4%bd%a0%e5%bc%80%e9%bb%91/">人工智能</a></a>科技有限公司于 9 月 17 日正式发布新一代星辰大模型 Xing4.0-29B-A4B。据 IT之家报道，该模型聚焦复杂任务理解、任务规划、工具调用与自主执行等能力，支持长上下文处理，可应用于代码开发、数据分析、办公自动化及生活服务等场景，是面向智能体（Agent）时代的轻量级代码智能体大模型。</p>
<h2 class="wp-block-heading">全栈国产训练链路</h2>
<p class="wp-block-paragraph"><a href="https://mylogs.cn/%e9%b8%bf%e8%92%99-7-%e8%b6%85%e7%a9%ba%e9%97%b4%e5%ad%98%e5%82%a8%e6%89%a9%e5%ae%b9%ef%bc%9a1tb-%e6%9c%ba%e5%9e%8b%e6%9c%80%e5%a4%9a%e8%85%be-109gb/"><a href="https://mylogs.cn/%e5%be%ae%e4%bf%a1%e9%b8%bf%e8%92%99%e7%89%88-8-0-22-34-%e5%b0%9d%e9%b2%9c%ef%bc%9a%e8%bf%99%e4%ba%9b%e6%96%b0%e5%8a%9f%e8%83%bd%e5%80%bc%e5%be%97%e5%85%b3%e6%b3%a8/"><a href="https://mylogs.cn/%e5%8d%8e%e4%b8%ba-watch-gt-6-%e6%8e%a8%e9%b8%bf%e8%92%99-7-%e5%85%ac%e6%b5%8b%ef%bc%9a%e5%85%89%e7%a9%b9%e8%a1%a8%e7%9b%98%e9%a2%86%e8%a1%94-12-%e9%a1%b9%e6%96%b0%e7%89%b9%e6%80%a7/"><a href="https://mylogs.cn/harmonyos-7%e6%ad%a3%e5%bc%8f%e7%89%88%e6%8e%a8%e9%80%81%ef%bc%9amate-80%e7%ad%89%e9%a6%96%e6%89%b9%e6%9c%ba%e5%9e%8b%e5%8f%af%e5%8d%87/">华为</a></a></a></a>官方介绍，Xing4.0-29B-A4B 总参数量 29B，激活参数仅 4B，是国内首个基于昇腾 Atlas 900 A3 SuperPoD 液冷超节点与昇思 MindSpore 框架完成训练的百亿参数级大模型，并面向复杂工程任务做了深度优化。<br>模型采用新一代架构设计，进一步提升长程任务处理与多步骤执行能力，能够根据用户给出的目标自主规划任务路径、调用工具并完成复杂任务。</p>
<h2 class="wp-block-heading">架构与训练细节</h2>
<p class="wp-block-paragraph">在架构层面，模型专为长程 Agent 任务设计：MLA 多头潜变量注意力用于压缩 KV 缓存；MTP 多 Token 预测增强生成连贯性；mHC 流形约束超连接用于解决训练数值不稳定的问题；Muon 与 QK-Clip 优化器保障训练稳定。<br>训练采用分阶段递进策略，序列长度从 4K 逐步扩展至 32K、128K、256K，系统性构建长程能力。</p>
<p class="wp-block-paragraph">工程优化方面，Xing4.0-29B-A4B 在昇腾超节点集群上通过多层次软硬件协同优化实现训练性能提升约 96%，接近翻倍：基于 MindSpore 全栈适配 mHC 多残差连接与 DSA 长序列机制，针对细粒度 MoE（64 路由专家、Top4 激活），通过专家负载均衡、Grouped GEMM、通信计算重叠及 DVM 图算融合，吞吐提升 32%；层级与算子级选择性重计算再提升 19%；自研 Ascend C mHC 融合算子解决 Sinkhorn 碎片化，计算效率提升 30%，整网吞吐再提升 25%。<br>此外，模型基于昇腾生态完成了 Slime 强化学习框架适配，面向 Agent、Coding、Reasoning 开展多专家强化学习训练，并通过 MOPD 技术实现多专家能力的高效融合。</p>
<h2 class="wp-block-heading">评测表现与落地门槛</h2>
<p class="wp-block-paragraph">在落地门槛上，模型原生支持 256K 上下文，可扩展至 512K；4-bit 量化后显存占用降至 15GB（较 FP16 节省约 75%），意味着 RTX 3090、RTX 4090 等 24GB 显存的消费级显卡即可本地运行长上下文任务。</p>
<p class="wp-block-paragraph">评测成绩单显示：SWE-bench Verified 达到 75.0，接近 Qwen3.6-35B-A3B 的 76.0，超过 Gemma4-26B-A4B 的 53.0；Terminal-Bench 2.1 为 57.5，超过 Qwen3.6-35B-A3B 的 51.5；SuperCLUE 智能体能力 93.52，位列第 3，与两款头部 Qwen 模型差距不足 1 分。</p>
<h2 class="wp-block-heading">全面开源</h2>
<p class="wp-block-paragraph">目前模型权重已上线 GitHub、HuggingFace、魔搭（ModelScope）、Gitee、魔乐（Modelers）五个开源社区，采用 Apache 2.0 许可。模型兼容 SGLang、vLLM、KTransformers 推理框架，以及 LLaMA-Factory、MindFormers 微调工具，并对 OpenCode、<a href="https://mylogs.cn/claude-opus-5-5-%e7%a0%b4%e6%8a%98%e5%8f%b7%e7%94%a8%e9%87%8f%e9%99%8d-95%ef%bc%8c%e6%96%87%e9%a3%8e%e6%9b%b4%e5%85%8b%e5%88%b6/">Claude</a> Code、OpenClaw、Hermes 等智能体框架做了定向适配。</p>
<p class="wp-block-paragraph">据华为方面披露，昇腾已支持 40 多个业界头部模型完成原生训练，也是国内唯一支持商用大规模预训练并训练落地 SOTA 大模型的厂商。Xing4.0-29B-A4B 以「总参 29B、激活仅 4B」的轻量化设计，把大模型私有化部署的门槛从「先买一台服务器」降到了「用你手边的显卡」，为开发者、政企与中小企业提供了一条自主可控的代码智能体落地路径。</p>]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
