<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>墨芯人工智能 &#8211; mylogs.cn</title>
	<atom:link href="https://mylogs.cn/tag/%e5%a2%a8%e8%8a%af%e4%ba%ba%e5%b7%a5%e6%99%ba%e8%83%bd/feed/" rel="self" type="application/rss+xml" />
	<link>https://mylogs.cn</link>
	<description>发现、记录、分享</description>
	<lastBuildDate>Tue, 29 Sep 2026 17:00:11 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	
	<item>
		<title>墨芯稀疏推理芯片亮相外滩大会：不堆卡，砍掉冗余计算</title>
		<link>https://mylogs.cn/%e5%a2%a8%e8%8a%af%e7%a8%80%e7%96%8f%e6%8e%a8%e7%90%86%e8%8a%af%e7%89%87%e4%ba%ae%e7%9b%b8%e5%a4%96%e6%bb%a9%e5%a4%a7%e4%bc%9a%ef%bc%9a%e4%b8%8d%e5%a0%86%e5%8d%a1%ef%bc%8c%e7%a0%8d%e6%8e%89%e5%86%97/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Fri, 11 Sep 2026 21:39:40 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI推理]]></category>
		<category><![CDATA[AI芯片]]></category>
		<category><![CDATA[国产芯片]]></category>
		<category><![CDATA[墨芯人工智能]]></category>
		<category><![CDATA[外滩大会]]></category>
		<category><![CDATA[稀疏计算]]></category>
		<category><![CDATA[算力]]></category>
		<guid isPermaLink="false">https://mylogs.cn/%e5%a2%a8%e8%8a%af%e7%a8%80%e7%96%8f%e6%8e%a8%e7%90%86%e8%8a%af%e7%89%87%e4%ba%ae%e7%9b%b8%e5%a4%96%e6%bb%a9%e5%a4%a7%e4%bc%9a%ef%bc%9a%e4%b8%8d%e5%a0%86%e5%8d%a1%ef%bc%8c%e7%a0%8d%e6%8e%89%e5%86%97/</guid>

					<description><![CDATA[在当前的人工智能产业里，&#8221;算力不够用&#8221;几乎是所有从业者的共同焦虑。扩充算力供给是一条路 [&#8230;]]]></description>
										<content:encoded><![CDATA[<p class="wp-block-paragraph">在当前的<a href="https://mylogs.cn/chatgpt-pro-%e9%87%8d%e5%bc%80-200-%e7%be%8e%e5%85%83%e6%a1%a3%ef%bc%9aapi-%e4%bb%b7%e5%80%bc%e8%bf%91%e7%bf%bb%e5%80%8d/"><a href="https://mylogs.cn/%e8%85%be%e8%ae%af%e5%86%85%e6%b5%8b-ai-%e6%b8%b8%e6%88%8f%e6%90%ad%e5%ad%90%e9%b9%85%e6%ac%a1%e5%85%83%ef%bc%9a%e6%95%b0%e5%ad%97%e4%ba%ba%e9%99%aa%e4%bd%a0%e5%bc%80%e9%bb%91/">人工智能</a></a>产业里，&#8221;算力不够用&#8221;几乎是所有从业者的共同焦虑。扩充算力供给是一条路，但在芯片供给与能耗都存在现实约束的情况下，另一条路正在被更多厂商认真对待：把计算中本来就不必要的部分砍掉，让同样的硬件跑出更多有效运算。</p>
<p class="wp-block-paragraph">9 月 9 日至 12 日，以&#8221;共创AI新经济&#8221;为主题的 2026 Inclusion·外滩大会在上海黄浦世博园举行。作为蚂蚁集团生态合作伙伴，国产 AI 芯片企业墨芯人工智能（MOFFETT AI）在大会上展出了自研 AI 计算卡产品，完整呈现了以专用稀疏推理芯片提升算力效能的技术路径。</p>
<h2 class="wp-block-heading">稀疏化：从底层架构削减冗余计算</h2>
<p class="wp-block-paragraph">墨芯成立于 2018 年，总部位于深圳，在上海、北京和硅谷设有办公室。创始团队包括卡内基梅隆大学的 AI 科学家，以及来自<a href="https://mylogs.cn/%e6%b7%b1%e8%93%9dl06%e8%bf%bd%e9%a3%8e%e7%89%8810%e6%9c%88%e4%b8%8a%e5%b8%82%ef%bc%8c%e9%85%8d%e7%a2%b3%e7%ba%a4%e7%bb%b4%e5%b0%be%e7%bf%bcai%e5%ba%a7%e8%88%b1/">英特尔</a>、高通等<a href="https://mylogs.cn/%e5%8f%b0%e7%a7%af%e7%94%b5-2nm-%e5%b9%b4%e5%ba%95%e6%9c%88%e4%ba%a7%e8%83%bd%e5%86%b2-12-%e4%b8%87%e7%89%87%ef%bc%8c%e6%8f%90%e5%89%8d%e4%b8%a4%e5%b9%b4%e8%be%be%e6%a0%87/">半导体</a>公司的芯片研发核心成员，累计拥有数十款产品、超过 50 亿颗主流芯片的量产经验。</p>
<p class="wp-block-paragraph">这家公司自称是&#8221;双稀疏算法&#8221;的发明者，在全球持有百余项专利，其技术路线是从算法和软件出发反向定义硬件，针对稀疏化做专门的架构设计。首款芯片 Antoum 支持 32 倍稀疏率，主要面向云端人工智能推理场景，可编程支持 CNN、RNN、LSTM、Transformer、BERT 等网络模型，并兼容浮点与定点数据类型。基于这颗芯片，墨芯陆续推出了 S4、S10、S30、S40 等系列 AI 计算卡。</p>
<p class="wp-block-paragraph">在公开基准测试中，这套方案有过可查的成绩：MLPerf Inference v3.0 中，S40 计算卡在 ResNet-50 模型上单卡算力达到 127375 FPS。公司方面称其计算卡在视觉、自然语言处理、大模型等主流任务上具备领先能效比与单位算力推理吞吐量，并连续三届在 MLPerf 推理测试中夺冠。</p>
<h2 class="wp-block-heading">落地四大片区，新一代 SparsePrime 年内推出</h2>
<p class="wp-block-paragraph">算力的价值最终要落到场景里。据介绍，基于自研芯片构建的推理集群，墨芯已经在西北、西南、华东、华北四大片区的<a href="https://mylogs.cn/ai-%e6%99%ba%e8%83%bd%e4%bd%93%e5%bc%95%e7%88%86%e9%9c%80%e6%b1%82%ef%bc%9a%e6%9c%8d%e5%8a%a1%e5%99%a8-cpu-%e4%ba%a4%e4%bb%98%e8%a6%81%e7%ad%89-30-%e5%91%a8/">数据中心</a>实现部署，结合各地产业与资源特点，为智能制造、生命科学、城市治理等不同场景提供推理支撑。</p>
<p class="wp-block-paragraph">面向不断演进的推理负载，墨芯即将推出新一代 SparsePrime 计算卡。该产品基于自研 Antoum 2.0 架构，专为大模型与复杂推理场景优化设计，广泛适配主流 Transformer 模型。在软件兼容层面，现有的 PyTorch、TensorRT、vLLM 等推理框架可近乎零代码修改迁移，同时支持 Triton 自定义算子开发。官方表述是&#8221;初步实现精度无损、算力翻倍的技术路径可能&#8221;——注意这是一个技术路径上的阶段性结论，而非已量产的确定指标。</p>
<p class="wp-block-paragraph">此前在 ICDIA 2026 上，墨芯的 S40AC 计算卡入选&#8221;2026 强芯 TOP100&#8243;。S40AC 采用主动涡轮散热设计，主打满负荷运行下的低温稳定，配合工业级强化设计支撑长时间运行。</p>
<h2 class="wp-block-heading">标准与联盟：降低产业链适配成本</h2>
<p class="wp-block-paragraph">要让更高效的计算方式真正服务于产业，还需要降低技术适配与协同的门槛。今年 7 月，墨芯成为工业和信息化部人工智能标准化技术委员会成员单位，依托稀疏计算领域的技术积累，参与 AI 基础硬件、软件平台及大模型等方向的标准研制。8 月，墨芯又发起成立稀疏计算产学研联盟，围绕前沿研究、关键技术攻关和成果转化开展协同创新。</p>
<p class="wp-block-paragraph">2025 年，墨芯入选国家发改委《中国战略性新兴产业典型案例》。从芯片架构创新，到标准共建与联盟协同，这家公司试图说明的是：在推理需求持续攀升的阶段，提升算力效能与扩充算力供给同样重要。</p>
<figure data-wp-context="{&quot;imageId&quot;:&quot;6abc48a4bd326&quot;}" data-wp-interactive="core/image" data-wp-key="6abc48a4bd326" class="wp-block-image size-large wp-lightbox-container"><img decoding="async" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://www.qbitai.com/wp-content/uploads/2026/09/7913a88bdad4b2d4643a9e7b708cc7be.jpeg" alt="墨芯人工智能在外滩大会展示 AI 计算卡产品" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：量子位</figcaption></figure>]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
