<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>阿里 &#8211; mylogs.cn</title>
	<atom:link href="https://mylogs.cn/tag/%e9%98%bf%e9%87%8c/feed/" rel="self" type="application/rss+xml" />
	<link>https://mylogs.cn</link>
	<description>发现、记录、分享</description>
	<lastBuildDate>Sun, 16 Aug 2026 08:31:17 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	
	<item>
		<title>阿里通义千问下载破 30 亿，成全球最火开源 AI 模型</title>
		<link>https://mylogs.cn/alibaba-qwen-3-billion-downloads/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Sun, 16 Aug 2026 08:31:03 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[Hugging Face]]></category>
		<category><![CDATA[中国AI]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[开源大模型]]></category>
		<category><![CDATA[开源生态]]></category>
		<category><![CDATA[通义千问]]></category>
		<category><![CDATA[阿里]]></category>
		<guid isPermaLink="false">https://mylogs.cn/alibaba-qwen-3-billion-downloads/</guid>

					<description><![CDATA[30 亿次下载意味着什么 开源大模型领域出现了一个标志性数字：阿里巴巴的通义千问（Qwen）家族累计全球下载量 [&#8230;]]]></description>
										<content:encoded><![CDATA[
<h2 class="wp-block-heading">30 亿次下载意味着什么</h2>



<p class="wp-block-paragraph">开源大模型领域出现了一个标志性数字：阿里巴巴的通义千问（Qwen）家族累计全球下载量突破 30 亿次，超越谷歌、Meta 等对手，成为全球下载量最高的开源 AI 模型家族。这一数据来自 Hugging Face 于 2026 年 8 月 14 日发布的一份「开源模型现状」报告，以及阿里巴巴同月 15 日的官方披露。</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6a8bb17a60b9f&quot;}" data-wp-interactive="core/image" data-wp-key="6a8bb17a60b9f" class="wp-block-image size-large aligncenter wp-lightbox-container"><img fetchpriority="high" decoding="async" width="1078" height="718" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/08/qwen_header.webp" alt="阿里通义千问下载破 30 亿，成全球最火开源 AI 模型" class="wp-image-5072" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/08/qwen_header.webp 1078w, https://mylogs.cn/wp-content/uploads/2026/08/qwen_header-300x200.webp 300w, https://mylogs.cn/wp-content/uploads/2026/08/qwen_header-1024x682.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/08/qwen_header-768x512.webp 768w" sizes="(max-width: 1078px) 100vw, 1078px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：China Daily</figcaption></figure>





<p class="wp-block-paragraph">在 Hugging Face 平台内部，2026 年 Qwen 的下载量约为 20.45 亿次，而谷歌约为 4.18 亿次、Meta 约为 2.27 亿次——这一统计只覆盖 Hugging Face Hub，还不含中国的 ModelScope 等平台，因此低于 Qwen 跨平台累计的 30 亿次。</p>



<h2 class="wp-block-heading">生态比单点性能更关键</h2>



<p class="wp-block-paragraph">截至披露时，阿里巴巴已开源超过 460 个 Qwen 模型，衍生出 30 万余个下游模型。仅在 Hugging Face 上，开发者就基于 Qwen 创建了 151,448 个衍生模型，是 Meta 衍生数的 2.6 倍、Llama 家族相关仓库数的 4.7 倍；同期的谷歌模型衍生数为 82,506 个。</p>



<p class="wp-block-paragraph">开源权重模型可以被下载、微调并用作新 AI 产品的积木，因此下载量与衍生模型数，成为衡量开发者「用脚投票」的指标，也折射出中美开源 AI 竞赛的此消彼长。报告还指出，2026 年中国头部实验室发布的最大开源模型，参数规模普遍高于美国同行：中方月度上限在 7540 亿到 2.78 万亿之间，而美方大多数月份的最大开源模型低于 1300 亿参数。同时，中国开发者普遍采用宽松许可证——在报告追踪的 178 个参数量超 200 亿的中国模型中，59% 使用 Apache 2.0、22% 使用 MIT，没有任何一个限制仅限非商业使用。</p>



<h2 class="wp-block-heading">为什么它能走出去</h2>



<p class="wp-block-paragraph">Qwen 的崛起并非只靠性能与低价。阿里通过云业务，把 Qwen 分发到东南亚、非洲等市场的企业客户，触达许多对手没有的渠道。报告称，Qwen 已成为开发者决定微调与部署模型时「默认工作流」的一部分。面对这一态势，Meta、英伟达等美国公司近几周也相继发布新的开源模型，争夺开发者。</p>



<p class="wp-block-paragraph">对中文世界而言，一个由中国公司主导、又能被全球开发者广泛采用的开源模型家族，意味着本地应用与二次开发有了更稳固的底座。</p>



<p class="has-small-font-size wp-block-paragraph">来源：China Daily / 彭博社（据 Hugging Face 2026 年 8 月开源模型报告）</p>

]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>苹果 Mac 国行版接入阿里千问，Apple 智能落地中国大陆</title>
		<link>https://mylogs.cn/apple-mac-qwen-china-mainland/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Sun, 09 Aug 2026 02:49:41 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[Apple 智能]]></category>
		<category><![CDATA[macOS]]></category>
		<category><![CDATA[Siri]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[千问]]></category>
		<category><![CDATA[苹果]]></category>
		<category><![CDATA[阿里]]></category>
		<guid isPermaLink="false">https://mylogs.cn/apple-mac-qwen-china-mainland/</guid>

					<description><![CDATA[苹果在中国大陆的“Apple 智能”终于从传说走向可操作。8 月 8 日前后，苹果在其 Mac 简体中文使用手 [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">苹果在中国大陆的“Apple 智能”终于从传说走向可操作。8 月 8 日前后，苹果在其 Mac 简体中文使用手册中新增了“在 Mac 上配合 Apple 智能使用千问”一章，首次以官方文档形式确认：国行 Mac 上的 Apple 智能可以调用阿里巴巴的千问大模型。</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6a8bb17a61807&quot;}" data-wp-interactive="core/image" data-wp-key="6a8bb17a61807" class="wp-block-image size-large aligncenter wp-lightbox-container"><img decoding="async" width="600" height="400" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/08/770d86e7310fe7feee0019e7f58c686f_header.webp" alt="苹果 Mac 国行版接入阿里千问，Apple 智能落地中国大陆" class="wp-image-4145" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/08/770d86e7310fe7feee0019e7f58c686f_header.webp 600w, https://mylogs.cn/wp-content/uploads/2026/08/770d86e7310fe7feee0019e7f58c686f_header-300x200.webp 300w" sizes="(max-width: 600px) 100vw, 600px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：36氪</figcaption></figure>





<p class="wp-block-paragraph">这项能力并非默认开启，而是作为 Apple 智能的“扩展”出现，覆盖两个入口：其一是写作工具，在备忘录、邮件等系统应用里直接生成或润色文本；其二是 Siri，当用户提出复杂问题时，Siri 会先判断是否适合交给千问，并在获得确认后才调用，涉及照片或文件时还需用户单独授权。</p>



<p class="wp-block-paragraph">要使用它，设备需升级到 macOS 26.6 或更高版本，且满足地域与账户条件：身处中国大陆且 Apple 账户地区设为大陆，或身处大陆但未登录账户，或使用国行 Mac。若用户身处海外、账户无中国账单地址，或设备购于境外，Siri 仍会连接 ChatGPT。苹果在手册中单列“千问与隐私”一节，用户可随时关闭该扩展。</p>



<p class="wp-block-paragraph">这次官宣早有铺垫。今年 7 月，“Apple 智能”作为端侧生成式人工智能服务出现在国家网信办的备案名单中，备案主体为苹果技术开发（上海）有限公司；苹果首席执行官库克也在财报电话会上确认，已获准在中国推出首批 Apple 智能功能。除阿里外，苹果还在推进与百度的合作，由后者承担中文搜索相关能力。对长期苦于国行设备 AI 短板的用户来说，这意味着 Siri 与系统级写作工具终于接上了成熟的中文大模型。</p>



<p class="has-small-font-size wp-block-paragraph">来源：China Daily、36氪</p>

]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>智能体榜首易主：Qwen3.8 以 55.4 分掀翻 Claude</title>
		<link>https://mylogs.cn/qwen38-max-agentic-index-first-place-artificial-analysis/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Thu, 06 Aug 2026 20:46:32 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI评测]]></category>
		<category><![CDATA[Claude]]></category>
		<category><![CDATA[Qwen]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[智能体]]></category>
		<category><![CDATA[通义千问]]></category>
		<category><![CDATA[阿里]]></category>
		<guid isPermaLink="false">https://mylogs.cn/qwen38-max-agentic-index-first-place-artificial-analysis/</guid>

					<description><![CDATA[你还在以为 AI 智能体的天下只有 Claude 和 GPT 吗？8 月 6 日，独立评测机构 Artific [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">你还在以为 AI 智能体的天下只有 Claude 和 GPT 吗？8 月 6 日，独立评测机构 Artificial Analysis 公布了新一期 Agentic Index（智能体能力指数）榜单，阿里通义千问 Qwen3.8-Max 以 55.4 分拿下全球第一，超过 Claude Opus 5 和 GPT-5.6。这是该指数发布以来，首次由中国模型登顶。</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6a8bb17a622bb&quot;}" data-wp-interactive="core/image" data-wp-key="6a8bb17a622bb" class="wp-block-image size-large aligncenter wp-lightbox-container"><img decoding="async" width="1200" height="821" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/08/dce7ba63_header.webp" alt="智能体榜首易主：Qwen3.8 以 55.4 分掀翻 Claude" class="wp-image-3873" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/08/dce7ba63_header.webp 1200w, https://mylogs.cn/wp-content/uploads/2026/08/dce7ba63_header-300x205.webp 300w, https://mylogs.cn/wp-content/uploads/2026/08/dce7ba63_header-1024x701.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/08/dce7ba63_header-768x525.webp 768w" sizes="(max-width: 1200px) 100vw, 1200px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">AI生成配图</figcaption></figure>





<p class="wp-block-paragraph">Agentic Index 衡量的是 AI 调用工具、规划多步任务、在真实工作场景中交付结果的能力——简单说就是&#8221;能不能当助手干活&#8221;。它由两项核心测试等权平均组成：GDPval-AA v2（模拟 44 种职业的知识工作完成度）和 τ³-Banking（金融客服多轮对话与知识检索）。两项都是实打实的工具调用测试，不是做选择题。</p>



<p class="wp-block-paragraph">说白了，这个榜单一向被美国闭源模型垄断。此前中国模型最好的成绩是 Kimi K3 的 50.1 分，而这次 Qwen3.8-Max 直接把纪录拉高了 5 分以上。这意味着在&#8221;让 AI 真正动手做事&#8221;这条赛道上，中美差距正在快速收窄。</p>



<p class="wp-block-paragraph">从模型规格看，Qwen3.8-Max 总参数量达 2.4 万亿（采用稀疏 MoE 架构），激活参数约 950 亿，上下文窗口支持 100 万 Token。它在多项子测试中表现突出：PaperBench（论文复现）93.0 分、OSWorld-Verified（电脑操作）86.1 分、Terminal-Bench 2.1（终端命令行操作）86.6 分——后两项均超过了 Claude Fable 5 和 GPT-5.6 Sol。</p>



<p class="wp-block-paragraph">价格方面也有明显优势。Qwen3.8-Max 的 API 定价约为 Claude Opus 5 输入价格的 40%、输出价格的 24%。阿里还宣布将于下周开源 Qwen3.8-Max 权重，如果兑现承诺，这将是迄今公开的最大规模模型之一。</p>



<p class="wp-block-paragraph">对开发者来说，这个排名传递了一个信号：选模型不必只盯美国闭源方案。如果你的应用涉及多模态操作、长程任务调度或成本敏感部署，Qwen3.8-Max 值得放进对比清单。</p>



<p class="has-small-font-size wp-block-paragraph">来源：Artificial Analysis / MarkTechPost / 量子位 / 上海证券报</p>

]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>千问 3.8-Max 首发：2.4 万亿参数拐点在哪</title>
		<link>https://mylogs.cn/%e5%8d%83%e9%97%ae-3-8-max-%e9%a6%96%e5%8f%91%ef%bc%9a2-4-%e4%b8%87%e4%ba%bf%e5%8f%82%e6%95%b0%e6%8b%90%e7%82%b9%e5%9c%a8%e5%93%aa/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Mon, 03 Aug 2026 04:54:40 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI开源]]></category>
		<category><![CDATA[MoE]]></category>
		<category><![CDATA[Qwen]]></category>
		<category><![CDATA[千问]]></category>
		<category><![CDATA[多模态]]></category>
		<category><![CDATA[大模型]]></category>
		<category><![CDATA[阿里]]></category>
		<guid isPermaLink="false">https://mylogs.cn/%e5%8d%83%e9%97%ae-3-8-max-%e9%a6%96%e5%8f%91%ef%bc%9a2-4-%e4%b8%87%e4%ba%bf%e5%8f%82%e6%95%b0%e6%8b%90%e7%82%b9%e5%9c%a8%e5%93%aa/</guid>

					<description><![CDATA[千问 3.8-Max 首发：2.4 万亿参数拐点在哪]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">你刷到一个数字，先别急着激动——2.4万亿参数、激活95B、千问史上首个开放权重的Max级模型，阿里2026年8月3日把Qwen3.8-Max端了出来。</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6a8bb17a62b3d&quot;}" data-wp-interactive="core/image" data-wp-key="6a8bb17a62b3d" class="wp-block-image size-large aligncenter wp-lightbox-container"><img loading="lazy" decoding="async" width="1200" height="674" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/08/e22f62889d07d84a84dffc5e953022d1_header.webp" alt="千问 3.8-Max 首发：2.4 万亿参数拐点在哪" class="wp-image-3398" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/08/e22f62889d07d84a84dffc5e953022d1_header.webp 1200w, https://mylogs.cn/wp-content/uploads/2026/08/e22f62889d07d84a84dffc5e953022d1_header-300x169.webp 300w, https://mylogs.cn/wp-content/uploads/2026/08/e22f62889d07d84a84dffc5e953022d1_header-1024x575.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/08/e22f62889d07d84a84dffc5e953022d1_header-768x431.webp 768w" sizes="auto, (max-width: 1200px) 100vw, 1200px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：腾讯网/IT之家</figcaption></figure>





<p class="wp-block-paragraph">它走的是稀疏MoE（混合专家）架构，总参数2.4万亿，每次推理只激活约950亿。上下文长度顶到1M tokens，硬件、显存、推理延迟这些事留给模型自己。定价是国际版每百万token输入2美元、输出6美元，对标Claude Opus 5只到对手的40%和24%。国内千问AI平台价格为每百万token输入12元、输出36元。</p>



<p class="wp-block-paragraph">动手能力方面，官方甩出三个真实案例：模型从零搭建oh-my-cli项目，无人工介入跑16天，265次提交、127个PR、151个issue；复现一篇推理论文并自我迭代，连续工作125小时、7600行代码、33轮GPU训练，AIME24比原方法再涨2.7分；参加WWW2025多模态对话挑战赛，24小时内击败458支人类队伍。芯片设计任务里，500轮交互把硬件门数从8298压到678，物理面积从106×106微米缩到46×46微米，整体缩小81%。</p>



<p class="wp-block-paragraph">基准上，PaperBench 93.0、IFBench 82.8、HealthBench 60.2、CoWorkBench 74.8、JobBench 53.4，多项超过Anthropic Fable 5和GPT-5.6 Sol；OSWorld-Verified 86.1、MLVU 90.8，多模态也不落下风。</p>



<p class="wp-block-paragraph">说白了，这版千问终于把&#8221;长程自主&#8221;摆到台面上了，标杆不再是单点刷分，而是能不能从一个空文件夹干完一个真实项目。权重下周登陆Hugging Face和ModelScope，Qwen3.8-27B同步开源。能调用Codex、Claude Code、Qoder这些主流框架，国内直接上qianwenai.com。</p>



<p class="wp-block-paragraph">我的判断是，国产大模型真正可用的临界点，不是榜单分数，而是这种&#8221;扔进去一个目标，干完十几个工作日&#8221;的工程闭环。等开源权重放出来，你会拿它跑什么？先想好怎么用。</p>



<p class="wp-block-paragraph">来源：千问官方博客、凤凰网科技、IT之家</p>

]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
