<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>百万上下文 &#8211; mylogs.cn</title>
	<atom:link href="https://mylogs.cn/tag/%e7%99%be%e4%b8%87%e4%b8%8a%e4%b8%8b%e6%96%87/feed/" rel="self" type="application/rss+xml" />
	<link>https://mylogs.cn</link>
	<description>发现、记录、分享</description>
	<lastBuildDate>Thu, 27 Aug 2026 03:10:36 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	
	<item>
		<title>GLM-5.3-Flash 上线 LM Studio：百万上下文，成本降九成</title>
		<link>https://mylogs.cn/glm-5-3-flash-%e4%b8%8a%e7%ba%bf-lm-studio%ef%bc%9a%e7%99%be%e4%b8%87%e4%b8%8a%e4%b8%8b%e6%96%87%ef%bc%8c%e6%88%90%e6%9c%ac%e9%99%8d%e4%b9%9d%e6%88%90/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Thu, 27 Aug 2026 03:10:36 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI 工具]]></category>
		<category><![CDATA[Bionic 智能体]]></category>
		<category><![CDATA[GLM-5.3-Flash]]></category>
		<category><![CDATA[LM Studio]]></category>
		<category><![CDATA[MoE 模型]]></category>
		<category><![CDATA[智谱 AI]]></category>
		<category><![CDATA[百万上下文]]></category>
		<guid isPermaLink="false">https://mylogs.cn/glm-5-3-flash-%e4%b8%8a%e7%ba%bf-lm-studio%ef%bc%9a%e7%99%be%e4%b8%87%e4%b8%8a%e4%b8%8b%e6%96%87%ef%bc%8c%e6%88%90%e6%9c%ac%e9%99%8d%e4%b9%9d%e6%88%90/</guid>

					<description><![CDATA[智谱（Z.ai）刚把 GLM-5.3-Flash 正式发布出来，几小时后，桌面端大模型工具 LM Studio [&#8230;]]]></description>
										<content:encoded><![CDATA[<p class="wp-block-paragraph">智谱（Z.ai）刚把 GLM-5.3-Flash 正式发布出来，几小时后，桌面端大模型工具 LM Studio 就把这个模型接进了自家的智能体平台 Bionic。据 9to5Mac 8 月 26 日报道，此次接入带来了三样变化：支持图像输入的多模态能力、100 万 token 的上下文窗口，以及比 GLM-5.2 明显更低的调用价格。</p>

<figure data-wp-context="{&quot;imageId&quot;:&quot;6a8fccc618676&quot;}" data-wp-interactive="core/image" data-wp-key="6a8fccc618676" class="wp-block-image size-large wp-lightbox-container"><img fetchpriority="high" decoding="async" width="1200" height="628" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/08/d4010f9ba6fe29977f4b65c86980fc44_header.webp" alt="LM Studio Bionic 智能体平台界面" class="wp-image-5489" srcset="https://mylogs.cn/wp-content/uploads/2026/08/d4010f9ba6fe29977f4b65c86980fc44_header.webp 1200w, https://mylogs.cn/wp-content/uploads/2026/08/d4010f9ba6fe29977f4b65c86980fc44_header-300x157.webp 300w, https://mylogs.cn/wp-content/uploads/2026/08/d4010f9ba6fe29977f4b65c86980fc44_header-1024x536.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/08/d4010f9ba6fe29977f4b65c86980fc44_header-768x402.webp 768w" sizes="(max-width: 1200px) 100vw, 1200px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption>图片来源：9to5Mac</figcaption></figure>

<h2 class="wp-block-heading">Bionic 是什么：从聊天窗口走向干活的智能体</h2>

<p class="wp-block-paragraph">LM Studio 长期以来被当作一款在本地运行开源大模型的桌面工具，用户下载模型权重，在自己的电脑上推理。今年 7 月中旬，它推出了 Bionic，把能力从&#8221;对话&#8221;扩展到&#8221;办事&#8221;：这是一个面向 Mac 和 Windows 的智能体应用，主打编程、资料研究，以及处理文档和文件这类需要多步操作的任务。</p>

<p class="wp-block-paragraph">Bionic 的模型来源有两条路。一条是本地运行的模型，全部计算发生在自己的机器上；另一条是云端托管模型，服务器位于美国，LM Studio 表示这部分适用严格的零数据保留策略，即不留存用户数据。</p>

<p class="wp-block-paragraph">模型阵容的扩张速度不慢。Bionic 发布后不久，LM Studio 先接入了月之暗面的 Kimi K3，时间是 7 月 27 日。8 月 26 日这次，轮到了智谱的 GLM-5.3-Flash，走的是云端调用通道。</p>

<h2 class="wp-block-heading">价格是这次最实际的变化：最多便宜十倍</h2>

<p class="wp-block-paragraph">对使用智能体的人来说，最直接的感受往往不是跑分，而是账单。智能体任务动辄要读一整个代码仓库、翻几十页文档、反复调用工具，token 消耗远高于普通聊天，单价的差别会被放大很多倍。</p>

<p class="wp-block-paragraph">LM Studio 给出的说法是，GLM-5.3-Flash 的运行成本最多可以比 GLM-5.2 低十倍，也就是降到约十分之一。这个量级的降幅，意味着一些原本因为太贵而不敢长时间跑的自动化流程，重新变得可行。</p>

<h2 class="wp-block-heading">模型本身：3200 亿参数，激活 180 亿</h2>

<p class="wp-block-paragraph">按 9to5Mac 的介绍，GLM-5.3-Flash 是一个 3200 亿参数的混合专家（MoE）模型，推理时激活 180 亿参数，支持图像和文本两种输入，上下文窗口为 100 万 token。混合专家架构的特点是总参数量很大，但每次推理只唤醒其中一小部分，这也是它能把单价压下来的技术前提。</p>

<p class="wp-block-paragraph">在智谱自己列出的基准测试中，GLM-5.3-Flash 全面超过上一代 GLM-5.2；与 Anthropic、OpenAI、Google 和深度求索（DeepSeek）的前沿模型相比，成绩大体处于同一区间。</p>

<p class="wp-block-paragraph">这款模型在正式发布前还有一段插曲：它曾以代号&#8221;Ox Alpha&#8221;在 OpenCode 和 OpenRouter 上匿名接受测试，凭表现积累了不少讨论度，直到官方揭晓身份，外界才知道匿名模型出自智谱。</p>

<h2 class="wp-block-heading">对中国用户意味着什么</h2>

<p class="wp-block-paragraph">有几点值得区分清楚。Bionic 的云端通道服务器在美国，实际可用性取决于网络环境；而本地模型这条路不受此限——只要机器带得动，权重下载到本机就能离线跑，数据不出设备，这对处理合同、代码、内部资料等敏感内容的人来说是实质性的优势。</p>

<p class="wp-block-paragraph">也就是说，GLM-5.3-Flash 进入 LM Studio 生态，真正的看点不在于&#8221;又多了一个可选模型&#8221;，而在于国产开源模型正在成为桌面端智能体工具的默认选项之一。开源权重加上大幅下降的调用成本，让&#8221;把智能体跑在自己电脑上&#8221;这件事的门槛，比半年前低了一截。</p>

<p class="wp-block-paragraph">想尝试的用户可以在 LM Studio 官网的 Bionic 页面查看具体接入方式和当前可用模型清单。</p>]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
