<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>AI 成本 &#8211; mylogs.cn</title>
	<atom:link href="https://mylogs.cn/tag/ai-%E6%88%90%E6%9C%AC/feed/" rel="self" type="application/rss+xml" />
	<link>https://mylogs.cn</link>
	<description>发现、记录、分享</description>
	<lastBuildDate>Sat, 15 Aug 2026 19:47:03 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	
	<item>
		<title>大模型价格战开打：中间档降价八成，顶级款按住不动</title>
		<link>https://mylogs.cn/llm-price-war-middle-tier-cut-80-percent/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Sat, 15 Aug 2026 19:46:43 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI 成本]]></category>
		<category><![CDATA[Anthropic]]></category>
		<category><![CDATA[Claude]]></category>
		<category><![CDATA[GPT-5.6]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[价格战]]></category>
		<category><![CDATA[大模型]]></category>
		<guid isPermaLink="false">https://mylogs.cn/llm-price-war-middle-tier-cut-80-percent/</guid>

					<description><![CDATA[美国头部 AI 实验室正在集体下调模型价格。降价的直接原因不是成本突然降下来了，而是对价格敏感的客户开始转投更 [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">美国头部 AI 实验室正在集体下调模型价格。降价的直接原因不是成本突然降下来了，而是对价格敏感的客户开始转投更便宜的替代方案，其中不少来自中国厂商。</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6a83256b8569c&quot;}" data-wp-interactive="core/image" data-wp-key="6a83256b8569c" class="wp-block-image size-large aligncenter wp-lightbox-container"><img fetchpriority="high" decoding="async" width="1200" height="821" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/08/30442beeaf4c72d615fb0ee1caa70956_header.webp" alt="大模型价格战开打：中间档降价八成，顶级款按住不动" class="wp-image-5010" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/08/30442beeaf4c72d615fb0ee1caa70956_header.webp 1200w, https://mylogs.cn/wp-content/uploads/2026/08/30442beeaf4c72d615fb0ee1caa70956_header-300x205.webp 300w, https://mylogs.cn/wp-content/uploads/2026/08/30442beeaf4c72d615fb0ee1caa70956_header-1024x701.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/08/30442beeaf4c72d615fb0ee1caa70956_header-768x525.webp 768w" sizes="(max-width: 1200px) 100vw, 1200px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：AI 生成配图</figcaption></figure>





<p class="wp-block-paragraph">具体动作已经落到价目表上。OpenAI 近期宣布把 GPT-5.6 Luna（其自称「最快、最实惠的模型」）的价格下调 80%：每百万输入 token 从 1 美元降到 0.20 美元，每百万输出 token 从 6 美元降到 1.20 美元。Anthropic 推出 Claude Opus 5，宣传口径是以 Fable 5（该公司能力最强的模型）「一半的价格」提供「前沿级智能」，Opus 5 定价为每百万输入 token 5 美元、每百万输出 token 25 美元。同一周，Anthropic 还取消了原定 9 月对 Sonnet 5 生效的涨价。</p>



<p class="wp-block-paragraph">按 Silicon Data 的 token 价格指数，自 7 月中旬以来，客户为美国头部实验室模型实际支付的价格已经下降近四分之一。token 是语言模型处理数据的计量单位，也是多数客户账单的计价依据。</p>



<h2 class="wp-block-heading">是什么把价格压了下来</h2>



<p class="wp-block-paragraph">这轮降价对美国的闭源模型厂商来说是个转向。此前它们主要在性能维度上竞争，而不是价格。变化来自中国实验室持续推出的开源模型——这些模型可以被开发者自由下载和调整，能力也在不断提升，直接对价格构成压力。报道点名了月之暗面（Moonshot）与深度求索（DeepSeek），称其已经在从硅谷到欧洲的用户中打开局面。</p>



<p class="wp-block-paragraph">企业端的成本压力同时在放大。Anthropic 和 OpenAI 正把部分企业客户从固定订阅转向按用量计费，客户按实际消耗的算力付费。账单上涨之后，一些企业的应对方式是给 AI 用量设上限，或者直接测试更便宜的替代品。DoorDash 与 Airbnb 都表示已开始使用中国厂商的模型来控制支出。</p>



<h2 class="wp-block-heading">标价便宜，不等于最终花得少</h2>



<p class="wp-block-paragraph">单看每百万 token 的标价，无法直接比较模型贵贱。能力更强的模型有时用更少的 token、更少的尝试次数就能完成同一个任务，于是标价更高的模型反而总成本更低。多数模型还能在不同的「effort」（算力投入档位）下运行，这既影响表现，也影响完成任务的最终花费。</p>



<p class="wp-block-paragraph">第三方评测机构 Artificial Analysis 在数学、科学、编程和推理等方向做了横向对比，两组结果颇能说明问题：</p>



<ul class="wp-block-list"><li>Anthropic 的 Opus 5 在 medium 档位下，性能与每任务成本都接近月之暗面 Kimi K3 的 max 档位；</li><li>OpenAI 的 GPT-5.6 Luna 在 max 档位下，表现与深度求索 V4 Flash 的 max 档位相当，但每完成一个任务的成本接近后者的两倍。</li></ul>



<h2 class="wp-block-heading">砍中间，守顶端</h2>



<p class="wp-block-paragraph">值得注意的是，这轮降价集中在中端产品，正是与中国模型正面竞争的价格带，最顶级的那一档并没有跟着降。长期使用大语言模型的网站托管商 Hostinger，其 AI 技术负责人 Mantas Lukauskas 观察到，最好的模型价格「持平到上涨」。他给出的判断是：</p>



<blockquote class="wp-block-quote is-layout-flow wp-block-quote-is-layout-flow">
<p class="wp-block-paragraph">美国实验室砍掉了中间，守住了顶端。</p>
</blockquote>



<p class="wp-block-paragraph">对这轮调价，OpenAI 与 Anthropic 均拒绝置评。一位接近 Anthropic 的人士称，Opus 5 定价低于旗舰 Fable 5，是这家公司「模型家族本来的构建方式，与竞争对手无关」。</p>



<p class="wp-block-paragraph">这些动作还有另一层背景：OpenAI 与 Anthropic 都在筹划以万亿美元估值上市，而投资者正在寻找证据，证明这个行业的巨额投入能够换来回报。降价能不能同时守住收入和客户，短期内会是两家都要回答的问题。对使用方来说，更实际的结论是：中间档模型的调用成本正在快速下滑，而顶级模型的价格暂时看不到松动。</p>



<p class="has-small-font-size wp-block-paragraph">来源：Ars Technica / Jamie John</p>

]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>同一句话喂 11 个 AI，结果差出 200 倍</title>
		<link>https://mylogs.cn/one-prompt-11-models-200x/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Thu, 13 Aug 2026 15:16:44 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI 成本]]></category>
		<category><![CDATA[AI 模型对比]]></category>
		<category><![CDATA[Claude Opus 5]]></category>
		<category><![CDATA[DeepSeek V4]]></category>
		<category><![CDATA[Netlify]]></category>
		<category><![CDATA[大模型评测]]></category>
		<category><![CDATA[提示词]]></category>
		<guid isPermaLink="false">https://mylogs.cn/one-prompt-11-models-200x/</guid>

					<description><![CDATA[同一句话喂 11 个 AI，结果差出 200 倍 同一个问题，交给不同的大模型，得到的答案可能天差地别。Net [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">同一句话喂 11 个 AI，结果差出 200 倍</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6a83256b8657d&quot;}" data-wp-interactive="core/image" data-wp-key="6a83256b8657d" class="wp-block-image size-large aligncenter wp-lightbox-container"><img decoding="async" width="1200" height="675" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/08/c4359e828a879d0c10cc9370cdfe95ae_header.webp" alt="同一句话喂 11 个 AI，结果差出 200 倍" class="wp-image-4723" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/08/c4359e828a879d0c10cc9370cdfe95ae_header.webp 1200w, https://mylogs.cn/wp-content/uploads/2026/08/c4359e828a879d0c10cc9370cdfe95ae_header-300x169.webp 300w, https://mylogs.cn/wp-content/uploads/2026/08/c4359e828a879d0c10cc9370cdfe95ae_header-1024x576.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/08/c4359e828a879d0c10cc9370cdfe95ae_header-768x432.webp 768w" sizes="(max-width: 1200px) 100vw, 1200px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：Netlify</figcaption></figure>





<p class="wp-block-paragraph">同一个问题，交给不同的大模型，得到的答案可能天差地别。Netlify 产品经理 Elad Rosenheim 做了一组有趣的实验：把同一段建站提示词，分别丢给 11 个主流大模型，每个模型跑三次，记录它们消耗的积分和产出的差异。结论很直观——选对模型，成本和效果能差出两百倍。</p>



<h2 class="wp-block-heading">实验怎么做的</h2>



<p class="wp-block-paragraph">实验场景设定为「社区咖啡馆单页网站」：要求包含营业时间、地址、简短菜单和一张照片，并且「除非我自己修改，否则内容不应变动」。这段文字没有给任何真实素材，只用一个「社区」来暗示方向。</p>



<p class="wp-block-paragraph">参与测试的 11 个模型分别是：Claude Opus 5、Claude Sonnet 5、GPT 5.6 Sol、Gemini 3.6 Flash、Kimi K3、Gemini 3.1 Pro、GPT 5.6 Terra、DeepSeek V4 Pro、GLM 5.2、Kimi K2.7 Code，以及 DeepSeek V4 Flash（0731 最新版）。每个模型都独立运行三次。</p>



<h2 class="wp-block-heading">成本差距触目惊心</h2>



<p class="wp-block-paragraph">按每次运行的平均积分消耗排序，差距相当惊人：</p>



<ul class="wp-block-list"><li>Claude Opus 5：平均 519（其中一次飙到 1055）</li><li>Claude Sonnet 5：平均 143</li><li>GPT 5.6 Sol：平均 141</li><li>Gemini 3.6 Flash：平均 103</li><li>Kimi K3：平均 102</li><li>Gemini 3.1 Pro：平均 53</li><li>GPT 5.6 Terra：平均 39</li><li>DeepSeek V4 Pro：平均 37</li><li>GLM 5.2：平均 27</li><li>Kimi K2.7 Code：平均 19</li><li>DeepSeek V4 Flash（0731）：平均仅 2.4</li></ul>



<p class="wp-block-paragraph">最贵的 Claude Opus 5 与最便宜的 DeepSeek V4 Flash，平均成本相差超过两百倍。值得注意的是，Opus 5 那次 1055 积分的运行「细节满满、令人惊喜」，自带可动画的印章式文字、自定义地图和开箱即用的深色模式；而两次 253、249 积分的运行「也不差」，但矢量图形仍显露出大模型能力的边界。</p>



<h2 class="wp-block-heading">贵的未必更好，便宜的也未必差</h2>



<p class="wp-block-paragraph">成本高低并不直接等于质量高低。文章观察到几个有意思的现象：</p>



<p class="wp-block-paragraph">GPT 5.6 Sol 虽然是「低强度」档位，却在基础设计直觉上胜过了 Anthropic 的中端模型，内容更丰富，只是配图偏通用。DeepSeek V4 Flash 虽然最便宜，某次运行却「最像中端闭源模型」，且消耗的积分最少。</p>



<p class="wp-block-paragraph">反过来，被寄予厚望的 Kimi K3 在本轮设计任务里「并不出彩」——它本是为长程智能体任务打造的前沿模型，需要换一种提示方式才能公平评判。GLM 5.2 三次运行风格差异大到「像来自几个不同的模型」，且当前版本是纯文本模型，无法接收图片输入。</p>



<h2 class="wp-block-heading">启示：先想清楚要什么</h2>



<p class="wp-block-paragraph">作者给出的阶段性结论是：当任务超出「做个简单网站」，真正的问题变成——模型是否懂得调用平台能力（数据库、AI、鉴权），是否能严格自检并做前端校验（图片输入是关键）。在仅做设计与文案的测试里，Opus 5 最巧妙，却并非必需；预算有限时，选用开箱即用或迭代式简单模型更划算。</p>



<p class="wp-block-paragraph">Netlify 与 OpenRouter 合作，通过 AI Gateway 和 Agent Runners 提供多种模型接入。Agent Runners 内置完整的编码智能体，支持 Claude Agent、OpenAI Codex、Gemini CLI，并新增 OpenCode 以接入 Kimi K3、GLM 5.2、DeepSeek V4 等开源模型。</p>



<p class="has-small-font-size wp-block-paragraph">来源：Netlify 博客（作者 Elad Rosenheim，Principal Product Manager），原文发布于 2026 年 8 月 12 日。</p>

]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
