<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>AI定价 &#8211; mylogs.cn</title>
	<atom:link href="https://mylogs.cn/tag/ai%e5%ae%9a%e4%bb%b7/feed/" rel="self" type="application/rss+xml" />
	<link>https://mylogs.cn</link>
	<description>发现、记录、分享</description>
	<lastBuildDate>Wed, 05 Aug 2026 05:02:15 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	
	<item>
		<title>token 越来越便宜，AI 账单却越来越离谱</title>
		<link>https://mylogs.cn/ai-token-pricing-tokenomics-challenge/</link>
					<comments>https://mylogs.cn/ai-token-pricing-tokenomics-challenge/#respond</comments>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Wed, 05 Aug 2026 05:02:01 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI定价]]></category>
		<category><![CDATA[AI成本]]></category>
		<category><![CDATA[Token]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[企业AI]]></category>
		<category><![CDATA[智能体]]></category>
		<guid isPermaLink="false">https://mylogs.cn/ai-token-pricing-tokenomics-challenge/</guid>

					<description><![CDATA[单价一路下跌，总账单却一路上涨——这是眼下企业采购 AI 服务时最普遍的困惑。英国广播公司（BBC）科技记者  [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">单价一路下跌，总账单却一路上涨——这是眼下企业采购 AI 服务时最普遍的困惑。英国广播公司（BBC）科技记者 Joe Fay 在 8 月 4 日的报道中指出，买方管不住成本，卖方定不出价格，整个行业还没人真正想明白 AI 该怎么收钱。</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6a7491460ce9c&quot;}" data-wp-interactive="core/image" data-wp-key="6a7491460ce9c" class="wp-block-image size-large aligncenter wp-lightbox-container"><img fetchpriority="high" decoding="async" width="1200" height="675" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/08/66ea45d0c02a0e6ade6134ee3d8ff69d_header.webp" alt="token 越来越便宜，AI 账单却越来越离谱" class="wp-image-3631" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/08/66ea45d0c02a0e6ade6134ee3d8ff69d_header.webp 1200w, https://mylogs.cn/wp-content/uploads/2026/08/66ea45d0c02a0e6ade6134ee3d8ff69d_header-300x169.webp 300w, https://mylogs.cn/wp-content/uploads/2026/08/66ea45d0c02a0e6ade6134ee3d8ff69d_header-1024x576.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/08/66ea45d0c02a0e6ade6134ee3d8ff69d_header-768x432.webp 768w" sizes="(max-width: 1200px) 100vw, 1200px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：Getty Images（经 BBC News 使用）</figcaption></figure>





<h2 class="wp-block-heading">问题出在“token”这个计量单位</h2>



<p class="wp-block-paragraph">用户向大模型提问、让它写代码或自动执行流程时，这段提示词会被拆成一个个被称为 token 的数学块交给模型处理，模型的回答同样以 token 的形式产出，再还原成文字、代码或指令。</p>



<p class="wp-block-paragraph">麻烦在于，这个过程并不可预测。提示词的细微差别会带来不同的回答，同一段提示词两次运行结果也未必一致，换个模型答案又不一样。而在智能体系统里，多个 AI 智能体协同决策与执行，token 消耗量和不确定性还会进一步叠加。</p>



<p class="wp-block-paragraph">身份管理公司 Saviynt 正在把智能体能力接入自家服务，公司高管 Simon Gooch 的说法很直白：“想把客户绑定在一套未来 12 个月、两年、三年的成本模型上，说实话根本讲不通，因为我们自己也不知道。”</p>



<h2 class="wp-block-heading">单价暴跌，用量暴涨</h2>



<p class="wp-block-paragraph">高盛的分析显示，近年来单个 token 及其对应额度的价格已大幅下滑，但企业和个人消耗的 token 数量却在飞速膨胀。该行预测，随着各方转向使用 AI 智能体，2026 年到 2030 年间 token 消耗量将增长 24 倍，达到每月 120 千万亿个（1.2×10¹⁷）。</p>



<p class="wp-block-paragraph">问题是，多数使用者对自己烧掉了多少 token 只有模糊的概念，往往要等到额度用尽或月底账单送达才反应过来。报道援引消息称，连微软都已收紧工程师对部分第三方编程工具的使用；而优步在今年早些时候，把一整年的 AI 编程 token 预算在几个月内就消耗殆尽。</p>



<p class="wp-block-paragraph">伦敦政治经济学院数字创新与信息系统副教授 Will Venters 认为，企业在内部试验或落地 AI 时最容易踩坑，因为员工会不知不觉把额度耗光。“大家发现这个成本真的很难管……它的产出是非确定的，所以价值也是非确定的。”</p>



<h2 class="wp-block-heading">各方的应对办法</h2>



<p class="wp-block-paragraph">工程软件公司 smartR AI 创始人 Oliver King-Smith 观察到，规模较小的组织“可以躲在雷达下，用固定费用的个人账户，我敢肯定大厂并不乐意”。但他判断这条路走不长：“大厂在这些账户上是在亏钱的。”一旦平台开始面临股东的盈利压力，“他们就会收紧”。</p>



<p class="wp-block-paragraph">英国财务软件公司 iplicit 首席财务官 Rob Steele 则强调提示词要写得更精确。他打了个比方：“你总不会一句交代都没有，就打发家里人去采购一周的东西吧？”</p>



<p class="wp-block-paragraph">Venters 补充说，当 AI 被嵌入一款要面向成千上万用户推广的产品时，局面会更难控制——管理者可能才意识到，除了核心的软件开发，测试、安全乃至护栏机制同样都要消耗 token。他还提到一个容易被忽视的对比：多雇几个 AI 智能体只需点一下按钮，而扩充人类团队则要经过编制和招聘的层层讨论。</p>



<p class="wp-block-paragraph">不过 Venters 也提醒，成本不可预测未必等于亏，企业可能确实从中获得了更高的价值。“这跟计算器不一样，”他说，“你喂给它的越多，它就越贵，但结果也可能越好。”</p>



<h2 class="wp-block-heading">卖方同样一头雾水</h2>



<p class="wp-block-paragraph">企业还得把这些成本转嫁给自己的客户，而这一步同样没有答案。软件公司 Sumo Logic 产品营销高级总监 Bill Peterson 说得直接：“没人真正搞明白。”该公司正在预览基于智能体的新安全服务，如何收费仍在与企业客户商讨中。“我们内部还在开一些‘有意思’的会。”他略带调侃地表示。</p>



<p class="wp-block-paragraph">可选方案包括全线涨价、按结果付费，或按“事件包”打包销售。但只要底层大模型厂商调整自己的定价策略，这些结构随时可能被推翻。“一旦进入浮动定价，价格每隔几个月就变一次，”Peterson 说，“客户不喜欢这样，没人是这么做预算的。”</p>



<p class="has-small-font-size wp-block-paragraph">来源：BBC News</p>

]]></content:encoded>
					
					<wfw:commentRss>https://mylogs.cn/ai-token-pricing-tokenomics-challenge/feed/</wfw:commentRss>
			<slash:comments>0</slash:comments>
		
		
			</item>
		<item>
		<title>GPT-5.6降价八成：OpenAI把API打到两折起</title>
		<link>https://mylogs.cn/gpt-5-6%e9%99%8d%e4%bb%b7%e5%85%ab%e6%88%90%ef%bc%9aopenai%e6%8a%8aapi%e6%89%93%e5%88%b0%e4%b8%a4%e6%8a%98%e8%b5%b7/</link>
					<comments>https://mylogs.cn/gpt-5-6%e9%99%8d%e4%bb%b7%e5%85%ab%e6%88%90%ef%bc%9aopenai%e6%8a%8aapi%e6%89%93%e5%88%b0%e4%b8%a4%e6%8a%98%e8%b5%b7/#respond</comments>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Fri, 31 Jul 2026 06:39:08 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI定价]]></category>
		<category><![CDATA[API降价]]></category>
		<category><![CDATA[GPT-5.6]]></category>
		<category><![CDATA[Luna]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[大语言模型]]></category>
		<guid isPermaLink="false">https://mylogs.cn/gpt-5-6%e9%99%8d%e4%bb%b7%e5%85%ab%e6%88%90%ef%bc%9aopenai%e6%8a%8aapi%e6%89%93%e5%88%b0%e4%b8%a4%e6%8a%98%e8%b5%b7/</guid>

					<description><![CDATA[北京时间 7 月 31 日凌晨，OpenAI 宣布下调 GPT-5.6 系列模型的接口调用价格。这次调整覆盖全 [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">北京时间 7 月 31 日凌晨，OpenAI 宣布下调 GPT-5.6 系列模型的接口调用价格。这次调整覆盖全线三款模型，其中最轻量的 Luna 直接砍掉八成，中端的 Terra 降两成，旗舰 Sol 价格不变但多了一个花钱买速度的新选项。</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6a7491460df69&quot;}" data-wp-interactive="core/image" data-wp-key="6a7491460df69" class="wp-block-image size-large aligncenter wp-lightbox-container"><img decoding="async" width="1200" height="799" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/07/f48a364e52e44504787c18dd7b2fea41_header.webp" alt="GPT-5.6降价八成：OpenAI把API打到两折起" class="wp-image-3017" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/07/f48a364e52e44504787c18dd7b2fea41_header.webp 1200w, https://mylogs.cn/wp-content/uploads/2026/07/f48a364e52e44504787c18dd7b2fea41_header-300x200.webp 300w, https://mylogs.cn/wp-content/uploads/2026/07/f48a364e52e44504787c18dd7b2fea41_header-1024x682.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/07/f48a364e52e44504787c18dd7b2fea41_header-768x511.webp 768w" sizes="(max-width: 1200px) 100vw, 1200px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：Wikimedia Commons (Coolcaesar, CC BY 4.0)</figcaption></figure>





<p class="wp-block-paragraph">对于把大模型接进自家业务的开发者和企业来说，这是今年以来最直接的一次成本利好。</p>



<h2 class="wp-block-heading">降价幅度：Luna 打两折，Terra 打八折</h2>



<p class="wp-block-paragraph">GPT-5.6 家族按能力分成三档：旗舰 Sol、成本更低但性能对标上一代 GPT-5.5 的 Terra，以及速度最快、价格最低的 Luna。数字代表代际，三个名字代表长期存在的能力层级，各自按自己的节奏迭代。</p>



<p class="wp-block-paragraph">从 7 月 30 日（美国时间）起，新的接口价格为：</p>



<ul class="wp-block-list"><li><strong>Terra</strong>：输入每百万 token 2 美元，输出每百万 token 12 美元。此前为 2.5 美元和 15 美元，降幅 20%。</li><li><strong>Luna</strong>：输入每百万 token 0.20 美元，输出每百万 token 1.20 美元。此前为 1 美元和 6 美元，降幅高达 80%。按当前汇率折算，Luna 的输入价格约合人民币 1.35 元，输出价格约合 8.11 元。</li><li><strong>Sol</strong>：维持输入 5 美元、输出 30 美元不变。</li></ul>



<p class="wp-block-paragraph">价格调整将陆续在 AWS 平台上同步生效。ChatGPT 与 Codex 的订阅价格和配额预算保持不变，但 Terra 与 Luna 的使用现在消耗更少的额度，相当于变相扩容。</p>



<h2 class="wp-block-heading">Sol 不降价，改卖速度</h2>



<p class="wp-block-paragraph">旗舰型号 Sol 这次没有降价，而是新增了一种 Fast 模式。该模式在接口层面提供最高 2.5 倍的响应速度，模型的智能水平完全不变，代价是收取标准价格的两倍。</p>



<p class="wp-block-paragraph">Fast 模式替代了接口中原有的 Priority Processing（优先处理），并与 Codex 中的 <code>/fast</code> 命令保持一致。此前已经标记为 priority 的接口请求仍可继续使用。</p>



<p class="wp-block-paragraph">这个设计相当于把“速度”单独拆成一个付费维度：实时对话、流式生成这类对延迟敏感的生产环境，可以多掏钱换吞吐；不着急的批量任务则不必为此买单。</p>



<h2 class="wp-block-heading">便宜到什么程度：一年前的前沿水平，成本只剩零头</h2>



<p class="wp-block-paragraph">OpenAI 在公告中给出的说法是，Luna 能以大约六个点的单位任务成本，交付一年前还属于前沿水准的性能，速度接近当时的九倍。</p>



<p class="wp-block-paragraph">在衡量专业工作能力的 Agents‘ Last Exam 测试中，Luna 的表现超过了 Claude Fable 5，而估算的单任务成本低了近 99%。</p>



<p class="wp-block-paragraph">从 GPT-5.6 发布时公布的评测数据看，这三档模型在这项测试上的差距并不大：Sol 为 52.7%，Terra 为 50.4%，Luna 为 50.3%，均高于上一代 GPT-5.5 的 46.9%。作为对照，Claude Fable 5 为 40.5%，Claude Opus 4.8 为 45.2%，Gemini 3.1 Pro Preview 为 32.1%。</p>



<p class="wp-block-paragraph">OpenAI 同时公布了一张基于 Artificial Analysis 智能指数 v4.1 的价格—性能分布图。图中 Luna 位于左上区域，在智能指数超过 50 分的同时，单次任务成本约为 0.05 美元（约合人民币 0.34 元）。Claude Opus 5、Gemini 3.6 Flash、GLM-5.2 Max 等模型智能指数接近，但完成单项任务的成本更高；DeepSeek V4 Pro 的单次成本低于多数前沿模型，智能指数约为 44 分。</p>



<h2 class="wp-block-heading">降价的底气：模型自己帮忙优化了推理系统</h2>



<p class="wp-block-paragraph">OpenAI 把效率提升归结为三层同时改进——模型本身、运行模型的推理系统，以及把模型连接到工具和上下文的智能体框架。更好的路由让硬件保持高负载，优化后的生产软件生成 token 的效率更高，更聪明的上下文管理让智能体避免重复已完成的工作。</p>



<p class="wp-block-paragraph">值得注意的是其中一段披露：在人类主导的流程中，GPT-5.6 Sol 自主重写并优化了生产环境的计算内核，设计并运行了数百次改进 token 生成的实验，还负责监控训练过程、在出现问题时介入。内核层面的工作让该模型端到端的服务成本下降了 20%，实验则让 token 生成效率提升超过 15%。</p>



<p class="wp-block-paragraph">换句话说，这次降价的一部分空间，是模型自己“省”出来的。OpenAI 称这形成了一个更紧的反馈循环：模型越强、越能自主工作，优化效率的能力就越快。</p>



<h2 class="wp-block-heading">分层定价的逻辑：把钱花在真正需要智能的环节</h2>



<p class="wp-block-paragraph">OpenAI 在公告中给出的建议是，企业先定义需要的结果和质量标准，再通过评测判断哪些环节增加智能能实质性改善结果、哪些环节用更快更便宜的处理就能达到同样质量。</p>



<p class="wp-block-paragraph">比如一条编码工作流，可以先用 Sol 消化不确定性、定下方案，再用 Luna 去实现已经明确的改动、编写并运行测试、评估结果。大规模文档分析、客户交互分类、常规实现这类高频任务，在新价格下具备了大范围铺开的经济性；而复杂的 Sol 任务则可以在必要时通过 Fast 模式提速。</p>



<p class="wp-block-paragraph">可用性方面，GPT-5.6 Terra 与 Luna 在 ChatGPT Work、Codex 和 OpenAI 接口中均可使用。在 ChatGPT Work 和 Codex 中，免费用户与 Go 用户可以使用 Terra，Plus、Pro、商业版和企业版用户可以在 Terra 与 Luna 之间选择。</p>



<p class="wp-block-paragraph">OpenAI 联合创始人兼首席执行官萨姆·奥特曼在社交平台发文称，目标是“在每一个模型层级，都提供最好的价格与智能的权衡”。</p>



<p class="wp-block-paragraph">消息公布后，开发者社区反应迅速，不少人认为 Luna 的降幅超出预期。对同行而言，压力显然又传导了一轮。</p>



<p class="wp-block-paragraph">来源：OpenAI 官方博客《Advancing the price-performance frontier with GPT‑5.6》（https://openai.com/index/advancing-the-price-performance-frontier-with-gpt-5-6/ ）、智东西</p>

]]></content:encoded>
					
					<wfw:commentRss>https://mylogs.cn/gpt-5-6%e9%99%8d%e4%bb%b7%e5%85%ab%e6%88%90%ef%bc%9aopenai%e6%8a%8aapi%e6%89%93%e5%88%b0%e4%b8%a4%e6%8a%98%e8%b5%b7/feed/</wfw:commentRss>
			<slash:comments>0</slash:comments>
		
		
			</item>
	</channel>
</rss>
