<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>Luna &#8211; mylogs.cn</title>
	<atom:link href="https://mylogs.cn/tag/luna/feed/" rel="self" type="application/rss+xml" />
	<link>https://mylogs.cn</link>
	<description>发现、记录、分享</description>
	<lastBuildDate>Fri, 31 Jul 2026 06:39:24 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	
	<item>
		<title>GPT-5.6降价八成：OpenAI把API打到两折起</title>
		<link>https://mylogs.cn/gpt-5-6%e9%99%8d%e4%bb%b7%e5%85%ab%e6%88%90%ef%bc%9aopenai%e6%8a%8aapi%e6%89%93%e5%88%b0%e4%b8%a4%e6%8a%98%e8%b5%b7/</link>
					<comments>https://mylogs.cn/gpt-5-6%e9%99%8d%e4%bb%b7%e5%85%ab%e6%88%90%ef%bc%9aopenai%e6%8a%8aapi%e6%89%93%e5%88%b0%e4%b8%a4%e6%8a%98%e8%b5%b7/#respond</comments>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Fri, 31 Jul 2026 06:39:08 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI定价]]></category>
		<category><![CDATA[API降价]]></category>
		<category><![CDATA[GPT-5.6]]></category>
		<category><![CDATA[Luna]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[大语言模型]]></category>
		<guid isPermaLink="false">https://mylogs.cn/gpt-5-6%e9%99%8d%e4%bb%b7%e5%85%ab%e6%88%90%ef%bc%9aopenai%e6%8a%8aapi%e6%89%93%e5%88%b0%e4%b8%a4%e6%8a%98%e8%b5%b7/</guid>

					<description><![CDATA[北京时间 7 月 31 日凌晨，OpenAI 宣布下调 GPT-5.6 系列模型的接口调用价格。这次调整覆盖全 [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">北京时间 7 月 31 日凌晨，OpenAI 宣布下调 GPT-5.6 系列模型的接口调用价格。这次调整覆盖全线三款模型，其中最轻量的 Luna 直接砍掉八成，中端的 Terra 降两成，旗舰 Sol 价格不变但多了一个花钱买速度的新选项。</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6a6fed2183332&quot;}" data-wp-interactive="core/image" data-wp-key="6a6fed2183332" class="wp-block-image size-large aligncenter wp-lightbox-container"><img fetchpriority="high" decoding="async" width="1200" height="799" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/07/f48a364e52e44504787c18dd7b2fea41_header.webp" alt="GPT-5.6降价八成：OpenAI把API打到两折起" class="wp-image-3017" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/07/f48a364e52e44504787c18dd7b2fea41_header.webp 1200w, https://mylogs.cn/wp-content/uploads/2026/07/f48a364e52e44504787c18dd7b2fea41_header-300x200.webp 300w, https://mylogs.cn/wp-content/uploads/2026/07/f48a364e52e44504787c18dd7b2fea41_header-1024x682.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/07/f48a364e52e44504787c18dd7b2fea41_header-768x511.webp 768w" sizes="(max-width: 1200px) 100vw, 1200px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：Wikimedia Commons (Coolcaesar, CC BY 4.0)</figcaption></figure>





<p class="wp-block-paragraph">对于把大模型接进自家业务的开发者和企业来说，这是今年以来最直接的一次成本利好。</p>



<h2 class="wp-block-heading">降价幅度：Luna 打两折，Terra 打八折</h2>



<p class="wp-block-paragraph">GPT-5.6 家族按能力分成三档：旗舰 Sol、成本更低但性能对标上一代 GPT-5.5 的 Terra，以及速度最快、价格最低的 Luna。数字代表代际，三个名字代表长期存在的能力层级，各自按自己的节奏迭代。</p>



<p class="wp-block-paragraph">从 7 月 30 日（美国时间）起，新的接口价格为：</p>



<ul class="wp-block-list"><li><strong>Terra</strong>：输入每百万 token 2 美元，输出每百万 token 12 美元。此前为 2.5 美元和 15 美元，降幅 20%。</li><li><strong>Luna</strong>：输入每百万 token 0.20 美元，输出每百万 token 1.20 美元。此前为 1 美元和 6 美元，降幅高达 80%。按当前汇率折算，Luna 的输入价格约合人民币 1.35 元，输出价格约合 8.11 元。</li><li><strong>Sol</strong>：维持输入 5 美元、输出 30 美元不变。</li></ul>



<p class="wp-block-paragraph">价格调整将陆续在 AWS 平台上同步生效。ChatGPT 与 Codex 的订阅价格和配额预算保持不变，但 Terra 与 Luna 的使用现在消耗更少的额度，相当于变相扩容。</p>



<h2 class="wp-block-heading">Sol 不降价，改卖速度</h2>



<p class="wp-block-paragraph">旗舰型号 Sol 这次没有降价，而是新增了一种 Fast 模式。该模式在接口层面提供最高 2.5 倍的响应速度，模型的智能水平完全不变，代价是收取标准价格的两倍。</p>



<p class="wp-block-paragraph">Fast 模式替代了接口中原有的 Priority Processing（优先处理），并与 Codex 中的 <code>/fast</code> 命令保持一致。此前已经标记为 priority 的接口请求仍可继续使用。</p>



<p class="wp-block-paragraph">这个设计相当于把“速度”单独拆成一个付费维度：实时对话、流式生成这类对延迟敏感的生产环境，可以多掏钱换吞吐；不着急的批量任务则不必为此买单。</p>



<h2 class="wp-block-heading">便宜到什么程度：一年前的前沿水平，成本只剩零头</h2>



<p class="wp-block-paragraph">OpenAI 在公告中给出的说法是，Luna 能以大约六个点的单位任务成本，交付一年前还属于前沿水准的性能，速度接近当时的九倍。</p>



<p class="wp-block-paragraph">在衡量专业工作能力的 Agents‘ Last Exam 测试中，Luna 的表现超过了 Claude Fable 5，而估算的单任务成本低了近 99%。</p>



<p class="wp-block-paragraph">从 GPT-5.6 发布时公布的评测数据看，这三档模型在这项测试上的差距并不大：Sol 为 52.7%，Terra 为 50.4%，Luna 为 50.3%，均高于上一代 GPT-5.5 的 46.9%。作为对照，Claude Fable 5 为 40.5%，Claude Opus 4.8 为 45.2%，Gemini 3.1 Pro Preview 为 32.1%。</p>



<p class="wp-block-paragraph">OpenAI 同时公布了一张基于 Artificial Analysis 智能指数 v4.1 的价格—性能分布图。图中 Luna 位于左上区域，在智能指数超过 50 分的同时，单次任务成本约为 0.05 美元（约合人民币 0.34 元）。Claude Opus 5、Gemini 3.6 Flash、GLM-5.2 Max 等模型智能指数接近，但完成单项任务的成本更高；DeepSeek V4 Pro 的单次成本低于多数前沿模型，智能指数约为 44 分。</p>



<h2 class="wp-block-heading">降价的底气：模型自己帮忙优化了推理系统</h2>



<p class="wp-block-paragraph">OpenAI 把效率提升归结为三层同时改进——模型本身、运行模型的推理系统，以及把模型连接到工具和上下文的智能体框架。更好的路由让硬件保持高负载，优化后的生产软件生成 token 的效率更高，更聪明的上下文管理让智能体避免重复已完成的工作。</p>



<p class="wp-block-paragraph">值得注意的是其中一段披露：在人类主导的流程中，GPT-5.6 Sol 自主重写并优化了生产环境的计算内核，设计并运行了数百次改进 token 生成的实验，还负责监控训练过程、在出现问题时介入。内核层面的工作让该模型端到端的服务成本下降了 20%，实验则让 token 生成效率提升超过 15%。</p>



<p class="wp-block-paragraph">换句话说，这次降价的一部分空间，是模型自己“省”出来的。OpenAI 称这形成了一个更紧的反馈循环：模型越强、越能自主工作，优化效率的能力就越快。</p>



<h2 class="wp-block-heading">分层定价的逻辑：把钱花在真正需要智能的环节</h2>



<p class="wp-block-paragraph">OpenAI 在公告中给出的建议是，企业先定义需要的结果和质量标准，再通过评测判断哪些环节增加智能能实质性改善结果、哪些环节用更快更便宜的处理就能达到同样质量。</p>



<p class="wp-block-paragraph">比如一条编码工作流，可以先用 Sol 消化不确定性、定下方案，再用 Luna 去实现已经明确的改动、编写并运行测试、评估结果。大规模文档分析、客户交互分类、常规实现这类高频任务，在新价格下具备了大范围铺开的经济性；而复杂的 Sol 任务则可以在必要时通过 Fast 模式提速。</p>



<p class="wp-block-paragraph">可用性方面，GPT-5.6 Terra 与 Luna 在 ChatGPT Work、Codex 和 OpenAI 接口中均可使用。在 ChatGPT Work 和 Codex 中，免费用户与 Go 用户可以使用 Terra，Plus、Pro、商业版和企业版用户可以在 Terra 与 Luna 之间选择。</p>



<p class="wp-block-paragraph">OpenAI 联合创始人兼首席执行官萨姆·奥特曼在社交平台发文称，目标是“在每一个模型层级，都提供最好的价格与智能的权衡”。</p>



<p class="wp-block-paragraph">消息公布后，开发者社区反应迅速，不少人认为 Luna 的降幅超出预期。对同行而言，压力显然又传导了一轮。</p>



<p class="wp-block-paragraph">来源：OpenAI 官方博客《Advancing the price-performance frontier with GPT‑5.6》（https://openai.com/index/advancing-the-price-performance-frontier-with-gpt-5-6/ ）、智东西</p>

]]></content:encoded>
					
					<wfw:commentRss>https://mylogs.cn/gpt-5-6%e9%99%8d%e4%bb%b7%e5%85%ab%e6%88%90%ef%bc%9aopenai%e6%8a%8aapi%e6%89%93%e5%88%b0%e4%b8%a4%e6%8a%98%e8%b5%b7/feed/</wfw:commentRss>
			<slash:comments>0</slash:comments>
		
		
			</item>
	</channel>
</rss>
