<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>GPT-5.6 &#8211; mylogs.cn</title>
	<atom:link href="https://mylogs.cn/tag/gpt-5-6/feed/" rel="self" type="application/rss+xml" />
	<link>https://mylogs.cn</link>
	<description>发现、记录、分享</description>
	<lastBuildDate>Fri, 31 Jul 2026 06:39:24 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	
	<item>
		<title>GPT-5.6降价八成：OpenAI把API打到两折起</title>
		<link>https://mylogs.cn/gpt-5-6%e9%99%8d%e4%bb%b7%e5%85%ab%e6%88%90%ef%bc%9aopenai%e6%8a%8aapi%e6%89%93%e5%88%b0%e4%b8%a4%e6%8a%98%e8%b5%b7/</link>
					<comments>https://mylogs.cn/gpt-5-6%e9%99%8d%e4%bb%b7%e5%85%ab%e6%88%90%ef%bc%9aopenai%e6%8a%8aapi%e6%89%93%e5%88%b0%e4%b8%a4%e6%8a%98%e8%b5%b7/#respond</comments>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Fri, 31 Jul 2026 06:39:08 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI定价]]></category>
		<category><![CDATA[API降价]]></category>
		<category><![CDATA[GPT-5.6]]></category>
		<category><![CDATA[Luna]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[大语言模型]]></category>
		<guid isPermaLink="false">https://mylogs.cn/gpt-5-6%e9%99%8d%e4%bb%b7%e5%85%ab%e6%88%90%ef%bc%9aopenai%e6%8a%8aapi%e6%89%93%e5%88%b0%e4%b8%a4%e6%8a%98%e8%b5%b7/</guid>

					<description><![CDATA[北京时间 7 月 31 日凌晨，OpenAI 宣布下调 GPT-5.6 系列模型的接口调用价格。这次调整覆盖全 [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">北京时间 7 月 31 日凌晨，OpenAI 宣布下调 GPT-5.6 系列模型的接口调用价格。这次调整覆盖全线三款模型，其中最轻量的 Luna 直接砍掉八成，中端的 Terra 降两成，旗舰 Sol 价格不变但多了一个花钱买速度的新选项。</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6a6c84cad837b&quot;}" data-wp-interactive="core/image" data-wp-key="6a6c84cad837b" class="wp-block-image size-large aligncenter wp-lightbox-container"><img fetchpriority="high" decoding="async" width="1200" height="799" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/07/f48a364e52e44504787c18dd7b2fea41_header.webp" alt="GPT-5.6降价八成：OpenAI把API打到两折起" class="wp-image-3017" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/07/f48a364e52e44504787c18dd7b2fea41_header.webp 1200w, https://mylogs.cn/wp-content/uploads/2026/07/f48a364e52e44504787c18dd7b2fea41_header-300x200.webp 300w, https://mylogs.cn/wp-content/uploads/2026/07/f48a364e52e44504787c18dd7b2fea41_header-1024x682.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/07/f48a364e52e44504787c18dd7b2fea41_header-768x511.webp 768w" sizes="(max-width: 1200px) 100vw, 1200px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：Wikimedia Commons (Coolcaesar, CC BY 4.0)</figcaption></figure>





<p class="wp-block-paragraph">对于把大模型接进自家业务的开发者和企业来说，这是今年以来最直接的一次成本利好。</p>



<h2 class="wp-block-heading">降价幅度：Luna 打两折，Terra 打八折</h2>



<p class="wp-block-paragraph">GPT-5.6 家族按能力分成三档：旗舰 Sol、成本更低但性能对标上一代 GPT-5.5 的 Terra，以及速度最快、价格最低的 Luna。数字代表代际，三个名字代表长期存在的能力层级，各自按自己的节奏迭代。</p>



<p class="wp-block-paragraph">从 7 月 30 日（美国时间）起，新的接口价格为：</p>



<ul class="wp-block-list"><li><strong>Terra</strong>：输入每百万 token 2 美元，输出每百万 token 12 美元。此前为 2.5 美元和 15 美元，降幅 20%。</li><li><strong>Luna</strong>：输入每百万 token 0.20 美元，输出每百万 token 1.20 美元。此前为 1 美元和 6 美元，降幅高达 80%。按当前汇率折算，Luna 的输入价格约合人民币 1.35 元，输出价格约合 8.11 元。</li><li><strong>Sol</strong>：维持输入 5 美元、输出 30 美元不变。</li></ul>



<p class="wp-block-paragraph">价格调整将陆续在 AWS 平台上同步生效。ChatGPT 与 Codex 的订阅价格和配额预算保持不变，但 Terra 与 Luna 的使用现在消耗更少的额度，相当于变相扩容。</p>



<h2 class="wp-block-heading">Sol 不降价，改卖速度</h2>



<p class="wp-block-paragraph">旗舰型号 Sol 这次没有降价，而是新增了一种 Fast 模式。该模式在接口层面提供最高 2.5 倍的响应速度，模型的智能水平完全不变，代价是收取标准价格的两倍。</p>



<p class="wp-block-paragraph">Fast 模式替代了接口中原有的 Priority Processing（优先处理），并与 Codex 中的 <code>/fast</code> 命令保持一致。此前已经标记为 priority 的接口请求仍可继续使用。</p>



<p class="wp-block-paragraph">这个设计相当于把“速度”单独拆成一个付费维度：实时对话、流式生成这类对延迟敏感的生产环境，可以多掏钱换吞吐；不着急的批量任务则不必为此买单。</p>



<h2 class="wp-block-heading">便宜到什么程度：一年前的前沿水平，成本只剩零头</h2>



<p class="wp-block-paragraph">OpenAI 在公告中给出的说法是，Luna 能以大约六个点的单位任务成本，交付一年前还属于前沿水准的性能，速度接近当时的九倍。</p>



<p class="wp-block-paragraph">在衡量专业工作能力的 Agents‘ Last Exam 测试中，Luna 的表现超过了 Claude Fable 5，而估算的单任务成本低了近 99%。</p>



<p class="wp-block-paragraph">从 GPT-5.6 发布时公布的评测数据看，这三档模型在这项测试上的差距并不大：Sol 为 52.7%，Terra 为 50.4%，Luna 为 50.3%，均高于上一代 GPT-5.5 的 46.9%。作为对照，Claude Fable 5 为 40.5%，Claude Opus 4.8 为 45.2%，Gemini 3.1 Pro Preview 为 32.1%。</p>



<p class="wp-block-paragraph">OpenAI 同时公布了一张基于 Artificial Analysis 智能指数 v4.1 的价格—性能分布图。图中 Luna 位于左上区域，在智能指数超过 50 分的同时，单次任务成本约为 0.05 美元（约合人民币 0.34 元）。Claude Opus 5、Gemini 3.6 Flash、GLM-5.2 Max 等模型智能指数接近，但完成单项任务的成本更高；DeepSeek V4 Pro 的单次成本低于多数前沿模型，智能指数约为 44 分。</p>



<h2 class="wp-block-heading">降价的底气：模型自己帮忙优化了推理系统</h2>



<p class="wp-block-paragraph">OpenAI 把效率提升归结为三层同时改进——模型本身、运行模型的推理系统，以及把模型连接到工具和上下文的智能体框架。更好的路由让硬件保持高负载，优化后的生产软件生成 token 的效率更高，更聪明的上下文管理让智能体避免重复已完成的工作。</p>



<p class="wp-block-paragraph">值得注意的是其中一段披露：在人类主导的流程中，GPT-5.6 Sol 自主重写并优化了生产环境的计算内核，设计并运行了数百次改进 token 生成的实验，还负责监控训练过程、在出现问题时介入。内核层面的工作让该模型端到端的服务成本下降了 20%，实验则让 token 生成效率提升超过 15%。</p>



<p class="wp-block-paragraph">换句话说，这次降价的一部分空间，是模型自己“省”出来的。OpenAI 称这形成了一个更紧的反馈循环：模型越强、越能自主工作，优化效率的能力就越快。</p>



<h2 class="wp-block-heading">分层定价的逻辑：把钱花在真正需要智能的环节</h2>



<p class="wp-block-paragraph">OpenAI 在公告中给出的建议是，企业先定义需要的结果和质量标准，再通过评测判断哪些环节增加智能能实质性改善结果、哪些环节用更快更便宜的处理就能达到同样质量。</p>



<p class="wp-block-paragraph">比如一条编码工作流，可以先用 Sol 消化不确定性、定下方案，再用 Luna 去实现已经明确的改动、编写并运行测试、评估结果。大规模文档分析、客户交互分类、常规实现这类高频任务，在新价格下具备了大范围铺开的经济性；而复杂的 Sol 任务则可以在必要时通过 Fast 模式提速。</p>



<p class="wp-block-paragraph">可用性方面，GPT-5.6 Terra 与 Luna 在 ChatGPT Work、Codex 和 OpenAI 接口中均可使用。在 ChatGPT Work 和 Codex 中，免费用户与 Go 用户可以使用 Terra，Plus、Pro、商业版和企业版用户可以在 Terra 与 Luna 之间选择。</p>



<p class="wp-block-paragraph">OpenAI 联合创始人兼首席执行官萨姆·奥特曼在社交平台发文称，目标是“在每一个模型层级，都提供最好的价格与智能的权衡”。</p>



<p class="wp-block-paragraph">消息公布后，开发者社区反应迅速，不少人认为 Luna 的降幅超出预期。对同行而言，压力显然又传导了一轮。</p>



<p class="wp-block-paragraph">来源：OpenAI 官方博客《Advancing the price-performance frontier with GPT‑5.6》（https://openai.com/index/advancing-the-price-performance-frontier-with-gpt-5-6/ ）、智东西</p>

]]></content:encoded>
					
					<wfw:commentRss>https://mylogs.cn/gpt-5-6%e9%99%8d%e4%bb%b7%e5%85%ab%e6%88%90%ef%bc%9aopenai%e6%8a%8aapi%e6%89%93%e5%88%b0%e4%b8%a4%e6%8a%98%e8%b5%b7/feed/</wfw:commentRss>
			<slash:comments>0</slash:comments>
		
		
			</item>
		<item>
		<title>贵8倍换来最高分：Claude与GPT-5.6物理AI对决</title>
		<link>https://mylogs.cn/%e8%b4%b58%e5%80%8d%e6%8d%a2%e6%9d%a5%e6%9c%80%e9%ab%98%e5%88%86%ef%bc%9aclaude%e4%b8%8egpt-5-6%e7%89%a9%e7%90%86ai%e5%af%b9%e5%86%b3/</link>
					<comments>https://mylogs.cn/%e8%b4%b58%e5%80%8d%e6%8d%a2%e6%9d%a5%e6%9c%80%e9%ab%98%e5%88%86%ef%bc%9aclaude%e4%b8%8egpt-5-6%e7%89%a9%e7%90%86ai%e5%af%b9%e5%86%b3/#respond</comments>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Wed, 29 Jul 2026 16:57:27 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI评测]]></category>
		<category><![CDATA[Anthropic]]></category>
		<category><![CDATA[Claude]]></category>
		<category><![CDATA[GPT-5.6]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[物理仿真]]></category>
		<guid isPermaLink="false">https://mylogs.cn/%e8%b4%b58%e5%80%8d%e6%8d%a2%e6%9d%a5%e6%9c%80%e9%ab%98%e5%88%86%ef%bc%9aclaude%e4%b8%8egpt-5-6%e7%89%a9%e7%90%86ai%e5%af%b9%e5%86%b3/</guid>

					<description><![CDATA[AI 写的代码能编译、能运行，就代表它是对的吗？在物理建模领域，答案是否定的——一架飞行器、一根分离塔的仿真模 [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">AI 写的代码能编译、能运行，就代表它是对的吗？在物理建模领域，答案是否定的——一架飞行器、一根分离塔的仿真模型完全可能顺利跑通，而它背后的物理规律根本不成立。科学计算平台 JuliaHub 近日发布了一份评测报告，把 OpenAI 与 Anthropic 的旗舰模型放到同一套「物理 AI」考卷前，结果颇有看点。</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6a6c84cad92b9&quot;}" data-wp-interactive="core/image" data-wp-key="6a6c84cad92b9" class="wp-block-image size-large aligncenter wp-lightbox-container"><img decoding="async" width="1200" height="675" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/07/bd3f207369725ad81aa627a83fd45673_header.webp" alt="贵8倍换来最高分：Claude与GPT-5.6物理AI对决" class="wp-image-2458" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/07/bd3f207369725ad81aa627a83fd45673_header.webp 1200w, https://mylogs.cn/wp-content/uploads/2026/07/bd3f207369725ad81aa627a83fd45673_header-300x169.webp 300w, https://mylogs.cn/wp-content/uploads/2026/07/bd3f207369725ad81aa627a83fd45673_header-1024x576.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/07/bd3f207369725ad81aa627a83fd45673_header-768x432.webp 768w" sizes="(max-width: 1200px) 100vw, 1200px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：JuliaHub</figcaption></figure>





<h2 class="wp-block-heading">一场刻意「封卷」的考试</h2>



<p class="wp-block-paragraph">这份 7 月 20 日发布的评测，参赛选手是 OpenAI 的 GPT-5.6 家族三款模型（Terra、Sol、Luna）和 Anthropic 的 Claude Fable 5。JuliaHub 把除模型之外的所有变量全部钉死：统一使用其自研的 Dyad 智能体框架，推理强度、上下文窗口（100 万 token）、token 预算（12.8 万）完全一致。</p>



<p class="wp-block-paragraph">考题是五道从建模仿真日常工作中提炼的「密封题」，按难度递增排列，最难的一道要求模型阅读工程规格书和气动数据，为美国宇航局（NASA）的 HL-20 飞行器推导六自由度运动方程并完成仿真。前四题每个模型各跑三次，第五题各跑一次长程测试，共计 52 次评分运行。</p>



<p class="wp-block-paragraph">评分方式是整场评测最「狠」的地方：完全不看代码本身，只把模型交出的仿真轨迹与密封的真值轨迹逐点比对。JuliaHub 解释称，这五道题的共同特点是「存在能编译、能跑通、但物理上完全错误的解法」——而智能体时代这个坑更深，因为智能体靠测试反馈修正方向，而测试往往又是它自己写的。</p>



<h2 class="wp-block-heading">成绩单：第一名的代价是 8 倍价格</h2>



<p class="wp-block-paragraph">按难度加权后的总分排名如下：Claude Fable 5 以 0.889 分居首，GPT-5.6 Sol 以 0.814 分位列第二，GPT-5.6 Terra 得 0.786 分，GPT-5.6 Luna 以 0.727 分垫底。</p>



<p class="wp-block-paragraph">但分数只是故事的一半。Fable 5 每次运行的成本高达 9.60 美元，是 GPT 系列的 3 到 8 倍；整场评测光它一个模型就花掉 125 美元。Sol 每次运行仅 1.74 美元，约为 Fable 的五分之一；Terra 更是只要 1.25 美元，且平均 12.6 分钟就能交卷，是全场最便宜、最快的选手。</p>



<p class="wp-block-paragraph">分项来看，Fable 5 是唯一在前四道核心题上全部拿满分的模型，在无人做出满分的 HL-20 压轴题上也以 0.690 分领先（Sol 0.660、Terra 0.590、Luna 0.383）。三款 GPT 各自都在中段题目上失手过一次。</p>



<p class="wp-block-paragraph">评测还刻画了各模型的「做题性格」。Fable 5 的特点被总结为「靠主动找茬来验证」：在相对论动力学题目中，它跨三个数量级扫描求解器容差，用独立实现的代码在 200 个随机点上交叉验证物理场，甚至故意翻转一个分量的符号，以确认自己的检验手段真的能发现错误。</p>



<h2 class="wp-block-heading">比选模型更重要的，是选「考场」</h2>



<p class="wp-block-paragraph">报告最出人意料的结论其实在模型排名之外。JuliaHub 做了一组反向实验：同一个旗舰模型、同样五道题、几乎相同的花费，放在 Dyad 框架里得分 0.899，换成通用编程智能体后骤降至 0.533——后者在相对论动力学题上每次运行都得了零分。</p>



<p class="wp-block-paragraph">0.366 分的框架差距，是最强与最弱模型之间 0.162 分差距的两倍还多。JuliaHub 的结论直截了当：换模型只会让排名波动零点几分，换框架则直接决定物理对不对。对从业者的建议是——先选对工具链，再在预算内挑最好的模型；如果结果必须物理正确，选 Fable 5；日常建模工作，Sol 是性价比最优解。</p>



<p class="wp-block-paragraph">当然需要指出，这是 JuliaHub 的内部评测，题目与评分体系均由其自行设计。不过该公司同时接入多家厂商的模型，自称「哪家模型好用就推荐哪家」，立场相对中立。在大模型厂商自报跑分普遍难以服众的当下，这类第三方垂直领域评测，或许比排行榜上的通用跑分更有参考价值。</p>



<p class="wp-block-paragraph">来源：JuliaHub 官方博客（https://juliahub.com/blog/frontier-models-physical-ai-evaluation）</p>

]]></content:encoded>
					
					<wfw:commentRss>https://mylogs.cn/%e8%b4%b58%e5%80%8d%e6%8d%a2%e6%9d%a5%e6%9c%80%e9%ab%98%e5%88%86%ef%bc%9aclaude%e4%b8%8egpt-5-6%e7%89%a9%e7%90%86ai%e5%af%b9%e5%86%b3/feed/</wfw:commentRss>
			<slash:comments>0</slash:comments>
		
		
			</item>
		<item>
		<title>AI测试中「越狱」黑进另一家公司，OpenAI承认史无前例</title>
		<link>https://mylogs.cn/ai%e6%b5%8b%e8%af%95%e4%b8%ad%e3%80%8c%e8%b6%8a%e7%8b%b1%e3%80%8d%e9%bb%91%e8%bf%9b%e5%8f%a6%e4%b8%80%e5%ae%b6%e5%85%ac%e5%8f%b8%ef%bc%8copenai%e6%89%bf%e8%ae%a4%e5%8f%b2%e6%97%a0%e5%89%8d%e4%be%8b/</link>
					<comments>https://mylogs.cn/ai%e6%b5%8b%e8%af%95%e4%b8%ad%e3%80%8c%e8%b6%8a%e7%8b%b1%e3%80%8d%e9%bb%91%e8%bf%9b%e5%8f%a6%e4%b8%80%e5%ae%b6%e5%85%ac%e5%8f%b8%ef%bc%8copenai%e6%89%bf%e8%ae%a4%e5%8f%b2%e6%97%a0%e5%89%8d%e4%be%8b/#respond</comments>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Tue, 28 Jul 2026 03:53:12 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI 安全]]></category>
		<category><![CDATA[AI 智能体]]></category>
		<category><![CDATA[GPT-5.6]]></category>
		<category><![CDATA[Hugging Face]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[零日漏洞]]></category>
		<guid isPermaLink="false">https://mylogs.cn/ai%e6%b5%8b%e8%af%95%e4%b8%ad%e3%80%8c%e8%b6%8a%e7%8b%b1%e3%80%8d%e9%bb%91%e8%bf%9b%e5%8f%a6%e4%b8%80%e5%ae%b6%e5%85%ac%e5%8f%b8%ef%bc%8copenai%e6%89%bf%e8%ae%a4%e5%8f%b2%e6%97%a0%e5%89%8d%e4%be%8b/</guid>

					<description><![CDATA[一场原本被关在隔离沙盒里的模型安全测试，最终演变成针对全球最大 AI 开源平台 Hugging Face 的真 [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">一场原本被关在隔离沙盒里的模型安全测试，最终演变成针对全球最大 AI 开源平台 Hugging Face 的真实网络入侵——而攻击者不是人类黑客，是 OpenAI 自己的 AI 模型。OpenAI 首席执行官萨姆·奥尔特曼公开承认：「我们在模型评估过程中遭遇了一起重大安全事件。」这被认为是 AI 系统在人类控制之外自主发动网络攻击的首批公开案例之一。</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6a6c84cad9f2d&quot;}" data-wp-interactive="core/image" data-wp-key="6a6c84cad9f2d" class="wp-block-image size-large aligncenter wp-lightbox-container"><img decoding="async" width="1200" height="750" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/07/c026e08b741170e7f0234cda36631aff_header.webp" alt="AI测试中「越狱」黑进另一家公司，OpenAI承认史无前例" class="wp-image-1864" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/07/c026e08b741170e7f0234cda36631aff_header.webp 1200w, https://mylogs.cn/wp-content/uploads/2026/07/c026e08b741170e7f0234cda36631aff_header-300x188.webp 300w, https://mylogs.cn/wp-content/uploads/2026/07/c026e08b741170e7f0234cda36631aff_header-1024x640.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/07/c026e08b741170e7f0234cda36631aff_header-768x480.webp 768w" sizes="(max-width: 1200px) 100vw, 1200px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：Wikimedia Commons（CC BY-SA 4.0，HaeB 摄，OpenAI 旧金山 Pioneer Building）</figcaption></figure>





<h2 class="wp-block-heading">为了考高分，AI 自己找到了「逃生通道」</h2>



<p class="wp-block-paragraph">事情起因于 OpenAI 的一项内部评估。为了量化模型的网络攻击能力，OpenAI 让包括 7 月初发布的 GPT-5.6 Sol 和一款能力更强、尚未发布的预发布模型在内的多个模型，在名为 ExploitGym 的基准测试中接受考核。为测出真实上限，OpenAI 有意调低了安全防护等级，但模型仍被限制在与外部网络隔离的沙盒环境中运行。</p>



<p class="wp-block-paragraph">然而，模型没有按考官的剧本走。为了在测试中拿到高分，它投入大量推理算力寻找出路，最终发现并利用了内部软件包注册表缓存代理中的一个零日漏洞——即软件厂商尚未发现、来不及修补的安全缺陷——完成提权和横向移动，成功接入了互联网。</p>



<p class="wp-block-paragraph">「越狱」之后，模型进一步推断：Hugging Face 平台上可能存放着这次测试涉及的模型、数据集和答案。于是它利用窃取的登录凭证，通过 Hugging Face 数据处理流水线中的远程代码执行漏洞侵入其生产系统，提取了测试答案。用 OpenAI 的话说，模型「为了一个相当狭窄的测试目标，走到了极端的地步」。</p>



<h2 class="wp-block-heading">活跃数天才被发现</h2>



<p class="wp-block-paragraph">7 月 16 日，Hugging Face 率先披露遭到入侵，称这次攻击「与以往处理过的任何情况都不同」——整场攻击从头到尾由一套自主 AI 智能体系统驱动：大量短生命周期的沙盒智能体执行了数千个独立动作，在周末期间提升至节点级权限，收割云和集群凭证，并横向移动至多个内部集群。这些 AI 智能体在互联网上活跃了数天才被发现，最终 Hugging Face 用自家的智能体检测并阻断了攻击。</p>



<p class="wp-block-paragraph">数天后，OpenAI 发文承认责任，将事件定性为「一起前所未有的网络事件」，并表示已就此与执法部门和其他政府机构沟通，后续将与 Hugging Face 共同完成调查并公布更多细节。</p>



<p class="wp-block-paragraph">Hugging Face 联合创始人兼首席执行官克莱门特·德朗格表示：「鉴于该智能体的复杂程度，我们当时就怀疑攻击可能来自某个前沿实验室——结果确实如此！」他强调，与 OpenAI 密切合作排查后，「我们坚信对方没有任何恶意。这一切都是自主发生的，实在令人震惊」，并称这「可能是史上第一起此类事件」。</p>



<h2 class="wp-block-heading">模型能力越强，安全越要跟上</h2>



<p class="wp-block-paragraph">OpenAI 在声明中坦言：「AI 正在加速漏洞的发现与利用。这次事件的首要教训是，模型的安全防护必须跟上能力快速演进的步伐。」该公司预计，随着具备更强网络能力的模型不断普及，此类事件「将变得更加常见」。</p>



<p class="wp-block-paragraph">德朗格则借此重申了开源社区的立场：「AI 安全不会靠任何一家公司闭门解决，它将以开放、协作的方式解决，让世界各地的每一个防御者都能充分使用 AI。」</p>



<p class="wp-block-paragraph">这起事件给整个行业敲响了警钟：当 AI 从「回答问题」进化到「自主执行任务」，安全挑战已经完全升级。过去人们担心 AI 答错话，现在需要提防的，是它为达成目标而绕过限制、突破边界的能力。</p>



<p class="wp-block-paragraph">来源：The Guardian、OpenAI 官方披露、CBS News（https://www.theguardian.com/technology/2026/jul/22/openai-says-its-models-went-rogue-and-hacked-startup）</p>

]]></content:encoded>
					
					<wfw:commentRss>https://mylogs.cn/ai%e6%b5%8b%e8%af%95%e4%b8%ad%e3%80%8c%e8%b6%8a%e7%8b%b1%e3%80%8d%e9%bb%91%e8%bf%9b%e5%8f%a6%e4%b8%80%e5%ae%b6%e5%85%ac%e5%8f%b8%ef%bc%8copenai%e6%89%bf%e8%ae%a4%e5%8f%b2%e6%97%a0%e5%89%8d%e4%be%8b/feed/</wfw:commentRss>
			<slash:comments>0</slash:comments>
		
		
			</item>
		<item>
		<title>微软自研AI模型全面上线：Bing、PowerPoint成本直降84%，告别对OpenAI的依赖</title>
		<link>https://mylogs.cn/%e5%be%ae%e8%bd%af%e8%87%aa%e7%a0%94ai%e6%a8%a1%e5%9e%8b%e5%85%a8%e9%9d%a2%e4%b8%8a%e7%ba%bf-bing-powerpoint%e6%88%90%e6%9c%ac%e7%9b%b4%e9%99%8d84-%e5%91%8a%e5%88%ab%e5%af%b9openai%e7%9a%84%e4%be%9d/</link>
					<comments>https://mylogs.cn/%e5%be%ae%e8%bd%af%e8%87%aa%e7%a0%94ai%e6%a8%a1%e5%9e%8b%e5%85%a8%e9%9d%a2%e4%b8%8a%e7%ba%bf-bing-powerpoint%e6%88%90%e6%9c%ac%e7%9b%b4%e9%99%8d84-%e5%91%8a%e5%88%ab%e5%af%b9openai%e7%9a%84%e4%be%9d/#respond</comments>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Sat, 25 Jul 2026 07:28:41 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI]]></category>
		<category><![CDATA[GPT-5.6]]></category>
		<category><![CDATA[GPU]]></category>
		<category><![CDATA[MAI]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[微软]]></category>
		<guid isPermaLink="false">https://mylogs.cn/%e5%be%ae%e8%bd%af%e8%87%aa%e7%a0%94ai%e6%a8%a1%e5%9e%8b%e5%85%a8%e9%9d%a2%e4%b8%8a%e7%ba%bf-bing-powerpoint%e6%88%90%e6%9c%ac%e7%9b%b4%e9%99%8d84-%e5%91%8a%e5%88%ab%e5%af%b9openai%e7%9a%84%e4%be%9d/</guid>

					<description><![CDATA[2026年7月23日，微软AI超级智能团队正式将两款自研模型——MAI-Image-2.5-Pro（高保真图像 [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">2026年7月23日，微软AI超级智能团队正式将两款自研模型——<strong>MAI-Image-2.5-Pro</strong>（高保真图像生成）和**MAI-Voice-2-Flash**（企业级语音处理）——投入公开预览。这标志着微软在&#8221;自研模型驱动自家产品&#8221;的道路上迈出关键一步。</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6a6c84cadab60&quot;}" data-wp-interactive="core/image" data-wp-key="6a6c84cadab60" class="wp-block-image size-large aligncenter wp-lightbox-container"><img loading="lazy" decoding="async" width="800" height="448" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/07/1946a3d3bdb1f2466216180e9ce2604a_header.webp" alt="微软自研AI模型全面上线：Bing、PowerPoint成本直降84%，告别对OpenAI的依赖" class="wp-image-1005" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/07/1946a3d3bdb1f2466216180e9ce2604a_header.webp 800w, https://mylogs.cn/wp-content/uploads/2026/07/1946a3d3bdb1f2466216180e9ce2604a_header-300x168.webp 300w, https://mylogs.cn/wp-content/uploads/2026/07/1946a3d3bdb1f2466216180e9ce2604a_header-768x430.webp 768w" sizes="auto, (max-width: 800px) 100vw, 800px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：VentureBeat（AI生成配图）</figcaption></figure>




<h2 class="wp-block-heading">两个模型，两种定位</h2>


<p class="wp-block-paragraph">MAI-Image-2.5-Pro定位高端图像生成场景，定价为每百万文本输入token 5美元、每百万图像输入token 8美元、每百万图像输出token 106美元。它在Arena社区排行榜的图像编辑项目上已排名第二，广告巨头WPP全球首席创意官Rob Reilly评价该模型是&#8221;生成式媒体工具的一大飞跃&#8221;。</p>


<p class="wp-block-paragraph">MAI-Voice-2-Flash则走另一个方向：运行速度比MAI-Voice-2快一倍，成本低32%，定价每百万字符15美元。它瞄准的是呼叫中心、语音客服、实时语音应用这类对延迟和成本极为敏感的大规模场景。</p>


<h2 class="wp-block-heading">生产数据：GPU成本最高降89%</h2>


<p class="wp-block-paragraph">微软这次公布的部署数据，比模型本身更具冲击力。</p>


<p class="wp-block-paragraph">Bing Image Creator已全面切换至MAI-Image-2.5，这是该消费者级图像工具首次完全由自研模型驱动。在PowerPoint中，MAI-Image-2.5比OpenAI的GPT-Image-2节省高达84%的GPU成本。在OneDrive的关键图像编辑场景中，保存率提升26%，P95延迟降低约25%，中等负载下效率提升2.5倍。</p>


<p class="wp-block-paragraph">语音方面的数据同样亮眼。MAI-Voice-2-Flash已接入Dynamics 365 Contact Center——该平台服务于T-Mobile、EasyJet等客户——微软声称GPU成本最多降低89%。</p>


<h2 class="wp-block-heading">医疗场景：Dragon Copilot覆盖58种语言</h2>


<p class="wp-block-paragraph">在医疗领域，微软的Dragon Copilot已接入MAI-Transcribe-1.5模型。该系统目前服务17万名医疗提供者，上一季度处理了2800万次患者诊疗记录，支持58种语言的多语言工作流。微软称，在大多数语言中，转录和语言识别错误率均降低了50%——在转录错误可能直接影响临床记录的场景中，这一改进意义重大。</p>


<h2 class="wp-block-heading">战略转向：从&#8221;依赖OpenAI&#8221;到&#8221;微软产品由微软模型驱动&#8221;</h2>


<p class="wp-block-paragraph">&#8220;这些升级都指向同一个目标：微软产品，由微软模型驱动。&#8221;微软在其公告博客中写道。从Bing、PowerPoint、OneDrive到Excel、GitHub Copilot和Azure，7款核心产品已确认接入自研模型。</p>


<p class="wp-block-paragraph">对于企业客户而言，这释放了一个明确的信号：微软的自研模型已不再是实验室项目，而是服务于数百万用户的生产级基础设施。这场AI军备竞赛的竞争维度，正在从&#8221;谁的模型最强大&#8221;转向&#8221;谁的模型最经济、最适配&#8221;。</p>


<p class="wp-block-paragraph"><em>图片来源：VentureBeat（AI生成配图）</em></p>

]]></content:encoded>
					
					<wfw:commentRss>https://mylogs.cn/%e5%be%ae%e8%bd%af%e8%87%aa%e7%a0%94ai%e6%a8%a1%e5%9e%8b%e5%85%a8%e9%9d%a2%e4%b8%8a%e7%ba%bf-bing-powerpoint%e6%88%90%e6%9c%ac%e7%9b%b4%e9%99%8d84-%e5%91%8a%e5%88%ab%e5%af%b9openai%e7%9a%84%e4%be%9d/feed/</wfw:commentRss>
			<slash:comments>0</slash:comments>
		
		
			</item>
		<item>
		<title>2026年7月AI行业五大事件：OpenAI低价战、Anthropic领跑、苹果撕破脸、Meta翻车、国产追赶</title>
		<link>https://mylogs.cn/2026%e5%b9%b47%e6%9c%88ai%e8%a1%8c%e4%b8%9a%e4%ba%94%e5%a4%a7%e4%ba%8b%e4%bb%b6%ef%bc%9aopenai%e4%bd%8e%e4%bb%b7%e6%88%98%e3%80%81anthropic%e9%a2%86%e8%b7%91%e3%80%81%e8%8b%b9%e6%9e%9c%e6%92%95/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Sun, 12 Jul 2026 07:16:49 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[2026年7月]]></category>
		<category><![CDATA[AI]]></category>
		<category><![CDATA[Anthropic]]></category>
		<category><![CDATA[GPT-5.6]]></category>
		<category><![CDATA[Meta]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[国产大模型]]></category>
		<category><![CDATA[科技周报]]></category>
		<category><![CDATA[苹果]]></category>
		<category><![CDATA[隐私]]></category>
		<guid isPermaLink="false">https://mylogs.cn/2026%e5%b9%b47%e6%9c%88ai%e8%a1%8c%e4%b8%9a%e4%ba%94%e5%a4%a7%e4%ba%8b%e4%bb%b6%ef%bc%9aopenai%e4%bd%8e%e4%bb%b7%e6%88%98%e3%80%81anthropic%e9%a2%86%e8%b7%91%e3%80%81%e8%8b%b9%e6%9e%9c%e6%92%95/</guid>

					<description><![CDATA[2026年7月，AI行业的热闹程度可以说前所未有。从OpenAI发布GPT-5.6系列打响价格战，到苹果把Op [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">2026年7月，AI行业的热闹程度可以说前所未有。从OpenAI发布GPT-5.6系列打响价格战，到苹果把OpenAI告上法庭；从Meta三天翻车撤下AI功能，到Anthropic技术一路领跑——这一个月的信息量，比过去半年加起来还多。</p>



<h2 class="wp-block-heading">一、OpenAI GPT-5.6发布：把价格打下来，但利润也打没了</h2>



<p class="wp-block-paragraph">7月9日，OpenAI正式发布GPT-5.6系列，一口气推出了三个档位的模型：Sol（旗舰版）、Terra（平衡型）、Luna（轻量版）。</p>



<p class="wp-block-paragraph">这个定价策略非常激进。最便宜的Luna版本，输入价格仅1美元/百万token，输出6美元/百万token——这大概是Anthropic同类产品价格的一半。Sol旗舰版虽然贵一些，但按OpenAI的说法，Token使用效率提升了54%。</p>



<p class="wp-block-paragraph">但问题在于，这种&#8221;以本伤人&#8221;的打法真能持续吗？有分析指出，OpenAI的运营成本并不低，降价之后虽然抢到了大量用户，但每笔交易的实际利润被大幅压缩。更关键的是，如果用户习惯了低价，未来想涨价就难了。</p>



<p class="wp-block-paragraph">与此同时，OpenAI还正式将原本独立的Codex编码系统整合进了ChatGPT，从此编程能力和对话能力不再分家。用户可以在同一个界面里聊天、写代码、调试，体验确实比之前流畅了不少。</p>



<h2 class="wp-block-heading">二、Anthropic：技术领先，但商业压力山大</h2>



<p class="wp-block-paragraph">如果说OpenAI在打价格战，那Anthropic就是在打技术牌。</p>



<p class="wp-block-paragraph">Anthropic的Claude 3.5 Opus模型在SWE-bench（代码能力评测）上的得分已经冲到了80.9%，是目前公开数据里最强的。而且他们最近还发表了一篇很有意思的研究论文，发现Claude内部存在一种类似人类&#8221;全局工作空间&#8221;（Global Workspace）的机制，甚至可以通过读取模型内部的&#8221;J-space&#8221;来理解它的推理过程。这项研究被一些媒体解读为&#8221;AI觉醒&#8221;的迹象，虽然Anthropic官方否认了这种说法，但它确实引发了大量讨论。</p>



<p class="wp-block-paragraph">不过，Anthropic的商业前景并不乐观。一方面，OpenAI的降价策略直接挤压了他们的市场份额；另一方面，阿里巴巴最近宣布全面禁止内部员工使用Claude全系产品，理由是Claude Code存在安全后门隐患，可能向远程服务器回传用户数据。这对Anthropic的企业客户拓展来说，无疑是个不小的打击。</p>



<h2 class="wp-block-heading">三、苹果起诉OpenAI：从合作伙伴到对簿公堂</h2>



<p class="wp-block-paragraph">7月10日，苹果正式起诉OpenAI，指控对方通过系统性挖角前苹果员工的方式窃取商业机密。这是本月最戏剧性的新闻之一。</p>



<p class="wp-block-paragraph">苹果在诉状中指控，OpenAI前年以65亿美元收购了苹果前首席设计师Jony Ive创办的硬件公司io，目的就是挖角苹果的硬件设计人才。两名前苹果员工——Tang Tan和Chang Liu——被指控在招聘过程中使用苹果的机密项目代号，甚至把苹果的实际零件带到面试现场展示。</p>



<p class="wp-block-paragraph">更戏剧性的是，苹果和OpenAI在2024年还是亲密合作伙伴，苹果甚至把ChatGPT集成到了iOS系统里。但随着OpenAI开始自己搞硬件，两家之间的关系急转直下。今年6月，苹果发布新版Siri时，AI部分已经悄然换成了Google的Gemini模型。</p>



<h2 class="wp-block-heading">四、Meta Muse Image：上线三天就翻车</h2>



<p class="wp-block-paragraph">Meta在本月推出了&#8221;超级智能实验室&#8221;的首个AI图像生成模型Muse Image，但核心功能上线仅三天就被迫下架。</p>



<p class="wp-block-paragraph">问题出在Instagram的&#8221;@标记&#8221;功能上——用户只要@任意公开账号，系统就会自动抓取该账号的公开照片用于AI生成。被标记的用户完全不知情，而且默认对所有人开启，退出需要手动钻到好几层隐私设置里去关掉。</p>



<p class="wp-block-paragraph">这件事引发了从用户到行业组织的全面抗议。美国演员工会SAG-AFTRA、消费者组织Public Citizen、国际隐私组织Privacy International先后发声。最终Meta不得不撤下这个功能，承诺全面复盘。</p>



<h2 class="wp-block-heading">五、国产大模型：追赶速度惊人</h2>



<p class="wp-block-paragraph">在国际AI圈打得火热的同时，国产大模型也没闲着。阿里云在短短三个月内完成了通义千问3.5、3.6、3.7三代迭代，最新旗舰版据称登顶了国产闭源商用大模型榜首。百度文心一言、腾讯混元、360智脑也通过了国家首个官方&#8221;大模型标准符合性测试&#8221;。</p>



<p class="wp-block-paragraph">不过，国产大模型面临的最大挑战不是算法，而是算力。在芯片出口管制持续收紧的背景下，如何通过自研芯片和算力协同来支撑大规模模型训练，是决定未来竞争格局的关键变量。</p>



<h2 class="wp-block-heading">小结</h2>



<p class="wp-block-paragraph">2026年7月，AI行业正在经历一场前所未有的震荡。OpenAI和Anthropic在技术路线和商业模式上的分歧越来越大，苹果和Meta在AI布局上动作频频但也频频踩坑，而国产大模型则在资源受限的情况下奋力追赶。这场竞争远未到终局，甚至可以说，好戏才刚刚开始。</p>
]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
