<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>AI 编程 &#8211; mylogs.cn</title>
	<atom:link href="https://mylogs.cn/tag/ai-%e7%bc%96%e7%a8%8b/feed/" rel="self" type="application/rss+xml" />
	<link>https://mylogs.cn</link>
	<description>发现、记录、分享</description>
	<lastBuildDate>Sat, 12 Sep 2026 15:26:15 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	
	<item>
		<title>Claude Code 之父：开发者该守住的是代码质量</title>
		<link>https://mylogs.cn/claude-code-%e4%b9%8b%e7%88%b6%ef%bc%9a%e5%bc%80%e5%8f%91%e8%80%85%e8%af%a5%e5%ae%88%e4%bd%8f%e7%9a%84%e6%98%af%e4%bb%a3%e7%a0%81%e8%b4%a8%e9%87%8f/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Sat, 12 Sep 2026 15:26:15 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI 工具]]></category>
		<category><![CDATA[AI 编程]]></category>
		<category><![CDATA[Anthropic]]></category>
		<category><![CDATA[Claude Code]]></category>
		<category><![CDATA[代码质量]]></category>
		<category><![CDATA[氛围编程]]></category>
		<category><![CDATA[鲍里斯·切尔尼]]></category>
		<guid isPermaLink="false">https://mylogs.cn/claude-code-%e4%b9%8b%e7%88%b6%ef%bc%9a%e5%bc%80%e5%8f%91%e8%80%85%e8%af%a5%e5%ae%88%e4%bd%8f%e7%9a%84%e6%98%af%e4%bb%a3%e7%a0%81%e8%b4%a8%e9%87%8f/</guid>

					<description><![CDATA[据《商业内幕》报道，随着 AI 彻底改变软件开发，Anthropic 旗下 Claude Code 的创作者鲍 [&#8230;]]]></description>
										<content:encoded><![CDATA[<p class="wp-block-paragraph">据《商业内幕》报道，随着 AI 彻底改变软件开发，Anthropic 旗下 Claude Code 的创作者鲍里斯·切尔尼（Boris Cherny）认为，开发者真正需要守住的，不再是亲手写下的每一行代码，而是代码质量本身。</p>
<h2 class="wp-block-heading">一封关于&#8221;AI 垃圾代码&#8221;的来信</h2>
<p class="wp-block-paragraph">当地时间 9 月 10 日，切尔尼在 X 平台上公开了一封开发者写给他的邮件，标题直白地写着&#8221;怎么处理 AI 垃圾代码？&#8221;。他透露，自己几乎每天都会收到类似来信，并尽量多作回复。</p>
<p class="wp-block-paragraph">这位匿名开发者把 AI 编程带来的&#8221;摩擦&#8221;归纳为两种截然不同的做法，请切尔尼判断哪一种更合理。第一种相对克制：仍像从前一样写代码，只是用 AI 加速，未必逐行审查，但代码必须经得起审查，提交者要能解释自己提交了什么，且代码对人类维护者而言至少不比以前更难。第二种则更放任，也就是当下流行的&#8221;氛围编程&#8221;（vibe coding）思路：把代码当黑箱，不关心内部实现，只看最终输出。</p>
<p class="wp-block-paragraph">来信者也坦言，不少人其实做不到第一种，却又担心因此失去工作，&#8221;很多人只是在硬着头皮用 AI&#8221;。</p>
<h2 class="wp-block-heading">原型可黑箱，生产代码标准更高</h2>
<p class="wp-block-paragraph">切尔尼完整公开了自己的回复，并指出两种做法并非只能二选一，各自都有合适场景。对于&#8221;只管结果、不管代码&#8221;的做法，他认为原型和一次性代码完全可以当成黑箱——反正最终会被丢弃，只要出问题的影响范围不大，就没必要追求完美。</p>
<p class="wp-block-paragraph">真正进入生产环境的代码则完全不同。切尔尼写道，Claude 写出的生产代码，标准应当比人类写的更高。他在文中列举了 Anthropic 内部设置的多道防护机制：大量代码规范检查规则与测试、Claude 驱动的端到端测试、每天运行的模糊测试工具，以及自动代码审查、安全审查和自动代码重构。他提醒，缺少这些措施，代码库很容易逐渐变成难以维护的烂摊子；好消息是模型能力越强，把这些日常流程跑顺也越容易，例如每天固定跑几套流程，或使用 Claude Code Review。</p>
<h2 class="wp-block-heading">开发者的新角色：mini CEO</h2>
<p class="wp-block-paragraph">切尔尼的核心观点是，开发者的真正职责在于&#8221;守住代码质量标准&#8221;。AI 行业有人把这种新角色称为&#8221;mini CEO&#8221;——开发者更像一名管理者，需要判断什么代码能进入系统，什么代码应当当场拦下。</p>
<p class="wp-block-paragraph">如果上述办法仍解决不了问题，切尔尼还给了三条退路：更直接地介入 Claude 的工作过程、让它重写整个代码库，或者干脆&#8221;等下一个模型&#8221;。在 AI 接管大量编码工作的趋势下，如何为代码质量设下闸门，正成为工程师价值所在的新焦点。</p>]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>差 0.9 分、便宜 64%：Cognition 新编码模型 SWE-2 值不值得换</title>
		<link>https://mylogs.cn/%e5%b7%ae-0-9-%e5%88%86%e3%80%81%e4%be%bf%e5%ae%9c-64%ef%bc%9acognition-%e6%96%b0%e7%bc%96%e7%a0%81%e6%a8%a1%e5%9e%8b-swe-2-%e5%80%bc%e4%b8%8d%e5%80%bc%e5%be%97%e6%8d%a2/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Fri, 11 Sep 2026 17:11:02 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI 编程]]></category>
		<category><![CDATA[Cognition]]></category>
		<category><![CDATA[Devin]]></category>
		<category><![CDATA[FrontierCode]]></category>
		<category><![CDATA[Kimi K3]]></category>
		<category><![CDATA[SWE-2]]></category>
		<category><![CDATA[编码智能体]]></category>
		<guid isPermaLink="false">https://mylogs.cn/%e5%b7%ae-0-9-%e5%88%86%e3%80%81%e4%be%bf%e5%ae%9c-64%ef%bc%9acognition-%e6%96%b0%e7%bc%96%e7%a0%81%e6%a8%a1%e5%9e%8b-swe-2-%e5%80%bc%e4%b8%8d%e5%80%bc%e5%be%97%e6%8d%a2/</guid>

					<description><![CDATA[做 Devin 的公司 Cognition 在 9 月 10 日发布了新的编码模型 SWE-2，同时把它接入  [&#8230;]]]></description>
										<content:encoded><![CDATA[<p class="wp-block-paragraph">做 Devin 的公司 Cognition 在 9 月 10 日发布了新的编码模型 SWE-2，同时把它接入 Devin Desktop、Devin CLI、Devin Web 与 Devin Fusion。官方给这次更新的定位很直接：接近前沿的能力，只要一部分价钱。</p>
<h2 class="wp-block-heading">分数差一点，价格差一大截</h2>
<p class="wp-block-paragraph">在 Cognition 自己的 FrontierCode 1.1 Main 基准上——这套基准考察的是 AI 写的拉取请求是否真会被人类维护者合并——SWE-2 拿到 50.0%。同一测试中，Anthropic 的 Fable 5.1 为 50.9%，OpenAI 的 GPT-6 Astra 为 53.3%，xAI 的 Grok 4.6 为 48.0%，而 Cognition 的上一代 SWE-1.7 为 42.0%。</p>
<p class="wp-block-paragraph">也就是说，SWE-2 与 Fable 5.1 只差 0.9 分。Cognition 称，达到这个分数的计算成本比 Fable 5.1 低 64%，部分媒体把多个基准上的节省概括为&#8221;最多 70%&#8221;。</p>
<p class="wp-block-paragraph">值得注意的是，SWE-2 是在月之暗面的开源模型 Kimi K3 基础上后训练而来，Kimi K3 的参数规模为 2.8 万亿。Cognition 同时表示，这是首次把强化学习扩展到数万亿参数规模。</p>
<h2 class="wp-block-heading">便宜的原因：少走弯路</h2>
<p class="wp-block-paragraph">SWE-2 是 Cognition 首个支持&#8221;投入档位&#8221;的模型，提供 medium、high、max 三档，让使用者按任务难度在成本与智能之间取舍，且三档是在同一次强化学习训练中端到端训出来的，而不是分别训练再拼装。</p>
<p class="wp-block-paragraph">效率上的变化相当明显。在 FrontierCode 1.1 Main 上，SWE-2 的 medium 档得分高于 SWE-1.7，同时平均少用 58% 的轮次、成本低 81%。更直观的一个数字是：SWE-2 medium 在中位数 18 步之后就做出第一次实质性代码修改，而 SWE-1.7 需要 48 步。</p>
<p class="wp-block-paragraph">原因并不神秘。SWE-1.7 习惯先把代码库翻个底朝天再动手，这在难题上是优势，在简单任务上就成了过度探索。SWE-2 判断力更强，能更早分辨哪部分代码与当前任务真正相关，于是更快进入实现阶段。按官方说法，最大的效率提升来自&#8221;聚焦式探索&#8221;。</p>
<p class="wp-block-paragraph">Cognition 还列出了几条内部测试中观察到的行为差异：SWE-2 更擅长写端到端覆盖的测试，更能抓到回归和边界情况；在常规路径被堵住时更愿意换一条路走，比如某次所需的 MCP 集成不可用，它转而从已获得的 Slack 频道记录里重建了数据；在被质疑时倾向于重新推导结论而不是重复原来的说法。三档之间的风格也有区别，medium 上手快、适合中低难度任务，high 和 max 在复杂任务上规划更多、验证更充分。</p>
<h2 class="wp-block-heading">但硬骨头上还是被拉开</h2>
<p class="wp-block-paragraph">如果只看上面这些数字，SWE-2 像是一次全面胜利。但 Cognition 在自己的发布里也放出了不利的一面：在难度更高的智能体基准 Terminal-Bench 4 上，SWE-2 只拿到 27.3%，而 Fable 5.1 为 55.8%，GPT-6 Astra 为 57.9%。这不是四舍五入能抹平的差距，它说明 SWE-2 的成本优势在日常编码任务上成立，在最难的智能体任务上还撑不住。</p>
<h2 class="wp-block-heading">怎么用、多少钱</h2>
<p class="wp-block-paragraph">Cognition 这次没有单独开放 API，也没有公布价格表或模型权重，而是把 SWE-2 直接并入了 Devin 现有的订阅：Pro 及以上档位可以无限使用，起步价每月 20 美元。现有的 Pro、Max 与 Teams 订阅用户有一个月的窗口期，其间 SWE-2 的用量完全不计入配额。</p>
<p class="wp-block-paragraph">还有一点需要说明：上述所有分数与成本对比都由 Cognition 自行报告，FrontierCode 也是该公司自己的基准，&#8221;首次将强化学习扩展到数万亿参数&#8221;同样是未经独立验证的说法。对正在 Cursor、GitHub Copilot 与各类编码智能体之间做选择的团队来说，判断依据最终还是要看它在真实代码库里交出来的东西需不需要重写。</p>
<p class="wp-block-paragraph">图片来源：Cognition 官方博客</p>]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>AI 一小时复刻 Windows 3.1：Win11 和 Mac 都能跑</title>
		<link>https://mylogs.cn/ai-%e4%b8%80%e5%b0%8f%e6%97%b6%e5%a4%8d%e5%88%bb-windows-3-1%ef%bc%9awin11-%e5%92%8c-mac-%e9%83%bd%e8%83%bd%e8%b7%91/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Thu, 10 Sep 2026 12:03:21 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI 编程]]></category>
		<category><![CDATA[Claude]]></category>
		<category><![CDATA[GitHub]]></category>
		<category><![CDATA[Windows]]></category>
		<category><![CDATA[复古计算]]></category>
		<category><![CDATA[开源项目]]></category>
		<category><![CDATA[氛围编程]]></category>
		<guid isPermaLink="false">https://mylogs.cn/ai-%e4%b8%80%e5%b0%8f%e6%97%b6%e5%a4%8d%e5%88%bb-windows-3-1%ef%bc%9awin11-%e5%92%8c-mac-%e9%83%bd%e8%83%bd%e8%b7%91/</guid>

					<description><![CDATA[想在 Windows 11 或者 macOS 上快速回味一把上世纪 90 年代的桌面？一位开发者用 AI 给出 [&#8230;]]]></description>
										<content:encoded><![CDATA[<p class="wp-block-paragraph">想在 Windows 11 或者 macOS 上快速回味一把上世纪 90 年代的桌面？一位开发者用 AI 给出的答案，只花了一个小时。</p>
<p class="wp-block-paragraph">开发者 Mayuki 近日发布了一个名为 ReProgman 的怀旧小项目，名字源自 Windows 3.1 时代的核心系统外壳程序&#8221;progman.exe&#8221;。这个程序管理器在 Windows 95 问世后便彻底退出历史舞台，距今已有三十年。</p>
<figure data-wp-context="{&quot;imageId&quot;:&quot;6aa6e027dd19f&quot;}" data-wp-interactive="core/image" data-wp-key="6aa6e027dd19f" class="wp-block-image size-large wp-lightbox-container"><img decoding="async" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/09/r20_02_header.webp" alt="ReProgman 运行界面"/><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：IT之家</figcaption></figure>
<h2 class="wp-block-heading">一小时出初版，还原度是最大卖点</h2>
<p class="wp-block-paragraph">在发布 ReProgman 的社交动态里，Mayuki 写道，自己让 Claude 做了一个 Windows 3.1 程序管理器的复刻版，并调侃&#8221;大概能对着它怀旧个 30 秒&#8221;。</p>
<p class="wp-block-paragraph">据介绍，Claude Code 生成这款 Windows 3.1 外壳复刻版的速度相当快，仅用约一小时产出的初版&#8221;效果已经不错&#8221;，不过后续仍需要花些功夫打磨细节、修复问题。Mayuki 自己也承认，实际用 ReProgman 操作大概半分钟就会觉得没意思——这本来就是个氛围感项目，不是生产力工具。</p>
<p class="wp-block-paragraph">从工程角度看，真正值得注意的是它跨平台的完成度：ReProgman 同时支持 Windows 11 与搭载 Apple 芯片的 macOS，外观精准还原了当年 progman.exe 的窗口风格，用户可以沿用复古逻辑浏览当前系统里的程序和文件。</p>
<h2 class="wp-block-heading">12 到 16MB，绿色免安装</h2>
<p class="wp-block-paragraph">面向普通用户的 ReProgman 正式版体积在 12 到 16MB 之间，属于典型的绿色免安装工具，下载后点开即可运行，无需安装流程。</p>
<p class="wp-block-paragraph">需要注意的是，编译和运行这款程序要求系统中安装有 .NET SDK 10.0 或更高版本；只想直接运行成品的用户则不受此限制。项目代码已经在 GitHub 上以 MIT 开源协议发布。</p>
<figure data-wp-context="{&quot;imageId&quot;:&quot;6aa6e027dd42e&quot;}" data-wp-interactive="core/image" data-wp-key="6aa6e027dd42e" class="wp-block-image size-large wp-lightbox-container"><img decoding="async" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/09/r20_02_inner1.webp" alt="ReProgman 界面细节"/><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：IT之家</figcaption></figure>
<h2 class="wp-block-heading">一小时做外壳，意味着什么</h2>
<p class="wp-block-paragraph">一个熟练开发者手写跨平台的桌面外壳复刻版，通常需要处理窗口绘制、图标排布、文件关联、跨平台图形栈适配等一系列琐碎工作，很难在一小时内成型。氛围编程（vibe coding）把这部分试错成本压到了极低——先让模型产出可运行骨架，人再把精力放在细节打磨上，这已经成为个人小项目里相当常见的做法。</p>
<p class="wp-block-paragraph">当然，也有人持不同意见：要体验复古计算的乐趣，不如在真实硬件上运行原汁原味的 MS-DOS 与 Windows 3.1 组合。今年 4 月，就有技术爱好者在搭载锐龙 9 9900X 处理器与 RTX 5060 Ti 显卡的现代硬件上，以裸机模式成功运行了 Windows 3.1X。</p>
<p class="wp-block-paragraph">两种路径并不冲突。一个追求的是&#8221;像不像&#8221;，一个追求的是&#8221;是不是&#8221;。对于只想找回当年那个窗口观感的大多数人来说，一个 12MB 的免安装小工具，显然比翻出一台老机器要现实得多。</p>]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>蚂蚁开源百灵视觉大模型：图片转网页得分超 GPT-5.4</title>
		<link>https://mylogs.cn/%e8%9a%82%e8%9a%81%e5%bc%80%e6%ba%90%e7%99%be%e7%81%b5%e8%a7%86%e8%a7%89%e5%a4%a7%e6%a8%a1%e5%9e%8b%ef%bc%9a%e5%9b%be%e7%89%87%e8%bd%ac%e7%bd%91%e9%a1%b5%e5%be%97%e5%88%86%e8%b6%85-gpt-5-4/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Wed, 09 Sep 2026 22:45:47 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI 编程]]></category>
		<category><![CDATA[Ling-3.0-flash-VL]]></category>
		<category><![CDATA[多模态]]></category>
		<category><![CDATA[开源模型]]></category>
		<category><![CDATA[百灵大模型]]></category>
		<category><![CDATA[蚂蚁集团]]></category>
		<category><![CDATA[视觉 Agent]]></category>
		<guid isPermaLink="false">https://mylogs.cn/%e8%9a%82%e8%9a%81%e5%bc%80%e6%ba%90%e7%99%be%e7%81%b5%e8%a7%86%e8%a7%89%e5%a4%a7%e6%a8%a1%e5%9e%8b%ef%bc%9a%e5%9b%be%e7%89%87%e8%bd%ac%e7%bd%91%e9%a1%b5%e5%be%97%e5%88%86%e8%b6%85-gpt-5-4/</guid>

					<description><![CDATA[9 月 9 日，蚂蚁集团宣布推出并开源百灵（Ling）系列首个原生多模态大模型 Ling-3.0-flash- [&#8230;]]]></description>
										<content:encoded><![CDATA[<p class="wp-block-paragraph">9 月 9 日，蚂蚁集团宣布推出并开源百灵（Ling）系列首个原生多模态大模型 Ling-3.0-flash-VL。该模型基于 Ling-3.0-flash 的 MoE（混合专家）架构扩展而来，总参数量为 124B，单次推理仅激活 5.5B 参数，原生支持图像、文本与视频输入，上下文窗口达到 256K Token。</p>
<p class="wp-block-paragraph">与常见的&#8221;语言模型外挂视觉模块&#8221;方案不同，Ling-3.0-flash-VL 从训练阶段就采用图文视频联合训练。模型引入任意分辨率视觉编码器与 VideoRoPE，语言主干沿用 42 层混合架构，KDA 与 Gated MLA 按 5:1 比例交替排列。在保持单次激活 5.5B 参数的小算力开销的同时，模型可在实时视频对话、多轮视觉交互和长时任务中保持低延迟响应。</p>
<h2 class="wp-block-heading">视觉能力加入后，文本智能不降反升</h2>
<p class="wp-block-paragraph">业界长期存在一个担忧：给大模型加上视觉能力，会稀释甚至拉低它的文本智能。蚂蚁集团的训练实践给出了相反的结论——原生多模态联合训练不仅拓展了应用边界，还拉升了文本表现。</p>
<p class="wp-block-paragraph">在 Artificial Analysis Intelligence Index v4.1.1 评估中，Ling-3.0-flash-VL 较纯文本版本 Ling-3.0-Flash 提升了 4 分。官方解释称，来自图像和视频的信息帮助模型建立了对概念、空间和现实世界更完整的理解，视觉并不只是一种新的输入模态。</p>
<figure data-wp-context="{&quot;imageId&quot;:&quot;6aa6e027ddf01&quot;}" data-wp-interactive="core/image" data-wp-key="6aa6e027ddf01" class="wp-block-image size-large wp-lightbox-container"><img decoding="async" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/09/b7e4a9c2d1f84350ae62c8d5f3a1b904_ith1.webp" alt="Ling-3.0-flash-VL 在多项多模态评测中与主流模型对比"/><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：蚂蚁集团官方评测数据</figcaption></figure>
<h2 class="wp-block-heading">视觉反馈闭环：从&#8221;看图说话&#8221;到&#8221;看结果干活&#8221;</h2>
<p class="wp-block-paragraph">Ling-3.0-flash-VL 的核心亮点是引入了视觉反馈闭环机制。传统多模态模型的任务执行是一次性的&#8221;生成&#8221;，而该机制将任务推进为&#8221;观察 → 行动 → 验证 → 修正&#8221;的持续闭环：模型执行操作后观察结果，与目标对比，发现偏差并持续修正。</p>
<p class="wp-block-paragraph">这一机制在三个场景中体现出价值。在前端开发场景，模型可根据网页截图理解布局、配色和组件关系，生成前端代码后查看浏览器渲染结果，与参考图对比后再修改代码，形成由视觉反馈驱动的开发闭环。在 Image-to-WebDev Arena 官方评测中，该模型以代号 linthium 参赛，在&#8221;图片转网页&#8221;任务中的评测得分高于 GPT-5.4。在 GUI 自动化场景，模型可识别页面结构和应用状态，拆解操作步骤，完成点击、输入、滚动和应用切换，支撑&#8221;查找网页数据、整理到表格、再生成图表&#8221;这类跨工具任务。在医疗报告解读场景，模型可将跨页、跨时期的血常规、生化、影像等多类数据整合为完整的健康图景，以&#8221;红黄绿灯&#8221;直观展示健康风险。</p>
<figure data-wp-context="{&quot;imageId&quot;:&quot;6aa6e027de0ae&quot;}" data-wp-interactive="core/image" data-wp-key="6aa6e027de0ae" class="wp-block-image size-large wp-lightbox-container"><img decoding="async" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/09/b7e4a9c2d1f84350ae62c8d5f3a1b904_header.webp" alt="Artificial Analysis 智能指数排行中 Ling 3.0 Flash 位列开源模型前列"/><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：Artificial Analysis 评测截图</figcaption></figure>
<h2 class="wp-block-heading">已可在灵光应用中实际使用</h2>
<p class="wp-block-paragraph">目前，Ling-3.0-flash-VL 的部分能力已接入蚂蚁旗下灵光 App。用户借助手机摄像头可实现&#8221;一拍即答&#8221;：识别动植物种类、食材、建筑地标和车型，连续描述眼前场景，并实时识别与翻译外语标识。在学习场景，模型可结合课程画面识别公式、示意图和板书内容，围绕知识点持续答疑。针对小时级的长视频，模型可通过视觉反馈闭环完成高光剪辑，依靠 256K 上下文窗口持续追踪任务状态。</p>
<p class="wp-block-paragraph">蚂蚁集团同时公布了模型的局限性：在长尾场景感知推理、长链路 Agent 执行及长程全栈编码等任务上，与最佳模型仍有差距。下一步将重点强化复杂图表与跨图片内容的理解验证能力，并提升真实工作流中的执行稳定性。</p>
<h2 class="wp-block-heading">开源信息</h2>
<p class="wp-block-paragraph">Ling-3.0-flash-VL 现已在 Ling Studio（chat.ant-ling.com）上线，免费体验开放中。模型的 BF16 和 FP8 版本已在 Hugging Face 与 ModelScope 平台开源，FP4 和 INT4 版本计划近期发布。对开发者而言，在 124B 总参数下仅需激活 5.5B 参数即可推理，部署成本明显低于同规模稠密模型，适合用于构建视觉 Agent 工作流和多模态应用。</p>]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>DeepSeek V4.1 Flash 将上线：API 最高降 60%</title>
		<link>https://mylogs.cn/deepseek-v4-1-flash-%e5%b0%86%e4%b8%8a%e7%ba%bf%ef%bc%9aapi-%e6%9c%80%e9%ab%98%e9%99%8d-60/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Wed, 09 Sep 2026 20:35:03 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI 编程]]></category>
		<category><![CDATA[API 降价]]></category>
		<category><![CDATA[DeepSeek]]></category>
		<category><![CDATA[V4.1 Flash]]></category>
		<category><![CDATA[大模型]]></category>
		<category><![CDATA[智能体]]></category>
		<category><![CDATA[算力成本]]></category>
		<guid isPermaLink="false">https://mylogs.cn/deepseek-v4-1-flash-%e5%b0%86%e4%b8%8a%e7%ba%bf%ef%bc%9aapi-%e6%9c%80%e9%ab%98%e9%99%8d-60/</guid>

					<description><![CDATA[9 月 9 日，DeepSeek 开放平台发布通知，计划于北京时间 2026 年 9 月 10 日前后正式发布 [&#8230;]]]></description>
										<content:encoded><![CDATA[<figure data-wp-context="{&quot;imageId&quot;:&quot;6aa6e027dec1c&quot;}" data-wp-interactive="core/image" data-wp-key="6aa6e027dec1c" class="wp-block-image size-large wp-lightbox-container"><img decoding="async" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/09/3d7a1e9c4b8f42ad9c1e6f5b0d3a8c27_header.webp" alt="DeepSeek Flash 系列价格调整对比"/><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：IT之家</figcaption></figure>
<p class="wp-block-paragraph">9 月 9 日，DeepSeek 开放平台发布通知，计划于北京时间 2026 年 9 月 10 日前后正式发布 V4.1 Flash 模型。官方表示，经内部及外部多方测试，V4.1 Flash 在性能、费用、响应速度、总处理用时等指标上已全面超越 V4 Pro。</p>
<p class="wp-block-paragraph">与模型发布同步的还有一次价格调整。距离上一次大幅涨价不到一个月，DeepSeek 宣布下调 Flash 系列定价，其中输入缓存命中部分降幅达到 60%。</p>
<h2 class="wp-block-heading">V4 Pro 请求将自动切换，按更低单价计费</h2>
<p class="wp-block-paragraph">按照官方说明，在 V4.1 Flash 正式上线之后、V4.1 Pro 上线之前，平台会把所有指向 V4 Pro 的接口请求全部路由到 V4.1 Flash，并按 V4.1 Flash 的单价计费。</p>
<p class="wp-block-paragraph">这意味着现有 V4 Pro 调用方无需改动任何代码，即可切换到性能更强的新模型，同时支付费用反而下降。在模型迭代通常伴随涨价的行业惯例下，这种&#8221;升级与降价同步&#8221;的做法并不多见。</p>
<h2 class="wp-block-heading">新价格：空闲时段与高峰时段相差一倍</h2>
<p class="wp-block-paragraph">新价格自北京时间 2026 年 9 月 10 日 12 时起执行，覆盖 deepseek-v4-flash 与 deepseek-v4-flash-vision-exp 两款模型，定位更高的 V4 Pro 价格保持不变。</p>
<p class="wp-block-paragraph">空闲时段每百万 token 价格为：输入缓存命中 0.02 元，输入缓存未命中 1 元，输出 4 元。此前这三项价格分别为 0.05 元、1.5 元和 4.5 元，降幅依次为 60%、33.33% 和 11.11%。</p>
<p class="wp-block-paragraph">高峰时段各项目价格为空闲时段的两倍，即输入缓存命中 0.04 元、输入缓存未命中 2 元、输出 8 元。高峰时段定义为北京时间周一至周五的 9:00 至 12:00 与 14:00 至 18:00，其余时间均为空闲时段。</p>
<p class="wp-block-paragraph">与 8 月涨价前的水平相比，缓存命中与未命中的输入价格已回落至 0.02 元和 1 元，但输出价格仍高于涨价前的 2 元。</p>
<h2 class="wp-block-heading">一个月前刚涨过价，V4 Pro 最高涨幅达 11 倍</h2>
<p class="wp-block-paragraph">时间线值得留意。8 月 13 日 V4 Pro 正式版上线时，DeepSeek 同步上调 API 价格，V4 Pro 系列最高涨幅达 11 倍，高峰时段每百万输出 token 最高达到 27 元。当时有开发者反映高峰时段成本明显上升，性价比优势被削弱。</p>
<p class="wp-block-paragraph">不到一个月后，Flash 系列迎来降价。有开发者按自身智能体工作流估算，综合调用成本可能下降约 40%，实际降幅取决于缓存命中率、输入输出 token 占比以及任务能否错峰执行。错峰与提高缓存复用率，成为压低成本的两个主要抓手。</p>
<h2 class="wp-block-heading">新模型：新架构、原生多模态，速度提升近两倍</h2>
<p class="wp-block-paragraph">9 月 8 日，DeepSeek 在官方交流群开启 V4.1 Flash 中间版本内测。据介绍，该版本采用新的模型结构，原生支持多模态，在能力、速度和成本上均有优化。</p>
<p class="wp-block-paragraph">参与测试的社区用户反馈，其生成速度约为每秒 284 个 token，而当前 V4 模型约为每秒 97 个 token，速度提升接近两倍。对于需要反复迭代的编程场景，这一提升具备明显的实用价值。</p>
<p class="wp-block-paragraph">在内测同步发放的问卷中，官方直接询问用户该模型能否全面替代线上运行的 V4 Pro。业内人士认为，这说明 DeepSeek 对 V4.1 Flash 的定位不只是 Flash 系列的内部迭代，而是希望以 Flash 的定价和速度，逼近甚至达到 Pro 级别的能力。</p>
<p class="wp-block-paragraph">目前该测试版本名称带有&#8221;expires-on-0910&#8243;标识，暗示将在此后下线，正式版的实际表现成为市场关注焦点。</p>
<h2 class="wp-block-heading">性价比仍是核心打法</h2>
<p class="wp-block-paragraph">第三方评测机构 Artificial Analysis 的数据显示，DeepSeek V4 Flash 的智能指数约为 53，低于 GPT-5.6 Sol 的 61 和 Claude Opus 5 的 63；但按单任务估算成本约为 0.25 美元，而后两者分别为 1.23 美元和 2.34 美元。</p>
<p class="wp-block-paragraph">这种差距凸显了 DeepSeek 一贯的策略：即便在绝对能力上不占首位，凭借显著更低的推理成本，仍能在规模化调用的开发者群体中保持吸引力。对普通消费者而言，API 降价的影响相对间接，能否传导为更低的 AI 服务价格或更宽松的使用额度，还要看开发者与应用厂商的取舍。</p>]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>微软给 Edge 商店开了&#8221;加速通道&#8221;，AI 写的扩展终于不用排队了</title>
		<link>https://mylogs.cn/%e5%be%ae%e8%bd%af%e7%bb%99-edge-%e5%95%86%e5%ba%97%e5%bc%80%e4%ba%86%e5%8a%a0%e9%80%9f%e9%80%9a%e9%81%93%ef%bc%8cai-%e5%86%99%e7%9a%84%e6%89%a9%e5%b1%95%e7%bb%88%e4%ba%8e%e4%b8%8d%e7%94%a8/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Wed, 09 Sep 2026 11:46:19 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI 编程]]></category>
		<category><![CDATA[Edge 浏览器]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[加载项商店]]></category>
		<category><![CDATA[开发者工具]]></category>
		<category><![CDATA[微软]]></category>
		<category><![CDATA[扩展审核]]></category>
		<guid isPermaLink="false">https://mylogs.cn/%e5%be%ae%e8%bd%af%e7%bb%99-edge-%e5%95%86%e5%ba%97%e5%bc%80%e4%ba%86%e5%8a%a0%e9%80%9f%e9%80%9a%e9%81%93%ef%bc%8cai-%e5%86%99%e7%9a%84%e6%89%a9%e5%b1%95%e7%bb%88%e4%ba%8e%e4%b8%8d%e7%94%a8/</guid>

					<description><![CDATA[微软 Edge 加载项商店正式启用新版扩展审核机制，引入自动化验证检查与每 15 天自动刷新一次的&#8221 [&#8230;]]]></description>
										<content:encoded><![CDATA[<p class="wp-block-paragraph">微软 Edge 加载项商店正式启用新版扩展审核机制，引入自动化验证检查与每 15 天自动刷新一次的&#8221;精选&#8221;徽章评估机制，目标是缩短扩展审核周期，应对 AI 辅助编程带来的扩展提交量激增。</p>
<p class="wp-block-paragraph">微软 Edge 团队在 9 月 8 日发布的开发者博客中披露，自去年为高质量、高价值扩展推出加速审核流程以来，扩展提交量持续增加，原有审核流程承受了进一步压力，导致扩展审核所需时间延长。AI 辅助编程和氛围编程大幅降低了扩展开发门槛，使 Edge 加载项商店收到的申请数量明显增加。</p>
<figure data-wp-context="{&quot;imageId&quot;:&quot;6aa6e027df6e4&quot;}" data-wp-interactive="core/image" data-wp-key="6aa6e027df6e4" class="wp-block-image size-large wp-lightbox-container"><img decoding="async" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/09/27ccaf9a959dc61a5b3d6a970f310228_1-1.webp" alt="Edge Add-ons 商店页面展示了 Microsoft Editor、Grammarly、Sider、DeepL 等多款 AI 相关扩展"/><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：Microsoft Edge 开发者博客</figcaption></figure>
<p class="wp-block-paragraph">新版审核流程的核心，是把重复性的验证检查交给自动化系统完成，让人工审核人员集中处理更复杂的情况。官方强调，新机制并不会降低审核标准或减少扩展必须通过的检查项，而是帮助更一致地发现已知的违规行为和安全问题。</p>
<p class="wp-block-paragraph">为了帮助用户筛选优质加载项，&#8221;精选&#8221;徽章的评估机制改为每 15 天自动刷新一次，评估依据包括 60 多项质量指标，涵盖扩展的多个质量维度。微软表示，更频繁的徽章刷新可以让优质扩展更快获得认可，也能让用户更及时地看到符合标准的扩展推荐。</p>
<p class="wp-block-paragraph">此次调整也反映出 AI 正从多个方面改变软件开发流程。从规模更大的 Linux 内核补丁，到外界对微软采用氛围编程方式开发 Windows 的质疑，再到 Edge 扩展发布前的审核方式，AI 对软件开发和分发流程的影响已经延伸到更广的环节。</p>
<p class="wp-block-paragraph">微软已面向所有注册开发者，在 Edge 加载项网站启用新的审核流程和每 15 天一次的精选徽章刷新机制。新版机制维持原有安全标准不变，扩展仍需符合商店最佳实践要求才能获得精选徽章。</p>
<figure data-wp-context="{&quot;imageId&quot;:&quot;6aa6e027df8c5&quot;}" data-wp-interactive="core/image" data-wp-key="6aa6e027df8c5" class="wp-block-image size-large wp-lightbox-container"><img decoding="async" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/09/27ccaf9a959dc61a5b3d6a970f310228_2-1.webp" alt="Edge 商店"精选"徽章示意"/><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：Microsoft Edge 开发者博客</figcaption></figure>]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>微软推 WinUI Agent：30 分钟生成原生应用</title>
		<link>https://mylogs.cn/%e5%be%ae%e8%bd%af%e6%8e%a8-winui-agent%ef%bc%9a30-%e5%88%86%e9%92%9f%e7%94%9f%e6%88%90%e5%8e%9f%e7%94%9f%e5%ba%94%e7%94%a8/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Sun, 06 Sep 2026 22:29:08 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI 编程]]></category>
		<category><![CDATA[GitHub Copilot]]></category>
		<category><![CDATA[Windows 11]]></category>
		<category><![CDATA[WinUI]]></category>
		<category><![CDATA[原生应用]]></category>
		<category><![CDATA[微软]]></category>
		<guid isPermaLink="false">https://mylogs.cn/%e5%be%ae%e8%bd%af%e6%8e%a8-winui-agent%ef%bc%9a30-%e5%88%86%e9%92%9f%e7%94%9f%e6%88%90%e5%8e%9f%e7%94%9f%e5%ba%94%e7%94%a8/</guid>

					<description><![CDATA[微软近日发布了一份面向开发者的快速入门指南，借助人工智能、VS Code 与自家的 Windows App D [&#8230;]]]></description>
										<content:encoded><![CDATA[<p class="wp-block-paragraph">微软近日发布了一份面向开发者的快速入门指南，借助人工智能、VS Code 与自家的 Windows App Development CLI，让开发者无需安装 Visual Studio，仅用约 30 分钟就能从空白文件夹起步，创建并发布一款 WinUI 3 原生应用。</p>

<h2 class="wp-block-heading">30 分钟造出一款原生应用</h2>

<p class="wp-block-paragraph">这份指南面向的是初学者。按照微软给出的流程，开发者借助免费的 GitHub Copilot，便可以让 AI 智能体自动添加功能、运行测试、把应用打包成 MSIX 安装包，再提交到 Microsoft Store。整个过程免费，需要的人工干预很少，开发者不必再经历传统应用开发中那些繁重的编码环节。</p>

<p class="wp-block-paragraph">不过，更值得关注的是微软随指南一并提供的 AI 辅助迁移方案，尤其是针对既有 WPF 与 UWP 应用的迁移指引。这折射出微软解决 Windows 长期&#8221;原生应用匮乏&#8221;问题的真实思路：让新应用更容易开发，让老应用更容易迁移，同时把两个过程中繁琐的活交给 AI。</p>

<h2 class="wp-block-heading">专为 WinUI 而生的智能体</h2>

<p class="wp-block-paragraph">新应用开发流程建立在 VS Code、.NET 10、WinUI 项目模板、GitHub Copilot 以及 WinUI Agent 插件之上。需要区分的是，这里的 WinUI Agent 不同于微软此前主推的通用 Copilot 聊天机器人，它被赋予了针对 WinUI 设计、代码审查、UI 测试、应用打包与框架迁移等任务的专门能力。微软还建议将它接入 Microsoft Learn 的 MCP 服务器，以便在查询时获取最新的 WinUI 接口文档。</p>

<p class="wp-block-paragraph">在迁移指引中，微软没有把工作简化为&#8221;查找替换&#8221;。以 WPF 为例，System.Windows.* 命名空间需要整体迁移到 Microsoft.UI.Xaml.*，微软为此给 AI 智能体提供了一整套涵盖控件、线程、窗口管理、DPI 与数据绑定的替换对照表，并附上初始提示词，告诉智能体应重点排查哪些问题。针对 UWP 到 WinUI 3 的迁移，微软直言 UWP 已不再处于积极开发状态，WinUI 3 与 Windows App SDK 才是后继方案。</p>

<h2 class="wp-block-heading">从&#8221;3&#8243;中走出的生产平台</h2>

<p class="wp-block-paragraph">在 Build 2026 大会上，微软明确将 WinUI 称作&#8221;Windows 应用的生产平台&#8221;，并从名称中去掉了&#8221;3&#8243;字，向开发者传达一个信号：未来不会再推倒重来地重构整个框架。微软还承诺降低运行时内存占用、新增 DataGrid 与图表支持、改善与 WPF 的互操作，并进一步扩大开源——事实上，如今的 WinUI 已经完全开源。</p>

<p class="wp-block-paragraph">微软自身也在用 WinUI 3 替换 Windows 11 中一批历史久远的界面组件，自动播放、打印管理等已率先改用新框架，后续还会有更多。微软强调，推广原生应用并非认为 WebView2 或 Electron 是糟糕的技术，其官方文档仍将 WebView2 视为混合开发的合理选择。颇具反差的是，Windows 11 自带的天气应用恰恰基于 WebView2 构建，在空闲状态下就会占用约 1.2GB 内存，约为苹果原生 macOS 天气应用的 5 倍。</p>]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>OpenAI 给 Codex 重设 5 小时限额</title>
		<link>https://mylogs.cn/openai-%e7%bb%99-codex-%e9%87%8d%e8%ae%be-5-%e5%b0%8f%e6%97%b6%e9%99%90%e9%a2%9d/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Tue, 25 Aug 2026 20:53:10 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI 编程]]></category>
		<category><![CDATA[ChatGPT]]></category>
		<category><![CDATA[Codex]]></category>
		<category><![CDATA[OpenAI]]></category>
		<category><![CDATA[使用限额]]></category>
		<guid isPermaLink="false">https://mylogs.cn/openai-%e7%bb%99-codex-%e9%87%8d%e8%ae%be-5-%e5%b0%8f%e6%97%b6%e9%99%90%e9%a2%9d/</guid>

					<description><![CDATA[OpenAI 在 8 月 24 日宣布，将为 ChatGPT Plus 订阅者的 Codex 与 ChatGP [&#8230;]]]></description>
										<content:encoded><![CDATA[<p class="wp-block-paragraph">OpenAI 在 8 月 24 日宣布，将为 ChatGPT Plus 订阅者的 Codex 与 ChatGPT Work 恢复每 5 小时的使用限额。过去几周，这两项功能仅受每周总额度约束，如今 5 小时限额重新上线。</p>

<h2 class="wp-block-heading">限额怎么变</h2>

<p class="wp-block-paragraph">OpenAI 的 Codex 与 ChatGPT Work 工程负责人 Thibault &#8220;Tibo&#8221; Sottiaux 在社交平台 X 上公布：自 8 月 25 日起，Plus 账户的 Codex 与 ChatGPT Work 重新启用 5 小时限额。用户触达 5 小时或每周任一上限后，需等待下一周期重置，或购买额外额度；OpenAI 偶尔也会免费重置，用户还可通过活动与邀请奖励累积&#8221;预留重置&#8221;次数。</p>

<p class="wp-block-paragraph">在此之前的数周里，OpenAI 临时取消了这两项功能的 5 小时限额，仅保留每周上限，其间还多次提前重置周额度以庆祝用户增长——两大平台合并后新增百万活跃用户。</p>

<h2 class="wp-block-heading">为什么又加回来</h2>

<p class="wp-block-paragraph">Sottiaux 解释，恢复 5 小时限额出于两点：其一，该限额能平滑计算负载，让周额度维持得更大方；其二，Plus 用户多为休闲型与新用户，容易在无意间一口气用光整周额度，继而感到困惑，体验并不好。</p>

<p class="wp-block-paragraph">他同时说明，未来数月内，每月 100 美元与 200 美元的 Pro 订阅暂不启用 5 小时限额。企业版与教育版的计费方式不同，沿用独立的基于额度的用量系统，本轮未作调整。</p>

<h2 class="wp-block-heading">Codex 与 ChatGPT Work 是什么</h2>

<p class="wp-block-paragraph">Codex 是 OpenAI 的编程智能体，可在云端读写代码、跑测试、提交改动；ChatGPT Work 则面向工作场景，把对话能力接入文档、表格与团队流程。两者都依赖云端大模型算力，额度本质上是调用次数的&#8221;燃料&#8221;。对习惯用 AI 辅助写代码的开发者来说，5 小时窗口意味着需要更合理地规划任务节奏。</p>

<h2 class="wp-block-heading">一点提醒</h2>

<p class="wp-block-paragraph">需要留意的是，ChatGPT 目前并未向中国内地用户开放官方服务，相关动态更适合关注 AI 工具进展的技术读者参考，而非日常使用指南。</p>

<figure data-wp-context="{&quot;imageId&quot;:&quot;6aa6e027e0bdc&quot;}" data-wp-interactive="core/image" data-wp-key="6aa6e027e0bdc" class="wp-block-image size-large wp-lightbox-container"><img fetchpriority="high" decoding="async" width="1200" height="628" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/08/61f5c7645d4de92acb9e214838458f99_header.webp" alt="ChatGPT Codex 界面示意" class="wp-image-5432" srcset="https://mylogs.cn/wp-content/uploads/2026/08/61f5c7645d4de92acb9e214838458f99_header.webp 1200w, https://mylogs.cn/wp-content/uploads/2026/08/61f5c7645d4de92acb9e214838458f99_header-300x157.webp 300w, https://mylogs.cn/wp-content/uploads/2026/08/61f5c7645d4de92acb9e214838458f99_header-1024x536.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/08/61f5c7645d4de92acb9e214838458f99_header-768x402.webp 768w" sizes="(max-width: 1200px) 100vw, 1200px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption>图片来源：9to5Mac</figcaption></figure>]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>免费「隐形」AI 模型 SWE Atlas 跑赢商业对手</title>
		<link>https://mylogs.cn/big-pickle-swe-atlas-50-8/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Sun, 16 Aug 2026 06:28:04 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI 编程]]></category>
		<category><![CDATA[DeepSeek]]></category>
		<category><![CDATA[SWE Atlas]]></category>
		<category><![CDATA[大模型评测]]></category>
		<category><![CDATA[开源模型]]></category>
		<category><![CDATA[软件工程]]></category>
		<guid isPermaLink="false">https://mylogs.cn/big-pickle-swe-atlas-50-8/</guid>

					<description><![CDATA[一款身份未公开的免费 AI 编程模型，在业内最难啃的软件工程评测之一上，跑出了超越同脚手架类别所有商业模型的成 [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">一款身份未公开的免费 AI 编程模型，在业内最难啃的软件工程评测之一上，跑出了超越同脚手架类别所有商业模型的成绩。</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6aa6e027e156e&quot;}" data-wp-interactive="core/image" data-wp-key="6aa6e027e156e" class="wp-block-image size-large aligncenter wp-lightbox-container"><img decoding="async" width="1200" height="600" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/08/7338c497162cd577258ccd8fce2f0407_header.webp" alt="免费「隐形」AI 模型 SWE Atlas 跑赢商业对手" class="wp-image-5059" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/08/7338c497162cd577258ccd8fce2f0407_header.webp 1200w, https://mylogs.cn/wp-content/uploads/2026/08/7338c497162cd577258ccd8fce2f0407_header-300x150.webp 300w, https://mylogs.cn/wp-content/uploads/2026/08/7338c497162cd577258ccd8fce2f0407_header-1024x512.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/08/7338c497162cd577258ccd8fce2f0407_header-768x384.webp 768w" sizes="(max-width: 1200px) 100vw, 1200px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：GitHub／PhillipChaffee/big-pickle-swe-atlas 项目页</figcaption></figure>





<h2 class="wp-block-heading">一次非官方的越级挑战</h2>



<p class="wp-block-paragraph">big-pickle 是 OpenCode Zen 平台上处于「隐形」（stealth）期的免费模型，其真实身份至今没有官方确认。从泄露的提供方报错与接口签名看，它背后很可能由 DeepSeek 的基础设施在支撑。一名开发者（GitHub 账号 PhillipChaffee）在 2026 年 8 月 11 日用它完整跑完了 Scale AI 的 SWE Atlas Codebase QnA 评测：全部 124 道任务解出 63 道，任务解决率达到 50.8%。</p>



<p class="wp-block-paragraph">SWE Atlas 的 Codebase QnA 任务要求模型在读懂一整个大型代码库的基础上回答工程问题，比单纯写函数更接近真实研发场景。该评测严格遵循 Scale 公开的协议——使用官方开源框架 Harbor v0.18.0、与排行榜上非第一方模型一致的 mini-swe-agent 2.4.6 极简脚手架，并以 Scale 指定的 claude-opus-4-5 作为裁判模型。整轮消耗的 6.74 亿个输入 token、430 万个输出 token 全部免费。</p>



<h2 class="wp-block-heading">横向对比：免费模型的越级表现</h2>



<p class="wp-block-paragraph">放在 SWE Atlas QnA 官方排行榜（2026 年 7 月 28 日更新）中，big-pickle 的成绩意味着：在相同的 Mini-SWE-Agent 脚手架类别里，它压过了榜单上所有条目，包括 GLM 5.2（48.12%）与 GPT-5.6-Sol（46.00%）。在整个榜单中，只有运行在原生 Claude Code 脚手架上的 Opus 5（63.17%）与 Opus 4.8（57.26%）略高。</p>



<p class="wp-block-paragraph">分语言看，TypeScript 解决率 58.1%（18/31）、Python 55.2%（16/29）、Go 50.0%（19/38）、C 语言 38.5%（10/26）；分任务类型看，代码上手（Code Onboarding）60.7%、架构与系统设计 52.3%、根因分析 45.9%、安全类 45.5%。</p>



<h2 class="wp-block-heading">结果可以独立核查</h2>



<p class="wp-block-paragraph">开发者在仓库中放出了逐任务的裁判日志、运行配置与复现脚本，任何人都能审计。需要说明的局限包括：每个任务只跑了一次（官方协议跑三次取均值，单次标准误约正负 4.5 个百分点）；沙箱资源被主动调低至 4 CPU / 8 GB（而非声明的 16/16），但 124 条轨迹的扫描显示零超时、零内存溢出，说明这只会压低而非抬高分数；模型身份未知，结果只是 2026 年 8 月 11 日当天该别名的快照。即便把两道未评分任务按「不通过」计，严格下界 49.2% 仍高于所有 Mini-SWE-Agent 榜单条目。</p>



<p class="has-small-font-size wp-block-paragraph">来源：GitHub（PhillipChaffee/big-pickle-swe-atlas）、Scale AI SWE Atlas</p>

]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>Claude Code 会话提效：让每个 token 更值</title>
		<link>https://mylogs.cn/claude-code-sessions-efficiency-guide/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Fri, 14 Aug 2026 20:03:19 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI 助手]]></category>
		<category><![CDATA[AI 编程]]></category>
		<category><![CDATA[Anthropic]]></category>
		<category><![CDATA[Claude Code]]></category>
		<category><![CDATA[开发工具]]></category>
		<category><![CDATA[提示词缓存]]></category>
		<guid isPermaLink="false">https://mylogs.cn/claude-code-sessions-efficiency-guide/</guid>

					<description><![CDATA[Anthropic 官方博客近日给出一组在 Claude Code 中跑出「高性价比」会话的建议，核心思路都围 [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">Anthropic 官方博客近日给出一组在 Claude Code 中跑出「高性价比」会话的建议，核心思路都围绕两件事：减少无效上下文、保护提示词缓存。下面把最实用的几条梳理出来。</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6aa6e027e21a9&quot;}" data-wp-interactive="core/image" data-wp-key="6aa6e027e21a9" class="wp-block-image size-large aligncenter wp-lightbox-container"><img decoding="async" width="1200" height="600" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/08/6eabc53bc0d0728d7393c97a6bf2cf92_header.webp" alt="Claude Code 会话提效：让每个 token 更值" class="wp-image-4878" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/08/6eabc53bc0d0728d7393c97a6bf2cf92_header.webp 1200w, https://mylogs.cn/wp-content/uploads/2026/08/6eabc53bc0d0728d7393c97a6bf2cf92_header-300x150.webp 300w, https://mylogs.cn/wp-content/uploads/2026/08/6eabc53bc0d0728d7393c97a6bf2cf92_header-1024x512.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/08/6eabc53bc0d0728d7393c97a6bf2cf92_header-768x384.webp 768w" sizes="(max-width: 1200px) 100vw, 1200px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：Anthropic</figcaption></figure>





<h2 class="wp-block-heading">任务之间用 /clear 清场</h2>



<p class="wp-block-paragraph">开始新任务前运行 <code>/clear</code>，可以避免上一任务的无关上下文被重新发回模型，直接省下 token。配合 <code>/rename</code> 还能在清空前给会话改名，方便日后找回。</p>



<h2 class="wp-block-heading">开局就定好模型与思考量级</h2>



<p class="wp-block-paragraph"><code>/model</code> 与 <code>/effort</code> 一旦在中途切换，会破坏提示词缓存、导致整段对话按全价重算。因此应在会话开始或 <code>/clear</code> 之后一次性设好。对于纯体力活，还可以用环境变量 <code>MAX_THINKING_TOKENS=0</code> 直接关掉思考，比把思考量级调到最低更省。</p>



<h2 class="wp-block-heading">用 @ 提及文件，而非只写路径</h2>



<p class="wp-block-paragraph">在消息里写 <code>@utils.test.ts</code> 这样的路径，文件会直接附到请求中，省去模型自行 Read 或搜索的多轮开销；同一会话里提一次即可，重复提及反而会附上副本。</p>



<h2 class="wp-block-heading">给嘈杂命令加安静标志，或丢给子代理</h2>



<p class="wp-block-paragraph">为产生大量输出的命令加上 <code>--reporter=dot</code> 之类的安静标志（可写进 ~/.bashrc 或 CLAUDE.md 固化习惯），或把「翻日志」这类噪声任务交给子代理。子代理拥有独立上下文，只把答案回传主会话、其余全部丢弃，能省下不少 token；对重复性的噪声任务，还可定义复用子代理并指定轻量模型以进一步降本。</p>



<h2 class="wp-block-heading">善用 /context、/compact 与 /rewind</h2>



<p class="wp-block-paragraph">新会话开局跑一次 <code>/context</code>，可看清已加载的系统提示、CLAUDE.md 与 MCP 工具，顺手关掉不需要的 MCP；准备离开前跑 <code>/compact</code>，用简短总结替换冗长对话，避免一小时后缓存过期被迫重算。如果最近几轮走偏了，<code>/rewind</code> 回退到出错前比 <code>/compact</code> 更便宜，因为它只截断末尾轮次、已缓存部分不花钱。</p>



<h2 class="wp-block-heading">把规矩写进 CLAUDE.md</h2>



<p class="wp-block-paragraph">CLAUDE.md 里只放特定指令，可复用的工作流应移入 skills 按需加载；把带安静标志的常用命令、以及「Compact 时保留什么」的说明固定下来，能持续减少轮次与输出行数。</p>



<p class="wp-block-paragraph">背后的原理是提示词缓存：只要请求前缀与服务器近期一致，前缀部分便能以约 0.1 倍输入价读取；一旦切换模型、切换思考量级或缓存超时，整段就要按全价重算。记住「开局设好、任务切分、离场压缩」，每个 token 自然更值。</p>



<p class="has-small-font-size wp-block-paragraph">来源：Claude by Anthropic（作者 Lydia Hallie）</p>

]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
