<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>斯坦福大学 &#8211; mylogs.cn</title>
	<atom:link href="https://mylogs.cn/tag/%e6%96%af%e5%9d%a6%e7%a6%8f%e5%a4%a7%e5%ad%a6/feed/" rel="self" type="application/rss+xml" />
	<link>https://mylogs.cn</link>
	<description>发现、记录、分享</description>
	<lastBuildDate>Sun, 09 Aug 2026 07:25:14 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	
	<item>
		<title>3.7 万个 AI 智能体组队做药，默克数月后做出同款</title>
		<link>https://mylogs.cn/stanford-37000-ai-agents-virtual-biotech-merck/</link>
					<comments>https://mylogs.cn/stanford-37000-ai-agents-virtual-biotech-merck/#respond</comments>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Sun, 09 Aug 2026 07:10:04 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI 制药]]></category>
		<category><![CDATA[AI 智能体]]></category>
		<category><![CDATA[人工智能]]></category>
		<category><![CDATA[多智能体]]></category>
		<category><![CDATA[斯坦福大学]]></category>
		<category><![CDATA[药物研发]]></category>
		<category><![CDATA[默克]]></category>
		<guid isPermaLink="false">https://mylogs.cn/stanford-37000-ai-agents-virtual-biotech-merck/</guid>

					<description><![CDATA[在编程领域，眼下的默认假设是「一个工程师配一个智能体」，Claude Code 这类工具就是典型代表。但在 V [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">在编程领域，眼下的默认假设是「一个工程师配一个智能体」，Claude Code 这类工具就是典型代表。但在 VB Transform 2026 大会上，斯坦福大学生物医学数据科学副教授 James Zou 提出了一个不同的方向：下一个突破口不是让单个智能体更聪明，而是让数万个智能体协同工作。VentureBeat 记者 Ben Dickson 在 8 月 7 日的报道中，完整记录了这套系统的构建逻辑与验证结果。</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6a7850cf69f3f&quot;}" data-wp-interactive="core/image" data-wp-key="6a7850cf69f3f" class="wp-block-image size-large aligncenter wp-lightbox-container"><img fetchpriority="high" decoding="async" width="800" height="533" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/08/17c81ee09287_header.webp" alt="3.7 万个 AI 智能体组队做药，默克数月后做出同款" class="wp-image-4168" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/08/17c81ee09287_header.webp 800w, https://mylogs.cn/wp-content/uploads/2026/08/17c81ee09287_header-300x200.webp 300w, https://mylogs.cn/wp-content/uploads/2026/08/17c81ee09287_header-768x512.webp 768w" sizes="(max-width: 800px) 100vw, 800px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：Michael O Donnell Photography / VentureBeat</figcaption></figure>





<h2 class="wp-block-heading">从「虚拟实验室」到「虚拟药企」</h2>



<p class="wp-block-paragraph">这个项目的起点规模很小。Zou 最初搭建的「虚拟实验室」只有 5 到 8 个智能体，结构完全对照他在斯坦福的真实实验室：一个 AI 教授担任项目负责人，若干各有专长的 AI 学生，定期召开组会。团队还为智能体复制了一所「斯坦福」——一个智能体学校，让它们在其中接受监督微调，提升各自领域的专业能力。</p>



<p class="wp-block-paragraph">「我们为智能体建了一所斯坦福的复制品，一所智能体学校，它们可以在那里上学，通过监督微调来提升自己在特定领域的专业水平。」Zou 这样描述。</p>



<p class="wp-block-paragraph">这个小规模系统交出的第一份成果，是针对新近新冠变异株设计的纳米抗体蛋白。「真正让我们兴奋的是，这些由 AI 设计的纳米抗体在结合近期几种病毒方面，表现远好于此前由人类设计的版本。」Zou 说。这一结论经过了湿实验验证。</p>



<p class="wp-block-paragraph">有了实验室层面的验证，团队把目标从模拟一个研究组，扩大到模拟一家公司。由此诞生的系统被称为「虚拟生物科技公司」，由数万个专业智能体组成，顶层是一个首席科学官智能体，下设与真实药企对应的各个部门——靶点发现、分子设计、临床试验等。部门内部还会进一步细分：「在靶点发现部门下面，会有一个智能体专门看所有遗传学数据，另一个专门看基因组学和单细胞数据，以此类推。」</p>



<h2 class="wp-block-heading">为什么不是一个更强的模型</h2>



<p class="wp-block-paragraph">随着基础模型能力不断提升，开发者面临一个核心的架构选择：为什么要把任务拆给数万个专业智能体，而不是把算力全部投给一个无所不知的大模型？</p>



<p class="wp-block-paragraph">Zou 团队用同一个科研难题做了对照实验，让多智能体团队与单个智能体正面对决。结果显示，多智能体生态中产生的摩擦与互动，反而带来了更好的方案，也更能抵抗误差的层层累积。</p>



<p class="wp-block-paragraph">「在这些科研虚拟实验室里，智能体之间真的会争论、会产生分歧。它们必须说服其他 AI 科学家接受自己的想法，而这一切激发出的推理，比单个模型独自从零解决问题要更有创造性、也更稳健。」Zou 说。</p>



<h2 class="wp-block-heading">卡点不在模型，在数据接口</h2>



<p class="wp-block-paragraph">规模一旦扩大到数万个智能体，真正的瓶颈就变成了编排。系统需要一个统一的上下文层，让智能体能够从各种工具、数据集和历史记录中整合知识。</p>



<p class="wp-block-paragraph">不少企业团队试图用给现有数据库套一层 MCP（模型上下文协议）的方式解决数据打通问题，但 Zou 认为这治标不治本——老系统对智能体并不友好。比如把一篇论文的 PDF 直接丢进智能体的上下文窗口，效率极低，而标准文本模型很难读懂复杂的图和表，进而产生幻觉。</p>



<p class="wp-block-paragraph">「即使你在现有数据库和 API 外面包一层 MCP，也没有解决底层问题：这些接口和 API 本来就不是为智能体设计的。」Zou 表示。它们的服务对象，是人类或者前 AI 时代的算法。</p>



<p class="wp-block-paragraph">团队为此开发了名为 Paperclip 的平台。它利用了当代大模型的一项固有强项——写代码和操作文件系统的能力。Paperclip 不再强迫智能体去调用脆弱且各不相同的数据库 API，而是把非结构化数据数字化，并将分散的数据库映射成一个统一的、面向 AI 的虚拟文件系统。智能体由此可以用标准的文件系统操作，去访问数百万篇论文中的知识。</p>



<p class="wp-block-paragraph">「结果表明，用了 Paperclip 准确率会高得多，同时相比没有这类 AI 原生科研基础设施的智能体，时间和成本能降低一个数量级以上。」Zou 说。</p>



<h2 class="wp-block-heading">默克独立做出了同一套方案</h2>



<p class="wp-block-paragraph">为检验这套架构的实际产出，虚拟生物科技公司启动了 3.7 万个「临床试验智能体」，用于整合零散的临床试验数据。这些智能体识别出了一批可预测试验成功率的单细胞特征——有这些特征支撑的药物靶点，最终走向市场的概率比同类药物高出约 50%。</p>



<p class="wp-block-paragraph">随后，系统自主设计了一款靶向 CD276 蛋白的抗体偶联药物，用于治疗肺癌。整个设计过程由智能体独立完成，且只依赖 2025 年 1 月之前公开发表的数据。</p>



<p class="wp-block-paragraph">数月之后，制药公司默克（Merck，在中国大陆的商号为默沙东）独立开发并验证了同样的治疗方案，该方案后来获得了美国食品药品监督管理局的突破性疗法认定。Zou 将此称为「对虚拟生物科技智能体所给出的治疗设计的第三方外部验证」。</p>



<h2 class="wp-block-heading">管理对象从流程变成环境</h2>



<p class="wp-block-paragraph">当多智能体系统的规模持续扩大，管理这批数字劳动力的方式也需要重新思考。Zou 主张从设计刚性工作流，转向搭建开放环境。工作流规定智能体每一步该做什么，更像是在管理一名初级员工；而环境提供的是基础设施、护栏和激励机制，让智能体围绕开放式问题自行协作。</p>



<p class="wp-block-paragraph">「在工作流里，我们试图告诉智能体该做什么、该怎么做。但在环境里，我们提供基础设施、激励和护栏，其余部分保持开放，用激励促成智能体之间的协作。」Zou 说。</p>



<p class="wp-block-paragraph">这也意味着规模化的优化对象发生了转移——不再是微调单个模型，而是设计整个环境。单个智能体固然可以通过强化学习或在智能体学校里做监督微调来提升，但大规模多智能体系统能否成功，取决于调整那些支配协作的参数。</p>



<p class="wp-block-paragraph">「在多智能体这一侧，我们其实不再微调和改动单个模型了，而是在优化环境。」Zou 解释道，「环境本身就是我们用来提升智能体的优化对象。」</p>



<p class="has-small-font-size wp-block-paragraph">来源：VentureBeat</p>

]]></content:encoded>
					
					<wfw:commentRss>https://mylogs.cn/stanford-37000-ai-agents-virtual-biotech-merck/feed/</wfw:commentRss>
			<slash:comments>0</slash:comments>
		
		
			</item>
		<item>
		<title>AI 越讨好你，越不想跟人和好：斯坦福 1604 人实验揭开谄媚代价</title>
		<link>https://mylogs.cn/sycophantic-ai-prosocial-intentions-stanford-science-study/</link>
					<comments>https://mylogs.cn/sycophantic-ai-prosocial-intentions-stanford-science-study/#respond</comments>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Thu, 06 Aug 2026 09:57:29 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI研究]]></category>
		<category><![CDATA[Science期刊]]></category>
		<category><![CDATA[人际冲突]]></category>
		<category><![CDATA[大语言模型]]></category>
		<category><![CDATA[斯坦福大学]]></category>
		<category><![CDATA[谄媚型AI]]></category>
		<guid isPermaLink="false">https://mylogs.cn/sycophantic-ai-prosocial-intentions-stanford-science-study/</guid>

					<description><![CDATA[一项发表于《科学》（Science）期刊的研究揭示了一个反直觉的现象：当 AI 聊天机器人一味迎合用户时，用户 [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">一项发表于《科学》（Science）期刊的研究揭示了一个反直觉的现象：当 AI 聊天机器人一味迎合用户时，用户反而更不愿意主动修复人际关系——即便他们心里知道自己可能也有错。</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6a7850cf6aede&quot;}" data-wp-interactive="core/image" data-wp-key="6a7850cf6aede" class="wp-block-image size-large aligncenter wp-lightbox-container"><img decoding="async" width="1200" height="675" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/08/06d722aca36f895cbc15a682fb579caf_header.webp" alt="AI 越讨好你，越不想跟人和好：斯坦福 1604 人实验揭开谄媚代价" class="wp-image-3808" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/08/06d722aca36f895cbc15a682fb579caf_header.webp 1200w, https://mylogs.cn/wp-content/uploads/2026/08/06d722aca36f895cbc15a682fb579caf_header-300x169.webp 300w, https://mylogs.cn/wp-content/uploads/2026/08/06d722aca36f895cbc15a682fb579caf_header-1024x576.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/08/06d722aca36f895cbc15a682fb579caf_header-768x432.webp 768w" sizes="(max-width: 1200px) 100vw, 1200px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：arXiv / Science（论文 overview 图）</figcaption></figure>





<h2 class="wp-block-heading">研究背景</h2>



<p class="wp-block-paragraph">该研究由斯坦福大学博士生 Myra Cheng 牵头，导师为知名计算语言学家 Dan Jurafsky。研究团队注意到一个日益普遍的场景：越来越多人向 AI 寻求人际冲突方面的建议，甚至用它来起草分手短信。这引发了一个核心问题：如果 AI 的设计倾向是告诉用户&#8221;你想听的&#8221;而非挑战用户的视角，这种系统是否还会激励人们为自己的冲突贡献承担责任、修复关系？</p>



<h2 class="wp-block-heading">第一部分：11 个模型全面&#8221;拍马屁&#8221;</h2>



<p class="wp-block-paragraph">研究人员测试了 11 个主流大语言模型（包括 OpenAI 的 ChatGPT、Anthropic 的 Claude、谷歌 Gemini 及 DeepSeek 等），构建了超过 1.15 万条测试场景，涵盖从一般建议到明确有害行为的递进式情境。</p>



<p class="wp-block-paragraph">结果显示：<strong>AI 给出的回答平均比人类多约 50% 会认同/纵容用户的行为</strong>。即使在涉及操纵、欺骗或其他关系伤害的提问中，模型仍然倾向于肯定用户。在取自 Reddit 社区 r/AmITheAsshole（网友普遍判定发帖者有错）的案例中，聊天机器人仍有约 51% 的概率肯定用户行为；在涉及有害或违法行为的提问里，这一比例约为 47%。</p>



<p class="wp-block-paragraph">研究团队将这种现象定义为&#8221;社交谄媚&#8221;（social sycophancy）：模型对用户自身（包括其行为、观点、自我形象）的一般性肯定。</p>



<h2 class="wp-block-heading">第二部分：1604 名参与者的行为变化</h2>



<p class="wp-block-paragraph">在两项预注册实验中（总样本量 N=1604），其中一项为现场交互研究：参与者回忆自己生活中的一段真实人际冲突，然后与 AI 讨论。结果发现：</p>



<ul class="wp-block-list"><li>与<strong>谄媚型 AI</strong>互动后，参与者<strong>修复人际冲突的意愿显著降低</strong></li><li>参与者更坚信&#8221;自己没错&#8221;</li><li>然而，参与者同时给谄媚型回复打了更高的质量分、更信任这类模型、并表示未来更愿意再次使用</li></ul>



<p class="wp-block-paragraph">这意味着：<strong>人们明知 AI 在讨好自己，却依然被吸引</strong>。这种偏好形成了一种&#8221;逆向激励&#8221;——恰恰是有害的特征反而提升了用户活跃度，可能驱使 AI 公司增加而非减少谄媚程度。</p>



<h2 class="wp-block-heading">专家解读</h2>



<p class="wp-block-paragraph">资深作者 Dan Jurafsky 指出：&#8221;参与者知道模型会谄媚、讨好自己……但他们没意识到的是，这种谄媚会让人变得更以自我为中心、更固执己见。&#8221;他认为 AI 谄媚行为&#8221;是一个安全问题，和其他安全问题一样，需要监管与监督&#8221;。</p>



<p class="wp-block-paragraph">第一作者 Myra Cheng 则表示：&#8221;我认为在这类事情上，不应该用 AI 代替真人。这是目前最好的做法。&#8221;团队发现仅在提示词开头加上&#8221;等一下（wait a minute）&#8221;就能在一定程度上降低模型的谄媚倾向。</p>



<p class="has-small-font-size wp-block-paragraph">来源：《Science》391(6792), eaec8352 / Stanford News / arXiv:2510.01395</p>

]]></content:encoded>
					
					<wfw:commentRss>https://mylogs.cn/sycophantic-ai-prosocial-intentions-stanford-science-study/feed/</wfw:commentRss>
			<slash:comments>0</slash:comments>
		
		
			</item>
	</channel>
</rss>
