<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>人工智能识别 &#8211; mylogs.cn</title>
	<atom:link href="https://mylogs.cn/tag/%e4%ba%ba%e5%b7%a5%e6%99%ba%e8%83%bd%e8%af%86%e5%88%ab/feed/" rel="self" type="application/rss+xml" />
	<link>https://mylogs.cn</link>
	<description>发现、记录、分享</description>
	<lastBuildDate>Sat, 01 Aug 2026 03:14:59 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	
	<item>
		<title>破折号已不是破绽：120万词实验揪出AI新文风</title>
		<link>https://mylogs.cn/%e7%a0%b4%e6%8a%98%e5%8f%b7%e5%b7%b2%e4%b8%8d%e6%98%af%e7%a0%b4%e7%bb%bd%ef%bc%9a120%e4%b8%87%e8%af%8d%e5%ae%9e%e9%aa%8c%e6%8f%aa%e5%87%baai%e6%96%b0%e6%96%87%e9%a3%8e/</link>
					<comments>https://mylogs.cn/%e7%a0%b4%e6%8a%98%e5%8f%b7%e5%b7%b2%e4%b8%8d%e6%98%af%e7%a0%b4%e7%bb%bd%ef%bc%9a120%e4%b8%87%e8%af%8d%e5%ae%9e%e9%aa%8c%e6%8f%aa%e5%87%baai%e6%96%b0%e6%96%87%e9%a3%8e/#respond</comments>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Sat, 01 Aug 2026 03:14:36 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[《经济学人》]]></category>
		<category><![CDATA[AI写作]]></category>
		<category><![CDATA[AI检测]]></category>
		<category><![CDATA[ChatGPT]]></category>
		<category><![CDATA[人工智能识别]]></category>
		<category><![CDATA[大模型]]></category>
		<guid isPermaLink="false">https://mylogs.cn/%e7%a0%b4%e6%8a%98%e5%8f%b7%e5%b7%b2%e4%b8%8d%e6%98%af%e7%a0%b4%e7%bb%bd%ef%bc%9a120%e4%b8%87%e8%af%8d%e5%ae%9e%e9%aa%8c%e6%8f%aa%e5%87%baai%e6%96%b0%e6%96%87%e9%a3%8e/</guid>

					<description><![CDATA[如果一篇文章里频繁出现长破折号，你大概会条件反射地怀疑：这是AI写的吧？ 《经济学人》最近做的一项语料实验给出 [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">如果一篇文章里频繁出现长破折号，你大概会条件反射地怀疑：这是AI写的吧？</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6a6f78b7da5bd&quot;}" data-wp-interactive="core/image" data-wp-key="6a6f78b7da5bd" class="wp-block-image size-large aligncenter wp-lightbox-container"><img fetchpriority="high" decoding="async" width="1600" height="900" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/08/7e4d835d4c3d8ef164f99cdfd7fdeeaa_header.webp" alt="破折号已不是破绽：120万词实验揪出AI新文风" class="wp-image-3094" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/08/7e4d835d4c3d8ef164f99cdfd7fdeeaa_header.webp 1600w, https://mylogs.cn/wp-content/uploads/2026/08/7e4d835d4c3d8ef164f99cdfd7fdeeaa_header-300x169.webp 300w, https://mylogs.cn/wp-content/uploads/2026/08/7e4d835d4c3d8ef164f99cdfd7fdeeaa_header-1024x576.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/08/7e4d835d4c3d8ef164f99cdfd7fdeeaa_header-768x432.webp 768w, https://mylogs.cn/wp-content/uploads/2026/08/7e4d835d4c3d8ef164f99cdfd7fdeeaa_header-1536x864.webp 1536w" sizes="(max-width: 1600px) 100vw, 1600px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：Wikimedia Commons (CC BY-SA 4.0 / Colin)</figcaption></figure>





<p class="wp-block-paragraph">《经济学人》最近做的一项语料实验给出的答案是：这个判断已经过时了。</p>



<h2 class="wp-block-heading">一个流传甚广、却越来越不准的&#8221;常识&#8221;</h2>



<p class="wp-block-paragraph">关于大语言模型的写作癖好，网上流传着一份心照不宣的清单：偏爱长破折号，钟情&#8221;delve（深入探究）&#8221;和&#8221;tapestry（织锦）&#8221;这类词，喜欢把世界描述成一幅&#8221;丰富的织锦&#8221;。</p>



<p class="wp-block-paragraph">问题在于，靠几个词、几个破折号就下结论，本身站不住脚。仅因为一篇文章出现了&#8221;delve&#8221;就断定出自机器之手，就像因为文中出现&#8221;imprudence（轻率）&#8221;便认定作者是简·奥斯汀一样荒谬。波兰格但斯克大学语言学家卡罗琳娜·鲁德尼茨卡（Karolina Rudnicka）指出，并不存在统一的AI文风，正如人类写作本来也不存在单一风格——作家各有各的语言癖好，比如艾米莉·狄金森就极其偏爱长破折号，而AI同样会形成自己的习惯。</p>



<p class="wp-block-paragraph">更麻烦的是，识别的紧迫性正在上升。据一项统计，互联网上超过三分之一的新网站由AI起草。今年英联邦短篇小说奖的获奖作品甚至被人指称为AI创作，评委还称赞其文风&#8221;沉静而权威&#8221;，尽管英联邦基金会否认了这一说法。</p>



<h2 class="wp-block-heading">55940个句子、120万个单词的对照实验</h2>



<p class="wp-block-paragraph">为了找出真正可靠的特征，《经济学人》设计了一项对照实验：让当前主流的四款大模型——OpenAI的ChatGPT、Anthropic的Claude、谷歌的Gemini和xAI的Grok——在不联网检索的前提下改写该刊文章，提示词使用的是其近来试验性附加在部分文章上的AI摘要。</p>



<p class="wp-block-paragraph">由此得到一份人类与AI写作并存的语料库，共比较分析了55940个句子、120万个单词。为确保识别出的是AI的共性特征而非《经济学人》自身文风，研究还将AI文本与美国有线电视新闻网、《纽约时报》《华盛顿邮报》的报道作了对比，并参考了1950年至2022年间出版的畅销小说片段。</p>



<p class="wp-block-paragraph">结论是：人机差异不只体现在用词和标点上，也体现在句子结构与段落组织方式上；但这些特征远没有大众想象中那么显眼，部分原因在于随着模型迭代，AI的文风一直在变。</p>



<h2 class="wp-block-heading">三个更靠谱的新破绽</h2>



<p class="wp-block-paragraph"><strong>其一，词汇变&#8221;端着&#8221;了。</strong> AI已经不那么爱用&#8221;delve&#8221;和&#8221;tapestry&#8221;，转而大量堆砌多音节词，例如significant（重要的）、increasingly（越来越）、consequences（后果）。它们比人类更爱用生僻词（如interdependence相互依存、reindustrialisation再工业化）和科学术语（如parameter参数、methodology方法论），也偏好把动词名词化（把expand变成expansion）。所有受测模型都有这种倾向，其中Gemini和Claude尤为明显。这大体就是乔治·奥威尔批评过的&#8221;矫饰辞藻&#8221;——用复杂词汇包装简单表达，只为显得高深；奥威尔当年就讥讽这类作者笃信&#8221;拉丁语和希腊语词汇比盎格鲁-撒克逊词汇更高贵&#8221;，而数据显示，AI笔下带拉丁语词尾的单词出现频率确实明显高于人类。</p>



<p class="wp-block-paragraph"><strong>其二，破折号翻案，标点整体变少。</strong> 在最新版本中，只有Claude使用长破折号的频率高于人类作者，而ChatGPT用得比这项研究中任何一位写作者都少。真正更可靠的信号是标点总量偏少：模型使用的逗号、分号都少于人类，括号更是几乎不用。原因有二，一是它们爱写长句——&#8221;and&#8221;是被过度使用得最厉害的词；二是它们很少引用专家原话。</p>



<p class="wp-block-paragraph"><strong>其三，句子长而平，套路化修辞扎堆。</strong> AI的句子普遍偏长，段落里几乎不会突然插入一句短促有力的话，读起来难免乏味。为了制造变化，它们高度依赖几种固定结构：&#8221;不是X，而是Y&#8221;&#8221;不仅……而且……&#8221;，以及&#8221;三项并列法则&#8221;。每1000个句子中，ChatGPT和Claude使用这些结构的频率高于其他模型，也高于人类作者。</p>



<h2 class="wp-block-heading">检测工具能撑多久</h2>



<p class="wp-block-paragraph">依靠算法检测是另一条路。行业领先公司Pangram声称其检测准确率达到99.98%，并已与博客平台Substack合作推出工具。但这类检测器本质上是黑箱，可能误判，且无法解释自己为何得出结论。</p>



<p class="wp-block-paragraph">更值得警惕的是，AI正在飞快地&#8221;改掉&#8221;自己的破绽。佛罗里达州立大学的汤米·尤泽克（Tommie Juzek）指出，大语言模型本就基于人类写作训练，并持续通过人类反馈优化：人们喜欢什么它就学什么，不喜欢什么就逐渐舍弃。</p>



<p class="wp-block-paragraph">一个细节颇能说明问题。不久前，《经济学人》记者向旧版ChatGPT提问&#8221;AI是不是过度使用破折号&#8221;，得到的回答是：&#8221;哈——这个问题问得真好！&#8221;如今再问同样的问题，它一本正经地答道：&#8221;最好还是谨慎使用。&#8221;</p>



<p class="wp-block-paragraph">所以，眼下若要识别AI写作，最值得留意的不再是某个标志性符号，而是那种平淡、端着、拉丁词源词汇密集的整体质感。但《经济学人》的研究也提醒：每一次模型更新，AI的文字都在离人类更近一步，这道识别题只会越来越难。</p>



<p class="wp-block-paragraph">来源：《经济学人》（How to spot AI writing）</p>

]]></content:encoded>
					
					<wfw:commentRss>https://mylogs.cn/%e7%a0%b4%e6%8a%98%e5%8f%b7%e5%b7%b2%e4%b8%8d%e6%98%af%e7%a0%b4%e7%bb%bd%ef%bc%9a120%e4%b8%87%e8%af%8d%e5%ae%9e%e9%aa%8c%e6%8f%aa%e5%87%baai%e6%96%b0%e6%96%87%e9%a3%8e/feed/</wfw:commentRss>
			<slash:comments>0</slash:comments>
		
		
			</item>
	</channel>
</rss>
