<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>无障碍 AI &#8211; mylogs.cn</title>
	<atom:link href="https://mylogs.cn/tag/%e6%97%a0%e9%9a%9c%e7%a2%8d-ai/feed/" rel="self" type="application/rss+xml" />
	<link>https://mylogs.cn</link>
	<description>发现、记录、分享</description>
	<lastBuildDate>Thu, 13 Aug 2026 19:37:53 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	
	<item>
		<title>谷歌手语 AI 落地手机，打手势就能发消息</title>
		<link>https://mylogs.cn/google-sl2t-sign-language-ai-pixel/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Thu, 13 Aug 2026 19:37:30 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[Gboard]]></category>
		<category><![CDATA[Google DeepMind]]></category>
		<category><![CDATA[MediaPipe]]></category>
		<category><![CDATA[Pixel 11]]></category>
		<category><![CDATA[SL2T]]></category>
		<category><![CDATA[手语识别]]></category>
		<category><![CDATA[无障碍 AI]]></category>
		<guid isPermaLink="false">https://mylogs.cn/google-sl2t-sign-language-ai-pixel/</guid>

					<description><![CDATA[谷歌旗下 DeepMind 近日发布大规模多语言手语转文本模型 SL2T，并首次把手语人工智能从实验室带进了消 [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">谷歌旗下 DeepMind 近日发布大规模多语言手语转文本模型 SL2T，并首次把手语人工智能从实验室带进了消费电子产品。这项功能已接入 Pixel 11 上的输入法 Gboard 与实时转写应用 Live Transcribe，首批支持将美国手语（ASL）翻译成英文。对全球数以千万计的听障人群来说，这意味着他们终于可以像普通人用语音输入一样，直接用手势「打字」。</p>



<figure data-wp-context="{&quot;imageId&quot;:&quot;6a7e1ddbd499c&quot;}" data-wp-interactive="core/image" data-wp-key="6a7e1ddbd499c" class="wp-block-image size-large aligncenter wp-lightbox-container"><img fetchpriority="high" decoding="async" width="1200" height="630" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/08/59edc2192400f07e092b75251884e240_header.webp" alt="谷歌手语 AI 落地手机，打手势就能发消息" class="wp-image-4747" style="max-width:100%;height:auto;" srcset="https://mylogs.cn/wp-content/uploads/2026/08/59edc2192400f07e092b75251884e240_header.webp 1200w, https://mylogs.cn/wp-content/uploads/2026/08/59edc2192400f07e092b75251884e240_header-300x158.webp 300w, https://mylogs.cn/wp-content/uploads/2026/08/59edc2192400f07e092b75251884e240_header-1024x538.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/08/59edc2192400f07e092b75251884e240_header-768x403.webp 768w" sizes="(max-width: 1200px) 100vw, 1200px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption class="wp-element-caption">图片来源：Google DeepMind</figcaption></figure>





<p class="wp-block-paragraph">## 对着手机打手语，就能搜索和发消息</p>



<p class="wp-block-paragraph">借助 SL2T，听障用户可以在任何原本需要打字的地方用手语与手机交流。在 Gboard 里，用户可以对着摄像头打手语，用来搜索网页、撰写消息或文档，也可以向 Gemini 提问或交代任务；在 Live Transcribe 里，用户还能用手语直接回应对话，不必再和对方反复打字。</p>



<p class="wp-block-paragraph">根据内部测试者的反馈，使用美国手语输入比用英语键盘打字更快、更自然，体验也更流畅。长期以来，语音转文字已经成为智能手机的标配功能，但全球现存超过两百种手语、约七千万听障人士，却长期缺少成熟稳定的移动端手语识别工具，无障碍交互始终存在缺口。</p>



<p class="wp-block-paragraph">## 为什么手语识别比语音识别难得多</p>



<p class="wp-block-paragraph">手语翻译面临两项核心挑战。第一，语音转写是在同一种语言内部，把声音按顺序映射成文字；而手语是拥有独立语法和词汇的自然语言，因此需要真正的机器翻译，而不是把一个个手势顺序转换成单词。</p>



<p class="wp-block-paragraph">第二，模型必须学会「看见」并理解身体动作。手语通过手、手臂、躯干、头部和面部同时发生的动作传递含义，在高帧率下准确追踪这些动作，是一项难度和计算量都很高的计算机视觉任务。也正因如此，早期的手语手套等产品存在根本局限——手语并非简单的「用手表达英语」，它既需要细微的全身动作视觉感知，也需要完整的语言翻译能力。</p>



<p class="wp-block-paragraph">## 十万小时数据，覆盖五十多种手语</p>



<p class="wp-block-paragraph">SL2T 的训练使用了超过十万小时的数据，覆盖五十多种手语，其中约四分之一为美国手语数据。谷歌表示，将不同手语、方言以及不同熟练程度的使用者放在一起联合训练，有助于模型学习共享的底层结构，实验效果优于单语种模型。</p>



<p class="wp-block-paragraph">在隐私保护上，SL2T 并不会把原始摄像头画面直接发送到服务器。手机端的 MediaPipe Holistic 模型会先追踪用户身体上约一百三十个关键点，只把相应的几何坐标传输出去，原始视频则立即丢弃。模型再把这些坐标序列直接翻译成文字，跳过了手语研究中常用的中间标注环节。谷歌认为，直接翻译能更好地处理面部神态和空间结构等信息，也摆脱了人工标注带来的词汇范围限制。</p>



<p class="wp-block-paragraph">在评估美国手语到英文翻译质量的 FLEURS-ASL 基准上，SL2T 是目前最强的手语翻译模型，其零样本 BLEURT 得分达到 70，明显高于此前公开结果。不过，模型在罕见手势、快速手指拼写、被动语态和缺乏上下文的时态判断上仍可能出错。</p>



<p class="wp-block-paragraph">## 听障群体全程参与设计</p>



<p class="wp-block-paragraph">SL2T 并非 DeepMind 第一次尝试面向残障群体的无障碍人工智能。早在 2025 年，科研团队就开源了基于轻量化架构的手语互译模型 SignGemma，为如今的消费级落地打下算法根基。此外，实验室还研发过帮助用户复刻嗓音、辨识含糊语音等多项普惠技术。</p>



<p class="wp-block-paragraph">值得一提的是，SL2T 的开发过程中，聋人社区与手语顾问委员会全程参与了从构想、数据收集到用户测试和影响力评估的各个环节。官方也明确界定，这项技术目前定位为低风险的辅助草稿生成工具，适用于消息、搜索、导航、记笔记和轻松的一对一交流，而不应用于医疗问诊、法律程序、课堂教学或政府福利判定等场景。</p>



<p class="wp-block-paragraph">首批功能仅开放美国手语到英文的翻译，后续谷歌计划逐步适配更多手语种类，并向更多安卓机型铺开。手语人工智能走进手机，迈出的虽只是一小步，却为缩小听障群体在数字世界的沟通鸿沟打开了新可能。</p>



<p class="has-small-font-size wp-block-paragraph">来源：Google DeepMind（SL2T 官方博客，https://deepmind.google/blog/putting-sign-language-ai-into-users-hands）</p>

]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
