<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>AI视频生成 &#8211; mylogs.cn</title>
	<atom:link href="https://mylogs.cn/tag/ai%e8%a7%86%e9%a2%91%e7%94%9f%e6%88%90/feed/" rel="self" type="application/rss+xml" />
	<link>https://mylogs.cn</link>
	<description>发现、记录、分享</description>
	<lastBuildDate>Tue, 29 Sep 2026 16:59:39 +0000</lastBuildDate>
	<language>zh-Hans</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	
	<item>
		<title>2026 AI视频生成横评：可灵Veo即梦谁更强</title>
		<link>https://mylogs.cn/2026-ai%e8%a7%86%e9%a2%91%e7%94%9f%e6%88%90%e6%a8%aa%e8%af%84%ef%bc%9a%e5%8f%af%e7%81%b5veo%e5%8d%b3%e6%a2%a6%e8%b0%81%e6%9b%b4%e5%bc%ba/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Mon, 14 Sep 2026 17:49:55 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI视频生成]]></category>
		<category><![CDATA[Google Veo]]></category>
		<category><![CDATA[MiniMax海螺]]></category>
		<category><![CDATA[Runway]]></category>
		<category><![CDATA[Sora 2]]></category>
		<category><![CDATA[即梦]]></category>
		<category><![CDATA[可灵3.0]]></category>
		<guid isPermaLink="false">https://mylogs.cn/2026-ai%e8%a7%86%e9%a2%91%e7%94%9f%e6%88%90%e6%a8%aa%e8%af%84%ef%bc%9a%e5%8f%af%e7%81%b5veo%e5%8d%b3%e6%a2%a6%e8%b0%81%e6%9b%b4%e5%bc%ba/</guid>

					<description><![CDATA[2026年的AI视频生成已经跨过&#8221;能用&#8221;门槛，进入量产阶段。如果只问一句&#8221; [&#8230;]]]></description>
										<content:encoded><![CDATA[<p class="wp-block-paragraph">2026年的AI视频生成已经跨过&#8221;能用&#8221;门槛，进入量产阶段。如果只问一句&#8221;哪款最强&#8221;，答案是：画质与音画同步看谷歌Veo 3.1，长视频与叙事看<a href="https://mylogs.cn/chatgpt-pro-%e9%87%8d%e5%bc%80-200-%e7%be%8e%e5%85%83%e6%a1%a3%ef%bc%9aapi-%e4%bb%b7%e5%80%bc%e8%bf%91%e7%bf%bb%e5%80%8d/">OpenAI</a>的Sora 2，但二者订阅门槛都在每月200美元以上；对大多数中国创作者而言，快手可灵3.0在运动控制、原生音频和价格之间取得了最佳平衡，字节即梦则胜在抖音生态与生成速度。下面从画质、时长、音频、价格四个维度横向对比八款主流模型。</p>
<figure data-wp-context="{&quot;imageId&quot;:&quot;6ac3f0f6c92be&quot;}" data-wp-interactive="core/image" data-wp-key="6ac3f0f6c92be" class="wp-block-image wp-lightbox-container"><img fetchpriority="high" decoding="async" width="1536" height="1024" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/09/c1a2i3v4i5d6e7o8f9a0b1c2d3e4f5_header.webp" alt="2026年主流AI视频生成模型概念图" class="wp-image-7006" srcset="https://mylogs.cn/wp-content/uploads/2026/09/c1a2i3v4i5d6e7o8f9a0b1c2d3e4f5_header.webp 1536w, https://mylogs.cn/wp-content/uploads/2026/09/c1a2i3v4i5d6e7o8f9a0b1c2d3e4f5_header-300x200.webp 300w, https://mylogs.cn/wp-content/uploads/2026/09/c1a2i3v4i5d6e7o8f9a0b1c2d3e4f5_header-1024x683.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/09/c1a2i3v4i5d6e7o8f9a0b1c2d3e4f5_header-768x512.webp 768w" sizes="(max-width: 1536px) 100vw, 1536px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption>图片来源：图片来源：AI生成配图</figcaption></figure>
<h2 class="wp-block-heading">八款主流模型横向对比</h2>
<p class="wp-block-paragraph">模型之间的差别主要体现在&#8221;能生成多长&#8221;&#8221;画质多真&#8221;&#8221;是否自带声音&#8221;&#8221;要花多少钱&#8221;。下表为公开资料与各家官方文档整理（数据截至2026年9月）：</p>
<figure class="wp-block-table"><table class="has-fixed-layout"><thead><tr><th>模型</th><th>开发商</th><th>最长时长</th><th>分辨率</th><th>原生音频</th><th>月费(美元)</th><th>定位</th></tr></thead><tbody><tr><td>&#8212;</td><td>&#8212;</td><td>&#8212;</td><td>&#8212;</td><td>&#8212;</td><td>&#8212;</td><td>&#8212;</td></tr><tr><td>Veo 3.1</td><td>Google</td><td>2分钟</td><td>4K</td><td>有</td><td>20–250</td><td>电影级画质+音画同步</td></tr><tr><td>Sora 2</td><td>OpenAI</td><td>4分钟</td><td>1080p/4K</td><td>无</td><td>20–200</td><td>写实叙事(9月24日停API)</td></tr><tr><td>可灵 3.0</td><td>快手</td><td>10秒</td><td>1080p</td><td>有</td><td>8–66</td><td>性价比+运动控制</td></tr><tr><td>即梦</td><td>字节跳动</td><td>2分钟</td><td>2K</td><td>无</td><td>免费起</td><td>抖音生态+生成快</td></tr><tr><td>Seedance 2.0</td><td>字节跳动</td><td>5–10秒</td><td>2K</td><td>无</td><td>0.022美元/秒起</td><td>质价比之王</td></tr><tr><td>海螺 2.3</td><td>MiniMax</td><td>60秒</td><td>1080p</td><td>有</td><td>10–40</td><td>高运动动作场景</td></tr><tr><td>Runway Gen-4</td><td>Runway</td><td>40秒</td><td>1080p</td><td>无</td><td>15–95</td><td>创作控制最强</td></tr><tr><td>万相 Wan 2.6</td><td>阿里巴巴</td><td>5秒</td><td>720p</td><td>无</td><td>0.07美元/秒</td><td>最快草稿迭代</td></tr></tbody></table></figure>
<h2 class="wp-block-heading">画质与音画：Veo 3.1 暂时领跑</h2>
<p class="wp-block-paragraph">在画质真实感与物理一致性上，谷歌Veo 3.1目前处于第一梯队，并且是首个原生生成音频的主流视频模型——环境音、配乐与画面在扩散过程中同步合成，省去单独配音环节。Sora 2的写实度同样顶尖，最长可生成4分钟片段，但默认静音，需要后期补声音。可灵3.0与即梦在国产模型中画质靠前，可灵的运动一致性和口型同步（支持普通话、粤语等）尤其适合短视频。</p>
<h2 class="wp-block-heading">国产模型：可灵与即梦怎么选</h2>
<p class="wp-block-paragraph">快手可灵3.0的优势是&#8221;均衡&#8221;：单条最长10秒且自带音频，免费版每天赠送约66积分（约6条视频），运动控制强、长镜头不容易崩。字节即梦依托抖音生态，生成速度最快（约2分半），免费额度充足，适合国内电商与社媒内容快速产出。两者都支持图生视频，适合把商品图直接转成短视频。阿里万相Wan 2.6定位&#8221;快而便宜&#8221;，约20秒出片、720p，适合故事板和快速试错。</p>
<h2 class="wp-block-heading">Sora 2 还能用吗</h2>
<p class="wp-block-paragraph">需要提醒的是，OpenAI已在2026年4月26日关停Sora网页与App，API将于2026年9月24日停止服务。对仍在使用Sora的团队，建议尽快迁移到可灵、Runway或Veo；Sora高昂的运营成本（日均约100万美元）和用户规模下滑，是其退场的主因。</p>
<h2 class="wp-block-heading">做短视频到底选哪款</h2>
<p class="wp-block-paragraph">面向国内平台，即梦（抖音生态）与可灵（运动控制）是首选；面向海外平台，可灵与Runway更稳妥；需要电影级画质且预算充足选Veo 3.1；追求特效玩法选Pika；对商用版权安全要求高可选Adobe Firefly（提供合同级IP赔偿）。2026年的现实是：没有一款工具通吃，专业创作者的标准做法是组合使用。</p>
<h2 class="wp-block-heading">当前仍有的短板</h2>
<p class="wp-block-paragraph">AI视频尚未完全解决三类问题：一是超过20至30秒后人物外观、背景容易出现不一致；二是&#8221;AI手&#8221;等细节特写仍有畸形；三是多数模型生成的是无声视频（Veo 3.1与Sora 2除外）。这些局限意味着关键镜头仍需人工审核与后期修补。</p>
<p class="wp-block-paragraph"><em>本文综合各家官方文档、第三方评测平台公开数据整理，数据截至2026年9月；具体定价与功能以官方最新说明为准。</em></p>]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>1.3B 世界模型开源：蚂蚁灵波让单卡跑实时交互世界</title>
		<link>https://mylogs.cn/1-3b-%e4%b8%96%e7%95%8c%e6%a8%a1%e5%9e%8b%e5%bc%80%e6%ba%90%ef%bc%9a%e8%9a%82%e8%9a%81%e7%81%b5%e6%b3%a2%e8%ae%a9%e5%8d%95%e5%8d%a1%e8%b7%91%e5%ae%9e%e6%97%b6%e4%ba%a4%e4%ba%92%e4%b8%96%e7%95%8c/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Sun, 13 Sep 2026 16:41:07 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI视频生成]]></category>
		<category><![CDATA[LingBot-World]]></category>
		<category><![CDATA[世界模型]]></category>
		<category><![CDATA[具身智能]]></category>
		<category><![CDATA[开源]]></category>
		<category><![CDATA[消费级GPU]]></category>
		<category><![CDATA[蚂蚁灵波]]></category>
		<guid isPermaLink="false">https://mylogs.cn/1-3b-%e4%b8%96%e7%95%8c%e6%a8%a1%e5%9e%8b%e5%bc%80%e6%ba%90%ef%bc%9a%e8%9a%82%e8%9a%81%e7%81%b5%e6%b3%a2%e8%ae%a9%e5%8d%95%e5%8d%a1%e8%b7%91%e5%ae%9e%e6%97%b6%e4%ba%a4%e4%ba%92%e4%b8%96%e7%95%8c/</guid>

					<description><![CDATA[1.3B 世界模型正式开源：蚂蚁灵波把实时交互世界模型的运行门槛，从服务器级算力拉到一张消费级显卡。个人开发者 [&#8230;]]]></description>
										<content:encoded><![CDATA[<p class="wp-block-paragraph">1.3B 世界模型正式开源：蚂蚁灵波把实时交互世界模型的运行门槛，从服务器级<a href="https://mylogs.cn/ai-%e6%99%ba%e8%83%bd%e4%bd%93%e5%bc%95%e7%88%86%e9%9c%80%e6%b1%82%ef%bc%9a%e6%9c%8d%e5%8a%a1%e5%99%a8-cpu-%e4%ba%a4%e4%bb%98%e8%a6%81%e7%ad%89-30-%e5%91%a8/">算力</a>拉到一张消费级显卡。个人开发者无需集群，也能在本地实时生成可交互的虚拟世界。</p>
<figure data-wp-context="{&quot;imageId&quot;:&quot;6ac3f0f6ca403&quot;}" data-wp-interactive="core/image" data-wp-key="6ac3f0f6ca403" class="wp-block-image wp-lightbox-container"><img decoding="async" width="1536" height="1024" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/09/6b53e3b1efa4054a2d28adfe556199bf_header.webp" alt="蚂蚁灵波 LingBot-World 2.0 世界模型可视化" class="wp-image-6897" srcset="https://mylogs.cn/wp-content/uploads/2026/09/6b53e3b1efa4054a2d28adfe556199bf_header.webp 1536w, https://mylogs.cn/wp-content/uploads/2026/09/6b53e3b1efa4054a2d28adfe556199bf_header-300x200.webp 300w, https://mylogs.cn/wp-content/uploads/2026/09/6b53e3b1efa4054a2d28adfe556199bf_header-1024x683.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/09/6b53e3b1efa4054a2d28adfe556199bf_header-768x512.webp 768w" sizes="(max-width: 1536px) 100vw, 1536px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption>图片来源：图片来源：蚂蚁灵波</figcaption></figure>
<p class="wp-block-paragraph">继今年 7 月发布 14B 主模型后，蚂蚁灵波科技本周再开源三款模型：LingBot-World 2.0 Small（1.3B）、Bidirectional（双向教师模型）与 Causal Pretrain（因果预训练底座）。其中 1.3B 版本面向消费级单卡 GPU 设计，可在单卡上实现实时生成。</p>
<p class="wp-block-paragraph">LingBot-World 2.0 是一个实时交互世界模型，支持小时级连续生成，可响应攻击、射箭、施法、射击等角色动作，以及下雪、下雨等环境事件。在更高算力与相应推理配置下，可达到 720P / 60FPS 的高清实时体验。技术架构上，模型接收相机位姿与文本指令两类控制信息：相机位姿通过位姿编码与自适应层归一化调整画面生成；文本指令通过交叉注意力机制关联不同视频片段的提示词，实现剧情动态更新。团队采用分布匹配蒸馏（DMD）应对长时生成中的累计漂移。系统还接入“导演—执行”框架，由视觉语言模型观察场景并提出事件，视频模型负责生成后续画面。其基础模型基于万相（Wan）开发，推理代码已适配 SGLang。值得注意的是，1.3B 版本采用商用开源协议，而 14B 版本为非商用，对中小企业更友好。</p>
<h2 class="wp-block-heading">14B 与 1.3B 到底差在哪</h2>
<figure class="wp-block-table"><table class="has-fixed-layout"><thead><tr><th>规格</th><th>14B 版本</th><th>1.3B 版本</th></tr></thead><tbody><tr><td>输出规格</td><td>720P / 60FPS</td><td>720P / 60FPS</td></tr><tr><td>开源协议</td><td>非商用</td><td>商用</td></tr><tr><td>部署硬件</td><td>服务器级</td><td>消费级独立显卡</td></tr></tbody></table></figure>
<p class="wp-block-paragraph">真正让一项技术扩散开的，往往不是最强的版本，而是第一个足够小、便宜、能被拿来尝试的版本。1.3B 的意义不在于参数少，而在于它把“能否跑起来”这个硬门槛拆掉了。过去世界模型更多停留在论文 demo 与在线体验，开发者只能“看”，不能“改”；现在可以本地运行、修改输入、测试交互设计、搭建原型。这对机器人仿真、游戏资产生成、具身智能训练数据的低成本合成，都是直接利好。</p>
<p class="wp-block-paragraph">与 Google Genie、Meta 及<a href="https://mylogs.cn/%e5%8f%b0%e7%a7%af%e7%94%b5-2nm-%e5%b9%b4%e5%ba%95%e6%9c%88%e4%ba%a7%e8%83%bd%e5%86%b2-12-%e4%b8%87%e7%89%87%ef%bc%8c%e6%8f%90%e5%89%8d%e4%b8%a4%e5%b9%b4%e8%be%be%e6%a0%87/">英伟达</a> Cosmos 等世界模型相比，LingBot-World 2.0 的差异化在于“实时交互 + 开源可商用 + 单卡可跑”三者同时成立。多数同类模型要么闭源，要么需要集群，要么仅支持离线生成。蚂蚁灵波同步开源 Causal Pretrain 与 Bidirectional，等于把后训练、评测、蒸馏、压缩、推理加速到场景适配的完整二次开发链路都交给了社区，降低了垂直场景小模型蒸馏的起步成本。</p>
<p class="wp-block-paragraph">从行业节奏看，世界模型正从“研究玩具”走向“生产力底座”。当单次生成能在消费级显卡上实时完成，它就不只是演示视频，而可以成为游戏引擎的素材生成器、机器人训练的仿真器、影视预演的草图工具。蚂蚁灵波用 1.3B 商用版把这条路铺到了个人开发者的桌面上，后续若能补齐动作多样性与长时序一致性，实用价值会进一步放大。</p>
<h2 class="wp-block-heading">什么是世界模型？</h2>
<p class="wp-block-paragraph">世界模型是一类能够基于当前状态与控制指令，实时生成后续画面与事件的生成式模型，常用于机器人仿真、游戏与具身智能训练。</p>
<h2 class="wp-block-heading">1.3B 版本和 14B 版本有什么不同？</h2>
<p class="wp-block-paragraph">核心差异在部署门槛与授权：1.3B 面向消费级单卡、采用商用协议；14B 需服务器级算力、仅限非商用，但生成质量与稳定性更高。</p>
<h2 class="wp-block-heading">个人开发者现在能做什么？</h2>
<p class="wp-block-paragraph">可在 Hugging Face 与魔搭社区下载 1.3B 模型，本地运行实时交互世界，并基于 Causal Pretrain 做后训练，或蒸馏出更小的垂直场景模型。</p>
<p class="wp-block-paragraph">本文基于蚂蚁灵波官方技术报告（arXiv:2607.07534）、IT之家公开报道及行业公开分析撰写。</p>]]></content:encoded>
					
		
		
			</item>
		<item>
		<title>Gemini Omni 1.1 Flash 发布：AI 视频可分段改、升 4K</title>
		<link>https://mylogs.cn/gemini-omni-1-1-flash-%e5%8f%91%e5%b8%83%ef%bc%9aai-%e8%a7%86%e9%a2%91%e5%8f%af%e5%88%86%e6%ae%b5%e6%94%b9%e3%80%81%e5%8d%87-4k/</link>
		
		<dc:creator><![CDATA[steve, zhang]]></dc:creator>
		<pubDate>Sun, 30 Aug 2026 06:53:41 +0000</pubDate>
				<category><![CDATA[科技]]></category>
		<category><![CDATA[AI工具]]></category>
		<category><![CDATA[AI视频生成]]></category>
		<category><![CDATA[Gemini Omni]]></category>
		<category><![CDATA[Google DeepMind]]></category>
		<category><![CDATA[生成式视频]]></category>
		<category><![CDATA[视频模型]]></category>
		<guid isPermaLink="false">https://mylogs.cn/gemini-omni-1-1-flash-%e5%8f%91%e5%b8%83%ef%bc%9aai-%e8%a7%86%e9%a2%91%e5%8f%af%e5%88%86%e6%ae%b5%e6%94%b9%e3%80%81%e5%8d%87-4k/</guid>

					<description><![CDATA[Google DeepMind 于 8 月 27 日发布 Gemini Omni 1.1 Flash，将此前预 [&#8230;]]]></description>
										<content:encoded><![CDATA[<p class="wp-block-paragraph">Google DeepMind 于 8 月 27 日发布 Gemini Omni 1.1 Flash，将此前预览版的生成式视频模型转为正式可用版本。新模型通过 Gemini API 在 Google AI Studio 中开放，并接入 Gemini Enterprise 智能体平台；普通用户可在 Google Flow（需 AI Plus、Pro 或 Ultra <a href="https://mylogs.cn/chatgpt-pro-%e9%87%8d%e5%bc%80-200-%e7%be%8e%e5%85%83%e6%a1%a3%ef%bc%9aapi-%e4%bb%b7%e5%80%bc%e8%bf%91%e7%bf%bb%e5%80%8d/">订阅</a>）中使用，Gemini App 则提供场景延伸功能。</p>

<p class="wp-block-paragraph">相比预览版每次调用只产出单条片段、几乎无法细化，1.1 Flash 新增了多项&#8221;控制&#8221;能力：场景延伸允许在已有片段后追加最多 10 秒新画面，单条序列累计上限 40 秒；首尾影格插值让创作者给定起始与结束两张画面，由模型生成中间运动；参考影片输入最长 3 秒，用于保持多段生成之间的视觉一致；360p 草稿模式可低成本快速试错，最终再以 1080p 或 4K 升频输出。模型同时处理文字、图片、音讯与视频输入。</p>

<p class="wp-block-paragraph">Google 给出的性能数据是：360p 草稿的生成速度比 720p 最快快约 60%，成本仅为其约三分之一。默认分辨率为 720p，1080p 与 4K 通过升频实现。</p>

<p class="wp-block-paragraph">在应用侧，Google 引用了两家企业客户的反馈。GMI Cloud 行销副总裁 Louisa Guo 表示，Omni Flash 的&#8221;准确性&#8221;对制作教育与讲解类内容尤为关键；Runway 首席创意官 Jamie Umpherson 称，该模型能自然融入既有的&#8221;提示词、图片或视频起步，再生成或编辑&#8221;的工作流。</p>

<p class="wp-block-paragraph">新模型代号 gemini-omni-1.1-flash，取代了早前的 gemini-omni-flash-preview。Google 提示，基于预览端点的开发者应尽早迁移，因为预览模型通常在正式版上线后被弃用。</p>

<p class="wp-block-paragraph">值得关注的是，1.1 Flash 支持带状态的多轮交互（stateful session），开发者可在同一会话中规划分镜、以 360p 草稿迭代、仅对通过品质门槛的片段做高清渲染。这意味着生成式视频正从&#8221;一次生成&#8221;走向&#8221;可组合、可编辑&#8221;的元件，便于嵌入自动化视频生产流水线。不过 4K 为升频而非原生渲染，长片仍需自行拼接，实际落地仍需额外评测与治理。</p>

<figure data-wp-context="{&quot;imageId&quot;:&quot;6ac3f0f6cb120&quot;}" data-wp-interactive="core/image" data-wp-key="6ac3f0f6cb120" class="wp-block-image size-large wp-lightbox-container"><img decoding="async" width="1300" height="731" data-wp-class--hide="state.isContentHidden" data-wp-class--show="state.isContentVisible" data-wp-init="callbacks.setButtonStyles" data-wp-on--click="actions.showLightbox" data-wp-on--load="callbacks.setButtonStyles" data-wp-on--pointerdown="actions.preloadImage" data-wp-on--pointerenter="actions.preloadImageWithDelay" data-wp-on--pointerleave="actions.cancelPreload" data-wp-on-window--resize="callbacks.setButtonStyles" src="https://mylogs.cn/wp-content/uploads/2026/08/gemini_omni_1_1_flash_20260827_header.webp" alt="Gemini Omni 1.1 Flash 生成式视频模型" class="wp-image-5663" srcset="https://mylogs.cn/wp-content/uploads/2026/08/gemini_omni_1_1_flash_20260827_header.webp 1300w, https://mylogs.cn/wp-content/uploads/2026/08/gemini_omni_1_1_flash_20260827_header-300x169.webp 300w, https://mylogs.cn/wp-content/uploads/2026/08/gemini_omni_1_1_flash_20260827_header-1024x576.webp 1024w, https://mylogs.cn/wp-content/uploads/2026/08/gemini_omni_1_1_flash_20260827_header-768x432.webp 768w" sizes="(max-width: 1300px) 100vw, 1300px" /><button
			class="lightbox-trigger"
			type="button"
			aria-haspopup="dialog"
			data-wp-bind--aria-label="state.thisImage.triggerButtonAriaLabel"
			data-wp-init="callbacks.initTriggerButton"
			data-wp-on--click="actions.showLightbox"
			data-wp-style--right="state.thisImage.buttonRight"
			data-wp-style--top="state.thisImage.buttonTop"
		>
			<svg xmlns="http://www.w3.org/2000/svg" width="12" height="12" fill="none" viewBox="0 0 12 12">
				<path fill="#fff" d="M2 0a2 2 0 0 0-2 2v2h1.5V2a.5.5 0 0 1 .5-.5h2V0H2Zm2 10.5H2a.5.5 0 0 1-.5-.5V8H0v2a2 2 0 0 0 2 2h2v-1.5ZM8 12v-1.5h2a.5.5 0 0 0 .5-.5V8H12v2a2 2 0 0 1-2 2H8Zm2-12a2 2 0 0 1 2 2v2h-1.5V2a.5.5 0 0 0-.5-.5H8V0h2Z" />
			</svg>
		</button><figcaption>图片来源：Google DeepMind</figcaption></figure>]]></content:encoded>
					
		
		
			</item>
	</channel>
</rss>
