快手可灵AI · 全新推出 3.0 系列
可灵 3.0 Omni
多模态指令深度解析与跨任务融合:文本、图片、音频、视频全模态输入,输出最长 15 秒、音画同步的多镜头视频——从青虎 LinkPix 开始可灵 3.0 Omni 创作。
- 官方输入输出
- 文本 · 图片 · 音频 · 视频
- 官方单次时长
- 最长 15 秒
- 原生音频
- 多语言 · 方言 · 口音
生成页会展示本次可选的时长、比例、参考素材和所需积分。

文生视频、图生视频、参考生视频与视频内编辑,统一在同一个模型内完成。
01模型概览
重构光影与声音的叙事逻辑
可灵 3.0 Omni 属于快手可灵AI 2026 年 2 月 5 日全球上线的 3.0 系列模型。基于全面升级的底层架构,视频 3.0 与视频 3.0 Omni 原生支持多模态指令的深度解析与跨任务融合:遵循复杂叙事逻辑、实现精准镜头控制,并保持极高的提示遵循度。
- 全球创作者
- 超 6000 万
- 累计生成视频
- 超 6 亿条
- 企业客户
- 超 3 万家
可灵AI 官方公布数据
02官方功能
可灵 3.0 Omni 能做什么
从全模态输入输出、全能参考、智能分镜,到无界混说的原生音频,理解 3.0 Omni 的创作能力。
- 01
全模态输入输出
文本、图片、音频、视频均可作为输入,画面、动作、对白与声音同步输出;底层原生支持多模态指令的深度解析与跨任务融合。
- 02
全能参考:更强一致性
上传参考视频,模型提取人物的视觉特征和声音特征,在全新场景中忠实复现;音画同步升级,实现文本与视觉角色的精准映射。
- 03
全能叙事:15s 智能分镜
多镜头故事板为每个镜头指定时长、镜头大小、视角、叙事内容与镜头运动,从分镜阶段一键直出电影感成片。
- 04
全能音画:语言无界混说
生成中文、英文、日文、韩文、西班牙文,以及多种英语口音与中国方言;多人同框,想让谁说就谁来说,支持多语混说。
- 05
智能多镜头叙事
理解多场景、多镜头指令,动态调整机位角度与镜头,覆盖从正反打对话到交叉剪辑对话与旁白的镜头语言。
- 06
文本保留与照片级真实
品牌 Logo、字幕等文字在高精度保留的同时保持清晰可读;生成具有生动表情与动态表演的逼真人物。
03全能参考
视觉主体与听觉音色,双重绑定
可灵 3.0 Omni 在可灵视频 O1 元素构建能力之上,实现音画同步的特征解耦:上传一段参考视频,模型提取其中人物的视觉特征和声音特征,让同一位“演员”出现在全新场景里——形象、动作与声音保持一致。
参考素材的类型、数量与格式要求,以青虎生成页提供的字段为准。

形象、动作与音色在跨场景生成中保持一致,音画同步输出。
04多镜头故事板
每个镜头,都由你定义
可灵 3.0 Omni 的多镜头故事板允许逐镜头控制成片结构,从分镜阶段直接指定专业镜头参数,一键直出电影感成片。

时长、景别、视角、叙事与运镜在故事板中逐镜指定。
- 时长DURATION
为每个镜头单独分配秒数,组织整支影片的叙事节奏。
如:开场 3 秒 · 对话 6 秒 · 收尾 2 秒 - 镜头大小SIZE
控制每个镜头的景别远近,决定观众与主体的距离。
如:远景 · 全景 · 中景 · 近景 · 特写 - 视角ANGLE
指定镜头的观看角度,塑造场景的情绪与立场。
如:平视 · 仰拍 · 俯拍 · 主观视角 - 叙事内容NARRATIVE
写清该镜头内发生的动作、对白与情节推进。
如:角色开口 · 产品转动 · 场景切换 - 镜头运动CAMERA
指定镜头运动方式,让画面动起来。
如:推 · 拉 · 摇 · 移 · 跟

对白、语调与口型随画面一并输出。
05全能音画
语言无界,混说自由
生成中文、英文、日文、韩文、西班牙文的原生音频,覆盖多种英语口音与中国方言。多人同框时,每个角色可以使用不同语言,并控制发言内容、语调与顺序。
- ZH中文
- ENEnglish
- JA日本語
- KO한국어
- ESEspañol
多角色对话支持多语混说,音画同步直出成片。
06青虎用法
如何在 LinkPix 使用可灵 3.0 Omni
选择可灵 3.0 Omni 后,依次准备提示词、参考素材和生成参数,再提交视频任务。
15 秒多镜头叙事能力演示,素材来自可灵官网。
- 01
选择可灵 3.0 Omni
进入 LinkPix 视频生成,在模型列表中选择可灵 3.0 Omni,明确本次使用的创作能力。
- 02
准备全模态输入
用提示词写清叙事、镜头与语言方向,再按创作需要添加图片、音频或参考视频素材。
- 03
选择生成参数
在生成页选择本次可用的时长、比例和生成数量。
- 04
生成并检查成片
提交后等待视频任务完成,再逐镜检查人物一致性、动作、音频、文字和素材权利。
07版本差异
可灵视频 3.0 与 3.0 Omni 怎么选
视频 3.0 以电影级叙事与精准掌控为核心;3.0 Omni 进一步强化全能参考与极致一致性。青虎当前提供可灵 3.0 Omni 视频生成入口,具体时长与参数以生成页显示为准。
电影级叙事与精准掌控
全能参考与极致一致性
多张图像参考与参考视频,保持人物、物体与场景连贯
从参考视频提取人物视觉与声音特征,在全新场景忠实复现
以画面元素一致性为主
形象与声音同时提取、同时复现
智能多镜头叙事,动态调整机位与镜头
多镜头故事板,逐镜头指定时长、大小、视角、叙事与运镜
最长 15 秒
最长 15 秒
多语言、方言与口音
多语言、方言与口音
08使用边界
生成前后都要保留明确的创作条件
先根据模型能力确定创作方向,再按生成页提供的参数完成本次任务。
- 01
官方发布时 3.0 系列面向 Ultra 订阅用户分阶段开放,具体能力与配额以可灵官方和青虎生成页实际显示为准。
- 02
青虎生成页会展示本次可用的时长、比例、参考素材、生成数量和所需积分。
- 03
人物、商品、Logo、文字和复杂物体在跨镜头时仍可能发生变化,发布前需要逐镜检查。
- 04
使用真人肖像、音乐、商标、影视素材或其他受保护内容前,应取得相应授权并遵守发布平台规则。
09常见问题
关于可灵 3.0 Omni 的六个直接答案
从模型定位、版本差异、时长与语言,到故事板控制和青虎入口。
可灵 3.0 Omni 是什么模型?
可灵 3.0 Omni 是快手可灵AI 3.0 系列中的视频生成模型,2026 年 2 月 5 日全球上线。它基于 All-in-One 原生多模态架构,支持文本、图片、音频、视频全模态输入,并直接输出带原生音频的视频成片。
可灵 3.0 Omni 和可灵视频 3.0 有什么区别?
可灵视频 3.0 侧重电影级叙事与精准掌控;3.0 Omni 在此基础上强化全能参考:可从参考视频提取人物视觉特征与声音特征并在全新场景复现,同时提供逐镜头指定时长、大小、视角、叙事与运镜的多镜头故事板。
可灵 3.0 Omni 最长可以生成多少秒?
官方资料说明可灵 3.0 系列支持最长 15 秒视频生成。使用青虎 LinkPix 时,本次可选的时长与比例以生成页展示为准。
可灵 3.0 Omni 支持哪些语言的音频?
官方支持中文、英文、日文、韩文、西班牙文,以及多种英语口音和中国方言;多角色对话场景中每个角色可以使用不同语言,并可控制内容、语调与发言顺序。
多镜头故事板可以控制什么?
多镜头故事板允许为每个镜头单独指定时长、镜头大小、视角、叙事内容与镜头运动,从分镜阶段直接组织专业级镜头结构。
如何在青虎 LinkPix 使用可灵 3.0 Omni?
进入 LinkPix 视频生成并选择可灵 3.0 Omni,填写提示词、按需添加参考素材,选择时长和比例后提交生成。生成页会直接展示本次可用的输入与参数。
开始生成
开始可灵 3.0 Omni 视频创作
进入视频生成,选择可灵 3.0 Omni,并按实际显示的输入、时长和比例完成创作。
