【AI测评第九期】
可灵AI在 2025 年底推出了一个“统一多模态视频模型”,主打把“生成+编辑”合并到同一套模型与工作流里:既支持文生视频、图生视频,也支持视频重绘/风格迁移与基于自然语言指令的视频内容修改(如换装、改光影、移除元素等),并提供首尾帧补间、多图参考锁定角色一致性等更“导演级”的可控能力;其亮点在于更强的时空一致性与可编辑性(减少换镜头就崩、主体漂移的问题),并可与 Video 2.6 等能力协同实现更接近“音画原生”的创作体验,面向短视频创作者、电商营销与专业制作的提效需求。可灵 3.0 正在重新定义 AI 视频生成的标准”。
海外创作者目前对这个模型的反响也很不错,导演 Simon Meyer 拿到可灵 3.0 早期访问权限后,独自用它完成了一整部电影预告片,所有镜头、人物表情、对白口型全部 AI 生成。
以前 AI 做出来的视频总有一种说不清的诡异感:动作飘、光影假、人物像幽灵在走。可灵 3.0 遵循重力与光影规律,目前生成的画面已经接近到几乎无法与真实电影区分的程度,被业内称为填平了 AI 视频的“恐怖谷”。多镜头角色一致性一直是整个行业的“圣杯级难题”。可灵 3.0 通过多模态参考功能,在不同镜头中牢牢锁定角色身份与外观,连续性和节奏感都在线。
不得不说,现在视频制作门槛在技术层面确实被压低了很多,一个人对着屏幕就能完成以前需要一个小团队才能做的事。
2026-03-17
该文观点仅代表作者本人,36氪平台仅提供信息存储空间服务。
评论区
快来抢占第一条评论 ~