kk77

通义万相视频是如何生成的?

今天体验了一下阿里通义万相的视频生成,现在来给大家说说通义万相视频怎么生成? 最基础的是文生视频和图生视频,跟大多数AI视频工具逻辑差不多。你输入一段提示词,或者上传一张图片,它就能给你生成一段视频。我先让deepseek给我生成了一个镜头的脚本,然后投喂给通义万相,它只能生成五秒钟的短视频,整体节奏很快,可能是我给的镜头太多,人物的表情还是有些生硬不自然,不容易让人有共鸣。 我还体验了首尾帧生成,你给两张图片,一张开始、一张结束,比如一张狐狸的照片和一张白衣少女的图片,再输入一句“狐狸转身变成月光下的少女”,它就会自动脑补中间的过程,把两个画面流畅地衔接起来。 最让我上头的其实是角色扮演功能。你上传一段5秒以内的个人视频,它能把这个形象“抠”下来,记住你的长相、神态甚至声音。然后你只需要输入一段文字描述,就能让这个形象去演科幻片、古装剧,甚至在大街上吃面,而且能保持人物的高度一致性。 总的来说,他的功能还是不太完善。。
2026-04-17
该文观点仅代表作者本人,36氪平台仅提供信息存储空间服务。
评论区

快来抢占第一条评论 ~

说真实观点...
有用有用
评论评论
转发转发