DeepSeek纯文本模型无法生成视频或图片
DeepSeek在最新推出时,我就开始接触使用了,以最近一次我的使用为例。
我让DeepSeek根据目前所发布的关于张杰鸟巢演唱会最新舞台的效果,让它生成视觉的图片,它能在短时间内根据我给出的“抖音舞台视频”这个线索,快速整合信息,通过抖音微博等途径搜集到相关的信息,获取演唱会已知的核心视觉元素(时光列车、机器人方阵、双向镜像舞台、星海等),并将其拆解成场景、视觉描述、背景、特效等维度,不是仅停留在“很美、很震撼”这种空泛的表达,而是给出了一些具体的装置名称,但是同时也暴露出来了DeepSeek的劣势,就是它不支持图像生成和视频生成,是纯文本模型,没能实现多模态的生成,在文本生成方面,内容确实非常的丰富且充实,但是并不能满足我生成图片的需求,希望DeepSeek未来能够继续精进,能够支持图片的生成和视频的生成。
2026-03-27
该文观点仅代表作者本人,36氪平台仅提供信息存储空间服务。
评论区
快来抢占第一条评论 ~