五大AI大模型测评Day7
今天测评的是大模型的多模态能力,由于ds和kimi暂时没有图像生成,今天不参与测试。
提示词是生成一张二次元风格的插画:一个抱着民谣吉他弹唱的短发女孩,背景是黄昏下的校园操场,光影柔和,细节丰富。
表现最好的是豆包,不愧是近期多模态表现最强的带来全民创作的seedance模型,图像质量很高很有日漫味,画面渲染也很真实,AI感很弱,提示词遵循也很到位,基本没什么短板,属于是稍加修饰就可以商用的程度。豆包多模态能力这块个人认为确实是可以放到国际上打打的实力。其次是表现平平的智谱清言,AI感有点重,感觉还停留在前年豆包生图或者是早期的stable diffusion生图的水平,真要生产力只能说是图一乐。虽然它的文本能力确实是佼佼者,但是多模态这块还有待加强。最后一档是完全不遵循提示词的文心4.5turbo生图模型,说是二次元风格给我生成一个现实的图片有点难评。不过文心5.0没有生图功能,如果有的话相信不会是这个水平。只能说未来可期。
2026-03-20
该文观点仅代表作者本人,36氪平台仅提供信息存储空间服务。
评论区
快来抢占第一条评论 ~