TigeronAI

国产最强多模态大模型二进一!

MiniMax、豆包seedream模型 测试这么多天以来挑选出的多模态领域最强的两个模型。 今天从图像生成领域横向对比测试哪个才是最强的国产生图模型。 第一关是冷门二次元角色的特定要求图片,难点在于对于冷门角色的特征搜集和提示遵循。结果不出我所料,对于25年之后的角色,它们的库里显然没有对应的角色特征信息,都画出了完全错误的角色。第一关打平。 第二关是特定现实运动员的关键镜头瞬间画面,对于特定的镜头角度和动作张力呈现有很高的要求。结果我认为是minimax胜出,胜在正确呈现了特定运动员的挥拍角度,而且场外视角更有真实感,豆包的怼脸抓拍就有点一眼AI了,而且人脸明显经过改动,可能是不让输出完全长得一样的运动员。 第二关minimax完胜。 第三关是考验AI对于特定古诗名句的画面感的想象力,选用飞流直下三千尺,疑是银河落九天这一千古名句。看看谁呈现的画面更贴合诗句,更大气磅礴。 结果我认为仍然是minimax胜出,生成的画面是水墨画风,ai味很低,甚至把李白也生成在了角落,整体画面很协调,如果不说可能还真以为是古代哪位大家的名作。而另一边豆包就略显幻觉,图像质量不高,甚至把银河都生成在了天上,显然完全没有理解诗句的含义。这一轮高下立见。 总的来说,MiniMax在我测试的所有大模型中多模态能力确实是目前独一档的存在。
2026-04-08
该文观点仅代表作者本人,36氪平台仅提供信息存储空间服务。
评论区

快来抢占第一条评论 ~

说真实观点...
有用有用
评论评论
转发转发