氪友zLcg

【AI测评第三期】豆包的信息处理能力

豆包的信息处理能力依旧是让人哭笑不得,并且我认为豆包只能听懂最直白的对话,就像我必须对一个幼儿园小孩发出最简单的指令一样。 那有的人就要说了,“豆包的生图能力明明很强啊”。确实,豆包在结果上是做得很好的,但前提是简单直白的需求,但凡需求说得不够直接,豆包的“大脑”就宕机了。这一特征我依然不是第一次感受到了。 比如我今天需要用Porsche的图做UI设计,如图是我给豆包的指令,静静是希望图中的汽车能变小一点,但又怕豆包把场景不变,汽车变成玩具车了,于是我说“帮我生成图片:假如你是拍这张图的摄像机,现在请你离这辆汽车更远,让汽车在画面中的占比更小,但角度不变”,如果豆包是一位真人的话,她肯定找不到工作(来自一个最近找实习找疯了的大学生的吐槽),我明确说了角度不变,豆包同学硬生生给我把车子的角度变成了正面......和第一期我让豆包给我制作韩式证件照一样,莫名其妙地把我的脸变成了正脸,我严重怀疑这是字节想要炫耀强大算法的手段之一。 我用同样的指令把这张图发给了Gemini做处理,然后又用别的表述说了一遍,Gemini给了我两次和原图一模一样的图片,我记得我用的是正版啊,Gemini,下期吐槽你!
2026-03-06
该文观点仅代表作者本人,36氪平台仅提供信息存储空间服务。
评论区

快来抢占第一条评论 ~

说真实观点...
有用有用
评论评论
转发转发