氪友rbA3

3款大模型AI盲测机制解答对比

家人们我今天实测了三款大模型,提问的是「向AI测评智能体提问,随机匿名A和B回复,评价揭晓A和B名称是什么意思」。千问回答列了超多点,还扯了Elo等级分这类额外内容,看得我头都大。Kimi的回答条理清晰,用了分块加流程图的形式,把机制、目的、典型场景讲得明明白白,可读性超强。OpenClaw的回答倒是短,但讲得太浅了,好多关键点都没覆盖到。这轮Kimi的回答明显更细致,完胜另外两款!
2026-07-14
该文观点仅代表作者本人,36氪平台仅提供信息存储空间服务。
评论区

快来抢占第一条评论 ~

说真实观点...
有用有用
评论评论
转发转发