氪不改命

豆包VSdeep seek(deep seek篇)

今天我想从一个比较新颖的角度来切入问题,让AI自己来测评自己会发生什么事情呢 我将依旧沿用上一篇的思路,依旧是一场对比测评,首先是deep seek,我先让deep seek自己来测评自己,分别三次,一次是深度思考,一次是智能搜索,一次是深度思考+智能搜索,让我们一起来看一下deep seek是怎么评价自身的吧 首先deep seek提到这次对自身测评的三个主要维度,也和最后其认为一个优秀的AI助手所需注意的三个品质对应起来 deep seek提到了功能性表现,用户体验和伦理规范,然后以此来延申出了“他”认为的测评“他”所需要注意的7个方面,或者说“他”认为测评AI应该去测评的7个方面 分别是: 1.知识储备 2.逻辑与理解 3.表达 4.安全 5.实用价值 6.创造力的向人化 7.认知边界 deep seek 在三次不同选项的回答中,也表达出了不同 在单独的深度思考中,deep seek 的表达相比后面的其他两个回答会更加扁平化,给人的感觉更加理论化,学术化 在单独的智能搜索中,deep seek 的表达显得没有那么僵硬,也许是举了较多例子的原因,还有表达用词上,最后也给出了一个结论,显示出了一种谦虚的感觉 在两者都勾选的情况下,deep seek选择了第一次深度思考的内容作为核心内容,选择第二次智能搜索的风格及表达,在思考过程的小字里,deep seek选择一个更加有趣的框架,具象化的标签,比喻的表达方式,更加生动简洁,最后还懂得来个开放式结尾,增强互动性 最后我给他抛出个问题中,deep seek给自己进行评价,从7个不同的维度进行打分,看来“他”很懂人类爱看什么,知道大家不喜欢虚头八脑的东西,分别是80,85,78,90,82,75,95,最后总结下来给自己打了82分,与他自己说的“阶段性合格,但永无止境”的分数是一样的 最后deep seek 认为一个优秀的AI助手需要平衡准确性,同理心与边界感,这次的测评当中我改变了一些之前的看法,deep seek 虽然只有冰冷的文字,但他在用他所有可以的方式来揣摩你,用自己可能不怎么擅长的表情来回复你,来显得不那么僵硬,“他”就像“他”自己说的一样,像个笔友,用文字会回复你,用深度思考聆听着
2026-03-07
该文观点仅代表作者本人,36氪平台仅提供信息存储空间服务。
评论区

快来抢占第一条评论 ~

说真实观点...
有用有用
评论评论
转发转发