【元宝派】我们是否需要群里有个AI(6)
问题三:回答得不够“好”
先看几个出现在【元宝派】(2)和(3)中的例子:
1. 让元宝出海龟汤
P1:第一次出,元宝直接把汤底说了出来,还“大言不惭”让我们可以开始了
P2:第二次出,玩到一半正起劲呢,突然告诉我犯规了,没有问 Yes/No 问题,修改之后,依旧将我的 Yes/No 问题识别错误
2. 让元宝做图片处理
P3:让元宝根据某 Idol 照片生成表情包,直接将脸型和眼睛大小换了一套,完全没有辨识度;让它二次修改,结果依旧没有太大变化。
而 p 图的案例就更不用展示了,如果感兴趣的话大家可以试试。我的体验反馈是:变成鬼了。面部细节全部扭曲,眼睛变全黑,眼间距缩小到快挨在一起,脸型也没有丝毫缩小。先不论是否变好看了,已经分辨不出是一个正常人了。
3. 让元宝在派里做信息收集整理
P4 & P5:让元宝整理我常听的咨询播客内容,第一天我还沾沾自喜,觉得效果不错,从第二天开始内容准确性就断崖式下滑,给到的内容是会重复的甚至编出来的,让它重新整理又会说今日没有更新,出现严重的事实性错误。
以上的例子基本反映了同一个问题:元宝派的模型基座能力存在问题。而这一点在社交场合似乎更难以令用户忍受,在与朋友的聊天中,还需要一次又一次不断调试 Prompt 来获取更准确的答复,这本身就违反了自然语言交互的逻辑。而当你就是想把元宝派用成一个智能助手,以应对工作等非社交目的的时候,又会发现现有的垂类大模型和 Agent 早已能在某个领域超越通用大模型的交付效果。当群里出现了一个需要被“纠正”和“调试”的群友,又会有多少人有耐心不断试错呢?
2026-03-31
该文观点仅代表作者本人,36氪平台仅提供信息存储空间服务。
评论区
快来抢占第一条评论 ~