最'潮流'的大模型花落谁家?
说是最潮流,其实是测试目前市面上主流LLM中哪家大模型的训练数据最新最前沿,虽然联网搜索可以弥补信息滞后性,但是训练后的数据分析能力和主动去网页扒取信息并分析所消耗的算力显然有区别,使用联网搜索的信息也较为片面,所以对比得出具有最新训练数据的AI还是有必要的。
参与测试的ai有文心、智谱、豆包、DS、kimi、千问。
首先不开联网搜索的情况下询问今天日期,只有DS和智谱回答错误,ds还算诚实,直接回答知识库没有今天的日期;智谱就有点犯病了直接编了一个24年的日期给我,可能这就是它知识库的最新日期。
第二个问题直接问知识库最新日期是几号,大部分都是在25年左右,而最早的竟然是在之前测试表现最好的文心模型,是23年10月,不过它给出了静态知识和动态知识的概念,确实部分ai如qwen、豆包、kimi、文心等界面并没有联网搜索的开关,而是它们默认根据用户需求主动的开启联网搜索,而不是受用户被动开启。
这点我认为还是利大于弊的,虽然更消耗算力,但是具备动态知识迭代的内在能力的大模型输出质量平均总会更高一些。
2026-04-12
该文观点仅代表作者本人,36氪平台仅提供信息存储空间服务。
评论区
快来抢占第一条评论 ~