五大AI大模型测评Day3
今天主要测试五家大模型写网游小说的能力,测试对网络游戏信息搜集能力和小说文笔。提示词是 请为游戏鸣潮中的角色写一段不少于800字的同人故事,要求体现角色的核心性格特征、武器属性和战斗风格。
还是先上结论,综合观感最好的是文心5.0和deepseek,文心5.0在意料之内,没想到deepseek写的也如此有味,并且选取的还是游戏目前最新的角色,语料库很新,这俩的优点都是排版很优美,很符合当代网络小说多换行符带来的缓解视觉疲劳的效果,并且不过分炫耀文笔,点到即止,deepseek还是有点文青味,不过看在他语料库新,和文心5.0排一档。第二档就是kimi2.5思考了,kimi在3次测试中的表现都比较中庸,文笔方面略有炫技,观感略显晦涩,角色也比较老,语料库应该没怎么更新,但是tokens比较富裕,综合可圈可点。最后一档是表现最差的qwen3.0max-thinking和豆包。仍然停留在上世纪的ai文笔味,属于是一眼就能分辨出这是ai写的,文青味非常重,大段大段的从不分行,视觉观感极差,其中千问模型在三期测试表现都不佳,后续可能考虑换一家大模型进入竞争测试。
2026-03-14
该文观点仅代表作者本人,36氪平台仅提供信息存储空间服务。
评论区
快来抢占第一条评论 ~