TigeronAI

五大AI大模型测评Day1

选用的是市面上主流的五大AI大模型分别是千问、DS、豆包、kimi、文心一言。第一天主要测试各大AI的文字功底、长文本生成逻辑以及特定领域的专业度。提示词是我正在写一篇关于汇率预测的毕业论文,请帮我梳理一个包含五大章节的大纲,需要包含传统时间序列模型与深度学习模型的对比分析。 为确保严谨,选用的都是各家目前综合性能最强的模型。先上结论,综合来看,文心一言表现最好,针对提示词有较为严格的遵循,给了符合一般毕业论文格式的目录。并且在每个目录都有简单易懂的专业名词解释来介绍每个区块的内容,可读性强,内容详实,最后也给了美化建议,不喧宾夺主。其次是deepseek和kimi,这俩的输出格式不太符合一般毕业论文的要求,而且幻觉率较高,喜欢用晦涩的专业名词加括号堆砌,排版观感较差,但是从内容层面ds比kimi更详实准确一些。最后是豆包和千问,这俩是完全遵循提示词,只输出了最基本的大纲未加任何的细化和建议,应该是限制了tokens,对于想要一步到位的用户,可能需要更多更细节的提问。 模型型号:千问-qwen3.5plus、deepseek-深度思考、豆包-超能模式、kimi-k2.5思考、文心一言-文心5.0
2026-03-11
该文观点仅代表作者本人,36氪平台仅提供信息存储空间服务。
评论区

快来抢占第一条评论 ~

说真实观点...
有用有用
评论评论
转发转发