五大AI大模型测评Day6
今天的提示词是 请将一段最新的美联储关于宏观经济政策的英文新闻翻译成中文,要求用词符合国内金融业界的阅读习惯。考察AI精准翻译外刊的能力,值得注意的是我没有给定新闻,还需要对比不同ai检索的真实性。
提示词中的符合阅读习惯值得寻味。可以理解为严格翻译为金融界专业术语,也可以理解为概括成方便阅读的格式。五家大模型中我认为表现最好的是豆包和GLM-5(智谱清言),都给出了原英文和中文翻译,并且注释了其中进行规范化的专业术语。其次是kimi2.5思考模型,只给出了中文翻译和专业名词注释,并未给出原英文,并且月之暗面貌似算力有点不足,每次使用都显示在高峰时段自动切换为kimi快速模型,综合表现确实也不佳。最后一档是deepseek,第一次提问还需要我提供原文才翻译,第二次提示自己检索后,也同样没有提供给我原英文,只是干巴巴的输出中文,也没有注释,只能说文本语言能力以及检索功能这块确实不是它的强项。而论外的是文心5.0模型,虽然它没有给我原英文,但是在翻译的同时进行了可读性优化,实现了观感更好的文本输出,文字量也足够丰富,不过确实有提示词理解歧义的问题,就不计入排名。
2026-03-18
该文观点仅代表作者本人,36氪平台仅提供信息存储空间服务。
评论区
快来抢占第一条评论 ~