GOOD猫柠

星火大模型测评

今天测评了一下讯飞的星火大模型,在中国大模型赛道中讯飞公司一直声量较小,同时在技术积累领域科大讯飞一直以在语音领域的技术积累比较丰富,而在大模型关注的文本和多模态领域则相对技术知名度没有那么高,作为一款基座模型,一直没有很好的体验星火大模型,今天以一般的评价维度来评价一下星火大模型。主要从上下文处理,多模态生成和代码辅助领域来测评。 首先是上下文处理领域,从实际体验来看星火大模型的上下文处理和Kimi,豆包大模型水平相当比文心一言的上下文处理能力要强但是比deepseek上下文处理能力要弱。具体来说就是处理一定长度的上下文时星火大模型可以较好的理解上下文表达的意思并且可以做出比较有效的推理,当上下文长度变长时星火大模型会出现比较明显的幻觉,并且随着推理步骤的增长会出现比较明显的误差累计。在多模态生成领域,讯飞星火大模型的能力较差,生成的图片虽然可以基本反映文字提示内容但是在生成风格和抽象表达领域比较差。 星火大模型做的比较好的是UI界面有可以直接针对办公辅助生成的提示界面,但是在编程语言上面个人觉得和文心一言能力相当,不如这个kimi和豆包大模型,但是在办公辅助领域做的比较好这个是比其他大模型要强。
2026-03-04
该文观点仅代表作者本人,36氪平台仅提供信息存储空间服务。
评论区

快来抢占第一条评论 ~

说真实观点...
有用有用
评论评论
转发转发