青泥AI
今天测试了青泥AI,青泥AI作为一款给学术人作为学术服务的agent,其中主要包含AI论文选题,AI论文写作和AI论文综述等一系列AI学术的活动它和其他针对科研工作所产生的Agent一样主要是面向在学校的本科生,研究生和博士生群体的,今天就从一般性学术任务的从简单到复杂来测评青泥AI。
首先采用的任务是文献综述,这是学术测评任务的基石,因为文献综述主要是考察针对一项研究领域的论文资料调研和整理,这考察了Agent在大量资料调查的信息搜集能力和针对搜集好的信息进行整理的上下文交互能力。针对文献综述这一任务,笔者从个人熟悉的领域进行考察,发现青泥AI在文献综述领域表现良好,基本上可以完全覆盖一个研究课题下的主流相关文献,同时在这个基础上针对文献做出了整理和分类可以使得研究者通过文献综述更好的进行进一步的探索,但是在通过文献综述思考未来研究方向的上,青泥AI只给出了比较泛泛的研究思路这是在未来需要进一步提升的地方。
关于青泥AI来产生研究课题,笔者认为在这一任务种青泥AI表现得比较挣扎,主要体现在不能很好地组织研究方法和数据,这可能是因为科学研究本身需要更多得思维输入和整体协调,这是全世界AI产品都做的不好得地方。
2026-03-10
该文观点仅代表作者本人,36氪平台仅提供信息存储空间服务。
评论区
快来抢占第一条评论 ~