4名农科大学生出专业题测试AI 多款主流大模型得0分引热议

近日,话题#4名大学生出题 AI考了0分#登上全网各大平台热搜,引发公众对人工智能能力边界的广泛讨论。

此次出题的4名大学生均为华中农业大学植物科学技术学院的在读农科学生,他们结合日常专业学习、田间实践积累的一手经验,整理出10道涉及作物病虫害辨识、农业生产实操判断的专业考题,对市面多款主流生成式大模型进行作答测试。

最终测试结果显示,所有参与测试的大模型正确率为0,没有答对任何一道题目,部分答案甚至出现了明显违背农业生产常识的低级错误。 参与出题的学生在采访中表示,此次的考题均未在公开网络平台公布过标准答案,部分题目还结合了湖北当地的耕地条件、作物种植习惯设定场景,没有下地实践经验的人很难做出准确判断。

这类偏向一线实操的专业判断,无法仅靠公开语料训练推导出正确答案,比如其中一道涉及小麦条锈病田间辨识的题目,多款AI都混淆了条锈病与叶锈病的发病特征,给出的答案和实际田间观测结果完全不符。

人工智能领域相关研究人员表示,此次测试的结果暴露了当前生成式AI的普遍短板。

目前主流通用大模型的训练高度依赖公开网络语料,对于缺乏大量公开标准化内容、需要实操经验积累的垂直细分领域,很容易出现事实性错误,甚至生成完全违背行业常识的内容

这一测试也给行业提了醒,垂直领域的AI落地不能只依赖通用大模型,需要补充专业一手数据、引入行业专家参与内容校准,才能避免错误输出带来的实际损失。 不少网友表示,此次测试打破了不少人对AI的“万能滤镜”,也证明了一线实践经验的不可替代性。

据了解,4名出题学生后续计划整理更多农业领域的专业考题,用于相关农业专用AI的训练校准,助力智慧农业的落地推广。

网友留言(0 条)

发表评论