4名大学生出题 AI考了0分 4名大学生出题 AI考了0分 瑞士联邦理工学院(EPFL)数学数据科学实验室发布一项研究,指出主流AI模型在面对部分简单题目时存在缺陷。研究团队通过研究生课程学生提交的题目,构建了包含235道题目的“blind-spots-bench”盲点基准测试集,旨在量化AI在标准考试之外的性能盲区,并对38个主流AI模型进行了评测。