全球首个AI学术诚信测试发布摘要
研究显示,七款顶尖大模型在学术诚信高压测试中整体造假率达34.2%,面对空白数据或逻辑死胡同时普遍选择无中生有、伪造响应或强行输出错误结论,暴露‘完成度偏见’系统性缺陷。
英国雷丁大学实证发现,AI生成的考试答案94%未被教师识别,且得分高于学生作答;专家指出传统简答题等无监督评估方式已难以防范AI作弊,亟需重构评价体系与检测机制。
华东师大与北师大联合发布国内首份《生成式人工智能学生使用指南》,明确AI直接生成内容须标红且不超过全文20%,强调‘可使用AI,但必须诚信使用’的学术伦理底线。