我们的服务符合学术规范和道德
专业 高端让您使用时没有后顾之忧

中国电化教育2025年第11期:语文整本书阅读场景下大语言模型阅读理解能力评测研究

来源:期刊VIP网 时间:


作者:魏顺平;刘欣怡;张悦;董艳;

单位:中央民族大学教育学院;数字化学习技术集成与应用教育部工程中心;深圳市龙华中学;北京师范大学教育技术学院;

摘要:随着教育数字化转型以及义务教育均衡发展的需求,大语言模型作为新兴的通用认知工具,正逐步应用于“整本书阅读”等语文教学场景。大语言模型能否理解经典名著,是决定其能否有效赋能语文整本书阅读的关键因素。基于此,文章构建了一个包含14部名著、500道选择题的测评数据集,覆盖语言特色、逻辑推理等10类问题,系统评估Deep Seek-V3、Qwen2.5-7B-Instruct等10个主流大模型的阅读理解能力。结果表明:(1)大语言模型总体正确率达82.5%,可以理解中学阶段的名著,其中国内模型表现显著优于国外模型,不同参数规模的大模型的表现不存在显著差异;(2)基于10个大语言模型的得分计算每道题的难度并绘制不同难度的题目频率分布,该分布为幂律分布而非常见的正态分布;(3)大语言模型的小说类名著与文言类名著阅读理解表现较弱,在生成创造任务中优势显著而在细节提取等精准定位任务中表现欠佳等。文章针对大语言模型在整本书阅读领域的应用提出面向教学层、内容层与技术层三个方面的建议,为推动整本书阅读教学提供智能化解决方案。

关键词:初中语文;;整本书阅读;;认知工具;;大语言模型;;阅读测评

基金资助:数字化学习技术集成与应用教育部工程研究中心2024年创新基金项目“面向人工智能的终身教育领域高质量数据资源治理与应用研究”(项目编号:1441001);; 中央民族大学2022年铸牢中华民族共同体意识滚动支持项目“面向群体中华民族共同体意识的数据密集型评价模型构建及其应用研究”(项目编号:2022MDZL13)研究成果