来源:期刊VIP网 时间:
作者:王亚敏;宾帅;赵杨;
单位:北京大学对外汉语教育学院;
摘要:本研究面向中文二语阅读测试研发的真实场景,通过多环节多视角的实证研究,系统验证了大语言模型赋能中文二语测试研发的可行性,初步构建出一条人机协同模式下的测试研发路径,涵盖“模型自动生成-质量系统评估-人机协作修改-学习者实测应用”四个核心环节。基于主客观指标的测评结果发现,模型生成试题与HSK真题在语篇输入、预期回答和整体质量上具有可比性。面向240名学习者的实测分析表明,生成试题具备良好的信效度和难度区分能力,能够较为准确地评估中文二语学习者的阅读能力。最后,我们总结了GPT-4应用于中文二语阅读测试生成的优势与局限,为国际中文教育考试现代化和智慧考试提供参考建议。
关键词:阅读测试;;大语言模型;;自动试题生成;;智慧考试
基金资助:国家社科基金重大项目“对标国际中文教育的二语习得理论创新研究”(编号:23&ZD320)资助