来源:期刊VIP网 时间:
作者:宋冰冰;刘立华;
单位:北京航空航天大学外国语学院;
摘要:本研究以政治演讲文本的及物系统标注为例,对比评估了包含大语言模型在内的4款标注工具的标注效果,并就其应用过程中出现的倦怠问题和幻觉问题展开了探讨。研究发现,新一代推理模型DeepSeek-R1和OpenAI o3-mini-high识别小句的精细度虽然略逊于传统标注软件UAM CorpusTool 6.2j,但强于基础通用模型GPT-4o mini;伴随输入文本长度的减小,其倦怠问题有所缓解,识别精细度得到了显著提升;其基于自身的语义理解和语境整合能力实现了对零句的识别标注,整体及物过程标注正确率达到了较高水平。基于此,本研究认为大语言模型,尤其是新一代推理模型作为自动标注工具应用于文本分析具有巨大潜力。
关键词:大语言模型;;文本分析;;及物系统;;DeepSeek;;OpenAI
基金资助:国家社科基金项目“批评话语研究视角下的中美官方话语互动研究”(编号:20BYY077)的阶段性成果