来源:期刊VIP网 时间:
作者:汪梦翔;
单位:北京联合大学师范学院;
摘要:本文探讨了基于多信息资源的汉语复合词自动生成方法,该方法旨在生成两类结果:一是生成已有的近义词,二是生成未登录的新词。两类结果的生成均涉及语素的替换。本文从语素层面入手,依据语言学中的平行周遍规则,首先界定可替换语素的取值范围;随后,结合语素词典的释义文本与How Net中语素间关系的知识,构建基于多信息资源的MIFSSM模型(多信息融合语义相似度模型),生成具有语义近似序列且能区分不同义项的近义语素集;最后,选用适当的组配规则对替换后的语素进行新的组合,并利用Chat GPT进行人机互动式评估。实验结果表明,在有限的预训练数据集下,该方法仍能有效且高质量地生成汉语复合词。
关键词:多信息资源;;复合词;;自动生成;;平行周遍规则;;词向量
基金资助:教育部人文社科基金青年项目“省略型汉语动名超常搭配的语义组配机制及处理方法研究(22YJC740073)资助