我们的服务符合学术规范和道德
专业 高端让您使用时没有后顾之忧

语言文字应用2024年第04期:基于多信息资源的汉语复合词自动生成研究

来源:期刊VIP网 时间:


作者:汪梦翔;

单位:北京联合大学师范学院;

摘要:本文探讨了基于多信息资源的汉语复合词自动生成方法,该方法旨在生成两类结果:一是生成已有的近义词,二是生成未登录的新词。两类结果的生成均涉及语素的替换。本文从语素层面入手,依据语言学中的平行周遍规则,首先界定可替换语素的取值范围;随后,结合语素词典的释义文本与How Net中语素间关系的知识,构建基于多信息资源的MIFSSM模型(多信息融合语义相似度模型),生成具有语义近似序列且能区分不同义项的近义语素集;最后,选用适当的组配规则对替换后的语素进行新的组合,并利用Chat GPT进行人机互动式评估。实验结果表明,在有限的预训练数据集下,该方法仍能有效且高质量地生成汉语复合词。

关键词:多信息资源;;复合词;;自动生成;;平行周遍规则;;词向量

基金资助:教育部人文社科基金青年项目“省略型汉语动名超常搭配的语义组配机制及处理方法研究(22YJC740073)资助