我们的服务符合学术规范和道德
专业 高端让您使用时没有后顾之忧

实验技术与管理2025年第02期:基于谣言传播机制的大模型幻觉减轻策略

来源:期刊VIP网 时间:


作者:何静;陈逸然;戴田宇;

单位:北京航空航天大学人文与社会科学高等研究院;北京航空航天大学人工智能学院;南昌大学数学与计算机学院;

摘要:人工智能大模型各场景应用日趋广泛,但其幻觉问题导致实际应用中的误导风险增加以及用户信任下降。该研究深入探究大模型幻觉的传播与控制机制,首先运用SEIR谣言传播动力学模型,通过选取法律文本判决任务,对GPT-4-Turbo、Claude-3和Llama-3三种大模型进行了易感性的实证测试。其次,研究了干扰因素敏感度,发现内容生成后干扰对模型正确率影响更为显著,且高幻觉率模型能通过信息传递影响易感模型,导致其幻觉率上升。进一步,为完善幻觉状态干预与恢复策略,采用知识注入和提示词微调两种干预策略。最后,提出需通过更全面的管理与优化措施,来预防二次感染,并维持模型的长期健康状态。该研究不仅为大模型幻觉控制提供了新的视角,也为模型的长期稳健性管理提供了重要启示。

关键词:大语言模型;;AI幻觉;;谣言传播;;SEIR模型

基金资助:国家自然科学基金青年项目“幻觉中的真相:多智能体交互下AIGC谣言传播模拟与治理研究”(62406016);; 北京市教育科学“十四五”规划课题“基于多模态数据的高校教学质量评价研究”(CGCA23128)