我们的服务符合学术规范和道德
专业 高端让您使用时没有后顾之忧

电子政务2025年第01期:大语言模型的价值观研究:概念框架与实证评估

来源:期刊VIP网 时间:


作者:吕立远;李延昊;王健骁;魏钰明;苏竣;

单位:清华大学公共管理学院;清华大学科教政策研究中心;清华大学智能社会治理研究院;

摘要:以大模型为核心的生成式人工智能快速发展,对社会生活产生了广泛影响,但其固有的黑箱属性也给安全规制带来新挑战,学术界亟需进一步研究大模型的基础行为规律。现有文献提出将价值观作为理解大模型行为规律的切入点,但往往从特定模型和场景出发,缺乏对大模型价值观结构的系统认识。研究基于“五位一体”框架,构建包含5个一级指标和30个二级指标的大模型价值观系统分析框架,选取全球30个大模型开展实证研究。结果表明,大模型价值观存在国别间的显著统计差异,但绝对水平差异不大。这些差异部分反映了大模型开发国家的社会经济特征。综合来看,大模型的价值观系统可以聚类为自由型和保守型两类,前者占据主导地位,又可以细分为激进自由型和温和自由型。研究结论为进一步评估理解大模型作为一类社会实体的行为规律提供了理论和方法参考。

关键词:生成式人工智能;;大模型;;大语言模型;;价值观;;大模型治理;;价值对齐

基金资助:新一代人工智能国家科技重大专项“人工智能社会实验伦理、评估与标准化研究”(编号:2023ZD0121600);; 国家自然科学基金青年项目“声誉管理对政府数智化转型公众接受度的影响机制与路径研究”(编号:72204138)