我们的服务符合学术规范和道德
专业 高端让您使用时没有后顾之忧

电子政务2025年第02期:人工智能大模型价值对齐的现状考察、问题检视与规范进路

来源:期刊VIP网 时间:


作者:曾雄;

单位:北京科技大学文法学院;

摘要:价值对齐是让大模型理解人类目标,使其行动决策与人类利益保持一致的风险治理对策。在理论方法上,大模型价值对齐包括自上而下和自下而上两种路径;在技术路线上,大模型价值对齐包括外部对齐、内部对齐和模型原理可解释等解决方案。不管采用哪一种理论方法和技术方案,大模型价值对齐面临的共同困境包括价值观多元性带来的价值标准选择难题,模型脆弱性带来的对齐“失败”挑战,以及对齐后成本与效率的综合平衡问题。面对价值对齐的实践挑战,仅从技术、伦理或法律的单一维度无法充分应对,因而宜采用技术、伦理和法律协同规制的方法。在技术上,坚持混合式进路,并构建循环对齐模式;在伦理上,基于社会选择理论合理选取价值观标准;在法律上,基于技术特征构建大模型价值对齐的规范指引。

关键词:人工智能;;大模型;;道德主体;;价值对齐;;生成式人工智能;;人机对齐

基金资助:国家社会科学基金重大项目“人工智能时代大国跨境数据战略竞争与中国应对研究”(批准号:23&ZD335);; 教育部人文社会科学青年基金项目“我国平台经济领域自我优待行为的反垄断规制研究”(项目号:24YJC820003)