来源:期刊VIP网 时间:
作者:韩旭至;
单位:华东政法大学法律学院;华东政法大学数字法治研究院;
摘要:价值对齐是大模型伦理风险防控的核心手段,是构建可信人工智能的关键。大模型价值对齐的运行机理展现了人机协同的技术治理逻辑。人工智能治理的制度规范蕴含了价值对齐的要求。然而,价值对齐的标准模糊对商业自由、言论自由造成冲击,价值对齐的义务责任不明引起开发者与提供者的权责失衡,大模型自主性与可控性、可解释性的法律要求之间又存在一定张力。针对上述困境,大模型价值对齐的理念应从绝对安全转向合理成本的模型安全,从单一维度规制转向共建共享的合作治理。在此基础上,大模型价值对齐应以体系融贯为原则,构建目标限缩与标准解释机制;以分类分级为基础,设计伦理风险评估、审计与应对机制;同时,以责任豁免与公共数据供给机制,形成对价值对齐的激励。
关键词:价值对齐;;大模型治理;;生成式人工智能;;科技伦理;;信息内容治理
基金资助:2024年度国家社科基金一般项目“大模型价值对齐的法治化机制研究”(24BFX013)的阶段性成果