我们的服务符合学术规范和道德
专业 高端让您使用时没有后顾之忧

科学技术哲学研究2025年第02期:人工智能价值对齐现有方法的批判与生成性认知路径分析

来源:期刊VIP网 时间:


作者:赵伟;

单位:华中师范大学马克思主义学院;

摘要:人工智能很难对齐,错位人工智能的部署可能不可逆转地破坏人类对世界的控制,甚至威胁人类文明。人工智能安全的主要方法是AI对齐,即创造与“人类价值观”对齐的人工智能。“价值对齐问题”是如何将人工智能的价值观与人类的价值观相一致的挑战,无论它们是什么,这样人工智能就不会对人类的存在构成风险。现有的几种主要价值对齐方法,例如技术路径和规范路径都没有解决价值对齐问题,建议在哲学上植根于当代认知科学的生成范式。为了使人工智能的价值观与人类保持一致,我们必须使和人类相关的东西与人工智能相关。这种方法解决对齐问题的结论是使人工智能在本体论上与人类相似。

关键词:人工智能;;存在主义风险;;价值对齐

基金资助:国家社科基金重大项目“马克思共同体思想及当代价值研究”(23&ZD200)