来源:期刊VIP网 时间:
作者:赵伟;
单位:华中师范大学马克思主义学院;
摘要:人工智能很难对齐,错位人工智能的部署可能不可逆转地破坏人类对世界的控制,甚至威胁人类文明。人工智能安全的主要方法是AI对齐,即创造与“人类价值观”对齐的人工智能。“价值对齐问题”是如何将人工智能的价值观与人类的价值观相一致的挑战,无论它们是什么,这样人工智能就不会对人类的存在构成风险。现有的几种主要价值对齐方法,例如技术路径和规范路径都没有解决价值对齐问题,建议在哲学上植根于当代认知科学的生成范式。为了使人工智能的价值观与人类保持一致,我们必须使和人类相关的东西与人工智能相关。这种方法解决对齐问题的结论是使人工智能在本体论上与人类相似。
关键词:人工智能;;存在主义风险;;价值对齐
基金资助:国家社科基金重大项目“马克思共同体思想及当代价值研究”(23&ZD200)