人工智能价值对齐现有方法的批判与生成性认知路径分析

科学技术哲学研究页数： 8 2025-04-05

摘要：人工智能很难对齐，错位人工智能的部署可能不可逆转地破坏人类对世界的控制，甚至威胁人类文明。人工智能安全的主要方法是AI对齐，即创造与“人类价值观”对齐的人工智能。“价值对齐问题”是如何将人工智能的价值观与人类的价值观相一致的挑战，无论它们是什么，这样人工智能就不会对人类的存在构成风险。现有的几种主要价值对齐方法，例如技术路径和规范路径都没有解决价值对齐问题，建议在哲学上植根于当... （共8页）

开通会员，享受整站包年服务

说明：本文档由创作者上传发布，版权归属创作者。若内容存在侵权，请点击申诉举报

科技文档

数学力学化学金融证券保险投资会计审计园艺林业旅游体育物理学生物学天文学气象学海洋学地质学新能源金属学农艺学农作物管理学领导学自然科学系统科学资源科学无机化工有机化工燃料化工化学工业材料科学矿业工程冶金工业安全科学环境科学工业通用机械工业无线电子电信技术铁路运输汽车工业船舶工业动力工程电力工业农业科学农业工程植物保护动物医学教育理论学前教育初等教育中等教育高等教育职业教育成人教育自然地理地球物理经济统计农业经济工业经济交通经济企业经济文化经济信息经济贸易经济财政税收市场研究科学研究互联网自动化轻工业核科学服务业石油然气服务业野生动物水产渔业硬件仪器仪表航空航天武器军事公路运输水利水电建筑科学软件