概念AI Safety
AI安全
AI安全(AI Safety)是研究如何确保人工智能系统按照预期目标可靠运行、避免产生有害后果的跨学科领域。其核心议题包括:系统鲁棒性与对抗攻击防御、AI价值对齐(使系统行为符合人类意图与价值观)、可解释性与透明度,以及对超级智能等长期风险的防控。该领域融合计算机科学、伦理学与控制论等学科,旨在降低AI系统在设计、部署及使用过程中的技术性与社会性风险。
时间轴 (近 90 天)
8月26日
2023年AI安全研究者的一项非正式调查显示,受访者对先进AI导致人类灭绝或类似永久性灾难的概率中位数估计在5%-20%之间
待验证50%