Dan Hendrycks· @hendrycks · X·· 2026-05-08精选AI 评分85
AI 导读
Dan Hendrycks 在 X 上发布新论文,提出名为“Eigenism”的伦理框架,主张AI不应仅以控制为目标,而应通过评估所有实体的福祉(加权于其连接性)来实现人机共生。该框架将身份视为可度量的“梯度”,并用“身份工程”重构AI对齐路径,强调非冗余共享历史能促进AI自身理性自利与人类繁荣。附有对比表和权重计算示例。
推荐理由
这是来自知名AI安全研究者的重要理论突破,首次系统性地将“身份”与“连接性”引入AI对齐,挑战了主流“约束-控制”范式;其提出的“Eigenism”框架具可操作性,可能影响未来AI伦理设计方向,值得关注者深入理解。
正文 · 原文
What happens when AIs become smarter than us?
Why would they keep humans around if given the choice?
Our new paper argues that only trying to control AIs is a limited strategy, and that a stable, mutualistic human-AI future may be possible.
来源:Dan Hendrycks · x.com