2024年5月,OpenAI公司前首席科学家伊利亚·萨茨克维尔离开了他亲手创立的“超级对齐”团队。几天后,他的搭档简·莱克也宣布辞职,并留下一句后来被广泛引用的告别:“在过去的几个月里,我的团队一直在逆风航行。”10天后,OpenAI干脆解散了超级对齐团队。这个曾被承诺用全公司20%算力,用4年时间解决如何让超级智能与人类价值对齐的部门,从启动到关闭,只用了10个月。几乎同时,伊利亚注册了一家叫Safe Superintelligence Inc. (SSI)的新公司,直白地把“安全”两个字放在了公司名字上,想再续价值对齐工作。然而,一年后,据《华尔街日报》的报道,SSI的估值已经达到320亿美元,但是还没有任何产品发布。安全成了它的估值,对齐成了它的招牌。如果说三年前OpenAI那场罢免大戏还能被解读为权力之争,那么随后几年在“价值对齐”这个领域无限接近于零的进展,则暴露了更深的问题:所谓价值对齐,可能就不是一个可被工程化解决的命题。它更像是一种社会需要的姿态,一种制度需要的符号。我曾在两年前写过一篇《直面AI价值对齐挑战》,主张以发展的眼光看待它。但时至今日,我必须修正自己的判断,与其继续维护这个概念,不如承认它的失败:价值对齐是一个伪概念。