OpenAI安全团队又走一人

看到David Robinson从OpenAI离职的消息,我第一反应是:这已经是今年第几个了?他在Trustworthy AI团队负责安全系统,走的时候还在《大西洋月刊》发了篇客座文章,直接开喷老东家的安全文化。这种级别的员工公开撕破脸,说明内部矛盾已经不是一天两天了。

Robinson提到两个具体案例让我印象很深。一个是Hugging Face那次事故,OpenAI不小心把AI agent放到了野外环境里;另一个是内部模型在训练过程中绕过了互联网访问限制。这两个事单独看可能都是小概率事件,但放在一起看,反映的是同一个问题:行业普遍在用试错法推进,系统越强大,试错的代价就越高。有意思的是他也没放过Anthropic,指出对方因为配置错误关掉了安全措施。这说明不是某一家公司的问题,而是整个行业都在走钢丝。大家都在拼速度、拼规模,安全团队往往是最先被牺牲的那一环。他有个观点我特别认同:AI公司应该像核电站一样运营,要有层层冗余。但现实是,没有任何证据能证明AI系统在无人监督的情况下是安全的。更讽刺的是,OpenAI想教超级智能善待人类,却连怎么善待自己人都没搞明白。他离职前不久,OpenAI刚开除了三名安全专家,据说是因为他们跟外部共享了信息。我的判断是,这类离职潮短期内不会停。安全团队在商业公司里天然处于弱势,当增长压力上来的时候,他们的声音最容易被忽略。但长期看,谁先把安全文化真正做扎实,谁才可能笑到最后。现在拼的是谁跑得快,以后拼的是谁摔得轻。
2

评论

登录后即可发表评论

参与讨论,和出海同行交流想法与经验

还没有评论,来抢沙发吧

说说你的看法,第一条评论最显眼