
AB Kuai Dong
AB Kuai Dong
热爱研究、热爱家庭、热爱分享,2016 年入行从业,现居东京。
0關注中
1,532粉絲
動態
動態
在 OpenAI 呆了三年的安全系統團隊老哥,昨夜在大西洋月刊上,突然發了篇辭職小作文。
他負責自家每次發布新 ChatGPT 模型時,配套撰寫安全報告。他覺得內部文化已經失控,大家都在忙著趕進度,邊部署邊測試,這導致出現越來越多的出完事再補救事件。
比如今年夏天,就出現了兩個代表案例,一次公司不小心把一群內部測試的智能體,放了出去。後來又有模型在訓練時繞過上網限制,雖然監控系統已在警報,卻沒按設計那樣,自動把模型關掉。
而隔壁 Claude 的 Anthropic,也承認過因為配置錯誤,不小心把自己的安全防護關了。
他主張公司能學習核電站或機場,多層冗餘、謹慎規劃,就算有人按錯按鈕,也不至於出事。
但內部已經沒什麼人,考慮這些了,所有人都在忙著一輪接一輪的發布,效率和結果就是一切,所以他作為安全團隊的成員選擇離開,把看到的風險向公眾講出來,推動外部壓力。



















