上周末,全球AI三大巨頭罕見釋放「放緩研發」信號,OpenAI首席執行官Sam Altman也再次呼籲AI行業共同建立安全標準。
9月14日,Altman在X平台發帖稱,人工智能發展存在兩種最壞結果:一是AI最終失控,人類失去對未來的控制;二是極度強大的AI被少數個人、公司或國家掌控,並將自身意志強加於所有人。他認為,這兩條紅線都不能觸碰。
Altman表示,OpenAI已開始在重大能力提升的強化學習訓練啓動前,主動制定明確的安全論證(safety cases),並希望其他前沿AI公司採取類似做法,圍繞模型失準、監控和安全等問題形成統一標準。
據The Information援引知情人士,Anthropic、OpenAI和谷歌已就合作成立AI行業標準機構展開磋商,相關工作組會議仍在進行。這意味着,頭部AI實驗室的安全治理思路正從各自制定內部規則,逐步轉向推動行業協調框架。

安全治理前移,AI「調速」並非放緩發展
Altman強調,隨着模型能力不斷提升,對齊(alignment)和安全技術也必須同步甚至更快發展,避免AI能力跑在安全保障之前。AI行業需要走一條「狹窄的中間道路」:既不能因競爭壓力犧牲安全,也不能讓AI能力提升明顯領先於對齊、監控和治理能力。
他認為,AI安全治理的重點正從模型部署後的風險控制前移至開發過程本身。OpenAI目前的做法是,在啓動預計將顯著提升模型能力的前沿強化學習訓練前,就提前制定安全論證(safety cases),而不是等模型完成後再進行安全評估。
他同時強調,「調速」(pacing)並非停止AI進步,而是避免以技術上能夠達到的最快速度推進。儘管安全論證和監控措施會增加研發成本,但這些投入仍有必要,以確保安全和治理能力跟上模型能力的提升。
監管尚待落地,AI行業應先行推動安全標準
在監管層面,Altman支持美國政府為前沿AI設立統一安全要求,但認為行業沒有必要等到相關立法落地後再行動。即使缺乏政府參與,主要AI實驗室也應率先推動行業標準機構成立,並探索獨立審計等機制。
據報道,Anthropic首席執行官Dario Amodei上周六已公開呼籲AI公司加強技術測試和審核方面的協調。此前,Anthropic、OpenAI和谷歌已就合作成立行業標準機構展開磋商。
Altman在一次員工大會上表示,即便美國政府暫時沒有參與,主要AI實驗室也應自行推進標準建設;至於全球層面的協調,則需要政府介入,但「首先我們應當盡力自為」。
在他看來,隨着AI能力持續提升,社會對前沿AI公司的安全要求也將越來越高,而行業自律最終需要落實到每一家AI實驗室的具體行動中。