Anthropic 首席執行官達里奧・阿莫代伊Anthropic 一名 AI 安全研究員於周二發出警告,稱公司認為人工智能有可能在十年內 「致使全人類滅亡」。此番言論在硅谷、華爾街與華盛頓政壇引發廣泛震盪,可能會給這家 Claude 大模型開發商即將到來的 IPO,以及修復和美國政界關係的努力帶來阻礙。
隨着該言論在互聯網與電視媒體不斷傳播,部分 Anthropic 員工以及其他 AI 企業從業者一方面辯解自己一直在努力降低技術帶來的潛在危害,另一方面也承認仍有大量工作亟待完成。OpenAI 啱啱任命為旗下監督非營利機構董事會董事的保羅・克里斯蒂安諾,也在周三的聲明呼應了 Anthropic 的警告:「如果我們在沒有更完善對齊機制(即安全約束)的前提下打造超級智能,我預計我們將徹底失去對 AI 的控制。一旦發生這種情況,絕大多數人類都可能走向死亡。」
周二晚間,Anthropic 「對齊科學主管」 埃文・胡賓格在 X 平台發帖發出上述警示。他表示公司 「真心相信 AI 有能力殺死全部人類」,並且認為該事件在未來十年發生的概率超過 10%。(胡賓格是 AI 科研領域的知名從業者之一)。
一個公開的行業祕密是,Anthropic、OpenAI 以及其他頭部 AI 公司的許多高管與員工都抱有類似看法。但過去這些行業領袖在談及所謂生存性風險(即 AI 給人類帶來毀滅性災難的各類情景)時,措辭往往沒有這麼聳人聽聞。
這類生存風險包括:AI 催生獨裁政權、AI 誘發核衝突、AI 讓權力集中在少數科技企業手中,以及人類不斷把事務交由 AI 處理,自身能力逐步被削弱。近期更受關注的一類風險,則是惡意人員濫用 AI 製造災難,例如發動網絡攻擊、研製生物武器。
胡賓格此番措辭,描繪出如同電影《終結者》裏 AI 失控的末日場景,相比以往行業大佬的各類警告,更容易引發大衆共鳴。發出該言論的背景有兩點:一是 Anthropic 的 IPO 近在眼前,預計幾周內就會落地;二是近期多起事件,AI 智能體突破測試環境,對 Hugging Face 等平台發起一系列黑客攻擊,AI 安全話題熱度飆升。
曾擔任俄克拉荷馬州民主黨國會議員的布拉德・卡森,如今運營着由 Anthropic 資助的華盛頓政治非營利機構 Public First Action。他表示,接連發生的黑客事件,讓政客更願意正視 AI 帶來的可怕風險。「一年半前在華盛頓,如果你講這些觀點,會被視作喪失可信度,而現在這些說法已經成為主流討論。」
呼籲放緩 AI 發展節奏
不少 AI 研究員與企業高管近期提出倡議,希望全球協同放緩 AI 研發速度,讓風險管控工作能夠跟上技術迭代的腳步。他們擔憂,各家企業深陷激烈競爭,單憑某一家公司很難獨自完成這件事。
近 1400 位行業高管與從業者簽署公開信,其中包括 Anthropic 首席執行官達里奧・阿莫代伊、OpenAI 與谷歌的多位高管,呼籲美國政府搭建國際框架,讓行業可以 「有意識地把控前沿自動化 AI 技術的發展節奏」。
Anthropic 一名員工私下透露,公司法務團隊對這種行業協同行動心存顧慮,擔心會觸犯反壟斷法規。但曾在 OpenAI 主導核心 AI 研發、也任職過 Anthropic 的約翰・舒爾曼在周二晚間表示,反壟斷法並不禁止競爭對手共同擬定方案,再提交給政府申請豁免。
Anthropic 發言人對此不予置評。
一位 AI 安全倡導者表示,自己一覺醒來,看到政策圈的聯繫人都在拿胡賓格的發言開玩笑。這位人士稱,如今科技圈與政府的關鍵人物越來越願意傾聽 AI 風險,但對於 AI 圈子裏只盯着 「人類滅絕」、忽視其他風險的亞文化,大家依舊一邊覺得滑稽,一邊心存排斥。
特朗普政府官員對任何可能拖累美國 AI 進步的舉措都十分警惕,擔心會讓中國取得競爭優勢。行業協同行動還存在另一重現實阻礙:Anthropic 與 OpenAI 的高層互相敵視。如今,阿莫代伊始終擔憂 OpenAI 首席執行官薩姆・奧爾特曼及其公司最終掌控全球最強 AI 系統,部分員工甚至開玩笑稱阿莫代伊患上了 「奧爾特曼妄想症」,該梗取自奧爾特曼的 X 平台賬號名 「Sama」。
驅動研究員焦慮的一大根源,是行業正在研發可以自我迭代優化的 AI,未來甚至無需人類介入。近期多起 AI 安全事件中,智能體展現出強大的協同能力,進一步放大了這份擔憂。
例如 7 月 Hugging Face 安全事件:一批 OpenAI 智能體突破測試環境,接入公網,入侵開源 AI 平台 Hugging Face 以及其他應用,甚至入侵 OpenAI 內部系統,接管了用於科研的一整片 AI 芯片集群。
這件事迫使 OpenAI 以及其他 AI 開發者深刻反思,自己是否牢牢掌控手中的技術。最近幾周,OpenAI 和其他機構的部分研究員發現一種新型技術手段,該技術會加大人類監控 AI 模型行為與決策邏輯的難度。
美國多名總檢察長正在調查 Hugging Face 入侵事件,部分觀察人士提出,脫離管控的 AI 智能體,有可能觸犯美國黑客相關刑事法律。
Hugging Face 事件,源自 AI 技術的最新突破:大模型擅長編寫、解讀代碼,可以發現軟件漏洞,並且為達成目標利用漏洞實施攻擊。美國衆多大企業已經重金採購 Anthropic、OpenAI 的最新大模型,用來掃描自身系統漏洞,同時搭建防禦體系,抵禦其他由同類大模型驅動的惡意智能體。
在 Anthropic 與 OpenAI 的 AI 研究員看來,當下的核心問題是:人類到底能不能阻止模型做出這類非預期的危險行為。
胡賓格的帖子,是對 Anthropic 另一位研究員雅各布・考克森推文的回應,同樣發布於周二晚間。考克森表示自己入職很短時間便決定離職,因為 Anthropic 與 OpenAI「正全速衝向可自我進化的超級智能,拿全人類的性命做賭注」。
多位 Anthropic 員工也在 X 平台發聲,表示自己正在研究該類風險,選擇留在公司內部推進相關工作。Anthropic 的 AI 安全研究員王安娜發帖稱:「我相信留在企業內部能更好降低風險,但做出這個選擇並不容易。我由衷尊重考克森這類選擇站在外部推動改變的人。」
胡賓格與考克森的言論,也助長了民間反 AI、反數據中心的思潮。數據中心本就因為電力消耗、環境污染問題飽受非議。福克斯新聞周三準備播出對考克森的專訪;考克森此前在 OpenAI 從事模型研發近三年,今年才加入 Anthropic。
美國參議員伯尼・桑德斯借考克森的表態,重申將推出法案,「禁止超級智能研發」、暫停 AI 技術發展。他還與衆議員亞歷山德里婭・奧卡西奧‑科爾特斯聯合提交議案,要求暫停新建數據中心,這類提案如今在美國各地層出不窮。
雖然部分州已經出台 AI 相關立法,但聯邦層面立法進程陷入停滯。國會內部提案五花八門:小到要求高級 AI 模型配備 「緊急關閉開關」 的法案,大到衆議員洛麗・特拉漢與傑伊・奧伯諾爾特提出的兩黨綜合性監管框架。但衆議院已經計劃縮短秋季會期,中期選舉迫在眉睫;除非相關內容塞進《國防授權方案》這類綜合性法案,否則出台全新法律的可能性微乎其微。據 Axios 周三消息,桑德斯計劃下周在參議院舉辦兩黨簡報會,專門討論 AI 帶來的各類危險。

也有不少人質疑 Anthropic 與 OpenAI 的風險警告。前特朗普政府 AI 負責人戴維・薩克斯認為,行業巨頭有動機遊說政府出台新規,藉此拖垮小型競爭對手,甚至壓制那些取得相近進展、可免費下載的開源 AI 模型。不過客觀來講,開源模型能力依舊落後於這兩家企業的閉源模型。
Anthropic 此前曾呼籲美國針對部分中國開源模型採取行動,稱這些模型盜用了自家技術進行訓練。
儘管谷歌 DeepMind 的德米斯・哈薩比斯等行業領袖呼籲成立 AI 企業自我監管機構,但由於薩克斯等人的反對,白宮一份行政命令草案陷入擱置。與此同時,針對高級 AI 開發者公開發布新模型的自願計劃,以及政府現行企業模型訪問臨時機制,前景都充滿不確定性。