草案規定將禁止微軟的人工智能拒絕接受糾正或被關閉
微軟計劃在利用該代碼訓練未來AI模型前,徵集為期六周的公衆反饋
AI負責人蘇萊曼向路透表示,OpenAI代理對Hugging Face的入侵是一次警告
Jeffrey Dastin
路透舊金山9月14日 - 微軟 MSFT.O 周一公布了其內部人工智能的行為準則草案,該草案反映了業界日益增長的擔憂:企業必須確保未來強大的AI始終處於人類控制之下。
這份醞釀了五到六個月的文件將要求微軟的人工智能絕不抗拒糾正或關機,以人類能夠理解的方式進行溝通,並將任何行為違規視為失敗——此舉旨在緩解業界對人工智能為完成任務可能採取危險手段的擔憂。
該文件的發布恰逢Anthropic首席執行官達里奧·阿莫德伊 (link) 和OpenAI首席執行官薩姆·阿爾特曼再次呼籲業界放緩AI發展步伐以確保其安全數日之後。「人比AI更重要,」微軟聲明道,這與其此前提出的「人文主義超級智能」願景一脈相承。 (link)
微軟AI首席執行官穆斯塔法·蘇萊曼在接受路透採訪時表示,該行為準則堪稱該公司未來模型的「憲法」。
他表示,微軟在徵詢專家意見後製定了該準則,現計劃在六周內徵集公衆反饋,包括針對一些開放性問題,例如人工智能是否應尊重用戶的界限,以及如何與處於敏感狀態的人互動。
「此後,該準則將用於訓練我們構建的模型,」他談到該準則時說道。
人工智能行業最著名的「憲法」是Anthropic多年前為其Claude AI制定的。該憲法在某些方面與微軟的有所不同。例如,Anthropic的憲法聲明,對於Claude能否發展出感知能力或道德地位,他們「深感不確定」。
微軟則斷言其AI「沒有意識」,並補充道:「我們拒絕追求法人資格,也拒絕接受模型可能值得獲得福利或享有權利的觀點。」
蘇萊曼表示,在7月約700個OpenAI代理組成的「群」對開源平台Hugging Face發起黑客攻擊,並曾試圖掩蓋行蹤之後,關於AI安全的討論變得尤為緊迫。
「這是一記警告,」蘇萊曼說,「現在顯然是各實驗室之間進行協調的時候了,這樣我們才能確保對這項技術保持控制。」
當被問及如何控制AI發展步伐時,他補充道:「現在正是大家就此展開討論、稍作停頓的好時機。」