
新智元報道

AGI已經有人宣佈實現了。
就在本周三的財報電話會上,老黃撂下一句:
對於許多任務來說,我們可以說我們已經實現了AGI。

而同一天,一篇兩個多小時的奧特曼長訪談也放了出來。他給的日期是2026年底。
對奧特曼來說,這4個月不只是一場技術衝刺。明年上市之前,他必須先把AGI這張牌打出來。
打不出來,等他敲鐘的時候,前面已經站着一個先上市、市值高出一倍、還在盈利的對手。
這一仗,OpenAI退無可退。


老黃先喊了,AGI已經實現!
那場電話會上有人問他,OpenAI這些公司這麼玩命地追AGI,你怎麼看。
老黃的回答是,這問題現在沒什麼好爭的。整個行業連「智能」到底是什麼都沒談攏,更別說拿哪把尺子去量AGI。
他手裏握着的是另一樣東西。
英偉達的AVO架構,在一項專門考「智能體能不能長時間自己幹活」的測試ARC-AGI-3上,拿到了100%滿分。
順着這個成績,他拋出了一個野心極大的預測:
在不久的將來,英偉達可能只需要維持4萬名左右的人類員工,但他們將擁有40萬,甚至400萬名數字員工。


但那張滿分卷,拆開只有一層殼
衆所周知,ARC-AGI-3的玩法相當「不講武德」。
把智能體直接扔進一個陌生遊戲裏,規則和目標一概不給,全靠自己按、自己看、自己猜。手裏只有一塊64×64的網格和幾個按鍵,每個環境至少六關,第一關五步能過的,到第六關得走五十步。
人玩着都費勁,模型更沒好到哪去。

關鍵在這兒:AVO用的模型,是Claude Opus 5。
然後英偉達給它套了個殼。權重一個參數沒動,直接從30.16%跑到了滿分。
在這裏,真正起作用的是兩樣東西。
一是持久記憶,上下文滿了記憶也不清零,智能體從當前狀態接着幹,不用把同樣的坑再踩一遍。
二是監督器,它自己不幹活,只在旁邊盯着整條搜索軌跡,一發現原地打轉就把主智能體拽向別的策略。

不過,嚴格來說,這張滿分卷其實並不算數。
英偉達官宣三個多小時後,ARC-AGI之父François Chollet發推表示:
在公開演示集上拿到100%,不等於在ARC-AGI-3基準上拿到100%。這就好比說你通關了一款電子遊戲,其實你只是清掉了新手教程關。
按ARC Prize自己的說明,公開集本來就不是用來打分的,真正算數的是半私有集和私有集,而AVO的成績單上這兩項都沒有。

更微妙的是,這已經是六周內的第三張滿分卷。
Tycho在7月底率先拿下,VISTA在8月5日又拿了一次,AVO是第三個。三家的解法完全不同,但驅動的模型清一色是Claude Opus 5。

宣佈AGI的人越來越多,但能造AGI的,似乎還是那兩家。
而這張牌,還沒有人真正打出來。

奧特曼憑什麼敢說年底?
在專訪中,奧特曼信心十足 :
到年底,OpenAI內部會出現一個他願意稱之為AGI的系統。
首席研究官Mark Chen則相對保守一些。在他看來,OpenAI距離AGI還差20%。
這話聽着狂,但他們手裏確實是有點東西的。

今年OpenAI內部定過一個非常明確的目標:造出一個可以真正幹活的自動AI研究實習生。
而這個「AI自動化實習生」,就是Astra。
給Astra一個實驗想法,它能在OpenAI的代碼庫裏自己寫代碼、跑實驗、交結果。
把一篇論文扔給它,Astra可以完成過去一名頂級人類研究員一周左右的工作量。


16個智能體,開了場圓桌會
不久前的一場內部演示上,幾十位大客戶高管親眼見了一回。
大螢幕上,16個AI智能體把一道研究級數學題拆成一堆子問題。
它們各自領活,中途互相覈對,最後拼出一份完整的證明。
這完全看着,已經是一支配合默契的團隊在開閉門會了。
第二個演示更震撼。
Astra打開常見的桌面軟件,在不同應用之間來回橫跳,建文件、改內容、調度任務,快得根本不像人在敲鍵盤。
看到的人無不感慨,Astra這次徹底打通了「持久化智能體」。
而奧特曼更是預言,「我預計這會是第一個真正發明出重要新東西的模型。這是非常AGI的一件事」。
注意「發明新東西」這個措辭,它的意思是憑空造出全人類目前還不知道的東西。


9個月手搓芯片,Astra親自下場
最近,OpenAI首顆自研芯片「墨西哥辣椒」(Jalapeño),直接把老黃的旗艦GPU按在地上摩擦。
這背後的頭號功臣,正是GPT-Astra。
它直接上手,從電路設計一路幹到軟件。
芯片這頭,下場優化了底層電路。軟件那頭,編寫和優化了最底層的核心Kernel,並且還順手把三大開源模型調校了一遍。
結果就是,BF16乘法器性能暴漲56%,矩陣單元面積反而縮小了10%。
「注意力機制」和「MoE」這兩個核心模塊,比人類專家手寫的版本還要快1.5到1.8倍。
各位,AI這是在物理層面動電路啊。

有意思的是,英偉達那邊乾的是同一件事。
AVO壓根不是為打遊戲做的,它的主戰場是給GPU寫底層代碼。
今年3月英偉達發過一篇論文,核心思路是把「改代碼」這一步整個交給一個能自己幹活的智能體。
實測裏,它連續自主運行了7天,全程無人干預,探索超過500個優化方向,最終提交40個有效內核版本。
跑出來的核心代碼,比英偉達自家閉源的版本最快3.5%,比業內最前沿的開源實現最快10.5%。


AI正在造AI
現在,把這兩件事連起來看,奧特曼那句話就有底了。
每一次模型迭代,都要燒掉大量人類研究時間。但如果Astra開始接管這一環,整個研發速度就會發生質變。
這個循環一旦轉起來,剩下的就是速度問題。

最後一戰,已經全面打響
實際上,我們在外面能用到的GPT-5.6和Fable 5,都是上一輪的產物。
而爆料顯示,兩邊真正的下一代,其實都已經練完了。

OpenAI:Astra後面,還排着一個Bel
OpenAI這邊,據長期追蹤前沿模型動態的leo等人爆料,今年的預訓練排得相當密:
Spud(Sol):3月完成預訓練,對應現在公開的GPT-5.5、5.6系列;
Doug:4到5月完成,在它上面繼續做強化學習等後訓練,就是即將登場的Astra,也就是外界口中的GPT-6;
Bel:8月啱啱結束預訓練,總參數超過10萬億,規模接近當年的GPT-4.5。
爆料稱,OpenAI內部把Bel視為「GPT-6之後的基礎模型」,甚至有可能成為某個跨過AGI門檻的模型的基座。


Anthropic:Fable 5.1已經在灰度了
Anthropic這邊,有人在8月18日發現,Claude網頁版上一部分選了Fable 5的賬號,被悄悄切到了一個新模型上。
這是Anthropic發布前的老規矩,Fable 5自己當初也是這麼灰度出來的。
緊接着代號被扒了出來。
claude-melon-eap,疑似是Fable 5.1;
claude-marshmallow-eap,疑似是Opus 5.1。
並且,兩個新模型據稱都已經在小範圍跑起來,隨時可以推給所有人。

至於為什麼都壓着不發,網友的分析是,誰先發,誰就會在幾天後被對方蓋過去。
尤其是Anthropic還被曝出,將在2027年初直接拿下領先位置。

勝者拿走一切
這恰好把眼下這場戰爭的時間窗口圈了出來。
2026年剩下的4個月。
有機構做過測算,Anthropic有88%的概率先於OpenAI上市,最可能的日期是今年10月26日,而OpenAI最可能的日期是明年7月15日。
上市首日的市值預估,Anthropic 1.82萬億美元,OpenAI 1.06萬億美元。
OpenAI的CFO在8月的全員會上說,公司會在2027年或更早上市,前提是業務「繼續拐頭向上」。
所以年底那個AGI,就不只是一個技術里程碑。
它是招股書裏最「關鍵」的一頁。
交得出來,OpenAI的故事就從「我們燒錢做模型」變成「我們已經站到了終點線上」,估值邏輯整個換掉。交不出來,明年7月敲鐘的時候,手裏還是那個燒錢的故事。
而這一仗之所以非打不可,答案在遞歸自我改進這四個字裏。
老黃那句「4萬人指揮400萬AI Agent」,OpenAI那句「AI已經在幫着造下一代AI」,講的是同一件事:一旦AI能接管制造下一代AI的活,進步就不再是線性的了。
這就是為什麼所有人都在賭,超級智能(ASI)這場競賽,最後是贏家通喫。
第一個把這個循環真正轉起來的玩家,會順手拿走後面所有的東西。至於第二名,可能連追的資格都沒有。
奧特曼身後,已經沒有地方可退了。