奧特曼最後一戰!4個月後,交付AGI

新智元報導
新智元報導

AGI已經有人宣稱實現了。
就在本週三的財報電話會上,老黃丟下這麼一句:
對於許多任務來說,我們可以說我們已經實現了AGI。

而同一天,一篇長達兩小時的奧特曼專訪也釋出。他給的時間是2026年底。
對奧特曼而言,這4個月不只是一次技術衝刺。明年上市前,他必須先把AGI這張牌打出來。
打不出來,等他敲鐘時,前面已站著一個先上市、市值高出一倍、還在盈利的對手。
這一仗,OpenAI已無退路。


那場電話會上有人問他,OpenAI這些公司如此拼命追AGI,你怎麼看。
老黃的回答是,這問題現在沒什麼好爭的。整個產業連「智能」到底是什麼都沒共識,更別說有統一標準來衡量AGI。
他手裡握著的,是另一樣東西。
英偉達的AVO架構,在一項專門考「智能體能否長時間自主工作」的測試ARC-AGI-3上,拿到了100%滿分。
順著這個成績,他丟出了一個極大膽的預測:
在不久的將來,英偉達可能只需要維持4萬名左右的人類員工,但他們將擁有40萬,甚至400萬名數字員工。


眾所皆知,ARC-AGI-3的玩法相當「不講武德」。
直接把智能體丟進一個陌生遊戲,規則和目標一概不給,全靠自己按、自己看、自己猜。手上只有一塊64×64格子和幾個按鍵,每個環境至少六關,第一關五步能過的,到第六關得走五十步。
人玩都困難,模型更是不樂觀。

關鍵在這裡:AVO用的模型,是Claude Opus 5。
然後英偉達給它加了一層殼。權重一點沒動,30.16%一舉衝到滿分。
在這裡,真正起作用的有兩項。
第一是持久記憶,即使上下文滿了記憶也不清空,智能體從當前狀態接著做,不必重蹈覆轍。
第二是監督器,它自己不動手,只是一直盯著整條搜索軌跡,一察覺原地打轉就把主智能體拉往別的策略。

不過,嚴格來說,這張滿分卷其實並不算數。
英偉達官宣才三小時,ARC-AGI之父François Chollet就在X上發文:
在公開演示集上拿到100%,並不等同於在ARC-AGI-3基準拿到100%。就像你通關了某款電子遊戲,其實你只走過了新手教學。
按ARC Prize官方的說法,公有集原本就不是用來計分的,真正有效的是半私有集與私有集,而AVO的成績單上這兩項都沒寫。

更微妙的是,這已經是六週內第三份滿分答卷。
Tycho在7月底首度達標,VISTA在8月5日又來一次,AVO則是第三家。三家的解法完全不同,但驅動模型統一都是Claude Opus 5。

宣稱AGI的人越來越多,但能造AGI的,似乎還是那兩家。
而這張牌,還沒人真的打出來。

在專訪中,奧特曼信心十足:
到年底,OpenAI內部會出現一個他願意稱作AGI的系統。
首席研究官Mark Chen則稍顯保守。在他看來,OpenAI距AGI還差20%。
這話聽起來很狂,但他們手裡確實有點東西。

今年OpenAI內部給出過一個非常明確的目標:造出一個能真正幹活的自動AI研究實習生。
而這個「AI自動化實習生」,就是Astra。
給Astra一個實驗想法,它能在OpenAI的程式碼庫裡自己寫程式、跑實驗、交結果。
丟給它一篇論文,Astra能完成過去頂尖人類研究員大約一週的工作量。


前陣子的一場內部演示,數十名大客戶高層親眼目睹了一次。
大螢幕上,16個AI智能體把一道研究級數學題拆成一堆子問題。
他們各自分工協作,過程中彼此校對,最後組成一份完整的證明。
畫面幾乎就像一組默契十足的團隊在閉門開會。
第二個演示更震撼。
Astra打開常見的桌面應用,在不同軟體間來回跳轉,建文件、改內容、派發任務,手速快到不像真人敲鍵盤。
現場看的人無不感嘆,Astra這次真的打通了「持久化智能體」。
而奧特曼更直接預言:「我預期這會是第一個真正發明新東西的模型。這是非常AGI的事情。」
請注意「發明新東西」這句話,意思就是憑空創造出全人類目前還沒發現的東西。


最近,OpenAI首款自研晶片「墨西哥辣椒」(Jalapeño),直接把老黃的旗艦GPU壓在地上摩擦。
這背後的最大功臣,正是GPT-Astra。
它直接上手,從電路設計一路做到軟體端。
硬體端,主導優化底層電路。軟體端,編寫和優化最底層的核心Kernel,還同步把三大開源模型調校一遍。
最終,BF16乘法器效能暴增56%,矩陣單元面積反而縮小10%。
「注意力機制」與「MoE」兩大核心模組,速度比人類專家手寫版快1.5至1.8倍。
各位,AI這可是具體動手到物理電路了。

有趣的是,英偉達那邊也在做同樣的事。
AVO根本不是拿來打遊戲的,主戰場是撰寫GPU底層程式。
今年3月英偉達曾發表論文,核心思想是把「改程式」這一步,整包交給能自我工作的智能體。
實測裡,它連續自主運作7天,全程無人干預,探索超過500種優化方向,最終提交40份有效Kernel版本。
產出的核心程式碼,比英偉達閉源版快3.5%,比業界最先進的開源實現快10.5%。


現在,把這兩件事連起來看,奧特曼那句預言就站得住腳了。
每回模型迭代,都得消耗大量人類研究時間。但如果Astra開始接管這一環,整個研發速度就會產生質變。
這個循環一啟動,後面就是比速度。

實際上,外界現在能用到的GPT-5.6和Fable 5,都還是上一輪的產物。
而爆料顯示,雙方真正的下一代,實則都已經訓練完畢。

Spud(Sol):3月完成預訓練,對應現在公開的GPT-5.5、5.6系列;
Doug:4到5月完訓,後續經強化學習等訓練,便是即將現身的Astra,也就是外傳的GPT-6;
Bel:8月剛結束預訓練,總參數超過10兆,規模逼近當年GPT-4.5。
爆料稱,OpenAI內部將Bel視為「GPT-6之後的基礎模型」,甚至可能成為某個跨過AGI門檻模型的基座。


Anthropic這邊,有人在8月18日發現Claude網頁版部分Fable 5帳戶,悄悄被換上一個新模型。
這是Anthropic發布前的慣例,Fable 5當初也是這樣灰度推出的。
接著代號就被扒出來了。
claude-melon-eap,疑似Fable 5.1;
claude-marshmallow-eap,疑似Opus 5.1。
而且,兩個新模型據傳都已經在小範圍上線,隨時可全面開放。

至於為何都按兵不發,網友們分析,誰先發幾天內肯定就被對方追回。
尤其Anthropic還外傳,2027年初會直接奪得領先地位。

這正好劃出了這場大戰的時間窗口。
2026年剩餘4個月。
有機構做過估算,Anthropic有88%機率搶先OpenAI上市,最可能日子是今年10月26日,OpenAI最可能是明年7月15日。
上市當天市值預估,Anthropic 1.82兆美元,OpenAI 1.06兆美元。
OpenAI的CFO在8月員工大會表示,公司將於2027年或更早上市,前提是業務「持續轉強」。
所以年底那個AGI,絕不只是技術里程碑。
那是招股說明書最「關鍵」的一頁。
如果交得出來,OpenAI的故事就從「我們燒錢造模型」變成「我們已經站上終點線」,估值邏輯全改。交不出來,明年7月敲鐘時,還是那個一直在燒錢的故事。
而這一仗必須要打的根本,在於遞迴自我改進這四個字。
老黃那句「4萬人指揮400萬AI Agent」,OpenAI那句「AI已在協助打造下一代AI」,說的其實是同一件事:一旦AI能自動承接下一代AI的研發,進步就不再是線性的。
這也是為什麼大家都在賭,超級智能ASI這場競爭,最後一定是贏家全拿。
第一個把這個循環真正做起來的,會順勢拿走後面一切。第二名,可能連追趕資格都沒有。
奧特曼背後,已經再無退路。
編輯:摩西 桃子


免責聲明:文章中的所有內容僅代表作者的觀點,與本平台無關。用戶不應以本文作為投資決策的參考。
您也可能喜歡
巴克萊拆解AI利潤格局:模型公司每100美元收入,35-40美元流向雲廠,為其帶來10-20美元營業利潤

一枚 AI 戒指,憑什麼值 160 億美元?

美聯儲會如何做?沃什給出答案!

GTA 6帶來投資機會!?

