GPT-6說自己是AGI,李飛飛和馬斯克不服了!|聊聊GPT 6、世界模型、Cybercab誰才是AGI?

先來上一段暴論!我一直是硅谷最討厭的“OpenAI 倒閉論”堅定倡導者。原本以為這次 GPT-6 和 Astra 憋出了什麼驚天大招,但看完全部發布與實測,我不僅沒看到所謂的通用人工智能,反而被硅谷巨頭的畫餅吃相給嚇慘了!不僅 OpenAI 還在生死線上死撐,等上市狂歡過去後,我看 Anthropic 和 Claude 怕是更要直接爆雷。
放眼現在的硅谷,簡直是一場群魔亂舞的集體瘋魔。奧特曼拼命兜售他的“最強大腦”,李飛飛瘋狂鼓吹她的“虛擬自習室”,馬斯克則開著沒有方向盤的鐵殼子宣稱搞出了“終極手腳”。每個人都指著自家的殘次品嗷嗷叫著宣稱 AGI 已來。可這到底是科技奇點,還是聯合收割韭菜的超級騙局?今天我就把這三大神話徹底扒個底朝天!
屎上雕花的 GUI,被 Agent 扒了個精光
先聊聊掀起巨浪的 GPT-6 和 Astra。很多人盯著那幾個基準跑分超過 Claude Fable 就高潮了,但那點微弱優勢算個屁?這次真正引發地震的,是 Computer Use 和 ARC-AGI-3 指標。
什麼叫 ARC-AGI-3?就是把 Agent 扔進完全陌生的複雜環境,看它能不能自己摸索規律、調用工具、根據反饋做決策。在這項殘酷測試裡,以往不可一世的 Opus 5 僅僅拿到區區 30 多分,而原生的 GPT-6 一上來就衝過 60 分——這相當於普通人面對反人類政務內網時的摸索水平。如果套上一套 Harness“馬鞍外掛”,配上長期記憶與上下文壓縮,它的成績甚至能飆升到 99.9 分!
這意味著什麼?這意味著過去幾十年引以為傲的軟件工程,本質上就是在屎山代碼上雕花!類似 Blender 這種反人類的 3D 工具,就算給你一千塊錢求著你去學,你願意耗費上千小時去啃那些反常識的快捷鍵嗎?當年大家學 Photoshop、工業 CAD,靠著“一萬小時定律”謀生甚至炫技泡妞,說白了全因圖形界面極其難用。但現在,Astra 拿著畫板根據證件照行雲流水地作畫,調動 Blender 渲染出的 3D 場景比資深設計師毫不遜色。
強如滅霸,要毀滅宇宙也得先去找手套和寶石。今天的軟件邏輯徹底變天了:軟件壓根不再需要討好人類,唯一的價值就是成為服務 Agent 的精密工具。越難用、越複雜的軟件,在 AI 面前越容易被降維打擊。當所有操作都能被 Agent 完美代勞,那些還在守著舊工具壁壘沾沾自喜的人,你們手裡的飯碗到底還剩幾分底氣?
數據枯竭是偽命題,學渣才抱怨書讀完了
市場上又在瀰漫一股悲觀論調:說什麼 2022 年前的高質量語料已被榨乾,新生成的全是汙染殘渣,大語言模型已經徹底撞牆。
這純粹是無能者的胡說八道!在我看來,學渣才天天抱怨環境差、書都讀完了,真正的學霸早就默默關門回去“溫故而知新”了。馬斯克的 Grok 一路飆到 4.6,國內智譜最新發布的 5.3 Flash,訓練量級相比前代直接躍升整整 10 倍以上!這種躍升不是無腦堆字數,而是從純文字直接縱身躍入全模態。哪怕算力有差距、原始數據有短板,只要把核心數據換個方式重新清洗、深度提煉,在後訓練階段重塑邏輯,模型爆發出的戰力照樣直追頂級梯隊。
Scaling Law 根本沒有失效,它只是從粗放挖煤變成了精細化原子重組。如果有人跳出來告訴你“語料耗盡讓 AI 停滯了”,你大可以直接把這當成研發遇到瓶頸時死鴨子嘴硬的藉口。拿數據枯竭當幌子,掩蓋的不過是自己在算法重構上的平庸與懶惰!
李飛飛的“三無”自習室,連個摩擦力都算不明白
既然大語言模型有物理天花板,大家又一窩蜂湧向“世界模型”。李飛飛帶著 World Labs 創辦不到一年就狂攬十多億美元融資,緊接著扔出了名為 Atlas 的宣傳片。
全網瞬間炸鍋:一張靜態圖片生成逼真三維空間、鏡頭自由漫遊、隨手拉出《黑客帝國》般的子彈時間!無數人驚呼“這就是真正的 AGI”。但冷靜下來看底細,它到底是個什麼東西?
說句難聽的大實話,這分明是個典型的“三無產品”!一無公開發布的嚴肅論文,二無開源檢驗的數據集,三無面向大眾的公開 API,僅對極少數機構私下開放。這就好比打星際爭霸,李飛飛的 Atlas 目前充其量只是探路工兵,幫你把地圖迷霧探開、標出基地座標而已。當兩個物體真正發生碰撞,表面微觀的摩擦力有多大?受力形變怎麼傳導?它根本一片空白,完全無能為力!
谷歌 Genie 交互一分鐘就斷電;英偉達 Cosmos 算力成本高到吐血;Meta 天天在社交媒體打嘴炮,離實用八字還沒一撇。各大門派各佔狹窄切片,連彼此邊界都沒摸到,就急匆匆套上“世界模型”皇冠出來兜售。在自習室裡用積木搭了個漂亮沙盤,難道就敢宣稱自己參透了宇宙物理規律嗎?
奧斯汀街頭的賽博馬戲,45 輛車能革誰的命?
大腦和自習室吹完了,總得落實到能幹活的實體手腳上吧?老馬同志帶著特斯拉 Cybercab 登場了。奧斯汀街頭號稱全球首款沒有方向盤的無人車正式商業運營,馬斯克再次高呼劃時代革命:人類 95% 的家用車平時都在車庫吃灰,未來所有車都要變成 Cybercab 上街跑滴滴幫主人躺賺。
作為被反覆割過韭菜的老車主,我一看到這種宏大敘事就後背冒涼氣。老馬這是又在“望山跑死馬”的套路里故技重施!你去扒扒奧斯汀政府官方註冊數據,底褲都要被扯下來:真正合法登記運營的 Cybercab,總共只有寒磣的 45 輛!而旁邊跑著的 Model Y 卻有整整 420 輛,規模幾乎是其十倍!
一臺只有兩扇門、兩個座位的古怪轎跑,除了喝咖啡、看車載電影裝個逼,能滿足哪門子日常出行?馬斯克偏要死磕反人性的兩座設計,扒開全是算計——商業化無人運營的唯一生死線,就是每英里運營成本!
Waymo 跑一英里綜合成本高達 2 美元以上,最新一代費盡全力才壓到 0.99 美元。馬斯克砍成兩座,用“Unboxed”模塊化產線配合雙人高能效三電,綜合能效比全球最省電的 Model Y 再暴漲 40% 到 60%,硬把每英里成本轟到 0.7 美元去幹翻對手。
可死穴依然在人身上。沒有方向盤,遇到極端路況怎麼辦?目前監管期仍需遠程安全員雲端兜底。若這種兜底演變成像當年把英語外教外包在菲律賓大樓裡打手柄遙控,那你靠兩座省下的造車電費,夠填補龐大的人力運營黑洞嗎?
五嶽不歸一,神仙也難救
奧特曼兜售大腦,李飛飛搭建自習室,馬斯克打造手腳。看似並駕齊驅,實則在各自孤島上畫地為牢。
李飛飛遇到物理交互死結,得找馬斯克的真實車隊要極端路況數據;馬斯克的純視覺模型遇到認知死角,得求奧特曼的大腦注入高維推理;而奧特曼的大腦想要在物理世界落地,又必須依賴現實中的實體。三家各自立派,數據格式和交互邏輯互不兼容。
這就好比武俠裡的五嶽劍派,華山練劍、恆山修氣、泰山論道,表面都聲稱掌握天下第一神功,但各大門派一天不真正融合歸一,就永遠不可能出現武林盟主。缺少了大腦、感知與執行的深度咬合,現階段哪怕把任何一個切片吹上天,也充其量只是個昂貴玩具,離重塑文明的 AGI 還有十萬八千里!
看著車庫裡天天吃灰的特斯拉,我前幾天還幻想讓它明早上街跑網約車給我賺火鍋錢。現在看來,我還是踏實打開手機聽早晚報吧——真指望老馬的車替我打工,我怕是得先買機票去菲律賓排隊應聘手柄操作員了。
真到 AGI 那天,沒人再談 AGI。
【訂閱 JustSayAI 早晚報】 📮JustSayAI 早晚報·粉絲專屬福利 每日兩封 · 一鍵聽報!現已全面支持郵件+IM+Skill端



