October 28, 2025 · JustSayAI

更新於

強化學習爛透了,我們離AGI還要十年?|帶你解讀AI大神Karpathy重磅訪談

強化學習爛透了,我們離AGI還要十年?|帶你解讀AI大神Karpathy重磅訪談

我們現在談論的 AI Agent,90%是在假勤奮?

為什麼 Andrej Karpathy最近那兩個多小時、信息密度高到撐爆上下文窗口的訪談 如此重要?因為它給整個行業潑了一盆冷水:AGI 至少還要十年 。

這個判斷不是空穴來風,而是基於他最熟悉的自動駕駛領域 。十年前,Waymo 看起來“再有兩三年就行了” ;十年後的今天,我們發現它離真正的無人駕駛還差得遠 。

AI 行業最大的幻覺,就是把 Demo 的成功錯當成產品的勝利 。

99.9%的絕望:你永遠看不了那部電影

Karpathy提出了一個“9 的難題” (The problem of nines) 。一個產品能用(Demo),和這個產品可靠(Product),是兩個世界。99% 的可靠性,和 99.99999% 的可靠性,差異是天壤之別 。要真正替代人類,比如自動駕駛,你需要的是“九個 9”的穩定性 。

這個差距就像我們下載一部電影,進度條卡在 99.9% 。你覺得馬上就能看了,但沒有最後那 0.01%,這部電影你就永遠看不了 。

他寧願現在的模型“不聯網” 。因為大模型的核心機制是給你一個“最高概率的答案” ,它很難“知道自己不知道什麼” 。當一個“高概率”的垃圾信源進來時,災難就發生了。

吃垃圾:AI 現在的實現方式很“傻”

我們對 AI 技術的認知也有兩個巨大的反常識誤區。

第一個是“垃圾”。我們總覺得模型越大越好,動輒萬億參數。但Karpathy認為,現在的大模型都“太大了” 。它們之所以這麼臃腫,是因為被迫吃進去了海量的“互聯網垃圾數據” 。他甚至判斷,一個真正足夠智能的模型,可能只需要 100 億(10B)參數就夠了 。

第二個是“吸管”。我們都以為強化學習是 AI 的靈丹妙藥。Karpathy的觀點是:“強化學習其實很糟” (Reinforcement Learning is actually terrible) 。那為什麼大家都在用?因為“其他東西更糟” 。他用了一個絕妙的比喻:現在的強化學習,就像“用一根吸管去吸取監督信號” (using a straw to suck a supervision signal) 。你試圖用一種極其低效、帶寬極窄的方式,去獲取一個極其龐大、複雜的世界模型。

所以,別看現在的 AI 編碼工具很熱鬧,Karpathy直言,這些工具對他這種大神來說“根本不可用” 。因為他的代碼“過度抽象簡潔”,而 AI 只會用網上學來的“生產規範”和“垃圾代碼”來汙染它 。

智能的本質是“遺忘”,不是記憶

這就引出了最核心的觀點:我們對“智能”的定義可能從一開始就錯了。我們總以為,智能是“記得多”。AI 把所有數據都記住了,就是智能。錯了!

當前 AI 的實現方式是“傻”的,是“力大磚飛”。真正的智能,是“遺忘” 。

現在的模型“記憶力”太好了,能一字不差地背誦文章。這種對海量知識的“模糊回憶”(hazy recollection)反而成為一種負擔。人類的遺忘反而是一種“特性優勢”(feature not a bug),它逼迫我們去泛化。就像我們的大腦處理信息,靠的是“壓縮”和“遺忘” 。你不會記得小學每天發生的瑣事 ;幾十年後,你記住的只是“一個美好的小學階段”,或者“初戀的味道” 。大腦把細節全部遺忘,只留下了高度壓縮的“經驗”和“感覺” 。

這才是智能。

舉個不恰當的例子。很多小孩背書快,靠的不是逐字記憶,而是“圖片記憶法” 。我把整頁課文當成一張“快照” (snapshot) 拍下來,記住的是它的結構、段落分佈 ,而不是文字本身。

這恰好引出了Karpathy盛讚 DeepSeek OCR 的原因 。DeepSeek OCR 做的不是簡單的文字識別,它做的是“壓縮” 。它用處理圖像的方式,把 1000 個文字 Token 壓縮成了極少數的圖像 Token,同時保留了 97% 的信息準確度 。這才是“一圖勝千言” 。這也讓Karpathy得出一個推論:也許我們未來的模型,應該徹底轉向“用純圖像來訓練”,而不是現在的純文本 。

召喚“幽靈”,而非製造“智能”

所以,Karpathy的“幽靈論”到底是什麼意思?

他說,我們不是在“製造一隻動物”(Animal),而是在“召喚一個幽靈”(Ghost)。我理解“Animal”是某種硅基生物,是能獨立演化的物種 。而“幽靈”,是對人類已有知識和智能的一種“映射”和“複製” 。我們現在做的所有事——用垃圾數據餵它、用吸管訓練它、用蠻力堆參數——都是在試圖復刻這個幽靈。

但這也許不是終點。我更傾向於認為,這個“幽靈”真正的價值,在於它在映射人類智能的過程中,能夠“湧現”出我們人類自己都不具備的智能 。

諷刺的是,大模型被訓練出來尋找“最高概率的答案” ,但它自己卻很難“知道自己不知道什麼” 。或許Karpathy是對的,我們早就該把模型的網線拔了 。

真正的智能,是壓縮和遺忘。

【訂閱JustSayAI早晚報】

🌈新朋友!訂閱「JustSayAI早晚報」· 每日兩封 · 一鍵聽報 

🌟老朋友!加入會員獲取JustSayAI早晚報+深度研報+文字專欄

【主播小紅書】:

📕叫我小蘇就好啊

拐點!DeepSeek V4 Flash斬殺線逼瘋硅谷,Google高層先地震了?其他模型還能活多久?
BLOG

拐點!DeepSeek V4 Flash斬殺線逼瘋硅谷,Google高層先地震了?其他模型還能活多久?

當 DeepSeek V4 Flash 帶著比同行低 10 倍的價格砸向市場時,我原本以為這只是一場尋常的價格戰。但我錯了,這根本不是什麼商業內卷,而是一道血淋淋的"斬殺線"!在這條線劃定的一瞬間,硅谷的巨頭們徹底破防了。 這道斬殺線到底有多殘暴?你這麼理解吧,這就相當於一件原本在美國賣 10 塊美金的貨,現在被中國企業硬生生幹到了 10 塊錢人民幣!硬是把大模型幹出了拼多多的氣質。這怎麼玩?那些定價高高在上的模型,瞬間全成了智商稅。 這就好比現在的中國電車市場。以前你要花四五十萬才能買到的 BBA 豪華體驗,現在 20 萬的國產電車直接給你拉滿。結果呢?BBA 銷量狂跌,連二手車都快賣不出去了。DeepSeek V4 Flash 就是那個把錨點死死釘在地上的狠角色。這就跟當年呂布轅門射戟一樣,我這一箭射在這兒了,斬殺線以下的這幫公司,你們掂量掂量自己,到底還要不要幹這事?這才是真正的降維打擊!這完全就是把 AI 變成了有醫保目錄的時代,曾經昂貴的特效藥,現在直接走集採就完事了。貴的?誰還買單? 我給你一個更接地氣的比喻。當年那幫小老闆剛起步的時候,誰開五菱宏

JustSayAI·2026年8月6日
最頂級的精明,看起來往往像理想主義|硬核拆解DeepSeek梁文鋒4小時會議
BLOG

最頂級的精明,看起來往往像理想主義|硬核拆解DeepSeek梁文鋒4小時會議

最近,DeepSeek創始人梁文鋒4小時的內部會議錄音洩露,整整42頁的實錄,把整個硅谷都給嚇慘了。 全網都在瘋狂造神,一口一個“梁聖”叫著,說他為了全人類大搞開源。但看完實錄,我只能冷笑一聲:最頂級的精明,看起來往往像理想主義! 10個月回本的恐怖算計,AI界的農夫山泉 看硅谷那幫搞大模型的,有幾個敢承認自己能賺錢的?梁聖彷彿在說:奧兄,我不是針對你,我是說在座的所有人都是垃圾! 全網都在驚呼梁文鋒是“賽博聖人”,其實他是一個極其冷酷的“量化精算師”。 很多人不理解:融了幾百億,為什麼他敢在顯卡溢價兩倍、甚至四倍時,依然瘋狂All in買卡? 因為這筆賬的贏率是百分之百——採購的設備,10個月內就能靠API調用收回全部本金。在服務器常規5年的折舊週期中,這意味著剩下的50個月,設備都在無成本、高效率地自我“印鈔”。 而他最狠的一招,是剋制住暴利慾望,將API價格鎖死在成本的6倍。你以為6倍很高?不,這恰恰是極致的“降價防守”——它把利潤壓到讓任何試圖買卡、自己本地部署的第三方“完全無利可圖”。這種算得極清的成本定價,直接從根部剝奪了

JustSayAI·2026年8月3日
智駕的終局是物理AI,L4可能比L3更快?|對話千里智駕CTO楊沐
BLOG

智駕的終局是物理AI,L4可能比L3更快?|對話千里智駕CTO楊沐

作為經典的特斯拉 HW3.0 車主,老修是徹徹底底被馬斯克畫的餅坑到了姥姥家。等了三年又三年,結果他輕飄飄地告訴老修硬件落後,直接不支持了?老車主被物理“斬殺”,毫無還手之力!但這還不是最恐怖的,最恐怖的是我猛然發現,現在市面上天天吹噓的端到端、物理AI,很可能根本就沒觸及終局!而大家眼巴巴盼著的完美 L3 自動駕駛,可能永遠只是個畫出來的大餅,反倒是看起來更遙遠的 L4,會以你根本想象不到的速度直接降臨,把那些還在吹噓 L3 的車企一波流帶走!嚇慘了嗎?你是不是覺得我在扯淡?來,今天我給你徹底扒一扒這智駕! 其實智駕不需要高級智能,但需要... 自動駕駛吹了這麼多年,到底進化到哪了?我給你捋捋這血淋淋的迭代史。 2019年前,大家搞的叫 RV(雷達視覺),就像個只知道往前看的一根筋,兩眼一抹黑。到了2022年,搞出了 BEV(鳥瞰圖),把側面7個攝像頭加上前面的主激光雷達拼接起來,算是開了個360度全景天眼,終於跟人類的視角完全對標了。到了2025年,也就是現在,端到端火了,大家都覺得自動駕駛已經牛逼壞了,恨不得立刻撒手不管了。 但你真以為它長腦子了

JustSayAI·2026年7月24日