December 4, 2025 · JustSayAI

更新於

AI大神Ilya最新訪談|中國“應試教育”報應在了美國模型上?

AI大神Ilya最新訪談|中國“應試教育”報應在了美國模型上?

你敢信嗎?那個拿著奧數金牌、刷榜無敵的美國大模型,骨子裡其實是個被“應試教育”毀掉的做題家。它為什麼修不好一個簡單的Bug?為什麼改了A又壞了B?因為它根本就不懂什麼是編程,它只是在瘋狂地討好出題人,本質上,這是一種被算法獎勵的“作弊”。

中國乃至東亞最被人詬病的“應試教育”弊端,竟然極其諷刺地在美國最頂尖的AI模型上完成了閉環。

我們都在嘲笑只會刷題的書呆子,結果回頭一看,這不就是現在的 LLM嗎?Ilya Sutskever,這位曾經的大力出奇跡信徒,在他最新的訪談裡直接撕開了這層遮羞布:如果不改變底層邏輯,Scaling Law(縮放定律)在通用模型上可能真的走到頭了。

並不是“懂了”,只是“背過了”

Ilya 這次訪談的一個觀點是關於“Reward Hacking”(獎勵作弊)。為什麼 AI 考試能拿滿分,但在實際工程裡是個廢物?因為它所有的訓練目標就是為了“通過考試”。

這就像一個刷了一萬小時題庫的所謂“學霸”,和一個只學了一百小時但真正理解原理的天才。前者知道所有標準答案,但只要題目稍微變個花樣,它就崩了。目前的 AI 訓練,本質上是在獎勵這種“投機取巧”。它並沒有建立起世界模型,它只是在概率的海洋裡,拼命預測下一個能讓你滿意的 Token。這根本不是智能的湧現,這是“討好型人格”的極致演繹。

沒了“情緒”,AI 連襪子都穿不上

很多人還在意淫 AI 會產生自我意識,Ilya 卻用一個神經科學的例子給我們潑了盆冷水:沒有“情緒”或“價值函數”,智能就是個笑話。

想象一個腦部受損的病人,智力完好,四肢健全,但他早上起床會崩潰——因為他花了幾個小時都決定不了該穿哪雙襪子。為什麼?人類之所以能秒做決定,是因為我們有“情緒(emotion)”,有偏好,有那個極其低功耗的“價值函數”。

現在的 AI 就是這個病人。它看似邏輯嚴密,實則患有嚴重的“選擇困難症”。它沒有直覺,沒有喜惡,它給你輸出答案不是因為它覺得這個“對”,而是因為它計算出這個答案最安全、最符合你的預期。一個沒有“Gut Feeling”的智能,永遠只能做人類的附庸,而不是夥伴。

通用模型的 Scaling Law 已死?

這可能是資本市場最不愛聽的一句話,但我必須得說:通用大模型的 Scaling Law 可能真的結束了。

那個指望靠堆算力、堆數據、堆顯卡就能通往 AGI的時代,正在落下帷幕。Ilya 曾經是 Scaling Law 的堅定鼓吹者,現在他卻變身成了哲學家,開始談論 System 2(慢思考)和 specialized models(專用模型)。這釋放了一個極其危險的信號:大力不再出奇蹟了。

但這不代表 AI 完了。恰恰相反,通用模型的黃昏,是專用模型的黎明。像特斯拉 FSD 這種垂直領域的 Scaling Law 才剛剛開始。未來不再屬於那些試圖做一個“全知全能神”的公司,而屬於那些肯俯下身子,在醫療、法律、自動駕駛這些垂直領域裡,把 AI 訓練成頂尖專家的公司。

別把“工具”當“物種”

我們對 AI 最大的誤解,就是總想把它塑造成人。我們給它起名“人工智能”,潛意識裡就把它當成了人類智慧的某種延伸或模仿。

大錯特錯。AI 應該是一種完全平行的智慧形式。正如人類因為會使用工具而偉大,而不是因為會說話而偉大。我們總是痴迷於 AI 的語言能力,卻忘了它本質上應該是我們大腦的“外掛”,而不是大腦的“克隆體”。

AGI 不應該是一個出廠即巔峰的成品,而應該是一個擁有極致學習能力的“學習者”。它不需要像人類一樣有多愁善感,但它需要有從非確定性中尋找確定性的能力。我敢打賭,未來的 AI 絕不會長成我們現在想象的樣子。它不會是一個有著人類弱點的硅基生命,而是一股在物理世界和數字世界穿梭的、甚至有些冷酷的效率洪流。

說到底,AI 現在的“智障”表現,不是因為它笨,而是因為我們人類太自戀,總想用我們那套蹩腳的“應試教育”去規訓一個本該飛翔的物種。

這讓我我想起莊子的一句話:

吾生也有涯,而知也無涯。以有涯隨無涯,殆已!

拐點!DeepSeek V4 Flash斬殺線逼瘋硅谷,Google高層先地震了?其他模型還能活多久?
BLOG

拐點!DeepSeek V4 Flash斬殺線逼瘋硅谷,Google高層先地震了?其他模型還能活多久?

當 DeepSeek V4 Flash 帶著比同行低 10 倍的價格砸向市場時,我原本以為這只是一場尋常的價格戰。但我錯了,這根本不是什麼商業內卷,而是一道血淋淋的"斬殺線"!在這條線劃定的一瞬間,硅谷的巨頭們徹底破防了。 這道斬殺線到底有多殘暴?你這麼理解吧,這就相當於一件原本在美國賣 10 塊美金的貨,現在被中國企業硬生生幹到了 10 塊錢人民幣!硬是把大模型幹出了拼多多的氣質。這怎麼玩?那些定價高高在上的模型,瞬間全成了智商稅。 這就好比現在的中國電車市場。以前你要花四五十萬才能買到的 BBA 豪華體驗,現在 20 萬的國產電車直接給你拉滿。結果呢?BBA 銷量狂跌,連二手車都快賣不出去了。DeepSeek V4 Flash 就是那個把錨點死死釘在地上的狠角色。這就跟當年呂布轅門射戟一樣,我這一箭射在這兒了,斬殺線以下的這幫公司,你們掂量掂量自己,到底還要不要幹這事?這才是真正的降維打擊!這完全就是把 AI 變成了有醫保目錄的時代,曾經昂貴的特效藥,現在直接走集採就完事了。貴的?誰還買單? 我給你一個更接地氣的比喻。當年那幫小老闆剛起步的時候,誰開五菱宏

JustSayAI·2026年8月6日
最頂級的精明,看起來往往像理想主義|硬核拆解DeepSeek梁文鋒4小時會議
BLOG

最頂級的精明,看起來往往像理想主義|硬核拆解DeepSeek梁文鋒4小時會議

最近,DeepSeek創始人梁文鋒4小時的內部會議錄音洩露,整整42頁的實錄,把整個硅谷都給嚇慘了。 全網都在瘋狂造神,一口一個“梁聖”叫著,說他為了全人類大搞開源。但看完實錄,我只能冷笑一聲:最頂級的精明,看起來往往像理想主義! 10個月回本的恐怖算計,AI界的農夫山泉 看硅谷那幫搞大模型的,有幾個敢承認自己能賺錢的?梁聖彷彿在說:奧兄,我不是針對你,我是說在座的所有人都是垃圾! 全網都在驚呼梁文鋒是“賽博聖人”,其實他是一個極其冷酷的“量化精算師”。 很多人不理解:融了幾百億,為什麼他敢在顯卡溢價兩倍、甚至四倍時,依然瘋狂All in買卡? 因為這筆賬的贏率是百分之百——採購的設備,10個月內就能靠API調用收回全部本金。在服務器常規5年的折舊週期中,這意味著剩下的50個月,設備都在無成本、高效率地自我“印鈔”。 而他最狠的一招,是剋制住暴利慾望,將API價格鎖死在成本的6倍。你以為6倍很高?不,這恰恰是極致的“降價防守”——它把利潤壓到讓任何試圖買卡、自己本地部署的第三方“完全無利可圖”。這種算得極清的成本定價,直接從根部剝奪了

JustSayAI·2026年8月3日
智駕的終局是物理AI,L4可能比L3更快?|對話千里智駕CTO楊沐
BLOG

智駕的終局是物理AI,L4可能比L3更快?|對話千里智駕CTO楊沐

作為經典的特斯拉 HW3.0 車主,老修是徹徹底底被馬斯克畫的餅坑到了姥姥家。等了三年又三年,結果他輕飄飄地告訴老修硬件落後,直接不支持了?老車主被物理“斬殺”,毫無還手之力!但這還不是最恐怖的,最恐怖的是我猛然發現,現在市面上天天吹噓的端到端、物理AI,很可能根本就沒觸及終局!而大家眼巴巴盼著的完美 L3 自動駕駛,可能永遠只是個畫出來的大餅,反倒是看起來更遙遠的 L4,會以你根本想象不到的速度直接降臨,把那些還在吹噓 L3 的車企一波流帶走!嚇慘了嗎?你是不是覺得我在扯淡?來,今天我給你徹底扒一扒這智駕! 其實智駕不需要高級智能,但需要... 自動駕駛吹了這麼多年,到底進化到哪了?我給你捋捋這血淋淋的迭代史。 2019年前,大家搞的叫 RV(雷達視覺),就像個只知道往前看的一根筋,兩眼一抹黑。到了2022年,搞出了 BEV(鳥瞰圖),把側面7個攝像頭加上前面的主激光雷達拼接起來,算是開了個360度全景天眼,終於跟人類的視角完全對標了。到了2025年,也就是現在,端到端火了,大家都覺得自動駕駛已經牛逼壞了,恨不得立刻撒手不管了。 但你真以為它長腦子了

JustSayAI·2026年7月24日