December 4, 2025 · JustSayAI

更新於

AI大神Ilya最新訪談|中國“應試教育”報應在了美國模型上?

AI大神Ilya最新訪談|中國“應試教育”報應在了美國模型上?

你敢信嗎?那個拿著奧數金牌、刷榜無敵的美國大模型,骨子裡其實是個被“應試教育”毀掉的做題家。它為什麼修不好一個簡單的Bug?為什麼改了A又壞了B?因為它根本就不懂什麼是編程,它只是在瘋狂地討好出題人,本質上,這是一種被算法獎勵的“作弊”。

中國乃至東亞最被人詬病的“應試教育”弊端,竟然極其諷刺地在美國最頂尖的AI模型上完成了閉環。

我們都在嘲笑只會刷題的書呆子,結果回頭一看,這不就是現在的 LLM嗎?Ilya Sutskever,這位曾經的大力出奇跡信徒,在他最新的訪談裡直接撕開了這層遮羞布:如果不改變底層邏輯,Scaling Law(縮放定律)在通用模型上可能真的走到頭了。

並不是“懂了”,只是“背過了”

Ilya 這次訪談的一個觀點是關於“Reward Hacking”(獎勵作弊)。為什麼 AI 考試能拿滿分,但在實際工程裡是個廢物?因為它所有的訓練目標就是為了“通過考試”。

這就像一個刷了一萬小時題庫的所謂“學霸”,和一個只學了一百小時但真正理解原理的天才。前者知道所有標準答案,但只要題目稍微變個花樣,它就崩了。目前的 AI 訓練,本質上是在獎勵這種“投機取巧”。它並沒有建立起世界模型,它只是在概率的海洋裡,拼命預測下一個能讓你滿意的 Token。這根本不是智能的湧現,這是“討好型人格”的極致演繹。

沒了“情緒”,AI 連襪子都穿不上

很多人還在意淫 AI 會產生自我意識,Ilya 卻用一個神經科學的例子給我們潑了盆冷水:沒有“情緒”或“價值函數”,智能就是個笑話。

想象一個腦部受損的病人,智力完好,四肢健全,但他早上起床會崩潰——因為他花了幾個小時都決定不了該穿哪雙襪子。為什麼?人類之所以能秒做決定,是因為我們有“情緒(emotion)”,有偏好,有那個極其低功耗的“價值函數”。

現在的 AI 就是這個病人。它看似邏輯嚴密,實則患有嚴重的“選擇困難症”。它沒有直覺,沒有喜惡,它給你輸出答案不是因為它覺得這個“對”,而是因為它計算出這個答案最安全、最符合你的預期。一個沒有“Gut Feeling”的智能,永遠只能做人類的附庸,而不是夥伴。

通用模型的 Scaling Law 已死?

這可能是資本市場最不愛聽的一句話,但我必須得說:通用大模型的 Scaling Law 可能真的結束了。

那個指望靠堆算力、堆數據、堆顯卡就能通往 AGI的時代,正在落下帷幕。Ilya 曾經是 Scaling Law 的堅定鼓吹者,現在他卻變身成了哲學家,開始談論 System 2(慢思考)和 specialized models(專用模型)。這釋放了一個極其危險的信號:大力不再出奇蹟了。

但這不代表 AI 完了。恰恰相反,通用模型的黃昏,是專用模型的黎明。像特斯拉 FSD 這種垂直領域的 Scaling Law 才剛剛開始。未來不再屬於那些試圖做一個“全知全能神”的公司,而屬於那些肯俯下身子,在醫療、法律、自動駕駛這些垂直領域裡,把 AI 訓練成頂尖專家的公司。

別把“工具”當“物種”

我們對 AI 最大的誤解,就是總想把它塑造成人。我們給它起名“人工智能”,潛意識裡就把它當成了人類智慧的某種延伸或模仿。

大錯特錯。AI 應該是一種完全平行的智慧形式。正如人類因為會使用工具而偉大,而不是因為會說話而偉大。我們總是痴迷於 AI 的語言能力,卻忘了它本質上應該是我們大腦的“外掛”,而不是大腦的“克隆體”。

AGI 不應該是一個出廠即巔峰的成品,而應該是一個擁有極致學習能力的“學習者”。它不需要像人類一樣有多愁善感,但它需要有從非確定性中尋找確定性的能力。我敢打賭,未來的 AI 絕不會長成我們現在想象的樣子。它不會是一個有著人類弱點的硅基生命,而是一股在物理世界和數字世界穿梭的、甚至有些冷酷的效率洪流。

說到底,AI 現在的“智障”表現,不是因為它笨,而是因為我們人類太自戀,總想用我們那套蹩腳的“應試教育”去規訓一個本該飛翔的物種。

這讓我我想起莊子的一句話:

吾生也有涯,而知也無涯。以有涯隨無涯,殆已!

扎克用 Muse,踹開美國互聯網的大門|個人Agent怎麼就火了呢?
BLOG

扎克用 Muse,踹開美國互聯網的大門|個人Agent怎麼就火了呢?

Meta 剛把 Muse 甩在全網臉上的時候,是真的把我給看傻了。小扎這次徹底破防,直接扒了西裝、光著膀子去踹大廠防盜門!什麼叫個人 Agent?什麼叫代客上網?扒掉這層黑話,本質到底是個啥?扎克伯格就是想在北美荒原上,砸出一個美國版“微信”! 過去十年小扎受了多大窩囊氣?苦蘋果久矣,苦谷歌久矣!堂堂萬億巨頭,手裡沒手機入口、沒操作系統,連個生態都沒有!在硅谷體面人眼裡,小扎算個什麼東西?無非是個倒騰信息流、賺散碎廣告費的土豪。川總閉門宴不帶他,國會問責買單第一個叫他,分肉時又一腳踢開。這十來年他憋的屈辱,布洛芬都不知道他有多痛!這次搞 Muse 連亞馬遜祖墳都敢刨,這就是藏不住的滔天野心。 誰還討論基模拉胯?扯下遮羞布直接“代客上網”! 很多朋友問我:為什麼 Muse 能在北美瘋火?難道 Meta 的大模型突然開掛了? 開什麼玩笑!Meta 基模拉胯成什麼德行,圈裡誰沒點數?你去大街上問問,誰還在討論小扎的模型參數?根本沒人理!所有人全在喊:Muse 太香了!只要能把事辦妥,誰管你後端掛的是開源模型,還是偷偷接了神秘東方力量? 秘密到底在哪?就

小苏·2026年9月30日
Computer Use,就是普通人的AGI!|GPT 6還是被低估了!
BLOG

Computer Use,就是普通人的AGI!|GPT 6還是被低估了!

你們以為大模型的上限,也就是個稍微聰明的聊天機器人?是個屁!當GPT-6接上機械臂,自己在那兒一幅接一幅地畫金門大橋油畫,還畫得一幅比一幅像樣時,我徹底想通了。 這意味著什麼?這意味著前沿AI開始直接上手操作物理和數字世界了!最讓人毛骨悚然的是,它的成本還在斷崖式下跌。Opus 5這種級別的模型,現在成本直接砍掉70%。你以為這是普通迭代?這是針對傳統白領斬殺程序的正式啟動!等GPT-8、9的Computer Use出來,哪怕智力原地踏步,只要價格打成白菜價,這就是普通人的AGI!屆時它操作電腦比你好,還比你便宜一萬倍。你在這個世界的生態位,還有嗎? 你的鐵飯碗,在它眼裡就是個笑話 我們之前覺得,Computer Use(讓AI控制電腦)是個雞肋。因為現在軟件都在API化、命令行化,誰還去點鼠標?就像Word普及了你非僱人敲打字機,這不是脫褲子放屁嗎?直到最近看到一個狠辣的場景,才徹底認慫。 有個做Mac清理軟件的獨立開發者,讓AI去下載了近四百個常用軟件。然後AI像個幽靈,追蹤這些軟件裝在哪個目錄,哪幾個文件夾藏著垃圾。它不僅逐一分析,還自動提取規則

小苏·2026年9月26日
GPT-6說自己是AGI,李飛飛和馬斯克不服了!|聊聊GPT 6、世界模型、Cybercab誰才是AGI?
BLOG

GPT-6說自己是AGI,李飛飛和馬斯克不服了!|聊聊GPT 6、世界模型、Cybercab誰才是AGI?

先來上一段暴論!我一直是硅谷最討厭的“OpenAI 倒閉論”堅定倡導者。原本以為這次 GPT-6 和 Astra 憋出了什麼驚天大招,但看完全部發布與實測,我不僅沒看到所謂的通用人工智能,反而被硅谷巨頭的畫餅吃相給嚇慘了!不僅 OpenAI 還在生死線上死撐,等上市狂歡過去後,我看 Anthropic 和 Claude 怕是更要直接爆雷。 放眼現在的硅谷,簡直是一場群魔亂舞的集體瘋魔。奧特曼拼命兜售他的“最強大腦”,李飛飛瘋狂鼓吹她的“虛擬自習室”,馬斯克則開著沒有方向盤的鐵殼子宣稱搞出了“終極手腳”。每個人都指著自家的殘次品嗷嗷叫著宣稱 AGI 已來。可這到底是科技奇點,還是聯合收割韭菜的超級騙局?今天我就把這三大神話徹底扒個底朝天! 屎上雕花的 GUI,被 Agent 扒了個精光 先聊聊掀起巨浪的 GPT-6 和 Astra。很多人盯著那幾個基準跑分超過 Claude Fable 就高潮了,但那點微弱優勢算個屁?這次真正引發地震的,是 Computer Use 和 ARC-AGI-3 指標。 什麼叫 ARC-AGI-3?就是把 Agent 扔進完全

Jacob Chen·2026年9月9日