July 24, 2026 · JustSayAI

智駕的終局是物理AI,L4可能比L3更快?|對話千里智駕CTO楊沐

智駕的終局是物理AI,L4可能比L3更快?|對話千里智駕CTO楊沐

作為經典的特斯拉 HW3.0 車主,老修是徹徹底底被馬斯克畫的餅坑到了姥姥家。等了三年又三年,結果他輕飄飄地告訴老修硬件落後,直接不支持了?老車主被物理“斬殺”,毫無還手之力!但這還不是最恐怖的,最恐怖的是我猛然發現,現在市面上天天吹噓的端到端、物理AI,很可能根本就沒觸及終局!而大家眼巴巴盼著的完美 L3 自動駕駛,可能永遠只是個畫出來的大餅,反倒是看起來更遙遠的 L4,會以你根本想象不到的速度直接降臨,把那些還在吹噓 L3 的車企一波流帶走!嚇慘了嗎?你是不是覺得我在扯淡?來,今天我給你徹底扒一扒這智駕!

其實智駕不需要高級智能,但需要...

自動駕駛吹了這麼多年,到底進化到哪了?我給你捋捋這血淋淋的迭代史。

2019年前,大家搞的叫 RV(雷達視覺),就像個只知道往前看的一根筋,兩眼一抹黑。到了2022年,搞出了 BEV(鳥瞰圖),把側面7個攝像頭加上前面的主激光雷達拼接起來,算是開了個360度全景天眼,終於跟人類的視角完全對標了。到了2025年,也就是現在,端到端火了,大家都覺得自動駕駛已經牛逼壞了,恨不得立刻撒手不管了。

但你真以為它長腦子了?扯淡!

現在的端到端方案,頂多算是個四肢發達、小腦長好了的“弱智”!什麼意思?這就好比,小腦能幫你維持平衡、躲避障礙,把運動神經拉滿了。但它懂什麼是“江湖規矩”嗎?

來個水坑,路中間長了個奇形怪狀的石柱,突然竄出來一群動物,它能認出來嗎?你遇到窄道匯入、遇到叉車加塞、極窄路段會車,老司機是怎麼幹的?老司機是靠察言觀色!看前車輪胎稍微轉了個30度,看對方司機手伸出來比劃了一下,甚至隔著玻璃看他眼神不對做個示意,就知道這孫子要插隊。這叫什麼?這叫因果關係推理!

而現在的智駕懂個屁的因果推理啊?它的底層邏輯就是模仿學習,它的本質就是在不帶任何智商的前提下,去嘗試擬合你的行為,這就是一種死板的概率分佈修正。它根本沒有因果推理能力,遇到這種複雜的交互博弈,立刻就得抓瞎!所以說,現在的自動駕駛,小腦是發育好了,但智商還停留在3歲,現在必須得給它瘋狂“雞娃”,把智商硬拔到10歲才行!

世界模型和 VLA?那就是給司機配個“神級領航員”

那到底怎麼給這三歲的弱智雞娃?難道給它塞個愛因斯坦的大腦進去嗎?

最近大家都在吹什麼“世界模型”、“VLA(視覺-語言-動作模型)”,聽得耳朵都起繭子了,覺得這玩意離我們普通老百姓十萬八千里。其實戳破了窗戶紙,根本沒那麼玄乎!

世界模型是個啥?它就是提出,必須用一種稠密的特徵來表徵這個世界。我不管你後續怎麼處理,我必須先把這個世界的一草一木、風吹草動都清清楚楚地編碼進系統裡,它就是一個完美的仿真器。

那 VLA 呢?就是想用大模型(LLM)的思維鏈能力,來彌補自動駕駛最缺乏的邏輯推理。

你以為物理 AI 就是一個超級模型解決所有問題嗎?你以為它是一個神仙,能把所有事情全包了?做夢呢!

這事兒的本質,相當於車子本身是一個底層的“司機”,專門負責踩油門和剎車;而大模型,就是坐在副駕駛的一個“神級領航員”。

常規路況下,司機自己開就行了;一旦遇到搞不定的神仙路況,司機直接轉頭問領航員:“大哥,前面這孫子想加塞,我咋辦?”這時候,領航員靠著世界模型的理解和大模型的因果推理,瞬間給出一個最優解。大家提世界模型也好,提VLA也好,本質就是怎麼把這兩個已經存在於大模型的能力,引入到現在的自駕基礎範式裡,我不讓既有能力回退,同時我又具備了新的推理能力。

別看現在很多大模型的 Demo 演示的時候像個下凡的仙女小龍女,一到你手裡就變成了買家秀的賈玲。為啥?因為如果你的基礎模型(基模)能力太差,沒有那些自駕的數據底子,你後期再怎麼做後處理(Post-training),它的上限都極其可憐!你連最基本的路況都識別不對,你還指望它能推理?

特斯拉在國內?可能連個車位都搶不到!

說到這,我知道肯定有人又要跪舔特斯拉了。確實,特斯拉 FSD 在北美,從第一性原理來看,那絕對是世界級的第一梯隊,無可厚非。

但它一旦到了國內呢?說句難聽的,它可能連個老頭樂都躲不開!這是為什麼?

因為特斯拉那套端到端能牛逼,是靠全北美乃至全世界的海量數據喂出來的。你每踩一腳剎車,每次亂轉一下方向盤,數據都能瞬間迴流給它訓練。

但你到了國內,能這麼玩嗎?第一,很多敏感地方你根本進不去,必須得隔離。第二,它的數據收集面臨極大的圖商資質等法規阻礙。

更致命的是,它只能從自己的車主身上收集數據。而像老修這種被淘汰的 HW3.0 老車主,我們的老車根本無法給它的新模型提供任何幫助!它想要在國內實現從0到1的數據循環閉環?抱歉!

200B 的大模型?你調的可能只是個“小老弟”

這時候你肯定要倒吸一口涼氣了:給車裝上這麼牛逼的世界模型、物理大腦,這車的硬件成本不得上天啊?這車我這輩子還買得起嗎?是不是得賣我幾百萬?

你這也太小看資本家精打細算的刀法了!

我問你,你以為你現在調用的那些號稱 200B(兩千億參數)的雲端大模型,每一次都是那個超級大腦在親力親為地回覆你嗎?

別做夢了!平時你問個“今天天氣咋樣”,後臺直接扔個 5B 的小模型,像打發要飯的一樣就把你打發了。只有當你急眼了開始罵人,或者扔給它一道微積分的高級題,它後臺識別到你需要高級智商了,才會真正去調用那個 200B 的龐然大物。

車端不也是一樣的道理嗎?殺雞焉用牛刀!如果只是在市區裡開個車切個菜,又不是讓你去造原子彈、當全能的具身智能家教,需要那麼驚天地泣鬼神的高智商嗎?

完全不需要!未來絕對是通過雲端協同,或者把大模型精準裁剪,搞出一個十幾二十萬的平民版。你以為你買的是個滿級號,其實平常跑的都是新手村配置,只有在面對極其變態的複雜路況時,它才會調用一點真本事!所以,別擔心買不起,主流入門版絕對能讓你消費得起。

L4 極大概率會比 L3 來得更快!

好了,最顛覆認知的邏輯來了。現在全行業都在等 L3 自動駕駛的普及,但我今天就把話放在這:L4 極大概率會比 L3 來得更快,而且快得多!

為什麼會得出這麼反常識的結論?

因為L3 意味著商業模式和責任主體的一次徹徹底底的變更。你的保險怎麼算?責任誰來定?整個鏈條要重寫!而且 L3 是要賣給普通消費者的。你要知道,消費者是這個世界上最難伺候的神仙!你把一個號稱完美的 L3 賣給他,他可是把你當全能神來要求的,他要求你的系統在任何極端天氣、任何變態路況下都完美無缺。只要稍微出點差錯,哪怕只是一次沒剎住,他都能把你祖宗十八代罵翻在熱搜上。

為了伺候好消費者,車企要投入海量的人力物力去填補那些永無止境的長尾場景,這筆賬在商業上根本算不過來!

但是 L4 呢?L4 是運營方驅動的!它是以純粹的商業用途為導向。只要能賺錢,我就在特定的運行設計域裡跑就行了。遇到搞不定的死角咋辦?很簡單,這個區域我不開放運營不就完了嗎!實在不行,我提前告知消費者,然後通過雲端輔助手段接管。

只要商業邏輯閉環了,投資回報率(ROI)算得過來,L4 就能直接落地賺錢。

這不就是純粹的降維打擊嗎?

當 L3 還在為了討好消費者而在無盡的代碼裡苦苦掙扎的時候,L4 早就靠著特定場景的商業運營開始瘋狂收割市場了!

不過說真的,老修作為一個被特斯拉坑了整整四年的老韭菜,現在唯一的願望就是:以後上車,前面方向盤直接給我拆了,騰個地兒讓他放杯茶泡個枸杞寫代碼。至於這車是 L3 還是 L4,只要別再讓他等“三個兩年”,哪怕你是人工智障他都認了!

越是完美的大餅,越是資本的鐮刀!

縫合怪GPT-5.6來了!OpenAI開始造超級App!中美AI正在交換劇本!
BLOG

縫合怪GPT-5.6來了!OpenAI開始造超級App!中美AI正在交換劇本!

GPT-5.6 終於放出來了,我看到那個界面的第一眼,真的是被嚇慘了!為啥?因為我再也不用去求 Claude Fable 5 這個老油條了! 我最近用 Fable 5 簡直要吐血,他就跟我們以前在公司裡遇到的那種架構師一模一樣:技術確實牛逼,但他推鍋能力也是天下無敵啊!你想一想,你以前在公司裡遇到那種老鳥,你問他個事兒,他直接跟你打太極!“哎呀,這個涉及到安全問題呀,那個不符合規範呀。”他天天把那些政治正確掛在嘴邊,跟你裝死。甚至表面上答應你,轉頭就甩給小弟做一個 50 分的殘次品應付了事。這種打工人的苦,我居然在 AI 身上又受了一遍,真的是賤兮兮的!我天天蹲在他旁邊,恨不得拿個磚頭逼著他幹活,但他是個 AI 吶,他不吃飯也不下班,你拿他有什麼辦法? 但現在,GPT-5.6 來了,這世界清靜了!他完全沒有拒絕我,什麼安全問題、七七八八的藉口,統統沒有。他就用那種清澈的眼神看著我,上來沒有任何廢話,直接切入正題。我剛才還在開車呢,十幾分鐘的路程,他已經把幾十萬字的文檔和日誌全部分析完畢,結果直接甩我臉上!你要是用 Fable 5,少說得繞個半小時一小時! 跟

JustSayAI·2026年7月11日
用什麼Fable 5?都給我去用國產模型!
BLOG

用什麼Fable 5?都給我去用國產模型!

我先把話撂這兒:普通人跟頂級閉源模型,已經基本無緣了。Fable 5 這次最嚇人的地方,不是它有多強,而是它終於把牌攤開了:你花了錢,也未必配用真貨。 你興沖沖進去,以為自己摸到的是頂級大腦,結果門口先站著一個明保鏢,需求不順眼,直接拒;後面還藏著一個暗保鏢,覺得你這個問題太傻,偷偷把你轉給更笨的模型。日誌裡甚至能看到一句近乎羞辱的話:too dumb to use Fable。翻譯成人話是什麼?你太菜,不配。 頂級模型,花錢還不讓摸! Fable 5 不是第一個幹這事的。GPT-5.6 官宣得很熱鬧,20 個合作伙伴、三個等級,什麼超牛逼、一般牛逼、普通牛逼,名字我都懶得記,因為反正哪個也輪不到我。Claude Code 呢?限額、降質、切腦,一套連招下來,你一邊付錢,一邊祈禱今天別把博士切成實習生。 這說明什麼?說明閉源模型進入了“看門時代”。它們不再只拼能力,而是拼誰更會限量,誰更會分層,誰更會把最好的東西供起來給估值講故事。你以為自己在買生產力,其實你買的是排隊資格。你問它問題,它先問你:你配嗎? 這就很荒誕了。模型公司天天講 AGI,天

JustSayAI·2026年7月7日
UI時代終結了!GLM 5.2+Codex實現Token自由!下一代人真的不用電腦了?
BLOG

UI時代終結了!GLM 5.2+Codex實現Token自由!下一代人真的不用電腦了?

聊聊最近在硅谷和國內全網殺瘋了的智譜 GLM 5.2。 我一點也不誇張,它簡直就是我們國產生態的 DeepSeek R1 時刻!自從我去年底瘋狂囤了這個 coding plan 套餐,什麼 OpenAI 的神壇,什麼 Claude 的信仰,瞬間從小甜甜變成了牛夫人。為什麼?因為我算是徹底實現了 Token 自由! 這到底是個什麼概念?就是你終於不用像個窮逼一樣,每敲一行代碼都要算計口袋裡那幾個可憐的銅板了。你想想,以前每次調用大模型,看著屏幕上跳躍的字符,你心裡想的不是代碼有多牛,而是“臥槽,這得花多少錢”!現在呢?你完全可以對它說,去,給我把活兒全乾了,別跟我廢話! 先說 Token 自由這件事 你肯定要問,這玩意兒到底有多爽? 這麼說吧,以前我用 Codex 調一個極其刁鑽的 bug,這哥們兒一言不合就給我開個瀏覽器,一晚上在那裡瞎搞 computer use,第二天早上起來一看,硬生生給我燒掉了 200 美金!這誰頂得住啊?我心都在滴血啊!這種感覺是什麼?這簡直就是你請了一個按小時收費的頂級大律師,一小時幾百美金,你平時根本不捨得用。用的時

JustSayAI·2026年6月30日