September 30, 2025 · JustSayAI

更新于

特斯拉解散 Dojo 超级计算机团队,这背后原因有哪些?

特斯拉解散 Dojo 超级计算机团队,这背后原因有哪些?

我必须承认,当马斯克突然宣布砍掉整个Dojo团队时,我的第一反应是:这是假新闻吗? 这可不是小打小闹,这是一个投入了数年、耗费了数十亿美金、在每一季财报里都被寄予厚望的“亲儿子”。用一个不那么恰当但足够形象的比喻,这无异于一个中年男人,在事业巅峰期,亲手割掉了自己的一个肾。你得想象一下,这有多疼。

但这绝不是一次简单的战略收缩,更不是一次愚蠢的投资失败。这是一次痛苦、决绝、但又无比理性的“献祭”。马斯克挥刀砍向的,不仅仅是一个落后英伟达四代、已然走进“进化死胡同”的自研芯片项目 ,更是向整个行业宣告:基于纯粹大语言模型(LLM)的旧神正在黄昏,一个名为“世界模型”(World Model)的新神,即将降临。特斯拉,或者说马斯克的整个AI帝国,正在完成一次架构上的“换脑手术”,一次从大脑到身体的彻底解耦。

语言模型的黄昏:六指“幻觉”与架构的尽头

让我们先谈谈那个被献祭的“旧神”——大语言模型。我们必须面对一个残酷的现实:LLM的进化正在明显见顶。别看GPT-5闹得沸沸扬扬,但它相较于前代,并没有带来“从3.5到4”那样的飞跃式突破,面对Grok和Claude,也只是微弱胜出。这背后,是架构的根本性瓶颈。

一个流传甚广的“六指测试”绝妙地揭示了LLM的软肋:

你给GPT-5一张P过的六指手掌照片,它会无比坚定地告诉你,这是五个手指。 它甚至会帮你把“正确的”五根手指标出来,而对那多出来的第六指视而不见,将其当成背景。这不是蠢,这是它世界观的底层缺陷。LLM的世界是靠海量文本“学习”来的,它拥有庞大的知识,却没有真实的常识。 它的认知里,“人有五指”是一条铁律,当现实与它的知识库冲突时,它选择相信知识,而不是相信现实。

这个问题,无法通过堆砌更多的数据和算力来解决。

LLM这种纯粹基于语言符号的二维压缩模式,在理解和交互三维物理世界时,存在着不可逾越的鸿沟。就像王兴兴所言,机器人端的模型根本用不上预训练的那些数据,也像李飞飞那句充满哲学意味的断言:“世界是三维的”。语言,终究只是三维世界在我们二维认知里的一个扁平投影。

世界模型降临:当AI睁眼看见三维真实

正当LLM在二维世界里卷生卷死时,Google DeepMind发布的Genie 3,为我们展示了通往三维世界的大门。它不再满足于阅读文字,而是通过观看海量的视频,以无监督的方式,自己“悟”出了一个可以交互、遵循物理规律、并且在时空上保持一致性的虚拟3D世界。

这与LLM是根本性的不同。它像AlphaZero不依赖人类棋谱、自我博弈进化一样,Genie 3正在摆脱人类语言的“标签”束缚,直接从像素中理解世界的运转方式。视频中的涂鸦,在你转了一圈后回来,它依然在那里;它能以每秒24帧的速度连续生成一分钟以上的流畅视频,每一帧都经过回溯计算,确保了惊人的物理一致性。

这才是具身智能的未来。过去,我们把机器人扔进真实世界里,通过一次次昂贵的碰撞去积累经验;而现在,我们可以在世界模型里,以接近零的边际成本,让无数个智能体24小时不间断地进行虚拟训练。

这也解释了马斯克为何要“换脑”——将“大脑”的预训练(交给X.AI和英伟达的通用能力)与“身体”的端侧推理(数百万辆特斯拉和机器人组成的真实世界数据采集器)彻底分开。大脑在上奥数班,身体则在练体育搏击,专业分工,效率至上。

道与术之争:真正的分野不在算力,而在模型之魂

所以,Dojo的死亡,并非特斯拉一家的得失,而是整个AI行业从“术”的竞争转向“道”的竞争的标志性事件。]过去,我们比拼的是谁的参数更多、算力更猛,这是“术”的层面。而现在,真正的分野在于你选择了哪条路,你的模型之魂是什么——是停留在二维语言的LLM,还是拥抱三维真实的World Model?

马斯克已经用割掉一个“肾”的惨痛代价,给出了他的答案。他选择放弃在“术”的层面与英伟达进行低效的追赶,而将所有赌注押在“道”的革新上。他要的,是一个能与物理世界深度交互、不断采集高质量真实数据的“身体”,而“大脑”则可以采用开放市场上最强的方案。这是一种更聪明、也更务实的策略。

黄仁勋的甜蜜烦恼

聊到这里,就不得不提那个皮衣下永远一身汗的男人——黄仁勋。 Dojo死了,最大的赢家看起来是他。但这背后,或许是更甜蜜的烦恼。无论是LLM还是World Model,都像饕餮巨兽般吞噬着算力,这让英伟达和台积电在短期内稳坐钓鱼台。 但真正的变革在于,市场的天平正在从“训练”端向“推理”端急剧倾斜。过去,客户是少数几家巨头;未来,每一个智能终端背后,都可能是一个推理芯片的新客户。蛋糕的切法,已经变了。

说到底,马斯克只是提前看到了语言的尽头。那个由文字和符号构建的精妙世界,终究只是一个“平面国”。

告别语言的平面国,世界终归是三维的。

观点整理自我的播客:人民公园说AI

👉訂閱「JustSayAI早晚報」· 每日兩封 · 一鍵聽報:https://justsayai.org/newsletter (需科学上网)

【关注频道】:

📺B站:叫我小苏就好啊

📕小红书:人民公园说AI

▶️油管:人民公园说AI

拐点!DeepSeek V4 Flash斩杀线逼疯硅谷,Google高层先地震了?其他模型还能活多久?
BLOG

拐点!DeepSeek V4 Flash斩杀线逼疯硅谷,Google高层先地震了?其他模型还能活多久?

当 DeepSeek V4 Flash 带着比同行低 10 倍的价格砸向市场时,我原本以为这只是一场寻常的价格战。但我错了,这根本不是什么商业内卷,而是一道血淋淋的"斩杀线"!在这条线划定的一瞬间,硅谷的巨头们彻底破防了。 这道斩杀线到底有多残暴?你这么理解吧,这就相当于一件原本在美国卖 10 块美金的货,现在被中国企业硬生生干到了 10 块钱人民币!硬是把大模型干出了拼多多的气质。这怎么玩?那些定价高高在上的模型,瞬间全成了智商税。 这就好比现在的中国电车市场。以前你要花四五十万才能买到的 BBA 豪华体验,现在 20 万的国产电车直接给你拉满。结果呢?BBA 销量狂跌,连二手车都快卖不出去了。DeepSeek V4 Flash 就是那个把锚点死死钉在地上的狠角色。这就跟当年吕布辕门射戟一样,我这一箭射在这儿了,斩杀线以下的这帮公司,你们掂量掂量自己,到底还要不要干这事?这才是真正的降维打击!这完全就是把 AI 变成了有医保目录的时代,曾经昂贵的特效药,现在直接走集采就完事了。贵的?谁还买单? 我给你一个更接地气的比喻。当年那帮小老板刚起步的时候,谁开五菱宏

JustSayAI·2026年8月6日
最顶级的精明,看起来往往像理想主义|硬核拆解DeepSeek梁文锋4小时会议
BLOG

最顶级的精明,看起来往往像理想主义|硬核拆解DeepSeek梁文锋4小时会议

最近,DeepSeek创始人梁文锋4小时的内部会议录音泄露,整整42页的实录,把整个硅谷都给吓惨了。 全网都在疯狂造神,一口一个“梁圣”叫着,说他为了全人类大搞开源。但看完实录,我只能冷笑一声:最顶级的精明,看起来往往像理想主义! 10个月回本的恐怖算计,AI界的农夫山泉 看硅谷那帮搞大模型的,有几个敢承认自己能赚钱的?梁圣仿佛在说:奥兄,我不是针对你,我是说在座的所有人都是垃圾! 全网都在惊呼梁文锋是“赛博圣人”,其实他是一个极其冷酷的“量化精算师”。 很多人不理解:融了几百亿,为什么他敢在显卡溢价两倍、甚至四倍时,依然疯狂All in买卡? 因为这笔账的赢率是百分之百——采购的设备,10个月内就能靠API调用收回全部本金。在服务器常规5年的折旧周期中,这意味着剩下的50个月,设备都在无成本、高效率地自我“印钞”。 而他最狠的一招,是克制住暴利欲望,将API价格锁死在成本的6倍。你以为6倍很高?不,这恰恰是极致的“降价防守”——它把利润压到让任何试图买卡、自己本地部署的第三方“完全无利可图”。这种算得极清的成本定价,直接从根部剥夺了

JustSayAI·2026年8月3日
智驾的终局是物理AI,L4可能比L3更快?|对话千里智驾CTO杨沐
BLOG

智驾的终局是物理AI,L4可能比L3更快?|对话千里智驾CTO杨沐

作为经典的特斯拉 HW3.0 车主,老修是彻彻底底被马斯克画的饼坑到了姥姥家。等了三年又三年,结果他轻飘飘地告诉老修硬件落后,直接不支持了?老车主被物理“斩杀”,毫无还手之力!但这还不是最恐怖的,最恐怖的是我猛然发现,现在市面上天天吹嘘的端到端、物理AI,很可能根本就没触及终局!而大家眼巴巴盼着的完美 L3 自动驾驶,可能永远只是个画出来的大饼,反倒是看起来更遥远的 L4,会以你根本想象不到的速度直接降临,把那些还在吹嘘 L3 的车企一波流带走!吓惨了吗?你是不是觉得我在扯淡?来,今天我给你彻底扒一扒这智驾! 其实智驾不需要高级智能,但需要... 自动驾驶吹了这么多年,到底进化到哪了?我给你捋捋这血淋淋的迭代史。 2019年前,大家搞的叫 RV(雷达视觉),就像个只知道往前看的一根筋,两眼一抹黑。到了2022年,搞出了 BEV(鸟瞰图),把侧面7个摄像头加上前面的主激光雷达拼接起来,算是开了个360度全景天眼,终于跟人类的视角完全对标了。到了2025年,也就是现在,端到端火了,大家都觉得自动驾驶已经牛逼坏了,恨不得立刻撒手不管了。 但你真以为它长脑子了

JustSayAI·2026年7月24日