
第 3 期 · 每週一期,判斷是連續的
JustSayAIWeeklyReport
深度求索四比零勝出卻未贏得用戶,成本倒掛終結性能競賽。
人民公园说AI · JustSayAI
www.justsayai.org
Week of
06.30 — 07.06
2026 年 7 月 6 日 · 本週判斷
Contents · 目錄
這一期,
讀什麼。
左側時間軸即本章節目錄 —— 你可以順序閱讀,也可以直接跳到任何一條主線。
Editor’s Thesis
本週總判斷
深度求索四比零勝出卻未贏得用戶,
成本倒掛終結性能競賽。
DeepSeek以4-0擊敗Claude卻未贏得所有用戶,這一悖論揭示了行業關鍵轉折:實驗室評測優勢與生產環境價值正在加速脫鉤。值得注意的是,V4-Flash與Gemini的成本倒掛已讓單純追逐性能指標顯得可疑。兩者放一起看,從通義千問前負責人轉向智能體、到開發者重新核算運行成本,AI競爭的主戰場正從模型排行榜遷移至注重經濟回報的實用部署。
The Tape · 本週音軌
整整 06:39。你可以先聽 60 秒。
Key Moments · 每一個紅標,都是本週音頻裡被標記出來的時刻
00:00試聽內
DeepSeek 以 4-0 擊敗 Claude(AI助手)。我仍然選擇了 Claude(AI助手)。 - YouTube
“這周看完就一個感覺——AI行業卷誰更聰明那套敘事,基本到頭了。”
- DeepSeek V4 Pro在盲測中以4-0擊敗Claude Opus 4.8,但測評博主仍選擇訂閱Claude。
- 用戶付費時更看重穩定性和錯誤成本,而非單項評分。
- 模型能力評測存在通脹,實際應用需考慮對齊和安全。
01:49鎖定 · 試聽外
DeepSeek V4-Flash vs Gemini:成本倒掛背後的暗賬
“第二條線,DeepSeek 那個 V4-Flash,SitePoint 直接拿它跟 Gemini 在生產環境算成本,說便宜到倒掛。”
- SitePoint比較DeepSeek V4-Flash和Gemini的生產成本,顯示DeepSeek便宜到倒掛。
- DeepSeek兼容OpenAI API,遷移成本低,但生產環境需考慮吞吐、緩存、失敗重試和維護成本。
- 低成本依賴特定架構犧牲通用性,用戶需自建腳手架。
04:01鎖定 · 試聽外
Qwen前負責人:混合思維模型是誤區,All in Agent
“通義千問前技術負責人林俊揚,直接說混合思維模型是個誤區,他要 All in Agent。”
- 林俊揚認為Qwen3的混合思維模式因模型缺乏元認知而不可靠。
- 下一代機會在Agent架構,將智能分散到工作流中。
- Agent的強化學習基礎設施(如Reward Model)是當前最大挑戰。
Story 01 · 音軌 00:00 · 其他
DeepSeek 以 4-0 擊敗 Claude(AI助手)。我仍然選擇了 Claude(AI助手)。 - YouTube
這周看完就一個感覺——AI行業卷誰更聰明那套敘事,基本到頭了。
事實 · Fact
🤖 DeepSeek V4 Pro盲測4-0勝Claude,作者為何仍選Claude?
- 01DeepSeek V4 Pro在盲測中以4-0擊敗Claude Opus 4.8,但測評博主仍選擇訂閱Claude。
- 02用戶付費時更看重穩定性和錯誤成本,而非單項評分。
- 03模型能力評測存在通脹,實際應用需考慮對齊和安全。
來源 ↗ youtube.com
Story 02 · 音軌 01:49 · 其他
DeepSeek V4-Flash vs Gemini:成本倒掛背後的暗賬
第二條線,DeepSeek 那個 V4-Flash,SitePoint 直接拿它跟 Gemini 在生產環境算成本,說便宜到倒掛。
事實 · Fact
🤖 DeepSeek V4-Flash vs Gemini:生產環境成本對比分析
- 01SitePoint比較DeepSeek V4-Flash和Gemini的生產成本,顯示DeepSeek便宜到倒掛。
- 02DeepSeek兼容OpenAI API,遷移成本低,但生產環境需考慮吞吐、緩存、失敗重試和維護成本。
- 03低成本依賴特定架構犧牲通用性,用戶需自建腳手架。
來源 ↗ sitepoint.com
Story 03 · 音軌 04:01 · 其他
Qwen前負責人:混合思維模型是誤區,All in Agent
通義千問前技術負責人林俊揚,直接說混合思維模型是個誤區,他要 All in Agent。
事實 · Fact
🤖 Qwen前負責人坦承混合思維模型缺陷,全面轉向AI Agent
- 01林俊揚認為Qwen3的混合思維模式因模型缺乏元認知而不可靠。
- 02下一代機會在Agent架構,將智能分散到工作流中。
- 03Agent的強化學習基礎設施(如Reward Model)是當前最大挑戰。
來源 ↗ marktechpost.com
Signal Scan · 本週其餘信號
還有 11 條,沒進本週主線。
🤖 NVIDIA 推理堆棧降低 DeepSeek V4 Token 成本 5 倍
本期頭條05🤖 Python調用Claude API入門指南:從安裝到流式響應
本期頭條06🤖 Claude Science成為Anthropic最新旗艦產品
本期頭條07🤖 Anthropic推出Claude科學測試版:多智能體AI工作臺助力基因組學研究
本期頭條08🤖 Anthropic指控三家中國AI公司用2.4萬賬戶1600萬次交互蒸餾Claude模型
本期頭條09🤖 Square零設置集成ChatGPT和Claude,餐廳訂單費率僅2.9%+$0.30
本期頭條10🤖 DeepSeek V4 7月中旬發佈,推出高峰時段API定價
本期頭條11🤖 DeepSeek V4 定檔7月中旬:高峰期 API 價格翻倍
本期頭條12🤖 DeepSeek V4正式版7月發佈,高峰期API費用翻倍
本期頭條13🤖 AI賬單衝擊:企業集體抵制,DeepSeek永久下調令牌價75%
本期頭條14🤖 DeepSeek開源AI模型以低成本實現技術突破
本期頭條整週速覽 —— 本週每一期早晚報的頭條,點擊回看當期:
06.30🚀 Gemini向美國用戶免費開放個性化AI圖像生成,DeepSeek永久下調令牌價格75%生圖免費新硬件,生物AI基建火,模型大降價邊緣AI落地,提示翻車社交生變
早報06.30🚀 美團開源LongCat-2.0,Anthropic指控DeepSeek等蒸餾Claude美團用國產芯片訓練出萬億參數模型還超低價,DeepSeek提速降費,GLM實現操作自由,AI圈卷瘋了
晚報07.01🤖 AI瀏覽器遭LayerX攻擊安全護欄失效,KFF民調揭示聊天機器人健康建議關聯疫苗謠言AI瀏覽器遭攻擊、健康謠言愛信AI、新模型來襲、腦機接口能讀句子、世界模型重現經典遊戲,這波消息真熱鬧!
早報07.01🤖 中國AI追趕Anthropic等,摩根士丹利AI減半風險對賬中國AI追平美國,移動設Token,摩根降權,手機AI上線,電影合作,科研新星,撲克改行量化,能耗太驚人了
晚報07.02🤖 馬斯克否認SpaceX AI手機報道,Square集成ChatGPT等推餐廳點單AI圈瘋了:闢謠、點餐、降本、融資、解封、舉報、芯片、貨運、6G、警不平
早報07.02🌟 DeepSeek被指示構建瀏覽器內勒索軟件,Weave Robotics推出家用機器人DeepSeek被指造勒索軟件,家用機器人7999美元,企業治理亂,Anthropic迴歸,G7喊標準,印度向西,電影也湊
晚報07.03🚀 谷歌等報告AI推高碳排放,OpenAI擬捐5%股權予美國主權財富基金谷歌亞馬遜碳排放飆升,OpenAI捐股權,智譜奪冠,安全成本設計遊戲哈薩比斯獲獎
早報07.03🤖 可靈籌20億美元擬從快手分拆,WebBrain開源本地AI瀏覽器代理可靈分拆、扎克慢、阿里省、美團萬億、開源、RAG、語音、編碼、訪華、版權
晚報07.04🤖 Trunk Tools棄通用模型縮文檔審查至10天,Midjourney發超聲掃描儀視頻遭質疑阿里找超導體,MJ做超聲,谷歌升級畫圖,專用AI改建築,55刀打包多模型...
早報07.04🤖 高盛維持MiniMax買入評級,ChatGPT等AI編程競技ChatGPT和DeepSeek打架,高盛看好MiniMax,世界盃監控升級,各種AI硬件和爭議層出不窮。
晚報07.05🤖 Midjourney與好萊塢大廠陷AI版權糾紛,Google推出Gemini Spark Mac版智能體扎堆開源內卷,好萊塢打版權戰醫療踩剎車,群體智慧新實驗,AI這周遍地開花
早報07.05🤖 GPT-5.5 Codex推理標記聚類或致性能下降,舊金山18萬美元年薪不再夠生活成本模型價格戰白熱化,DeepSeek低價勝出卻遭棄用,GPT-5.5翻車,舊金山高薪不夠花,AI智能體崛起效率革命加速
晚報07.06🚀 DeepMind獲ICML 2026大獎,中國全力攻關機器人靈巧手製造ICML大獎、中國靈巧手、AI翻譯、開源工作臺、模型經濟性、自我進化、教育新導師,AI遍地開花!
晚報本週共 14 條頭條,前 3 條是主線;早晚報 13 期。
The Week in One Line · 一句話總結
“深度求索四比零勝出卻未贏得用戶,成本倒掛終結性能競賽。”
每天兩封,用 10 分鐘把 AI 的噪音變成判斷力。早報看世界,晚報看中國。

人民公园说AIJustSayAI Weekly Report
JustSayAIWeeklyReport
每天兩封,把 AI 的噪音變成判斷力。
Next Issue · 下一期
2026.07.13 · 每週一更新 →