
第 3 期 · 每周一期,判断是连续的
JustSayAIWeeklyReport
深度求索四比零胜出却未赢得用户,成本倒挂终结性能竞赛。
人民公园说AI · JustSayAI
www.justsayai.org
Week of
06.30 — 07.06
2026 年 7 月 6 日 · 本周判断
Contents · 目录
这一期,
读什么。
左侧时间轴即本章节目录 —— 你可以顺序阅读,也可以直接跳到任何一条主线。
Editor’s Thesis
本周总判断
深度求索四比零胜出却未赢得用户,
成本倒挂终结性能竞赛。
DeepSeek以4-0击败Claude却未赢得所有用户,这一悖论揭示了行业关键转折:实验室评测优势与生产环境价值正在加速脱钩。值得注意的是,V4-Flash与Gemini的成本倒挂已让单纯追逐性能指标显得可疑。两者放一起看,从通义千问前负责人转向智能体、到开发者重新核算运行成本,AI竞争的主战场正从模型排行榜迁移至注重经济回报的实用部署。
The Tape · 本周音轨
整整 06:39。你可以先听 60 秒。
Key Moments · 每一个红标,都是本周音频里被标记出来的时刻
00:00试听内
DeepSeek 以 4-0 击败 Claude(AI助手)。我仍然选择了 Claude(AI助手)。 - YouTube
“这周看完就一个感觉——AI行业卷谁更聪明那套叙事,基本到头了。”
- DeepSeek V4 Pro在盲测中以4-0击败Claude Opus 4.8,但测评博主仍选择订阅Claude。
- 用户付费时更看重稳定性和错误成本,而非单项评分。
- 模型能力评测存在通胀,实际应用需考虑对齐和安全。
01:49锁定 · 试听外
DeepSeek V4-Flash vs Gemini:成本倒挂背后的暗账
“第二条线,DeepSeek 那个 V4-Flash,SitePoint 直接拿它跟 Gemini 在生产环境算成本,说便宜到倒挂。”
- SitePoint比较DeepSeek V4-Flash和Gemini的生产成本,显示DeepSeek便宜到倒挂。
- DeepSeek兼容OpenAI API,迁移成本低,但生产环境需考虑吞吐、缓存、失败重试和维护成本。
- 低成本依赖特定架构牺牲通用性,用户需自建脚手架。
04:01锁定 · 试听外
Qwen前负责人:混合思维模型是误区,All in Agent
“通义千问前技术负责人林俊扬,直接说混合思维模型是个误区,他要 All in Agent。”
- 林俊扬认为Qwen3的混合思维模式因模型缺乏元认知而不可靠。
- 下一代机会在Agent架构,将智能分散到工作流中。
- Agent的强化学习基础设施(如Reward Model)是当前最大挑战。
Story 01 · 音轨 00:00 · 其他
DeepSeek 以 4-0 击败 Claude(AI助手)。我仍然选择了 Claude(AI助手)。 - YouTube
这周看完就一个感觉——AI行业卷谁更聪明那套叙事,基本到头了。
事实 · Fact
🤖 DeepSeek V4 Pro盲测4-0胜Claude,作者为何仍选Claude?
- 01DeepSeek V4 Pro在盲测中以4-0击败Claude Opus 4.8,但测评博主仍选择订阅Claude。
- 02用户付费时更看重稳定性和错误成本,而非单项评分。
- 03模型能力评测存在通胀,实际应用需考虑对齐和安全。
来源 ↗ youtube.com
Story 02 · 音轨 01:49 · 其他
DeepSeek V4-Flash vs Gemini:成本倒挂背后的暗账
第二条线,DeepSeek 那个 V4-Flash,SitePoint 直接拿它跟 Gemini 在生产环境算成本,说便宜到倒挂。
事实 · Fact
🤖 DeepSeek V4-Flash vs Gemini:生产环境成本对比分析
- 01SitePoint比较DeepSeek V4-Flash和Gemini的生产成本,显示DeepSeek便宜到倒挂。
- 02DeepSeek兼容OpenAI API,迁移成本低,但生产环境需考虑吞吐、缓存、失败重试和维护成本。
- 03低成本依赖特定架构牺牲通用性,用户需自建脚手架。
来源 ↗ sitepoint.com
Story 03 · 音轨 04:01 · 其他
Qwen前负责人:混合思维模型是误区,All in Agent
通义千问前技术负责人林俊扬,直接说混合思维模型是个误区,他要 All in Agent。
事实 · Fact
🤖 Qwen前负责人坦承混合思维模型缺陷,全面转向AI Agent
- 01林俊扬认为Qwen3的混合思维模式因模型缺乏元认知而不可靠。
- 02下一代机会在Agent架构,将智能分散到工作流中。
- 03Agent的强化学习基础设施(如Reward Model)是当前最大挑战。
来源 ↗ marktechpost.com
Signal Scan · 本周其余信号
还有 11 条,没进本周主线。
🤖 NVIDIA 推理堆栈降低 DeepSeek V4 Token 成本 5 倍
本期头条05🤖 Python调用Claude API入门指南:从安装到流式响应
本期头条06🤖 Claude Science成为Anthropic最新旗舰产品
本期头条07🤖 Anthropic推出Claude科学测试版:多智能体AI工作台助力基因组学研究
本期头条08🤖 Anthropic指控三家中国AI公司用2.4万账户1600万次交互蒸馏Claude模型
本期头条09🤖 Square零设置集成ChatGPT和Claude,餐厅订单费率仅2.9%+$0.30
本期头条10🤖 DeepSeek V4 7月中旬发布,推出高峰时段API定价
本期头条11🤖 DeepSeek V4 定档7月中旬:高峰期 API 价格翻倍
本期头条12🤖 DeepSeek V4正式版7月发布,高峰期API费用翻倍
本期头条13🤖 AI账单冲击:企业集体抵制,DeepSeek永久下调令牌价75%
本期头条14🤖 DeepSeek开源AI模型以低成本实现技术突破
本期头条整周速览 —— 本周每一期早晚报的头条,点击回看当期:
06.30🚀 Gemini向美国用户免费开放个性化AI图像生成,DeepSeek永久下调令牌价格75%生图免费新硬件,生物AI基建火,模型大降价边缘AI落地,提示翻车社交生变
早报06.30🚀 美团开源LongCat-2.0,Anthropic指控DeepSeek等蒸馏Claude美团用国产芯片训练出万亿参数模型还超低价,DeepSeek提速降费,GLM实现操作自由,AI圈卷疯了
晚报07.01🤖 AI浏览器遭LayerX攻击安全护栏失效,KFF民调揭示聊天机器人健康建议关联疫苗谣言AI浏览器遭攻击、健康谣言爱信AI、新模型来袭、脑机接口能读句子、世界模型重现经典游戏,这波消息真热闹!
早报07.01🤖 中国AI追赶Anthropic等,摩根士丹利AI减半风险对账中国AI追平美国,移动设Token,摩根降权,手机AI上线,电影合作,科研新星,扑克改行量化,能耗太惊人了
晚报07.02🤖 马斯克否认SpaceX AI手机报道,Square集成ChatGPT等推餐厅点单AI圈疯了:辟谣、点餐、降本、融资、解封、举报、芯片、货运、6G、警不平
早报07.02🌟 DeepSeek被指示构建浏览器内勒索软件,Weave Robotics推出家用机器人DeepSeek被指造勒索软件,家用机器人7999美元,企业治理乱,Anthropic回归,G7喊标准,印度向西,电影也凑
晚报07.03🚀 谷歌等报告AI推高碳排放,OpenAI拟捐5%股权予美国主权财富基金谷歌亚马逊碳排放飙升,OpenAI捐股权,智谱夺冠,安全成本设计游戏哈萨比斯获奖
早报07.03🤖 可灵筹20亿美元拟从快手分拆,WebBrain开源本地AI浏览器代理可灵分拆、扎克慢、阿里省、美团万亿、开源、RAG、语音、编码、访华、版权
晚报07.04🤖 Trunk Tools弃通用模型缩文档审查至10天,Midjourney发超声扫描仪视频遭质疑阿里找超导体,MJ做超声,谷歌升级画图,专用AI改建筑,55刀打包多模型...
早报07.04🤖 高盛维持MiniMax买入评级,ChatGPT等AI编程竞技ChatGPT和DeepSeek打架,高盛看好MiniMax,世界杯监控升级,各种AI硬件和争议层出不穷。
晚报07.05🤖 Midjourney与好莱坞大厂陷AI版权纠纷,Google推出Gemini Spark Mac版智能体扎堆开源内卷,好莱坞打版权战医疗踩刹车,群体智慧新实验,AI这周遍地开花
早报07.05🤖 GPT-5.5 Codex推理标记聚类或致性能下降,旧金山18万美元年薪不再够生活成本模型价格战白热化,DeepSeek低价胜出却遭弃用,GPT-5.5翻车,旧金山高薪不够花,AI智能体崛起效率革命加速
晚报07.06🚀 DeepMind获ICML 2026大奖,中国全力攻关机器人灵巧手制造ICML大奖、中国灵巧手、AI翻译、开源工作台、模型经济性、自我进化、教育新导师,AI遍地开花!
晚报本周共 14 条头条,前 3 条是主线;早晚报 13 期。
The Week in One Line · 一句话总结
“深度求索四比零胜出却未赢得用户,成本倒挂终结性能竞赛。”
每天两封,用 10 分钟把 AI 的噪音变成判断力。早报看世界,晚报看中国。

人民公园说AIJustSayAI Weekly Report
JustSayAIWeeklyReport
每天两封,把 AI 的噪音变成判断力。
Next Issue · 下一期
2026.07.13 · 每周一更新 →