🤖 AI 大模型日报 — 2026-08-06(星期四)
全球 AI 大模型行业动态速览 | 本期涵盖:Jeff Dean 离职创业震动硅谷、哈萨比斯卸任 DeepMind CEO、阿里 Qwen3.8-Max 突袭发布、DeepSeek V4 Flash 低价风暴席卷全球、Meta 发布 Muse Code 编程 Agent、视频生成进入「几分钱时代」等
📌 一、今日最热话题速览
| 序号 | 热点主题 | 关键信息 |
|---|---|---|
| 1 | 🔥 Jeff Dean 离职创业,谷歌股价蒸发 1.34 万亿 | 与 Sanjay Ghemawat、Quoc Le、Oriol Vinyals 创办 Discovery Loop;哈萨比斯同步卸任 DeepMind CEO |
| 2 | 🚀 阿里 Qwen3.8-Max 突袭发布 | 2.4T 参数,Arena 榜单冲进全球第一梯队,编程能力超越 Claude Opus 5,价格仅为 Opus 5 的 24%~40% |
| 3 | 💸 DeepSeek V4 Flash 低价风暴 | 能力直逼 Opus 4.8,价格仅为其百分之一;海外平台争相倒贴补贴,单日跑出 8T tokens |
| 4 | 🎬 视频生成进入「几分钱时代」 | Sand.ai 开源全球首个千亿 MoE 视频模型 MAGI-2-preview;MiniMax H3 上线秘塔,768P 低至 0.09 元/秒 |
| 5 | 🛠️ Meta 发布 Muse Code | 面向大型代码库的终端编程 Agent,子 Agent 并行协作,瞄准 Codex 与 Claude Code |
| 6 | 🤖 Gemini Robotics ER 2 发布 | 谷歌最强「具身推理」模型,实时空间推理 + 多机器人协作 |
📰 二、重磅新闻深度解读
🔴 Top 1:Jeff Dean 离职创业 + 哈萨比斯卸任——谷歌 AI 权力架构大重组
时间:2026年8月5日(消息发布)
核心事件:
- 谷歌传奇人物、谷歌 DeepMind 与谷歌研究院首席科学家、Gemini 负责人 Jeff Dean 宣布离职创业
- 新公司名为 Discovery Loop,定位公益性公司(Public Benefit Corporation),使命是实现机器学习、科学和工程的自动化
- 创始团队堪称「史上最豪华创业阵容」,均为谷歌 AI 元老:
- Jeff Dean:谷歌大脑联合创始人、谷歌唯二 Senior Google Fellow(L11)
- Sanjay Ghemawat:美国国家工程院院士、L11,Google 文件系统/MapReduce/Bigtable 共同作者
- Quoc Le:谷歌大脑联合创始人,seq2seq、思维链共同作者
- Oriol Vinyals:谷歌 DeepMind 研究副总裁兼深度学习负责人、Gemini 联合负责人
- 市场反应:消息一出,谷歌股价下跌 4%,瞬间蒸发 1860 亿美元(约合人民币 1.34 万亿)
- 谷歌态度:劈柴(Pichai)送上祝福,透露谷歌已入股并成为其云合作伙伴;但据《连线》爆料,劈柴曾苦苦挽留四人保留谷歌工牌
- 融资:首轮由 Radical Ventures 与 Khosla Ventures 联合领投,Kleiner Perkins、Lightspeed、Doerr Capital 参投
哈萨比斯职务变动:
- 谷歌 DeepMind CEO 哈萨比斯(Demis Hassabis)卸下原职,转任 DeepMind 董事长兼谷歌母公司 Alphabet 首席科学家
- 将专注于 AGI 长期战略、社会影响与科学研究(含 Isomorphic Labs 药物研发)
- 其原职责由长期副手 Koray Kavukcuoglu 接手,升任 DeepMind 高级副总裁,直接向劈柴汇报——研究到产品的统一指挥权进一步向 CEO 收束
人才流失背景:
- 6月18日:Transformer 核心作者 Noam Shazeer 二次跑路转投 OpenAI
- 6月19日:诺奖得主 John Jumper 转会 Anthropic
- 6月24日:两位 Gemini 核心贡献者(Jonas Adler、Alexander Pritzel)加盟 Anthropic
- 至此,Gemini 的三位主要领导者 Jeff Dean、Oriol Vinyals、Noam Shazeer 均已离开谷歌
- 评论指出:谷歌面临「创新者窘境」——大模型竞争要求更集中的组织执行,而下一代技术突破又依赖顶尖研究者的自主空间
🔴 Top 2:阿里 Qwen3.8-Max 突袭发布——「能打」且「便宜」
时间:2026年8月3日
核心信息:
- 总参数量达 2.4 万亿,编程、专业工作、长程任务、多模态智能体全面升级
- 在权威第三方榜单 Arena 冲进全球大模型第一梯队,表现直逼 Anthropic Claude 系列
- 编程能力甚至超过 Claude Opus 5 和 Fable 5(High 版本)
- 实测:可从空文件夹出发、无人干预自主推进十多天,交付真实可用的完整项目;33 秒完成几十页论文的跨章节交叉分析
价格(每百万 tokens):
| 地区 | 输入 | 输出 | 隐式缓存命中 |
|---|---|---|---|
| 国内 | 12 元 | 36 元 | 1.5 元 |
| 国际 | Opus 5 的 40% | Opus 5 的 24% | — |
- 网友实测:复刻《愤怒的小鸟》一周额度消耗不到九成;基准测试「KO」了 GPT-5.6 Sol
- 评测中在科研复现、多模态理解、长视频和电脑操作多项超越 GPT-5.6、Opus 4.8 与 Fable 5
🔴 Top 3:DeepSeek V4 Flash 低价风暴打服硅谷
时间:2026年7月31日 V4-Flash-0731 发布后持续发酵
核心信息:
- V4-Flash-0731 与 4 月 Preview 完全相同的架构和模型尺寸,仅重跑了一遍后训练
- 性能飙升:DeepSWE 得分 7.3 → 54.4,Cybergym 76.7,Terminal Bench 2.1 达 82.7
- Artificial Analysis 智能指数 50 分,反超自家 V4 Pro,能力直逼 Opus 4.8
- 价格(每百万 tokens):缓存未命中输入 $0.14、输出 $0.28,被研究公司背书为「已知最便宜的前沿模型」
生态效应:
- OpenCode:仅 8月1日 一天就跑出 8T tokens
- Nous Portal:给 V4 Flash 打一折限时 7 天,比 Fable 5 便宜一千多倍
- Cline(开源 Coding Agent):提供免费额度后烧了几天发现太便宜,直接将免费额度翻了三倍
- 开发者实测:7 分钱一个 3D 游戏、5 毛钱一把 CS、一个月 30 元随便「蹬」
- 前瞻:DeepSeek Code 可能即将到来——DeepSeek Harness 负责人崔添翼已开启 Agent Harness 开源项目内测招募
🏢 三、各重要模型最新动态
1️⃣ OpenAI — GPT-5.6 系列大降价
时间:2026年7月31日起
| 模型 | 定位 | 输入($M) | 输出($M) | 调整 |
|---|---|---|---|---|
| GPT-5.6 Luna | 成本敏感型入门款 | 0.2 | 1.2 | 降 80%(6.8→1.35 元输入) |
| GPT-5.6 Terra | 日常干活主力 | 2 | 12 | 降 20% |
| GPT-5.6 Sol | 旗舰 | 5 | 30 | 原价,新增 Fast mode(2.5 倍速度) |
- 降价原因:官方称 GPT-5.6 Sol 参与自身改进,效率飞跃,回馈用户
- ChatGPT 与 Codex CLI 的 Auto-review 模型从 GPT-5.4 换成 Luna,预计成本降至约 十分之一
- 意义:OpenAI 正在把「支撑 Agent 干活的模型」卖到过去简单小模型的价位
2️⃣ Anthropic — Claude 系列
- Claude Opus 5(7月24日发布):Opus 档位阶跃式升级,主打长时运行 Agent、编程与专业工作
- Claude Sonnet 5(6月30日发布):编程、Agent、专业工作达到前沿水平
- Fable 5:7月1日全球重新上线(此前曾被紧急撤下);与 Amazon、Microsoft、Google 等 Glasswing 伙伴共同提出越狱严重程度评分行业框架
- 组织动态:8月4日,Mariano-Florentino Cuéllar 加入担任首席全球事务官(Chief Global Affairs Officer);诺奖得主 John Jumper、Gemini 核心贡献者 Jonas Adler / Alexander Pritzel 相继加盟
3️⃣ Google — Gemini 系列 & 机器人
- Gemini Robotics ER 2(7月30日发布):最强「具身推理」模型,充当机器人「大脑」——实时空间推理、多步任务规划、多机器人协作;通过观看连续视频流追踪自身进度、实时纠错;现已通过 Gemini API / AI Studio / Gemini Enterprise Agent Platform 开放
- Gemini for Science 上线:面向科学研究的 Gemini 应用与实验工具
- 人事动荡:Jeff Dean、Oriol Vinyals、Noam Shazeer 三位 Gemini 核心领导者均已离开;哈萨比斯转任董事长兼 Alphabet 首席科学家;Koray Kavukcuoglu 接掌 DeepMind 日常研发
4️⃣ Meta — Muse Code
- Muse Code(8月5日发布,beta):面向大型代码库的终端编程 Agent,单命令安装
- 由 Meta 此前发布的编程模型 Muse Spark 驱动;任务过大时自动「扇出」为并行子 Agent(隔离 worktree 中并行工作)
- 扎克伯格称测试中可同时为游戏构建 6 个功能且零冲突
- Meta AI 负责人 Alexandr Wang:在成本角度对许多工作流是「极好的选择」——直指 OpenAI Codex 与 Anthropic Claude Code
- 背景:Meta 6月已进军企业 AI(客服 Agent),持续加码追赶
5️⃣ Alibaba — Qwen3.8-Max
- 2.4T 参数突袭发布(8月3日),Arena 全球第一梯队,编程超 Claude Opus 5 / Fable 5
- 端到端自主交付:复杂编程任务可无人干预推进数天至数周
- 价格:国内输入 12 元/输出 36 元(每百万 tokens),国际为 Opus 5 的 40%/24%
6️⃣ DeepSeek — V4 Flash / V4 系列
- V4-Flash-0731 以极低价格($0.14/$0.28 每百万 tokens)达到直逼 Opus 4.8 的能力
- 开源 TileKernels GPU 算子库:用 TileLang 编写,减少手写底层 CUDA
- DeepSeek Code(编程工具)内测招募中
7️⃣ 视频生成新势力
- Sand.ai MAGI-2-preview(8月5日开源):全球首个千亿 MoE 视频生成模型——总参数 114B、单次激活约 6B;10 秒 1080P 生成成本约 5 毛钱(行业主流约十分之一);AA 视频生成榜单第六;采用单流架构 + Multi-Head LatentMoE(36 层 × 3072 专家单元)+ 自研 MagiMoE kernel 库;创始人曹越(清华特等奖学金、Swin Transformer 共同一作、光年之外联合创始人)
- MiniMax H3:MiniMax 首个开源视频模型,Artificial Analysis 视频编辑 Top1;原生双声道、2K、文字呈现、动作迁移;秘塔 AI 上线开箱即用,768P 0.09 元/秒、2K 0.15 元/秒(10 秒视频不到 1 块钱)
8️⃣ 其他值得关注
- 开源版 Claude Science——OpenAI4S(北大&元空 AI 联合实验室,MIT 协议,核心零依赖):Code-as-Action 思路复刻科研 Agent,内置 30+ 科研 Skills,支持自有 GPU 算力接入,坚持 no-fabrication(不伪造)策略
- AI 凿开 CUDA 护城河:一家成立一年的公司用 AI 编程 Agent 仅花 10 小时搭出「类 CUDA 软件」;DeepSeek 开源 TileKernels 减少手写 CUDA
- 微软叫停 Tokenmaxxing:7 月起各业务部门设置「AI Token 预算目标」,内部默认模型切换为更便宜的 GPT-5.6,员工可查看个人 token 支出(许多工程师每月数百至数千美元)
- 吴恩达发布 100% 开源的个人桌面 Agent
- 淘天开启 2027 届校招:AI 技术类岗位占比超 9 成
📈 四、行业趋势分析
趋势 1:价格战进入白热化,「几分钱」时代全面到来
- DeepSeek V4 Flash($0.14/$0.28)→ GPT-5.6 Luna 降 80%($0.2/$1.2)→ Qwen3.8-Max 国际价仅为 Opus 5 的 24%~40% → MiniMax H3 视频 0.09 元/秒
- 推理成本被系统性打穿,Agent 高频调用成本骤降,应用层创业门槛大幅降低——「一个刚毕业的学生也能用 AI 做出第一个产品 demo」
- 平台方反向补贴(Nous Portal 一折、Cline 免费额度翻三倍),说明低价模型已成为获客武器
趋势 2:谷歌人才流失加速,「创新者窘境」集中爆发
- 一周内 Gemini 三大核心领导者(Dean、Vinyals、Shazeer)全部离开,叠加哈萨比斯卸任 CEO
- 大公司组织惯性 vs 顶尖研究者自主空间的结构性矛盾凸显
- 人才流向:OpenAI(Shazeer)、Anthropic(Jumper、Adler、Pritzel)、创业(Discovery Loop)——顶级人才正在从「平台」流向「实验室+创业公司」
趋势 3:开源模型全面逼近闭源,开闭源竞争维度升级
- Qwen3.8-Max 编程超 Claude Opus 5、DeepSeek V4 Flash 能力直逼 Opus 4.8、Kimi K3(2.8T)此前已成史上最大开源模型
- 视频生成领域:Sand.ai 开源千亿 MoE、MiniMax H3 开源并霸榜——视频生成正走上语言模型的「开源老路」
- 竞争指标从「效果单维」扩展到「能否继续训练、接口是否被单一平台控制」
趋势 4:AI 开始重塑 AI 基础设施本身
- AI 编程 Agent 10 小时「复刻」类 CUDA 软件;DeepSeek 用 TileLang 减少手写 CUDA
- GPT-5.6 Sol 参与自身改进实现效率飞跃(「左脚踩右脚」)
- 微软把 token 当「关键资源」管理——AI 成本治理成为企业级刚需
趋势 5:视频生成进入千亿 MoE 时代
- MoE 架构破解视频模型「更大、更长、更便宜」的不可能三角
- 单流架构(音画同模)+ 细粒度专家路由(3000+ 专家/层)+ 自研 infra 成为新范式
- AI 视频从「玩具」走向生产力工具:广告片、漫剧、长镜头电影感镜头均可低成本生成
📅 五、未来关注预告
| 事项 | 说明 |
|---|---|
| DeepSeek Code | Agent Harness 内测招募中,编程工具或将补齐 |
| Discovery Loop 后续 | 四位谷歌传奇的融资细节与团队组建动态 |
| 谷歌新旗舰 Gemini | 核心人才流失后,新旗舰版本如何应对 OpenAI/Anthropic 压力 |
| Qwen3.8-Max 全面开放 | 预览版口碑发酵后的正式版与生态动作 |
| AI 视频开源竞赛 | Sand.ai MAGI-2、MiniMax H3 之后,谁能接棒 |
数据来源:量子位、TechCrunch、Anthropic News、Google DeepMind Blog、Reuters、Wired 等公开报道(检索时间:2026-08-06)。本报告由 AI 自动汇总生成,仅供参考。
&spm=1001.2101.3001.5002&articleId=163527352&d=1&t=3&u=12844ebf02e3410bb23dc8f8755d8928)
317

被折叠的 条评论
为什么被折叠?



