每日 AI 新闻|Google 重组 DeepMind 领导层,多名核心研究者离职创业
# 每日 AI 新闻|Google 重组 DeepMind 领导层,多名核心研究者离职创业
## 今日要闻
### Google 重组 DeepMind 领导层,多名核心研究者离职创业
Google 宣布 Demis Hassabis 不再担任 DeepMind 首席执行官,转任 DeepMind 董事长兼 Alphabet 首席科学家;现任首席技术官 Koray Kavukcuoglu 将负责日常管理。Google 首席科学家 Jeff Dean 与多名资深研究者将离职创办科学研究自动化公司 Discovery Loop,Google 计划投资该公司。
**AI 解读:** 这次调整同时改变研究决策链与核心人才结构,后续要看新负责人能否稳定 Gemini 的研发节奏。
## 主要新闻
### Meta 推出面向大型代码库的 Muse Code 编程代理
Meta 推出首款编程代理 Muse Code,并同步更新 Muse Spark 1.2。该产品面向 macOS 与 Linux,可在后台异步执行大型代码库中的复杂任务;Meta 将其定位为 Claude Code 与 Codex 的直接竞争产品。
**AI 解读:** Meta 把模型与代码代理一起推出,真正竞争力要由长任务可靠性、权限控制和实际价格验证。
### Anthropic 组建面向 Claude 的内部 AI 芯片设计团队
Anthropic 正在招聘工程师并组建内部 AI 芯片设计团队,计划让硬件与 Claude 模型协同设计,以提高运行速度和能效。此前该公司主要依赖 NVIDIA、Google 和 Amazon 等外部供应商提供的加速器。
**AI 解读:** 自研芯片可能降低长期推理成本,但从组建团队到量产部署仍是多年期工程。
### Qwen-Image-3.0 向千问 AI 平台所有用户开放
阿里将 Qwen-Image-3.0 上线千问 AI 平台并向所有用户开放,同时提供 API。发布信息称,该模型支持复杂版面、最长约 4,500 token 的提示以及 10 像素级文字渲染,API 文生图价格从每张 0.18 元起。
**AI 解读:** 开放给所有用户比榜单成绩更重要,实际价值取决于复杂文字与编辑任务中的稳定性。
### 腾讯发布 Hy ASR 3.0 preview 语音识别模型
腾讯混元发布 Hy ASR 3.0 preview,重点从逐字转写扩展到结合上下文理解语义,并加强方言与复杂场景识别。该预览版已在腾讯元宝中首发上线,部分能力同时向开发者开放。
**AI 解读:** 语音识别从逐字转写转向语境理解,企业落地仍需检验噪声、口音和专业词汇表现。
### 即梦为 Seedance 2.5 推出 Maya 与 Blender 专业工具
字节跳动旗下即梦接入 Seedance 2.5,并上线 Maya、Blender 原生插件和智能编辑等专业工具。更新把视频生成能力接入三维制作流程,而不再局限于网页或移动端的单次生成。
**AI 解读:** 原生插件降低了专业团队接入门槛,但镜头一致性与可编辑性仍决定能否进入正式制作流程。
### 美国上诉法院撤销针对 Perplexity 购物代理的初步禁令
美国第九巡回上诉法院撤销 Amazon 针对 Perplexity Comet 购物代理获得的初步禁令,并发回下级法院继续审理。法院认为,在当前记录下,是用户借助代理访问 Amazon 服务器,Amazon 因而不太可能依据相关计算机访问法律证明 Perplexity 本身实施了访问。
**AI 解读:** 裁决为用户驱动的浏览器代理留出空间,但法院明确没有建立适用于所有智能体的新规则。
### Wayve 与 Uber 获准在伦敦开展有人监督的自动驾驶载客服务
Wayve 与 Uber 获得伦敦交通局许可,可使用自动驾驶车辆开展有人监督的乘客服务。获批车辆仍需配备安全员,这一步把双方此前的测试与预约计划推进到受监管的实际载客阶段。
**AI 解读:** 这只是有人监督的准入阶段,距离无安全员的大规模商业运营仍有监管和安全门槛。
### Zoox 将于 8 月 10 日在拉斯维加斯启动收费 Robotaxi
Amazon 旗下 Zoox 宣布从 8 月 10 日起在拉斯维加斯为其无方向盘和踏板的专用 Robotaxi 收取车费。该服务此前已经提供免费乘坐,上周获得联邦监管豁免后进入实际收费运营阶段。
**AI 解读:** 从免费试乘转向收费是商业化节点,后续关键是服务范围、车队规模和持续安全记录。
### 豆包全量上线原生音视频全双工模型 SeedRealtime
字节跳动 Seed 团队于 8 月 5 日推出 SeedRealtime,把音频、视频和文本放进统一的原生架构。它可以在持续对话中同时看、听、说,处理主动提醒、对话时机和背景噪声;该模型已经在豆包 App 全量上线。
**AI 解读:** 原生音视频全双工把交互从轮流问答推进到持续感知,真实价值要看延迟、误触发和隐私控制。
### Sand AI 开源 114B 参数 MAGI-2 Preview 音视频模型
Sand AI 发布 MAGI-2 Preview 的推理代码和权重。该模型总参数 114B、每个 token 激活约 6B,支持文生视频和图生视频并同步生成声音,可生成 10 秒片段,再通过两阶段流程提升到 1080p;官方仓库采用 Apache 2.0 许可证。
**AI 解读:** 稀疏激活降低了单步计算量,但八张 Hopper GPU 和约 307GB 权重仍让本地部署门槛很高;可复现的代码与权重才是这次发布的核心价值。
### 美国拟将开放权重模型排除在自愿预发布安全测试之外
路透和 Axios 报道称,白宫正在讨论的自愿预发布测试框架主要覆盖闭源、前沿且可能构成国家安全风险的模型,开放权重模型不在其中。该框架尚未公开,具体定义和适用边界仍不清楚。
**AI 解读:** 排除开放权重可减少发布前门槛,但框架尚未公开,定义、覆盖范围和发布后的滥用治理仍是空白。
### 阿里云上线 One Key MCP,统一多服务鉴权与计费
阿里云 Model Studio 上线 One Key MCP,开发者可用一枚 API Key 调用首批 14 家合作伙伴、六个领域的 MCP 服务,并兼容 Qoder、Codex、Claude Code 和 Cursor。访问授权、调用与计费由同一入口集中管理。
**AI 解读:** 统一密钥降低了接入摩擦,也扩大了单个凭证的权限半径,企业仍需细分授权、轮换和审计。
### 腾讯扩大 Hy3 的全球可用范围
腾讯把 295B 参数的 Hy3 扩展到全球开发者、企业和普通用户,可通过 WorkBuddy、腾讯设计 Miora 与 TokenHub 使用;WorkBuddy 的全球免费体验持续到 8 月 31 日。这是 7 月正式发布后的新可用性阶段,而不是重复发布模型。
**AI 解读:** 这次变化的重点是可用范围,后续要看地区条款、接口稳定性和免费期后的价格。
## 传闻
本期没有达到刊发门槛的传闻。