AI 日报 2026.06.10:Claude 家族双发、Gemma 4 开源、轨道算力登场

2026 . 06 . 10 AI 日报

今天的 AI 圈出了三件值得放在一起说的事:Anthropic 同时扔出 Fable 5 和 Mythos 5 两款模型,一颗定价降了一半;Google DeepMind 把 Gemma 4 12B 用 Apache 2.0 开源了;Elon Musk 对着镜头算了一笔 SpaceX AI1 轨道的账。这三件事不在同一个维度,但它们指向同一个判断——AI 基础层的竞争正在从模型性能蔓延到定价策略、生态开放和基础设施形态

其他新闻也不少。中国 2950 亿美元、Apollo 和 Blackstone 350 亿美元融资交易、德国法院裁定 Google 要为 AI Overviews 的错误内容负责,每一条单独拎出来都够单独发一篇。今天先让它们各占一个章节。

1. Claude Fable 5 和 Claude Mythos 5

Anthropic 今天正式推出 Claude Fable 5,定价 $10/百万输入 tokens、$50/百万输出——比 Claude Mythos Preview 降了一半。按这个价格,调用成本和 Claude Opus 差不多,但能力上限完全不同。

根据 Anthropic 发布的测试数据,Fable 5 在软件工程、知识工作、视觉理解和科学推理等多个基准上达到 SOTA。Stripe 在早期测试中反馈,Fable 5 把过去几个月的工程工作量压缩到了几天。FrontierCode 基准——由开源维护者手工制作的 150 个真实任务——Fable 5 在最高难度档排在前列。

定价之外,Fable 5 真正值得注意的地方是它的自主工作时间。这是 Claude 系列里第一款能在没有人为干预的情况下持续处理长流程任务的模型——对编码 Agent、数据清洗管线这类场景来说,自主工作时间的延长等于成本的直接下降。

同一天发布的 Claude Mythos 5 走的是另一个方向。Fable 5 在敏感主题上回退到 Claude Opus 4.8,平均会话触发率低于 5%;Mythos 5 拿掉了这些限制,目前通过 Project Glasswing 向网络防御者开放。Fable 5 面向通用市场,Mythos 5 面向垂直安全场景——同根同源,服务对象分化。

Anthropic 定价策略
$10
每百万输入 tokens
$50
每百万输出 tokens
-50%
相对 Mythos Preview

2. Google DeepMind 发布 Gemma 4 12B:统一的无编码器多模态模型

Gemma 4 12B 最大的变化是架构。Google DeepMind 这次把视觉编码器给拆掉了——不再是图像进编码器再进语言模型,而是把视觉信号直接映射到语言模型的 embedding 空间。结果是单个模型原生支持文字、图片、音频三种输入,不需要在不同模态之间切换路由。

内存占用控制得不错。12B 参数的模型,跑起来只要 16GB 显存,在消费级笔记本上就能本地跑。相比之下,26B 参数 MoE 模型的性能它基本能追上,显存占用却不到一半。模型内置了多 token 预测 drafter 用来降低延迟,推理速度有明显提升。

开源协议是 Apache 2.0,Google DeepMind 说 Gemma 系列累计下载已经超过 1.5 亿次。对于想在本地跑多模态模型的开发者来说,Gemma 4 12B 是目前最划算的选择之一。

3. 小米 MiMo 与 TileRT 联合发布 UltraSpeed 模式,1T 模型输出突破 1000 tokens/s

1T 参数的模型跑出 1000 tokens/s——这个数字放在两个月前还不现实。小米 MiMo 和 TileRT 这次是在模型层和系统层各做了一件事:模型侧用 FP4 量化(只量化 MoE Expert 部分)加 DFlash 块级推测解码,coding 场景下平均每个 prompt 能提前接受 6.3 个 token;系统侧 TileRT 把推理引擎做成了常驻内核,绕过用户态切换开销。

API 已经限时开放,从 6 月 9 日到 23 日,价格是 MiMo-V2.5-Pro 的三倍,速度提升约 10 倍。FP4 权重和 DFlash checkpoint 已经开源到 HuggingFace。

4. Elon Musk 详解 SpaceX AI1 轨道 AI 数据中心卫星方案

Elon Musk 对着镜头算了一下这个方案的数字:每颗卫星峰值功率 150 kW,持续计算功率 120 kW——差不多相当于一台 NVIDIA GB300 机架。太阳能板效率 250 W/m²,双面散热器排热密度 1400 W/m²,激光链路互联带宽约 1 Tbps,往返延迟 6-8 ms。

这个延迟数字意味着从地面站发一个请求到卫星处理完再回来,中间隔了两次光速传输(地面到低轨 600-800 km,往返),6-8 ms 已经快赶上纽约到伦敦的光纤延迟了。用卫星做算力的真正瓶颈不在延迟,而在单颗卫星的散热和供电——120 kW 的持续算力,散热密度比地面机房高出几倍。

SpaceX 计划部署百万颗卫星,目标是先在低轨凑到吉瓦级算力,长期看往太瓦级推。这个量级的大规模卫星星座如果在轨算力真能跑通,数据中心的形式可能要重新定义。

5. 中国准备2950亿美元计划资助全国AI基础设施建设

中国计划在未来五年投入约两万亿元人民币(约 2950 亿美元)建设全国数据中心网络。这份计划把数据中心基础设施提升到了国家战略高度,目标是扶持国内 AI 产业并缩小与美国的差距。

2950 亿美元这个数字直接把美国近年的 AI 基础设施投资计划比了下去。但数据中心建起来是一回事,算力利用率是另一回事——国内 GPU 供给、散热、电力配套和人才储备都在制约因素之列。不过方向已经定了:AI 基础设施已经从企业投资升级到了国家级竞赛。

6. 里程碑式德国裁决:Google AI Overviews 被视为谷歌自身言论,需为错误回答承担责任

德国地方法院的裁决没有什么模棱两可:Google AI Overviews 生成的内容被视为 Google 自身的言论,不能援引搜索引擎运营商的有限责任保护。涉案 Overviews 错误地将两家出版商与欺诈行为关联,相关错误并未出现在任何链接来源中。

这个裁决的直接影响是 AI 生成内容的责任归属有了判例参考。Google 可以用这笔钱,但判决的逻辑可能扩展到其他 AI 生成摘要、AI 搜索结果和 AI 自动回复场景——不管你是做搜索、客服还是内容推荐,AI 输出的法律责任现在有了具体参照。

7. Apollo 与 Blackstone 联手 350 亿美元 AI 融资交易

Apollo 和 Blackstone 这笔 350 亿美元的交易不是一笔普通的投资——它是在为 AI 芯片的采购做融资结构设计。Anthropic 和 Broadcom 参与其中,说明交易结构里已经包含了模型公司和芯片公司的多方协同。

这种融资模式如果跑通,未来 AI 基础设施的资本开支就不需要再等企业现金流或传统 VC 轮次,可以直接用结构化金融工具把未来几年的算力需求提前变现。

8. OpenAI 秘密提交 IPO 申请

OpenAI 秘密提交了 IPO 申请,消息一出立刻引发关注。与此同时,奥特曼旗下的 Tools for Humanity 正在裁员——这家公司因虹膜扫描项目 World 和加密货币 Worldcoin 而知名,投后估值 25 亿美元。

两件事放在一起看,OpenAI 的上市路径和 Tools for Humanity 的收缩形成了对照。OpenAI 在从非营利走向上市,而 Tools for Humanity 在收缩——一个在扩张,一个在收缩,两者都在为 AI 的下一步筹措资金。

9. 火山引擎TRAE Work企业版正式上线,面向全员提供AI办公平台

火山引擎把 TRAE Solo 升级成了 TRAE Work 企业版。产品分两个模式:Work 模式面向非技术岗,支持 PPT 和文档的混合输入输出;Code 模式面向开发,用自然语言生成页面或小应用。

字节在 AI 办公领域的布局速度很快,从 Copilot 风格的产品(TRAE Solo)到全公司的 AI 办公平台,产品线跨度不小。企业 AI 办公平台现在是个拥挤的赛道——Google Workspace、Notion AI、飞书 AI,加上字节的 TRAE——最终的赢家可能不是技术最牛的,而是先跑进工作流的那个。

10. AI 编程独角兽 Cursor 欧洲总部落子伦敦

Cursor 把欧洲总部设在伦敦,计划招聘 200 人左右,在巴黎和慕尼黑设小型办事处。这个布局不只是为了人才——欧洲的 AI 监管环境比美国更复杂,在欧洲设点意味着对 GDPR 和欧盟 AI 法案的直接响应。

更有意思的是 SpaceX 手里 600 亿美元的收购选择权。Cursor 目前 B2B 年化营收约 26 亿美元,客户包括英国航空、英国石油、诺基亚。这家公司现在的速度——不是产品迭代速度,是营收增长速度——可能是 AI 编程工具里最快的几个之一。600 亿美元的选择权,SpaceX 这笔买卖看着不便宜,但在 AI 编程工具的格局里,Cursor 现在的价值很难用传统 P/S 倍数来衡量。

11. 速览

动态 要点
台湾考虑限制AI芯片对华出口以配合美国 据知情人士透露,台湾当局正考虑对AI芯片出口中国大陆实施更严格的管制,以进一步与美国出口限制措施对齐。此举旨在遏制半导体走私,但可能招致北京方面的谴责。
Claude Managed Agents 新增定时运行和环境变量存储功能 Claude Managed Agents 今日在 Claude Platform 公开测试两项新功能:代理可按 cron 计划自动执行周期性任务(如夜间数据同步、周度合规扫描、每日摘要),无需用户自建调度器,支持暂停、恢复、归档或按需触发;vaults 新增环境变量支持,允许代理通过 CLI 进行
Gemini 3.5 Live Translate 发布 说 hello, hola, 你好–欢迎 Gemini 3.5 Live Translate:我们最新的音频模型,专为快速跨语言交流而构建。🌐
OpenRouter 推出 Advisor 工具
Cohere发布North Mini Code
Text-To-Lottie:Agent Skill + 本地预览 Harness
FrontierCode 基准测试:AI 编程评估新标准
开源工具 Tokei:在菜单栏实时监控 AI coding agent token 用量
一个Agent如何通过链式调用两个HuggingFace Space构建3D巴黎画廊 一个编码Agent调用HuggingFace上的两个Space,从零构建了展示巴黎地标3D高斯散点图的交互式画廊。Agent先用ideogram-ai/ideogram4生成每个纪念碑的黑色背景图像,再通过VAST-AI/TripoSplat从单张图像重建3D高斯散点(.ply),自动完成坐标系校正
GitHub Skills 推出新技能「Teach」

今日观察

今天三条主线:

Anthropic 在走全栈路线。

Fable 5/Mythos 5 同时发、定价直降一半、自主工作时间拉满、企业市场 B2B 占比超越 OpenAI——这不是单点产品发布,是多线同时推。从模型到平台到生态,Anthropic 在同时抢多个位置。

算力的物理形态开始分化。

SpaceX 轨道算力方案、中国国家级数据中心、企业级融资结构——AI 算力不再只是 GPU 集群问题,它变成了航天工程、国家财政和金融结构问题。钱进来之后,形态自然会往不同方向长。

AI 生成内容的法律责任有了判例。

德国法院的裁决把 AI 输出归为 Google 自身言论,不享受搜索引擎的有限责任保护。这不是 Google 一家的事——所有用 AI 生成内容作为产品核心的公司,都多了一个需要单独面对的法律问题。

— 全文完 —

← 返回首页