AI 日报 2026.06.02:Alphabet 800 亿美元押注 AI,MiniMax M3 开源叫板 Opus

2026 . 6 . 2 AI 日报

今天的头条属于两个截然不同的信号:一边是 Alphabet 宣布通过发行股票筹集 800 亿美元投入 AI,资本层面已经到了”不计成本”的阶段;另一边是 MiniMax 开源发布 M3 模型,用 100 万 token 上下文和 MSA 稀疏注意力架构在 SWE-Bench Pro 上跑出 59% 的成绩,直接叫板 Opus 4.7。

一个在烧钱,一个在开源——但方向一致:AI 基础设施的军备竞赛正在全面升级,而这次的开源贡献来自中国公司。

1. Alphabet 发行股票筹集 800 亿美元投入 AI

据 Bloomberg 报道,Alphabet 将通过发行股票筹集 800 亿美元,专门用于 AI 支出计划。这笔钱将用于数据中心扩张、TPU 集群部署以及 Google DeepMind 的研究投入。

$80B
AI 专项筹集

股权
融资方式

2026
执行年份

800 亿美元是什么概念?比 OpenAI 最近一轮融资的 3 倍还多。Google 的资产负债表优势在这里体现得淋漓尽致——他们不需要等盈利,直接通过资本市场把未来十年的 AI 投资提前锁死。

这笔资金大部分会流向基础设施:数据中心、芯片采购、电力供应。AI 军备竞赛的底层逻辑从来不是算法,而是谁能更快地铺满算力。Google 这次的动作等于告诉市场:算力军备的大门,他们打算再焊死十年。

2. MiniMax M3 开源发布:100 万 token 上下文与 MSA 稀疏注意力

MiniMax 今天发布了 M3——一个前沿编码与 AI Agent 能力并重的开源模型。支持 100 万 token 的超长上下文窗口,采用全新的 MSA(MiniMax Sparse Attention)稀疏注意力架构,把每 token 的计算成本降到前代的 1/20,预填充速度提升 9 倍,解码速度提升 15 倍。

1M
Token 上下文窗口

59%
SWE-Bench Pro 得分

1/20
每 Token 计算成本

在 SWE-Bench Pro 编码基准上,MiniMax M3 拿到了 59.0%,超越了 GPT-5.5 和 Gemini 3.1 Pro,性能接近 Opus 4.7。这是中国开源模型在编码能力上最接近顶级闭源模型的一次。

模型已经可以通过 MiniMax Code、Token Plan 和 API 服务使用。开源社区的响应值得关注——如果 M3 能像 DeepSeek 那样引发二次创新,编码 Agent 的格局可能会被重塑。

3. Sam Altman:AI 发展必须以人类为中心

在最新采访中,Sam Altman 明确表示:AI 不应被设计为追求脱离人类需求的目标。他批判了行业里”AI 将摧毁大量工作”的叙事,认为人们真正担忧的不是 AI 带来的好处,而是自身在未来的角色、经济前景与自主权。

AI 行业的失败在于未能清晰解释人类如何在每一步保持对未来的控制权,以及如何在 AI 时代继续拥有充实、有意义的生活。

Altman 这番话的背景是 OpenAI 内部正在经历史上最大规模重组,同时面临来自 Anthropic 在 B2B 市场的强势挤压。在这个节点强调”以人为本”,既是价值观宣言,也是产品定位——OpenAI 要把自己从”技术最先进”的公司重新定位为”最值得信任”的公司。

4. SenseNova-U1-8B-MoT-Infographic:AI 图表生成难题

大多数 AI 模型在生成图表时都存在典型问题:负值显示为正、柱状图位置偏移、元素关系混乱。商汤推出的 SenseNova-U1-8B-MoT-Infographic 专门针对这些场景优化,能够生成数值准确的图表,并支持实时调整设计和布局。

项目已在 Hugging Face 上提供模型下载,GitHub 上有效果案例。这个细分领域的精度提升,对企业报表自动化来说是个实际利好。

5. NVIDIA Cosmos 3:物理 AI 推理与行动模型

NVIDIA 发布了 Cosmos 3——面向物理 AI 的前沿基础模型。机器人、自动驾驶车辆和智能空间可以用它理解真实世界、预测事件发展、生成适应特定环境与任务的行动方案。融合了物理推理、世界理解与行动生成三项能力。

物理 AI 是下一个十年的核心战场之一。NVIDIA 在这条赛道的布局越来越完整:硬件(GPU)→ 仿真(Isaac Sim)→ 模型(Cosmos 3)→ 部署(Jetson),全栈通吃。

6. xAI Composer 2.5 发布

xAI 的最新编程模型 Composer 2.5 已在 Grok Build 中上线,用户可通过 `/models` 菜单选择。这是一款擅长长时间运行任务和复杂指令的快速模型,面向 SuperGrok 和 X Premium+ 用户开放。

Grok Build 的迭代速度在加快——从 Grok 3 到 Composer 2.5,xAI 在开发者工具这条线上明显在发力。对 SuperGrok 用户来说,又多了一个不用离开 X 平台就能完成复杂编程任务的选项。

7. JetBrains Mellum2 发布:12B 混合专家模型

JetBrains 在 Hugging Face 发布了 Mellum2——一个 12B 参数的混合专家(MoE)模型。作为开发工具链巨头,JetBrains 切入 LLM 赛道本身就值得关注。

Mellum2 的目标场景显然是代码补全和智能提示——与其用第三方 API,JetBrains 更愿意把模型能力直接嵌入 IDE 体验。这对 GitHub Copilot、Cursor 等现有玩家意味着多了一个有 IDE 原生优势的对手。

8. 速览

动态 要点
Qwen3.7-Plus 多模态智能体,图像与视频理解、图像生成、工具使用
ChatGPT 长文编辑 全屏编辑模式下支持更长的文章,可保存到资料库
Krea 2 LoRAs 对所有人开放,图像生成定制化能力升级
Karpathy 学习方法论 分享高效学习 AI 的路径和经验
Meta WhatsApp 隐身聊天 推理在手机硬件安全飞地内完成,Meta 工程师无法访问
Nemotron 3 Ultra 本周即将发布,NVIDIA 推理模型新品

今日观察

今天三条线:

800 亿美元的规模信号。

Alphabet 通过股权融资锁死未来算力投入,等于在 AI 军备竞赛里先手宣布”我跟了”。竞争对手要么跟进,要么在算力规模上落后一个身位。这不是一家公司的决策,是整个行业被资本推着加速的缩影。

中国开源模型正在逐个突破关键点。

MiniMax M3 在编码基准上接近 Opus 4.7,SenseNova-U1 解决了图表生成的精度问题——这不是追赶,是在细分能力上打出差异化。开源社区的节奏比闭源更快,因为每次发布都是全社区的弹药。

AI Agent 正在变成”默认选项”。

JetBrains 把模型嵌入 IDE,Meta 把推理放进制服——Agent 能力不再需要单独申请或付费,它变成了产品的基本配置。当 Agent 成为默认,采用率的问题就从”要不要用”变成了”用哪个”。

— 全文完 —

← 返回首页