跳转至

AI 每日简报 | 2026-06-18

今日概览

今日AI行业的焦点集中在人才争夺、资本并购和开源模型三条主线上。Transformer联合发明人Noam Shazeer从Google跳槽至OpenAI,SpaceX以600亿美元天价收购Cursor,智谱GLM-5.2以MIT许可开源并登顶开源模型榜首。与此同时,Claude Fable 5出口管制禁令的争议持续升温,OpenAI Q1财报泄露显示巨额亏损。

  • Noam Shazeer 离开 Google 加入 OpenAI,AI 人才争夺战升级
  • SpaceX 600亿美元全股票收购 Cursor,创风投初创收购纪录
  • 智谱 GLM-5.2 MIT 开源,753B 参数登顶 Artificial Analysis 开源模型指数
  • OpenAI Q1 财报泄露:收入 57 亿美元,亏损 37 亿美元,运营利润率 -122%
  • 100+ 安全专家联名反对 Claude Fable 5 出口管制禁令

深度阅读推荐

⭐ Noam Shazeer 离开 Google 加入 OpenAI(Transformer 联合发明人的再次跳槽)

Transformer 架构论文"Attention Is All You Need"的联合作者、Google Gemini 模型联合负责人 Noam Shazeer 在 X 上宣布将离开 Google 加入 OpenAI。不到两年前,Google 花费 27 亿美元从 Character.AI 将 Shazeer 买回,如今他再次出走,凸显了顶级 AI 人才争夺的白热化。

核心观点:这一变动不仅是个人选择,更是 AI 行业权力格局的信号——OpenAI 在 IPO 前夕通过股权激励吸纳顶级人才的策略正在奏效,而 Google 即使砸下重金也难以锁住核心研究者。

来源:The Information | US News


⭐ SpaceX 600 亿美元收购 Cursor(史上最大风投初创收购案)

SpaceX IPO 仅四天后,即以 600 亿美元全股票交易收购 AI 编程助手 Cursor 的母公司 Anysphere。此次收购旨在将 Cursor 整合进 SpaceX 早前合并 xAI 后形成的 AI 部门,构建专有编码模型以降低对 Anthropic 和 OpenAI 的依赖。值得注意的是,Cursor 市场份额已从去年 6 月的 41% 下降至今年 5 月的约 26%。

核心观点:Musk 的布局逻辑是「AI + 基础设施」的垂直整合——通过 xAI 的模型能力 + Cursor 的开发者入口 + SpaceX 的算力基础设施形成闭环。600 亿美元的溢价赌注在于 AI 编程将成为软件生产的新操作系统。

来源:TechCrunch | CNBC


⭐ 智谱 GLM-5.2 MIT 开源,登顶开源模型排行榜(Open Weights Surge From China)

智谱(Z.ai)6 月 16 日正式以 MIT 许可开源 GLM-5.2,753B 参数(40B 激活参数,MoE 架构),100 万 token 上下文窗口。在 Artificial Analysis Intelligence Index 上以 51 分领先 MiniMax-M3(44)和 DeepSeek V4 Pro(44),成为当前最强开源模型。在 SWE-bench Pro 上得分 62.1,超过 GPT-5.5 的 58.6。Simon Willison 评价其为"可能是当前最强的纯文本开源 LLM"。

核心观点:GLM-5.2 的 MIT 许可意味着企业可以自由下载、微调和部署。在中国开源模型密集发力的背景下(DeepSeek V4、Kimi K2.6、GLM-5.2),开源阵营正在缩小与闭源前沿模型的差距,且成本仅为 GPT-5.5 的六分之一。

来源:VentureBeat | Simon Willison | Artificial Analysis


⭐ OpenAI Q1 财报泄露:收入 57 亿美元,亏损 37 亿美元

据 The Information 报道,OpenAI 2026 年 Q1 收入约 57 亿美元,同比增长三倍,年化收入跑速达 250 亿美元。但同期烧钱 37 亿美元,调整后运营利润率为 -122%——每赚 1 美元就额外亏损 1.22 美元。OpenAI 称全年收入目标 300 亿美元"在轨道上",但若维持当前利润率,全年亏损将达 366 亿美元。

核心观点:在 OpenAI 即将 IPO 的关键时刻,这份财报揭示了 AI 行业的核心矛盾——收入高速增长但盈利遥遥无期。300 亿美元年收入与 -122% 利润率并存,投资者需要判断这是"Amazon 式战略亏损"还是结构性难题。

来源:The Information | PYMNTS | 量子位


⭐ Claude Fable 5 出口管制禁令争议持续升温

6 月 12 日美国商务部以国家安全为由发布出口管制指令,要求 Anthropic 暂停所有外国公民(包括美国境内的外国公民和 Anthropic 自身非美国籍员工)对 Fable 5 和 Mythos 5 的访问。触发禁令的"越狱"方式竟然只是要求模型"修复这段代码"。网络安全专家 Kate Moussouris 指出这只是"模型按预期工作"。Simon Willison 和超过 100 位安全专家联名发声,认为该禁令损害美国网络防御能力。

核心观点:这一事件折射出 AI 监管的核心困境——安全能力与攻击能力本质上是同一枚硬币的两面。如果"修复代码"的能力就构成出口管制理由,那所有前沿模型都将面临同样的风险,这实质上等于叫停所有新模型部署。

来源:TechCrunch | Anthropic 声明 | Simon Willison


⭐ OpenAI 发布 AI 化学家:GPT-5.4 自主完成药物化学实验

OpenAI 与 Molecule.one 合作展示了一个近乎自主的 AI 化学家系统。GPT-5.4 配合 Arcadia Science 的 Maria AI 平台和专用化学实验室,从文献综述到实验设计、结果分析再到后续研究提案,全流程自主完成了一项 Chan-Lam 偶联反应的优化研究,显著提升了原本收率极低的药物合成反应。整个过程耗时约 2.5 个月(加上人类写作的半个月)。

核心观点:这是 AI 从"辅助科研"向"自主科研"迈进的重要里程碑。与纯粹的基准测试不同,这项工作在真实实验室中完成了完整的科学研究循环,产出了可验证的实验结果。

来源:OpenAI 官方博客 | Hacker News 讨论


OpenAI

GPT-5.6 即将发布

OpenAI 首席科学家 Jakub Pachocki 向员工透露 GPT-5.6 将于本月发布,称其为 GPT-5.5 的"显著改进"。从 GPT-5.4(3月)到 GPT-5.5(4月)再到 GPT-5.6(6月),OpenAI 已进入不到 60 天一个版本的快速迭代周期。开发者自 5 月中旬起已在 Codex 后端日志中检测到 GPT-5.6 的路由痕迹。

来源:AI Weekly | 36Kr

LifeSciBench 生命科学基准发布

OpenAI 发布 LifeSciBench,一个由专家编写和评审的基准测试,用于评估 AI 系统处理真实生命科学研究任务和决策的能力。

来源:OpenAI

部署模拟:发布前预测模型行为

OpenAI 推出 Deployment Simulation 方法,利用真实对话数据在部署前预测 AI 模型行为,提升安全性和评估准确性。

来源:OpenAI

OpenAI S-1 秘密提交 SEC

OpenAI 已向 SEC 秘密提交 S-1 文件,IPO 进程持续推进。结合 Shazeer 加入和 GPT-5.6 即将发布,OpenAI 正全力为上市做准备。

来源:OpenAI


Google DeepMind / Gemini

Noam Shazeer 出走,Gemini 团队核心人物流失

⭐ 深度推荐(详见深度阅读区)

Gemini 3.5 Flash 持续迭代

Gemini 3.5 Flash 目前是 Google 在代理和编码任务上的旗舰模型。Google 同时推进 Gemini 3 Deep Think(强推理)、Deep Research(研究自动化)、Gemini Live(实时交互)和 Gemini Omni(全模态生成)等产品线。Managed Agents API 进入公开预览。

来源:Google Cloud Blog


Anthropic / Claude

Fable 5 / Mythos 5 出口管制禁令持续发酵

⭐ 深度推荐(详见深度阅读区)

Anthropic 主动向政府提交 AI 监管建议书

在 Fable 5 禁令事件后,Anthropic 主动向美国政府提交了一份详细的 AI 监管建议书,试图在政策层面引导行业走向。

来源:Anthropic

Claude 法律工具大扩展

Claude 发布 20+ 新法律 MCP 连接器和 12 个专业领域插件,覆盖研究、合同、发现、案件管理和法律援助等工作流。

来源:Releasebot


国内大厂动态

智谱 GLM-5.2 MIT 开源,开源模型新王者

⭐ 深度推荐(详见深度阅读区)

小米 MiMo 突破 1000 token/s 推理速度

小米与推理引擎合作伙伴 TileRT 联手,在万亿参数 MiMo-V2.5-Pro 模型上实现了 1000+ token/s 的推理速度,峰值达 1200 token/s。使用标准 8 GPU 商用服务器,无需专用硅片。技术方案包括 FP4 量化、DFlash 投机解码和 TileRT 持久核心 GPU 运行时。作为参考,Claude Opus 4.6 约 71 token/s,Gemini Flash 约 192 token/s。

来源:小米 MiMo 官方 | MarkTechPost

DeepSeek V4:1.6 万亿参数,效率革命

DeepSeek V4 是 1.6 万亿参数 MoE 模型(49B 激活参数),原生支持 100 万 token 上下文。核心叙事是效率——相比 V3.2,单 token 推理算力需求下降 73%。DeepSeek 获得国家大基金投资,估值 450 亿美元。

来源:36Kr

北京建"AI 工厂":目标 10 万 P 算力,日产 10 万亿 Token

九章云极发布"AI 工厂"战略,定义智能规模化新基建,计划实现 1000 倍综合降本。

来源:量子位

讯飞医疗 AI 在多项关键测评上超过 GPT-5.5

科大讯飞旗下医疗 AI 在多项关键医疗测评中打败 GPT-5.5,被量子位报道为"困住医疗 AI 的死循环终于有国产玩家跑通了"。

来源:量子位

国产算力进入 Token 标准化时代

量子位报道指出,当前国产算力的瓶颈不在芯片本身,而在从异构算力到可用 Token 之间的工程化转化能力。

来源:量子位


AI 研究前沿

⭐ 苏剑林新文:MoE 环游记第 9 篇——门控归一化之争

苏剑林(月之暗面研究员)发布「科学空间」最新文章,深入讨论 MoE Router 的激活函数选择问题:Softmax vs Sigmoid,以及先 Softmax 再选 Top-k 还是先选 Top-k 再 Re-Norm 的差异。文章从 DeepSeek 的 Loss-Free 负载均衡出发,系统梳理了门控归一化的不同方案及其理论分析。

核心观点:MoE 架构的门控设计远比表面看起来复杂,归一化策略的选择直接影响模型训练稳定性和性能。这是理解 DeepSeek V4 等最新 MoE 模型设计决策的重要参考。

来源:科学空间

FrontierCode:新的高难度编程基准

Devin 团队 Cognition 发布 FrontierCode 基准,150 个任务分三个难度。Diamond 级别 Claude Opus 4.8 仅得 13.4%,GPT-5.5 得 6.3%。由 20 位开源开发者手工构建,每任务投入超 40 小时,评估代码的可合并性而非仅仅正确性。

来源:Import AI #461

Sequent:新对齐安全非营利组织成立

前英国 AI 安全研究所首席科学家 Geoffrey Irving 联合 Timaeus 研究者创立 Sequent,专注超级智能对齐研究。目标 40-80 名全职员工,首轮筹资 1-1.5 亿美元。核心理念:"对齐进展没有跟上 ASI 开发的步伐",需要在可扩展监督、学习理论、博弈论等方向建立多元化研究组合。

来源:Sequent 官网 | Import AI #461

DRPO:改进 LLM 强化学习稳定性

HuggingFace 热门论文,用平滑正则化替代硬掩码,在信任域边界外提供连续梯度修正,提升 LLM 强化学习训练稳定性。

来源:HuggingFace Trending

AARRI-Bench:AI 能否胜任研究实习生的工作?

西安交大等团队发布"Act As a Real Research Intern"基准,82 个任务测试 AI 系统的技术能力、研究直觉和学术伦理。最佳系统 Claude-Opus-4.7 得分 68.3%。亮点包括检测伪造数据、识别论文注入攻击、拒绝导师篡改数据的指令等。

来源:arXiv


行业观点与解读

Import AI #461:对齐研究、FrontierCode、AI 研究实习生

Jack Clark(Anthropic 联合创始人)本周的 Import AI 通讯覆盖三大主题:Sequent 对齐研究组织的成立("对齐没有走在正轨上")、FrontierCode 编程基准、以及 AI 系统能否胜任研究实习生工作的评估。同时报道了小米 MiMo 1000 token/s 速度突破。

来源:Import AI

Simon Willison:GLM-5.2 评测

Simon Willison 详细评测了 GLM-5.2,指出其在 Artificial Analysis 指数上领先所有开源模型,在 Code Arena WebDev 排行榜上仅次于 Claude Fable 5(令人惊讶的是,这是一个纯文本模型)。但 token 使用量偏高(每任务 43k,高于同级模型)。价格仅 \(1.40/\)4.40(输入/输出),不到 GPT-5.5 的六分之一。

来源:Simon Willison

Charity Majors:AI 要求更高的工程纪律,而非更低

Simon Willison 引用了 Charity Majors 的文章,核心观点:2025 年发生的事情是代码生产的经济学被颠覆——代码从珍贵、可复用、精心维护的资产,变成了可丢弃、可再生的东西。这要求更高的工程纪律,而非更低。

来源:Simon Willison 引用

宝玉(@dotey):Anthropic Agent 编程趋势报告解读

宝玉近期解读了 Anthropic 发布的 2026 Agent 编程趋势报告,阐述编程从"人写"变成"人指挥 AI Agent 写"的转变,以及 Codex 团队如何用自己的产品构建产品。

来源:@dotey on X


值得关注的视频

Latent Space × No Priors 联合特别节目:Satya Nadella 访谈

Latent Space 和 No Priors 联合制作的 Satya Nadella 深度访谈,讨论 MAI 模型、生态系统思维和 Agent 驱动的未来工作形态。

来源:Microsoft

B 站 AI 早报覆盖 Fable 5 禁令

B 站 AI 早报(2026-06-10 期)报道了 Claude Fable 5 和 Mythos 5 的发布,随后 6 月 12-13 期跟进了禁令事件。

来源:Bilibili


灵感种子

AI 人才流动的"引力场"已经改变方向
Shazeer 从 Google 到 Character.AI 再回 Google 再到 OpenAI 的轨迹,映射出 AI 行业权力中心的迁移。值得关注的不仅是单个跳槽,而是一个系统性趋势:当 OpenAI 的 IPO 预期创造了巨大的期权引力场时,连 Google 27 亿美元的留人策略也失效了。这对未获上市预期加持的中小 AI 公司意味着什么?

开源模型的"六分之一定价"正在改写竞争规则
GLM-5.2 以 GPT-5.5 六分之一的价格提供接近甚至超越的性能,这不是个案——DeepSeek V4、Kimi K2.6 都在同一价格带。如果开源 / 低价模型能持续缩小与闭源前沿的差距,API 定价战争可能很快进入新阶段。对开发者来说,现在是重新评估模型选择策略的好时机。

"修复代码"触发出口管制,AI 安全治理的荒诞时刻
Fable 5 被禁的触发条件是"fix this code"——这是任何编码模型最基础的能力。这个案例完美展示了 AI 监管的核心难题:安全能力和危险能力是不可分割的。这一事件可能成为 AI 治理史上的标志性案例,值得持续跟踪其对行业和政策的长期影响。

1000 token/s 的"速度即质量"时代
小米 MiMo 在商用 GPU 上突破 1000 token/s,比 Claude Opus 快 14 倍。当推理速度提升一个数量级时,许多之前不可行的应用场景变得可能——实时代码重构、交互式长文档编辑、多 Agent 协作等。速度本身就是一种新的模型能力维度。


生成时间:2026-06-18 08:36 | 下次更新:明日 9:00