AI 每日简报 | 2026-06-17¶
今日概览¶
今日 AI 圈焦点集中在 Anthropic 出口管制危机持续发酵、OpenAI IPO 前财务数据曝光、微信支付正式推出 AI 专属卡打通智能体消费闭环、智谱 GLM-5.2 开源发布,以及国内多起大额融资(林俊旸卜拉格、大晓机器人)。海外方面,Import AI 周报聚焦新成立的对齐安全组织 Sequent,Simon Willison 持续关注 Fable 5 出口管制争议。苏剑林今日更新 MoE 系列新文。
今日最值得关注的事件:
1. Anthropic Fable 5 出口管制:高管赴华盛顿"危机谈判",Simon Willison 引述安全专家批评禁令荒谬
2. 微信支付正式发布 AI 专属卡,WorkBuddy 率先接入,智能体可直接完成消费
3. OpenAI Q1 亏损 37 亿美元,营收 57 亿美元,S-1 已秘密提交 SEC
4. 智谱 GLM-5.2 + ZCode 3.0 双发布,MIT 协议开源,1M 上下文
5. 林俊旸新公司卜拉格亮相,首轮估值 135 亿,聚焦具身智能
深度阅读推荐¶
⭐ Anthropic Fable 5 出口管制风波持续升级¶
Anthropic 高管团队(前沿红队负责人 Logan Graham、安全主管 Dave Orr、研究员 Nicholas Carlini)于 6 月 16 日赴华盛顿与商务部面对面谈判。这是禁令发布以来的首次线下会议,被外界描述为"危机谈判"。网络安全专家 Kate Moussouris 指出,所谓的"越狱"不过是让模型"修复代码"——这正是防御性安全最需要的能力,禁止这一能力等于损害美国自身的网络防御。Axios 报道透露,事态可能部分源于"态度问题"而非纯技术原因。
核心观点: 这是历史上首次政府强制下架已公开部署的前沿模型。这一事件正在重塑 AI 公司与政府关系的博弈框架——完美的越狱防御在技术上可能不可能实现,而出口管制的标准如何界定将影响整个行业。
来源:Anthropic 官方声明 | Axios 报道 | Simon Willison 评论 | Kate Moussouris 分析
⭐ OpenAI S-1 秘密提交,Q1 财务数据曝光¶
OpenAI 于 6 月 8 日向 SEC 秘密提交 S-1 注册文件,朝 IPO 迈出关键一步。据 The Information 披露的股东文件,OpenAI Q1 营收 57 亿美元,但亏损 37 亿美元,调整后经营利润率为 -122%。全年预计亏损约 140 亿美元(GAAP 口径可能高达 250 亿美元)。目标估值超过 1 万亿美元,最早可能于 2026 年 9 月上市。
核心观点: AI 超级独角兽正以"烧钱换规模"的模式冲刺公开市场。营收增长迅猛但亏损同样惊人,这一模式能否在公开市场获得认可,将成为 AI 行业商业化的标志性事件。
来源:OpenAI S-1 公告 | OpenAI 财务分析 | IPO 估值分析
⭐ Import AI 461:对齐安全新组织 Sequent 成立,FrontierCode 编码基准发布¶
Jack Clark 本期 Import AI 聚焦三大主题:(1)UK AISI 和 Timaeus 的研究者联手成立非营利组织 Sequent,目标融资 1-1.5 亿美元,宣称"对齐研究没有跟上节奏";(2)Cognition 发布 FrontierCode 编码基准,Claude Opus 4.8 在最难级别 Diamond 上仅得 13.4%;(3)小米 MiMo 万亿参数模型达到 1000 tokens/s 推理速度。
核心观点: Sequent 的成立标志着对齐安全研究正从实验室内部走向独立第三方——他们明确表示"如果需要,我们会发出警告"。FrontierCode 的难度之高令人安心,当前最强模型在 Diamond 级别表现不到 15%,这个基准可能比 SWE-Bench 生命周期更长。
来源:Import AI 461 | Sequent 官网 | FrontierCode
⭐ 苏剑林新文:MoE 环游记第 9 篇——门控归一化之争(MoE Gating Normalization)¶
苏剑林(月之暗面研究员)今日发布 MoE 系列第 9 篇,深入讨论 MoE Router 的门控归一化问题:Softmax vs Sigmoid,先选 Top-k 再归一化(Re-Norm)还是先归一化再选 Top-k?文章从 DeepSeek 的 Sigmoid + Loss-Free 方案出发,系统分析了不同归一化策略对模型训练的影响。
核心观点: 这篇文章直接关联 DeepSeek V4 和 Kimi K2 等最新 MoE 架构的核心设计选择。苏剑林的 MoE 系列已经成为中文社区理解前沿 MoE 技术的最佳参考资料。
OpenAI¶
部署模拟:发布前预测模型行为(Deployment Simulation)¶
OpenAI 发布部署模拟研究,使用真实对话数据在模型部署前预测其行为,以提高安全性和评估准确性。这一方法旨在弥合实验室测试与真实世界使用之间的差距。
来源:OpenAI 博客
S-1 秘密提交 SEC,冲刺万亿美元 IPO¶
OpenAI Q1 营收 57 亿美元,亏损 37 亿美元。6 月 8 日已秘密提交 S-1 注册文件,目标估值超万亿美元。⭐ 深度推荐(详见深度阅读区)
推出 1.5 亿美元合作伙伴网络¶
OpenAI 推出 Partner Network,投入 1.5 亿美元帮助全球合作伙伴加速企业 AI 采用和部署。
Google DeepMind / Gemini¶
Gemini 3.5 Flash 全面可用,Managed Agents 公测¶
Google 持续推进 Gemini 3.x 系列,3.5 Flash 已全面可用(GA),被定位为在编程和 Agent 任务上持续表现最优的模型。同时,Gemini API 推出 Managed Agents 公测,开发者可在 Google 托管的安全沙箱中构建有状态的自主 Agent。此外,API 新增 Webhook 事件驱动支持,取代轮询工作流。
来源:Gemini API 更新日志 | Google DeepMind 博客
Anthropic / Claude¶
Fable 5 出口管制危机持续,高管赴华盛顿谈判¶
6 月 9 日发布的 Fable 5 和 Mythos 5 在三天后被美国政府以国家安全为由下令全面禁用,影响全球所有用户(包括 Anthropic 的外国籍员工)。6 月 16 日,Anthropic 派出高级技术团队赴华盛顿面对面谈判。⭐ 深度推荐(详见深度阅读区)
来源:Anthropic 声明 | Fortune 报道
Claude 基础设施承压,12 天内第 10 次故障¶
6 月 16 日的故障是 6 月 5 日以来的第 10 次重大服务中断。Opus 4.8 和 Haiku 4.5 持续出错,Anthropic 承认基础设施正面临前所未有的需求压力。
Claude Code 更新:嵌套子 Agent、安全模式¶
Claude Code 新增 /cd 会话切换、嵌套子 Agent(可产生自己的子 Agent)、安全模式(隔离故障配置),扩展了后备模型并改进了会话标题和插件搜索。
国内大厂动态¶
微信支付发布 AI 专属卡,打通智能体消费闭环¶
微信支付 6 月 17 日正式推出"AI 专属卡",这是专为 AI 智能体支付场景设计的产品。已率先接入腾讯桌面办公 Agent WorkBuddy,用户可在 Agent 对话中直接完成从推荐到下单的全流程消费。安全设计上,AI 专属卡设立独立账户,与主账户完全隔离,Agent 消费仅限专属卡余额。
智谱 GLM-5.2 + ZCode 3.0 双发布¶
6 月 13 日,智谱发布 GLM-5.2 并计划 MIT 协议开源。核心升级是"真正可用的 1M 上下文",面向 Agentic Engineering 打造。同日发布的 ZCode 3.0 全面切换为自研 Agent 内核。
来源:智谱 GLM-5.2 发布 | 深度解析
林俊旸新公司卜拉格亮相,首轮估值 135 亿¶
前阿里 Qwen 负责人林俊旸创立的卜拉格正式亮相,聚焦具身智能方向。高榕创投与红杉中国联合领投,各出资 1 亿美元,腾讯跟投 2000 万美元,首轮投后估值约 20 亿美元(约 135 亿人民币)。
大晓机器人获数亿美元融资,15 家 VC 争投¶
具身智能大脑公司大晓机器人再获数亿美元融资,走世界模型路线。半年内完成三连发:从开源到端侧再到训练场。
来源:量子位报道
讯飞医疗大模型 V3.5 发布,多项测评超越 GPT-5.5¶
讯飞医疗正式推出星火医疗大模型 V3.5,在多项关键医疗测评上打败 GPT-5.5,实现了从"实验室"到"临床"的跨越。IDC 报告中综合实力行业第一。
来源:量子位报道
北京建设 AI 工厂:目标 10 万 P 算力,日产 10 万亿 Token¶
九章云极发布"AI 工厂"战略,北京建设大规模算力基础设施,计划实现 1000 倍综合降本。
来源:量子位报道
Kimi Work Beta 版开启内测¶
月之暗面推出 Kimi Work Beta 版,面向知识工作者的通用型本地 Agent。用户无需终端或命令行,用自然语言描述目标即可完成任务分解、并行执行、工具调用和文件管理。同时,公司正寻求新一轮融资,目标 20 亿美元。
小米 MiMo 万亿参数模型达到 1000 tokens/s¶
小米 MiMo-V2.5-Pro-UltraSpeed 在 8 GPU 通用节点上实现 1000+ tokens/s 推理速度。这是万亿参数模型首次在非定制硬件上达到这一速度,采用 FP4 量化和 DFlash 推测解码技术。API 试用期 6 月 9-23 日。
来源:小米 MiMo 博客 | MarkTechPost
AI 研究前沿¶
Sequent:独立对齐安全研究组织成立¶
UK AISI 对齐团队和 Timaeus 的研究者联合成立非营利组织 Sequent,目标融资 1-1.5 亿美元,计划扩展到 40-80 名全职研究人员。核心主张是当前对齐研究"没有跟上节奏",需要独立于大型 AI 实验室的第三方进行系统性研究。⭐ 深度推荐(详见深度阅读区)
来源:Sequent 官网
FrontierCode:新编码基准,Diamond 级别最强模型仅 13.4%¶
Cognition 发布 FrontierCode,150 个任务分三个难度级别。Diamond 级别:Claude Opus 4.8 得 13.4%,GPT-5.5 得 6.3%。基准由 20 位开源开发者手工构建,每个任务花费超过 40 小时,重点评估代码可合并性而非单纯正确性。
AARRI-Bench:测试 AI 能否胜任研究实习生工作¶
西安交通大学等发布 Act As a Real Research Intern 基准,82 个任务测试 AI 系统能否完成入门级研究任务。最佳系统 Claude-Opus-4.7 得分 68.3%。特色任务包括识别伪造数据、拒绝不当指令、识别死胡同等。
来源:arXiv 论文
苏剑林:MoE 门控归一化之争¶
今日发布 MoE 系列第 9 篇,系统讨论 MoE Router 门控函数的归一化策略——Softmax vs Sigmoid,先选 Top-k 再归一化还是反过来。直接关联 DeepSeek V4 的设计选择。⭐ 深度推荐(详见深度阅读区)
行业观点与解读¶
Simon Willison:Fable 5 出口管制是"荒谬"的¶
Simon Willison 连续发文跟踪 Fable 5 出口管制事件,引用网络安全专家 Kate Moussouris 的分析指出:所谓"越狱"只是让模型执行正常的防御性安全任务(修复代码),禁止这一能力反而损害美国网络安全。Willison 同时关注了 Georgi Gerganov(llama.cpp 作者)对 Qwen3.6-27B 本地模型编程能力的高度评价。
来源:Willison 关于出口管制的评论 | Willison 引用 Gerganov
本地模型已经可用了¶
Vicki Boykis 发文"Running local models is good now",llama.cpp 作者 Georgi Gerganov 在评论中表示 Qwen3.6-27B 是"非常称手的本地编程模型",他已在日常维护工作中使用近一个半月。配合极简 Agent 框架(pi agent 的离线模式)和简短 system prompt 即可高效工作。
宝玉(@dotey)近期关注¶
宝玉近期分享了 Codex 团队如何用自己的产品构建产品的访谈("整个 Spec 只有 10 个要点"),以及陶哲轩关于 AI 与数学关系的最新演讲。
来源:宝玉推特
值得关注的视频¶
B 站 AI 内容
-
16 款旗舰 AI 模型多维度测评(2026 年 6 月)— 覆盖上下文衰减、文本推理、编码、工具调用、多模态等 8 个维度的系统评测,值得 AI 从业者参考。B 站链接
-
Anthropic 推出 Claude Fable 5 及 Claude Mythos 5 | AI 早报— 对 Fable 5 发布和后续出口管制事件的中文解读。B 站链接
YouTube 播客
今日未发现过去 24 小时内的重要新集更新。近期值得回看的包括 Latent Space 与 Satya Nadella 的交叉对谈(6/3),以及 Import AI 461 中提及的 Sequent 对齐安全组织专题。
灵感种子¶
AI 支付基础设施正在成形 — 微信支付 AI 专属卡的发布标志着"Agent 经济"从概念走向现实:当智能体可以安全地替用户花钱时,AI 应用的商业模式将从"卖订阅"演变为"拿佣金"。这可能催生一个新的平台经济层——谁控制了 Agent 的支付通道,谁就控制了 Agent 生态的商业化入口。
对齐研究的"独立第三方"时代 — Sequent 的成立代表一种新范式:对齐安全研究不能只由开发前沿模型的公司自己做,需要独立的、有能力"吹哨"的外部组织。他们的研究组合策略(可扩展监督、学习理论、博弈论、角色理论)比单一方向押注更稳健。值得关注的是,这类组织能否吸引到顶级人才,以及能否在实际影响力上与大实验室抗衡。
出口管制正在重塑 AI 公司的产品策略 — Fable 5 事件表明,前沿模型的发布不再只是技术问题,而是地缘政治问题。AI 公司可能需要像芯片公司一样,在产品设计阶段就考虑出口管制合规。这对开源模型意味着什么?如果闭源模型随时可能被政府叫停,开源模型的战略价值将进一步提升。
万亿参数推理速度突破千 token/s — 小米 MiMo 在通用 GPU 上实现这一里程碑,说明推理优化的红利远未耗尽。当推理速度快到"实时重构代码"成为可能时,软件开发的范式可能真正改变——不再是写代码然后运行,而是描述意图然后由 AI 即时生成和执行。
生成时间:2026-06-17 23:17 | 下次更新:明日 9:00