跳转至

AI 每日简报 | 2026-06-11

今日概览

AI 行业正在经历历史性的资本化转折点:OpenAI、Anthropic 双双提交 IPO 申请,SpaceX(含 xAI)今日定价$135/股备战 Nasdaq,三大 AI 巨头齐聚上市赛道;与此同时,技术侧同样密集:Anthropic 发布 Mythos 级公开模型 Fable 5,Google 开源文本扩散模型 DiffusionGemma,Apple WWDC 重构 Siri 接入 Gemini 并开放 Claude/ChatGPT 作为替代选项。

今日最值得关注的 5 条事件:
1. 🚀 AI IPO 三重奏:SpaceX 今日定价,OpenAI + Anthropic 同周提交 S-1,AI 资本化浪潮达到高点
2. ⭐ Anthropic Claude Fable 5 发布:首个公开可用的 Mythos 级模型,能力全面超越 Opus 4.8
3. ⭐ Google DiffusionGemma 开源:文本扩散架构,生成速度比同量级模型快 4 倍,颠覆 AR 生成范式
4. ⭐ Apple WWDC:Siri 接入 Gemini,iOS 27 开放 Claude/GPT 替换:AI 进入十亿级端侧用户争夺战
5. 豆包 6 月下旬正式付费:3.45 亿月活的国内最大 AI 应用开启商业化


深度阅读推荐

⭐ Anthropic 发布 Claude Fable 5 与 Claude Mythos 5

Anthropic 于 6 月 9 日正式发布 Claude Fable 5,这是 Mythos 级模型首次向公众开放。Fable 5 在几乎所有能力基准上都处于 SOTA,尤其擅长软件工程、知识工作、视觉理解和科学研究,支持 100 万 token 上下文与 12.8 万 token 最大输出,并内置自适应思维(adaptive thinking)。与此同时,Anthropic 还向通过审核的合作伙伴部署了 Claude Mythos 5,限定用于 Glasswing 合作机构及特定生物研究场景。

对于高风险领域(网络安全、生物、化学),Fable 5 会拒绝响应并回退到 Claude Opus 4.8,是 Anthropic 在能力与安全之间平衡的一次公开展示。定价为每百万输入 token $10、每百万输出 token $50,6 月 22 日前 Pro/Max/Team/Enterprise 计划免费使用,23 日起需消耗额度。

核心观点:
- Mythos 级能力首次公开可用,意味着 Anthropic 认为 Fable 5 在安全约束下已足够可控;但 Mythos 5 本体仍受严格限制,这条能力边界是 Anthropic 安全战略的具体体现
- 高风险领域「自动回退 Opus 4.8」的设计是业界首次将安全回退机制产品化,值得追踪其他厂商是否跟进

来源:Anthropic 官方发布 | TechCrunch 报道 | CNBC


⭐ Google 开源 DiffusionGemma:文本扩散模型,速度提升 4 倍

6 月 10 日,Google DeepMind 以 Apache 2.0 协议开源 DiffusionGemma,这是一个 26B 参数(MoE 架构,激活 3.8B)的文本扩散模型,是主流开源生态中第一个大规模文本扩散模型。

DiffusionGemma 放弃了传统自回归(AR)生成范式,改用与图像扩散类似的并行细化机制:从随机 token 画布出发,同步细化整段文本。这带来了独特优势:在 RTX 5090 上超过 700 token/秒,在单卡 H100 上超过 1000 token/秒,比同量级 AR 模型快约 4 倍。同时,非线性任务(如填充函数中间、编辑局部文本)上的表现也更自然。

Google 明确标注这是实验性模型,整体输出质量仍低于标准 Gemma 4,速度优势主要体现在本地单用户场景。

核心观点:
- 这是文本扩散范式在开源生态中迈出的重要一步,对于推理加速研究和本地部署场景有参考价值
- 目前质量仍低于标准 Gemma 4,说明文本扩散还需要时间追赶 AR 的质量天花板——但速度路径已经验证

来源:MarkTechPost | SiliconANGLE | GIGAZINE


⭐ Apple WWDC 2026:Siri 接入 Gemini,iOS 27 开放多 AI 插件生态

6 月 8 日苹果 WWDC 2026 开幕,Tim Cook 在(据报其个人最后一场)WWDC 主题演讲中发布了用 Google Gemini 重构的新版 Siri,底层运行谷歌定制模型,交由约每年 10 亿美元的多年合同背书。

更重要的是 iOS 27 Extensions 框架:Siri、Writing Tools、Image Playground 全部向第三方 AI 开放,用户可在 App Store 专属区域选择将 Claude(Anthropic)、ChatGPT(OpenAI)、Grok(xAI)或 Gemini 设为系统默认 AI 助手。iOS 27 developer beta 已于 8 日当天发布,公开 beta 预计 7 月中旬,正式版随秋季新 iPhone 推出。

核心观点:
- Apple 本质上在做「AI 操作系统层」的分发生意——不押注单一模型,而是收取平台税,让 AI 厂商争夺十亿级用户入口;这个逻辑和 App Store 如出一辙
- 对 Anthropic 而言,Claude 进入 iPhone 默认 AI 选项意味着 B2C 渠道的重大突破,会直接影响其 IPO 估值叙事

来源:MacRumors | 9to5Mac | The Next Web


⭐ AI IPO 三重奏:OpenAI、Anthropic、SpaceX 同周上市布局

这是 AI 行业资本化的历史性节点:

  • Anthropic:6 月 1 日提交机密 S-1,距同日关闭 650 亿美元 Series H 仅 4 天,估值约 9650 亿美元,是首家私募市值超越 OpenAI 的 AI 实验室。
  • OpenAI:6 月 8 日提交机密 S-1,估值 8520 亿美元,Goldman Sachs + Morgan Stanley 主导,目标 2026 年秋季(9-11 月)上市窗口。
  • SpaceX(含 xAI):今日(6 月 11 日)为定价日,发行价 $135/股,目标估值约 1.75 万亿美元,融资规模约 750 亿美元,将成史上最大 IPO。

核心观点:
- 三家 AI 相关公司同周排队 IPO,在 AI 概念股已经回调 7.4%(Nasdaq 6 月 1 日高点至今)的时间窗口内竞速,透露出「趁估值没打下去赶紧上市」的紧迫感
- Anthropic 估值 9650 亿美元对比其 470 亿美元年化收入,市销率超过 20x,市场对 AI 增长的预期定价依然极为激进

来源:Fortune - Anthropic S-1 | OpenAI 官方 | NPR - SpaceX IPO | CNBC - SpaceX


OpenAI

ChatGPT Dreaming V3 记忆升级扩展至 Free 用户

OpenAI 于 6 月 4 日将 Dreaming V3 内存架构向 Free 层用户开放,此前已覆盖 Plus/Pro 美国用户。Dreaming V3 彻底改变 ChatGPT 记忆机制:不再依赖手动保存的记忆列表,而是在对话结束后后台扫描历史会话,自动综合更新用户画像。新增三项用户控制:可审阅的记忆摘要页、手动添加/修改记忆、主题偏好设置(设置哪些话题不记忆)。实测记忆准确率:2024 年 41.5%→ 2025 年 67.9%→ 2026 年 Dreaming V3 达 82.8%。

来源:OpenAI 官方 | Engadget


OpenAI 将 GPT-5.5-Cyber 扩展至欧盟

OpenAI 宣布通过「EU Cyber Action Plan」将 GPT-5.5-Cyber 推广至欧洲,向经审核的欧洲网络安全团队、企业、政府机构和 EU AI Office 开放限量预览。GPT-5.5-Cyber 是专为网络安全设计的旗舰变体,支持漏洞分析、恶意软件逆向、渗透测试等高权限任务。个人访问者须于 6 月 1 日起启用「Advanced Account Security」。

来源:OpenAI 官方 | TechTimes


OpenAI 提交机密 S-1 正式启动 IPO 进程 ⭐ 深度推荐(详见深度阅读区)

来源:OpenAI 官方 | Fortune


Google DeepMind / Gemini

Google 开源 DiffusionGemma ⭐ 深度推荐(详见深度阅读区)

来源:MarkTechPost


Gemini 3.5 Flash 正式 GA 发布(回顾:5 月 19 日 I/O 发布)

Gemini 3.5 Flash 作为 Google I/O 2026 的重点产品,于 5 月 19 日正式上线并持续扩展。该模型定位为「Agent 和编码任务的旗舰模型」,在 Terminal-Bench 2.1(76.2%)、MCP Atlas(83.6%)等 Agentic 基准上超越 Gemini 3.1 Pro,生成速度是其他前沿模型的 4 倍。定价 \(1.50/\)9 每百万 token(输入/输出),比上代涨价 3 倍,但仍比 Gemini 3.1 Pro 便宜 40%。

来源:Google 官方博客 | TechCrunch


Apple WWDC:Siri 底层切换至 Gemini ⭐ 深度推荐(详见深度阅读区)

来源:MacRumors


Anthropic / Claude

Claude Fable 5 与 Claude Mythos 5 发布 ⭐ 深度推荐(详见深度阅读区)

来源:Anthropic 官方


Anthropic 提交机密 S-1 正式启动 IPO 进程 ⭐ 深度推荐(详见深度阅读区)

估值约 9650 亿美元,距 Series H 关闭仅 4 天提交,成为首家私募市值超越 OpenAI 的 AI 实验室。

来源:Anthropic 官方 | TechCrunch


Claude 上线 20+ 法律 MCP 连接器

Claude 发布 20+ 个法律行业专用 MCP 连接器和 12 个细分领域插件,覆盖法律研究、合同审查、案件发现、事务管理、法律援助等场景,面向律所和企业法务团队。

来源:Releasebot Anthropic 更新


Claude Code 新增嵌套子 Agent 支持

Claude Code 更新支持嵌套 Sub-agents、更智能的模型与区域处理、新增插件搜索,并改善了 Chrome、VSCode 和 Terminal 工作流集成。

来源:Releasebot Claude Code


国内大厂动态

豆包 6 月下旬正式开启付费订阅

字节跳动旗下豆包(Doubao)预计 6 月下旬正式上线付费版,分三档:标准版 68 元/月(688 元/年)、加强版 200 元/月(2048 元/年)、专业版 500 元/月(5088 元/年),基础功能永久保持免费。豆包当前月活用户 3.45 亿,是国内最大 AI 应用。付费方向主要面向程序员、数据分析、专业设计、流程自动化等生产力场景。

来源:界面新闻 | 光明网 | 虎嗅


DeepSeek V4.1 预计本月发布,首轮 500 亿元融资接近落地

据量子位报道,DeepSeek 创始人梁文锋主导的首轮外部融资目标 500 亿元人民币,梁文锋本人出资最高 200 亿元(占总额 40%),估值已达约 515 亿美元。V4.1 模型定于 6 月发布,将原生支持多模态输入(图像、音频),并强化 MCP 协议适配,大幅降低企业接入门槛。

来源:量子位


Doubao-Seed-2.0-lite:字节首款全模态理解模型

字节跳动火山引擎于 5 月 6 日发布 Doubao-Seed-2.0-lite,豆包大模型家族首款支持视频/图像/音频/文本原生统一理解的全模态模型,在细粒度感知、语音识别、具身理解等基准上优于 Gemini-3.1-Pro。

来源:IT之家 | DoNews


国产开源长视频框架 JoyAI-Echo 杀入全球第一梯队

量子位报道,京东开源的长视频生成框架 JoyAI-Echo 在用户偏好测试中得分 59.4%~81.7%,跨镜头一致性和声音准确率(0.8646)居行业前列。支持多镜头、多场景、多段音频连续切换,保持人物形象和声音一致性,内置 Director Agent 支持对话式剪辑。

来源:量子位


AI 研究前沿

DiffusionGemma:首个大规模开源文本扩散模型 ⭐ 深度推荐(详见深度阅读区)

来源:MarkTechPost


DRPO:用平滑正则化替代硬掩码,改善 LLM 强化学习稳定性

HuggingFace Daily Papers 推送,DRPO(发表于 6 月 8 日)针对 LLM 强化学习训练中的不稳定问题,以平滑正则化替代传统硬掩码方案,提高训练稳定性和最终性能。

来源:HuggingFace Papers


VibeVoice:基于 next-token diffusion 的多说话人长语音合成

VibeVoice 使用 next-token diffusion 和高效连续语音分词器合成长篇多说话人语音,对长对话、有声书等场景有直接应用价值。

来源:HuggingFace Papers


SkillOpt:文本空间 Agent 技能系统优化器

SkillOpt 提出一套针对 Agent 技能的文本空间系统级优化器,可自动改进 Agent 使用工具的策略,无需人工调整。

来源:HuggingFace Papers


行业观点与解读

宝玉(@dotey):「Anthropic 报告揭示 Agent 编程八大趋势」

宝玉整理翻译 Anthropic 年初发布的《2026 Agentic Coding Trends Report》,提炼八大核心趋势:AI 从 Copilot 升级为 Collaborator/Team;多 Agent 协作取代单 Agent 工作流;编程门槛进一步降低(非工程师可通过 Agent 接口完成开发任务);Agent 任务时长从分钟级扩展到数天。核心观点:写代码这件事正在从「人写」变成「人指挥 AI Agent 写」。

来源:宝玉 X 推文 | 华尔街见闻


Simon Willison:「Claude Fable 5 初印象」

Django 联合创始人、知名 AI 工具观察者 Simon Willison 于 6 月 9 日第一时间发布 Claude Fable 5 使用初印象,详细记录在高风险任务回退机制下的实际体验以及与 Claude Opus 4.8 的对比测试。

来源:Simon Willison's Weblog


豆包付费引发用户强烈反对:3.45 亿月活的商业化转折点

豆包宣布付费计划后,虎嗅等平台的评论区出现大量用户反对声音,主要集中在:定价偏高、免费版功能限制担忧、替代选项丰富(DeepSeek 仍免费)。这是中国大模型商业化转型中的典型矛盾:月活规模巨大但付费转化率仍是未知数。

来源:虎嗅 | 澎湃新闻


值得关注的视频

Latent Space:Ethan He(xAI)谈 Grok Imagine 与 AI 视频 Agent 的未来(6月1日)

Latent Space 与 xAI 的 Ethan He 深度对话,探讨 Grok Imagine、视频 Agent 以及语言模型驱动的交互式世界模型前景。xAI 目前在视频 AI 赛道上是最少被深度讨论的玩家之一,这期节目提供了难得的内部视角。值得观看。

来源:Latent Space Podcast


Latent Space:⭐ Satya Nadella × Latent Space/No Priors 深度对谈(6月3日)

Satya Nadella 与 Latent Space、No Priors 联合访谈,深度讨论微软 MAI 模型、AI 生态系统战略和 Agent 化企业软件的未来。微软 CEO 亲自解读 AI 战略,信息密度极高,推荐观看。⭐

来源:Latent Space Podcast


今日无 B 站视频更新(今日扫描无符合条件的近 48 小时内容)。


灵感种子

「AI 平台税」的历史重演

Apple 通过 iOS 27 Extensions 开放多 AI 插件生态,本质上复制了 App Store 的平台逻辑:不押注单一 AI,而是向所有 AI 厂商收取入场费换取十亿级用户分发。值得思考的问题是:在 AI 浪潮里,谁会成为「操作系统层」的赢家?是苹果、是谷歌(Gemini 底座)、还是成为默认入口的 AI 本身?

文本扩散 vs 自回归:下一代生成范式之争

DiffusionGemma 的发布标志着文本扩散架构从学术讨论走向可下载的开源模型。图像生成领域经历了 GAN → VAE → Diffusion 的范式跃迁,文字生成是否也会经历类似演变?目前质量仍是软肋,但「并行生成 + 非线性编辑」的特性对代码补全、文档局部修改等场景有潜在优势,值得持续跟踪。

IPO 估值泡沫还是合理预期?

Anthropic 9650 亿估值、OpenAI 8520 亿估值,对应的年化营收分别约为 470 亿和数百亿美元,市销率均超过 20x。与此同时,Nasdaq 已从 6 月 1 日高点下跌 7.4%。AI 公司上市潮是否将成为这轮 AI 牛市的顶点标志?历史上,重要赛道「集体上市」往往发生在周期中后段——但这次 AI 是否真的不一样?

豆包 3.45 亿月活:商业化是生死考验还是必然归宿?

豆包付费引发的用户反弹揭示了中国 AI 产品商业化的核心矛盾:免费获取的海量用户习惯了「不付钱的 AI」,而 token 成本是真实支出。DeepSeek 仍免费、Kimi 月活已跌 30%-42%——豆包的付费转化率,将成为中国 AI 应用商业化能否走通的标志性数据点。


生成时间:2026-06-11 15:29 | 下次更新:明日 9:00