AI 每日简报 | 2026-06-26¶
今日概览¶
AI 芯片自研竞赛加速、模型蒸馏引发中美对抗、中国 AI 应用商业化破局——今日行业三条主线交织。OpenAI 携手 Broadcom 发布首颗自研推理芯片 Jalapeño,Anthropic 指控阿里巴巴大规模非法蒸馏 Claude 模型,智谱 GLM-5.2 开源后股价飙涨、唐杰隔空回应马斯克,演语科技 ARR 破 3 亿美元成为中国 AI 应用首个独角兽。
- ⭐ OpenAI × Broadcom 发布自研推理芯片 Jalapeño
- ⭐ Anthropic 指控阿里巴巴用 2.5 万假账号非法蒸馏 Claude
- ⭐ 智谱发布 GLM-5.2,CodeArena 全球可用模型排名第一
- ⭐ 演语科技 B+ 轮融资近 3 亿美元,ARR 破 3 亿
- ⭐ OpenAI 研究论文揭示 AI Agent 如何重塑工作方式
深度阅读推荐¶
以下条目标注为 ⭐ 深度推荐,包含 AI 提炼的核心观点。
⭐ OpenAI 与 Broadcom 联合发布首颗自研推理芯片 Jalapeño(OpenAI and Broadcom unveil LLM-optimized inference chip)¶
OpenAI 与 Broadcom 联合推出 Jalapeño——一款专为 LLM 推理优化的定制芯片,也是两家公司多代计算平台合作的首款产品。该芯片从设计到流片仅用 9 个月,开发过程中使用了 OpenAI 自身模型加速设计优化。早期测试显示,Jalapeño 在每瓦性能上大幅优于当前最先进方案,计划 2026 年底启动部署。
核心观点:这标志着 OpenAI 正式从"GPU 消费者"向"芯片设计者"转型。9 个月的研发周期暗示 AI 辅助芯片设计可能大幅缩短传统半导体开发节奏。与 Microsoft 合作部署 GW 级数据中心的计划,意味着 OpenAI 正在构建从模型到硬件的全栈控制力。
来源:OpenAI 官方博客 | TechCrunch | CNBC
⭐ Anthropic 指控阿里巴巴大规模非法蒸馏 Claude 模型¶
Anthropic 正式指控阿里巴巴通义千问团队在 2026 年 4-6 月间,通过近 2.5 万个虚假账号与 Claude 进行了超过 2880 万次对话,系统性地提取模型的 Agent 推理、软件工程和长程任务能力。Anthropic 称这是迄今为止中国公司对美国 AI 实验室最大规模的"对抗性蒸馏"攻击,已致信白宫。
核心观点:此事件将 AI 模型知识产权保护推上中美科技博弈的前台。"对抗性蒸馏"作为一种新型攻击方式,暴露了闭源模型通过 API 暴露的固有风险——模型的推理模式和数据结构可以被大规模 prompt 反向工程。
来源:CNBC | Bloomberg | Tom's Hardware
⭐ 智谱发布并开源 GLM-5.2,唐杰隔空回应马斯克¶
智谱 AI 发布旗舰模型 GLM-5.2,总参数 744B,激活参数 40B,支持 100 万 token 上下文窗口。在 CodeArena 评测中以 1595 分排名全球第二(仅次于目前不可用的 Fable 5),为全球可用模型中第一。发布后智谱股价当日一度暴涨 42%,市值触及 1.27 万亿港元。马斯克预测中国模型 2027 年 Q1 追平 Fable,智谱 CEO 唐杰回应:"用不了那么久。"
核心观点:GLM-5.2 的性能表现显示中国开源模型与全球闭源顶尖的差距正在急剧缩小。智谱上市后的市值表现也反映了资本市场对中国自主 AI 基础设施的信心。
⭐ 演语科技 B+ 轮融资近 3 亿美元,成中国 AI 应用首个 3 亿 ARR 独角兽¶
AI 创意内容公司演语科技(EVOKEN)完成近 3 亿美元 B+ 轮融资,投后估值超 20 亿美元,由 Granite Asia、腾讯及顺为资本领投。公司 ARR 突破 3 亿美元——融资金额约等于年度收入,在中国 AI 应用创业史上极为罕见。产品覆盖 AI 图片、设计及视频创作,其中 LibTV 上线两月收入增长 13 倍以上。
核心观点:演语科技证明了中国 AI 应用层不必依赖"单款爆品"逻辑,多产品矩阵同样能跑通商业化路径。3 亿 ARR 对标全球 AI 应用第一梯队,标志着中国 AI 应用从"出海 + 低价"模式向正向现金流驱动的增长切换。
⭐ OpenAI 研究论文:AI Agent 正在重塑工作方式(How agents are transforming work)¶
OpenAI 发布内部研究报告,展示 AI Agent 在公司内部如何改变工作方式。关键数据:99 百分位用户每天产生超过 60 小时的 Codex Agent 时长(分布在多个并行 Agent 上);研究部门的 Agent 使用量较 2025 年 11 月增长 56 倍;法务、财务和招聘部门在 2026 年 4 月前后已转向 Codex 为主要工具,平均律师或招聘人员 85% 以上的输出 token 来自 Codex。
核心观点:最引人注目的信号不是开发者的使用——而是非开发者的爆发式增长(个人用户增长 137 倍,组织用户增长 189 倍)。这意味着 AI Agent 正在从"程序员工具"变成"全员生产力基础设施"。
来源:OpenAI 官方博客
OpenAI¶
⭐ 自研推理芯片 Jalapeño 正式发布(OpenAI and Broadcom unveil LLM-optimized inference chip)¶
OpenAI 与 Broadcom 联合推出首款 LLM 推理优化芯片 Jalapeño,从设计到流片仅 9 个月。早期测试性能每瓦大幅优于当前方案,计划 2026 年底启动部署,与 Microsoft 合作建设 GW 级数据中心。
来源:OpenAI 博客
⭐ AI Agent 重塑工作方式研究报告(How agents are transforming work)¶
OpenAI 发布内部 Agent 使用研究,非开发者用户增长 137 倍,法务/财务/招聘等部门 85% 输出 token 来自 Codex。
来源:OpenAI 博客
帮助构建先进 AI 共享标准(Helping build shared standards for advanced AI)¶
OpenAI 宣布支持 Appia Foundation,推动 AI 评估框架、安全实践和全球合作的共享标准建设。
来源:OpenAI 博客
GPT-5 帮助免疫学家解决三年悬案(How GPT-5 helped immunologist Derya Unutmaz solve a 3-year-old mystery)¶
GPT-5 Pro 帮助免疫学家 Derya Unutmaz 破解了一个持续三年的 T 细胞行为谜题,该突破有望推动癌症和自身免疫疾病研究。
来源:OpenAI 博客
Google DeepMind / Gemini¶
⭐ 两名核心 Gemini 研究员即将转投 Anthropic¶
据 Bloomberg 报道,Google DeepMind 的 Jonas Adler(负责 AI 编码)和 Alexander Pritzel(负责预训练)计划离开加入 Anthropic。两人此前参与了 AlphaFold 研究。这是继 John Jumper 转投 Anthropic、Noam Shazeer 加入 OpenAI 之后,Google 在六天内失去的第四位高级 AI 研究员。Anthropic 和 OpenAI 即将 IPO 的股权吸引力是人才流失的关键因素。
核心观点:Google 正面临前所未有的 AI 人才流失危机。IPO 前期的股权激励成为最强的人才武器——这是市值 2 万亿美元的公司难以匹配的。
来源:Bloomberg | TechCrunch
Gemini 3.5 Pro 仍在限定预览阶段¶
Gemini 3.5 Flash 已于 5 月 Google I/O 正式发布,但旗舰版 Gemini 3.5 Pro 截至目前仍仅向部分 Vertex AI 企业客户开放限定预览,尚未面向公众开放。
Gemini 3 Deep Think 向 AI Ultra 订阅用户推出¶
Google 最强推理模式 Gemini 3 Deep Think 开始向 Google AI Ultra 订阅用户推出,专注于数学、科学、逻辑和复杂多步推理问题。
来源:Google 博客
Anthropic / Claude¶
⭐ 指控阿里巴巴大规模非法蒸馏 Claude 模型¶
Anthropic 指控阿里巴巴通义千问团队通过 2.5 万假账号进行 2880 万次对话,系统性提取 Claude 模型能力,是迄今最大规模的模型蒸馏攻击。
来源:CNBC
Claude Tag 在 Slack 上线¶
Anthropic 推出 Claude Tag,Enterprise 和 Team 客户可在 Slack 频道中 @Claude 分配任务,支持多人协作、上下文记忆、主动更新和异步任务处理。将工具、数据和代码库连接到团队工作流。
来源:TechCrunch
Anthropic 工程负责人:Claude Code 让工作变成"孤独体验"¶
Anthropic 工程领导层坦承,Claude Code 虽然大幅提升了生产力,但也让员工的工作体验变得更加孤独——引发了关于 AI 工具如何改变团队协作文化的反思。
来源:Fortune
Google 顶尖研究员 Adler、Pritzel 即将加入 Anthropic¶
详见 Google DeepMind 板块。Anthropic 持续从 Google 吸引顶尖人才,IPO 前期股权是关键吸引力。
来源:Bloomberg
国内大厂动态¶
⭐ 智谱发布 GLM-5.2,全球可用模型 CodeArena 第一¶
智谱 AI 发布并开源 GLM-5.2(744B 总参数 / 40B 激活参数 / 100 万 token 上下文),CodeArena 1595 分排全球第二,可用模型第一。发布后股价暴涨 42%,市值触及 1.27 万亿港元。马斯克与唐杰就中国模型追赶时间隔空交锋。
⭐ 演语科技完成近 3 亿美元 B+ 轮,ARR 突破 3 亿美元¶
中国 AI 创意内容公司成为首个 3 亿 ARR 独角兽,产品覆盖图片、设计和视频创作。腾讯、顺为、红杉中国等持续加码。
豆包专业版上线,字节跳动正式开启付费模式¶
豆包推出三档付费订阅:标准版 68 元/月、加强版 200 元/月、专业版 500 元/月。付费功能聚焦 PPT 生成、数据分析、影视制作等复杂场景。免费版承诺不缩减。截至 3 月,豆包月活已达 3.45 亿,日活 1.4 亿——这是中国最大 AI 应用首次转向付费模式。
科大讯飞发布企业服务 Claw 平台¶
科大讯飞推出企业级 AI 服务平台 Claw,号称"一句话搞定需求到方案全流程",面向企业 B 端场景。
来源:量子位
世界模型混战:Momenta 率先冲刺 IPO¶
自动驾驶公司 Momenta 在世界模型赛道率先冲刺 IPO,AI 司机收入三年涨 42 倍。
来源:量子位
AI 研究前沿¶
AI 与责任:德国法院裁定 Google 须为 AI Overview 错误担责¶
Bruce Schneier 评论德国法院里程碑式裁决:Google 须为其 AI Overview 中的错误信息承担责任。Schneier 指出,AI Agent 是部署者的代理人,应当受到与人类代理人相同的法律约束——否则企业将获得巨大的不当激励,用不可靠的 AI 替代人类专业人员。
Prompt 注入即角色混淆(Prompt Injection as Role Confusion)¶
最新研究证实 LLM 本质上无法可靠区分系统指令和用户输入——模型更多依赖文本的"风格"而非实际的角色标签来判断权限级别。"去风格化"可将攻击成功率从 61% 降至 10%。研究者警告,除非实现真正的角色感知,否则注入防御将永远是打地鼠游戏。
来源:Simon Willison | 论文网站
Nature 关注:AI 聊天伴侣的情感风险¶
Nature Machine Intelligence 发表评论文章,呼吁关注 AI 聊天伴侣带来的情感依赖风险。研究显示,高频使用与孤独感、依赖性增强呈正相关;中等使用量下语音交互可降低孤独感,但过度使用则适得其反。
来源:Nature Machine Intelligence | 量子位
行业观点与解读¶
Simon Willison:用 Claude Code 将 0.2B 图像修复模型 Moebius 移植到浏览器¶
Simon Willison 分享了他如何利用 Claude Code 将 0.2B 参数的 Moebius 图像修复模型通过 ONNX Runtime Web + WebGPU 移植到浏览器端运行的完整过程。文中展示了多 Agent 并行工作流的实践——一边用 Codex Desktop 做 Datasette 的主项目,一边用 Claude Code 在 /tmp 文件夹里探索性地完成模型移植。
"意外的匿名":LLM 生成的求职申请让招聘者一无所知¶
Tom MacWright 撰文指出一个新趋势:越来越多的求职申请由 LLM 共写,链接到 LLM 生成的作品集网站,再链接到 LLM 生成的 GitHub 项目。"完美的、生成的、提示的简历是通用且无个性的——它告诉我关于这个人的一切,唯独不告诉我这个人是谁。"
来源:Simon Willison 引用 | Tom MacWright 原文
值得关注的视频¶
本日无新发现值得特别推荐的视频内容。此前发布的 Latent Space × No Priors 联名播客(Satya Nadella 专访,6 月 3 日发布)仍值得回听。
今日无更新
灵感种子¶
以下是今日简报中值得进一步思考的灵感种子。
从"消费 GPU"到"设计芯片":AI 公司的垂直整合加速
OpenAI 的 Jalapeño 标志着 AI 公司开始像 Apple 一样追求软硬一体。9 个月的芯片开发周期——而非传统的 3-5 年——暗示 AI 辅助芯片设计本身就是一个值得深挖的方向。如果模型可以加速自身运行硬件的设计,这构成了一个自我强化的正反馈循环。
"对抗性蒸馏"揭示闭源模型的根本悖论
Anthropic 指控阿里巴巴的事件指向一个更深层问题:闭源模型需要通过 API 提供服务才能产生收入,但每一次 API 调用都在暴露模型的推理模式。2880 万次对话足以构建出相当完整的知识蒸馏。这是否意味着"闭源 + API 服务"的商业模式本身就包含不可调和的矛盾?
非开发者的 Agent 爆发:比开发者增长更快的信号
OpenAI 内部数据中最被忽视的数字:非开发者 Agent 用户增长 137 倍。当律师、招聘人员的 85% 输出来自 Codex 时,"AI 编程工具"这个标签本身已经过时了——它正在变成通用的知识工作操作系统。
中国 AI 应用的商业化转折点
演语科技 3 亿 ARR + 豆包 3.45 亿月活开启收费,两件事放在一起看:中国 AI 应用正在同时验证"出海多产品矩阵"和"本土超级应用付费转化"两条路径。2026 年可能是中国 AI 应用从"补贴换增长"切换到"正向现金流"的分水岭年份。
生成时间:2026-06-26 09:05 | 下次更新:明日 9:00