AI 每日简报 | 2026-06-25¶
今日概览¶
AI 芯片自研潮迎来里程碑时刻——OpenAI 携手 Broadcom 发布首款自研推理芯片 Jalapeño,向 Nvidia 定价权发起正面挑战。与此同时,GPT-5.6 即将在本周内正式发布,1.5M token 上下文窗口将创下新纪录。Google 在一周内连失两位顶级 AI 人才(Noam Shazeer → OpenAI,John Jumper → Anthropic),AI 人才战争白热化。Anthropic 则以 Claude Tag 和 Claude Code 升级双管齐下,加速企业级 AI 协作落地。
- OpenAI 联合 Broadcom 发布自研推理芯片 Jalapeño
- GPT-5.6 本周内发布在即,1.5M token 上下文窗口
- Google 一周痛失 Noam Shazeer 和 John Jumper 两大核心人才
- Anthropic 推出 Claude Tag,将 AI 协作引入 Slack 团队工作流
- 美国科罗拉多州 AI 法案 6 月 30 日正式生效,成全美首部综合性州级 AI 法
深度阅读推荐¶
⭐ OpenAI 联合 Broadcom 发布首款自研推理芯片 Jalapeño(OpenAI and Broadcom unveil LLM-optimized inference chip)¶
OpenAI 与 Broadcom 联合推出名为 Jalapeño 的定制推理芯片,专为 LLM 推理优化。从设计到流片仅用 9 个月,工程样片已在实验室中以目标频率和功耗运行 GPT-5.3-Codex-Spark 等 ML 工作负载。OpenAI 承诺到 2029 年通过微软部署 10GW 自研加速器。
核心观点:这是 OpenAI 从"模型公司"向"全栈 AI 基础设施公司"转型的标志性事件。自研芯片意味着 OpenAI 不再完全依赖 Nvidia,有望大幅降低推理成本——这对其日益增长的消费级和企业级产品线至关重要。早期测试显示每瓦性能"显著优于"当前最先进水平。
来源:OpenAI 官方博客 | TechCrunch | VentureBeat
⭐ GPT-5.6 本周发布在即(GPT-5.6 launch window starts this week)¶
OpenAI 首席科学家 Jakub Pachocki 将 GPT-5.6 描述为"对 GPT-5.5 的有意义改进"。该模型已在 ChatGPT Pro 中被部分用户观察到。预期亮点:1.5M token 上下文窗口(GPT-5.5 API 为 1M)、推理预算从 768 提升至 960、训练数据截止延伸至 2026 年 5 月、集成 Playwright 实现网页自动化。Polymarket 交易者给出 83% 的概率预测将在 6 月 22-28 日之间发布。
核心观点:1.5M token 上下文是当前主流模型中最大的,配合推理预算提升,意味着 GPT-5.6 在复杂 Agent 场景下的能力将有质的飞跃。
来源:TechTimes | Geeky Gadgets
⭐ Google 一周痛失两大 AI 核心人才(Google loses two top AI researchers in one week)¶
6 月 18 日,Transformer 论文共同作者、Gemini 联合负责人 Noam Shazeer 离开 Google 加入 OpenAI 担任架构研究负责人。仅两天后的 6 月 20 日,2024 年诺贝尔化学奖得主、AlphaFold 核心创造者 John Jumper 宣布离开 Google DeepMind 加入 Anthropic。
核心观点:这两次离职发生在同一周,是 AI 行业人才竞争史上最具象征意义的事件之一。Shazeer 是 Transformer 架构的奠基者之一,他加入 OpenAI 可能深刻影响下一代模型架构设计;Jumper 的加入则标志着 Anthropic 在"AI for Science"方向的战略野心。对 Google 而言,这意味着基础架构和 AI 科学两大领域同时失去旗帜性人物。
来源:TechCrunch | Search Engine Journal | 36Kr
⭐ Anthropic 推出 Claude Tag(Claude Tag launches on Slack)¶
Anthropic 推出 Claude Tag,这是一个 Slack 上的多人 AI 协作工具(beta)。企业和团队客户可以在 Slack 频道中 @Claude,委派任务给它异步处理。Claude Tag 能记住频道中的相关上下文、规划和执行任务,基于 Opus 4.8 模型运行。
核心观点:Claude Tag 将 AI 从"对话工具"升级为"团队成员"。与 ChatGPT 的 Slack 集成不同,Claude Tag 强调上下文记忆和主动任务管理——这更接近于一个"虚拟同事"而非"聊天机器人"。
来源:Anthropic 新闻 | Releasebot
OpenAI¶
⭐ OpenAI 与 Broadcom 发布自研推理芯片 Jalapeño(OpenAI and Broadcom unveil LLM-optimized inference chip)¶
OpenAI 首款自研芯片,与 Broadcom 联合开发,专注 LLM 推理优化。9 个月完成从设计到流片,工程样片已运行 ML 工作负载。计划 2026 年底开始部署,到 2029 年通过微软扩展至 10GW 级别。早期测试显示每瓦性能显著优于现有方案。⭐ 深度推荐(详见深度阅读区)
来源:OpenAI 官方
⭐ GPT-5.6 即将发布(GPT-5.6 imminent launch)¶
OpenAI 首席科学家确认 GPT-5.6 是"有意义的改进",预计本周发布。已在 ChatGPT Pro 中被部分用户观察到。亮点包括 1.5M token 上下文、Playwright 集成、更大推理预算。⭐ 深度推荐(详见深度阅读区)
来源:TechTimes
OpenAI 帮助建立先进 AI 共享标准(Helping build shared standards for advanced AI)¶
OpenAI 通过 Appia 基金会支持 AI 评估框架、安全实践和全球合作的共享标准建设。
来源:OpenAI 官方
GPT-5 帮助免疫学家解决三年未解之谜(How GPT-5 helped immunologist solve a 3-year-old mystery)¶
免疫学家 Derya Unutmaz 使用 GPT-5 Pro 解开了一个关于 T 细胞行为的三年悬案,该突破可能支持癌症和自身免疫疾病研究。
来源:OpenAI 官方
Samsung 在全球员工中部署 ChatGPT Enterprise 和 Codex¶
三星电子向全球员工推出 ChatGPT Enterprise 和 Codex,成为 OpenAI 最大规模的企业 AI 部署之一。
来源:OpenAI 官方
Noam Shazeer 加入 OpenAI 担任架构研究负责人¶
Transformer 论文共同作者、Google Gemini 联合负责人 Noam Shazeer 于 6 月 18 日离开 Google 加入 OpenAI。⭐ 深度推荐(详见深度阅读区)
Google DeepMind / Gemini¶
⭐ Google 一周失去两位 AI 核心人物(Google loses Shazeer and Jumper in one week)¶
Noam Shazeer(Transformer 共同作者)和 John Jumper(AlphaFold 缔造者、诺贝尔化学奖得主)在同一周分别加入 OpenAI 和 Anthropic,这是 Google AI 人才流失的标志性事件。⭐ 深度推荐(详见深度阅读区)
来源:TechCrunch
Gemini 3.5 Flash 正式发布¶
Google 发布 Gemini 3.5 Flash GA 版本,被描述为"在 Agent 和编码任务中持续保持前沿性能的最智能模型"。在多模态理解方面领先 Gemini 3.1 Pro。
Google 发布 Managed Agents(公开预览)¶
Google 在 Gemini API 中推出 Managed Agents 公开预览,支持开发者构建和部署在 Google 托管 Linux 沙箱中运行的自主有状态 Agent。
Anthropic / Claude¶
⭐ Claude Tag 发布(Claude Tag launches on Slack)¶
Anthropic 推出 Claude Tag(beta),在 Slack 中实现 AI 多人协作。基于 Opus 4.8,支持频道上下文记忆、异步任务处理和主动更新。面向 Enterprise 和 Team 客户开放。⭐ 深度推荐(详见深度阅读区)
来源:Anthropic 新闻 | Releasebot
Claude Code 持续升级¶
最新更新包括:沙箱凭据阻止(sandbox.credentials 设置)、组织级模型限制、全屏鼠标支持增强、--resume 修复等。量子位评价"Karpathy 称之为 LLM 第三次变革"。
来源:Claude Code Changelog | 量子位
John Jumper(诺贝尔化学奖得主)加入 Anthropic¶
AlphaFold 核心创造者 John Jumper 于 6 月 20 日离开 Google DeepMind 加入 Anthropic,标志着 Anthropic 在 AI for Science 领域的战略布局。
来源:TechCrunch
Anthropic 首尔办公室开幕¶
6 月 17 日,Anthropic 在首尔开设办公室并宣布与韩国 AI 生态系统的新合作伙伴关系。
来源:Anthropic 新闻
国内大厂动态¶
阿里 QoderWork 推出"峰谷 Token"策略¶
阿里云 QoderWork 推出峰谷 Token 定价,夜间使用 Qwen3.7 低至 2 折,涵盖 QoderWork、Qoder Desktop 等产品。
来源:量子位
百度智能云发布千帆 Token Plan 企业版¶
百度智能云发布千帆 Token Plan 企业版,已率先完成智谱 GLM-5.2 适配。
来源:量子位
智谱 AI GLM-5.2 发布¶
智谱发布 Agent 模型 GLM-5.2,以及通用模型 GLM-4.7、推理模型 GLM-4.7(Thinking Mode)、开源生图模型 GLM-Image。
Momenta 冲刺 IPO——世界模型混战¶
自动驾驶公司 Momenta 率先冲刺 IPO,其世界模型方向的布局引发行业关注。量子位报道"AI 司机收入 3 年涨 42 倍"。
来源:量子位
WAIC 2026 SAIL 奖 TOP30 发布¶
2026 世界人工智能大会 SAIL 奖 TOP30 及青年优秀论文奖 TOP20 正式发布。
来源:量子位
AI 研究前沿¶
DeepSeek V4.1 Flash 登顶 HuggingFace 趋势¶
DeepSeek V4.1 Flash 发布一周内即登上 HuggingFace 趋势模型榜首,中国开源权重模型占据前十中的五席,创历史新高。
NatureBench:评估 AI 编码 Agent 的科学发现能力¶
NatureBench 基于 90 个来自 Nature 期刊的跨学科科学任务,评估 AI 编码 Agent 实现科学发现(而非仅仅复现)的能力。
1 小时真机 RL 微调成功率破 95%:HIL-ResRL¶
HIL-ResRL 框架实现即插即用的 VLA"外挂",真机强化学习微调仅需 1 小时即可将成功率提升至 95% 以上。
来源:量子位
Simon Willison:Prompt Injection 即"角色混淆"¶
Simon Willison 分享了一篇重要研究,证实 LLM 无法可靠区分特权文本和用户输入——模型更依赖文本风格而非实际标签来判断角色。"去风格化"处理可将攻击成功率从 61% 降至 10%。
Simon Willison:将 Moebius 0.2B 图像修复模型移植到浏览器¶
Simon Willison 使用 Claude Code 将 Moebius 0.2B 图像修复模型成功移植为浏览器端 WebGPU 应用,展示了小型模型在浏览器中运行的可行性。
行业观点与解读¶
⭐ Karpathy:Software 3.0 与 Agent 工程(Sequoia Ascent 2026 回顾)¶
Karpathy 在博客中总结了 Sequoia Ascent 2026 的观点:LLM 正成为一种新的可编程层,上下文窗口即新程序。他区分了"氛围编程"(降低门槛)和"Agent 工程"(提升上限)两个概念,认为 AI 时代的核心技能是「可验证性」——AI 在有自动反馈信号的任务上进步最快。
ChatGPT 市场份额首次跌破 50%¶
据报道,ChatGPT 的市场份额首次降至 50% 以下,反映出 AI 聊天应用市场的竞争日趋激烈。
美国科罗拉多州 AI 法案 6 月 30 日生效¶
科罗拉多州《消费者人工智能保护法》(SB24-205)将于 6 月 30 日正式生效,成为美国首部综合性州级 AI 法。该法要求高风险 AI 系统(涉及就业、教育、住房、医疗、金融等决策)的开发者和部署者采取合理措施保护消费者免受算法歧视。
来源:Brownstein | Colorado General Assembly
宝玉(@dotey):Agent 编程八大趋势¶
宝玉分享了 Anthropic 报告揭示的 2026 编程变革趋势,核心观点是编程正从"人写代码"转向"人指挥 AI Agent 写代码"。
来源:X @dotey
值得关注的视频¶
⭐ Satya Nadella × No Priors × Latent Space 联合专访(Microsoft Build 2026)¶
微软 CEO 首次登上 Latent Space 播客,与 swyx、Sarah Guo、Elad Gil 对谈。讨论了前沿 AI 生态建设、统一 Agent 平台、长时间运行的"自动驾驶"Agent Scout 等话题。推荐观看。
来源:Latent Space | Microsoft
B 站 AI 早报近期更新¶
B 站"AI 早报"系列持续日更,近期覆盖了 Claude Fable 5/Mythos 5 发布、Kimi K2.7 Code 开源、MiniMax M3 权重开放等话题。
灵感种子¶
自研芯片:AI 公司的"垂直整合"终局? OpenAI 发布 Jalapeño 推理芯片,加入 Google(TPU)、Amazon(Trainium/Inferentia)的自研芯片阵营。当 AI 公司同时掌握模型、芯片和数据中心,Nvidia 的"卖铲子"商业模式是否面临根本性挑战?更值得关注的是:OpenAI 声称用自己的模型加速了芯片开发——AI 设计 AI 芯片,这是否意味着硬件迭代周期也将被 AI 压缩?
"角色混淆"揭示 LLM 安全的根本困境。 Prompt Injection 研究表明,LLM 通过文本风格而非角色标签来识别指令来源。这意味着目前所有基于"系统提示 vs 用户输入"分离的安全机制都建立在不稳固的基础上。对于正在大规模部署 Agent 的企业来说,这是一个必须认真对待的安全缺口——尤其是当 Agent 需要读取和处理不可信来源内容时。
人才流动重塑 AI 格局。 Google 在一周内失去 Transformer 共同作者和诺贝尔奖得主,这不仅仅是"挖角"故事——它折射出一个更深层的趋势:顶级 AI 研究者正在用脚投票,从大平台流向更聚焦、更灵活的 AI 原生公司。当 OpenAI 获得架构设计的奠基者、Anthropic 获得 AI for Science 的领军人物,未来 12 个月的模型和产品竞争格局可能因此发生显著变化。
合规倒计时:AI 监管从理论走向实践。 科罗拉多州 AI 法案 5 天后生效,这是美国首部针对"高风险 AI 系统"的综合性消费者保护法。对于在就业、金融、医疗等领域使用 AI 做决策的企业,合规准备时间所剩无几。这或许预示着 2026 下半年将有更多州和国家跟进类似立法。
生成时间:2026-06-25 09:06 | 下次更新:明日 9:00