跳转至

AI 每日简报 | 2026-05-08

今日概览

AI 行业迎来密集转折周:OpenAI 向数亿用户免费开放 GPT-5.5 Instant,Anthropic 借 SpaceX 算力突破 API 速率瓶颈,Ilya Sutskever 宣告大模型扩展时代终结。与此同时,中国 AI 产业全面从烧钱补贴转向商业付费,豆包首发订阅制,DeepSeek 启动史上首轮融资。

  • GPT-5.5 Instant 成为 ChatGPT 新默认模型,幻觉减少 52.5%,全部用户免费
  • Anthropic 与 SpaceX 达成 30 万 GPU 算力合作,Claude Code 速率上限翻倍
  • Ilya Sutskever 宣告「扩展时代已结束,研究时代开始」
  • 中国 AI 付费潮:豆包、Kimi、文心同时启动付费订阅
  • DeepSeek 首轮融资估值 450 亿美元,国家大基金领投

深度阅读推荐

以下条目标注为 ⭐ 深度推荐,包含 AI 提炼的核心观点。


⭐ GPT-5.5 Instant 全员免费开放,ChatGPT 默认模型升级

5 月 5 日,OpenAI 将 ChatGPT 默认模型从 GPT-5.3 Instant 切换为 GPT-5.5 Instant,并向全部用户免费开放。新模型在医疗、法律、金融等高风险场景下幻觉虚假陈述减少 52.5%,AIME 2025 数学基准从 65.4 跃升至 81.2,回复长度减少约 30%。新增「记忆来源」功能,主动调用历史对话和 Gmail 数据,并允许用户查看、修正或删除 AI 的推理依据。这是 GPT-5.5 完整版发布后的首个轻量级落地,对标的是「又快又好」的大众体验。

核心观点:OpenAI 的模型分层策略趋于清晰——Instant(日常速度型)、Thinking(深度推理型)、Pro(最高强度型)。GPT-5.5 Instant 解决了 5.3 版本过度谨慎和 4o 过度迎合的两极问题,试图找到准确性与亲和力的新平衡点。同时,52.5% 的幻觉降低不是小修小补,而是对高风险场景可靠性的实质性提升。

来源:TechCrunch | eWeek


⭐ Anthropic 与 SpaceX 达成 30 万 GPU 算力合作

5 月 6-7 日,Anthropic 与马斯克旗下 SpaceX 达成重磅算力协议,获得孟菲斯 Colossus 1 数据中心超过 300 兆瓦算力容量,包括 22 万张以上英伟达 H100/H200/GB200 GPU。该合作立竿见影:Claude Code 五小时速率上限翻倍,Pro/Max 用户取消高峰期限速,Claude Opus API 最高等级输入 Token 速率从每分钟 200 万提升至 1000 万。与此同时,马斯克宣布 xAI 将解散并入 SpaceXAI。

核心观点:这不是一次普通的云计算采购,而是一次行业范式转移的信号。Anthropic 的营收增速碾压 OpenAI(年化 300 亿 vs 250 亿美元),但基础设施瓶颈始终是最大制约。SpaceX 的 GPU 集群原本为 Grok 训练准备,xAI 的解散使其成为闲置产能,Anthropic 的接入本质上是 AI 算力的「供需再匹配」。更大的看点在于:这条合作线将 Anthropic 与马斯克拉入同一阵营,与 OpenAI-微软联盟形成新的对抗格局。

来源:DigiTimes | AI Business | 钛媒体


⭐ Ilya Sutskever:扩展时代已终结,研究时代重启

前 OpenAI 首席科学家、SSI(Safe Superintelligence)创始人 Ilya Sutskever 在 4 月初接受 Dwarkesh Patel 长达 90 分钟深度访谈,宣告「大模型扩展时代(2020-2025)已经结束」,AI 正重新进入以研究突破为核心的年代。他的核心论断:互联网高质量文本数据已基本耗尽,合成数据边际收益递减,100 倍算力不再保证能力跃升。SSI 以 30 亿美元融资押注研究路线,他认为像 AlexNet(2 张 GPU)和 Transformer(8-64 张 GPU)这样的范式级突破,从来不需要极限算力——需要的是洞察。

核心观点:Ilya 的「三个时代」框架——研究时代(2012-2020)→ 扩展时代(2020-2025)→ 重返研究时代(2025-?)——为行业提供了一个高阶认知地图。他最尖锐的观察是「公司比想法还多」:资金充裕的实验室遍地都是,但真正的新方法极度稀缺。这对从业者的启示是:如果你只是在做「更大规模的下一轮训练」,你已经站在了历史的错误一侧。

来源:腾讯云开发者 | Implicator


⭐ Karpathy「锯齿状智能」:AI 能重构 10 万行代码,却让你走路去洗车

在 4 月底红杉 AI Ascent 2026 炉边谈话及后续推文复盘中,Andrej Karpathy 提出了一个尖锐的观察:前沿模型可以重构 10 万行代码并发现零日漏洞,但也会建议你步行 50 米去洗车场洗车——他把这称为「锯齿状智能」(Jagged Intelligence)。原因在于可验证性 + 经济学:RL 训练数据集中在代码、数学等可自动验证且商业价值高的领域,而日常生活常识因验证困难而被忽略。他同时提出「你可以外包思考,但不能外包理解」——Agent 能执行、搜索、总结、编程,但人类仍需判断什么重要、何为真实。

核心观点:Karpathy 的框架给出了一个实用的 AI 应用判断标准:你的任务是否在模型训练过的能力范围内?如果在,AI 会超神;如果不在,它会犯低级错误。这解释了为什么 AI 编码效率惊人但产品决策仍需人类。更深层的警示:「外包思考但不外包理解」意味着人类角色的核心从执行转向判断——如果你不具备理解力,Agent 只会放大你的错误。

来源:机器之心 | 新浪财经


⭐ DeepSeek 启动史上首轮融资,估值 450 亿美元

5 月 6-7 日,多家权威媒体确认 DeepSeek 正洽谈首轮外部融资,国家集成电路产业投资基金(国家大基金)领投,腾讯等互联网巨头参与。估值在短短半个月内从约 200 亿美元飙升至 450-500 亿美元,预计融资 30-40 亿美元。核心驱动因素包括 V4 模型发布后技术实力的认可、核心人才不断被挖走带来的留人压力、以及算力扩张所需的十亿美元级投入。这标志着 DeepSeek 从「不融资不商业化」的极客模式,正式转向资本驱动的中国 AI 头部玩家。

核心观点:国家大基金首次布局大模型公司,意味着中国 AI 政策思路从「硬件补短板」转向「芯片+模型」协同生态。DeepSeek 的 V4-Flash 将 API 价格打到每百万 Token 仅 0.1 元,创全球新低,这种「极致性价比」路线正在重塑全球 AI 定价基准。但人才流失和商业化压力将成为融资后最大的考验。

来源:证券时报 | 36氪 | 东方财富


⭐ 豆包首发付费订阅,中国 AI 行业进入商业变现时代

5 月 4-6 日,字节跳动旗下月活 3.45 亿的 AI 应用「豆包」正式推出付费订阅服务,标准版 68 元/月、加强版 200 元/月、专业版 500 元/月。基础聊天仍免费,付费集中在 PPT 生成、数据分析、视频制作等高算力消耗场景。几乎同时,Kimi 和百度文心也启动了付费方案。摩根士丹利评价此举为「中国 AI 行业迈向商业可持续性的具有深远意义的信号」。

核心观点:中国 AI 的「免费烧钱」时代在 2026 年 5 月正式落幕。驱动因素不只是算力账单(字节 2026 年 AI 基础设施预算约 1600 亿元),更关键的是用户规模已经大到足以支撑付费转化——豆包 3.45 亿月活远超 ChatGPT 的付费用户基数的数倍。这个转折点意味着中国 AI 竞争的焦点从「谁的用户多」转向「谁的用户愿意付钱」。

来源:澎湃新闻 | 证券时报


⭐ DeepMind 千名员工投票组建工会,AI 军事化引发内部抗议

5 月 5 日,超过 1000 名英国 Google DeepMind 员工通过通信工人工会(CWU)和联合工会(Unite)投票支持组建工会——这将是前沿 AI 实验室的首个工会。抗议焦点是 Google 与美国国防部的军事 AI 合同以及 12 亿美元的对以 Project Nimbus 合同。超过 600 名 Google 员工签署公开信反对,员工威胁发起「研究罢工」可能影响 Gemini 等核心产品。他们要求建立独立伦理监督机构,并给予员工拒绝参与特定项目的道德权利。

核心观点:DeepMind 的工会化不是一个孤立事件,而是 AI 行业从「技术乐观主义」进入「伦理责任清算」的标志。当模型能力突破实验室边界进入军事和监控领域,技术人员开始组织化地反抗。这件事的连锁效应可能波及 OpenAI(已有类似五角大楼合作)和 Anthropic(刚刚涉足国防领域)。未来的 AI 人才竞争可能不只是薪资——而是「你能拒绝什么项目」。

来源:Fortune | Engadget


⭐ Claude Managed Agents 推出「Dreaming」功能

Anthropic 在 5 月 6 日的开发者大会上发布 Claude Managed Agents 的「Dreaming」功能,允许 Agent 通过回顾历史会话、识别模式、发现重复错误和团队偏好来进行自我改进。Agent 不再每次从零开始,而是跨会话持续进化。同期发布的还有 Outcomes(目标驱动执行+独立评分 Agent)和 Multi-agent Orchestration(跨专业子 Agent 任务委派)。

核心观点:Dreaming 本质上是 Agent 的「长期记忆 + 元学习」能力。它解决了一个核心痛点:当前 Agent 系统每次会话都是独立、无状态的,而真正的生产力工具需要随时间累积经验和判断力。Anthropic 正在系统性地构建 Agent 的操作系统——Dreaming 是记忆层,Orchestration 是调度层,Outcomes 是评估层。

来源:ZDNet


OpenAI

GPT-5.5 Instant 全员免费开放 | ⭐ 深度推荐(见上方深度阅读区)


OpenAI 发布 GPT-5.5-Cyber 网络安全专用模型 | 5 月 2 日发布,专门面向网络安全场景的 GPT-5.5 变体。公司高管 Chris Lehane 透露,OpenAI 已向美国政府提前开放访问权限用于国家安全测试。该模型正在向全球核心网络安全机构开放。与通用模型不同,Cyber 版本针对漏洞发现、威胁分析等安全任务进行了专项优化。

来源:路透社/Investing.com | 财联社


OpenAI 今年将投入 500 亿美元算力 | 5 月 5 日在与马斯克的诉讼庭审中,OpenAI 总裁 Greg Brockman 透露公司 2026 年预计在算力上花费约 500 亿美元,相比 2017 年的约 3000 万美元增长了超过 1600 倍。Brockman 同时披露,公司迄今已为 2023 年后训练的模型投入约 1200 亿美元用于训练计算资源,并预计在 2027 和 2028 年翻倍。这一数字揭示了前沿模型竞赛的真实壁垒:已经不再是算法之争,而是资本密度之争。

来源:Tech in Asia


OpenAI 与微软重组合作 | OpenAI 与微软重新谈判合作协议,以有时间限制的非排他性 IP 许可(至 2032 年)取代了原有的开放式 AGI 排他条款。微软保留前沿模型的免版税使用权,OpenAI 承诺超过 2500 亿美元的 Azure 云消费。关键变化:OpenAI 现在可以自由部署到 AWS、Google Cloud 和其他云服务商,打破了此前的单一云绑定。

来源:[搜索结果综合] — 此信息来自搜索摘要,原文链接为付费报道


ChatGPT 手机更多细节泄露 | 分析师郭明錤 5 月 5 日披露,OpenAI 的「AI Agent 智能手机」目标 2027 年上半年量产,预计搭载定制联发科 Dimensity 9600 芯片(台积电 N2P 工艺)、双 NPU 架构、LPDDR6 内存和 UFS 5.0 存储。预计 2027-2028 年间出货量约 3000 万台。手机将围绕 AI Agent 而非传统 App 模式设计,这可能成为后智能手机时代的首个硬件形态。

来源:Moneycontrol | Notebookcheck


Google DeepMind / Gemini

Project Mariner 正式关闭 | 5 月 4 日,Google 正式终止了 Project Mariner——这款 AI Agent 曾能以截图方式像人类一样浏览网页。其核心技术被吸收进 Gemini API 和 Gemini Agent。3 月已有征兆,当时项目组员工被重新分配。关闭原因反映了行业大趋势:终端/代码驱动的 Agent(如 OpenClaw、Claude Code)比视觉浏览器 Agent 更可靠、更高效。

来源:Digital Trends | WebProNews


DeepMind 千名员工投票组建工会 | ⭐ 深度推荐(见上方深度阅读区)


Google 正研发 OpenClaw 竞品「Remy」 | Google 内部正在开发代号为「Remy」的个人 AI Agent,定位为 24/7 全天候个人助理,覆盖工作、学习和日常生活场景。据内部文档描述,Remy 可以主动处理任务并学习用户偏好。目前处于内部测试阶段,外界预测可能在 5 月 19-20 日的 Google I/O 2026 上预览。Google 显然看到了 OpenClaw(原 Claude Computer Use 的开源替代)和 Claude Code 的成功,正在将 Gemini 从一个聊天机器人升级为真正的操作系统级助手。

来源:ITPro


Anthropic / Claude

与 SpaceX 达成 30 万 GPU 算力合作 | ⭐ 深度推荐(见上方深度阅读区)


Managed Agents 推出「Dreaming」功能 | ⭐ 深度推荐(见上方深度阅读区)


与黑石、高盛合作成立 15 亿美元企业 AI 服务公司 | Anthropic 联合黑石、Hellman & Friedman 和高盛,成立新的独立 AI 服务公司,注资 15 亿美元。该公司将向医疗、制造和金融服务领域的中型企业直接派驻 Anthropic 工程师,将 Claude 深度嵌入核心业务运营——模式类似于 Palantir 的前沿部署。这与 OpenAI 的「Deployment Company」策略高度相似,两个顶级实验室正同步将触角从平台延伸至行业落地。

来源:ET Now News


IPO 传闻:最早 10 月上市,估值或超 9000 亿美元 | Bloomberg 报道 Anthropic 正考虑最早于 2026 年 10 月进行 IPO,潜在估值可能超过 9000 亿美元。公司年化营收已从 2025 年底的约 90 亿美元飙升至 2026 年 3 月的 300 亿美元以上,首次超越 OpenAI 约 250 亿美元的 ARR。Claude Code 的采用率在 2026 年 Q1 同比增长 80 倍。

来源:Yahoo Finance


国内大厂动态

DeepSeek / Kimi / 豆包 / 智谱 等

DeepSeek 启动首轮融资,估值 450 亿美元 | ⭐ 深度推荐(见上方深度阅读区)


豆包首发付费订阅 | ⭐ 深度推荐(见上方深度阅读区)


Kimi 即将完成 20 亿美元新融资,估值突破 200 亿 | 月之暗面(Kimi)即将完成新一轮 20 亿美元融资,由美团龙珠领投(出资超 2 亿美元),中国移动、CPE 等参投,投后估值突破 200 亿美元。加上年初两轮,Kimi 半年内累计融资超 39 亿美元,成为大模型创业公司中累计融资最多的。与此同时,Kimi 年度经常性收入(ARR)在 4 月已突破 2 亿美元。公司还申请了「KimiClaw」注册商标,涵盖科学仪器类目,引发硬件产品线猜想。

来源:腾讯新闻 | 搜狐


字节发布 Doubao-Seed-2.0-lite 全模态理解模型 | 5 月 6 日,火山引擎发布豆包大模型家族首款全模态理解模型,支持视频、图像、音频、文本原生统一理解。在物理、医疗等高阶学科推理上大幅超越 Pro 版本,实现「音画同步」深度联合推理,支持 19 种语种转写和 14 个语种互译。最独特的是首次实现 GUI 图形界面理解与执行一体化——能像真人一样点击、拖拽、输入,已在电竞复盘、在线教育、跨境电商等场景落地。

来源:搜狐/极客早知道


中国 AI 周 Token 调用量首次领跑全球 | 最新数据显示,中国周 Token 调用量达到 7.94 万亿,环比暴涨 81%,首次在调用规模上大幅超越美国(同期仅 3.26 万亿)。这一数据印证了中国 AI 应用层正在经历爆发式增长,也解释了为何各大厂商在此时启动付费——用户量已足够支撑商业化。

来源:aitop100.cn


国内 AI 价格「全面涨价潮」 | 3 月起阿里云、腾讯云、百度智能云相继上调 AI 算力价格,智谱一季度多次提价,Kimi 输入价格上涨 58%。字节跳动 2026 年 AI 基础设施预算约 1600 亿元(850 亿采购 AI 芯片,750 亿投数据中心),但 2025 年净利润同比下滑超 70%。「烧钱换规模」模式正被全行业抛弃。

来源:澎湃新闻


AI 研究前沿

重要论文、技术突破

GAPT:受睡眠巩固启发的自适应训练算法 | 5 月最新论文提出 Gated Phase Transition(GAPT)——一种在训练过程中自适应切换记忆阶段和压缩阶段的算法,灵感来源于睡眠的记忆巩固机制。在 GPT-2 预训练实验中,该算法将 Matrix-Based Entropy 降低 50%,交叉熵改善 4.8%,分布外泛化(OOD)提升 35%。这不只是一个性能提升,更暗示了一种新的训练范式:不只是堆更多数据和算力,而是优化「学习过程」本身。

来源:HuggingFace Papers


Dephaze 语义锚定:零参数消除 AI 幻觉 | 5 月 4 日发表的论文提出了一种基于数学恒等式 φ³ − φ⁻³ = 4 的推理时校正框架,无需重新训练、不增加参数即可消除 LLM 幻觉。已在 GPT-2、Llama-3.2-3B 和 Mistral-7B 上验证。虽然实际效果待大规模验证,但「零成本消除幻觉」的思路本身值得关注——如果可行,将从根本上改变 LLM 可靠性的讨论。

来源:Zenodo


组件感知自推测解码:混合模型推理加速新方法 | 5 月最新 arXiv 论文(2605.01106)首次利用混合语言模型(如 Falcon-H1、Qwen3.5)的内部架构异质性进行自推测解码,在并行混合模型上达到 0.68 的接受率。这项工作回应了行业对 SSM/Transformer 混合架构日益增长的兴趣,同时解决了混合模型推理效率的实际工程问题。

来源:Papers.cool


行业观点与解读

KOL 重要推文、深度分析文章

Karpathy「锯齿状智能」与 Agentic Engineering | ⭐ 深度推荐(见上方深度阅读区)


Ilya Sutskever:扩展时代终结,研究时代重启 | ⭐ 深度推荐(见上方深度阅读区)


「谁在为中国 AI 买单」——付费潮背后的商业逻辑 | 腾讯新闻深度分析梳理了中国 AI 收费潮的底层逻辑:字节跳动 1600 亿基础设施预算下 2025 年净利润暴跌 70%,算力成本吃掉所有利润。豆包 3.45 亿月活已触及增长天花板,免费模式不可能再持续。有趣的是,用户反应两极分化——一部分人愿意为高级功能付费,另一部分人则认为 AI 聊天「应该是互联网基础设施」。这场争议本质上是 AI 定位之争:工具还是水电?

来源:腾讯新闻


PwC 与 OpenAI 打造首个「AI 原生」财务部门 | 5 月 5 日,PwC 与 OpenAI 宣布扩大合作,共同构建所谓「企业级首个 AI 原生财务职能」。AI Agent 将与人类监督者协同工作,重塑采购、预测、资金管理和会计核账等核心财务流程。这个案例之所以值得关注,不是因为技术有多新,而是因为它代表了 AI 在企业中最具挑战性的落地场景——财务涉及合规、审计和责任追溯,AI 的错误不能容忍。

来源:TMCnet


灵感笔记

以下是今日简报中值得进一步思考的灵感种子,待用户发掘和记录。

  • 「公司比想法还多」(Ilya)→ 当前 AI 行业的真正稀缺品不是资本、不是算力、不是人才——而是新的想法。这对从业者的启示:与其追逐下一个大模型训练,不如思考什么是别人没想到的问题。

  • 「外包思考但不外包理解」(Karpathy)→ 这是一个极具张力的命题。如果理解是不可外包的,那么 AI 时代人类最重要的技能就是判断力。但判断力是可训练的吗?如何训练?这可能是教育领域下一个核心问题。

  • AI 的「付费墙」与「基础水电」之争 → 豆包收费引发的争议触及一个根本问题:AI 聊天应该像搜索引擎一样是免费的公共基础设施,还是像 SaaS 一样是付费生产力工具?两个答案可能都对——取决于 AI 服务提供的价值层级。

  • Agent 记忆的「Dreaming」范式 → Anthropic 的 Dreaming 功能让 Agent 像人类一样通过「睡眠回顾」来学习。这个隐喻很有趣:如果 AI Agent 的发展轨迹模仿人类认知进化(感知→记忆→反思→元认知),那么下一步是什么?自我意识?还是持续学习?

  • 中国 AI 周 Token 调用量 7.94 万亿领跑全球 → 这个数据本身就很震撼。中国在 AI 基础设施(芯片)上的劣势似乎没有阻碍应用层爆发。如果「应用层先飞、基础设施跟后」的模式成立,这对其他发展中国家意味着什么?


生成时间:2026-05-08 07:00 | 下次更新:明日 7:00