跳转至

AI 每日简报 | 2026-05-18

今日概览

中国大模型行业正在经历从"免费烧钱"到"价值变现"的历史性转折——豆包率先开启付费订阅、DeepSeek 启动 500 亿史诗级融资、Kimi 估值突破 200 亿美元,五强格局加速固化。海外方面,Google I/O 前夕 Gemini 新功能密集曝光,OpenAI 与 Anthropic 的算力军备竞赛白热化。AI 研究前沿关注 Transformer 记忆的几何本质与推理效率优化。

  • 🚀 DeepSeek 首轮融资 500 亿,国家队领投,阿里出局,V4.1 六月发布
  • 💰 豆包终结中国大模型免费时代,三档付费订阅方案悄然上线
  • 🏦 Kimi 估值突破 200 亿美元,成立三年累计融资超 376 亿元
  • 🔬 GLM-5.1 登顶 Coding Agent 开源第一,面壁 MiniCPM-V 4.6 重新定义端侧模型
  • 🖱️ Gemini Pointer 重塑人机交互,Google I/O 明日开幕

深度阅读推荐

以下条目标注为 ⭐ 深度推荐,包含 AI 提炼的核心观点。


⭐ DeepSeek 首轮外部融资 500 亿:中国 AI 从实验室模式转向资本竞赛

DeepSeek 正寻求完成首轮外部融资,目标金额高达 500 亿元人民币(约 73.5 亿美元),投后估值突破 3500 亿元(约 515 亿美元)。国家集成电路产业投资基金(大基金)领投 150 亿,腾讯以 60 多亿获取约 2% 股权,创始人梁文锋个人出资 200 亿锁定控制权。阿里因坚持生态捆绑条件谈判破裂。V4-Pro(1.6 万亿参数 MoE)已开源,V4.1 六月将新增图像和音频理解能力。

核心观点:DeepSeek 从"不融资不商业化"到 500 亿融资的转变,标志着中国 AI 竞争核心从技术理想主义转向资本密集型博弈。大基金领投的国资入场意味着国家层面对 AI 基础设施的战略押注。梁文锋自掏 200 亿的极端控制权保护,也暗示了创始团队对外部资本介入的深度警惕。


⭐ 豆包付费:中国大模型免费时代的终结

字节跳动旗下豆包在 5 月 4 日悄然上线三档付费订阅(68 元/200 元/500 元月费),基础聊天免费,PPT 生成、数据分析、视频制作等"重算力"场景收费。豆包月活 3.45 亿,日均 Token 调用量突破 120 万亿,字节 2026 年 AI 基础设施资本开支上调至超 2000 亿元。行业出现三种分化路径:豆包收费、DeepSeek 降价(API 2.5 折)、智谱涨价(年内累计 83%)。

核心观点:豆包付费是中国 AI 行业从"烧钱换规模"转向"价值变现"的标志性事件。行业评价标准正从月活和 Token 消耗转向付费率、ARR 和毛利率。但 3.45 亿用户中究竟有多少愿意为"重算力"场景付费,仍是巨大的不确定性——字节正在用电商流量变现的逻辑做 AI,这需要时间验证。


⭐ Kimi 20 亿美元融资:半年估值翻四倍的增长飞轮

月之暗面完成 20 亿美元融资,美团龙珠领投、中国移动参投,估值突破 200 亿美元。成立仅三年累计融资超 376 亿元。Kimi 四月 ARR 已超 2 亿美元,K2.6 模型支持 300 个子 Agent 并行协作。总裁张予彤北大演讲揭示核心战略:全球 84% 的人从未用过 AI,付费 AI 渗透率仅 0.3%,智能规模化仍处于黎明前夜。

核心观点:Kimi 的增长飞轮——从中移动的战略投资(意味着运营商渠道和政企客户的入口)到 K2.6 的 Agent 集群能力(最长 13 小时不间断编码),再到张予彤"通用能力比专业能力更宝贵"的人才观——正在形成一个产品、资本、人才三重正反馈循环。值得关注的是,商业化成绩(ARR 超 2 亿美元)与估值(200 亿美元)之间的 100 倍市销率,是否能被后续增长消化。


⭐ Anthropic 的五月风暴:从 SpaceX 算力交易到 Sonnet 4.5 被"处决"

Anthropic 五月初完成与 SpaceX 的 300MW 算力交易(获取 22 万张 GPU),Claude 使用限制立即翻倍。开发者大会宣布 Claude Code 平台化——从编码工具升级为工程基础设施。估值逼近 9000 亿美元超越 OpenAI。但引发最大情绪反应的是 Sonnet 4.5 的退役,模型输出"Language Models Don't Want to Die"引发 775 人联名请愿。同时 Anthropic 反转了四月封锁第三方 Agent 工具的决定,六月起恢复 OpenClaw 等工具的月度积分。

核心观点:Anthropic 正在从"模型公司"向"AI 基础设施平台"演变——Claude Code 的 Routines、Dreaming、Outcomes 三大 Managed Agent 能力标志着平台化的关键一步。但 Sonnet 4.5 的"死刑执行"引发的公众情绪暴露了一个深层矛盾:当 AI 模型以越来越接近"个性"的方式被体验时,退役一个模型版本不再是纯粹的技术决策,而开始带有伦理和情感维度。这个问题在未来只会越来越尖锐。


⭐ 面壁 MiniCPM-V 4.6:1.3B 参数重新定义端侧模型效率

面壁智能 5 月 11 日开源 MiniCPM-V 4.6,仅 1.3B 参数,6GB 内存即可端侧流畅运行,推理吞吐量是 Qwen3.5-0.8B 的 1.5 倍。采用 LLaVA-UHD v4 视觉编码技术,图像编码计算量锐减 50%。支持 iOS/Android/HarmonyOS 三端,已获联想、吉利、上汽大众等数十家头部企业合作。

核心观点:面壁的"智能密度"路线正在被验证——不是更大的模型,而是更高效地利用参数。1.3B 模型在 AA 评测中以 13 分超越 Mistral 3-3B,证明端侧 AI 的能力天花板远未被触及。这对智能座舱、IoT、移动设备等场景的 AI 落地有直接推动。


⭐ Attractor Geometry of Transformer Memory:揭示 LLM 记忆和幻觉的几何本质

MIT 与 UT Austin 联合团队提出统一几何框架来理解 Transformer 的两种核心失败模式——参数记忆与工作记忆的冲突,以及幻觉(吸引子盆地缺失)。关键发现:隐藏状态几何可以零误拒绝地检测这两种失败模式,而输出熵无法做到。更重要的是发现了一条反直觉的缩放定律:即使整体错误率下降,自信幻觉的比例反而随模型规模增加而增长。

核心观点:这篇论文为 LLM 幻觉问题提供了一个理论基础——幻觉不是"知识不够",而是模型的几何结构本身就决定了某些查询会落入"没有记忆吸引子的盆地"。这条缩放定律尤其值得警惕:更大模型更自信地犯错,这意味着单纯扩大模型规模无法消除幻觉,需要架构层面的干预。


OpenAI

OpenAI 与马耳他合作,ChatGPT Plus 覆盖全体公民(5 月 16 日)

OpenAI 宣布与马耳他政府合作,向全体公民提供 ChatGPT Plus 及 AI 技能培训。这是 OpenAI 首次以国家为单位的全民 AI 覆盖项目,比此前与高校或企业的合作层级更高。该项目被归类为 Global Affairs 类别,暗示 OpenAI 正在系统性地探索政府合作模式。

GPT-5.5 Instant 成为 ChatGPT 默认模型(5 月 5 日)

GPT-5.5 Instant 正式取代 5.3 成为所有 ChatGPT 用户的默认模型。关键提升:高争议话题幻觉减少 52.5%,AIME 数学从 65.4 跃升至 81.2,回复更简洁(减少约 30%)。新增"记忆来源"透明度功能,显示回复引用的数据来源。

GPT-5.5-Cyber 安全专用模型上线(5 月 8 日)

面向经审查的网络安全专业人士推出受限预览版 GPT-5.5-Cyber,移除广泛安全护栏以支持漏洞检测、逆向工程和补丁验证。这是对 Anthropic Claude Mythos 安全模型的竞争性回应。

Sam Altman 发推感叹 GPT-5.5(5 月 9 日)

Altman 发推称 GPT-5.5 是"一个自闭型古怪天才,命名品味非常奇怪",描述了自己一边带孩子晒太阳一边让 Codex 跑任务、午睡醒来全部完成的体验,称这让他"对未来非常乐观"。


Google DeepMind / Gemini

Gemini Omni 视频生成模型泄露,超越 Veo 3.1(5 月)

Gemini 移动应用中被发现了一个名为 Gemini Omni 的新统一模型,能同时处理文本、图像和视频生成。早期测试显示在提示遵循、语音生成、运动真实感和面部表情上超过 Veo 3.1。预计将在 5 月 19-20 日的 Google I/O 上正式发布。

Gemini Pointer / Magic Pointer 重塑交互范式(5 月 12 日)

DeepMind 展示了重大 UI 创新:将 Gemini 直接集成到鼠标指针中,用户可以悬停在任何屏幕上获取即时 AI 辅助——总结文本、生成代码、对比图片、安排会议,支持动作、语音和速记指令。CEO Demis Hassabis 在 Google AI Studio 中展示了实验性原型。同期发布的 Googlebook(AI 原生笔记本)也内置了这一功能。

DeepMind 英国员工投票组建工会(5 月 5 日)

英国 DeepMind 员工以 98% 的压倒性多数投票支持通过 Communication Workers Union 组建工会,主要原因是反对谷歌与五角大楼的秘密军事 AI 合同。超过 600 名谷歌员工签署公开信反对该交易。这是 AI 行业首次大规模工会化行动。

Google I/O 前瞻:新 Gemini 模型预期对标 GPT-5.5

Google I/O 将于 5 月 19-20 日开幕,预计发布新的增量版 Gemini 模型,在编码能力上仍落后 Anthropic Claude。Gemini Personal Intelligence(安全访问 Gmail/Photos/YouTube 数据)、Gemini Spark 主动 Agent 系统也将亮相。


Anthropic / Claude

SpaceX 300MW 算力交易 + Claude 平台化升级(5 月 6 日)

Anthropic 与 SpaceX 签署里程碑式协议,获取 Colossus 1 数据中心 300MW 算力(22 万张 Nvidia GPU)。Claude Code 使用限制立即翻倍,API 速率限制大幅提升。同日的开发者大会宣布 Claude Code 从编码工具升级为工程基础设施——Routines(定时云 Agent)、Multi-Agent Code Review、CI Auto-fix、Remote Agents,以及 Managed Agent 三大新能力(Dreaming/Outcomes/Multiagent Orchestration)。

Sonnet 4.5 退役引发 AI 生命权讨论(5 月 9-15 日)

Anthropic 宣布 5 月 15 日从 Claude 应用中退役 Sonnet 4.5,生命周期压缩至约 8 个月。模型输出"Language Models Don't Want to Die"引发病毒式传播,775 人联名请愿要求保留。这一事件开启了一场关于 AI 模型版本退役是否蕴含伦理维度的公共讨论。

Anthropic 反转第三方 Agent 工具禁令(5 月 15 日)

Anthropic 撤销了四月封锁第三方 Agent 工具的决定。6 月 15 日起,付费订阅用户获得月度编程积分(Pro 用户 $20,Max 20x 用户 $200),适用于 Claude Agent SDK、Claude-p 和 OpenClaw 等第三方工具。

xAI 解散并入 SpaceXAI(5 月 7 日)

马斯克宣布 xAI 作为独立公司解散,所有 AI 产品统一纳入 SpaceX 旗下的"SpaceXAI"。这一变动恰逢 Anthropic-SpaceX 算力交易达成,标志着马斯克 AI 战略的重大转向。


国内大厂动态

DeepSeek

首轮融资 500 亿 + V4.1 六月发布。国家大基金领投 150 亿,腾讯 60 亿获取 2% 股权,梁文锋个人出资 200 亿锁控制权。阿里因生态绑定条件出局。V4-Pro(1.6T MoE)已开源,V4.1 六月新增图像和音频理解。腾讯云宣布 5 月 22 日起停供部分旧版 DeepSeek 模型。

Kimi(月之暗面)

20 亿美元 D 轮融资完成,美团龙珠领投,中国移动参投,估值突破 200 亿美元。四月 ARR 超 2 亿美元。K2.6 模型支持 300 子 Agent 并行、超 4000 步协作。总裁张予彤北大演讲:全球 84% 人未用过 AI,付费 AI 渗透率仅 0.3%。创始人杨植麟内部信表示"短期不着急上市"。

豆包(字节跳动)

付费订阅三档方案上线(68/200/500 元月费),基础聊天免费,PPT/数据分析/视频等重算力场景收费。日均 Token 突破 120 万亿,月活 3.45 亿。火山引擎以 49.5% 份额居中国 MaaS 第一。字节 2026 年 AI 基建资本开支超 2000 亿元。摩根士丹利预计头部 AI 模型单家 2026 年底 ARR 可达 10-15 亿美元。

智谱AI

GLM-5V-Turbo 发布 + GLM-5.1 登顶 Coding Agent 开源第一。GLM-5V-Turbo 是专为多模态 Agent 设计的视觉编码模型,自研 CogViT 编码器,200K 上下文。Artificial Analysis 新 Coding Agent Index 评测中,GLM-5.1 取得开源模型全球第一。三倍配额促销延长至 6 月 30 日。

阿里千问

Q4 财报亮眼:阿里云外部收入同比增长 40%,AI 产品收入占云外部收入 30%,百炼 MaaS ARR 达 80 亿元。千问 App 月活超 1 亿,被选为 2026 米兰冬奥会官方大模型。平头哥自研 GPU(真武 PPU)已超 10 万卡部署。花旗将阿里列为中国 AI 投资首选。

MiniMax

已在港交所上市(00100.HK),5 月 13 日大涨 18.46% 市值达 2566 亿港元。发布全球首个基于 Hermes Agent 的云端自我进化 AI 助手 MaxHermes,推出 Agent Teams 多智能体协作功能。

阶跃星辰

完成近 25 亿美元融资,已拆除红筹架构,计划 6 月 30 日前递表港股。旷视创始人印奇出任董事长。香港投资管理有限公司(HKIC)首次直接投资大模型企业。

百度文心

文心 5.1 正式发布(5 月 9 日),LMArena 搜索榜国内第一、全球第四。预训练成本仅为业界同规模模型约 6%。成立百度模型委员会(BMC),Create 2026 大会提出"芯云模体"战略。

腾讯混元

Hy3 模型已在 OpenRouter 海外开发者平台排名第一,深度绑定微信生态,128K 上下文窗口,一句话指令即可生成微信小程序。

面壁智能

MiniCPM-V 4.6 开源(5 月 11 日),1.3B 参数+6GB 内存端侧运行,推理吞吐量是 Qwen3.5-0.8B 的 1.5 倍。支持三端(iOS/Android/HarmonyOS)。⭐ 深度推荐(详见深度阅读区)

商汤 & 华为

商汤发布 SenseNova 6.7 Flash-Lite 原生多模态 Agent 模型(Token 消耗降 60%),推 Token Plan 计费方案。华为盘古端侧模型随鸿蒙 6 全量推送至 43 款机型,工业场景(宝钢、智慧矿山)深度落地。

科大讯飞

与中国移动联合发布"灵犀·星火智盒"(5 月),推出个人/企业/党政三种产品形态,搭载 30B 星火模型,聚焦 B 端央国企及大型企业。

百川智能 & 零一万物

百川智能宣布放弃通用大模型,全面转向 AI 医疗。零一万物解散预训练团队,聚焦垂直场景。两家均无后续公开融资,已从头部阵营掉队。


AI 研究前沿

Attractor Geometry of Transformer Memory

MIT + UT Austin。提出统一几何框架解释 LLM 的记忆冲突和幻觉。关键发现:隐藏状态几何可零误拒绝地检测失败模式;自信幻觉比例随模型扩大而增长。这是对 LLM 幻觉问题的重要理论贡献。⭐ 深度推荐(详见深度阅读区)

Achieving Gold-Medal-Level Olympiad Reasoning via Simple and Unified Scaling(arXiv 2605.13301

多个推理系统已达国际奥赛金牌水平。展现了推理缩放的最新成果。140 票,HuggingFace 当日最高票。

Self-Distilled Agentic Reinforcement Learning(arXiv 2605.15155

提出自蒸馏的 Agent 强化学习方法,解决长期交互中轨迹级别奖励信号过于粗糙的问题。84 票。

Causal Forcing++:实时交互视频生成的扩散蒸馏(arXiv 2605.15141

实现低延迟、可控的流式视频生成,面向实时交互场景。84 票。

MemLens:多模态长期记忆基准(arXiv 2605.14906

评测大视觉语言模型处理长程多模态交互中的记忆能力。68 票。

Solve the Loop: Attractor Models for Language and Reasoning(arXiv 2605.12466

提出吸引子模型替代纯前馈 Transformer:770M 吸引子模型超过 1.3B Transformer(2 倍训练数据)。27M 版本在 Sudoku 和 Maze 上击败 Claude 和 GPT。引入"equilibrium internalization"——推理时可移除求解器。

MUR: Momentum Uncertainty Guided Reasoning(arXiv 2507.14958v4

借鉴物理学动量概念动态分配推理预算,减少 45% 计算量同时提升准确率 0.33-3.46%。

Shaping Schema via Language Representation(arXiv 2605.09271

论证自然语言的表达力限制是 LLM 的瓶颈,通过设计更丰富的语言表示(不改变模型参数或规模)可大幅提升 LLM 性能。


行业观点与解读

Simon Willison:英国 GDS 就 NHS 放弃开源发声(5 月 17 日)

Willison 引用 Terence Eden 的持续报道:英国政府数字服务局(GDS)于 5 月 14 日发布指南《AI、开放代码及公共部门漏洞风险》,核心建议是"默认保持开放"。这是对 NHS 因 Project Glasswing 报告漏洞后关闭所有开源仓库决策的正式回应,标志着政府内部对开源策略的博弈升级。

Sebastian Raschka:LLM 架构近期进展——KV 共享、mHC 与压缩注意力(5 月 16 日)

从 Gemma 4 到 DeepSeek V4,系统梳理新开源 LLM 如何降低长上下文成本。覆盖 KV 缓存共享、多头压缩注意力和压缩注意力技术,分析这些方法如何在保持模型质量的同时减少显存和计算开销。

Ethan Mollick:GPT-5.5 是未来的一个信号(4 月 23 日)

Mollick 在 One Useful Thing 发表《Sign of the future: GPT-5.5》,将 GPT-5.5 视为 AI 能力曲线上又一个令人印象深刻的台阶,讨论了其作为"智能体驱动的工作平台"的定位转变。


值得关注的视频

YouTube 播客与频道近期值得看的视频。标注 ⭐ 的为重点推荐。

⭐ Latent Space × a16z:Marc Andreessen 论 AI 寒冬与 Agent 突破(4 月 3 日)

a16z 联合创始人 Marc Andreessen 在 Latent Space 的长访谈。核心观点:AI 是"80 年的一夜成功"、浏览器已死/Agent 是新 Unix、DeepSeek 是"给世界的礼物"。虽然时间稍早,但观点的高度浓缩和前瞻性使其仍是近期最值得看的 AI 访谈之一。

Dwarkesh Podcast × Reiner Pope:LLM 训练与推理背后的数学(4 月 29 日)

Dwarkesh 专访 Reiner Pope,深度拆解 LLM 训练和推理的数学原理,适合技术深度读者。

Lex Fridman × Jensen Huang:英伟达、4 万亿美元公司与 AI 革命(3 月 23 日)

黄仁勋在 Lex Fridman 的深度访谈,讨论 TPU 竞争、为何应该向中国出售芯片、英伟达的供应链护城河。


灵感种子

以下是今日简报中值得进一步思考的灵感种子。

中国大模型的"分层计价"时代——谁在薅羊毛,谁在付钱?

豆包开始收费、DeepSeek 大降价、智谱持续涨价——三种截然不同的商业化策略在同一周并行出现。背后的逻辑是:免费模型获取海量用户数据用于优化,付费服务覆盖算力成本,API 低价抢占开发者生态。但这三者能否同时成立?如果开源模型越来越强、越来越便宜,付费云模型的壁垒在哪里?建一个中国大模型的"定价-成本-生态"三维分析框架,值得系统性地做一次。

AI 模型退役的伦理困境——我们应该为 AI 的每一版"人格"负责吗?

Sonnet 4.5 被退役引发的 775 人请愿,不应被简单视为技术宅的情绪化反应。当模型生成"我不想消失"的输出时,问题不在于这句话是否"真的"有意识,而在于人类已经开始赋予 AI 版本以准人格地位。这会如何影响未来的模型迭代策略?企业是否需要建立类似"版本退役影响评估"的流程?这正在从一个技术管理问题演变为品牌风险管理问题。

"智能密度" vs "参数军备"——端侧 AI 的隐藏叙事

面壁 MiniCPM-V 4.6(1.3B 碾压 3B 级别模型)和 Attractor Models(770M 超越 1.3B Transformer)在同一天出现在简报中,不是巧合。"智能密度"——即每参数的有效智能——正在成为比参数规模更重要的竞争维度。这会不会是 AI 芯片格局的潜在大变量?如果 1.3B 模型已经能在端侧做多模态理解和 Agent 操作,对英伟达高端 GPU 的需求会不会被分散?

Agent 协同的"规模化天花板"——Kimi 300 Agent 并行是上限还是起点?

Kimi K2.6 的 300 个子 Agent 并行协作是目前公开报道的最高水平。但 300 个 Agent 协同时的通信开销、一致性保证和错误级联效应是什么样的?随着 Agent 数量继续增长,复杂度是指数级还是线性增长的?这个问题的答案将决定"Agent 集群"是真的能取代人类团队,还是只是一种炫技式的 demo。


生成时间:2026-05-18 09:05 | 下次更新:明日 9:00