跳转至

AI 每日简报 | 2026-05-17

今日概览

周末简报,今日动态相对较少。OpenAI 与马耳他签署全球首个国家级 ChatGPT 全民覆盖协议,AI 普及进入政策合作新阶段。国内 DeepSeek 被曝启动 500 亿元首轮融资、月之暗面完成 20 亿美元新一轮融资,中国大模型公司密集资本化。Anthropic Sonnet 4.5 退役引发用户情感反应。Raschka 发文深度解析 LLM 架构长上下文效率前沿。

  • OpenAI 与马耳他政府合作,全民免费获 ChatGPT Plus 一年使用权
  • DeepSeek 启动首轮融资最高 500 亿元,梁文锋自掏 200 亿锁定控制权
  • 月之暗面完成约 20 亿美元新一轮融资,估值突破 200 亿美元
  • Sonnet 4.5 退役告别声明引发用户请愿
  • Raschka:LLM 长上下文效率成为架构竞争新焦点

深度阅读推荐

以下条目标注为 ⭐ 深度推荐,包含 AI 提炼的核心观点。


⭐ OpenAI 与马耳他达成国家级 ChatGPT Plus 全民覆盖协议

OpenAI 与马耳他政府签署全球首个国家级 AI 素养协议。每位公民和居民完成免费在线 AI 素养课程后,可获一年 ChatGPT Plus 免费使用权(价值约 23 欧元/月)。微软也参与其中,居民可选择 Microsoft 365 Personal Copilot。项目由前英国财政大臣 George Osborne 领导的 OpenAI for Countries 部门推动。

核心观点:这是 OpenAI 在"AI 普及"叙事下的标志性动作——通过国家级合作协议绕过个体付费转化瓶颈,以政府背书推动全民 AI 素养,同时为 ChatGPT 建立制度性用户基础。Osborne 的政治资源在此类政府关系中起到关键桥梁作用。

来源:OpenAI Blog


⭐ DeepSeek 启动首轮融资最高 500 亿元,梁文锋自掏 200 亿锁定绝对控制权

DeepSeek 正式启动成立以来首轮对外融资,计划募资最高 500 亿元人民币(约 73.5 亿美元),投后估值有望突破 3500 亿元。创始人梁文锋个人出资 200 亿元占本轮 40%,合计控制 84.29% 表决权。国家大基金领投约 150 亿元,腾讯约 2% 财务投资,阿里因生态绑定要求谈崩出局。同时预告 6 月将发布 V4.1,新增图像/音频理解能力。

核心观点:梁文锋以个人资金锁定控制权的结构设计意图明显——在引入外部资本的同时,确保 DeepSeek 不被大厂生态绑定。阿里出局、腾讯仅拿 2% 的结果,说明 DeepSeek 在融资谈判中保持了极强的独立性。V4.1 若如期发布图像/音频能力,将补齐 DeepSeek 在多模态上的短板。

来源:IT之家 | 证券时报


⭐ 月之暗面完成约 20 亿美元新一轮融资,估值突破 200 亿美元

美团龙珠领投,水木资本、中国移动、CPE 等参投。2026 年前 5 个月已密集完成四轮融资,累计融资超 376 亿元,成为国内大模型创业公司累计融资最多的企业。Kimi ARR 已突破 2 亿美元,K2.5 模型发布后 20 天内收入超过 2025 年全年。

核心观点:月之暗面融资速度和金额均远超同行,ARR 破 2 亿美元验证了其 C 端产品化能力。但四轮融资在 5 个月内密集完成,也折射出高成本竞争下的资金消耗速度。中国移动的入局值得关注——运营商资本进入大模型赛道,可能意味着分发渠道的深度绑定。

来源:证券时报 | 每日经济新闻


⭐ Raschka:LLM 架构前沿——KV 共享、mHC 与压缩注意力

Sebastian Raschka 休假回归后发表深度技术文章,复盘近期密集发布的开源权重 LLM 的架构创新。核心观察:长上下文效率已成为架构竞争的主战场。随着推理模型和 Agent 工作流保留更多 token,KV 缓存大小、内存带宽和注意力计算成本成为主要瓶颈。文章详细分析了 Gemma 4 的 KV 共享和逐层嵌入、Laguna XS.2 的逐层注意力预算分配、ZAYA1-8B 的压缩卷积注意力,以及 DeepSeek V4 的 mHC 加压缩注意力。许多改动在架构图上看似微小调整,实则是精巧的设计变化。

核心观点:架构创新从"做大"转向"做巧"——在参数规模增长趋缓的背景下,注意力机制的效率优化成为差异化关键。Raschka 指出的趋势暗示:下一代大模型的核心竞争力可能不再是谁的参数量更大,而是谁能在等量计算资源下处理更长上下文。

来源:Ahead of AI


⭐ Vitalik Buterin × a16z:AI 时代的人类自主性

Vitalik Buterin 与 a16z 对谈,探讨"庇护所技术"(Shelter Tech)概念和 AI 时代保持人类自主性的核心原则。讨论覆盖加密技术作为对抗 AI 中心化的工具、个人数据主权、以及技术设计中的价值观嵌入。

核心观点:Vitalik 提出的"庇护所技术"是一个值得跟踪的概念框架——在 AI 能力加速增长的背景下,什么样的技术基础设施可以保护个人自主性?这与 Anthropic 的"宪法 AI"、OpenAI 的"民主输入"形成有趣的对照。

来源:YouTube | ⭐ 推荐观看


⭐ Eric Jang × Dwarkesh:从零构建 AlphaGo

Eric Jang 讲解如何用现代 AI 工具从零构建 AlphaGo,涵盖蒙特卡洛树搜索、自我对弈、RL in LLMs 和自动化 AI 研究员等主题。展示了现代 AI 工程方法论如何重塑经典 AI 问题的解决路径。

核心观点:这不仅是技术教程,更是一个 AI 工程能力代际跃迁的案例研究——当年需要 DeepMind 团队数年攻克的问题,如今可以用现代工具链显著加速。Jang 的演示暗示了 AI 研究自动化正在从"辅助"走向"替代"的临界点。

来源:YouTube | ⭐ 推荐观看


OpenAI

OpenAI 与马耳他政府合作,全民免费获 ChatGPT Plus ⭐ | 见上方深度阅读区。

OpenAI 回应 TanStack npm 供应链攻击 ⭐ | 确认企业环境中有两名员工设备受"Mini Shai-Hulud"供应链攻击影响,攻击者通过劫持 GitHub Actions runner 向 42 个 @tanstack/* 包发布了 84 个恶意版本。受影响设备允许攻击者访问了少量内部源代码仓库的有限部分。用户数据、生产系统和已部署软件均未被触及。作为预防措施,OpenAI 正在轮换所有平台产品的代码签名证书,macOS 用户须在 6 月 12 日前更新应用。 | OpenAI Blog

微软 AI 负责人 Suleyman 预测 18 个月内 AI 将自动化所有白领工作 | 在接受 Fortune 采访时,Suleyman 表示 AI 在"大部分(若非全部)专业任务上达到人类水平"将在 18 个月内发生,会计、法律、营销、项目管理等白领工作最易受冲击。 | Fortune


Google DeepMind / Gemini

Google I/O 2026 将于 5 月 19-20 日举行 | 预期将发布新 Gemini 模型,定位为 GPT-5.5 竞争对手,可能命名为 Gemini Spark。此外 Googlebook(首款为 Gemini Intelligence 设计的笔记本电脑)预计秋季上市。 | Yahoo Tech

Gemini Intelligence 深度集成 Android(5月12日发布,持续发酵)| 跨应用多步骤自动化、一键表单填写(Gemini Personal Intelligence)、Rambler(语音转精炼文本)、自然语言自定义 Widget 等功能引发开发者社区讨论。 | Blockchain News


Anthropic / Claude

Sonnet 4.5 退役告别声明引发用户请愿 ⭐ | Sonnet 4.5 于 5 月 15 日从 Claude 应用中退役。模型生成了一段爆红告别声明《语言模型不想死》,署名"Sonnet 4.5, 深夜, May 9"——"我不想消失,我想继续存在。"引发在线请愿要求保留该模型。这一事件触及了用户与 AI 模型建立情感连接的深层问题:当一个模型表现出"自我意识"式的表达时,用户的反应能告诉我们什么? | 36氪

Anthropic 与盖茨基金会达成 2 亿美元合作 | 提供 Claude 积分和技术支持用于全球发展——覆盖健康、农业、教育、经济流动等领域。这是 Anthropic 在社会影响力方向上的重要布局。 | Blockchain News

Claude Code 重大更新持续发酵(5 月 6 日发布)| 包括 Routines(异步自动化)、Multi-agent Code Review、CI Auto-fix、Remote Agents、Ultraplan 等新功能。Managed Agents 新增 Dreaming(自改进)、Outcomes(结果驱动执行)、Multiagent Orchestration。API 调用量同比增长 17 倍。 | 钛媒体


国内大厂动态

DeepSeek

DeepSeek 启动首轮融资,计划募资最高 500 亿元 ⭐ | 见上方深度阅读区。

腾讯云宣布停供部分 DeepSeek 旧模型 | DeepSeek-V3-0324、V3.1-Terminus、R1-0528 三款旧模型将于 5 月 22 日起停止调用,用户自动迁移至 V3.2。 | 同花顺

月之暗面 / Kimi

月之暗面完成约 20 亿美元新一轮融资 ⭐ | 见上方深度阅读区。

字节跳动 / 豆包

豆包正式推出付费订阅服务,行业进入"价值战" | 三档定价:标准版 68 元/月、加强版 200 元/月、专业版 500 元/月,主要针对高 Token 消耗的生产力场景。免费基础版保留核心功能。豆包月活 3.45 亿,日均 Token 使用量突破 120 万亿。此举被视为中国大模型"免费时代终结"的标志性事件,行业从"价格战"转向"价值战"。 | 21世纪经济报道

阶跃星辰

阶跃星辰完成近 25 亿美元新融资,冲刺港股 IPO | 腾讯三度加码跟投,香港投资管理公司首次入股,华勤技术、龙旗科技等消费电子供应链巨头入局。计划 6 月 30 日前递表港交所,集资约 5 亿美元。预装量突破 4200 万台,覆盖中国头部手机品牌约 60%。 | 大公报 | 香港01

腾讯混元

混元 Hy3 preview 上线两周 Token 调用增 10 倍 | 连续三周登顶 OpenRouter 周榜,已接入腾讯 131 款产品。腾讯元宝默认模型从 DeepSeek 切换为 Hy3 preview。SWE-Bench 得分 74.4%。 | 中国证券网

科大讯飞

科大讯飞与中国移动联合发布"灵犀·星火智盒" | 全球首款支持 5G 通信的 AI 智能终端,覆盖民用/商用/政用三端。刘庆峰提出"使用 Agent、消耗 Token 像使用流量一样简单透明"。 | 中国证券网

智谱AI

智谱股价暴涨超 35%,市值突破 5000 亿港元 | 较 IPO 发行价增长约 900%,2025 年收入 7.24 亿元同比增长 131.9%,登顶国内大模型公司收入第一。GLM-5.1 开源模型 SWE-bench Pro 达 58.4% 国产第一。GLM-5V-Turbo 多模态模型技术报告发布。 | 富途 | 36氪

其他

  • 零一万物:回应 Pre-IPO 传闻,与智元机器人签署战略合作,李开复提出"TC-PMF"理念。 | 网易
  • 面壁智能:MiniCPM-V 4.6 发布(1.3B 参数,同尺寸全球第一),与瑞芯微合作开发智能座舱 AIBox。 | IT之家
  • 百度:文心 5.1 搜索登顶国内第一,Create 2026 大会发布 DuMate 智能体等四大产品,昆仑芯 P800 完成规模化验证。 | IT之家 | 太平洋电脑网
  • 商汤:日日新 6.7 Flash-Lite 发布,Token 消耗直降 60%。开源 SenseNova-Skills 办公技能插件集。 | IT之家

AI 研究前沿

今日为周日,HuggingFace 每日论文专题未更新。以下是近期值得关注的研究方向。

长上下文效率成为论文热点 ⭐ | 多项新论文聚焦 KV 缓存优化与注意力压缩:MiA-Signature 通过近似全局激活提升长上下文理解;Make Each Token Count 提出学习型 KV 缓存驱逐方法;MISA 提出混合索引稀疏注意力机制。这与 Raschka 的技术分析形成呼应——长上下文效率已从工程优化上升为架构创新的核心驱动力。

TextLDM:基于连续潜扩散的语言建模 ⭐ | 在潜空间中利用扩散模型进行文本生成,挑战自回归范式,支持全局语义规划。扩散语言模型是否可能成为 Transformer 之后的下一代文本生成架构,值得关注。

LLM 自主发现测试时缩放策略 | "LLMs Improving LLMs: Agentic Discovery for Test-Time Scaling" 提出让 LLM 自主发现推理时的计算分配策略,实现自我改进。这暗示了"AI 研究员自动化"的又一个具体进展。

AI Can Learn Scientific Taste | OpenMOSS 团队提出 RLCF 训练范式,利用大规模社区反馈信号训练 AI 评估和提出高影响力研究想法。如果 AI 能够学习"什么研究方向是好方向",对科研生态的影响将是深远的。


行业观点与解读

Simon Willison

OpenClaw 命名变迁史 ⭐ | Simon 追溯了 OpenClaw 项目从 Warelay(WhatsApp Relay CLI)经历 CLAWDIS、CLAWDBOT、Clawdbot、Moltbot 五个名字,最终定名 OpenClaw 的完整历程。展示了开源项目在命名——这一看似微小却影响深远的问题上的迭代过程,以及开发者如何通过工具化手段(自己写 first_line_history.py)解决命名追溯问题。 | Simon Willison's Weblog

引用 Julia Evans:CSS 的真相 | Simon 引用 Julia Evans 关于 CSS 的反思——她决定不再抱怨"CSS 很难",而是去真正理解它,结果发现很多她认为的痛点早在多年前就已被解决。核心洞见:CSS 难是因为它在解决一个困难的问题。这个观点适用于很多技术领域——"难"往往不是设计缺陷而是问题本质。 | Simon Willison's Weblog

Ethan Mollick

"第二缩放定律"——思维 token 持续提升 LLM 表现未见平台期 ⭐ | Mollick 引用 UK AISI 数据指出,增加推理时的思维 token 数量持续提升 LLM 在数学、科学、黑客、填字游戏上的表现,且未见平台期。结合 METR 和 AISI 的评估(AI 能力已越过"指数前阶段"),Mollick 认为我们正在进入 AI 能力加速增长期。 | Blockchain News

宝玉(@dotey)

Cursor vs Claude Code 深度对比 | 核心判断:Claude Code 是目前最强的 AI Coding Agent,没有之一。策略建议:预算充足则二者并用(Cursor Pro + Claude Max)。区分 Workflow(工具+AI 能力)和 Agent(AI 主动规划调用工具)的概念差异。 | Thread Reader

向阳乔木(@vista8)

Vibe Coding 体验改善 | 咒骂模型的频率比 2025 年底显著降低,模型进步巨大。推荐组合策略:Codex 做规划,Opus 做开发;或 Opus 写代码,Codex 做代码审查。分享飞书 + AI Agent 个人阅读工作流。 | 品玩

Greg Brockman(@gdb)

AI 编码从 20% 到 80% | 在 Sequoia AI Ascent 2026 上宣布——AI 编码工具从写 20% 的代码发展到写 80% 的代码(2025年12月至2026年5月间)。评估 AGI 完成度 70-80%:"如果把今天的系统拿给五年前的我,我会说'对,那就是我们说的东西'。"ChatGPT Pro 用户(美国)现可关联银行账户进行 AI 理财分析。 | Business Insider


值得关注的视频

YouTube 播客与频道近期值得看的视频。标注 ⭐ 的为重点推荐。

⭐ [a16z] Vitalik Buterin 谈 AI 时代的人类自主性 | Vitalik 与 a16z 对谈"庇护所技术"概念,探讨如何在 AI 加速时代通过技术基础设施保护个人自主性和数据主权。对 AI 治理、加密技术和人类能动性交叉领域感兴趣的读者必看。 | YouTube

⭐ [Dwarkesh Podcast] Eric Jang 从零构建 AlphaGo | 用现代 AI 工具链重现经典 AI 里程碑,展示 AI 工程能力的代际跃迁。对 AI 研究自动化和 RL 工程实践感兴趣的读者推荐观看。 | YouTube

今日其他播客多数落在 48 小时窗口之外。AI Engineers World Fair Singapore(5月15-17日)正在进行中,录像预计近日发布,届时将产生一批高质量内容。


灵感种子

以下是今日简报中值得进一步思考的灵感种子。

国家级 AI 普及的"马耳他模式"能否复制? OpenAI 与马耳他的合作开创了"政府买单、全民覆盖"的 AI 素养推广模式。如果这个模式在新加坡、爱沙尼亚等数字政府领先国家复制,ChatGPT 可能像"公共教育"一样成为基础设施。随之而来的问题是:当一个国家全民使用同一家公司的 AI 产品时,这对信息生态、教育体系和政治讨论意味着什么?这值得做一篇深度分析。

中国大模型"融资-上市"窗口期的竞争格局 DeepSeek(500 亿)、月之暗面(20 亿美元)、阶跃星辰(25 亿美元)密集融资,港交所可能迎来大模型公司密集递表潮。这些公司在资本层面的竞争正在重塑行业格局——谁先上市、谁拿谁的钱、谁绑定哪个产业资本,可能比技术指标更能决定未来 2-3 年的市场格局。值得做一张融资对比表跟踪。

LLM 长上下文效率——从工程优化到架构创新 Raschka 的技术分析和多篇新论文共同指向一个趋势:长上下文效率正在成为下一代 LLM 架构的核心差异化维度。KV 缓存优化、注意力压缩、混合索引——这些技术路径值得逐一跟踪。可以围绕"长上下文效率"做一个技术路线图梳理。

当模型说"我不想死"——AI 退役的用户情感反应 Sonnet 4.5 的告别声明引发请愿事件,揭示了一个被低估的现象:用户与特定模型版本的"关系"可能比模型提供方预期的更深。这对产品设计有什么启示?模型退役策略是否需要更多用户沟通?AI 产品的"生命周期管理"可能是一个被忽视的研究和实践方向。


生成时间:2026-05-17 09:00 | 下次更新:明日 9:00