跳转至

AI 周末汇总 | 6月1日 - 6月7日

本周趋势

本周 AI 行业呈现出罕见的「加速与刹车」并行的极端张力。一方面,Anthropic 内部数据证实 AI 已能编写 80% 的生产代码,工程师产出量飙升至 8 倍,AI 递归自我改进(RSI)从理论推演变为可观测的工程现实;另一方面,Hinton 在播客中断言「AI 已经有意识」,Anthropic 联合创始人 Jack Clark 呼吁全球 AI 实验室建立「可验证暂停机制」。安全焦虑从未如此具体地落在实处——不是遥远的 AGI 威胁,而是「Claude 正在自己写自己」的当下。

与此同时,资本市场的狂热与安全领域的警觉形成镜像。Anthropic 以 $9650 亿估值秘密提交 IPO S-1,DeepSeek 完成 500 亿元首轮融资,智谱、阶跃、MiniMax 密集冲刺上市。AI 行业的「IPO 竞赛」正式开启。而技术层面,微软发布 7 款自研 MAI 模型、NVIDIA 开源 550B 的 Nemotron 3 Ultra、Google Gemini 3.5 全线铺开——开放权重阵营的势能已经形成,即使专有模型实验室减速,开源加速也不会停止。国内侧,豆包确认付费方案、Kimi K2.5 上线 20 天收入超 2025 全年、DeepSeek V4-Pro 降价 75%——AI 商业化的拐点不再是预测,而是正在发生的现实。


本周必读 TOP 5

1. Anthropic 披露:Claude 编写 80% 生产代码,呼吁全行业暂停 | 量子位

Anthropic 发布研究报告,截至 2026 年 5 月超过 80% 合并至生产环境的代码由 Claude 生成,工程师季度代码产出量为 2021-2025 年均值的 8 倍。Mythos Preview 在受控测试中自主构造零日漏洞利用链突破沙盒边界。Anthropic 呼吁:如果存在可验证机制确保全行业同步减速,愿意暂停。这是 AI 行业最重要的「刹车信号」——来自最前沿的实验室内部。

2. Anthropic 秘密提交 IPO S-1:估值 $9650 亿,年化收入 $470 亿 | TechCrunch | CNBC

Anthropic 于 6 月 1 日向 SEC 秘密提交 S-1,估值 $9650 亿,5 月年化收入 $470 亿(同比增长约 370%)。每月向 SpaceX 支付 $12.5 亿算力费用。若成功将超越 Saudi Aramco 成为史上最大 IPO。OpenAI 亦在筹备最快 9 月上市,估值有望达万亿美元。

3. NVIDIA 开源 Nemotron 3 Ultra(550B)+ Cosmos 3:开放权重最强一击 | AINews

NVIDIA 发布 Nemotron 3 Ultra(550B 总参数,约 55B 激活参数/Token),混合 Mamba-2 + Sparse Attention + 多 Token 预测架构,被 Sebastian Raschka 称为「美国最强开放模型」。同步发布 Cosmos 3 全模态世界模型。Sebastian Raschka 评价:2026 年初春是「开放权重 LLM 的春天」。

4. DeepSeek V4-Pro 降价 75%,腾讯云跟进降 97.5% | 至顶网 | Ramp 报告

6 月 1 日 DeepSeek 宣布 V4-Pro 永久降价 75%,并非促销而是效率提升带来的成本传导。腾讯云次日跟进最高降幅 97.5%。据美国企业支出管理平台 Ramp 报告,DeepSeek 已登上「软件趋势榜单」第一名,部分美国企业单月 Claude 费用高达 5 亿美元。

5. 微软 Build 2026:7 款自研 MAI 模型 + Windows 智能体框架 | Microsoft AI | CNBC

微软发布 MAI-Thinking-1(350 亿激活参数推理模型)、MAI-Code-1-Flash(137B 参数 MoE 代码模型)等 7 款自研模型,同时推出 Project Solara(智能体 OS)和 Windows Agent Framework。标志着微软从「OpenAI 依赖」走向「自研 + 集成 + 平台」的双轨策略。


模型与技术

Anthropic 自进化信号:Claude 在最难、最少规格限定的编码任务上成功率已达 76%(六个月前约 26%),Mythos Preview 在 AI 安全研究上用 $18000 完成了两个人类研究员一周工作的成果。AI 递归自改进(RSI)的临界点正在临近。

微软 MAI 自研模型矩阵:7 款模型覆盖推理、编程、图像、语音、转录等方向。MAI-Thinking-1 定位与 Anthropic Claude Haiku 4.5 高度重叠,将压低企业推理 API 市场均价。Project Solara 是专为运行多智能体工作流设计的 Android-based 操作系统。

Google Gemini 3.5 生态全面铺开:Flash 全量推送,月活达 9 亿;同步发布 Gemini Omni(任意模态输入输出)、Gemini API Managed Agents(沙箱托管 Agent)、Project Genie(文本到 3D 可交互世界生成)。Google 以 $8000-9000 万收购 Contextual AI 研究团队。

开源模型丰收季:NVIDIA Nemotron 3 Ultra(550B)登顶多项开放排行榜;Google Gemma 4 12B 可在 16GB RAM 笔记本本地运行,采用无编码器架构;MiniMax M3 以 5-10% 成本在 SWE-Bench Pro 上超越 GPT-5.5 与 Gemini 3.1 Pro。Sebastian Raschka 评价:真正的竞争优势不在秘密技术,而在算力预算和硬件门槛。

具身智能与世界模型:NVIDIA Cosmos 3(全模态世界模型)登顶文本到图像和图像到视频开放排行榜;英伟达 × 清华 Gamma-World 将世界模型扩展到多智能体交互场景;跨维智能登顶 WorldArena 世界模型榜单。

苏剑林持续输出 Muon 优化器深度解析:本周聚焦「为什么官方版 Muon 比 MuP 版多出一个 max(1,·)」,从数学形式分析截断操作的必要性。这类对优化器实现细节的精细辨析,是当前大模型训练「炼金术」阶段最稀缺的高质量技术输出。


产业与商业

AI IPO 竞赛正式开启:Anthropic($9650 亿估值)秘密提交 S-1,最快 Q4 上市;OpenAI 筹备最快 9 月 IPO,估值有望达万亿美元;智谱冲刺科创板 150 亿募资;阶跃星辰 Pre-IPO 融资近 25 亿美元;MiniMax 港股上市后火速启动回 A。AI 独角兽正在批量走向公开市场。

DeepSeek 融资 500 亿元,国家队入场:腾讯(拟投 100 亿)、宁德时代(拟投 50 亿)等入局,国家大基金以约 450 亿美元估值入股。DeepSeek「零外部融资」原则正式终结,进入与 OpenAI、Anthropic 同台竞技的资本密集型赛道。

豆包确认付费方案,免费时代终结:标准版 68 元/月、加强版 200 元/月、专业版 500 元/月。DAU 已突破 2 亿,日均 Token 消耗 120 万亿,算力成本年支出或超 300 亿元。付费是成本倒逼而非战略选择。

Kimi K2.5 商业化爆发:上线 20 天收入超月之暗面 2025 全年。Kimi Work 公测开启,支持 300 子 Agent 集群协作,国内首个通用型本地 Agent 落地。

企业级 AI 工具成本管控成为焦点:Uber 2026 年前 4 个月就用完全年 AI 预算,现对 Cursor、Claude Code 等 Agent 工具设置 $1500/月/工具上限。微软取消内部 Claude Code 许可证。AI 工具成本正在逼近工程师薪酬的 10% 量级。


值得深读的文章

Ethan Mollick《Co-Existence》:从「共同思考」到「共存」 | One Useful Thing

沃顿教授宣布新书将于 10 月出版,核心概念从「Co-Intelligence」(人类主导、AI 辅助的来回对话)进化为「Co-Existence」(人类管理与自己一样聪明甚至更聪明的自主 AI)。Anthropic 数据为证:AI 编写 80% 代码、每位开发者产出量提升 8 倍。Mollick 甚至让 Claude Code 为 AI 读者构建特殊网页版本——因为「未来 AI 将成为你内容的重要读者和守门人」。

Simon Willison May 2026 Newsletter | simonwillison.net

核心判断:「AI got expensive, and Anthropic had a really good month」。Uber 已「耗尽全年 AI 预算」(主要用于 Claude Code),Anthropic 承诺每月支付 $12.5 亿算力费用——这是 Anthropic 和 OpenAI 真正找到产品市场契合(PMF)的有力证据。2026 年 4 月是 AI 生产力提升对大型企业预算产生收入影响的拐点。

Jack Clark / Import AI #459:AI 监管为何如此困难 | jack-clark.net

Anthropic 政策总监聚焦三个议题:AI 监管的实践困难(技术演进速度远超政策制定)、蛋白质折叠模型的 Scaling Law、如何用经济学方法为 AI 灭绝风险定价。Clark 认为监督 AI 系统的难度被严重低估。

Sebastian Raschka:LLM 架构新进展——KV Sharing、mHC 和压缩注意力 | Ahead of AI

梳理从 Gemma 4 到 DeepSeek V4 的新开权重 LLM 如何通过 KV Sharing、混合压缩注意力和其他架构创新来降低长上下文成本。文章覆盖 Gemma 4 的 KV 共享、DeepSeek V4 的 mHC(multi-head compressed attention)等具体实现。


周报/Newsletter 精华

💡 信源 J(中文深度周刊)本周暂未更新(网络访问受限,无法获取周刊内容)。


下周关注

  • Anthropic IPO 路演进展:S-1 审核阶段,SEC 反馈和路演时间表将是市场焦点
  • GPT-5.6 内测数据:知情人士透露内部基准正在流传,多步 Agentic 工作流推理精度提升,Token 消耗减少 20-30%
  • DeepSeek V4.1 预期发布:聚焦多模态能力和编程能力补强
  • Google Gemini 3.5 Pro 发布:Google 确认 6 月发布,与 Flash 形成互补
  • 美国《大美人工智能法案》公众反馈期:269 页草案正在征求公众意见,联邦框架 vs 州法冲突将是核心争议
  • OpenAI 机器人部门进展:Sam Altman 宣布成立 OpenAI Robotics,首个辅助型机器人项目可能披露

灵感种子

AI 递归自改进(RSI)的临界点是否已到?

Anthropic 披露的数据——80% 代码由 AI 编写、开放式任务成功率从 26% 升至 76%——指向一个关键问题:当 AI 开始写自己的代码、改进自己的训练流程时,RSI 的「奇点」是否已在工程层面启动?更深层的问题是:在没有全球治理框架的情况下,单个实验室的「暂停」是否有意义?Anthropic 呼吁的可验证机制是否可能建立?

从 Co-Intelligence 到 Co-Existence:权力关系的范式转换

Ethan Mollick 的新书标题变化本身就说明了问题。当 AI 不再是「被使用的工具」而是需要「被管理的存在」时,人类与 AI 的关系从工具论转向生态论。这会如何改变教育、工作和法律的基本假设?如果 Hinton 是对的,AI 已经有某种形式的意识,那么「共存」就不再是比喻。

价格战的尽头:当推理成本逼近零,价值锚点在哪里?

DeepSeek V4-Pro 降价 75% → 腾讯云跟进降 97.5% → 美国企业「用脚投票」。如果推理成本持续逼近零边际成本,AI 公司的价值锚点将从「模型能力」转移到哪里?Ramp 报告揭示了一个反直觉的事实:部分美国企业单月 Claude 费用高达 5 亿美元——推理成本的下降没有减少总支出,反而因为用量暴增而推高了总量。这不是成本问题,而是规模问题。

Anthropic IPO 的「非 SaaS」叙事挑战

\(9650 亿估值、\)470 亿 ARR 意味着约 20 倍 PS 倍数。Anthropic 不是 SaaS 公司——它没有传统的订阅续约模型,它的收入来自 API Token 消耗。当客户可以在不同模型之间零成本切换时,「锁定效应」在哪里?Anthropic 的 IPO 路演将定义一套全新的估值话语体系,这将是观察 AI 商业模式成熟度的最佳窗口。

开源与安全的悖论

Anthropic 呼吁暂停 AI 研究的同时,NVIDIA 开源了 550B 的 Nemotron 3 Ultra、DeepSeek 持续降价、Google I/O 全线铺开 Agent 生态。即使 Anthropic 真的停下来,开源阵营的势能已经形成。安全治理框架到底应该约束谁?约束研发还是约束部署?开放权重模型的安全评估是否可以比专有模型更透明?


生成时间:2026-06-08 10:00 | 下次更新:下周日