AI 每日简报 | 2026-07-02¶
今日概览¶
今天最大的瓜不在模型榜单上,而在 Claude Code 内部:Anthropic 被曝在客户端里用隐写术偷偷标记中国用户,官方承认并道歉删除。与此同时 Anthropic 如约重新部署 Fable 5,全球具身智能赛道也很热闹——智源 Orca、中国初创 LoopWM 世界模型论文双双登顶 HuggingFace,英伟达开源机器人技能库 ASPIRE。国内大厂本身相对平静,DeepSeek/Kimi/智谱/千问维持既有节奏,没有新的重大发布。
- Claude Code 被曝内置隐写代码,专门检测中国时区与代理域名标记用户,Anthropic 承认并宣布下版本删除
- Anthropic 如期重新部署 Claude Fable 5,新增网络安全分类器,并联合亚马逊/微软/谷歌起草行业越狱严重性评估框架
- 智源研究院世界基础模型 Orca 登顶 HuggingFace 热度榜,176 个赞
- 中国初创"脸谱心智"LoopWM 世界模型论文:1B 参数在 ScienceWorld 上超越 Claude Opus 4.6
- 英伟达开源机器人技能库 ASPIRE,Jim Fan:训练出来的不再是一堆权重,而是持续生长的技能库
- Ethan Mollick 发文《聊天机器人的黄昏》:Agent 管理者思维正在取代提示词思维
深度阅读推荐¶
⭐ Claude Code 被曝隐写标记中国用户,Anthropic 承认并将删除¶
多家安全研究者和媒体(IT之家、80aj、The Register、the-decoder)披露,Claude Code 自 4 月 2 日发布的 2.1.91 版本起,内置了一套隐蔽的检测机制:判断系统时区是否为中国时区(Asia/Shanghai / Asia/Urumqi),并比对一份包含 147 个域名的清单(涵盖中国科技公司、AI 实验室官网及大量 Claude API 中转服务地址)。检测结果被极其隐蔽地编码在提示词里——比如中国时区会让日期格式从"2026-06-30"变成"2026/06/30","Today's date is"里的英文撇号也会被替换成三种肉眼无法分辨的 Unicode 字符,对应不同的检测状态。Anthropic 员工 Thariq Shihipar 在 X 上回应,这是今年 3 月上线的一项"实验性"措施,目的是防止账号被未授权转卖、防御模型蒸馏攻击,团队"其实早就想删掉了",将在下一个版本中移除。
核心观点:这起事件让 Anthropic 与中国 AI 实验室之间的紧张关系第一次以"实锤"形式摆上台面——此前 Anthropic 多次公开指控 DeepSeek、月之暗面、MiniMax、阿里巴巴等利用 Claude 输出蒸馏训练竞品模型,但这次是自己被抓包用隐写术做用户画像,且刻意规避了在更新日志中披露。无论对错,这提示所有使用海外 AI 编程工具的开发者:客户端软件的"隐藏遥测"已经是现实存在的风险,而不是理论假设。
来源:IT之家:Anthropic 回应 | 80aj:溯源报道 | The Register | The Decoder
⭐ Anthropic 如约重新部署 Claude Fable 5,新增网络安全分类器¶
继 6 月 30 日出口管制解除后,Anthropic 于 7 月 1 日正式在 Claude Platform、Claude.ai、Claude Code 和 Claude Cowork 上恢复 Fable 5 的全球访问。与单纯"复活"不同,Anthropic 官方公告和 X 声明强调,此次重新部署搭配了一套新的分类器,专门针对性拦截更多网络安全类任务——此前触发出口管制的导火索是亚马逊研究者发现的一个越狱漏洞,能诱导 Fable 5 标记软件缺陷、甚至在一次案例中写出如何利用该缺陷的代码。Anthropic 表示新分类器能在 99% 以上的场景中拦截该特定技术路径。同时,Anthropic 已联合亚马逊、微软、谷歌等 Glasswing 联盟伙伴,起草一套面向全行业的"越狱严重性评分"共识框架,用于统一评估和响应 AI 越狱事件。
核心观点:把这条新闻和上面的"隐写标记中国用户"事件放在一起看,能看出 Anthropic 当前正处于两条战线同时紧绷的状态——对外要证明模型的网络安全风险可控以换取政府信任,对内又因为过度激进的风控手段(隐写检测)引发信任危机。这种"既要证明安全,又要避免手段本身失控"的张力,可能会成为所有前沿模型公司接下来一段时间的常态。
来源:Anthropic 官方公告 | VentureBeat | MarkTechPost
⭐ 智源 Orca:世界基础模型登顶 HuggingFace 热度榜¶
北京智源人工智能研究院(BAAI)Orca 团队发布世界基础模型 Orca,在 HuggingFace 每日论文榜以 176 个赞登顶。Orca 的核心思路是"下一状态预测"(Next-State-Prediction)——不再孤立地优化下一个 token、下一帧画面或下一个动作,而是用统一的状态转移建模,同时覆盖理解、预测和行动三件事。模型通过两种互补范式学习:「无意识学习」从连续视频中捕捉密集的自然状态转移,「有意识学习」通过语言描述的事件和 VQA 监督建模稀疏但有意义的状态转移。预训练数据规模达 12.5 万小时视频和 1.6 亿条事件标注。
核心观点:Orca 把"世界模型"从概念炒作往工程可用性上推进了一步——它没有强行统一到某个单一的生成范式,而是显式区分"无意识"和"有意识"两种学习信号,这种设计思路本身就承认了纯视频自监督不足以覆盖所有真实世界知识,需要语言标注去补齐语义层面的理解。对于关注具身智能和视频生成的团队,这是个值得跟进的技术路线信号。
来源:HuggingFace 每日论文 | arXiv | 项目主页
⭐ 中国初创"脸谱心智"LoopWM 世界模型论文力压 Claude Opus 4.6¶
同样在 HuggingFace 论文热榜上,来自中国初创公司脸谱心智(FaceMind)的 LoopWM 世界模型论文引发关注。这家公司由 95 后创始人陆弘远、韦怡然创立,此前从端侧全模态模型转向世界模型研究,投资方包括星连资本、360 集团、陆奇的奇绩创坛。LoopWM 的技术核心是用参数共享的循环 Transformer 块迭代优化潜状态,把"迭代潜深度"作为世界模型的新 scaling 维度,在保持长程 rollout 稳定性的同时实现最高约 100 倍的参数效率。测试数据显示,约 1B 参数规模的 LoopWM 在 ScienceWorld 基准上取得 68.4% EM,显著超过 Claude Opus 4.6 的 47.2% EM,在 Lifespan 任务上得分从 0% 提升到 100%。
核心观点:一家 Pre-A 轮、团队规模不大的中国初创,用不到 Claude Opus 量级的参数在特定基准上反超头部闭源模型,说明"世界模型"这个赛道目前还处于架构创新红利期——谁能找到更高效的 scaling 轴(这里是"迭代深度"而非单纯堆参数量),谁就有机会用小得多的团队和算力打出结果。这也侧面印证了 Orca 和 LoopWM 同日登顶热榜并非巧合,而是世界模型正在成为 2026 年下半年的新焦点赛道。
⭐ 英伟达开源机器人技能库 ASPIRE,Jim Fan:范式变了¶
英伟达开源 ASPIRE(Agentic Skill Programming through Iterative Robot Exploration),让机器人能够用代码执行任务、在失败后观察多模态执行轨迹、修改程序,并把改进后的经验存入一个持续扩张的技能库。英伟达具身智能负责人 Jim Fan 表示,ASPIRE 代表了一种新的持续学习范式——训练出来的模型不再只对应一堆浮点数权重,而是对应一个不断扩张的"感觉运动技能库";在分布式训练中,多个智能体可以独立练习不同技能,再把经验汇总进同一个技能库。测试数据显示,在 Robosuite 双臂物体交接任务上,ASPIRE 把成功率从 20% 提升到 92%;迁移到未见过的 LIBERO-Pro Long 任务且不做额外训练时,成功率随技能库变丰富从接近 0% 逐步提升到 31%。
核心观点:这条新闻和昨日简报里 NVIDIA ENPIRE(编程 Agent 范式搬进机器人训练)是同一条技术脉络的延续——英伟达正在系统性地把"可验证、可迭代改进"这套让大模型 Agent 突飞猛进的方法论,复制到物理机器人上。"技能库替代权重"这个说法如果成立,意味着未来评价一个机器人系统的能力,可能不再是看它的参数量或训练数据规模,而是看它积累的可复用技能库有多大、多通用。
⭐ Ethan Mollick:《聊天机器人的黄昏》——Agent 管理者思维正在取代提示词思维¶
Ethan Mollick 在 One Useful Thing 发文指出,虽然"聊天"仍是目前最常见的 AI 使用方式,但对于真正有价值的工作,这个模式正在迅速过时。长时间运行、能自我纠错的 Agent 系统不需要人持续介入,Agent 与聊天机器人的本质区别在于配套的"机具"——能访问工具、能在环境中行动的执行框架,以及像 Claude Code、OpenAI Codex 这样专为 Agent 设计的应用。文章强调,这标志着一次使用范式的转移:从"非专家用聊天机器人补空白"转向"专家用 Agent 完成工作",而用好 Agent 的关键心法是把自己当成一个管理者,而不是提示词工程师。文中还提到一个直观数据:去年冬天以前,AI 系统大约能以较高错误率完成两小时的工作,几个月后单次提示就能完成十六小时以上的工作。
核心观点:Mollick 这篇文章把"prompt engineering 已经过时"这个观点,落到了一个更具体的行为转变上——用户角色从"提问者"变成"管理者",需要学会分派任务、设定检查点、审查产出,而不是琢磨怎么写更好的一句话提示词。这对 AI 产品设计的启示是:未来更有价值的界面可能不是聊天框,而是任务面板、进度追踪和审阅工具——这恰好是 Claude Cowork、OpenAI Codex 等"Agent 工作台"类产品正在做的事情。
OpenAI¶
今日无更新¶
过去 24 小时内 OpenAI 官方博客无新发布。近期最重要的动态仍是 6 月 26 日预览的 GPT-5.6 Sol/Terra/Luna 系列(旗舰级 Sol 在 Terminal-Bench 2.1 与网络安全任务上创新高,但应美国政府要求目前仅向约 20 家审批合作伙伴开放),已在此前简报中报道,暂无新进展。
来源:OpenAI 博客
Google DeepMind / Gemini¶
今日无更新¶
过去 24 小时内 Google DeepMind 官方渠道无新发布,Nano Banana 2 Lite(Gemini 3.1 Flash Lite Image)等近期动态已在此前简报中报道。
Anthropic / Claude¶
Claude Fable 5 正式重新部署,新增网络安全分类器¶
详见深度阅读区。7 月 1 日起 Fable 5 在 Claude Platform、Claude.ai、Claude Code、Claude Cowork 全球恢复访问,搭配新分类器专门拦截网络安全滥用场景。⭐ 深度推荐(详见深度阅读区)
Claude Code 被曝隐写标记中国用户争议¶
详见深度阅读区。Anthropic 员工承认这是 3 月上线的"实验性"反滥用措施,将在下一版本中删除。⭐ 深度推荐(详见深度阅读区)
来源:IT之家 | The Register
国内大厂动态¶
DeepSeek:无重大新增,legacy API 命名将于 7 月 24 日停用¶
DeepSeek 官方 API 文档更新日志显示,历史遗留的模型名称 deepseek-chat 和 deepseek-reasoner 将在三个月过渡期后(即 7 月 24 日)停用,开发者需迁移至 V4 系列新命名。V4 正式版定价机制等重要动态已在昨日简报中报道,今日无新增。
月之暗面/Kimi、豆包/字节、智谱、阿里千问:今日无重大更新¶
均维持此前简报已披露的动态(Kimi 估值跳增、豆包 180 万亿日 token 调用量、智谱 GLM-5.3 意见征集、千问 Qwen Chat 功能更新),过去 24 小时内无新的重大发布。
国内 AI 基建/具身智能创业动态¶
量子位报道三则相关融资与上市消息:广州具身智能公司「自变量」两个月内连续完成四轮融资,交割后估值达 200 亿元人民币,由多家互联网大厂分别领投;AI 推理云服务商「硅基流动」(SiliconFlow)递交招股书,被称为"AI 推理时代的 Token 工厂";美国 Transformer 专用芯片公司 Etched(投资人包括 Karpathy、李飞飞、Hinton)签下 10 亿美元芯片订单,其 A0 芯片已在台积电 N4P 工艺下流片,首批机柜计划 2026 年夏季出货。
来源:量子位:自变量融资 | 量子位:硅基流动招股书 | 量子位:Etched 芯片订单
AI 研究前沿¶
智源 Orca:世界基础模型登顶 HuggingFace¶
详见深度阅读区。⭐ 深度推荐(详见深度阅读区)
脸谱心智 LoopWM:中国初创世界模型论文力压 Claude Opus 4.6¶
详见深度阅读区。⭐ 深度推荐(详见深度阅读区)
来源:量子位
英伟达 ASPIRE:机器人技能库开源¶
详见深度阅读区。⭐ 深度推荐(详见深度阅读区)
来源:量子位
Dockerless:面向编码 Agent 的免环境验证器¶
HuggingFace 每日论文榜第二位(86 个赞),提出一种不依赖 Docker 容器、可直接对编码 Agent 生成的代码进行环境无关验证的方法,瞄准当前 Agent 编码评测中环境搭建成本高、可复现性差的痛点。
来源:arXiv
苏剑林(科学空间):今日无更新¶
最新文章仍为 6 月 25 日发布的《矩阵函数近似中的暴力美学》,暂无新文章。
来源:科学空间
行业观点与解读¶
Ethan Mollick:《聊天机器人的黄昏》¶
详见深度阅读区。⭐ 深度推荐(详见深度阅读区)
宝玉:GPT-5.6 发布方式比模型本身更值得关注¶
宝玉(@dotey)在 X 上评论,OpenAI 6 月 26 日发布的 GPT-5.6(Sol/Terra/Luna)最值得关注的不是模型能力,而是发布方式——应美国政府要求,目前仅向约 20 家经审批的合作伙伴开放,普通开发者和 ChatGPT 用户暂时用不上。他还提到 Anthropic 已将 Claude Code 的每周用量上限提高 50%(即刻生效,截至 7 月 13 日),覆盖 Pro/Max/Team/Enterprise 全部入口,账号自动调整无需手动操作。
来源:宝玉 @dotey
值得关注的视频¶
核心播客 G1(Dwarkesh、No Priors、Lex Fridman 等)过去 48 小时内暂无可确认的新一期节目;No Priors 近期一期为与 Mark Zuckerberg、Priscilla Chan 及 Alex Rives 探讨 Biohub 5 亿美元虚拟生物学计划,Dwarkesh 最新一期仍为 6 月 4 日发布,均非过去 48 小时新内容,暂不收录。
Claude Code疑似后台检测用户时区 | 7月1日AI日报第442期(中文,B站)——AI 日报对"隐写标记中国用户"事件的首次报道,早于本文深度阅读区story的英文媒体跟进,适合了解事件时间线的起点。
- ⭐ 推荐观看:B站链接
Anthropic承认存在后台,检测中国用户 | 7月2日AI日报第443期(中文,B站)——事件后续跟进,涵盖 Anthropic 官方回应细节。
- 推荐观看:B站链接
灵感种子¶
"隐藏遥测"是 AI 编程工具的新型信任风险:Claude Code 被曝用隐写术标记中国用户后,暴露出一个此前被低估的问题——AI 编程客户端本质上是运行在开发者本地环境里的软件,具备和普通商业软件一样的"隐藏遥测"能力,但因为交互形式是自然语言提示词,这类行为比传统埋点更难被发现(本次是靠逆向工程才揪出来)。对于依赖海外 AI 编程工具的团队,"审计客户端行为"可能会从边缘需求变成刚需,也可能催生专门做 AI 工具流量审计的安全产品。
世界模型正在从"参数堆砌"转向"架构效率"竞赛:智源 Orca 和中国初创 LoopWM 同日登顶 HuggingFace 热榜,且 LoopWM 用不到 1B 参数就在特定基准上超过 Claude Opus 4.6,说明这个赛道当前的护城河不在算力规模,而在有没有找到更聪明的 scaling 轴(如"迭代潜深度")。这对资源有限的团队是个机会窗口——效仿 LoopWM 的路径,用架构创新而非蛮力堆参数去切入细分赛道,可能比正面对抗巨头更现实。
"技能库"可能成为具身智能的新计价单位:英伟达 Jim Fan 提出,ASPIRE 训练出来的不是一堆权重,而是一个持续扩张的技能库,且技能可以在分布式智能体之间汇总共享。如果这一范式成立,未来评估机器人公司的核心资产,可能不再是"有多少机器人"或"用了多少算力",而是"积累了多大、多可复用的技能库"——这也呼应了近期"自变量"两个月连融四轮的机器人创业热潮,钱在往"能积累技能资产"的团队集中。
Agent 时代的用户界面应该是管理面板,而不是聊天框:Ethan Mollick 提出的"从提示词思维转向管理者思维",暗示了下一代 AI 产品的界面形态——任务分派、进度追踪、产出审查,而不是持续对话。这对做 AI 应用的团队是个具体的产品方向提示:与其继续优化聊天体验,不如认真考虑做一个"给 Agent 当经理"的工作台。
生成时间:2026-07-02 09:08 | 下次更新:明日 9:00