跳转至

AI 每日简报 | 2026-07-03

今日概览

今天没有模型发布级别的大新闻,OpenAI / Google DeepMind / Anthropic 官方渠道过去 24 小时均无新动态。焦点转向"国产算力自主可控"的商业验证:美团 LongCat-2.0 用零英伟达芯片链路训练出万亿参数模型,且已在 OpenRouter 全球调用量杀入前三;具身智能数据采集范式也有新突破,FaceMind(脸谱心智,即昨日 LoopWM 世界模型论文的作者)提出 Ego-NeuroLoop 四路同步信号采集方法,呼应了这两天世界模型赛道的技术脉络;商业化层面,昆仑万维天工 AI Native 业务 ARR 突破 8 亿美元,向中国首个非 BAT 10 亿美元 ARR 的 AI 公司迈进。

  • 美团 LongCat-2.0:全球首个"零英伟达"链路训练的万亿参数大模型,OpenRouter 调用量杀入全球前三
  • FaceMind 提出 Ego-NeuroLoop 具身智能数据采集新范式:同步采集视线 / 脑电 / 肌电 / 环境四路信号
  • 昆仑万维天工 AI Native 业务 ARR 突破 8 亿美元,冲刺"非 BAT 首个 10 亿美元 ARR AI 公司"
  • 清华 / 蚂蚁社区开源 AReaL 2.0,聚焦自演进智能体的强化学习基础设施
  • Simon Willison 发布基于 LLM 库的编程 Agent 实验 llm-coding-agent,用 Claude Fable 5 全程辅助开发

深度阅读推荐

以下条目标注为 ⭐ 深度推荐,包含 AI 提炼的核心观点。


⭐ 美团 LongCat-2.0:全球首个"零英伟达"训练的万亿参数模型,OpenRouter 调用量杀入全球前三

美团于 6 月 30 日正式发布新一代大模型 LongCat-2.0,总参数规模达 1.6 万亿(MoE 架构,单 token 平均激活约 480 亿,动态范围 33B~56B),原生支持 1M 超长上下文。这次发布最值得关注的不是参数量本身,而是训练路径——LongCat 团队自 2023 年开始探索国产算力,从千卡起步,用三年时间逐步攻克算子适配、通信优化、分布式稳定性等基础难题,最终在五万卡国产算力集群上完成了这个万亿参数模型全流程的训练与推理,全程未使用英伟达芯片。今天的新进展是,LongCat-2.0 预览版已通过 OpenRouter 平台向全球开发者开放调用,上线不久调用量便杀入 OpenRouter 全球大模型榜单前三,仅次于 Hermes 和 Claude Code(OpenClaw 排第三,LongCat 具体名次需以榜单实时数据为准,但已被量子位称为"海外开发者的抢手货")。

核心观点:这条新闻的分量不在于"又一个万亿参数模型",而在于它是国产算力链条能训出顶级规模模型的一次公开、可验证的证明——不是自说自话的跑分,而是海外开发者用真实调用量投票的结果。放在中美 AI 芯片博弈的大背景下看,这可能是过去半年里"国产替代"叙事最具体的一块拼图:从"能不能训"到"训出来的东西好不好用、海外市场认不认",这是质变。

来源:量子位 | 美团技术团队 | 新京报

⭐ FaceMind 提出 Ego-NeuroLoop:具身智能数据采集正在"进人体"

继昨日 LoopWM 世界模型论文引发关注后,中国初创公司脸谱心智(FaceMind)今日再度带来新进展——提出一套名为 Ego-NeuroLoop 的具身智能数据采集新范式。核心思路是:具身智能真正缺的不是更多视频,而是一类能记录"人类大脑、身体和环境如何形成闭环"的数据——人看哪里、什么时候准备动作、肌肉如何启动、反馈怎样出现、动作又如何被修正。Ego-NeuroLoop 把人类完成任务的过程拆成四类同步信号采集:world camera(外部环境)、gaze(注意力/视线)、EEG 脑电(神经状态)、sEMG 表面肌电(肌肉执行)。在模型侧,FaceMind 用其此前发布的循环世界模型(Looped World Models,即 LoopWM 的技术基础)对环境状态做迭代式内部修正,形成"数据侧采闭环、模型侧跑闭环"的完整链路。

核心观点:把这条新闻和昨天的 LoopWM 论文放在一起看,能看清 FaceMind 的完整技术叙事——先用"迭代潜深度"的循环 Transformer 架构证明小参数也能在世界模型任务上超越大模型,再用 Ego-NeuroLoop 把数据采集从"看视频学统计规律"升级为"采集人类感知-决策-执行的完整贝叶斯闭环"。这暗示了一个可能的行业分野:当纯视频自监督学习(如智源 Orca 的"无意识学习"路径)逐渐触及信息密度上限时,下一波竞争壁垒可能会转向谁能低成本、大规模地采集脑电/肌电这类原本只用于医疗和脑机接口场景的侵入式人体信号。

来源:量子位 | 网易订阅转载

⭐ 昆仑万维天工 AI:Native 业务 ARR 突破 8 亿美元,冲刺非 BAT 首个 10 亿美元 ARR AI 公司

昆仑万维宣布,旗下天工 AI 的 AI Native 模型与产品业务年度经常性收入(ARR)已突破 8 亿美元,其中 AI 短剧平台业务 ARR 超过 7 亿美元,AI 工具业务 ARR 突破 1 亿美元。具体驱动力是天工旗下短剧平台 DramaWave 已完成"AI 原生化"改造——目前平台超过 80% 的新增发布内容由 AI 生成。自 2025 年第四季度周亚辉接任天工 AI CEO 以来,公司管理层公开目标是让 ARR 持续向 10 亿美元迈进,力争成为中国 AI 产业历史上首个"BAT 之外 10 亿美元 ARR"的 AI 公司。

核心观点:这条新闻和 LongCat-2.0 一起,共同指向 2026 年下半年国产 AI 竞争评价体系的一个转向——从"模型跑分/参数规模"转向"真实商业化收入规模"。天工的路径尤其值得注意:它没有押注通用对话助手,而是把 AI 原生生成能力垂直押注在 AI 短剧这个具体场景上,用内容平台的方式验证付费意愿。这对资源有限的创业团队是个具体启示——与其继续卷通用模型榜单,不如找一个能被"AI 原生化"改造、且用户愿意为内容/结果买单的垂直场景。

来源:量子位 | 21经济网 | 网易订阅转载


OpenAI

今日无更新

过去 24 小时内 OpenAI 官方博客无新发布。最新一条为 6 月 30 日发布的《How ChatGPT adoption has expanded》,基于 OpenAI Signals 数据展示 ChatGPT 在全球的使用增长情况,属于常规运营数据披露,非重大新闻。此前预览的 GPT-5.6 Sol/Terra/Luna 系列(6 月 26 日,因美国政府要求目前仅向约 20 家审批合作伙伴开放)仍是近期最重要动态,已在此前简报中报道。

来源:OpenAI 博客


Google DeepMind / Gemini

今日无更新

过去 24 小时内 Google DeepMind / Gemini 官方渠道无新发布。近期动态(Gemini 3.5 Flash 发布、Nano Banana 2 Lite 等)均已在此前简报中报道。


Anthropic / Claude

今日无更新

过去 24 小时内 Anthropic 官方渠道无新发布。近期重要动态(Claude Sonnet 5 发布、Claude Science 上线、Fable 5 全球重新部署、Claude Code 隐写标记争议)均已在此前简报中报道。KOL 板块中 Simon Willison 分享了一则用 Claude Fable 5 辅助开发编程 Agent 的实践记录,详见下方"行业观点与解读"。


国内大厂动态

美团 LongCat-2.0:零英伟达训练的万亿参数模型

详见深度阅读区。⭐ 深度推荐(详见深度阅读区)

来源:量子位 | 美团技术团队

昆仑万维天工 AI:ARR 突破 8 亿美元

详见深度阅读区。⭐ 深度推荐(详见深度阅读区)

来源:量子位

科大讯飞:智能交互生态发布会,三大平台同步升级

科大讯飞举办智能交互生态发布会,公司旗下三大平台(据量子位报道,覆盖办公、教育、硬件交互相关产品线)同步升级,具体功能细节量子位未在快讯中展开,需持续关注后续详细报道。

来源:量子位

DeepSeek / Kimi / 豆包 / 智谱 / 阿里千问:今日无重大更新

均维持此前简报已披露的动态(DeepSeek V4 系列、Kimi K2.6 与港股上市评估、豆包 Doubao-Seed-2.1、智谱 GLM-5.2、千问 Qwen Chat 功能更新),过去 24 小时内无新的重大发布。


AI 研究前沿

FaceMind Ego-NeuroLoop:具身智能数据采集新范式

详见深度阅读区。⭐ 深度推荐(详见深度阅读区)

来源:量子位

AReaL 2.0 开源:面向自演进智能体的强化学习基础设施

研究社区开源 AReaL 2.0,定位为"让 Agent 越用越强"的强化学习基础设施,目标是与社区共同推进自演进智能体(self-evolving agent)生态发展。量子位快讯未展开具体技术细节,属于基础设施类开源更新,方向上呼应了近期 Agent RL 训练基础设施持续迭代的趋势。

来源:量子位

TurboServe:流式视频生成的高效低成本服务框架

清华大学团队发布 TurboServe,登顶 HuggingFace 每日论文榜(16 个赞),提出一套面向流式视频生成的高效、经济的服务(Serving)方案,瞄准视频生成模型部署时的推理成本和延迟痛点。

来源:HuggingFace 每日论文 | arXiv

苏剑林(科学空间):今日无更新

最新文章仍为 6 月 25 日发布的《矩阵函数近似中的暴力美学》,暂无新文章。

来源:科学空间


行业观点与解读

Simon Willison:用 Claude Fable 5 全程辅助搭建编程 Agent 库 llm-coding-agent

Simon Willison 发布 llm-coding-agent 0.1a0,是其 LLM 库(已逐渐演变为一个 Agent 框架)之上的一次编程 Agent 实验——目标是看看基于该库能做出一个什么样的"Claude Code 风格"编程 Agent。他先用 Claude Code for web(Fable 5)写 spec.md,再用同一个 Agent 以红绿 TDD 的方式分批提交代码完成实现,过程中偶尔手动用 OpenAI API 测试。成果是一个可通过 uvx --with llm-coding-agent llm code 直接运行的编程 Agent,支持文件读写编辑、命令执行等工具,并提供了一个未被要求但自动生成的 Python API(CodingAgent(model="gpt-5.5", root="/path").run(...))。同日 Willison 还分享了用 DSPy 优化 Datasette Agent 系统提示词的研究笔记。

核心观点:这类"用 Agent 造 Agent"的实践本身没有惊天动地的技术突破,但样本价值很高——它是一线开发者对"Software 3.0"工作方式的真实记录:从写 spec、TDD 分批提交,到人工只做抽查测试,整个过程几乎不需要逐行审代码。这印证了 Karpathy 近期反复强调的"编程单位从写代码行变成委派宏观动作"的判断,也是 Ethan Mollick 昨日"聊天机器人黄昏"一文中"用户应像管理者一样使用 Agent"的一个具体案例。

来源:Simon Willison

宝玉 / 向阳乔木:今日无可确认的新动态

过去 24 小时内未搜索到两位 KOL 明确发布于 2026 年 7 月 2-3 日的新推文内容,暂不收录,避免引用过期信息。


值得关注的视频

核心播客 G1(Dwarkesh、No Priors、Latent Space 等)过去 48 小时内无可确认的新一期节目——No Priors 最新一期仍为与 Mark Zuckerberg、Priscilla Chan、Alex Rives 探讨 Biohub 5 亿美元虚拟生物学计划(与昨日简报相同),Latent Space 最新一期为 6 月 4 日发布,Dwarkesh 最新一期同样停留在 6 月 4 日,均非过去 48 小时新内容。B 站 AI 资讯频道(AI 日报、AI 前沿日报、TAI 快报)今日未能搜索到可验证的具体最新一期编号与链接,为避免引用错误内容暂不收录,建议下次运行时直接访问频道页面核实。

今日无收录视频。


灵感种子

以下是今日简报中值得进一步思考的灵感种子。

"零英伟达"训练+海外调用量前三,是国产算力叙事第一次有了可验证的外部信号:过去关于国产芯片能否支撑大模型训练的讨论,大多停留在企业自己公布的跑分或内部测试数据。LongCat-2.0 的不同之处在于,它把"好不好用"的判断权交给了 OpenRouter 上的海外开发者——调用量杀入全球前三是用真实付费/使用行为投出来的结果,而不是自证。对于关注中美 AI 硬件博弈走向的人来说,这可能是判断"国产替代到底走到哪一步了"最值得追踪的一类信号:不是发布会上的参数表,而是开放平台上的真实调用榜单。

具身智能的数据竞赛正从"看世界"转向"进人体":FaceMind 的 Ego-NeuroLoop 把 EEG 脑电、sEMG 表面肌电这类原本主要用于医疗诊断和脑机接口研究的信号采集手段,直接搬进了具身智能的训练数据管道。这和智源 Orca 依赖纯视频自监督的"无意识学习"路径形成鲜明对比。如果这个方向被验证有效,具身智能公司的核心壁垒可能会从"算力和参数规模"转向"能不能大规模、低成本、合规地采集人体闭环信号"——这可能催生一批专做人体信号采集硬件和数据服务的新公司。

"非 BAT 10 亿美元 ARR"可能成为国产 AI 应用公司的下一个分水岭叙事:天工 AI 冲刺 10 亿美元 ARR、叠加此前 MiniMax 上市、智谱和字节陆续披露的商业化数据,说明国产 AI 应用层的竞争评价体系正在从"模型跑分"转向"真实收入规模"。天工的路径——不做通用助手,而是把 AI 原生生成能力垂直押注在 AI 短剧这个具体内容场景——对资源有限的创业团队是个具体提示:与其继续卷通用模型能力,不如找一个能被"AI 原生化"改造、且用户愿意为内容或结果直接付费的垂直场景。

"用 Agent 造 Agent"正在成为一线开发者验证 Software 3.0 工作法的标准动作:Simon Willison 用 Claude Fable 5 写 spec、TDD 分批提交、几乎不逐行审代码就完成了一个可用的编程 Agent 库,这类实践正变得越来越常见。这提示做开发者工具的团队一个具体机会——与其继续优化"代码补全"体验,不如认真考虑如何让开发者更方便地把"写 spec + 抽查测试"这套工作流固化成可复用的工具链。


生成时间:2026-07-03 09:18 | 下次更新:明日 9:00