跳转至

AI 每日简报 | 2026-07-12

说明:7 月 11 日简报缺失,本期覆盖窗口延长为 7 月 10 日上午至 7 月 12 日中午(约 48 小时)。

今日概览

大厂 AI 从「合作」正式转入「全面对抗」:苹果周五起诉 OpenAI 窃取商业机密,同时官宣新版 Siri 弃用 ChatGPT 改投 Gemini——诉讼与分发转移双击落在 OpenAI 的 IPO 窗口期上。资本侧,SK 海力士纳斯达克首日大涨 13%、市值 1.27 万亿美元,为 Anthropic 和 OpenAI 的 IPO 排队验证了「AI 支出是结构性而非周期性」的定价逻辑。GPT-5.6 发布 48 小时进入口碑修正期,OpenAI 两次重置用量并承诺回滚 UI。国内侧,中科曙光落成全国产十万卡集群,生数科技 Vidu S1 登顶 HuggingFace 论文热榜。

今日要点:

  1. ⭐ 苹果起诉 OpenAI 窃取商业机密,新版 Siri 秋季改用 Google Gemini
  2. ⭐ SK 海力士纳斯达克首日 +13%,AI 基础设施 IPO 逻辑获市场验证
  3. ⭐ GPT-5.6 上线 48 小时:口碑分化、两次额度重置、「64 子智能体解开 50 年数学猜想」引热议
  4. ⭐ 生数科技 Vidu S1 登顶 HuggingFace 热榜:实时交互视频生成,无限时长不漂移
  5. ⭐ 中国首个十万卡集群落成,全国产算力支撑「十万卡时代」

深度阅读推荐

以下条目标注为 ⭐ 深度推荐,包含 AI 提炼的核心观点。

⭐ 苹果起诉 OpenAI:合作时代在法庭上终结(Apple sues OpenAI alleging trade secret theft)

苹果 7 月 10 日(周五)在北加州联邦法院起诉 OpenAI 窃取商业机密,称其为开发消费硬件系统性获取苹果知识产权,指控「渗透到每一个层级」:OpenAI 硬件负责人 Tang Tan(前苹果副总裁)被指要求仍在苹果任职的面试者把「实物零件」带到面试现场做「展示讲解」;OpenAI 被指教离职员工规避苹果的安全审查流程;前员工 Chang Liu 被指偷走一台苹果笔记本,被列为共同被告。导火索是 OpenAI 以 64 亿美元收购 Jony Ive 的 IO Products 进军硬件,直接踩进苹果腹地。苹果寻求赔偿、禁令,并要求 OpenAI 停止使用其商业机密。

同日,苹果确认今秋发布的新版 Siri 将弃用 ChatGPT,改用 Google Gemini。对 OpenAI 而言这是双重打击:来自 3 万亿美元公司的活跃诉讼构成 IPO 招股书中必须披露的重大诉讼风险,Siri 换 Gemini 则直接削弱其消费分发叙事。2024 年那场「ChatGPT 进 iPhone」的高调联姻,两年后以互相拆台收场。

核心观点:
- 大厂 AI 的「合作阶段」正式结束:当模型公司做硬件、硬件公司换模型,过去两年的伙伴关系网络正在按各自的垂直整合野心重新洗牌,诉讼将成为常态工具。
- 人才流动即 IP 风险:这场诉讼的核心不是专利而是「人带走了什么」——对所有从大厂挖人的 AI 公司来说,招聘流程本身正在变成法律雷区。

来源:CNBC | Bloomberg | TechCrunch | Fortune

⭐ SK 海力士纳斯达克首日 +13%:AI 基建 IPO 的定价锚出现

SK 海力士完成史上最大外国公司赴美 IPO(265 亿美元),获 7 倍超额认购,首日开盘 170 美元、收于 168.01 美元(+13%),市值 1.27 万亿美元,位列全美第 11——低于特斯拉、高于礼来。董事长崔泰源对 CNBC 表示,AI 智能体和机器人需要「大量内存芯片」,即便宣布五年内产能翻倍,「所有客户都说不够」。

这一结果的意义超出一家存储公司:它是对「AI 支出是结构性而非周期性」这一定价假设的最强验证。如果机构投资者接受了这个逻辑,Anthropic(传闻 S-1 目标估值 9650 亿美元)和 OpenAI(8300 亿至 1 万亿美元)的四季度 IPO 将按同样的框架定价。7 月 14 日 SKHY 期权上市后的首批交易,将给出机构方向性信念的最清晰信号。

核心观点:
- 存储芯片这个「历史上最周期性的行业」被按成长股定价,意味着市场正在给整个 AI 供应链重估——这既是 Anthropic/OpenAI IPO 的顺风,也把「AI 支出结构性」假设变成了单点系统性风险。
- 内存而非 GPU 正成为新叙事焦点:智能体和机器人的常驻上下文对内存的需求增长快于算力,「memory wall」可能是下一轮基建投资主线。

来源:AIToolsRecap 汇总 | SK Hynix 上市分析

⭐ GPT-5.6 上线 48 小时:口碑分化与 OpenAI 的快速纠错

GPT-5.6 发布后的两天成为一场大型公开压力测试。负面侧:用户抱怨 Luna/Terra/Sol 三档 × 多推理档位组成的「30 多种配置组合」缺少 Auto 路由(Raschka 等公开吐槽);ChatGPT Work 与 Codex 的产品分工令人困惑;默认设置把用户推向昂贵档位,用量消耗远超预期,甚至发现 spawn_agent 生成的子智能体默认继承 Sol Ultra 配置,出现「隐性子智能体成本爆炸」。OpenAI 罕见地快速认错:两次重置全体用户用量、承认默认值问题、承诺恢复熟悉的侧边栏导航并澄清 Work 与 Codex 定位。

正面侧:社区共识是 GPT-5.6 最大的跃升在编排与 Computer Use 而非纯对话质量——Sol 作为「规划者/验证者/编排者」表现突出。最吸睛的是 OpenAI 员工放出的案例:Sol Ultra 用 700 词 Prompt 驾驭 64 个子智能体,在一小时内给出图论「圈双覆盖猜想」(Cycle Double Cover Conjecture,悬置 50 年)的声称证明,由 Greg Brockman 转发放大,量子位也做了中文报道;Bubeck 另提及单人用 GPT-5.6 完成百万行 Lean 形式化。这些声称仍待外部审查。健康领域,OpenAI 称在 2 万次医生盲评中,医生发现 GPT-5.6 回答的缺陷比医生自己写的回答更少。

核心观点:
- 「发布工程」正在成为独立竞争力:当产品是 agentic 系统,发布事故(配置爆炸、成本失控)的杀伤力不亚于模型能力短板,OpenAI 的 48 小时纠错速度本身就是护城河的一部分。
- 「并行研究智能体」是各家都想讲的下一个故事:64 子智能体证数学猜想无论最终是否成立,都标志着叙事从「单模型多聪明」转向「一群模型能干成什么」。

来源:smol.ai 07-10 期 | OpenAI 产品负责人纠错声明 | 量子位:GPT-5.6 一小时解开 50 年数学猜想 | Greg Brockman 转发

⭐ 生数科技 Vidu S1 登顶 HuggingFace 热榜:视频生成进入「实时交互」时代

生数科技 7 月初发布的实时交互视频模型 Vidu S1,其论文本周五以 119 票登顶 HuggingFace 每日论文热榜。技术路线为自回归 + 扩散(AR + Diffusion):不再一次性生成完整视频,而是基于已生成帧、当前语音指令和对话上下文持续预测后续内容。首次实现无限时长实时生成,连续生成数小时画面不漂移不退化;支持用户通过语音或摄像头与角色实时对话,模型即时理解语义并同步生成表情、眼神、手势和肢体动作——把语音从「驱动口型的信号」升级为「控制视觉行为的实时指令」。规格为 540P/25fps(最高 42fps),可跑在消费级显卡上。

核心观点:
- 数字人的技术底座正在被替换:传统「音频驱动口型 + 预设动作库」的数字人方案,在语义驱动的实时生成面前可能整体过时,直播、陪伴、客服等场景的落地路径被重新打开。
- 与蚂蚁 LingBot-Video(视频模型作为机器人大脑)对照,国内视频生成正沿「实时交互」和「具身物理」两条线同时突破,且都选择在论文和开源层面高调竞争。

来源:HuggingFace 论文页 | 爱范儿 | 雷峰网

⭐ 中国首个十万卡集群落成:全国产算力的规模化宣言

7 月 11 日,中科曙光宣布中国首个十万卡级智算集群落成,基于曙光 8000 系列,采用全国产算力芯片,精度覆盖从 FP64 到 INT8,走「超智融合」路线(超算与智算统一调度),目前已跑通 300 余项应用。在英伟达高端芯片对华受限的背景下,这是国产算力第一次在「单集群十万卡」这个此前只有美国头部实验室达到的规模刻度上完成交付。

核心观点:
- 十万卡是训练前沿模型的入场券量级——国产集群迈过这道门槛,意味着中美 AI 竞争的约束条件从「有没有卡」进一步转向「软件栈成熟度和互联效率」。
- 「超智融合」是差异化路线:把 HPC 与 AI 负载统一调度,赌的是科学计算与大模型训练融合的 AI4S 场景,这与纯 GPU 云的商业逻辑不同,值得跟踪其实际利用率。

来源:量子位 | 量子位(续报)


OpenAI

  • 苹果起诉 OpenAI + Siri 转投 Gemini(详见深度阅读区):诉讼与分发转移双击落在 IPO 窗口期。CNBC
  • Fidji Simo 卸任全职,转任兼职顾问:OpenAI 应用业务 CEO Fidji Simo 宣布因慢性病康复需要退出全职岗位,改任兼职顾问,将继续参与 AI 与健康相关工作。发布 ChatGPT Work 后第二天官宣,应用业务领导层再度变动。@fidjissimo
  • Bio Bug Bounty 转为私有长期项目,奖金翻倍至 5 万美元:专门征集针对预设生物安全挑战的通用越狱;另自 9 月 1 日起,「网络安全可信访问」成员访问最强网络能力模型需使用硬件安全密钥。OpenAI | @cryps1s
  • GPT-5.6 用量两次重置、UI 修正路线图公布:详见深度阅读区 GPT-5.6 条目。@thsottiaux
  • 德国电信案例:用 AI 重构电信业务:OpenAI 发布 Deutsche Telekom 企业案例(7 月 10 日),常规客户故事。OpenAI

Google DeepMind / Gemini

  • 新版 Siri 今秋改用 Gemini:苹果确认弃用 ChatGPT,Google 拿下 iPhone 的 AI 入口——消费分发格局最大的一次易手。CNN
  • Google 启动 Africa Applied AI Lab:向非洲研究者和创业者提供 AI 技术早期访问与 Google 专家直接技术指导。Medium 周报汇总
  • Gemini 3.5 Pro 仍按计划 7 月 17 日发布(此前已报道,与 WAIC 撞期,下周为密集发布周)。AIToolsRecap

Anthropic / Claude

  • Claude Code 桌面版内置浏览器:Anthropic 为 Claude Code 桌面版上线 in-app browser,Claude 可在应用内直接浏览文档和网站,减少上下文切换。@ClaudeDevs
  • Fable 5 额度重置:GPT-5.6 发布当天,Anthropic 重置了 Fable 5 使用额度,量子位以《GPT-5.6 一发布,Claude 终于舍得重置 Fable 5 额度了》调侃这场贴身竞争。量子位

国内大厂动态

  • 中国首个十万卡集群落成(详见深度阅读区):中科曙光曙光 8000,全国产芯片,超智融合。量子位
  • 生数科技 Vidu S1(详见深度阅读区):实时交互视频生成登顶 HF 热榜。爱范儿
  • DeepSeek V4 正式版 7 月中旬上线,将实行峰谷定价:腾讯云披露 V4 正式版「原厂直供」计划 7 月中上线;官方峰谷定价方案为高峰时段(9:00-12:00、14:00-18:00)价格翻倍,V4 Pro 高峰输出 12 元/百万 token。用行政手段调节推理负载,国内大模型定价进入「电网模式」。新浪财经 | 新浪财经(峰谷定价)
  • 具身数据行业深观察:近百玩家、一年融资 44.7 亿:量子位盘点具身智能数据赛道十大现状——采集厂、标注厂、仿真数据商涌入,但「靠卖数据赚钱」的商业模式尚未跑通。量子位
  • 许锦波团队 MoleculeOS 正式开放:分子之心把 AI 生物研发做成「操作系统」,AI 从工具变为研发流程的组织者,覆盖蛋白设计全链路。量子位
  • 英伟达 RTX Spark 真机现身 Bilibili World:CPU 与 GPU 直接合封,笔记本形态跑 120B 大模型,「超级芯片」进入消费级落地阶段。量子位
  • 中国「拟人化 AI」合规期限 7 月 15 日到期:字节、阿里已确认合规,下周关注应用商店的第三方下架与执法动作。AIToolsRecap

AI 研究前沿

以下来自 HuggingFace 7 月 10 日论文热榜(7 月 11 日周六无更新)。

  • Vidu S1 论文(详见深度阅读区):实时交互视频生成模型,当日热榜第一(119 票)。HuggingFace
  • Video-Oasis:一半视频基准不看视频也能做对(Rethinking Evaluation of Video Understanding):诊断发现现有视频理解基准约半数题目无需视觉输入即可解出,暴露当前视频模型能力评估的严重失真——「视频理解很强」的结论可能建立在有漏洞的考卷上。热榜第二(50 票)。HuggingFace
  • UniClawBench:主动式智能体的真实任务基准(A Universal Benchmark for Proactive Agents on Real-World Tasks):用 Docker 容器实时评测 + 多角色闭环评估,测「主动发现该干什么」而非「照指令干活」,切中 Agent 落地的关键盲区。HuggingFace
  • Jet-Long:动态双焦 RoPE 的零样本长上下文扩展(Efficient Long-Context Extension with Dynamic Bifocal RoPE):零训练动态调整缩放因子 + 双焦注意力,跨序列长度保持性能。HuggingFace
  • LLM-as-a-Verifier:重复采样 + 分数对数概率排序,在 Terminal-Bench V2、SWE-Bench Verified、RoboRewardBench、MedAgentBench 上报告 SOTA——「验证器比生成器好训」的又一佐证。论文讨论
  • Unsloth 发布 Qwen3.6 NVFP4 量化:宣称推理最快提速 2.5 倍,27B 可跑 24GB 显存,35B-A3B 在 B200 上达 17,561 tok/s(主要惠及 Blackwell 架构)。Unsloth

行业观点与解读

  • 「真正的产品是 harness」成为共识话题:Perplexity CEO Arav Srinivas 称模型之上的「挽具」(路由、记忆、工具调用、安全栏、企业上下文)才是产品本体;LangChain 同期发布 Deep Agents 组合,OpenWiki(主动记忆)、OpenSWE 等编排工具密集涌现。前沿模型能力趋同背景下,价值向 harness 层迁移的信号越来越密。smol.ai 汇总 | @dee_bosa
  • GPT-5.6 健康能力的医生盲评:Karan Singhal 披露在 2 万次维度评分的盲评中,医生发现 GPT-5.6 回答的缺陷少于医生自撰回答;Luna 最低推理档即超 GPT-5.5 最高档且成本低 25 倍。健康正在成为一线实验室的正式产品垂直。@thekaransinghal | OpenAI
  • GLM-5.2 遭外媒「恐慌式」报道引发反弹:Futurism 称开源 GLM-5.2「任何硬件都能跑、无厂商拦截层、擅长挖漏洞」,r/LocalLLaMA 社区反驳其硬件门槛描述严重失实,并主张「用同等强度的模型做防御」而非限制开源。开源安全叙事的攻防战仍在继续。Reddit 讨论
  • KOL 博客动态:苏剑林(最新 7 月 6 日)、Karpathy、Ethan Mollick、Raschka、Import AI(最新 464 期,7 月 6 日)过去 48 小时均无更新;Simon Willison 周末仅发布 sqlite-utils 4.1 工具更新。科学空间 | Simon Willison

值得关注的视频

  • B站 AI 日报(灵感港)周末期:覆盖苹果诉 OpenAI、SK 海力士上市等热点的中文快讯,几分钟过完当日要闻(本期具体链接以频道最新为准)。Bilibili 频道
  • 核心访谈播客(Dwarkesh、Latent Space、No Priors、Lex Fridman)过去 48 小时无新发布;Latent Space 最新为 7 月 8 日 Satya Nadella 专访(前期简报已覆盖)。Latent Space

灵感种子

以下是今日简报中值得进一步思考的灵感种子。

「合作协议里的 IP 边界」将成为 AI 行业的高频法律战场:苹果诉 OpenAI 的核心指控全部围绕「人」——面试带零件、离职规避审查、带走笔记本。当模型公司纷纷垂直整合进硬件、硬件公司反向做模型,2024-2025 年签下的那批合作协议正在变成互相起诉的证据库。对创业者的启示很具体:从大厂挖人时的合规流程设计,本身就是一个尚未被工具化的空白市场。

AI 基建的「证券化时刻」值得两面看:SK 海力士按成长股定价上市成功,等于市场公开接受「AI 支出结构性论」。这为 Anthropic/OpenAI 的 IPO 铺平道路,但也意味着这个假设第一次有了每天交易的价格——一旦任何前沿实验室的资本开支放缓,传导链会比以往任何一轮科技周期都更快、更公开。关注 7 月 14 日 SKHY 期权上市后的隐含波动率。

实时交互视频可能先于具身智能兑现商业价值:Vidu S1 把「语音 → 视觉行为」做成实时闭环且可跑消费级显卡,意味着直播数字人、AI 陪伴、互动教学的成本结构将被重写。与蚂蚁 LingBot 的「视频模型当机器人大脑」路线对照:同一套视频生成技术栈,交互娱乐的变现在前、机器人落地在后——「以虚养实」可能是视频基模公司的普遍路径。

Agentic 产品需要「成本安全栏」这个新品类:GPT-5.6 的 spawn_agent 默认继承 Sol Ultra 配置导致用量爆炸,本质是权限系统缺了「预算」这个维度。当子智能体可以再生成子智能体,成本控制需要类似 IAM 的层级化管控(每任务预算、自动降档、成本审计)。这是 harness 层里最刚需、也最容易被忽视的一块。


生成时间:2026-07-12 12:11 | 下次更新:明日 9:00