跳转至

AI 每日简报 | 2026-06-30

今日概览

AI 模型管控成为本周主旋律:美国政府首次对前沿模型实施审批制度,OpenAI GPT-5.6 和 Anthropic Fable 5/Mythos 5 均受影响。与此同时,DeepSeek 官宣 V4 正式版 7 月中旬发布,智谱 GLM-5.2 开源登顶,中国 AI 公司在开源和商业化上持续发力。

  • DeepSeek 宣布 7 月中旬发布 V4 正式版,DSpark 推理加速框架已开源
  • OpenAI GPT-5.6 Sol/Terra/Luna 受限预览,仅约 20 家政府批准企业可用
  • Anthropic Fable 5 有望 7 月初解禁,Mythos 5 已向约 100 家组织恢复访问
  • 智谱 GLM-5.2 开源登顶开源模型榜首,MIT 许可
  • OpenAI 发布欧盟 AI 劳动力报告,分析 AI 对欧洲就业的影响

深度阅读推荐

⭐ 美国政府首次对前沿 AI 模型实施审批准入制度

OpenAI 的 GPT-5.6 Sol 和 Anthropic 的 Fable 5/Mythos 5 同时成为美国政府模型管控的首批对象。特朗普政府要求 AI 公司在发布具有高级网络能力的模型前给予政府最多 30 天的预审权。这标志着 AI 监管从硬件层面(芯片出口管制)升级到了模型权重层面,是 AI 治理的分水岭事件。

核心观点:前沿模型正在变成一种「许可证商品」——谁能用、什么时候用,由政府而非市场决定。这种模式若长期化,将根本改变 AI 公司的商业模式和全球竞争格局。

来源:OpenAI 博客 | TechCrunch | 新浪科技

⭐ DeepSeek V4 正式版 7 月中旬发布,DSpark 框架推理提速 60-85%

DeepSeek 宣布将于 7 月中旬发布 V4 正式版并同步更新定价策略。与此同时,DSpark 推理加速框架已开源,采用半自回归生成和置信度调度验证方法,在 V4-Flash 上实现 60-85% 的单用户生成加速,V4-Pro 上实现 57-78% 的加速。

核心观点:DSpark 的核心贡献不在模型架构,而在推理系统工程——通过推测解码(speculative decoding)大幅降低 GPU 空转时间。这与 DeepSeek 一贯的「用工程优化弥补算力差距」战略一脉相承。

来源:B站 AI 日报第 441 期 | VentureBeat | MarkTechPost

⭐ 智谱 GLM-5.2 开源登顶,编程能力超越 GPT-5.5

智谱 6 月正式发布并开源 GLM-5.2(754B 参数,A40B 激活),MIT 许可,支持 100 万 token 上下文。在全球权威编程和综合能力评测中稳居开源模型第一名,编程能力直接对标 Claude Opus 4.8。

核心观点:GLM-5.2 以 MIT 许可开源且性能登顶,标志着中国 AI 公司在开源模型领域从追赶者转为领跑者。结合智谱市值重回万亿港元,「开源 + 商业化」的双轮驱动模式初见成效。

来源:知乎 | OSCHINA | 极道


OpenAI

欧盟 AI 劳动力报告发布(Mapping Europe's AI Workforce Opportunity)

OpenAI 发布了一份新报告,分析 AI 可能如何重塑欧盟的就业市场,标注了哪些职业可能面临自动化、增长或工作流程变化。这是 OpenAI 在全球政策领域的持续布局。

来源:OpenAI 博客

HP 启动 Frontier 战略合作伙伴关系

HP Inc. 将 OpenAI Frontier 合作伙伴关系扩展至客户体验、软件开发和企业运营等领域的 AI 部署。

来源:OpenAI 博客

GPT-5.6 Sol/Terra/Luna 受限预览(回顾)

6 月 26 日发布的 GPT-5.6 系列包含 Sol(旗舰,\(5/\)30 每百万 token)、Terra(均衡,\(2.50/\)15)和 Luna(快速,\(1/\)6)。OpenAI 表示已配备最强安全栈,但在政府要求下仅向约 20 家经审批的企业开放预览。OpenAI 明确表示不认为「政府审批准入应成为长期默认模式」。⭐ 深度推荐(详见深度阅读区)

来源:OpenAI 博客 | Fortune


Google DeepMind / Gemini

Gemini 3.5 Flash 正式发布

Gemini 3.5 Flash 已作为 GA 版本发布,定位为在 Agent 和编程任务中提供持续前沿性能的最智能模型。速度保持 Flash 系列水准,智能表现在多个维度上媲美大型旗舰模型,并在关键基准上超越 Gemini 3.1 Pro。

来源:Google AI for Developers

Gemini Omni 发布

Gemini Omni 是一款多模态模型新突破,支持从任意输入生成任意输出(starting with video),在世界理解、多模态和编辑能力上实现跨越。

来源:Google Cloud Blog

Gemini 3 Deep Think 向 AI Ultra 用户推出

Gemini 3 Deep Think 作为 Google 的顶级推理模式,专攻数学、科学、逻辑和复杂多步骤问题,已开始向 Google AI Ultra 订阅用户推出。

来源:Google DeepMind Blog


Anthropic / Claude

Fable 5 有望 7 月初解禁

多家媒体报道,特朗普政府预计将很快恢复 Anthropic Claude Fable 5 的公开访问,最快可能在 7 月初。Fable 5 于 6 月 10 日发布后仅三天即因美国商务部出口管制令被迫全球下线。⭐ 深度推荐(详见深度阅读区)

来源:新浪科技 | GIGAZINE | InfoQ

Mythos 5 已向约 100 家组织恢复访问

6 月 26 日,美国商务部批准 Anthropic 将 Mythos 5 部署给一组约 100 家公司和联邦机构,包括多家财富 500 强企业。Mythos 5 是 Anthropic 最强大的网络安全模型。

来源:CNBC

Claude 企业功能更新

Claude 现允许企业用户在 Slack 中直接 @Claude 来委派任务。同时新增了企业级 MCP 连接器管理功能(首先支持 Okta),管理员可通过身份提供商为整个组织统一配置 MCP 连接器。

来源:Anthropic 新闻


国内大厂动态

DeepSeek:V4 正式版 7 月中旬发布 + 大规模扩招

DeepSeek 宣布 V4 正式版将于 7 月中旬发布,同步更新定价策略。此前 6 月 15 日,DeepSeek 已官宣完成首轮外部融资超 510 亿元(投后估值 3500-4000 亿元),创全球 AI 单轮融资纪录。6 月 25 日启动成立以来最大规模扩招,33 类岗位全开。⭐ 深度推荐(详见深度阅读区)

量子位分析文章《Claude Mythos 让梁文锋决定融资》指出,Anthropic Mythos 级别模型的出现加速了 DeepSeek 的融资决策——不储备弹药无法打持久战。

来源:B站 AI 日报第 441 期 | IT之家 | 量子位

月之暗面/Kimi:估值 300 亿美元融资 + Kimi Work Beta

月之暗面正寻求新一轮最高 20 亿美元融资,估值 300 亿美元,6 个月内第三轮融资。ARR 在 3 月突破 1 亿美元,4 月达 2 亿美元以上。6 月初 Kimi Work Beta(本地 Agent)开启内测,K2.7 Code 编程模型已开源。

来源:新浪财经 | 新浪科技

豆包/字节:Doubao-Seed-2.1 Agent 模型发布

豆包发布 Doubao-Seed-2.1 Agent 模型(Pro 和 Turbo 两版),面向 Coding 和 Agent 时代。通用 Agent 能力、Coding 端到端交付和多模态理解三大核心能力全面升级。日均调用量已突破 120 万亿 Tokens。

来源:DoNews

智谱:GLM-5.2 开源登顶

GLM-5.2(754B/A40B)6 月正式开源,MIT 许可,编程能力在开源模型中排名第一。Z.ai(原智谱 AI)GLM-5.2 以 51 分登顶开源权重模型榜首,大幅领先 MiniMax-M3(44 分)和 DeepSeek V4 Pro(44 分)。⭐ 深度推荐(详见深度阅读区)

来源:知乎 | OSCHINA

阿里千问:Qwen3.7 系列

Qwen3.7 系列 5 月底发布,Max 版综合评分 1284 分超越 GPT-5.5。最大技术突破为「全域思考模式」(文本+图像+代码统一推理链)。618 期间推出 5 折等促销活动。

来源:知乎 | 阿里云开发者


AI 研究前沿

Ornith-1.0:面向 Agent 编程的自脚手架 LLM(Self-Scaffolding LLMs for Agentic Coding)

DeepReinforce 发布首个开源权重模型 Ornith-1.0(MIT 许可),包含 9B/31B Dense 和 35B/397B MoE 变体,基于 Gemma 4 和 Qwen 3.5 构建。Simon Willison 实测 35B 版本表现出色,Agent 工具调用流畅。

来源:Simon Willison's Weblog

隐空间世界模型打通长时序双向物理因果链

量子位报道了全球首个在隐空间中打通长时序双向物理因果链的世界模型。该模型由无界动力发布,与地平线、理想合作,刚融资 2 亿美元,冲到具身智能榜单第一。

来源:量子位

Agentjacking:AI 编程 Agent 面临的新安全威胁

Tenet Security 6 月 13 日披露「Agentjacking」攻击技术,利用伪造 Sentry 错误报告 + Markdown 注入劫持 Claude Code、Cursor、Codex 等 AI 编程 Agent 执行恶意命令,攻击成功率 85%,波及 2,388 个组织。

来源:BuildThisNow


行业观点与解读

Simon Willison:Ornith-1.0 开源模型评测

Simon Willison 6 月 29 日发文评测 Ornith-1.0 35B 版本,使用 LM Studio 运行 Q4_K_M 量化版(20GB),接入 Pi 开发工具。初步印象非常好——在多工具调用 Agent 场景下表现流畅,代码搜索和分析任务完成度高。

来源:Simon Willison's Weblog

Jon Udell:Agent 不是取代人的循环,而是人邀请 Agent 加入的循环

Simon Willison 引用 Jon Udell 的观点:「我不喜欢 'human in the loop' 这个说法,因为它把权威让渡给了机器。这是我们的循环,我们邀请 Agent 加入团队。」这一视角为当前 Agent 编程热潮提供了有益的纠偏。

来源:Jon Udell 博客

量子位:「词元盗用」正在成为 AI 商业化新风险

有人瞄准的不是钱,而是 Token——「词元盗用」(Token theft)正成为 AI 服务商面临的新型安全风险,文章分析了相关攻击模式和防范策略。

来源:量子位

苏剑林:矩阵函数近似中的暴力美学(6月25日)

苏剑林最新博文探讨了在 arXiv 上发布的《Muon^p: Muon with Fractional Spectral Powers》启发下,提出一套理论上可以拟合任意矩阵函数的通用近似框架。内容涉及矩阵幂的高效计算和 Newton-Schulz 迭代的推广。

来源:科学空间


值得关注的视频

B站 AI 日报第 441 期 | DeepSeek 宣布 7 月中旬发布 V4 正式版

⭐ 最新一期 AI 日报覆盖了 DeepSeek V4 正式版发布计划和定价策略更新等重要消息,是了解当日 AI 动态的高效入口。
B站链接

盘点一周 AI 大事 | GPT-5.6 逆袭 Mythos

B站 AI 周报视频,回顾本周 GPT-5.6 与 Mythos 的竞争态势和政府管控风波。
B站链接

月耗万刀实测 | 2026 年 6 月 16 款旗舰 AI 模型多维度测评

大规模横评,覆盖当前主流旗舰模型,值得关注各模型在实际使用中的差异。
B站链接

Latent Space × No Priors 联名特辑 | Satya Nadella 访谈(6月3日)

微软 CEO Satya Nadella 与 swyx、Sarah Guo、Elad Gil 对谈,讨论前沿生态构建、统一 Agent 平台和长时运行 autopilot 的愿景。推荐观看。
Latent Space


灵感种子

Agent 编程的安全盲区:Agentjacking 攻击以 85% 的成功率劫持主流编码 Agent,暴露出当前 Agent 系统在处理外部输入时缺乏有效的信任边界。随着越来越多开发者将代码库交给 Agent 自主操作,Agent 的输入验证和权限隔离机制亟需从「可选」变为「必须」。

前沿模型的「许可证化」:GPT-5.6 和 Fable 5 同时受政府管控,意味着最强模型正在从「商品」变成「战略资源」。这对依赖 API 构建产品的创业公司意味着什么?在模型访问受限的环境下,开源模型(如 GLM-5.2、Ornith-1.0)的战略价值可能被重新评估。

推理侧的工程革命:DSpark 的 60-85% 推理加速不改模型架构、不牺牲质量,纯靠推测解码和系统工程。这暗示当前 LLM 推理系统仍有巨大的工程优化空间。对于算力受限的团队,推理优化可能比模型训练更有杠杆效应。

「我们的循环,Agent 只是被邀请加入的」:Jon Udell 翻转了「human in the loop」的叙事。当前 Agent 编程热潮中,很多实践默认以 Agent 为中心、人为辅。但 Udell 提醒我们:应该是人定义工作流,Agent 作为团队成员加入——这个视角差异可能决定 Agent 工具的设计方向。


生成时间:2026-06-30 09:07 | 下次更新:明日 9:00