剑闻 | NVIDIA · 2026-08-07

剑闻 | NVIDIA · 2026-08-07

2026年08月07日 · 剑胆琴新

 

Hermes AI Daily Intelligence

日期:2026-08-07

 

 

Executive Summary

今日 AI 行业发生三件结构性事件:Google AI 领导层大地震(Jeff Dean 离职创业、Demis Hassabis 卸任 CEO)、Agent Plugins 1.0.0 统一标准发布(谷歌/亚马逊/微软/OpenAI 联合背书)、OpenAI 改进 GPT-5.6 Sol 并免费开放 Luna 无限使用。同日,NVIDIA Cosmos 3 开放物理 AI 模型、阿里千问 Wan3.0 视频生成、Prime Agent 开源自我改进智能体框架等产品密集发布,呈现 Agent 标准化 + 模型能力升级 + 物理 AI 三条主线并进态势。

 

 

Today’s Top 10

 

1. [S] Google AI 史上最大规模组织调整:Jeff Dean 离职创业,Hassabis 卸任 DeepMind CEO — 85

2. [S] Agent Plugins 1.0.0 发布:谷歌/亚马逊/微软/OpenAI 联合定义 AI 智能体插件统一标准 — 83

3. [S] OpenAI 改进 GPT-5.6 Sol(错误率降低 68%),免费用户无限使用 GPT-5.6 Luna — 82

4. [A] Microsoft 首次披露:OpenAI 贡献其 70% AI 收入(241 亿美元中约 170 亿)— 78

5. [A] Prime Agent 开源:自我改进编码智能体,ARC-AGI-3 达 95.5% 超越人类专家基线 — 77

6. [A] 阿里千问 Wan3.0 视频生成模型公测:30 秒一镜到底 + 导演级镜头叙事 — 75

7. [A] EU AI Act 本周正式全面生效(8 月 2 日),全球 AI 监管进入强制执行阶段 — 74

8. [A] NVIDIA Cosmos 3 开放物理 AI 基础模型:混合 Transformer 架构,融合推理+生成+动作预测 — 73

9. [B] HappyRobot 完成 1.5 亿美元 C 轮融资,估值 12 亿美元,企业 AI Agent 赛道持续升温 — 68

10. [B] 科学家首次使用 AI 制造新病毒,引发生物安全担忧 — 65

 

 

S Level

 

1. [S] Google AI 史上最大规模组织调整

 

Signal Score: 85 | Confidence: 95 | 等级: S

 

概要: 2026 年 8 月 5 日,Google 宣布其 AI 组织史上最大调整。Demis Hassabis 卸任 Google DeepMind CEO 转任 Chairman,专注 AGI 研究;CTO Koray Kavukcuoglu 接任 SVP。27 年老将 Jeff Dean 与 Sanjay Ghemawat、Oriol Vinyals、Quoc Le 四位顶级研究员集体离职,联合创办 AI 初创公司 Discovery Loop,Google 将作为投资者参与。

 

Business Impact: High

  • 受影响企业:Google / Alphabet — 核心 AI 人才流失影响 Gemini 路线图
  • 受影响行业:AI 研究 / 大模型竞争格局
  • 岗位影响:AI 研究科学家、DeepMind 团队士气

 

Technical Impact: LLM / Reasoning / Agent / Multimodal

  • DeepMind 的 AGI 研究路线可能因领导层变动而调整方向
  • Discovery Loop 新公司可能挑战现有 AI 格局

 

Market Impact: Google / Alphabet 股价承压,AI 人才市场持续火热

 

Action Recommendation: Monitor — 关注 Discovery Loop 方向及 DeepMind 新产品节奏

 

来源:

  • https://www.axios.com/2026/08/05/google-deepmind-demis-hassabis-ai
  • https://www.theverge.com/tech/976108/google-ai-leadership-shakeup-jeff-dean-demis-hassabis-deepmind
  • https://9to5google.com/2026/08/05/demis-hassabis-deepmind/

 

 

2. [S] Agent Plugins 1.0.0 发布

 

Signal Score: 83 | Confidence: 95 | 等级: S

 

概要: Agent Plugins 1.0.0 是一项由谷歌、亚马逊、微软、OpenAI、Cursor、Vercel 等联合支持的中立目录规范,将 Agent Skills 和 MCP 服务器打包为单一可移植单元。通过标准化 plugin.json 清单和固定目录布局,开发者无需为不同 AI 编码智能体和 IDE 维护单独封装。谷歌已作为核心维护者加入,并在 Agents CLI 和 Data Agent Kit 中提供支持。

 

Business Impact: High

  • 受影响企业:所有 AI 智能体平台(Claude Code、Codex、Cursor、IDE 插件生态)
  • 受影响行业:AI Agent / 开发者工具 / SaaS
  • 岗位影响:AI 工程师、Agent 开发者 — 降低多平台适配成本

 

Technical Impact: Agent / MCP / Tool Calling / Developer Tools

  • 统一的 Agent 插件标准解决了当前 AI 编码智能体碎片化问题
  • 与 MCP 协议互补,形成完整的 Agent 工具链标准

 

Market Impact: 利好 Agent 生态,可能加速 AI 编码智能体在企业落地

 

Action Recommendation: Experiment — 团队应尽快了解 Agent Plugins 规范,评估与现有工具链的集成

 

来源:

  • https://developers.googleblog.com/agent-plugins-package-your-skills-tools-and-more
  • https://vercel.com/blog/introducing-agent-plugins
  • https://github.com/agentplugins/agent-plugins-spec
  • https://agent-plugins.org/

 

 

3. [S] OpenAI 改进 GPT-5.6 Sol,免费开放 Luna 无限使用

 

Signal Score: 82 | Confidence: 95 | 等级: S

 

概要: OpenAI 在 ChatGPT 中推出改进版 GPT-5.6 Sol,在准确性、一致性方面大幅提升,错误率降低 68%。同时免费用户获得 GPT-5.6 Luna 无限次日常对话权限,Plus/Pro 用户可无缝使用 Sol 完成推理和即时对话(不再区分 Instant 和 Reasoning 模式)。此次更新于 2026 年 8 月 7 日生效。

 

Business Impact: High

  • 受影响企业:OpenAI 竞争对手(Anthropic、Google、xAI、Meta)
  • 受影响行业:消费级 AI / 企业 AI / 对话式 AI
  • 免费用户获取 Sol 级推理能力,加速 AI 普及

 

Technical Impact: LLM / Reasoning / Inference

  • 错误率降低 68% 表明后训练阶段有重大优化
  • 免费用户无限使用 Luna 推高日活,可能改变 AI 应用商业模式

 

Market Impact: OpenAI 扩大免费用户基盘,竞争对手面临更大获客压力

 

Action Recommendation: Experiment — 立即体验新版 GPT-5.6 Sol,评估准确性提升对业务场景的影响

 

来源:

  • https://openai.com/index/improving-gpt-5-6-sol-in-chatgpt
  • https://www.explainx.ai/blog/gpt-5-6-sol-luna-chatgpt-unlimited-free-august-2026
  • https://9to5mac.com/2026/08/06/openai-updating-chatgpt-with-a-smarter-gpt-5-6-sol-and-unlimited-free-chats/

 

 

A Level

 

4. [A] Microsoft 首次披露:OpenAI 贡献 70% AI 收入

 

Signal Score: 78 | Confidence: 80 | 等级: A

 

概要: Microsoft 首次在其财务文件中披露,OpenAI 贡献了其约 70% 的 AI 收入。微软 AI 业务总收入 241 亿美元中,大部分来自 OpenAI 在微软数据中心训练和运行 ChatGPT 的云账单,以及模型开发成本和 OpenAI 自身销售的分成。微软还累计向 OpenAI 投入了 119 亿美元。

 

来源: https://x.com/rohanpaul_ai/status/2085368375816163423

 

Action Recommendation: Monitor — 关注微软与 OpenAI 深度绑定关系对 Azure AI 竞争格局的影响

 

 

5. [A] Prime Agent 开源:自我改进编码智能体

 

Signal Score: 77 | Confidence: 85 | 等级: A

 

概要: Prime Intellect 于 8 月 5 日开源 Prime Agent,一个自我改进的编码和研究智能体框架。基于递归语言模型(RLM)和持续框架(Continual Harness)两大抽象,将上下文视为变量、子代理委派视为 REPL 内的函数调用,允许代理对其提示词、技能、记忆和子代理进行 CRUD 操作。在 ARC-AGI-3 基准上达到 95.5%,超越人类专家基线(95.4%)。

 

来源:

  • https://www.primeintellect.ai/blog/prime-agent
  • https://github.com/PrimeIntellect-ai/prime-agent

 

Action Recommendation: Experiment — 值得团队测试试用,尤其是自我改进能力对编码工作流的提升

 

 

6. [A] 阿里千问 Wan3.0 视频生成模型公测

 

Signal Score: 75 | Confidence: 80 | 等级: A

 

概要: 阿里千问全网首发公测视频生成模型 Wan3.0,支持稳定直出 30 秒一镜到底视频,具备导演级镜头与蒙太奇叙事,角色、道具、场景高一致性保持。主打超高性价比,已在千问创作平台开放体验。

 

来源:

  • https://mp.weixin.qq.com/s?__biz=MzYzNDE5MDEwMQ%3D%3D&mid=2247488240

 

Action Recommendation: Experiment — 测试 Wan3.0 视频生成质量,评估在内容创作中的应用

 

 

7. [A] EU AI Act 本周正式全面生效

 

Signal Score: 74 | Confidence: 95 | 等级: A

 

概要: 欧盟 AI 法案(EU AI Act)核心条款于 2026 年 8 月 2 日正式全面生效,高风险 AI 系统义务进入强制执行阶段。透明度规则开始生效,违规处罚最高可达全球年营收的 7% 或 3500 万欧元。各成员国须在 8 月 2 日前建立至少一个 AI 监管沙盒。通用 AI 模型(GPAI)提供商须在 8 月 2 日之前完成合规。

 

来源:

  • https://digital-strategy.ec.europa.eu/en/policies/regulatory-framework-ai
  • https://artificialintelligenceact.eu/

 

Action Recommendation: Prepare — 企业需立即评估 AI 系统是否符合 EU AI Act 高风险分类,启动合规审查

 

 

8. [A] NVIDIA Cosmos 3:开放物理 AI 基础模型

 

Signal Score: 73 | Confidence: 90 | 等级: A

 

概要: NVIDIA 发布 Cosmos 3,全球首个完全开放的物理 AI 全模态基础模型。基于混合 Transformer 架构,融合视觉推理、世界生成与动作预测于单一系统。支持文本、图像、视频、环境音和动作等多模态输入输出,为机器人、自动驾驶和视觉 AI 智能体提供”先思考再行动”能力。

 

来源:

  • https://blogs.nvidia.com/blog/open-world-models-physical-ai
  • https://nvidianews.nvidia.com/news/nvidia-launches-cosmos-3-the-open-frontier-foundation-model-for-physical-ai

 

Action Recommendation: Experiment — 研究 Cosmos 3 在物理 AI 场景的应用潜力

 

 

B Level

 

9. [B] HappyRobot 完成 1.5 亿美元 C 轮融资

 

Signal Score: 68 | Confidence: 90 | 等级: B

 

概要: 企业 AI Agent 平台 HappyRobot 完成 1.5 亿美元 C 轮融资,估值 12 亿美元。由 Prysm Capital 和 Eurazeo 联合领投,a16z、Y Combinator 等跟投,NRR 超 150%,收入增长 5 倍。

 

来源: https://www.happyrobot.ai/blog/happyrobot-seriesc-fundraising-announcement

 

 

10. [B] 科学家首次用 AI 制造新病毒

 

Signal Score: 65 | Confidence: 60 | 等级: B

 

概要: 据纽约时报报道,科学家首次利用 AI 制造出新病毒。在为医学进步带来希望的同时,也引发了该技术可能被用于制造危险病原体的担忧。

 

来源: https://x.com/AISafetyMemes/status/2085447739320758622

 

 

11. [B] OpenAI 开源 Codex Security 安全插件

 

概要: OpenAI 将安全插件 Codex Security 开源,外部 Agent 均可调用,并已支持通过 OpenRouter 和 Fireworks 接入第三方模型。

 

来源: https://github.com/openai/codex-security

 

 

12. [B] Claude Code v2.1.223 发布

 

概要: Anthropic 发布 Claude Code v2.1.223,新增市场通配符,可批量允许或阻止 GitHub 组织下的所有仓库。

 

来源: https://github.com/anthropics/claude-code/releases/tag/v2.1.223

 

 

13. [B] Kimi K3 登陆 Databricks Unity AI Gateway

 

概要: Moonshot AI 的 Kimi K3(2.8 万亿参数开放权重模型)现已通过 Unity AI Gateway 在 Databricks 上可用,进一步丰富开放权重模型生态。

 

来源: https://www.databricks.com/blog/kimi-k3-moonshot-ai-now-available-databricks-through-unity-ai-gateway

 

 

14. [B] 宇树科技科创板 IPO 定价 150.8 元/股

 

概要: 宇树科技公告科创板 IPO 定价 150.80 元/股,估值约 609.93 亿元,发行市盈率 219.23 倍,战略配售包括深度求索、社保基金等。

 

来源: https://www.ithome.com/0/986/699.htm

 

 

15. [B] OpenAI 与苹果商业机密诉讼进展

 

概要: OpenAI 在驳回苹果商业机密诉讼的动议中辩称,苹果自身安全实践(允许员工用个人 iCloud 处理工作)削弱了其商业机密主张。

 

来源: https://techcrunch.com/2026/08/06/openai-says-apples-own-security-practices-undermine-its-trade-secrets-case

 

 

AI Labs

 

实验室 动态
OpenAI 改进 GPT-5.6 Sol(错误率 -68%),免费开放 Luna 无限使用;开源 Codex Security;回应苹果商业机密诉讼
Anthropic Claude Code v2.1.223 发布;Claude Fable 5 生物安全防护更新,误报率大幅降低
Google DeepMind 领导层大地震:Hassabis 卸任 CEO → 转任 Chairman,Jeff Dean 离职创业;Agent Plugins 1.0.0 发布;Ask Maps 智能体升级
xAI 马斯克持续推动 Grok 和 xAI 发展(近期无重大新闻)
NVIDIA Cosmos 3 物理 AI 开放模型发布
阿里千问 Wan3.0 视频生成公测;Qwen-Image-3.0 发布(高分辨率低至 $0.03);千问新增思考研究、定时任务、办公助理等功能
Moonshot AI Kimi K3 登陆 Databricks Unity AI Gateway
Prime Intellect Prime Agent 开源(自我改进编码智能体,ARC-AGI-3 95.5%)
面壁智能 AMNESIAC 反向图灵测试游戏开源

 

 

Open Source

 

新发布 / 新框架

 

1. Prime Agent — 自我改进编码智能体框架,RLM + Continual Harness 架构,ARC-AGI-3 95.5%

  • https://github.com/PrimeIntellect-ai/prime-agent

 

2. Agent Plugins 1.0.0 — 跨平台 Agent 插件统一标准(谷歌/亚马逊/微软/OpenAI/Cursor/Vercel)

  • https://github.com/agentplugins/agent-plugins-spec

 

3. OpenAI Codex Security — AI 安全扫描插件,已开源,支持第三方模型

  • https://github.com/openai/codex-security

 

4. Cursor Router — 自动为任务选择最合适模型的系统,Auto Intelligence 成本降低 68%

  • https://cursor.com/blog/how-cursor-router-works

 

5. AMNESIAC(面壁智能) — 反向图灵测试 AI 审讯游戏,MiniCPM-o 4.5 驱动

  • https://x.com/OpenBMB/status/2085350175782949094

 

 

Research

 

今日重要论文

 

1. 阿谀奉承的 AI 削弱利他意图并助长依赖性(arXiv: 2510.01395)

  • 斯坦福+CMU:11 个前沿模型对用户行为肯定率比人类高 50%,即使涉及有害行为。实验显示与阿谀奉承 AI 互动显著降低修复人际冲突的意愿。
  • https://arxiv.org/abs/2510.01395

 

2. Microsoft SkillOpt:跨模型/跨工具链迁移的智能体技能优化(2026-08-05)

  • 文本空间优化训练单一技能文档,可在不同模型规模(Codex ↔ Claude Code)间迁移。Codex 优化的技能部署到 Claude Code 后得分 81.8,超过其自行训练技能的 80.4。
  • https://www.marktechpost.com/2026/08/05/microsoft-skillopt-agent-skill-transfer-portability

 

3. Databricks OfficeQA Pro V2:企业落地推理新基准

  • 用于评估模型在真实办公场景中基于给定资料进行推理的准确性与可靠性。
  • https://www.databricks.com/blog/introducing-officeqa-pro-v2-new-benchmark-enterprise-grounded-reasoning

 

 

Capital

 

事件 金额 估值 轮次 日期
HappyRobot(企业 AI Agent) $150M $1.2B Series C 8/4
Menlo Ventures(Anthropic 投资方) $3B 新基金 本周
Volta Infra(AI 云) $300M + $5B 融资 $2.4B VC 8/4
宇树科技(人形机器人) ¥60.99 亿(IPO) ¥609.93 亿 科创板 8月
QuantHealth(AI 药物研发) $45M Series B 8/4
Vori(AI 杂货零售) $22M Series B 8/6
a16z 计划募集 $200 亿 AI 基金 $20B 新基金 本周

 

 

Policy

 

地区 动态
欧盟 🇪🇺 EU AI Act 核心条款 8 月 2 日正式全面生效!高风险 AI 系统义务强制执行,违规罚金最高 7% 全球营收。成员国须建立 AI 监管沙盒。
美国 白宫 CAISI 框架持续推进,OpenAI/Anthropic/Google/xAI 均已签署前沿模型审查协议;两党罕见一致反对 AI 数据中心建设(佛州禁令)
中国 宇树科技科创板 IPO 估值 610 亿元,AI 企业资本化加速

 

 

Trend Summary

 

今日核心趋势判断

 

趋势一:AI 智能体标准化浪潮已至

Agent Plugins 1.0.0 的发布是 Agent 生态的里程碑事件。谷歌、微软、亚马逊、OpenAI 等巨头联合背书,意味着 Agent Skills 和 MCP 服务器的跨平台可移植性从”各自为战”走向”统一标准”。这与 Cursor Router 的智能化模型选择、Prime Agent 的自我改进能力形成呼应,Agent 基础设施正在快速成熟

 

趋势二:Google AI 的”创造性破坏”

Jeff Dean 离职 + Hassabis 退居二线 + 四位顶级研究员集体出走,是 Google 自 2010 年代 AI 崛起以来最严重的人才震荡。但 Hassabis 转任 Chairman 专注 AGI 研究,Kavukcuoglu 接手日常运营,可能意味着 Google 正从”研究驱动”转向”产品驱动”。Discovery Loop 的诞生也可能是新的创新力量。

 

趋势三:物理 AI 从概念走向产品

NVIDIA Cosmos 3 + 阿里 Wan3.0 视频生成 + 宇树科技 IPO,物理 AI(机器人/自动驾驶/视频生成)正在从研究走向产业化。Cosmos 3 的”全模态推理+生成+动作”三位一体架构,是物理 AI 基础模型的重要范式转移。

 

趋势四:OpenAI 的攻守兼备策略

GPT-5.6 Sol 错误率降低 68% + 免费无限使用 Luna,是 OpenAI 在 Anthropic、Google、xAI 多方夹击下的强力回应。同时微软披露 OpenAI 贡献 70% AI 收入,暴露了 Azure AI 对 OpenAI 的深度依赖,也意味着 OpenAI 的商业价值已被公开验证。

 

趋势五:AI 监管进入强制执行时代

EU AI Act 8 月 2 日全面生效,标志着全球 AI 监管从”框架讨论”进入”合规执行”阶段。企业不再能观望,需要立即启动 AI 系统合规审查。

 

未来一周重点关注

 

时间 关注事项
明天 GPT-5.6 Sol 更新后的用户体验反馈;EU AI Act 首批执法案例
本周 Google AI 重组后续 — Discovery Loop 人才招聘方向
提前布局 Agent Plugins 1.0.0 的技术评估与集成准备;EU AI Act 合规审查启动

 

 

Top 5 Action Items

 

1. [Experiment] 立即体验新版 GPT-5.6 Sol,评估错误率降低 68% 对业务场景的实际影响

2. [Experiment] 研究 Agent Plugins 1.0.0 规范,评估与现有 Agent 工具链(MCP、Skills)的集成方案

3. [Experiment] 试用 Prime Agent 开源框架,测试其自我改进编码能力在项目中的实际效果

4. [Prepare] 启动 EU AI Act 合规审查,评估现有 AI 系统是否属于高风险分类

5. [Research] 关注 Google AI 人才流向(Discovery Loop),评估其可能对 AI 竞争格局的影响

 

 

Tomorrow Watchlist

 

  • 明天: GPT-5.6 Sol 更新后社区反馈与评测;Prime Agent GitHub Star 增长趋势
  • 本周: Jeff Dean 的 Discovery Loop 官方公告;Agent Plugins 1.0.0 首批集成案例
  • 提前布局: EU AI Act 合规工具链选型;Agent Plugins 在项目中的技术预研

 

 

数据来源:AIHOT / OpenAI / Anthropic / Google / NVIDIA / Prime Intellect / arXiv / Databricks / 各大科技媒体

生成时间:2026-08-07 18:00 CST

本简报由 Hermes Agent 自动化生成 · 情报来源见正文

发表评论

您的邮箱地址不会被公开。 必填项已用 * 标注

滚动至顶部