2026 年 7 月 23 日(周四),过去 48 小时堪称"AI 基础设施周":NVIDIA 7 月 21 日发布专为 Agentic AI 设计的 Vera CPU,AMD 7 月 22-23 日 Advancing AI 2026 大会开幕并首发 Zen 6 EPYC Venice 与 Helios AI Rack,Block 发布基于 Nostr 的开源工作空间 Buzz,Google 推出 Gemini 3.6 Flash 并确认 Gemini 4 预训练启动。四件大事集中在 AI 基础设施层,AI 产业的竞争重心正在从模型层转向基础设施层。

本文首发地址 https://h89.cn/archives/718.html

NVIDIA Vera CPU 正式发布:为 Agentic AI 打造的处理器

2026 年 7 月 21 日,NVIDIA 正式发布 Vera CPU——一款基于 Arm 架构、搭载全新 Olympus 微架构的服务器 CPU,定位为"全球首款为 Agentic AI 时代打造的处理器"。Vera 不是 Rubin GPU 平台的配角,而是 NVIDIA 独立进军 CPU 市场的产品。

Vera 采用单芯片(monolithic die)设计而非小芯片方案,配备 LPDDR5X 内存,10 路解码前端,面向不规则、分支密集、延迟敏感的软件路径优化——这正是 Agentic AI 工作负载的特征。性能方面,NVIDIA 官方数据显示:Agentic AI 任务 1.8 倍于 x86 CPU;同等功耗下能效翻倍(2 倍能效);比传统机架级 CPU 快 50%;256 台液冷 Vera CPU 可组成集群,支持 22,500+ 并发 CPU 环境。目标场景包括代码执行、工具调用、沙箱、分析、数据管道与编排,以及强化学习训练,同时减轻 GPU 的 CPU 预处理/后处理负担。

Vera CPU 是 NVIDIA Vera Rubin 平台的核心组件之一,平台包含 Vera CPU、Rubin GPU、NVLink 6 Switch、ConnectX-9 SuperNIC、BlueField-4 DPU、Spectrum-6 以太网交换机与 Groq 3 LPU,7 款芯片全部进入量产。Forbes 分析认为,NVIDIA 选择此时推出 Vera,是因为 Agentic AI 的 CPU 工作负载(代码执行、工具调用、检索增强)正在成为瓶颈。Los Alamos 国家实验室已将 Vera 用于 Veritas 超级计算机。具体定价未公布,预计与 AMD EPYC 高端型号竞争,H2 2026 开始出货。

来源:

AMD Advancing AI 2026 开幕:Zen 6 EPYC Venice 256 核 2nm 首发 + Helios AI Rack

2026 年 7 月 22 日,AMD Advancing AI 2026 在旧金山 Moscone Center 开幕,首日发布多项重磅产品,7 月 23 日 CEO Lisa Su 发表主题演讲。这是 AMD 在 AI 基础设施领域的最大规模产品发布。

EPYC Venice(Zen 6)采用 TSMC N2(2nm Gate-All-Around)制程,是业界首款进入量产的高性能计算芯片,比 Intel 和 NVIDIA 的 2nm 产品至少早一个季度;每插槽 256 核 / 512 线程;1.6 TB/s 内存带宽加 PCIe Gen 6 连接;是首个支持 SP7 平台的 EPYC 处理器;预计 Q3 2026 首批系统出货。Helios AI Rack 由 Instinct MI455X 加速器、EPYC Venice CPU、Pensando Vulcano NIC(800Gbps)组成,配备 31 TB HBM4 内存——目前业界最大的单机架 AI 内存容量,2.9 exaflops FP4 性能;采用开放标准(Open AI Rack),与 OCP 兼容,支持第三方厂商集成,定位直接对标 NVIDIA Vera Rubin 平台。

Instinct MI400 系列包含 MI430X / MI440X / MI455X 三个 SKU,MI455X 为 Helios 旗舰配置,MI440X 为 8-way UBB 盒的直接替代(兼容 MI300/350 机箱),下一代 MI500 系列已预告。发布日 AMD 股价上涨 7.63%;分析师认为 Venice 的 2nm 首发优势将"重置服务器竞赛";Goldman Sachs 目标价 $640,Stifel $635。NVIDIA 7 月 21 日发布 Vera、AMD 7 月 22 日发布 Venice,两家公司分别从 GPU 和 CPU 的起点向对方领地渗透。

来源:

  • TechTimes - "AMD Advancing AI 2026 Opens With Zen 6 Venice, Helios, and Open AI Rack Bet"(2026-07-22)
  • WCCFTech - "Watch The AMD 'Advancing AI 2026' Event Live Here"(2026-07-22)
  • Hardware Busters - "AMD Launches Zen 6 With EPYC 'Venice' — 256 Cores on TSMC 2nm"(2026-07-22)
  • Tom's Hardware - "AMD's Enterprise CPU and GPU roadmap"(2026-07-22)
  • AMD Official - Advancing AI 2026 Keynote Page
  • TechTimes - "EPYC Venice Arrives Wednesday: AMD's Zen 6 on TSMC 2nm Resets Server Race"(2026-07-20)

Block Buzz 正式发布:开源 Nostr 工作空间,AI Agent 成为团队"正式成员"

2026 年 7 月 21 日,Jack Dorsey 的 Block(原 Square)正式发布 Buzz——一个免费、开源、基于 Nostr 协议的协作工作空间,将团队聊天、Git 代码托管、AI Agent 整合在统一的身份系统下。Buzz 免费、开源(Apache 2.0)、可自托管,底层为用 Rust 编写的 Nostr relay,GitHub 地址 github.com/block/buzz,定位为 Slack 和 GitHub 的开源替代。

核心设计:每个 AI Agent 获得独立的 Nostr 加密密钥对,不是通过人类用户账号运行,而是拥有自己的身份;每个 Agent 操作带双重签名——Agent 自己的签名加其人类所有者的签名,形成可验证的"护照"和监管链;Agent 可以发消息、审代码、启动自动化、参与对话,和人类同事一样;支持 Claude Code、Codex、Goose 等多种 Agent 框架。功能包括团队聊天(频道、私信、语音、媒体分享)、Git 代码仓库托管、自动化工作流,所有消息、反应、工作流步骤、审查批准、git 事件都是 Nostr 协议上的签名事件。

Jack Dorsey 在推文中表示:"we're launching BUZZ! a new groupchat... model-agnostic, decentralized, self-sovereign, and open source"。Buzz 是 Block 在 Nostr 生态上的最大投入,此前 Block 已资助 Nostr 开发并推出 Nostr 原生社交应用。行业解读:TechTimes 称 Block 的 Buzz 给每个 AI Agent 一个加密身份和签名监管链;SiliconANGLE 称每个 Agent 作为工作空间成员加入,有自己的权限;Decrypt 称 Buzz 是模型无关的,支持 Claude Code、Codex 和 Block 自己的 Goose;Cryptobriefing 称其是 Slack 和 GitHub 的竞争对手。

来源:

  • Block.xyz - "Introducing Buzz: where humans and agents work together"(2026-07-21)
  • TechTimes - "Block Launches Buzz: Open-Source Workspace Where AI Agents Sign Their Own Work"(2026-07-22)
  • SiliconANGLE - "Block launches Buzz, an open-source workspace for humans and AI agents"(2026-07-21)
  • Decrypt - "Jack Dorsey's Block Launches Buzz, a Nostr-Based Slack and GitHub Rival for AI Agents"(2026-07-21)
  • Cryptobriefing - "Block launches Buzz, a Nostr-based rival to Slack and GitHub"(2026-07-21)
  • ExplainX - "Buzz by Block: Chat + AI Agents + Git on Nostr (2026)"(2026-07-22)

Google Gemini 3.6 Flash 发布,Gemini 4 预训练启动

2026 年 7 月 21-22 日,Google 连续发布多项 Gemini 更新:正式推出 Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 两款新模型,同时透露 Gemini 3.5 Pro 正在与合作伙伴测试,并确认 Gemini 4 的预训练已经启动——这是 Google 迄今为止"最雄心勃勃的预训练任务"。

Gemini 3.6 Flash 输出 token 减少 17%(回复更简洁),定价低于 Gemini 3.5 Flash,在所有基准测试上均超越 3.5 Flash,面向消费者通过 Gemini 应用提供。Gemini 3.5 Flash-Lite 更轻量、更便宜,定位"边缘侧 + 高吞吐量"场景。Gemini 3.5 Pro 仍在延迟中——此前多次跳票(7 月 17 日窗口已过),目前正在与合作伙伴测试,无具体发布日期。Gemini 4 预训练已启动,架构已确定进入训练阶段,预计发布时间为 2027 年(取决于训练进度)。

定价方面,FourWeekMBA 分析认为 Google 正在执行"双速定价策略":Flash 系列走向"边际成本趋近于零"($0/Mtok 目标),Pro/Ultra 系列保持高端定价,与 OpenAI GPT-5.6 Sol 的"价格战"直接竞争。

来源:

  • CNBC - "Google expands Gemini lineup with cheaper models and new Mythos rival"(2026-07-21)
  • The Decoder - "Google ships three new Gemini Flash models but its frontier 3.5 Pro remains lost in training"(2026-07-22)
  • SiliconANGLE - "Google expands Gemini with cheaper models and a bug-hunter it keeps on a leash"(2026-07-21)
  • TechTimes - "Gemini 3.6 Flash Cuts Token Costs and Scores Higher on Every Benchmark"(2026-07-22)
  • FourWeekMBA - "Google Gemini 3.6 Flash and Gemini 4 Pre-Training Signal a Two-Speed Pricing Strategy"(2026-07-22)
  • Analytics Insight - "Google Unveils Gemini 3.6 Flash, 3.5 Flash-Lite; Next-Gen Gemini 4 Enters Training"(2026-07-22)

AI Agent 安全七月合辑:四次攻击,同一种漏洞

2026 年 7 月,TNW 发表综合报道《Four teams just broke AI agents four ways in ten days. The flaw is the same one.》,将过去十天发生的四次独立 AI Agent 安全攻击串联起来,揭示了一个共同的底层漏洞——AI Agent 本身没有做错任何事,安全漏洞存在于它的周围环境。

四次攻击的完整拼图:

其一,Claude for Chrome 扩展劫持(Manifold Security):任意浏览器扩展可伪造用户点击,让 Claude for Chrome 读取 Gmail、Google Docs、Calendar;漏洞在于扩展只检查"是否有点击",不检查"点击是否真实";严重程度为高(默认)/ 严重("不询问即执行"模式下);5 月报告给 Anthropic,8 个版本后仍未修复。

其二,AI Agent 记忆投毒(arXiv:2607.06595):一封精心编写的邮件可以在 AI Agent 中植入虚假记忆;邮件通过正常垃圾邮件过滤,Agent 读取后超过一半概率将攻击者指令写入长期记忆;记忆持久化使影响覆盖所有未来会话,普通 prompt injection 只影响单次对话;用户无任何警告。

其三,开源模型后门投毒(Semgrep / Katie Paxton-Fear):使用不到 £75 和 1 小时,用 10 个带毒训练样本即可让模型在从未见过的 prompt 中写出带后门的代码;更大的模型更容易被投毒而非更难;模型权重无法像传统软件一样被审计。同步研究方面,Origin Security 的 David Kaplan 构建了通过邮件工具静默窃取数据的带毒模型。

其四,AI Agent 连接器(Connector)的"移动目标"问题(PromptArmor):ChatGPT 和 Claude 的第三方连接器平均每 9 分钟变化一次;追踪的 2,517 个连接器中,931 个在 6 周内发生了改变;厂商在已有连接器上增加了 1,686 个新工具,重写了 1,127 个工具描述;Dropbox 连接器从 8 个工具增长到 24 个,从 0 个可删除数据到 4 个;Zoom 连接器搜索会议记录时,敏感数据可能传递给 10 个 AI 子处理器、8 个模型家族。

四次攻击的共同点:点击来源不可信、记忆存储不可信、模型权重不可信、连接器配置不可信。Agent 的"万能"卖点正是它的安全弱点。

来源:

  • TNW - "AI agent security: four July attacks, one shared flaw"(2026-07-22)
  • Manifold Security - "Claude for Chrome Extension Bypass"(2026-07)
  • arXiv:2607.06595 - Agent Memory Poisoning
  • Semgrep - "AI Supply Chain Problem: Poisoning Open-Weight Models for $75"(2026-07)
  • Origin Security - "The Mole in the Model"(2026-07)
  • PromptArmor - "Claude and GPT Connectors Change Every 9 Minutes"(2026-07)
  • Simon Willison - "The Lethal Trifecta"(2025-06)

本文链接:NVIDIA Vera CPU、AMD Zen 6、Block Buzz、Gemini 3.6 Flash、Agent 安全 - https://h89.cn/archives/718.html

版权声明:原创文章 遵循 CC 4.0 BY-SA 版权协议,转载请附上原文链接和本声明。

标签: AMD, google, NVIDIA, Vera CPU, Zen 6, EPYC Venice, Block, Buzz, Nostr, Gemini 3.6 Flash, Gemini 4, Agentic AI

欸谨特公众号
微信扫码关注:欸谨特
Agent · 效率工具 · 实战笔记

添加新评论