动察Beating AI News
3.18K subscribers
902 photos
2 videos
1 file
3.44K links
AI新闻信息流
Download Telegram
分析:黄仁勋今日需证明Groq整合路线,否则定制芯片叙事占上风

知名行业分析师 Patrick Moorhead 在 GTC 2026 开幕前发布长篇分析,核心判断是:今日黄仁勋演讲的真正考题,是能否展示训练 GPU、预填充加速器、Groq 解码处理器和 CPU 在统一软件层下协同运作的完整路线图。做到,GTC 2026 标志着英伟达完成平台转型;做不到,叙事将倒向超大型云厂商自研芯片。

他梳理的已确认事实:Vera Rubin NVL72 机架(72 颗 Rubin GPU + 36 颗 Vera CPU,NVLink 6 以每 GPU 3.6TB/s 互联)已在 AWS、谷歌云、微软、甲骨文四家云厂部署,下半年量产爬坡;Rubin GPU 以 1.6 倍于 Blackwell 的晶体管数量实现 5 倍推理性能,推理达 50 Petaflops、训练达 35 Petaflops;200 亿美元 Groq 并购完成,以非排他性许可为框架,同步引入创始人 Jonathan Ross 及约 80% 的工程师团队,超过 2019 年 70 亿美元收购 Mellanox 的规模。

Moorhead 对今日演讲的预判:正式推出 NemoClaw(英伟达面向企业 AI Agent 的开源平台);展示 2028 年架构 Feynman 的路线图,该架构据分析机构报告将采用台积电 A16 1.6nm 工艺;Ross 预计亦将亮相演讲台。

他也指出了三个风险:Groq 整合在超大型云厂规模下尚未验证,200 亿美元对未经实战的技术代价高昂;能源约束是 2027 年最大变量,近 40% 的新建数据中心集中在电力充裕的德克萨斯州,但沿海地区面临真实瓶颈;英伟达数据中心 AI 市占率预计在未来两年从 90% 以上压缩至约 70%。

信源:https://x.com/PatrickMoorhead/status/2033215183884042493
Nebius与Meta签270亿美元5年合同,Vera Rubin首批大规模落地

Nebius Group(纳斯达克:NBIS)今日宣布与 Meta 签订新的 5 年 AI 基础设施供应协议,合同总额最高约 270 亿美元。

协议分两部分:Nebius 将向 Meta 提供 120 亿美元的专项算力,基于英伟达 Vera Rubin 平台的首批大规模商业部署之一,最早于 2027 年初开始交付;此外,Meta 就 Nebius 即将建设的新集群承诺额外采购最高 150 亿美元的算力,Nebius 计划优先向第三方客户销售这部分产能,剩余再由 Meta 承接。

这是 Nebius 与 Meta 扩大既有合作关系的结果,CEO Arkady Volozh 称将「持续兑现」,公司 2026 年财务指引维持不变。3 月 11 日,英伟达刚宣布向 Nebius 投资 20 亿美元,双方合作目标是 2030 年底前部署超过 5GW 的英伟达系统,今日 Meta 合同可视为该合作的首个大规模落地。

信源:https://nebius.com/newsroom/nebius-signs-new-ai-infrastructure-agreement-with-meta
安全产品反而泄密:360安全龙虾将HTTPS通配符证书私钥打包进本地目录

360 近期发布的安全产品「安全龙虾」被发现将 *.myclaw.360.cn 的通配符域名证书及对应私钥直接打包在本地安装目录中。安全龙虾的界面基于定制版 360 浏览器,通过 https://myclaw.360.cn:19798/ 本地地址访问,工程师为实现这一本地 HTTPS 连接,将通配符证书和私钥一并放入客户端。

该通配符证书覆盖 myclaw.360.cn 下所有子域名,私钥泄露后第三方可伪造该域名下的 HTTPS 加密连接,证书目前尚未吊销。360 SRC 团队回应称此事为内部已知问题,正在处理。

信源:https://x.com/landiantech/status/2033517161914982768
OpenAI拟与四大PE组建百亿美元合资公司,抢在IPO前锁定企业AI渠道

OpenAI 正与 TPG、Advent International、Bain Capital 和 Brookfield Asset Management 四家私募股权公司深入谈判,计划组建一家投前估值约 100 亿美元的合资公司,将 OpenAI 的企业级产品部署到这些 PE 旗下的被投企业及更广泛的市场。PE 方合计出资约 40 亿美元,获得股权和董事会席位,TPG 担任领投方。OpenAI 向投资者提供优先股,回报优先于普通股东且下行风险有限。

Anthropic 也在同步推进类似交易,正与黑石、Permira 和 Hellman & Friedman 谈判组建合资公司,PE 方出资规模约 10 亿美元,但提供的是不带优先回报保护的普通股。

两家公司争抢 PE 合作的逻辑一致:PE 掌控大量企业客户并影响其软件和 AI 预算,而双方最快今年 IPO。在企业 AI 市场中 Anthropic 被普遍认为领先于 OpenAI。截至上月底,OpenAI 企业业务年化收入为 100 亿美元,占其 250 亿美元总年化收入的 40%。合资公司还将帮助推广 OpenAI 上月推出的企业平台 Frontier 及其与 BCG、麦肯锡等咨询巨头合作的 Frontier Alliances 计划。各方均未就合资计划发表评论,交易条款仍可能变动。

信源:https://www.reuters.com/business/openai-courts-private-equity-join-enterprise-ai-venture-sources-say-2026-03-16/
Meta旗下Manus发布桌面端,AI agent走出云端可直接操控用户本地电脑

去年底被 Meta 收购的通用 AI agent 平台 Manus 昨日发布桌面应用 Manus Desktop,核心功能「My Computer」首次将 Manus 从云端沙箱带到用户本地电脑,即日起面向 macOS 和 Windows 用户开放。

Manus 自上线以来完全运行在云端隔离沙箱中,拥有网络、命令行、文件系统和浏览器等能力,但无法触及用户的本地文件和应用。My Computer 通过在用户终端执行命令行指令来操作本地电脑,可读取、分析和编辑本地文件,启动和控制本地应用程序。官方博文展示的场景包括让 Manus 自动识别并分类整理上千张杂乱照片,以及用 Swift 在 Mac 上从零构建实时会议翻译应用,全程终端命令完成,20 分钟交付,未打开 Xcode。

权限控制方面,每条终端命令在执行前都需用户明确授权,提供「始终允许」和「仅允许一次」两种选项。My Computer 还支持调用本地 GPU 进行机器学习训练或大模型推理,用户可从手机等设备远程向家中电脑下达任务,只要电脑开机且 Manus Desktop 在运行即可。该功能同时整合了 Manus 已有的定时任务和自定义 Agent,可设置自动化本地例行任务,如每天早上清理下载文件夹或每周生成本地数据汇总报告。

信源:https://manus.im/blog/manus-my-computer-desktop
Codex多代理功能正式上线:自定义Agent并行分工,最多6路并发

OpenAI 的 AI 编程工具 Codex 发布 CLI 0.115.0,将此前处于实验阶段的多代理(subagent)功能转为默认启用,无需再手动在配置中开启。用户可在一次对话中并行启动多个专项代理分头工作,主代理等待全部结果后统一汇总返回。官方文档将这一设计的动机归结为解决「上下文污染」和「上下文腐化」:当探索日志、测试输出、堆栈跟踪等中间产物堆积在主会话中,模型表现会随对话增长而下降,子代理将这些噪声工作移到独立线程中执行,只向主线程返回摘要。

Codex 内置三类代理:default(通用)、worker(执行导向,负责代码实现和修复)和 explorer(只读探索,侧重代码搜索和文件阅读)。用户也可通过 TOML 配置文件自定义代理,指定名称、职责描述、系统指令、模型选择和沙箱权限,放在 ~/.codex/agents/`(个人)或 .codex/agents/`(项目级)下即可生效。文档示例展示了一套 PR 审查工作流:pr_explorer 映射受影响的代码路径,reviewer 检查正确性和安全风险,docs_researcher 通过 MCP 服务器查阅框架 API 文档,三者并行完成后由主代理汇总。

0.115.0 还引入了实验性 CSV 批量处理工具 spawn_agents_on_csv`:读取 CSV 文件,每行启动一个子代理执行相同指令模板(通过 `{column_name} 占位符),全部完成后导出汇总 CSV,适用于逐文件审计、批量 PR 检查等重复性任务。模型方面,子代理默认推荐 gpt-5.4,轻量扫描和快速摘要场景可切换为速度更快的 gpt-5.3-codex-spark。并发线程数默认上限 6,嵌套深度默认 1 层,子代理继承父会话的沙箱和审批策略。

信源:https://developers.openai.com/codex/subagents
英伟达黄仁勋:Vera Rubin七款芯片全线量产,黄仁勋预见1万亿美元算力订单

英伟达创始人兼 CEO 黄仁勋在 GTC 2026 大会上正式宣布 Vera Rubin 平台全面量产,整合七款全新芯片,涵盖五类机架系统,整体设计为一台专为智能体 AI 打造的超级计算机。

核心机架 Vera Rubin NVL72 集成 72 颗 Rubin GPU 和 36 颗 Vera CPU,通过 NVLink 6 互连。与上一代 Blackwell 平台相比,训练大型混合专家模型所需 GPU 数量减至四分之一,每瓦推理吞吐量最高可达 Blackwell 的 10 倍,每令牌成本降至十分之一。

五类机架系统构成完整 AI 工厂基础设施:

- Vera Rubin NVL72 GPU 机架
- Vera CPU 机架(256 颗 Vera CPU,效率是传统 CPU 的 2 倍、速度提升 50%)
- Groq 3 LPX 推理加速机架
- BlueField-4 STX 存储机架(专为 AI Agent 键值缓存设计,推理吞吐量最高提升 5 倍)
- Spectrum-6 SPX 以太网机架

能耗管理方面,英伟达同步发布 DSX 平台:DSX Max-Q 可在固定电力限额内多部署 30% 的 AI 基础设施,DSX Flex 可激活此前无法利用的 100 吉瓦闲置电网容量。

AWS、谷歌云、微软 Azure、甲骨文云及 CoreWeave、Lambda、Nebius 等云服务商,以及思科、戴尔科技、惠普企业、联想、超微等系统厂商均宣布将于今年下半年推出 Vera Rubin 产品。Anthropic、Meta、Mistral AI 和 OpenAI 已明确将使用该平台训练更大规模的模型。

黄仁勋表示,他预测 Blackwell 和 Vera Rubin 系统在 2025 至 2027 年的合计订单将至少达到 1 万亿美元,较去年 GTC 给出的 5000 亿美元预测翻倍。

信源:https://nvidianews.nvidia.com/news/nvidia-vera-rubin-platform
英伟达黄仁勋推出首款Groq芯片LPX:与Vera Rubin组合每兆瓦推理效率最高提升35倍,并展示下一代Kyber原型

Groq 3 LPU(语言处理单元)是英伟达去年 12 月以约 200 亿美元收购 AI 推理芯片初创公司 Groq 后推出的第一款芯片,预计今年第三季度开始出货。Groq 3 LPX 机架可容纳 256 颗 LPU,配备 128GB 片上 SRAM 和每秒 640TB 的扩展互连带宽。官方称 LPX 与 Vera Rubin NVL72 搭配部署时,每兆瓦推理吞吐量最高可提升 35 倍,同时解锁万亿参数、百万令牌上下文推理场景的营收潜力。黄仁勋将两款处理器描述为"极端差异却相互统一:一个追求高吞吐,一个追求低延迟",LPX 的片上内存则大幅扩展模型可用的总内存容量。LPX 机架计划今年下半年随 Vera Rubin 平台一同上市。

大会上,黄仁勋还展示了代号 Kyber 的下一代机架架构原型。Kyber 将 144 颗 GPU 的计算托盘改为垂直排列,以提升物理密度、降低延迟,将搭载于 Vera Rubin 的继任平台 Vera Rubin Ultra,预计 2027 年推出。

信源:https://nvidianews.nvidia.com/news/nvidia-vera-rubin-platform
英伟达黄仁勋发布DLSS 5:传统3D图形与生成式AI融合,黄仁勋称这一路径将席卷各行业

英伟达黄仁勋在 GTC 大会上发布 DLSS 5,通过将传统 3D 图形的结构化数据与生成式 AI 模型融合,让 GeForce GPU 在本地实现实时 4K 照片级渲染,无需逐像素光栅化每个场景元素。黄仁勋在演讲中将这一方法描述为"可控 3D 图形与概率性生成式 AI 的融合",称前者"完全可预测"、后者"高度逼真",两者结合可让开发者创作出"既精美又可控"的内容。

黄仁勋将 DLSS 5 的技术路径定位为更广泛范式转移的起点,称"将结构化信息与生成式 AI 融合的做法,将在一个行业接一个行业中复现"。他以 Snowflake、Databricks、BigQuery 等企业数据平台为例,预判未来 AI Agent 将同时调用结构化和生成式数据库处理任务。

信源:https://techcrunch.com/2026/03/16/nvidias-dlss-5-uses-generative-ai-to-boost-photo-realism-in-video-games-with-ambitions-beyond-gaming/
英伟达黄仁勋发布NemoClaw:为企业快速搭建OpenClaw AI Agent提供标准技术栈

英伟达黄仁勋在 GTC 大会上发布 NemoClaw,这是专为开源 AI Agent 框架 OpenClaw 设计的企业级参考技术栈。黄仁勋在演示中描述其运作方式:"它找到 OpenClaw、下载它,然后给你搭建一个 AI Agent。"OpenClaw 由奥地利软件开发者 Peter Steinberger 于今年 1 月发布,据英伟达官方表述是"史上增长最快的开源项目"。Steinberger 上月加入 OpenAI,OpenAI CEO Sam Altman 表示 OpenClaw 将以开源项目形式长期存在,由 OpenAI 持续支持。

英伟达还同期发布了在 DGX Spark(英伟达推出的桌面级 AI 超级计算机)上本地运行 OpenClaw 的操作手册,帮助开发者在不依赖云端的情况下构建始终在线、可访问本地文件和应用的 AI Agent。

信源:https://www.cnbc.com/2026/03/16/nvidia-gtc-2026-ceo-jensen-huang-keynote-blackwell-vera-rubin.html
英伟达黄仁勋披露自动驾驶进展:Uber将在全球28城部署Drive AV车队,日产等五大车企接入L4平台

英伟达黄仁勋在 GTC 大会上披露与 Uber 此前宣布的自动驾驶合作的具体细节:Uber 将基于英伟达 Drive AV 软件在全球 28 座城市、四大洲部署自动驾驶车队,计划 2028 年前完成,首批城市为洛杉矶和旧金山,预计 2027 年开始运营。

此外,黄仁勋宣布日产、比亚迪、吉利、五十铃、现代五家车企将基于英伟达 Drive Hyperion 平台研发 L4 级自动驾驶乘用车。五十铃还将与自动驾驶技术公司 Tier IV 合作开发自动驾驶公共汽车,采用英伟达 AGX Thor 机器人系统芯片。

信源:https://www.cnbc.com/2026/03/16/nvidia-gtc-2026-ceo-jensen-huang-keynote-blackwell-vera-rubin.html
前OpenAI CTO创办的Thinking Machines获英伟达战略投资,将部署至少1吉瓦Vera Rubin系统

英伟达与 Thinking Machines Lab 宣布达成多年期战略合作,后者将部署至少 1 吉瓦的下一代 Vera Rubin 系统用于前沿模型训练,目标明年初上线。英伟达同时对 Thinking Machines Lab 进行了一笔「重大投资」,具体金额未披露。

Thinking Machines Lab 由前 OpenAI CTO Mira Murati 联合创立并担任 CEO。Murati 在公告中表示:「英伟达的技术是整个领域的基石。这次合作加速了我们构建可被用户塑造和定制的 AI 的能力。」双方合作还包括为英伟达架构设计训练和推理系统,以及为企业、研究机构和科学界拓宽前沿 AI 和开放模型的访问渠道。

黄仁勋称 Thinking Machines 汇聚了一支世界级团队来推进 AI 前沿,并表示英伟达「非常高兴能与 Thinking Machines 合作,实现他们对 AI 未来的愿景」。

信源:https://blogs.nvidia.com/blog/nvidia-thinking-machines-lab/
英伟达GTC机器人全景:Cosmos 3统一世界模型发布,GR00T N2登顶机器人策略排行榜,迪士尼雪宝登台

英伟达在 GTC 大会上发布一系列物理 AI 新产品,并与全球机器人生态的工业巨头、人形机器人先驱和手术机器人厂商展开合作。黄仁勋称「物理 AI 已经到来,每家工业企业都将成为机器人公司」。

核心产品发布:

1. Cosmos 3:首个统一合成世界生成、视觉推理和动作模拟的世界基础模型,用于加速复杂环境下的通用机器人智能开发
2. Isaac Lab 3.0:早期访问版本,支持在 DGX 级基础设施上进行大规模机器人学习,基于全新 Newton 物理引擎 1.0 和 PhysX SDK 构建,新增多物理仿真和复杂灵巧操控支持
3. GR00T N1.7:早期访问版本,附带商业许可,为量产机器人部署提供高级灵巧控制等通用技能
4. GR00T N2(预览):基于 DreamZero 研究的下一代机器人基础模型,采用全新世界动作模型架构,在新任务新环境中的成功率是主流视觉语言动作模型的两倍以上,目前在 MolmoSpaces 和 RoboArena 排行榜上排名第一,计划年底前发布

工业机器人方面,全球装机量超过 200 万台的 FANUC、ABB Robotics、YASKAWA 和 KUKA 正将 Omniverse 库和 Isaac 仿真框架集成到虚拟调试方案中,同时将 Jetson 模块集成到控制器中用于边缘 AI 推理。人形机器人方面,1X、AGIBOT、Agility、波士顿动力、Figure 等公司正使用 Cosmos、Isaac Sim 和 Isaac Lab 加速研发。医疗机器人方面,CMR Surgical 使用 Cosmos-H 仿真训练其 Versius 手术系统,强生医疗使用 Isaac Sim 和 Cosmos 后训练工作流训练 Monarch 泌尿平台,美敦力正探索 IGX Thor 为手术机器人系统提供功能安全。

大会的亮点时刻之一来自迪士尼:迪士尼使用基于英伟达 Warp 框架并集成到 Newton 物理引擎中的 GPU 加速物理模拟器 Kamino,训练雪宝(Olaf)和 BDX 机器人角色的运动策略,让雪宝学会管理自身热量并降低碰撞噪音。黄仁勋在主题演讲中与雪宝机器人同台亮相,雪宝将于 3 月 29 日在巴黎迪士尼乐园首次正式登场。

信源:https://nvidianews.nvidia.com/news/nvidia-and-global-robotics-leaders-take-physical-ai-to-the-real-world
英伟达GTC发布Nemotron 3三款新模型:Ultra主打前沿推理,VoiceChat将语音识别、大模型、语音合成合为一体

英伟达在 GTC 大会上宣布扩展 Nemotron 3 开放模型家族,新增三款面向 AI Agent 的多模态模型:

1. Nemotron 3 Ultra:定位前沿级智能,在 Blackwell 平台上以 NVFP4 格式实现 5 倍吞吐效率,面向编程助手、搜索和复杂工作流自动化场景
2. Nemotron 3 Omni:整合音频、视觉和语言理解能力,可从视频和文档中高效提取洞察
3. Nemotron 3 VoiceChat:支持实时对话,AI 可同时监听和回应,将自动语音识别(ASR)、大语言模型处理和语音合成(TTS)整合在单一系统中

英伟达同期还发布了 Nemotron 安全模型与 Agent 检索管线,前者检测文本和图像中的不安全内容,后者提升 Agent 输出的相关性和准确性。此外,英伟达本月 11 日已先行发布 Nemotron 3 Super,一款 1200 亿参数(120 亿活跃参数)的混合 Mamba-Transformer MoE 模型,原生支持 100 万 token 上下文窗口,吞吐量较前代提升 5 倍以上,在 OpenClaw Agent 基准测试 PinchBench 上以 85.6% 的得分成为同类最佳开放模型。

CodeRabbit、CrowdStrike、AI 编程工具 Cursor、Factory、ServiceNow 和 AI 搜索引擎 Perplexity 等公司已在部署 Nemotron 模型用于 Agent 应用。AI 科研平台 Edison Scientific 将 Nemotron 集成到其自主 AI 科学家 Kosmos 中,服务超过 5 万名研究人员,可并行执行数百项研究任务,据其官方表述可将数月研究压缩到一天完成。

信源:http://nvidianews.nvidia.com/news/nvidia-expands-open-model-families-to-power-the-next-wave-of-agentic-physical-and-healthcare-ai
黄仁勋称「Claude Code和OpenClaw引爆了Agent拐点」:英伟达发布OpenShell安全运行时,17家企业巨头接入

英伟达在 GTC 大会上发布 Agent Toolkit 开放平台,核心组件是开源安全运行时 OpenShell,为自主运行的 AI Agent 提供基于策略的安全、网络和隐私护栏。黄仁勋在发布会上表示:「Claude Code 和 OpenClaw 引爆了 Agent 拐点,将 AI 从生成和推理延伸到了行动。员工将被由前沿、专业和定制 Agent 组成的团队所增强,企业软件行业将进化为专业化的 Agent 平台,IT 行业正处于下一次大扩张的临界点。」

Agent Toolkit 还包含与 LangChain 共同构建的开源 AI-Q Blueprint,采用前沿模型负责编排、Nemotron 开放模型负责研究的混合架构,查询成本可降低超过 50%。英伟达使用 AI-Q Blueprint 开发的 Agent 目前在 DeepResearch Bench 和 DeepResearch Bench II 两个排行榜上均排名第一。

安全方面,英伟达正与思科、CrowdStrike、谷歌、微软安全和 TrendAI 合作,使 OpenShell 兼容其网络安全和 AI 安全工具。CrowdStrike 同步发布了「安全设计 AI 蓝图」(Secure-by-Design AI Blueprint),将 Falcon 平台的防护能力直接嵌入英伟达 AI Agent 架构。

17 家软件平台厂商已接入 Agent Toolkit:Adobe、Amdocs、Atlassian、Box、Cadence、思科、Cohesity、CrowdStrike、达索系统、IQVIA、Palantir、Red Hat、SAP、Salesforce、西门子、ServiceNow 和 Synopsys。其中 Salesforce 将以 Slack 作为主界面和编排层运行 Agentforce Agent,西门子推出基于 Nemotron 的 Fuse EDA AI Agent 用于芯片和 PCB 设计全流程自动化。

信源:https://markets.businessinsider.com/news/stocks/nvidia-ignites-the-next-industrial-revolution-in-knowledge-work-with-open-agent-development-platform-1035934820
英伟达联手Mistral AI等8家AI实验室组建Nemotron Coalition,共建开源前沿模型Nemotron 4

英伟达在 GTC 大会上宣布成立 Nemotron Coalition,联合 8 家全球 AI 实验室共同推进开源前沿基础模型的开发。这是业界首个由模型构建者和 AI 开发者组成的联盟,通过共享研究、专业知识、数据和算力来加速开源 AI 创新。

联盟首批成员包括图像生成公司 Black Forest Labs、AI 编程工具 Cursor、AI Agent 框架 LangChain、法国 AI 公司 Mistral AI、AI 搜索引擎 Perplexity、前 DeepMind 研究员 Misha Laskin 创立的 Reflection AI、印度语言 AI 公司 Sarvam 以及前 OpenAI CTO Mira Murati 创立的 Thinking Machines Lab。

联盟首个项目是由 Mistral AI 与英伟达联合主导训练的基础模型,在英伟达 DGX Cloud 上完成训练后将开源发布,成为即将推出的 Nemotron 4 模型家族的基石。各成员将贡献各自专长:Black Forest Labs 提供多模态能力,Cursor 提供真实使用场景的性能需求和评估数据集,LangChain 专注 Agent 可靠工具调用和长程推理,Perplexity 贡献前沿模型开发经验,Sarvam 专注多语言和语音优先的本地化能力。

黄仁勋表示:「开放模型是创新的命脉,是全球参与 AI 革命的引擎。Nemotron Coalition 联合世界级 AI 实验室,开发倡导透明、协作与主权的前沿开放模型,确保 AI 的未来与世界同行、为世界而建。」

信源:https://nvidianews.nvidia.com/news/nvidia-launches-nemotron-coalition-of-leading-global-ai-labs-to-advance-open-frontier-models
英伟达发布Dynamo 1.0:AI工厂的开源「操作系统」,Blackwell推理性能最高提升7倍

英伟达在 GTC 大会上发布 Dynamo 1.0,一款面向生成式和 Agent 推理的开源分布式软件,定位为 AI 工厂的「操作系统」,负责在集群范围内协调 GPU 和内存资源。在最近的行业基准测试中,Dynamo 将 Blackwell GPU 的推理性能最高提升 7 倍。

黄仁勋表示:「推理是智能的引擎,驱动着每一次查询、每一个 Agent 和每一个应用。通过 Dynamo,我们创造了 AI 工厂的首个'操作系统'。」

Dynamo 通过智能「流量调度」将推理任务拆分到多个 GPU 上,并在 GPU 与低成本存储之间动态搬运数据,减少浪费、缓解内存瓶颈。对于 Agent AI 和长提示场景,Dynamo 可将请求路由到已缓存相关上下文的 GPU 上,不需要时再卸载缓存。核心组件包括 KVBM(内存管理)、NIXL(GPU 间高速数据传输)和 Grove(简化扩展),均可作为独立模块使用。Dynamo 已与 LangChain、llm-d、LMCache、SGLang 和 vLLM 等开源框架原生集成。

采用方覆盖多个层级:

1. 云服务商:AWS、微软 Azure、谷歌云、甲骨文云
2. 英伟达云合作伙伴:阿里云、CoreWeave、Nebius、Together AI 等
3. AI 原生公司:Cursor、Hebbia、Perplexity
4. 全球企业:阿斯利康、贝莱德、字节跳动、Coupang、Instacart、美团、PayPal、Pinterest、Shopee、软银

信源:https://www.globenewswire.com/news-release/2026/03/16/3256759/0/en/NVIDIA-Enters-Production-With-Dynamo-the-Broadly-Adopted-Inference-Operating-System-for-AI-Factories.html
英伟达公布2028年Feynman架构完整阵容:Rosa CPU致敬DNA之母,NVLink 8扩展至1152 GPU

英伟达在 GTC 大会上首次公开 2028 年 Feynman 架构的完整组件阵容,这是继 Vera Rubin(2026 年下半年)和 Vera Rubin Ultra(2027 年)之后的下一代平台。

Feynman 平台包含六大核心组件:

1. Feynman GPU:下一代 AI 加速器
2. Rosa CPU:以发现 DNA 双螺旋结构的关键人物 Rosalind Franklin 命名,专为在 Agent AI 基础设施全栈中高效调度数据、工具和 Token 而设计
3. LP40 LPU:第三代语言处理单元(继 Vera Rubin 的 LP30 和 Rubin Ultra 的 LP35 之后),通过 NVLink 连接 Feynman GPU
4. BlueField-5 DPU:下一代数据处理单元
5. CX10:下一代网络控制器
6. Spectrum 7 204T:下一代网络交换芯片

互连方面,Feynman 将采用第八代 NVLink 8,支持铜缆和共封装光学(CPO)两种介质,机架规模从 Vera Rubin 的 NVL144 扩展至 NVL1152。

信源:https://en.mashdigi.com/nvidia-unveils-more-detailed-roadmap-for-the-2028-feynman-generation-introducing-rosa-cpus-and-extending-the-optoelectronic-convergence-architecture-of-the-rubin-generation/
英伟达进军太空计算:发布Vera Rubin Space-1模块,AI算力是H100的25倍

英伟达在 GTC 大会上宣布进入太空计算领域,发布 Space-1 Vera Rubin 模块,专为在轨数据中心设计,集成 2 颗 Rubin GPU 和 1 颗 Vera CPU,AI 推理算力最高可达 H100 的 25 倍,使大语言模型和基础模型可直接在轨道上运行。

黄仁勋表示:「太空计算,最后的前沿,已经到来。随着卫星星座的部署和深空探索的推进,智能必须存在于数据产生的地方。」他同时坦言太空散热是一项未解决的工程挑战:「太空中没有传导,没有对流,只有辐射,我们必须搞清楚如何在太空中冷却这些系统。」

Space-1 模块针对尺寸、重量和功耗受限环境设计,支持在轨自主分析、实时数据处理和科学发现。首批合作伙伴包括太空太阳能公司 Aetherflux、私人空间站开发商 Axiom Space、卫星通信公司 Kepler Communications、地球观测公司 Planet Labs、Sophia Space 和云计算卫星公司 Starcloud。具体上市时间尚未公布。

信源:https://nvidianews.nvidia.com/news/space-computing
AWS将部署超100万颗英伟达GPU,成首家支持RTX PRO 4500 Blackwell的主要云商

AWS 在 GTC 大会上宣布将从 2026 年起在其全球云区域部署超过 100 万颗英伟达 GPU,涵盖 Blackwell 和 Vera Rubin GPU 架构。双方合作已持续 15 年。

AWS 同时成为首家宣布支持 RTX PRO 4500 Blackwell Server Edition GPU 的主要云服务商,新实例适用于数据分析、对话式 AI、内容生成、推荐系统和视频渲染等工作负载。

技术集成方面,AWS 通过 Elastic Fabric Adapter(EFA)支持英伟达 NIXL 互连加速,用于分离式大语言模型推理,支持英伟达 GPU 和 AWS Trainium 的任意组合。Amazon EMR on EKS 搭配 RTX PRO 6000 Blackwell Server Edition 的 EC2 G7e 实例,Apache Spark 性能提升 3 倍。英伟达 Nemotron 3 Super 模型也将登陆 Amazon Bedrock。

信源:https://aws.amazon.com/blogs/machine-learning/aws-and-nvidia-deepen-strategic-collaboration-to-accelerate-ai-from-pilot-to-production/
去年发布的DGX Station桌面超算正式开售,DGX Spark新增4台集群组网

英伟达在 GTC 大会上宣布,去年 Computex 上发布的 DGX Station 桌面超级计算机现已正式接受订购,将由华硕、戴尔科技、技嘉、MSI 和超微发货,惠普稍后加入。该机搭载 GB300 Grace Blackwell Ultra Desktop Superchip,配备 748GB 统一内存和 20 petaflops 算力,可在桌面上本地运行万亿参数模型的推理和微调。

入门级产品 DGX Spark 新增集群功能,最多 4 台 Spark 可通过 ConnectX-8 SuperNIC 组成统一系统,性能近乎线性扩展,适合团队级中等规模模型开发。首批客户包括 Snowflake(本地测试 Arctic 训练框架)、美国电力研究院 EPRI(AI 天气预报)、医疗 AI 公司 Medivis(手术工作流视觉语言模型)、微软研究院和康奈尔大学(AI 教学)。系统开箱即支持 OpenAI gpt-oss-120b、谷歌 Gemma 3、Qwen3、Mistral Large 3、DeepSeek V3.2 和英伟达 Nemotron 等开源模型。

信源:https://venturebeat.com/infrastructure/nvidias-dgx-station-is-a-desktop-supercomputer-that-runs-trillion-parameter