模型
NVIDIA 在 AI Infra Summit 展示 Vera Rubin 与 DSX 平台的能效优化成果
NVIDIA 在 AI Infra Summit 上发布多项合作与性能数据,涵盖电网灵活负载、DSX MaxLPS 功耗优化、Groq 3 LPX 推理加速以及 AgentX 基准测试结果,核心指标正从峰值性能转向每兆瓦生成的有效 Token 数。

正在加载内容…
芯片、GPU 与计算基础设施
按专题关键词整理已发布事件,最多显示 300 条。
模型
NVIDIA 在 AI Infra Summit 上发布多项合作与性能数据,涵盖电网灵活负载、DSX MaxLPS 功耗优化、Groq 3 LPX 推理加速以及 AgentX 基准测试结果,核心指标正从峰值性能转向每兆瓦生成的有效 Token 数。

模型
NVIDIA 在 AI Infra Summit 上展示 DSX 平台进展。Lambda 的验证显示,固定功率预算下 Token 吞吐量可提升 24%;Emerald AI 与硅谷电力的合作已在生产环境中完成超过 200 次自动需求响应。

模型
Google Cloud 宣布 Dataflow 批量作业暂停/恢复功能正式商用,并新增对搭载 NVIDIA RTX PRO 6000 Blackwell GPU 的 G4 虚拟机的支持,用于加速大规模 AI 推理工作负载。
模型
NVIDIA 宣布与 SB Energy 合作,在俄亥俄州 PORTS-Pike 园区锁定土地、电力与厂房(LPS)容量,为 OpenAI 提供 NVIDIA 全栈计算基础设施。初期部署预计达 4.25 吉瓦,OpenAI 到 2030 年的相关承诺规模约 12 吉瓦。
模型
根据 NVIDIA 基于 SemiAnalysis AgentX 工作负载的早期测量数据,Vera Rubin NVL72 在代理式 AI 推理中每兆瓦吞吐量可达 GB300 NVL72 的 30 倍,每百万 token 成本降低至多 35 倍。
模型
NVIDIA 宣布 Groq 3 LPX 机架级系统进入全面量产,在长上下文基准测试中实现每秒 3,400 个输出 token。同时,Spectrum-X Multiplane、Scale-In 网络架构及 NVLink Fusion 同步更新,多家合作伙伴已开始采用 Vera Rubin 平台。
模型
据Google威胁情报小组(GTIG)2026年9月发布的报告,攻击者在2026年第二季度已从基础提示词交互升级为多代理自动化工作流,将大规模凭证窃取等行动的耗时压缩至数小时。同时,针对开源软件供应链、专有AI知识产权及企业云算力的攻击显著增加。
模型
NVIDIA 推出 NVLink Fusion,允许超大规模云厂商和 AI 公司将自研 XPU 接入 NVIDIA 成熟的 NVLink 网络、MGX 机架架构及软件栈,在保留定制芯片创新的同时降低 AI 工厂的部署复杂度与时间成本。
Agent
NVIDIA 发布 NVHBM 定制高带宽内存技术,将内存控制器集成至 HBM 基底裸片,提升带宽与能效并释放 XPU 计算面积。Amazon Annapurna Labs 将率先在 Trainium4 芯片中采用该技术。
模型
NVIDIA 已同意以 129.3 亿美元收购开源 AI 平台 Hugging Face。交易完成后,Hugging Face 将继续作为开放平台运营,支持多模型、多云与多加速器生态,无需依赖 NVIDIA 计算硬件。
模型
NVIDIA 在阿姆斯特丹 IBC 2026 大会上宣布扩展 NVIDIA AI for Media,推出视频真伪检测、3D 人体姿态估计、帧生成与超分辨率等能力,并联合多家合作伙伴将其集成至广播、体育和流媒体工作流。同时,Holoscan for Media 引入开放媒体交换层,Sports Intelligence Playbooks 为体育组织提供专有数据微调路径。
模型
AI 推理芯片公司 d-Matrix 宣布将通过 NVLink Fusion 技术,把下一代 Raptor XPU 接入 NVIDIA AI 基础设施平台,以加速大规模低延迟推理部署。
模型
据NVIDIA AI Blog介绍,当前主要商业化Robotaxi项目均在使用NVIDIA提供的训练、仿真与车载计算平台。该平台覆盖从模型训练到实车部署的完整开发周期,Uber、Waymo、特斯拉等出行服务商、自动驾驶开发商及车企已在亚洲、欧洲、中东和北美采用这一架构。
模型
Skild AI 推出 S1 机器人基础模型,通过上下文学习技术,使机器人无需重新训练权重即可从单段演示视频中理解并执行未见过的长序列任务。该模型基于 NVIDIA AI 基础设施开发,已在制造、物流等领域建立超过 60 个部署合作。