
今天分享的是:英伟达2026 GTC大会 黄仁勋演讲PPT
报告共计:76页
在刚刚落幕的英伟达2026 GTC大会上,黄仁勋再次以一场充满技术张力与产业野心的演讲,向全球展示了AI基础设施的又一次跨越式迭代。本次大会的核心信息可以浓缩为:AI正在从“训练时代”全面迈入“推理时代”,而英伟达已经为这场产业拐点做好了从芯片、系统到软件生态的全栈准备。
首先,大会最重磅的发布当属新一代AI芯片平台“Vera Rubin NVL72”与“LPX”系统的亮相。黄仁勋将其定义为解锁3000亿美元收入机会的关键引擎。Vera Rubin芯片集成了288GB HBM4内存与4GB SRAM,带宽达到惊人的22TB/s,SRAM带宽更是实现55倍提升,运算性能达到50 PFLOPs(NVFP4)。这一代产品的核心突破在于将处理器、内存与通信极致耦合,形成“极端性能处理器集群”。与之配套的NVL72系统则进一步放大了这一优势,支持16TB共享上下文与50Tb/s网络带宽,为下一代Agentic AI(代理式人工智能)提供了工业级算力底座。值得注意的是,英伟达首次明确提出“芯片不再是单一产品,而是整套机架系统”的设计哲学,从7颗芯片到5套机架系统,形成完整AI工厂基础设施。
其次,黄仁勋用大量篇幅论证了“推理拐点”的到来。他指出,当前全球推理计算量已达ChatGPT初代模型的万倍级别,而英伟达通过极致软硬协同设计,将“每瓦特生成的Token数”与“每Token成本”推至行业新高度。现场数据显示,Blackwell NVL72相比Hopper架构在推理吞吐量上实现35倍提升,尤其在高交互场景下,单位用户每秒处理的Token数大幅领先。黄仁勋强调,随着AI应用从简单对话向复杂代理演化,推理将成为AI工厂最主要的“工作负载”,而Token本身正在成为一种新型工业商品。英伟达通过GB200 NVL72等系统,已确立为全球规模化AI推理的标准基础设施。
在软件与生态层面,英伟达同步发布了多个重磅工具与模型。其中DLSS 5引入“3D引导神经渲染”技术,进一步巩固了其在图形与AI融合领域的领先地位。面向企业级市场,英伟达推出NemoClaw——一个基于OpenClaw的智能代理开发工具包,旨在推动企业从传统SaaS模式向“Agent-as-a-Service”转型。黄仁勋认为,这一转变将催生企业IT的又一次文艺复兴。同时,英伟达还发布了Nemotron 3 Super模型,该模型在多项基准测试中超越Claude、GPT-5.4等主流闭源模型,成为当前最优秀的开源代理模型之一,并与全球多家AI领军企业组成“Nemotron联盟”,共同推进开放前沿模型的发展。
值得关注的是,英伟达在此次大会上首次系统阐述了“结构化数据是AI的物理真实”这一理念。黄仁勋指出,全球企业每年产生数百ZB的非结构化数据,但真正驱动AI落地的,是价值1200亿美元的结构化数据生态。通过与IBM、戴尔、Google Cloud等伙伴合作,英伟达帮助企业将海量非结构化数据快速转化为可用的结构化数据,从而在制造、仓储、运维等场景中实现分钟级的数据刷新与业务闭环。雀巢、NTT DATA、Snap等客户的实际应用案例,均验证了这一路径在降本增效上的显著成效。
最后,黄仁勋用“AI工厂是AI时代的工业基础设施”作为整场演讲的收尾。他强调,无论是Vera Rubin、NemoClaw,还是Nemotron 3 Super,英伟达的每一层创新都在围绕一个核心目标:让企业能够以最高效率、最低成本构建并运行自己的AI工厂。从芯片到系统,从模型到代理,英伟达正在将AI从“科研工具”升级为“工业生产力”。2026年,随着推理工作负载的全面爆发,英伟达正试图通过极致的软硬协同设计,确立其在下一阶段AI竞争中的绝对主导地位。
以下为报告节选内容










报告共计: 76页
中小未来圈,你需要的资料,我这里都有!












