英伟达AI芯片突破:BlackwellUltra性能飙升,成本大幅降低
创始人
2026-02-18 14:25:58
0

2月16日,英伟达宣布其Blackwell Ultra AI架构(GB300NVL72)在能效与成本上取得显著突破。通过DeepSeek-R1模型测试,与前代Hopper GPU相比,每兆瓦吞吐量提升50倍,百万tokens成本降低至35分之一。英伟达还预告了下一代Rubin平台,预计其每兆瓦吞吐量将比Blackwell再提升10倍,进一步推动AI基础设施的演进。

Blackwell Ultra通过NVLink技术将72个GPU连接成统一的计算单元,互联带宽高达130TB/s,远超Hopper时代的8芯片设计。全新的NVFP4精度格式配合极致的协同设计结构,进一步巩固了其在吞吐性能上的统治地位。AI推理成本方面,相比Hopper架构,新平台将每百万Token的成本削减至35分之一;即便与上一代Blackwell(GB200)相比,GB300在长上下文任务中的Token成本也降低至1.5分之一,注意力机制处理速度翻倍,适配代码库维护等高负载场景。

OpenRouter的《推理状态报告》指出,与软件编程相关的AI查询量在过去一年中激增,占比从11%攀升至约50%。这类应用通常需要AI代理在多步工作流中保持实时响应,并具备跨代码库推理的长上下文处理能力。英伟达为应对这一挑战,通过TensorRT-LLM、Dynamo等团队的持续优化,进一步提升了混合专家模型(MoE)的推理吞吐量。例如,TensorRT-LLM库的改进,让GB200在低延迟工作负载上的性能在短短四个月内提升了5倍。

相关内容

热门资讯

享界G9预售火爆:24小时订单... 8月6日,享界G9官方宣布,新车预售24小时内订单量突破10300台。预售价43.98万元起,下订可...
福特电动皮卡Fathom明年上... 今日,福特汽车公司宣布了其下一代电动皮卡的详细信息,新车被命名为Fathom,预计于明年晚些时候上市...
新一代奔驰smart精灵#1上... 8月6日,新一代奔驰smart精灵#1正式上市,共推出两款车型,售价区间为15.29-17.29万元...
华为鸿蒙智行享界G9预售火爆,... 8月6日,华为终端官方宣布,鸿蒙智行首款豪华硬派SUV享界G9首批展车已陆续到店。华为常务董事余承东...
英伟达组建AI安全团队,押注开... 今日,英伟达正在组建一支新的AI安全与网络安全工程团队,旨在提升AI安全的重要性。上月底,英伟达发布...
字节跳动打造5万亿参数AI模型... 今日,字节跳动被爆正在讨论训练一个参数规模超5万亿的AI模型,这将超过阿里的Qwen3.8-Max(...
广东烹饪协会会长赵利平为粤菜师... 广东烹饪协会会长赵利平为第七届粤港澳大湾区“粤菜师傅”职业技能大赛打call!匠心烹调岭南百味,巧手...
粤港澳三地首次联合举办!202... 文/羊城晚报全媒体记者 郭思琦 通讯员 粤消宣图/通讯员供图为持续深化粤港澳三地消防交流协作,8月3...
广东:对游客推行柔性执法,外地... 文/羊城晚报全媒体记者 郭思琦暑期正值各地旅游高峰。8月4日,记者梳理发现,全国多个城市针对外地车辆...
出海阿拉伯,广东新能源汽车的水... 编者按:当前,中国企业出海正从“机会型探索”迈向“战略型深耕”新阶段,挑战与机遇交织推动出海主体突破...