当前位置:首页 > Deepseek应用场景 > 正文内容

英伟达宣布创造满血 DeepSeek 推理世界记录

6个月前 (03-19)Deepseek应用场景342

IT之家 3 月 19 日消息,英伟达在今日举行的 NVIDIA GTC 2025 上宣布其 NVIDIA Blackwell DGX 系统创下 DeepSeek-R1 大模型推理性能的世界纪录。

据介绍,在搭载了八块 Blackwell GPU 的单个 DGX 系统上运行 6710 亿参数的满血 DeepSeek-R1 模型可实现每用户每秒超 250 token 的响应速度,系统最高吞吐量突破每秒 3 万 token。

英伟达表示,随着 NVIDIA 平台继续在最新的 Blackwell Ultra GPU 和 Blackwell GPU 上突破推理极限,其性能将会继续不断提高。

▲ 运行 TensorRT-LLM 软件的 NVL8 配置的 NVIDIA B200 GPU

单节点配置:DGX B200(8 块 GPU)与 DGX H200(8 块 GPU)

测试参数:最新测试采用 TensorRT-LLM 内部版本,输入 1024 token / 输出 2048 token;此前测试为输入 / 输出各 1024 token

计算精度:B200 采用 FP4,H100 / H200 采用 FP8 精度

英伟达表示,通过硬件和软件的结合,他们自 2025 年 1 月以来成功将 DeepSeek-R1 671B 模型的吞吐量提高了约 36 倍。

节点配置:DGX B200(8 块 GPU)、DGX H200(8 块 GPU)、两个 DGX H100(8 块 GPU)系统

测试参数:依然采用 TensorRT-LLM 内部版本,输入 1024 token / 输出 2048 token;此前测试为输入 / 输出各 1024 token;并发性 MAX

计算精度:B200 采用 FP4,H100 / H200 采用 FP8 精度

与 Hopper 架构相比,Blackwell 架构与 TensorRT 软件相结合可实现显著的推理性能提升。

英伟达表示,包括 DeepSeek-R1、Llama 3.1 405B 和 Llama 3.3 70B,运行 TensorRT 软件并使用 FP4 精度的 DGX B200 平台与 DGX H200 平台相比已经提供了 3 倍以上的推理吞吐量提升。

英伟达表示,在对模型进行量化以利用低精度计算优势时,确保精度损失最小化是生产部署的关键。IT之家注意到,在 DeepSeek-R1 模型上,相较于 FP8 基准精度,TensorRT Model Optimizer 的 FP4 训练后量化(PTQ)技术在不同数据集上仅产生微乎其微的精度损失。


“英伟达宣布创造满血 DeepSeek 推理世界记录” 的相关文章

百家医院接入DeepSeek,是助手还是对手?

百家医院接入DeepSeek,是助手还是对手?

记者 张铃 凌晨3点,北京清华长庚医院(下称“长庚医院”)一间手术室的灯光刚熄灭,一位外科医生没有休息,而是掏出手机用起了DeepSeek,还把一则又有医院接入DeepSeek的消息转发给了...

石头科技旗下Roborock APP接入DeepSeek

石头科技旗下Roborock APP接入DeepSeek

中证报中证网讯(记者 张兴旺)2月21日,石头科技官方微博发布海报,旗下Roborock APP已完成DeepSeek-R1接入,并将于近期正式上线。据悉,石头科技作为头部智能硬件公司,在DeepSe...

安诊儿融合DeepSeek 推动医疗AI准确性、安全性升级

安诊儿融合DeepSeek 推动医疗AI准确性、安全性升级

2月16日,由浙江省卫健委和蚂蚁集团联合推出的“安诊儿”宣布融合DeepSeek-R1,升级大模型底座能力。此前基于蚂蚁百灵医疗大模型,安诊儿已实现基于循证医学的即时响应和多轮对话能力。此次融合Dee...

降准降息时间定了!100万房贷能省多少钱?DeepSeek帮您算算

降准降息时间定了!100万房贷能省多少钱?DeepSeek帮您算算

2025年5月7日,中国人民银行发布关于下调个人住房公积金贷款利率的通知,内容如下:中国人民银行上海总部,各省、自治区、直辖市及计划单列市分行;各政策性银行、国有商业银行,中国邮政储蓄银行,各股份制商...

DeepSeek在企业应用:解锁高效智能新篇章

DeepSeek在企业应用:解锁高效智能新篇章

DeepSeek在企业应用:解锁高效智能新篇章一、引言在数字化浪潮的推动下,企业正面临着前所未有的挑战与机遇。如何快速响应市场变化、提升运营效率、优化决策过程,成为了企业持续发展的关键。DeepSee...

如何运用Deepseek新技术赋能EPC项目全过程精细化管理及风险防范?

如何运用Deepseek新技术赋能EPC项目全过程精细化管理及风险防范?

在国务院、住建部等多部委大力推行工程总承包模式的引领下,EPC工程近年来迅猛发展,推动了EPC项目走上加速发展之路,开启了新时代下建筑工程发承包模式的新篇章。但在EPC项目的实践过程中,各相关单位针对...