搜索
当前所在位置: 首页>GPU卡

建议收藏:RTX 5090从卡和整机方面与4090相比,有何升级与变化

发布时间:2026-05-25 14:24:23 作者:超级管理员 点击:268 【 字体:

RTX 5090显卡

一、5090和4090 GPU卡的综合对比

英伟达RTX 5090于2025年1月7日发布。采用最新的Blackwell架构,配备32GB GDDR7显存,显存带宽高达1792 GB/s,并支持第五代Tensor核心和第四代光线追踪核心。和上一代旗舰GeForce卡4090对比如下:

GPU对比
RTX 5090
RTX 4090
核心
GB202
AD102
架构
Blackwell
Ada Lovelace

CUDA核心数

21,760 
16384
Tensor核心
680(第五代)
512(第四代)
FP16-Tensor TFlops
(后面挂*是稀疏

209.5/419T*

165T/330T*

FP8-Tensor TFlops
838/1676*
660/1321T*
FP4-Tensor TFlops
1676/3352*
不支持
显存类型

GDDR7

GDDR6 x
显存容量
32GB
24GB
显存位宽

512Bit

384Bit
显存带宽

1792GB/s

1008GB/s
PCIe接口
PCIe 5.0x16
PCIe 4.0x16
功耗TDP
575W
450W
GPU机型
6U8机型,风扇卡和涡轮卡并存,风扇卡四宽,高度更高
4U8机型,涡轮卡为主
单卡标准双宽全高全长

主流的5090涡轮卡的尺寸情况如下,4U的标准GPU服务器通常支持的GPU卡的高度不超过120mm,因此我们看到的5090GPU机型多为5、6U,其中6U更多。

目前市场上的涡轮卡5090有两个高度,125和135mm,空间越大散热效果越好。

5090的风扇卡不同品牌的尺寸也有差异,宽度都是4宽、高度和长度举例如下:358mm(长)x149mm(高)x76mm(宽);

二、RTX5090 八卡机服务器的特点

和4090的GPU服务器相比,5090整机主要有以下3类不同:

1、平台升级至PCIe5.0:5090的接口是PCIe5.0,为了把GPU的性能发挥到最优,需要CPU也升级至支持PCIe5.0,比如Intel的第四代、第五代的至强可扩展CPU,AMD的Genoa  9004系列处理器,CPU的升级也导致服务器平台价格的提升;

2、整机尺寸提升至6U:前面章节介绍到,5090卡的高度超过了120mm,标准的4U机箱已不再适用,需要提升至5或6U的高度,并且风扇卡的宽度为4宽,单排放不下8卡,风扇卡机型必须采用前后2个GPU背板的设计;

3、供电散热的要求更高:一张5090的GPU的标准TDP是575W(实际工作时,如果超频可超过这个功率),在散热和供电上需要进行重点考虑,比如支持3+1或者2+2模式的2700w或3200w冗余电源方案.

三、RTX5090有关的典型问题

1、5090的价格问题:5090年初的时候价格炒的很高,一度超过3w人民币,但是随着市场的冷静,最近单卡价格(8月的第一周)来到了2万人民币左右,和4090持平了。下图是从某个渠道获得的一个报价,风扇卡跌破2w,但是涡轮卡要贵1-2k:

2、单台8卡5090算力多少:目前给客户做方案,一台8卡5090还是建议按稀疏FP16精度算力来算,单台八卡机的算力等于419T x 8=3.25P,粗略估算的话按照3.2或者3.3P都行;如果是稠密算力则对应数值减半;

3、风扇还是涡轮,怎么选:目前市场上做5090整机的分两个路线就是涡轮还是风扇,风扇卡的直接的优势价格便宜,一张卡从价格上要比涡轮卡低1-2千,但是涡轮卡更符合数据中心场景的应用,因为散热方面更优,在7x24小时运行商可靠性更高,但是需要对风扇卡进行改装,一旦改装就失去了原厂质保,这个取舍需要客户综合考虑,个人角度还是更倾向于涡轮卡的方案(大家有何不同意见可以评论区聊)。

4、老黄发布会上5090的AI TOPS 3352是啥?结合咨询英伟达原厂的朋友和查看官方资料,3352 TOPS指的就是FP4精度的Tensor加速算力的稀疏数值,因为从5090这一代(Blackwell架构)开始就原生支持FP4精度算力,老黄会根据最新支持的精度来做营销(吹牛);反观4090的1321其实是FP8精度的Tensor加速算力的稀疏数值(因为4090不支持FP4);


阅读全文
相关推荐

GPU服务器前端网络组网概述

GPU服务器前端网络组网概述
根据H100-GPU服务器确认各网络平面针对H100-GPU服务器的配置清单,可进行网络平面划分:single-400GE 8x (支持IB NDR/Ethernet OSFP),用于后端网络GPU分布式集群梯度同步single-200GE 1x (支持IB HDR/Ethernet QSFP56),用于对接存储网络dual-25GE 1x(SFP+),用于对接前端网络注:single指Single Port (单口网卡),...

5月智算动态:信创GPU目录发布/tokens中转站被罚/B300回落/H2oo靴子落地/HBM3e需求爆发

5月智算动态:信创GPU目录发布/tokens中转站被罚/B300回落/H2oo靴子落地/HBM3e需求爆发
国产算力1.信创目录发布:第一批9颗信创算力芯片基于国产工艺(含封装),目录发布对各地方项目影响巨大地方态度:各地方政企“吹风”优先支持本地进目录的产品运营商态度:运营商自采项目“吹风”只能采购目录产品测试条件:前提条件,国产工艺(含代工),很多产品都送测了,第一批没进入,关键是代工(含封装)低点的问题...

北京 A100-40G 现货出租

北京 A100-40G 现货出租
GPU裸金属服务器-A100*8CPU: 2*Intel Xeon Gold 6248R(24Core,3.0GHz)内存:24*32GB系统盘:2*480GBSATA SSD数据盘:4*1.92TB NVMe SSD显卡:Nvidia A100 PCIE 40G *8网卡:1 x2*25GE价格:85000/月有效期:7天 压一付一 年闭口...

约20亿投资·140MW供电·万P算力·PUE低于1.23尚航无锡(惠山云)国际智算中心深度分析

约20亿投资·140MW供电·万P算力·PUE低于1.23尚航无锡(惠山云)国际智算中心深度分析
一、项目概况与战略定位尚航无锡(惠山云)国际智算中心位于无锡市惠山区锦惠路10号,是尚航科技在长三角枢纽布局的核心算力节点。项目于2017年启动建设,总投资超20亿元,占地近百亩,规划建筑面积约66600平方米,机柜总量15500个,IT容量近100MW。该中心是尚航科技环上海、环北京、环广州三大算力节点布局的关键一环,也是...

AI算力缺货从GPU烧到了一整条产业链?

AI算力缺货从GPU烧到了一整条产业链?
2026年,一场覆盖芯片、云、服务器与数据中心零部件的全产业链算力短缺正席卷全球。从GPU、CPU、HBM,到光模块、铜缆模块、高速交换机、电力与液冷设备,乃至云计算和Token资源,几乎全线供不应求。算力稀缺与全线涨价,已成为贯穿整个AI产业的核心叙事。这并非简单的供需错配,而是AI算力架构升级带来的系统性重构。01 需求...

GPU显卡驱动如何安装?

GPU显卡驱动如何安装?
注:GPU服务器建议不要升级内核版本,一旦升级内核后需要重新安装GPU驱动安装GPU驱动$apt-getinstallgccmake$apt-getupdate$wgethttp://cn.download.nvidia.com/XFree86/Linux-x86_64/440.44/NVIDIA-Linux-x86_64-440.44.run$sudochmod+xNVIDIA-Linux-x86_64-440.44.run$s...

GPU服务器中的ETH、RDMA、GID、NVLink分别是什么?

GPU服务器中的ETH、RDMA、GID、NVLink分别是什么?
英伟达的旗舰机型,GB300的核心优势不止在于Grace CPU+Blackwell Ultra GPU的超强硬件配置,更在于一套分层、高速、低延迟的互联传输体系。很多时候会被四个名词绕晕:ETH、GID、RDMA、NVLink。它们到底各自是什么?谁负责内网、谁负责外网?谁依赖谁、谁限制谁?算力跑不满、集群通信卡顿、RDMA掉线,根源大多藏在这四者的...

算力成本失控:CPU两轮涨价超40%,内存半年翻倍,高端GPU租赁排到2027年

算力成本失控:CPU两轮涨价超40%,内存半年翻倍,高端GPU租赁排到2027年
本周服务器硬件全线紧缺态势未改。英特尔第二轮涨价于5月底正式落地,综合涨幅 40%~51% ;内存合约价Q1创单季暴涨 90%以上 历史纪录;高端GPU租赁价格年内再涨近 40% ,H200排期已延至 2027年Q2。AI产业正从“GPU独大”转向 全栈紧缺。一、CPU:涨价加速,两轮累计超40%服务器CPU价格持续走高,英特尔已完成两轮公开涨价:第...

三步部署DeepSeek V4模型

三步部署DeepSeek V4模型
背景:DeepSeek V4其核心突破在于全系标配 100 万 token(约 75 万汉字)的超长上下文窗口‌,并针对效率与性能进行了系统性优化。目前发布了两个版本,分别为DeepSeekV4-Pro(旗舰版)‌ 和 ‌‌DeepSeek V4-Flash(轻量版),下面以DeepSeek V4-Flash(轻量版284B)部署为例展开。参考链接:https://docs.vllm.ai/projects/a...

英伟达全线产品又又又涨价!

英伟达全线产品又又又涨价!
《英伟达官宣DGX Station for Windows工作站,可运行1万亿参数模型》 这篇文章中有小伙伴提到可选配的RTX PRO 6000 Blackwell显卡价格就要10万元人民币。其实现在英伟达全系列产品都上涨了,本文盘点下相关产品的价格。英伟达全系列产品包括数据中心GPU、企业级(专业级)GPU、消费者GPU,消费者GPU包括RTX Geforce系列,企...
返回顶部