问AI · 5090成企业级显卡平替折射何种算力缺口?
英伟达面向顶级PC游戏玩家推出的旗舰显卡GeForce RTX 5090,如今在部分市场的售价已经超过5000美元,原因是一些买家正将其用作企业级GPU的替代品。
RTX 5090最初于2025年1月发布,建议零售价为1999美元,但由于AI系统搭建者大量抢购有限的供货,其价格已经飙升至5000美元以上。香港科技媒体HKEPC最先报道称,本应用于运行《使命召唤》等游戏的5090显卡,正被装进工作站中,取代英伟达的企业级显卡RTX 6000。
5090与6000有诸多共同点,规格表也十分相似。两者都基于Blackwell架构打造;6000拥有24000个核心,而5090为21000个核心。6000的最大性能为126 TFLOPS,5090则为104 TFLOPS。
两者最大的差距在于板载显存。5090显卡配备32GB显存,而6000则配备96GB显存,这在AI应用中会造成巨大差异。使用5090显卡,用户无法加载超过32GB的模型,而使用6000显卡,则可以加载最大96GB的模型。这一点绝对会造成明显的区别。
AI公司传统上依赖专用硬件,比如英伟达的数据中心加速器和专业级GPU。然而,随着AI工作负载持续扩张,市场对几乎任何能够提供强大算力的高性能GPU都产生了需求。
即便售价高达5000美元,5090仍然算得上是一笔划算的交易。6000的平均售价在12000美元到15000美元之间。
Jon Peddie Research公司总裁乔恩·佩迪表示,对于某些应用场景和客户来说,5090可能已经完全够用。他说:“如果你运行的是能够装进32GB显存的小型模型,并且不在意纠错功能,那么5090就是一种廉价的AI训练方案。这种方案可能适用于内部系统,但对于必须满足各种工作负载需求的超大规模数据中心运营商来说,就派不上用场了。”
而且32GB的空间其实并不算宽裕。举例来说,一个参数量为70亿、以FP16精度运行的相对较小模型,就需要80GB的显存。
英伟达方面未回应置评请求。
Q&A
Q1:RTX 5090和RTX 6000有什么区别?
A:两者都基于Blackwell架构,性能规格相近,但最大区别在于显存容量。RTX 5090配备32GB显存,RTX 6000配备96GB显存,这使得6000能够加载更大的AI模型,而5090只能加载不超过32GB的模型。
Q2:为什么游戏显卡RTX 5090的价格会涨到5000美元以上?
A:因为一些AI系统搭建者将其作为企业级GPU的替代品来抢购,导致供不应求。虽然RTX 5090原本是为游戏设计的,但其算力表现足以吸引部分AI用户,尽管价格已远超1999美元的原始建议零售价,但仍比价格在12000到15000美元的RTX 6000便宜不少。
Q3:用RTX 5090做AI计算靠谱吗?
A:对于运行小型模型且不介意缺乏纠错功能的用户来说,RTX 5090可以作为廉价的AI训练方案,但32GB显存空间有限,例如一个70亿参数的小型模型在FP16精度下就需要80GB显存,因此并不适合需要处理各种复杂工作负载的大型数据中心运营商。
成为付费用户可以阅读 英伟达 所有资料
了解更多 →