业余博主在线分享,部分数据可能存在误差,要是你知晓正确内容,欢迎评论区留言找茬,一起互相指正!
2022年底英伟达推出RTX 4080,这款显卡配备16GB显存,主要面向游戏玩家和轻度创作者使用,当时RTX 4090已经搭载24GB显存,但价格实在太高,很多用户想运行30B参数的大模型,却发现16GB显存根本不够用,一旦显存满了系统就卡住,只能换显卡或者改用云服务,英伟达没有在消费级产品中加入32GB版本,却在A100、H100这类专业卡上直接配置大容量显存,相当于将普通用户与AI生产力需求隔离开来。
到了2026年夏天,闲鱼平台上突然出现大量标着“全新未拆”的RTX 4080显卡,它们都声称拥有32GB显存,外观却保持着老款的涡轮散热设计,实际上这些卡是经过民间技术爱好者改造的产物,原本只有16GB的显存芯片被额外焊接了16GB,凑成了32GB的总容量,但CUDA核心数量没有增加,位宽依旧维持256-bit,甚至可能连BIOS都没有重新编写,这种做法已经超出了普通超频的范畴,相当于硬生生将一张游戏显卡改造成了适合推理计算的硬件。
有人抢着买这款设备,特别是那些做本地AI推理的小团队,他们花一万多块钱就能拿下,比租用云服务划算很多,也比二手H100便宜不少,运行30B模型时显存不会爆掉,缓存可以多装一些中间结果,用起来确实方便,但也有人遇到问题,比如驱动识别不了新加的显存,散热跟不上,系统时不时蓝屏,还有案例显示焊接位置出错,导致PCIe信号混乱,整台机器没法用,至于售后服务,根本就没有这个选项。
这件事其实早有先例,2020年就有人把2080Ti加到48GB显存,用来挖矿和训练小模型,那些卡用了好几年,说明消费级硬件确实有潜力,只是厂商故意限制着不放出来,英伟达靠显存容量来分档定价,16GB给玩家用,24GB以上留给企业客户,利润稳稳的。
从技术角度来说,这些改装显卡的带宽还是短板,256-bit的位宽比不过4090的384-bit,数据吞吐速度慢,但很多推理任务对显存的利用率还不到70%,这种时候多出16GB显存比速度快一点更重要,能顺利运行就够了。
现在这些显卡大多是个人卖家挂出来的,没有原包装,也没有检测报告,平台也不怎么管,从法律上说这不算违法,但企业采购不敢碰,学校搞科研也不会把它列进预算里,有意思的是,七月份国产芯片厂商悄悄推出了32GB GDDR6X的消费级显卡,性能虽然比不上4090,但至少多了一个选择,我觉得民间这股魔改风潮背后,不只是因为显存不够用,更多是大家对垄断现象的一种小小反抗。
热门跟贴