ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

字节要买 100 万张显卡,但不是用来打游戏的

字节要买 100 万张显卡,但不是用来打游戏的 9月27号外媒 The Information 报道了一个消息字节跳动在考虑采购约 100 万张英伟达 RTX PRO 5500 显卡用途是跑 AI。100 万张是什么概念英伟达每个季度对中国市场的供应量大约是 50 万张。也就是说字节一家公司的采购计划就能吃掉两个季度的全部配额。但有意思的不是数量是型号。字节没有去买玩家们抢破头的 RTX 5090也没有去买那种动辄几十万一张、被管制卡着脖子的数据中心专用卡。它选了一张中间的卡——RTX PRO 5500一张面向工作站的专业显卡。这就有意思了跑 AI 到底该买什么卡大厂的选择和玩家的选择为什么差这么远一张显卡的三个身份同样是英伟达出的卡其实分成三个完全不同的世界卡的类型例子卖给谁大概价位消费级游戏卡RTX 5090玩家、个人2万—4万元专业工作站卡RTX PRO 5500企业、机房面向企业采购数据中心加速卡H100 / B200超大厂几十万一张还被管制字节选的 RTX PRO 5500 就卡在中间那个位置比游戏卡贵、比数据中心卡便宜而且不在美国出口管制重点盯防的数据中心加速器清单里——路可能绕得开这是它现在这么抢手的现实原因之一。大厂挑卡看的不是跑分很多人以为跑 AI 就是看显卡算力强不强、跑分高不高。实际上大厂选卡第一眼看的是显存。显存可以粗暴地理解为显卡自己的工作台。模型越大需要的工作台越大。工作台不够大模型就装不下算力再强也白搭。打个比方RTX 5090 是一张 32GB 显存的卡相当于一张能铺开中型图纸的办公桌RTX PRO 5500 有 84GB相当于一张两倍多宽的大绘图台。你跑一个中小型 AI 模型比如常见的十几B参数级别5090 那张办公桌够用速度快价格低很香但你要跑更大的模型30B、70B 级别5090 的桌面就摆不下了这时候 5500 的大桌面一张卡就能装下不用两张卡拼。字节买卡是给豆包这种全民级 AI 用的——每天几亿人次提问模型必须大所以大显存比高跑分值钱。这就是它选 5500 而不是 5090 的核心逻辑。第二个差别一张卡能不能分着用还有个更少人知道的功能叫 MIG。简单说RTX PRO 5500 可以在硬件层面把一张卡切成两个独立的小卡比如把 84GB 切成两个 42GB分别给两个不同的业务用互相不干扰——就像一间大办公室隔成两间独立会议室一边开会另一边完全不受影响。这对企业特别重要。一家公司可能同时要跑白天给客服用的问答模型、给搜索用的排序模型、给内部用的文档模型。用 5500一张卡就能切成两半各干各的用 5090做不到这种硬件级隔离只能靠软件凑合稳定性和安全性都差一截。而企业采购时最怕的就是一个业务出问题连带全崩。所以这个分身能力是很多人愿意多花钱买专业卡的原因。那大厂怎么用这些卡不是一张一张插在电脑里用。是把 8 张卡装进一台 4U—5U 的服务器里再把几十台服务器推进机房组成一个卡池。上面跑推理引擎可以理解成AI 接线员软件外面接上 API谁要用 AI 就来调。字节那 100 万张卡最终就是变成几万、几十万台这样的 8 卡服务器日夜不停地回答用户的问题。这叫推理——AI 训练好之后、每天实际干活的过程。现在行业里推理需求已经是训练的好几倍这才是最大的显卡市场。现在入场还有个现实问题在涨价最后说个坏消息。如果你看完心动想给公司配一台跑 AI 的机器——现在整机里涨得最凶的不是显卡是内存。2026 年二季度内存DRAM的合约价一个季度就涨了 58% 到 63%服务器专用内存条每 GB 的价格大概涨了四倍。原因不复杂全世界的数据中心都在抢内存而能大规模生产内存的只有三星、SK 海力士、美光这三家产能根本跟不上。连英伟达这种毛利率 75% 的巨头都扛不住已经通知微软、谷歌这些客户明年年初出货的服务器价格要涨 15% 以上。所以如果你 2026 年有采购计划一个朴素的建议预算要按现在做不要按半年后降一点做——这轮周期里等降价的人一直在多花钱。写在最后回到开头那个问题字节买 100 万张 5500你买 5090谁买错了都没错。跑分是给玩家的显存和分身能力是给企业的——需求不同答案就不同。对个人和中小团队5090 的 8 卡整机依然是性价比很高的选择对要跑大模型、要多业务隔离的企业5500 这种大显存专业卡才是对口的工具。看懂了这个区别你就看懂了这轮 AI 硬件热潮里最核心的一个生意逻辑。
返回列表