租美国服务器要不要看机柜功率密度?先分清两个数字
最近有两条机房新闻传得比较广。一条是 CVC DIF 收购了德国 firstcolo,交易里那座在建的 FRA7 机房,单机柜最高能扛 200kW,配液冷,2027 年初投产;另一条是马来西亚棕榈油局搞出了一款棕榈油基的浸没式冷却液,把整台服务器泡进去散热,说是能省 30% 到 50% 的能耗。
这两条新闻底下都有人问同一句话:那我租美国服务器,是不是也得看这个。
先给答案:200kW 这个数字跟你没关系。一台德国的、2027 年才投产的、给 AI 训练准备的机柜,不会影响你在洛杉矶租的那台 E3 或者 Gold。但"机柜还剩多少电"这个问题跟你有关系,而且比大多数人以为的更有关系。这两件事经常被混在一起谈,所以值得分开说清楚。
200kW 是给谁准备的
传统托管机房的机柜设计值,常见区间是每柜 3 到 8kW,新一点的普遍设计到 10 至 15kW,划出来做高密度的区域能到 20kW 以上。各家差异很大,这只是个大致的量级感。
200kW 比这高一个数量级。它对应的是整柜塞满 GPU 训练节点的场景,也只有这种场景撑得起液冷的建设和维护成本。液冷目前还是少数派——按 DCD 的报道口径,全球采用浸没式冷却的数据中心大约只占 1%,卡点主要在维护流程上:机器泡在油里,换个盘、插个网线都不是原来那套操作了。
所以这类机房的容量,基本是签长约的云厂商和 AI 公司在消化,很少会变成市场上零散可租的独立服务器。你在报价单上看到的美国服务器,绝大部分仍然跑在风冷机房里,这个状况短期内不会变。
明白这一点,就不用被这类新闻牵着走。真正会硌到你的,是另一个数字。
会硌到你的那个数字
租服务器的人很少问机柜功率,因为交付的时候机器是好的、能跑,看不出问题。问题通常在半年后出现,形式是这样的:
你想加两张 GPU,或者从 8 盘位加到 16 盘位,工单发过去,机房回复说这个位置加不了,要换柜,换柜要停机迁移,迁移可能还要重新配 IP。这时候才发现,当初那台机器所在的机柜,剩余功率余量本来就不多。
算一笔简单的账。假设机柜按 6kW 设计,实际可用一般会留些余量,姑且算 5kW 出头。一台常规双路服务器满载通常在 400W 到 800W 之间,新一代高 TDP 平台会更高,单颗 CPU 的 TDP 就能到 350W 甚至更多。按 600W 估,这个柜子装八九台就基本到顶了,还没算交换机和 PDU 本身的开销。你要往里塞一台满载 2kW 的多卡 GPU 机器,等于占掉三四台常规机器的位置——机房要么不接,要么就得给你稀释着放,周围空出来的位置也是成本,最后一定会体现在报价里。
这就解释了一个常见现象:同样挂着"美国服务器"的牌子,有些高配机型的价格明显不成比例,或者常年显示缺货。不一定是商家不想卖,也可能是机柜里的电和风确实不够分。
还有一种更麻烦的情况,是机器给了,但跑不满。散热跟不上的时候 CPU 会降频保护,GPU 同理。这种损耗不会报错,也不会触发告警,你只会觉得这台机器好像没有想象中快,然后去怀疑 CPU 型号选错了。
怎么自己查,怎么问机房
自查这件事其实不难,多数人只是没想到去查。
带 IPMI 或 iDRAC 的机器可以直接读整机功耗。用 ipmitool sensor 或者 ipmitool dcmi power reading 看当前功率,跑一轮压力测试再读一次,就能拿到自己这台机器的空载和满载区间。有这个数,后面所有讨论才有依据——你至少知道自己占了多少。
然后是向机房提问。这里要说句实话:很多机房不会直接告诉你机柜的设计功率和剩余余量,尤其是转售商,中间隔了一层,销售自己也未必清楚。这是行业现状,得接受。所以问法比问题本身重要,与其问"你们机柜多少 kW",不如把问题落到具体动作上:
我这台机器后面要加两张 300W 的卡,这个位置能不能加电?
这个问题机房是要回答的,因为它对应一个具体的工单。销售答不上来,一般会去问机房侧,而这个来回本身就能告诉你不少信息——如果对方能明确给出"可以,加到多少瓦以内没问题",说明这个位置有余量;如果只是含糊说"应该可以",那在你真正要加的时候大概率会出问题。
同样的问法可以套到别的场景:从 8 盘加到 16 盘、从单电源换双电源、把内存插满。都是具体动作,都能问出真东西。
另外值得问一句的是计费方式。有的机房按机位收费,电在一定额度内包含;有的按实际功耗或者按预留功率单独计。这两种模式下,你加硬件的成本结构完全不同,签合同之前问清楚,比事后扯皮省事。
大多数业务其实不用管这些
写到这里得往回收一收,不然容易显得这个问题比实际更严重。
企业官网、外贸独立站、WordPress、常规 API 服务、中小型数据库,这类业务单机满载也就几百瓦,普通风冷机房绰绰有余,机柜功率永远不会成为你的瓶颈。这些业务真正该盯的还是老三样:线路质量、带宽是否够用、故障响应快不快。为了一个用不上的功率余量去挑机房,属于用错了力气。
SellBGP 的美国服务器部署在洛杉矶 CoreSite LA2 和 600 West 7th Street,走的是常规商用机房路线,常规机型的供电和散热有充分余量,不需要客户操心这一层。
功率密度真正变成问题,是在负载往高功耗方向走的时候:多卡 GPU 推理、渲染、大规模并行计算、高密度存储。这几类业务在选型阶段就该把散热和供电摆到台面上谈,而不是等上线以后再补。如果业务是这个方向,可以直接看高存储服务器或 GPU 服务器这类针对性配置,选型时把预期的满载功耗和后续扩容计划一并说明,让机房侧提前排位置。
说到底,这条新闻对普通租户的价值不是"我也要 200kW",而是提醒了一件平时不会想起来的事:你租的不只是一台机器,还有它在那个柜子里占的电和风。平时感觉不到,要加东西的时候才会撞上。上线前顺手读一次功耗、问一句能不能加电,成本几乎为零,能省掉的是半年后一次计划外的停机迁移。