据CNBC报道,英伟达GPU在人工智能领域供不应求,其股价本周再创纪录,市值接近6万亿美元;企业正通过亚马逊、微软、谷歌等大型云服务商,CoreWeave等新兴云服务商,线上市场乃至直接采购获取算力。英伟达管理层预计,截至10月的季度营收将达到1080亿美元,同比增长89%。

选择增多也让急需算力的企业面临决策难题。云基础设施提供商多年来位居英伟达客户名单前列,但其业务正在多元化。一份文件显示,7月季度有五家客户至少占英伟达应收账款的10%,高于1月季度的三家。行业研究机构SemiAnalysis统计,截至9月,英伟达GPU提供方数量为323家,而不到11个月前为209家。英伟达首席执行官黄仁勋上月在旧金山高盛科技会议上说,将会出现一批“非常非常令人兴奋”的新云,合计手握数千亿美元订单积压。

许多大公司每年在亚马逊、谷歌和微软的多种云服务上花费数千万美元。自2022年ChatGPT推出以来,企业越来越多地转向超大规模云厂商获取GPU,以运行生成式AI工作负载。AI助手初创公司Abacus首席执行官宾杜·雷迪说,与企业客户交谈时,你的次级处理商最好是Azure。Gartner的数据显示,亚马逊和微软在2025年控制了59%的云基础设施市场;过去一年,Anthropic和OpenAI承诺在亚马逊和微软之间支出超过5000亿美元。Gartner分析师哈迪普·辛格说,超大规模云厂商凭借十多年的全栈能力,处于向企业展示信任的有利位置,但它们并不总有企业所需的那么多GPU。亚马逊首席执行官安迪·贾西7月对分析师说,这家零售商和云先驱无法满足其预计今年的全部需求,并认为2027年也会如此。

如果超大规模云厂商供应充足,新云就不会激增。运营虚拟沙盒的初创公司Modal从使用超大规模云厂商转向与主要新云签约,目前使用25家新云,其首席执行官埃里克·伯恩哈德松说,你可以获得几百块甚至一千块GPU,但在我们的规模上,需要多得多的GPU。谷歌和微软已开始向CoreWeave采购,尽管彼此之间也存在竞争。总部位于荷兰、在美国运营的新云Nebius首席营收官马克·博罗迪茨基说,一些超大规模云厂商接触他们,希望照顾那些他们担心无法在客户需要时提供服务的客户。视频生成初创公司Reactor通过Nebius和超大规模云厂商使用GPU,其首席执行官阿尔贝托·泰乌蒂说,数据中心位置很重要,Nebius以不错的价格提供Reactor需要的特定GPU、可靠的客户服务以及足够的硬件和软件。

最显眼的新云可能要求预付部分款项,芯片可能几个月后才能上线,因为供应商根据合同融资并搭建数据中心设备,伯恩哈德松说。CoreWeave执行副总裁陈·戈德堡说,CoreWeave很难在提前一天通知的情况下向新客户交付1万块GPU。首席执行官迈克·因特拉托在公司8月财报电话会上说,CoreWeave的近期容量基本售罄。如果企业想立即获得GPU,可能不得不考虑知名品牌之外的选择。一些新云并非家喻户晓,因为它们瞄准特定国家,这在某些情况下可行。Runpod首席执行官甄陆说,目前容量紧张,对像我们这样的公司来说,与供应商的关系实际上是最严守的秘密之一。专业新云比大型GPU云可以提供更多灵活性,后者通常要求预付款和长期承诺。