| A100 pcie40G - 1200/卡/月;裸金属八卡机:8*910B - 15000/月 8*4090 - 7800/月 8*5090 - 12000/月 8*A100 pcie40G - 9000/月 8*A100 pcie80G - 25000/月 8*A100 nvlink80G - 35000/月 8*A800 nvlink80G - 34000/月 8*H20*96G - 35000/月 8*H20*141G - 46000/月 8*L40 - 12000/月 8*L40S - 16000/月 8*H100 - 75000/月 8*H800 - 69000/月 8*H200 -94000/月 8*B200 -130000/月 8*B300 -280000/月 |
英伟达B200 GPU租赁价格暴涨94%!算力租赁市场迎来“黄金时代”
一、一则消息引爆算力租赁概念股2026年6月17日,AI推理基础设施服务商Baseten首席执行官Tuhin Srivastava披露了一个令整个AI行业为之震动的消息:其云服务商已正式通知,英伟达B200 GPU租赁价格将在今年10月续约时从每小时2.63美元上涨至5.10美元,涨幅高达约94%。 消息一出,资本市场迅速反应。6月18日,算力租赁概念午后全面拉升,东方国信涨停,中嘉博创、智微智能等多只概念股同步涨停。科创创业人工智能ETF华安上涨5.65%,成交额近1.5亿元。寒武纪上涨超14%,海光信息、中际旭创等算力产业链核心标的纷纷跟涨。科创创业AI指数近6个月涨幅已超过48%,算力相关权重占比超七成,充分反映了市场对算力产业链景气度的高度认可。 二、94%涨幅背后:算力供需失衡已到临界点B200租赁价格为何暴涨94%?答案藏在供需两端。 需求侧正在经历爆炸式增长。中国信通院数据显示,2026年一季度国内AI算力需求同比暴涨417%,而供给增速仅为128%。随着大模型从“即时问答”走向“长程任务”——让AI像人一样连续工作数小时、自主完成一个完整的大型工程——推理任务对算力的消耗呈指数级增长。德勤研报显示,2026年推理任务将占据全球AI总计算负载的三分之二。 根据全球头部AI聚合平台OpenRouter的最新统计数据,国内AI大模型周Token调用量已连续七周稳居全球**,周调用量达14.19万亿Token,环比大幅增长27.49%,已连续六周超越美国。万联证券研究认为,随着国产大模型的能力迭代升级,应用场景拓宽拓深,Token调用量有望持续增长。 供给侧则持续吃紧。英伟达Blackwell架构的B200/H200等高端芯片在全球范围内供不应求。当前采购1000块GPU的交付周期已延长至12至15个月,新订单普遍排至2027年第二季度。国盛证券研报指出,仅头部云厂商能够获得较为充足的高端算力,二线云厂商及大模型公司对高端算力的需求远未满足,缺口巨大。 供需失衡直接推高了算力租赁价格。根据半导体研究机构SemiAnalysis发布的H100一年期租赁合约价格指数,英伟达H100 GPU的租赁合约价格从2025年10月触及每GPU每小时1.70美元的低点后,已飙升至2026年3月的每GPU每小时2.35美元,涨幅接近40%。国内市场上,H100月租已站稳5.5万至6万元区间,新签合同交付排期普遍延至2027年上半年。在现货市场,供需紧张程度更为极端——全类型GPU的按需租赁产能已全面售罄,即便价格持续上涨,已锁定按需实例的用户也不愿将产能释放回市场。花旗分析师在6月14日发布的报告中也指出,A100 GPU租赁价格过去一周上涨0.6%,六周累计上涨11%,表明AI算力需求并非只集中在***的硬件上。 上游算力硬件已开启全面涨价潮。据华龙证券研报,CPU方面英特尔和AMD已分别于2026年3月底和4月起通知客户上调全系列CPU产品价格,平均涨幅在10%至15%之间。华泰证券指出,国产AI芯片也正迎来涨价窗口,下半年HBM采购成本涨幅或超50%,AI芯片综合成本上涨约30%至50%。 三、算力租赁市场迈入2600亿时代GPU租赁价格的飙升,是整个算力租赁市场蓬勃发展的缩影。 据中国信通院数据,2026年一季度国内算力租赁市场规模已达680亿元,同比增长62%,预计全年将突破2600亿元。从更长的周期来看,中国算力租赁市场规模从2024年的约1480亿元增长到2025年的约2116亿元,2026年有望达到2600亿元上下。 从租赁体量来看,据科智咨询数据,中国智能算力租赁市场规模从2024年的377EFLOPS增长到2025年的632EFLOPS,2026年预计达984EFLOPS,呈翻倍式增长。2026年算力租赁订单将密集释放,全年租赁体量有望达到2025年的4倍。 与此同时,百亿级算力合作大单近期在资本市场密集涌现,各类企业纷纷跨界进入算力赛道。据央视新闻报道,算力行业被视为数字时代的高端“写字楼租赁”生意——企业巨额投入建设机房和设施,再出租算力资源以获取收益。 在政策层面,国家正以前所未有的力度推动算力基础设施建设。“十五五”规划纲要明确提出深入推进“东数西算”工程,构建多层次算力设施体系和全国一体化算力网。国家数据局印发的《2026年数字经济发展工作要点》将“加快建设全国一体化算力网”列为重点任务。工业和信息化部正在按照“点、链、网、面”体系化思路推动算力基础设施建设。据测算,算力网直接投资将达到万亿量级,还将带动人工智能、自动驾驶、低空经济等产业加快成长。 四、互联网大厂竞速搭建算力护城河在这场算力争夺战中,国内互联网巨头正在以前所未有的速度加码算力布局。 字节跳动正与天数智芯讨论采购至少5万颗AI芯片,主要用于大模型推理负载。若交易达成,天数智芯将成为继华为和寒武纪之后,字节跳动的第三家GPU供应商。字节跳动已明确将训练和推理两套芯片供应链完全拆分:大规模模型训练采用华为昇腾、寒武纪高端训练卡;线上C端豆包、企业MaaS海量并发推理则引入天数智芯智铠系列等专用推理GPU。 除了字节跳动,互联网大厂均在密集布局数据中心。百度在全国布局万卡级AI算力集群规模;阿里巴巴2026财年单季度资本开支超380亿元,预估未来三年超3800亿元加码云和智算硬件;腾讯在全国多地建设腾讯云HCC高性能AI集群,2026年下半年大规模导入国产算力,同步对外提供混元大模型MaaS、游戏AIGC、视频生成推理服务。 面壁智能AI Infra技术负责人分析称,互联网大厂密集构建多供应商算力体系主要基于供给确定性、议价权与成本结构——在大厂算力需求中,推理体量远大于训练,而推理对芯片的要求比训练低一个台阶,国产芯片在推理侧已达可用水平。 五、国产算力崛起:GPU租赁的“中国方案”在海外GPU租赁价格暴涨、交付周期不断延长的背景下,国产算力生态正在加速形成,为AI开发者和企业提供了GPU租赁的全新选择。 大模型与国产算力深度绑定。 6月17日,智谱正式上线并开源新一代旗舰大模型GLM-5.2,主攻“长程任务”能力,在全球百万用户参与的前端开发评估系统Code Arena上取得全球可用模型**的表现。GLM-5.2采用MIT协议开放、允许免费商用,线上推理已全面依托多个国产算力平台,在Day 0即完成与华为昇腾、平头哥、摩尔线程、寒武纪、昆仑芯、沐曦、海光、壁仞等8大国产算力平台的全适配。预计下半年昇腾950超节点上市后,将成为GLM-5.2强劲的算力底座。 国产芯片完成万亿级大模型训练验证。 近日,深圳河套学院AI训练平台项目团队联合哈尔滨工业大学、华为等机构,基于昇腾910C国产AI算力集群,成功完成1.6万亿参数DeepSeek-V4-Pro大模型的全参数后训练。该项目模型算力利用率突破30%,核心训练算子效率提升14%,各项指标均达到工业级应用标准。这一实践验证了国产AI芯片具备支撑***超大参数模型训练的能力。此前,国产算力多应用于模型推理和小幅微调,难以胜任全参数深度训练,此次突破标志着国产算力不再局限于推理环节。 国产芯片获***认证。 2026年5月,国家首次在安全可靠测评中设立AI芯片品类,9款国产芯片获评最高安全可靠等级I级,华为海思、阿里平头哥、壁仞科技、海光信息、天数智芯、沐曦股份、摩尔线程榜上有名。信创国产化已成为面向政企、央国企业务的硬性合规要求。 国产GPU企业加速产品迭代。 6月17日,专注3D架构AI云端大算力芯片的算苗科技宣布,其面向大模型推理的3D TokenPU芯片A4E正式流片,实现了依托国产供应链的高端AI算力芯片落地。6月13日,MiniMax正式开源***上下文多模态大模型M3,摩尔线程宣布旗下AI训推一体智算卡MTT S5000已完成首发适配。 国产算力租赁平台正在崛起。 以深圳市云擎天下科技有限公司旗下的云擎天下算力租赁平台为例,该公司是一家专注于批量供应GPU算力资源与服务的专业平台。平台汇聚了从RTX 3090、4090等消费级显卡到A100、A800、H100、H800等企业级数据中心GPU的全谱系算力阵容,同时覆盖NVIDIA全系及国产信创GPU服务器。依托海量高性能算力集群基础设施,云擎天下为人工智能领域上下游行业客户提供灵活高效的GPU云租赁、显卡及服务器整机购买等服务。在行业影响力方面,云擎天下先后亮相2024中国算力大会和2025中国算力大会,展示了其在GPU算力租赁领域的核心优势。在海外GPU租赁价格暴涨、交付周期长达15个月的背景下,以云擎天下为代表的国产算力租赁平台,凭借高性价比和多元化的算力供给体系,正在成为越来越多AI开发者和企业的务实选择。 六、从“卖算力”到“卖Token”:算力租赁模式升级值得关注的是,算力租赁的业务模式正在发生质的飞跃——从单纯的裸算力出租,进化为模型服务或Token分成模式,即从“卖算力”转向“卖Token”。这一转型意味着算力租赁的价值链条正在延伸,行业天花板被进一步打开。 2026年正是AI从训练转向推理主导的关键拐点。OpenClaw、ClaudeCode等Agent框架迅速普及,算力的应用从训练走向智能体等推理需求主导,从问答模式走向智能体循环,从单轮生成升级为多步规划、持续执行。TrendForce数据显示,北美五大云服务商2026年AI训练算力预计增长56%,而推理算力将暴增122%,后者增速是前者的两倍以上。IDC预测,到2029年中国市场推理算力占比将接近八成。 推理时代对算力租赁提出了全新要求——低延迟、高效缓存管理、异构芯片协同。以Groq LPU为代表的专用推理芯片正在兴起,与GPU结合进行异构计算,推动推理能力和效率普惠。这意味着GPU租赁不再只是提供单一种类的芯片,而是要构建覆盖训练、推理全场景的多元化算力供给体系。 七、算力租赁:AI时代的“新石油”英伟达B200 GPU租赁价格暴涨94%,绝非偶然。它是AI算力供需严重失衡的必然结果,也是算力租赁市场进入“黄金时代”的强烈信号。 对于AI创业公司、科研机构和传统企业而言,自建算力基础设施的门槛正在变得难以逾越——GPU采购周期长达15个月、单卡成本持续攀升、技术迭代速度不断加快。在这种背景下,算力租赁和GPU租赁正在成为获取AI算力的**解。 从2600亿的市场规模,到417%的需求增速,再到94%的租金涨幅——所有数据都在指向同一个结论:算力即权力,租赁即未来。谁能以更灵活、更高效的方式提供算力租赁服务,谁就能在这场AI竞赛中占据先机。随着国产算力生态的日益成熟和“模型—算力—应用”产业正循环的加速跑通,GPU租赁市场正迎来前所未有的发展机遇。 声明:此篇为云擎天下-超高性价比AI算力服务平台原创文章,转载请标明出处链接:https://www.omniyq.com/sys-nd/575.html
|