云擎天下-超高性价比AI算力服务平台

 A100 pcie40G - 1200/卡/月;裸金属八卡机:8*910B - 15000/月  8*4090 - 7800/月  8*5090 - 12000/月  8*A100 pcie40G - 9000/月  8*A100 pcie80G - 25000/月  8*A100 nvlink80G - 35000/月  8*A800 nvlink80G - 34000/月  8*H20*96G - 35000/月 8*H20*141G - 46000/月  8*L40 - 12000/月  8*L40S - 16000/月 8*H100 - 75000/月 8*H800 - 69000/月 8*H200 -94000/月 8*B200 -130000/月 8*B300 -280000/月 

全球GPU算力资讯简要【20260628】

一、字节跳动洽谈采购天数智芯5万颗AI推理芯片
字节跳动正与国产GPU厂商天数智芯洽谈采购至少5万颗AI芯片,主要用于推理工作负载。若交易达成,天数智芯将成为继华为和寒武纪之后,字节跳动的第三家GPU供应商。2026年字节预计投入约1500亿元用于全球算力采购,其中国内约600至650亿元,国产算力预计将占400亿元以上份额。

二、江原科技发布旗舰AI芯片“江原T1”
6月24日,江原科技在APEC中小企业工商论坛上首发自研旗舰高端算力芯片——江原T1。该芯片从架构设计到制造封装全面实现国产化,综合性能对标国际一线高端算力产品,达到国产量产芯片**梯队水平。江原科技已构建“芯片+云服务+大模型+行业应用”一体化产品体系。

三、燧原科技科创板IPO过会
国产GPU“四小龙”之一的燧原科技科创板IPO成功过会。公司2026年一季度实现营业收入2.87亿元,同比增长1474.85%,预计上半年营收达10.6亿至11.5亿元。

四、MWC上海展会算力供应链厂商集中亮相
6月24日MWC26上海开幕,诸多算力供应链厂商参展。当前CPU、光纤等算力核心部件均出现紧缺,服务器订单积压排队。

五、国内AI大模型周调用量持续领跑全球
据行业平台统计,6月15日至19日中国AI大模型周调用量近13万亿Token,持续领跑全球。国产模型与国产芯片加速协同,DeepSeek V4、GLM 5.2等均与华为昇腾、寒武纪、海光等国产芯片厂商实现Day0适配。

六、英伟达宣布Vera Rubin NVL4超算系统Q4起供货
6月22日,英伟达宣布推出Vera Rubin超级计算平台,结合Rubin GPU与Vera CPU,单系统可提供超过7 exaflops级AI算力与约5 PF FP64科学计算能力,支持最高144 GPU/机架密度。戴尔、HPE、Supermicro等厂商也将推出基于该架构的高密度超算系统。

七、OpenAI联合博通发布首款自研AI推理芯片Jalapeño
6月24日,OpenAI与博通联合发布首款定制AI推理芯片Jalapeño,专为大语言模型推理设计的ASIC芯片,从设计到流片仅用时9个月。OpenAI负责底层架构设计,博通负责硅片实现与网络硬件。工程样片已在实验室中成功运行GPT-5.3、Codex和Spark等工作负载。OpenAI表示这是其多代计算平台计划的**步。

八、AMD股价年内飙升超130%,华尔街机构密集上调目标价
截至6月,AMD股价年内已飙升逾130%,6月至少六家华尔街机构上调其目标价。花旗将AMD上调至买入,称其MI450 GPU是英伟达的“合法替代品”。花旗预计AMD的AI GPU收入短期内将达到330亿美元。AMD一季度营收达102.5亿美元,数据中心业务同比增长57%。

九、高通发布数据中心整体战略及Dragonfly产品组合
6月25日,高通正式发布数据中心整体战略,推出Dragonfly数据中心产品组合,并已拿下Meta、微软等客户。三家巨头(英伟达、OpenAI、高通)在同一天的布局表明,AI芯片竞争正从单一GPU竞赛进入GPU、ASIC、CPU、内存、网络和软件生态共同竞争的新阶段。

十、全球算力租赁价格持续上涨,算力资产稀缺性强化
据租赁市场监测数据,截至6月15日,英伟达B200按需租赁均价较去年6月上涨约7%,B300较去年11月上涨超50%,旧款H200、H100租赁价格亦小幅上涨约3%。另有云服务商计划于10月将B200租赁续约价格上调约94%。千卡级GPU采购订单交付周期已延长至2027年。

商务合作:cloud-engine-ben(微信)
客服热线:19886543806
联系地址:深圳市南山区招商街道沿山社区南海大道1079号花园城数码大厦A座二楼
企业信息