云擎天下-超高性价比AI算力服务平台

 A100 pcie40G - 1200/卡/月;裸金属八卡机:8*910B - 15000/月  8*4090 - 7800/月  8*5090 - 12000/月  8*A100 pcie40G - 9000/月  8*A100 pcie80G - 25000/月  8*A100 nvlink80G - 35000/月  8*A800 nvlink80G - 34000/月  8*H20*96G - 35000/月 8*H20*141G - 46000/月  8*L40 - 12000/月  8*L40S - 16000/月 8*H100 - 75000/月 8*H800 - 69000/月 8*H200 -94000/月 8*B200 -130000/月 8*B300 -280000/月 

全球GPU算力资讯简要【20250726】

一、华为昇腾384超节点真机全球首秀

华为在2025世界人工智能大会(WAIC)首次线下展出昇腾384超节点真机,整合384颗昇腾NPU与192颗鲲鹏CPU,算力达300 Pflops,性能为英伟达NVL72系统的1.7倍。其网络带宽(269TB/s)和内存带宽(1229TB/s)分别提升107%和113%,突破通信、散热与生态适配三大瓶颈。

⚡️ 二、国产砺算G100 GPU跑分超英伟达RTX 4060

砺算科技G100 GPU现身Geekbench,OpenCL跑分111,290分,超越英伟达RTX 4060约10%,采用自研TrueGPU架构,支持DirectX 12等主流接口,计划7月26日正式发布。

三、阶跃星辰Step 3大模型适配国产芯片

阶跃星辰发布Step 3大模型,在国产芯片上推理效率达DeepSeek-R1的300%,并联合华为昇腾、沐曦等近10家芯片厂商成立“模芯生态联盟”,推动国产算力协同。

四、摩尔线程:大模型算力需求5年激增千倍

摩尔线程副总裁王华指出,2020-2025年大模型训练算力需求增长近1000倍,FP8精度和万卡集群成为刚需。摩尔线程已构建支持FP8混合精度训练的国产集群方案,性能提升20%-30%。

五、OpenAI推理模型夺IMO**,GPT-5预热

OpenAI全新推理模型在2025国际数学奥林匹克竞赛(IMO)中达到**水平,攻克100分钟深度推理难题,并预告GPT-5即将发布,凸显算力扩展与强化学习突破。

六、英伟达Jetson Thor端侧芯片即将发售

英伟达端侧算力芯片Jetson Thor T5000(算力2070T FP4)和T4000(1200T FP4)即将量产出货,支持具身智能与边缘实时处理,为自动驾驶、机器人提供云端协同算力。

七、英伟达/AMD恢复对华供应“降级版”芯片

英伟达H20、AMD MI309等“特供版”GPU恢复对华出口,但性能大幅受限(如H20算力仅为A100的15%)。国内企业采取“两条腿走路”策略,兼顾采购与自主研发。

八、上海证劵:大模型竞赛持续驱动算力投资

OpenAI ChatGPT Agent上线推动算力消耗激增,叠加GPT-5发布预期,算力基础设施(光模块、PCB、液冷等)投资需求将持续高企,国产GPU厂商加速承接外溢订单。

九、国内算力产业链多环节创新高

光模块(周涨27.45%)、液冷、IDC等算力硬件板块股价领涨,中际旭创、新易盛等龙头扩产应对需求。华为昇腾生态已汇聚665万开发者及8800家合作伙伴。

十、上海打造全球AI算力高地

上海将AI纳入三大先导产业,全市综合算力指数全国首位,徐汇“模速空间”与浦东“模力社区”形成东西协同生态链,推动芯片-模型-应用全链路创新。

总结本周趋势

  1. 国产算力突破:昇腾384超节点与砺算G100标志硬件性能跃升;

  2. 大模型竞赛加剧:GPT-5与Step 3推动高精度算力(如FP8)需求;

  3. 端侧算力崛起:英伟达Jetson Thor加速物理AI落地;

  4. 全球博弈新态势:对华芯片出口“有限解冻”与国产替代并行。

商务合作:cloud-engine-ben(微信)
客服热线:19886543806
联系地址:深圳市南山区招商街道沿山社区南海大道1079号花园城数码大厦A座二楼
企业信息