| A100 pcie40G - 1200/卡/月;裸金属八卡机:8*910B - 15000/月 8*4090 - 7800/月 8*5090 - 12000/月 8*A100 pcie40G - 9000/月 8*A100 pcie80G - 25000/月 8*A100 nvlink80G - 35000/月 8*A800 nvlink80G - 34000/月 8*H20*96G - 35000/月 8*H20*141G - 46000/月 8*L40 - 12000/月 8*L40S - 16000/月 8*H100 - 75000/月 8*H800 - 69000/月 8*H200 -94000/月 8*B200 -130000/月 8*B300 -280000/月 |
全球GPU算力资讯简要【20250726】️ 一、华为昇腾384超节点真机全球首秀华为在2025世界人工智能大会(WAIC)首次线下展出昇腾384超节点真机,整合384颗昇腾NPU与192颗鲲鹏CPU,算力达300 Pflops,性能为英伟达NVL72系统的1.7倍。其网络带宽(269TB/s)和内存带宽(1229TB/s)分别提升107%和113%,突破通信、散热与生态适配三大瓶颈。 ⚡️ 二、国产砺算G100 GPU跑分超英伟达RTX 4060砺算科技G100 GPU现身Geekbench,OpenCL跑分111,290分,超越英伟达RTX 4060约10%,采用自研TrueGPU架构,支持DirectX 12等主流接口,计划7月26日正式发布。 ️ 三、阶跃星辰Step 3大模型适配国产芯片阶跃星辰发布Step 3大模型,在国产芯片上推理效率达DeepSeek-R1的300%,并联合华为昇腾、沐曦等近10家芯片厂商成立“模芯生态联盟”,推动国产算力协同。 四、摩尔线程:大模型算力需求5年激增千倍摩尔线程副总裁王华指出,2020-2025年大模型训练算力需求增长近1000倍,FP8精度和万卡集群成为刚需。摩尔线程已构建支持FP8混合精度训练的国产集群方案,性能提升20%-30%。 五、OpenAI推理模型夺IMO**,GPT-5预热OpenAI全新推理模型在2025国际数学奥林匹克竞赛(IMO)中达到**水平,攻克100分钟深度推理难题,并预告GPT-5即将发布,凸显算力扩展与强化学习突破。 六、英伟达Jetson Thor端侧芯片即将发售英伟达端侧算力芯片Jetson Thor T5000(算力2070T FP4)和T4000(1200T FP4)即将量产出货,支持具身智能与边缘实时处理,为自动驾驶、机器人提供云端协同算力。 七、英伟达/AMD恢复对华供应“降级版”芯片英伟达H20、AMD MI309等“特供版”GPU恢复对华出口,但性能大幅受限(如H20算力仅为A100的15%)。国内企业采取“两条腿走路”策略,兼顾采购与自主研发。 八、上海证劵:大模型竞赛持续驱动算力投资OpenAI ChatGPT Agent上线推动算力消耗激增,叠加GPT-5发布预期,算力基础设施(光模块、PCB、液冷等)投资需求将持续高企,国产GPU厂商加速承接外溢订单。 九、国内算力产业链多环节创新高光模块(周涨27.45%)、液冷、IDC等算力硬件板块股价领涨,中际旭创、新易盛等龙头扩产应对需求。华为昇腾生态已汇聚665万开发者及8800家合作伙伴。 ️ 十、上海打造全球AI算力高地上海将AI纳入三大先导产业,全市综合算力指数全国首位,徐汇“模速空间”与浦东“模力社区”形成东西协同生态链,推动芯片-模型-应用全链路创新。 总结本周趋势
声明:此篇为云擎天下-超高性价比AI算力服务平台原创文章,转载请标明出处链接:https://www.omniyq.com/sys-nd/157.html
|