| A100 pcie40G - 1200/卡/月;裸金属八卡机:8*910B - 15000/月 8*4090 - 7800/月 8*5090 - 12000/月 8*A100 pcie40G - 9000/月 8*A100 pcie80G - 25000/月 8*A100 nvlink80G - 35000/月 8*A800 nvlink80G - 34000/月 8*H20*96G - 35000/月 8*H20*141G - 46000/月 8*L40 - 12000/月 8*L40S - 16000/月 8*H100 - 75000/月 8*H800 - 69000/月 8*H200 -94000/月 8*B200 -130000/月 8*B300 -280000/月 |
全球GPU算力资讯简要【20260712】一、Meta“卖算力”引发市场恐慌后迅速反转 本周初,Meta被曝计划推出云业务对外出售“过剩”AI算力,引发全球资本市场剧烈震荡,费城半导体指数两日暴跌超11%,A股科技板块单日蒸发超万亿元。但随后Meta接连释放利好消息:今年计划部署7GW算力基建、明年翻倍至14GW,自研AI芯片Iris量产在即,并发布最强模型首次收费。扎克伯格公开否认算力过剩,称出租算力是因为外部报价更高。Meta股价本周大涨近15%。 二、英特尔Arc Pro B70高并发AI推理反超英伟达旗舰 7月9日,蓝戟公布的测试数据显示,英特尔Arc Pro B70 32GB显卡在DeepSeek-R1高并发推理测试中,吞吐量较RTX 5090D高出7.5%至8.6%,较RTX 4090D高出34%至48%。该卡售价仅9000-10000元,而RTX 5090D售价超2万元。分析指出RTX 4090D仅24GB显存,高并发下显存瓶颈凸显。 三、英伟达H200芯片有望有限度对华出货 消息称中国政府计划允许阿里巴巴、字节跳动、DeepSeek等头部AI企业限量采购英伟达H200芯片,总量预计不足20万颗,仅为申请量的一半。H200的FP16算力达990TFLOPS,性能约为H100两倍。获批芯片**用于AI模型训练,推理任务须优先使用国产处理器。 四、英伟达RTX 5090 SE规格曝光 7月10日,科技媒体曝光英伟达计划推出RTX 5090 SE显卡,配备14080个CUDA核心、384-bit位宽及24GB GDDR7显存,性能介于RTX 5090和RTX 5080之间。 五、AMD MI355X推理成本仅为英伟达B200一半 AMD MI355X在运行GLM 5.2模型时,单节点聚合吞吐量达2626 token/s,性能约为英伟达旗舰B200的八成,但部署成本不到B200的一半。这一成果通过软件优化而非特殊硬件实现。 六、国产GPU沐曦MXC600大规模出货,订单排至2027年 沐曦主力产品MXC600芯片已实现大规模批量出货,部分品类订单已排至2027年。该芯片为全自研架构AI训练推理旗舰GPU,首次完成从设计到软件栈的全链条国产化。沐曦已启动下一代C700项目,目标性能接近H100水平。 七、华为Atlas 950 SuperPoD将亮相,剑指英伟达 华为Atlas 950 SuperPoD将于7月17日上海WAIC大会首次公开亮相,四季度正式上市。该超节点搭载昇腾950芯片,FP8算力达8 EFLOPS,**支持8192张NPU互联。华西证券分析称其总算力达英伟达NVL144的6.7倍。 八、中国首个全国产十万卡AI超集群“曙光8000”落成 7月10日,中科曙光宣布中国首个全国产十万卡AI超集群——曙光8000(登峰)正式落成,同步接入国家超算互联网。这标志着AI基础设施建设从万卡级迈向十万卡级。同日,国家超算互联网核心节点在郑州上线运行。 九、DeepSeek、智谱被曝自研AI芯片 7月7日,路透社援引消息称DeepSeek已秘密启动自研AI芯片项目约一年,方向聚焦推理芯片。同时智谱也被曝寻求本土晶圆合作推进自研芯片。两家公司均旨在降低对英伟达等外部供应商的依赖。 十、算力租赁价格持续上涨,金山云上调资本开支 摩根大通数据显示,6月非超大规模云厂商市场的GPU租赁价格继续上涨,H100平均价格环比上涨3.7%,已连续第七个月上涨。AWS的EC2 Capacity Blocks预订价格7月起上涨约20%。金山云因小米百亿级算力采购需求,将2026年资本开支上调至150亿元。 声明:此篇为云擎天下-超高性价比AI算力服务平台原创文章,转载请标明出处链接:https://www.omniyq.com/sys-nd/625.html
|