芯原发布高性能GPGPU-AI计算IP
芯原股份推出新一代GPGPU-AI计算IP,支持INT4/FP4等混合精度计算及3D堆叠内存集成,专为汽车电子与边缘服务器优化,可高效运行DeepSeek等大模型推理任务。
英博数科推出弹性GPU容器服务
英博云发布GPU算力产品矩阵,提出“单位有效算力成本”新标准,支持按分钟级计费的弹性资源分配,显著降低企业推理成本。
摩尔线程千卡集群落地多城
夸娥(KUAE)智算集群解决方案在亦庄、密云、南京完成部署,支持200B参数大模型训练(如Aquila2),千卡扩展效率达91%。
京东云vGPU平台助力金融业算力优化
华夏基金采用京东云vGPU算力平台后,GPU利用率提升70%,推理任务资源满足率达98%,推动金融领域降本增效。
国家数据局加速算力网建设
全国一体化算力网络将于2025年全面运行,重点解决东西部算力资源失衡问题,目标提升总算力规模50%。
英伟达GB200出货预期遭下调
摩根士丹利研报指出,受国产替代加速影响,2025年GB200芯片出货量或从3.5万下调至2.5万件,供应链损失或达350亿美元。
Meta万卡集群支持Llama 3训练
Meta定制24K GPU集群训练Llama 3,单卡计算利用率超400 TFLOPS,凸显万卡规模已成大模型训练门槛。
边缘AI驱动GPGPU架构升级
芯原技术团队指出,边缘服务器对Transformer模型的支持需求激增,新一代GPGPU需融合稀疏计算与核间通信优化。
英伟达H100 NVL芯片商用扩展
搭载双GPU NVLink的H100 NVL芯片加速落地,推理性能较A100提升10倍,可处理千亿级参数模型。
多模态算力成本成AIGC落地瓶颈
视频生成(如Sora)与多模态应用推高算力需求,企业探索异构算力混合部署以平衡成本与性能。