亚马逊发布Trainium 3 AI芯片
亚马逊AWS于12月2日发布新一代自研AI训练芯片Trainium 3。该芯片采用3nm工艺,单颗FP8算力达2.52 PFLOPs,搭载该芯片的Trn3 UltraServer总算力可达362 PFLOPs,能效比前代提升40%。
英伟达GB200 NVL72系统性能提升10倍
英伟达在12月3日公布的数据显示,其GB200 NVL72系统(集成72颗Blackwell GPU)对DeepSeek-R1、Mistral Large 3等开源MoE模型的推理性能较上一代H200平台提升约10倍。
英伟达与新思科技扩大战略合作
12月1日,英伟达与新思科技宣布扩大战略合作,共同推动GPU加速计算在芯片设计、物理仿真、数字孪生等工程领域的应用,英伟达同时投资20亿美元认购新思科技普通股。
优刻得发布新一代GPU虚拟化技术
12月1日,优刻得正式发布新一代GPU虚拟化技术,支持对单张GPU的显存与算力进行双维度切分,最小粒度可至10%,可同时承载多个AI工作负载,提升资源利用率。
谷歌TPU对外供货,挑战英伟达
谷歌自研的Tensor Processing Unit(TPU)近日宣布对外供货,被视为对英伟达GPU主导地位的直接挑战。市场分析指出,TPU性能已比肩GPU,可能引发算力格局变化。
阿里云Aegaeon入选SOSP,GPU用量削减82%
阿里云提出的计算池化解决方案“Aegaeon”入选**学术会议SOSP 2025。该方案在Beta测试中,服务720亿参数大模型所需的H20 GPU数量从1,192个减至213个,削减比例达82%。
亚马逊推出新一代AI芯片Trainium3
参考消息网12月4日报道,亚马逊AWS推出自主研发的Trainium3 AI芯片,宣称其计算性能是上一代的四倍,能耗降低40%,且相比使用英伟达GPU的系统可降低最多50%的训练和运营成本。
摩尔线程科创板上市,成国产GPU**股
12月5日,摩尔线程正式在上海证券交易所科创板挂牌上市,成为中国首家登陆资本市场的全功能GPU企业。其产品已实现AI计算、图形渲染、物理仿真等多功能集成,支持万卡级智算集群。
砺算科技发布首款国产自研6nm GPU
12月4日,砺算科技发布首款基于自研架构的6nm GPU“7G100”系列,包含12GB和24GB两款型号。该芯片未使用国外IP授权,性能达到国际主流水准,并支持Windows on Arm平台。
记忆张量与商汤大装置实现国产GPGPU体系级突破
12月4日,记忆张量联合商汤大装置在国产GPGPU上跑通业内首个“记忆—计算—调度”一体化的PD分离商用推理集群。在真实负载下,集群吞吐提升75%,综合推理性价比达到同代NVIDIA A100的150%。