阿里云发布GPU池化方案,显著节约算力成本
阿里云在SOSP 2025会议上公布了名为“Aegaeon”的计算池化解决方案。该方案通过Token级虚拟化等技术,让多个AI模型动态共享GPU资源。在测试中,服务数十个720亿参数大模型所需的GPU数量从1192个降至213个,降幅高达82%,能大幅降低大模型服务的硬件成本。
国产通用GPU“曦云C600”在南京发布
沐曦股份在南京正式发布其首款全国产通用GPU——曦云C600。该芯片集成了大容量存储与混合精度算力。沐曦与中国科学院合作的国产千卡集群已成功完成多个大模型的全参数训练,证实了国产算力已具备大模型预训练能力。
南京浦口形成集成电路全产业链生态
作为“曦云C600”的诞生地,南京浦口经开区已集聚超过300家集成电路上下游企业,形成了从IC设计、晶圆制造、封装测试到材料配套的完整产业链。这一产业生态为国产芯片的持续创新和发展提供了重要支撑。
欧洲首批!丹麦DCAI部署NVIDIA DGX B300系统
丹麦AI基础设施提供商DCAI宣布,将在其Gefion超级计算机上部署NVIDIA DGX B300 AI基础设施。这使其成为欧洲首批、丹麦首家获得该系统的机构。此举将为欧洲的研究人员和企业在AI训练与推理方面提供更强大的算力。
Hyperscale Data将推出按需NVIDIA GPU云服务
Hyperscale Data公司宣布,计划于2026年上半年通过其密歇根AI数据中心园区,推出一个按需的NVIDIA GPU云服务平台。该服务将提供对NVIDIA H100、B200和B300等先进GPU的即时、灵活访问,帮助客户降低AI和高性能计算项目的硬件投入门槛。
谷歌与Anthropic达成数百亿美元算力合作
谷歌将向人工智能公司Anthropic提供高达100万颗其自研的TPU芯片,这笔交易价值数百亿美元。这批芯片计划于2026年部署,将提供超过1吉瓦的算力,旨在降低Anthropic对英伟达GPU的依赖。
甲骨文推出全球**AI超算,服务OpenAI
甲骨文发布了名为OCI Zettascale10的AI超算集群。它集成了80万块英伟达GPU,峰值算力宣称高达16 ZettaFLOPS,将成为OpenAI未来“星际之门”超算的算力核心,并计划在2026年下半年向客户提供服务。
全球AI算力需求持续激增
开发尖端AI系统的成本正大幅攀升,因其需要海量算力来训练和运行大型语言模型。此次谷歌与Anthropic高达数百亿美元的算力合作,是当前AI硬件竞赛中规模**的交易之一,凸显了这一趋势。
多元算力架构成为发展趋势
产业界正积极寻求算力供应的多元化。例如,Anthropic同时使用谷歌TPU和亚马逊自研芯片;阿里云的“Aegaeon”方案则通过池化技术提升现有GPU资源的利用效率。
算力成本优化是关键挑战
在算力规模不断扩大的同时,如何有效控制和优化成本已成为全球企业关注的焦点。无论是通过阿里云的池化技术,还是Hyperscale Data提供的按需云服务,其核心目标之一都是帮助企业以更经济的方式获取算力。