英伟达发布新一代 Blackwell 架构 GPU:英伟达正式推出基于Blackwell架构的B200 GPU,其性能大幅提升,宣称在处理万亿参数级大模型时,性能和能效较上一代提升高达25倍,再次巩固其在AI训练和推理领域的领导地位。
AMD 扩大 MI300X 系列供应以争夺AI市场:AMD宣布其Instinct MI300X加速器的出货量正在增加,并获得了更多云服务提供商和大型科技公司的订单,旨在从英伟达手中争夺更多AI算力市场份额。
微软Azure宣布部署新一代自研AI加速器:微软宣布在其Azure云数据中心中大规模部署第二代自研AI芯片Maia,旨在为其Copilot等AI服务提供更高效、成本更优化的算力支持,减少对第三方GPU的依赖。
国内“壁仞科技”发布新一代BR系列通用GPU:中国GPU企业壁仞科技发布了其新一代BR104/102系列通用GPU产品,强调在AI训练和推理性能上的突破,并已开始向特定客户送样测试,旨在推动国产高性能算力发展。
谷歌Cloud TPU v5p全面上市:谷歌宣布其最新一代AI加速器Cloud TPU v5p已全面上市,为客户提供强大的算力选择,用于训练大规模前沿AI模型,与英伟达GPU在云服务市场展开竞争。
OpenAI 寻求合作以应对全球GPU短缺:有报道称,OpenAI的首席执行官Sam Altman正在与全球投资者和芯片制造商进行谈判,旨在筹集巨额资金以建设覆盖全球的AI芯片制造网络,从根本上解决制约AI发展的算力瓶颈问题。
美国政府考虑对华AI芯片出口限制进行升级:有消息传出,美国拜登政府正在敦促盟友国家加强对中国AI技术出口的管制,并可能进一步收紧高端GPU(如英伟达特供版芯片)的出口许可规则,以减缓中国AI算力发展速度。
亚马逊AWS推出基于NVIDIA Grace Hopper的实例:亚马逊云科技(AWS)推出了新的EC2实例,搭载英伟达GH200 Grace Hopper Superchip,该芯片将CPU和GPU紧密结合,专为加速巨型AI模型和海量数据的处理而设计。
摩尔线程发布全新MTT S4000数据中心GPU:中国GPU厂商摩尔线程发布了专为AI计算和数据中心场景设计的全新MTT S4000 GPU,支持主流AI框架和模型,助力国产AI算力基础设施的建设。
AI算力需求激增,台积电CoWoS先进封装产能持续紧张:由于英伟达、AMD等AI芯片巨头订单爆满,台积电的CoWoS先进封装产能成为关键瓶颈。公司正积极扩产,但预计供不应求的局面将持续到2025年,制约着全球GPU的实际供应量。