| A100 pcie40G - $ 200/card/month;BMS:8*Ascend 910B $ 2000/month 8*4090D - $ 800/month 8*4090 - $ 900/month 8*A100 pcie40G - $ 1400/month 8*A100 pcie80G - $ 3200/month 8*A100 nvlink80G - $ 3800/month 8*A800 nvlink80G - $ 3800/month 8*H20 - $ 4000/month 8*L20 - $ 1300/month 8*L40 - $ 1600/month 8*L40S - $ 2200/month 8*H100 - $ 8000/month 8*H200 - $ 9200/month 8*B200 - $ 13000/month |
글로벌 GPU 컴퓨팅 파워 핵심 동향【2026년07월일05】1. Meta, 클라우드 사업 추진 – 잉여 AI 연산 자원 외부 임대 Meta는 외부 고객을 대상으로 한 클라우드 사업 "Meta Compute"를 준비 중이라고 발표했습니다. 데이터센터 내 GPU 등 연산 자원을 직접 임대하거나 API를 통해 AI 모델 서비스를 제공할 계획입니다. 이 소식에 '연산 과잉 공급' 우려가 제기되면서 일부 클라우드 서비스 기업과 메모리 반도체 종목이 급락했지만, 일각에서는 고급 지능 연산은 여전히 수요가 공급을 초과한다는 분석도 나오고 있습니다. 2. NVIDIA, AI 스타트업 지원 위해 '수익 공유'형 신모델 도입 NVIDIA는 AI 클라우드 서비스 제공업체가 대규모 인프라를 확보하고 이를 스타트업 등에 제공할 수 있도록 수익 공유 및 크레딧 지원 방식을 도입했습니다. NVIDIA는 GPU를 직접 임대하지 않고 GPU, 소프트웨어 플랫폼, 크레딧을 제공합니다. 첫 두 파트너사는 최대 21만 개의 GPU를 배치할 예정이며, 각각 호주와 인도네시아에 거점을 둡니다. 3. Kingsoft Cloud, GPU 클러스터 가속화 – Xiaomi 예산 대폭 증액, Alibaba와 5년 계약 Kingsoft Cloud는 하반기 GPU 연산 클러스터 구축을 가속화한다고 밝혔습니다. Xiaomi의 연산 수요는 초대형 클러스터로 확대되었으며, 투자 예산은 100억 위안 이상으로 증가했습니다. Kingsoft Cloud는 2026년 자본 지출 계획을 150억 위안으로 상향 조정했습니다. 또한 Alibaba의 대규모 모델 팀은 3,000대 이상의 8-GPU 서버를 포함한 5년 연산 임대 계약을 Kingsoft Cloud와 체결했습니다. 4. Meta 및 AMD, 5년간 6기가와트 연산 용량 공급 계약 체결 Meta와 AMD는 5년간 6기가와트 규모의 연산 용량 공급 계약을 맺었습니다. Meta는 여러 세대의 AMD Instinct GPU를 조달하고, AMD는 실적 연동형 워런트를 Meta에 발행합니다. AMD CEO는 양사 협력이 "매우 특별하다"며 MI450과 Helios에 대한 고객 관심이 초기 예상을 웃돌고 있다고 전했습니다. 5. AWS, AI 연산 자원 사전 예약 가격 약 20% 인상 2026년 7월부터 Amazon Web Services는 머신러닝용 용량 블록(EC2 Capacity Blocks for ML)의 예약 가격을 약 20% 인상합니다. 이 서비스는 대규모 모델 훈련 및 미세 조정 등 중단이 어려운 작업을 위해 GPU를 사전에 확보하는 데 사용됩니다. 6. GPU 임대 가격 지속 상승 – A100/H100/B200 수개월 연속 오름세 6월 기준 비(非)하이퍼스케일러 시장의 GPU 임대 가격은 계속 상승했습니다. A100 평균 임대 가격은 시간당 1.63달러로 전월 대비 6.3% 올라 5개월 연속 상승했고, H100은 2.72달러로 3.7% 상승(7개월 연속), B200은 5.33달러로 2.7% 상승했습니다. 또한 RTX 5090의 월 임대료는 시장에서 약 11,500~12,000위안 수준에 형성되어 있습니다. 7. Iluvatar CoreX, ByteDance로부터 AI 추론 칩 5만 개 수주 추진 ByteDance는 Iluvatar CoreX(天数智芯)와 최소 5만 개의 AI 추론 칩(주로 Zhikai 시리즈 클라우드 추론 GPU) 구매를 협의 중입니다. ByteDance의 연산 전략에서 Huawei Ascend와 Cambricon은 대규모 사전 훈련 부하를, Iluvatar CoreX는 대량 소비자 향 추론 시나리오를 담당합니다. 중국 AI 서버 시장에서 국산 칩 점유율은 이미 41%에 달합니다. 8. 중국전자기술집단 제58연구소, 지능 연산 칩 중대 진전 CETC 제58연구소는 여러 핵심 지능 연산 칩에서 중대한 진전을 이루었습니다. ZQ300 시리즈 AI SoC는 핵심 기술을 돌파하고 테이프아웃에 성공했으며, ZQ500 범용 GPU는 양산에 돌입했습니다. ZQ300은 이종 컴퓨팅 아키텍처를 채택해 병렬 연산 프레임워크와 AI 가속 유닛을 통합했고, ZQ500은 우수한 연산 성능과 낮은 전력 소비를 구현해 무인 장비, 레이더 시스템, 스마트 단말 등 다양한 분야에 적용 가능합니다. 9. Jingjia Micro(景嘉微), 차세대 GPU 아키텍처 진행 상황 공개 Jingjia Micro는 투자자 소통 플랫폼에서 고성능 범용 GPU 칩 연구개발 및 산업화 프로젝트의 두 가지 칩(모델 1 및 모델 2)을 개발 중이라고 밝혔습니다. 모델 1은 새로운 아키텍처를 채택해 렌더링 및 범용 연산 성능을 대폭 향상시켜 그래픽 워크스테이션 및 클라우드 렌더링 시장을 겨냥합니다. 모델 2는 추론 프레임워크 및 주류 훈련에 대응하는 소프트웨어 스택을 개발하여 추론-훈련 통합형 효율적 연산 활용을 실현합니다. 10. 국무원 상무회의, AI 발전 논의 – 8개 부처, 연산 인프라 구축 추진 7월 1일 리창(李强) 총리는 국무원 상무회의를 주재하고 AI 발전 현황을 보고받았으며, 핵심 기술 조기 돌파와 초대형 지능 연산 클러스터 건설 가속화를 강조했습니다. 또한 공업정보화부 등 8개 부처는 '공업인터넷 고품질 발전에 관한 실시 의견'을 발표하여 공업인터넷 인프라와 지능 연산·초고속 연산 인프라의 일체형 계획 및 동시 구축을 추진하기로 했습니다. Declaration: This article is originally created by Shenzhen Cloud Engine - a cost-effective AI computing power service platform. For reprint, please indicate the source link:https://www.omniyq.com/kor/sys-nd/613.html
|