Облачный движок - экономичная платформа аренды AI GPU

 A100 pcie40G - $ 200/card/month;BMS:8*Ascend 910B $ 2000/month  8*4090D - $ 800/month  8*4090 - $ 900/month  8*A100 pcie40G - $ 1400/month  8*A100 pcie80G - $ 3200/month  8*A100 nvlink80G - $ 3800/month  8*A800 nvlink80G - $ 3800/month  8*H20 - $ 4000/month  8*L20 - $ 1300/month  8*L40 - $ 1600/month  8*L40S - $ 2200/month  8*H100 - $ 8000/month  8*H200 - $ 9200/month  8*B200 - $ 13000/month 

Глобальные новости о GPU-вычислениях【20260705】

1. Meta планирует запуск облачного бизнеса по сдаче в аренду свободных AI-мощностей

Meta объявила о создании облачного бизнеса «Meta Compute» для внешних клиентов. Компания намерена сдавать в аренду GPU и другие вычислительные ресурсы из своих дата-центров, а также предоставлять AI-сервисы через API. Новость вызвала опасения «переизбытка вычислительных мощностей», что привело к падению акций некоторых облачных провайдеров и производителей чипов памяти. Однако аналитики отмечают, что проблема скорее структурная – высококлассные интеллектуальные мощности по‑прежнему дефицитны.

2. NVIDIA внедряет модель «доход от аренды» для поддержки AI-стартапов

NVIDIA представила программу разделения доходов и кредитной поддержки, которая помогает облачным провайдерам создавать крупную инфраструктуру и предоставлять вычислительные ресурсы стартапам. Вместо прямой аренды GPU, NVIDIA предоставляет партнёрам GPU, программную платформу и кредитные линии. Первые два партнёра планируют развернуть до 210 000 GPU – один в Австралии, другой в Индонезии.

3. Kingsoft Cloud ускоряет строительство GPU-кластеров; Xiaomi увеличивает бюджет, Alibaba подписывает пятилетний контракт

Kingsoft Cloud объявила об ускоренном развёртывании вычислительных кластеров во втором полугодии. Потребности Xiaomi в мощностях выросли до суперкрупного кластера, инвестиционный бюджет превысил 10 млрд юаней. Капитальные расходы Kingsoft Cloud на 2026 год увеличены до 15 млрд юаней. Кроме того, команда крупных моделей Alibaba заключила с Kingsoft Cloud пятилетний договор аренды мощностей, включающий более 3000 серверов с восемью GPU каждый.

4. Meta и AMD заключили пятилетнее соглашение на 6 гигаватт вычислительных мощностей

Meta и AMD подписали контракт на пять лет, предусматривающий поставку 6 ГВт вычислительных мощностей. Meta закупит несколько поколений AMD Instinct GPU, а AMD выпустит в пользу Meta варранты, привязанные к финансовым показателям. Генеральный директор AMD заявила, что сотрудничество является «особенным», а интерес клиентов к MI450 и Helios превзошёл первоначальные ожидания.

5. AWS повышает цены на резервирование AI-мощностей примерно на 20%

С июля 2026 года Amazon Web Services увеличивает стоимость резервирования EC2 Capacity Blocks for ML примерно на 20%. Этот сервис позволяет компаниям заранее бронировать GPU для задач обучения больших моделей и тонкой настройки, которые нельзя прерывать.

6. Цены аренды GPU продолжают расти – A100/H100/B200 дорожают несколько месяцев подряд

По данным за июнь, на рынке, не считая крупнейших облачных провайдеров, ставки аренды GPU продолжили повышаться. Средняя цена A100 составила $1,63 за GPU-час, рост на 6,3% за месяц (пятый месяц подряд); H100 – $2,72 (+3,7%, седьмой месяц подряд); B200 – $5,33 (+2,7%). Рыночные ставки месячной аренды RTX 5090 сосредоточены в диапазоне 11 500–12 000 юаней в месяц.

7. Iluvatar CoreX получила заказ на 50 000 чипов для инференса от ByteDance

ByteDance ведёт переговоры о закупке как минимум 50 000 чипов для инференса (серия Zhikai) у Iluvatar CoreX. В стратегии ByteDance нагрузка по предварительному обучению ложится на Huawei Ascend и Cambricon, а Iluvatar CoreX ориентирована на массовые потребительские сценарии инференса. На китайском рынке AI-серверов доля отечественных чипов достигла 41%.

8. 58-й институт CETC добился значительного прогресса в разработке интеллектуальных чипов

58-й научно-исследовательский институт Китайской электронной технологической корпорации (CETC) сообщил о прорывах в нескольких ключевых чипах. Серия ZQ300 AI SoC завершила этап технической верификации и успешно вышла на стадию тестового производства; массовый выпуск универсального GPU ZQ500 уже начался. ZQ300 использует гетерогенную архитектуру, объединяющую параллельные вычисления и AI-ускорители; ZQ500 отличается высокой производительностью и низким энергопотреблением и подходит для беспилотных систем, радиолокации и умных терминалов.

9. Jingjia Micro раскрыла информацию о новой архитектуре GPU

На платформе взаимодействия с инвесторами Jingjia Micro сообщила, что в рамках проекта по созданию высокопроизводительного универсального GPU разрабатываются две модели чипов. Модель 1 получит новую архитектуру с улучшенной производительностью рендеринга и универсальных вычислений, будет нацелена на графические станции и облачный рендеринг. Модель 2 включает разработку программного стека, совместимого с популярными фреймворками инференса и обучения, обеспечивая эффективное объединение этих задач.

10. Государственный совет КНР обсудил развитие AI; восемь министерств продвигают строительство вычислительной инфраструктуры

1 июля премьер Ли Цян провёл заседание Госсовета, на котором были заслушаны доклады о развитии AI. Была подчёркнута необходимость ускорения прорыва в ключевых технологиях и создания сверхкрупных кластеров интеллектуальных вычислений. Кроме того, восемь министерств, включая Министерство промышленности и информатизации, опубликовали руководящие указания по высококачественному развитию промышленного интернета, где предлагается интегрированное планирование и синхронное строительство инфраструктуры промышленного интернета вместе с вычислительными мощностями (интеллектуальными и суперкомпьютерными).

Отдел продаж: +8619886543278 (WhatsApp)
Написать нам: yqtxben@163.com
Наш адрес: Китай, город Шэньчжэнь, район Наньшань, здание Garden City Digital, блок A, 2-й этаж.
Связаться с нами