Специфікації Rubin Ultra Cuts: Чи впорається Nvidia з зростанням цін на пам'ять?
Оригінал | Odaily Planet Daily (++@OdailyChina++)
Автор | Azuma (++@azuma_eth++)
Цього минулого вихідного дня звіт від відомої дослідницької компанії SemiAnalysis викликав значні обговорення в індустрії штучного інтелекту.
Основний зміст звіту стверджує, після того, як SemiAnalysis наприкінці червня повідомила, що оригінальний дизайн Nvidia (NVIDIA) з 4 чіпами Rubin Ultra буде зменшено вдвічі, дослідницька компанія тепер розкрила, що Nvidia надала попередній перегляд Rubin Ultra основним клієнтам, але його специфікації ще більше знизилися від попередніх очікувань.
Скриншоти інформації, пов'язаної з Rubin Ultra, які були витікали в звіті SemiAnalysis, виглядають наступним чином:
- Rubin Ultra зберігатиме ту ж теоретичну пікову продуктивність, що й Rubin, обидва на 35 PFLOPs;
- Обсяг пам'яті був серйозно зменшений, специфікації знизилися до 192 ГБ з 8-шаровим укладанням (8-Hi), навіть нижче, ніж у Rubin з 288 ГБ з 12-шаровим укладанням (12-Hi);
- Зміна в пропускній здатності пам'яті незначна, лише збільшилася на 1 ТБ/с, що в основному можна ігнорувати в реальних розрахунках з високою пропускною здатністю;
- Споживання енергії на чіпі навіть трохи зросло, мінімальне споживання енергії таке ж, як у Rubin (1800 Вт), але максимальне споживання енергії вище (2600 Вт);
- Єдине значне покращення - це "збільшення розміру світу", яке зросло з 72 GPU до 576 GPU, що означає, що Nvidia перенесла реальну точку продажу на кластерну мережу, дозволяючи підключати до 576 GPU Rubin Ultra в масивний "супер логічний GPU" (Rubin підтримує лише з'єднання до 72 карт).
Спочатку позиціонований як топова флагманська версія Nvidia, оголошена на GTC 2026, Rubin Ultra був спроектований для інтеграції більшої кількості чіпів і пам'яті з високою пропускною здатністю, щоб задовольнити екстремальні масштаби навчання та висновків моделей ШІ. Однак, виходячи з останніх деталей специфікацій, розкритих SemiAnalysis, очевидно, що Nvidia скоригувала концепцію дизайну Rubin Ultra.
Швидке зростання цін на HBM змушує Nvidia переглянути
Протягом останніх двох років одним з найважливіших компонентів у розширенні індустрії ШІ безумовно була HBM.
З вибуховим попитом на прискорювачі ШІ, такі як Nvidia H100, H200 і Blackwell, пам'ять з високою пропускною здатністю перетворилася з відносно нішевого продукту високого класу на найскладніший компонент у всій інфраструктурі ШІ. SK Hynix, Samsung і Micron постійно розширюють свої інвестиції в HBM, одночасно оновлюючи свою продуктивність, але дисбаланс між попитом і пропозицією продовжує підвищувати ціни на HBM.
Для виробників чіпів ШІ важливість HBM очевидна — GPU обробляють обчислення, тоді як HBM забезпечує високу швидкість передачі даних, і разом вони визначають ефективність навчання та висновків моделей ШІ. Однак проблема в тому, що HBM стала настільки дорогою, що починає впливати на загальну економіку систем ШІ. Наприклад, ціна HBM3 була лише $180-220 на своєму мінімумі в Q2 2025, але зросла до $600-700 в Q1 цього року (контрактна ціна), і навіть вище до $700-850 в Q2 (спотова ціна).
Згідно з оцінками SemiAnalysis, з ростом цін на HBM, чиста вартість матеріалів (BOM) одного стелажа Rubin Ultra зросла з приблизно $6.6 мільйонів до $8 мільйонів, але після коригування специфікацій дизайну вартість може знизитися до приблизно $6.4 мільйонів.
Для Nvidia така значна різниця в вартості піднімає дуже реальне питання — якщо вони продовжать збільшувати обсяг HBM відповідно до оригінального дизайну, чи принесе це все ще покращення продуктивності, що відповідає витратам? Чи є інші кращі варіанти?
SemiAnalysis надала відповідь у звіті, стверджуючи, що коригування Rubin Ultra в основному представляє оптимізацію структури витрат системи ШІ в умовах обмежених ресурсів, зменшуючи відносно дорогі конфігурації HBM (частка витрат зменшується з майже 40% до 28%) і перерозподіляючи ресурси на більш цінні можливості масштабування з'єднань (частка витрат зростає з 4% до 12%).
Як вже згадувалося раніше, основний напрямок оновлення Rubin Ultra тепер змістився на "можливості масштабування системного з'єднання". Архітектура NVL576, підтримувана Rubin Ultra, може підключати до 576 GPU в єдину обчислювальну область через NVLink, прагнучи компенсувати коригування специфікацій окремого чіпа за рахунок розширення системи більшого масштабу.
Акції зберігання падають, ринок турбує пік попиту
У відповідь на цю новину акції, пов'язані зі зберіганням, колективно знизилися після відкриття корейського фондового ринку цього ранку. Станом на 11:45 за пекінським часом, SK Hynix і Samsung, дві провідні компанії HBM, обидві впали приблизно на 8%, а індекс KOSPI також знизився приблизно на 5%.
Ринок почав турбуватися, що якщо коригування специфікацій для Rubin Ultra, розкриті SemiAnalysis, є правдивими (Nvidia не підтвердила цю інформацію публічно), чи означає це, що Nvidia, як основний покупець в інфраструктурі ШІ, зменшує свій попит на HBM?
Протягом останніх двох років, з швидким зростанням вимог до розширення ШІ, HBM стала найскладнішою частиною інфраструктури ШІ. Виробники чіпів, такі як Nvidia та AMD, постійно збільшували конфігурації HBM у прискорювачах ШІ, підвищуючи продуктивність компаній зі зберігання, таких як SK Hynix, Samsung і Micron, в той час як також зміцнювали свою цінову владу по всьому ланцюгу постачання.
Вибір Nvidia може вказувати на те, що виробники чіпів ШІ розглядають можливість оптимізації дизайну апаратного забезпечення, щоб зменшити залежність від високої ємності HBM для окремих чіпів. Якщо цей шлях виявиться здійсненним, можливості для виробників HBM продовжувати підвищувати ціни, ймовірно, будуть обмежені.
Будівництво інфраструктури ШІ врешті-решт відійде від ери "божевільного укладання та безглуздого підвищення цін", і тепер навіть Nvidia, що сидить на троні обчислювальної потужності, почала скорочувати свій бюджет.
Ціна --
Цей контент надано лише для загальних інформаційних цілей і не є фінансовою, інвестиційною, юридичною чи податковою консультацією. Події, нагороди, онлайн-акцій або пов’язану інформацію, згадана тут, не слід розглядати як рекомендацію, прохання чи запрошення до купівлі, продажу, торгівлі чи інших операцій з криптоактивами. Криптоактиви є дуже волатильними та можуть призвести до збитків. Доступність послуг, продуктів WEEX та пов’язаних із ними подій може відрізнятися залежно від регіону. Ви несете відповідальність за забезпечення відповідності вашої участі чинному місцевому законодавству та нормативним актам.
Вам також може сподобатися

Falcon створює канал випуску токенів GPU в Ель-Сальвадорі

Axcompute отримала аванс у 317 мільйонів доларів та прогнозує результати

Зарубіжні ЗМІ: Ігровий бізнес AMD навряд чи стане буфером для AI-бульбашки

Qwen 27B випереджає Claude Opus у деяких кодингових бенчмарках

Біткоїн-майнінгові компанії розширюють бізнес у сфері AI-центрів даних та укладають контракт на 16,8 мільярда доларів

NVIDIA розширює програму фінансування AI до 500 мільярдів доларів
![[Альфааналіз] Пітер Тіль, 72% портфоліо в енергетиці... вузьке місце інвестицій в AI переміщується](/public-static/7_ca1b7746d1.png?format=avif)
[Альфааналіз] Пітер Тіль, 72% портфоліо в енергетиці... вузьке місце інвестицій в AI переміщується

Baido Q2: Загальний дохід 313 мільярдів юанів, дохід від AI бізнесу перевищує половину

UBS досліджує китайський AI-індустріальний ланцюг: великі моделі прискорюють ітерацію, фінансування починає надходити до напівпровідників

NVIDIA розпочала масове виробництво оптичних комутаторів на основі спільного пакету

Коли ШІ позичає гроші на Уолл-стріт: «CapEx цикл» технологічних гігантів прискорює фінансування

CME планує запустити два ф'ючерсні контракти на оренду GPU 5 жовтня

OpenAI підписала угоду про суперцентр даних в Огайо, Nvidia гарантує 105 мільярдів доларів

«Нова нафта» епохи ШІ: Ф'ючерси на обчислювальну потужність незабаром з'являться

Gonka розпочала підтримку DeepSeek V4 Flash 0731

Підводний дата-центр Ульсана, реалізація проекту інфраструктури ШІ

Витрати на ШІ великих технологічних компаній досягнуть 665 мільярдів: інвестиції чи бульбашка?

Майнери Bitcoin звертаються до ШІ, хешрейт знижується

Доходи HIVE за перший квартал 2027 року: +73,5%, але збитки досягають 142 мільйонів

Ключовий момент для капіталу? Наратив AI переходить від технологій до фінансування, гіганти стикаються з проблемами грошового потоку, ринок облігацій вже тривожить

NVIDIA планує інвестувати 3 мільярди доларів у SB Energy для підтримки проекту OpenAI

Акції СанДіск після зростання на 500%: чи продовжить SNDK дорожчати?

Орендна плата за H100 зросла на 40%, ринок GPU розділився

Огляд Gemini 3.7 Flash: Дешевша модель Google більше не є дурною

ЗМІ: Anthropic розраховує на дохід до $200 млрд у 2028 році перед IPO

Марк Кубан вважає, що чіпи штучного інтелекту можуть стати новою інвестиційною сферою

Як Nockchain реалізує подвійний прибуток через майнінг та інференцію?

Serenity: Попит на AI в ланцюгу постачання продовжує зростати, зберігання та інші етапи очікують тривалу експансію

Фінансова гарантія Nvidia на 500 мільярдів доларів підтримує продажі GPU



