Специфікації Rubin Ultra Cuts: Чи впорається Nvidia з зростанням цін на пам'ять?

By: www.odaily.news|2026/08/03 04:57:59
0
Поширити
copy
Оцінити в GoogleОцінити в Google

Оригінал | Odaily Planet Daily (++@OdailyChina++)

Автор | Azuma (++@azuma_eth++)

Цього минулого вихідного дня звіт від відомої дослідницької компанії SemiAnalysis викликав значні обговорення в індустрії штучного інтелекту.

Основний зміст звіту стверджує, після того, як SemiAnalysis наприкінці червня повідомила, що оригінальний дизайн Nvidia (NVIDIA) з 4 чіпами Rubin Ultra буде зменшено вдвічі, дослідницька компанія тепер розкрила, що Nvidia надала попередній перегляд Rubin Ultra основним клієнтам, але його специфікації ще більше знизилися від попередніх очікувань.

Скриншоти інформації, пов'язаної з Rubin Ultra, які були витікали в звіті SemiAnalysis, виглядають наступним чином:

  • Rubin Ultra зберігатиме ту ж теоретичну пікову продуктивність, що й Rubin, обидва на 35 PFLOPs;
  • Обсяг пам'яті був серйозно зменшений, специфікації знизилися до 192 ГБ з 8-шаровим укладанням (8-Hi), навіть нижче, ніж у Rubin з 288 ГБ з 12-шаровим укладанням (12-Hi);
  • Зміна в пропускній здатності пам'яті незначна, лише збільшилася на 1 ТБ/с, що в основному можна ігнорувати в реальних розрахунках з високою пропускною здатністю;
  • Споживання енергії на чіпі навіть трохи зросло, мінімальне споживання енергії таке ж, як у Rubin (1800 Вт), але максимальне споживання енергії вище (2600 Вт);
  • Єдине значне покращення - це "збільшення розміру світу", яке зросло з 72 GPU до 576 GPU, що означає, що Nvidia перенесла реальну точку продажу на кластерну мережу, дозволяючи підключати до 576 GPU Rubin Ultra в масивний "супер логічний GPU" (Rubin підтримує лише з'єднання до 72 карт).

Спочатку позиціонований як топова флагманська версія Nvidia, оголошена на GTC 2026, Rubin Ultra був спроектований для інтеграції більшої кількості чіпів і пам'яті з високою пропускною здатністю, щоб задовольнити екстремальні масштаби навчання та висновків моделей ШІ. Однак, виходячи з останніх деталей специфікацій, розкритих SemiAnalysis, очевидно, що Nvidia скоригувала концепцію дизайну Rubin Ultra.

Швидке зростання цін на HBM змушує Nvidia переглянути

Протягом останніх двох років одним з найважливіших компонентів у розширенні індустрії ШІ безумовно була HBM.

З вибуховим попитом на прискорювачі ШІ, такі як Nvidia H100, H200 і Blackwell, пам'ять з високою пропускною здатністю перетворилася з відносно нішевого продукту високого класу на найскладніший компонент у всій інфраструктурі ШІ. SK Hynix, Samsung і Micron постійно розширюють свої інвестиції в HBM, одночасно оновлюючи свою продуктивність, але дисбаланс між попитом і пропозицією продовжує підвищувати ціни на HBM.

Для виробників чіпів ШІ важливість HBM очевидна — GPU обробляють обчислення, тоді як HBM забезпечує високу швидкість передачі даних, і разом вони визначають ефективність навчання та висновків моделей ШІ. Однак проблема в тому, що HBM стала настільки дорогою, що починає впливати на загальну економіку систем ШІ. Наприклад, ціна HBM3 була лише $180-220 на своєму мінімумі в Q2 2025, але зросла до $600-700 в Q1 цього року (контрактна ціна), і навіть вище до $700-850 в Q2 (спотова ціна).

Згідно з оцінками SemiAnalysis, з ростом цін на HBM, чиста вартість матеріалів (BOM) одного стелажа Rubin Ultra зросла з приблизно $6.6 мільйонів до $8 мільйонів, але після коригування специфікацій дизайну вартість може знизитися до приблизно $6.4 мільйонів.

Для Nvidia така значна різниця в вартості піднімає дуже реальне питання — якщо вони продовжать збільшувати обсяг HBM відповідно до оригінального дизайну, чи принесе це все ще покращення продуктивності, що відповідає витратам? Чи є інші кращі варіанти?

SemiAnalysis надала відповідь у звіті, стверджуючи, що коригування Rubin Ultra в основному представляє оптимізацію структури витрат системи ШІ в умовах обмежених ресурсів, зменшуючи відносно дорогі конфігурації HBM (частка витрат зменшується з майже 40% до 28%) і перерозподіляючи ресурси на більш цінні можливості масштабування з'єднань (частка витрат зростає з 4% до 12%).

Як вже згадувалося раніше, основний напрямок оновлення Rubin Ultra тепер змістився на "можливості масштабування системного з'єднання". Архітектура NVL576, підтримувана Rubin Ultra, може підключати до 576 GPU в єдину обчислювальну область через NVLink, прагнучи компенсувати коригування специфікацій окремого чіпа за рахунок розширення системи більшого масштабу.

Акції зберігання падають, ринок турбує пік попиту

У відповідь на цю новину акції, пов'язані зі зберіганням, колективно знизилися після відкриття корейського фондового ринку цього ранку. Станом на 11:45 за пекінським часом, SK Hynix і Samsung, дві провідні компанії HBM, обидві впали приблизно на 8%, а індекс KOSPI також знизився приблизно на 5%.

Ринок почав турбуватися, що якщо коригування специфікацій для Rubin Ultra, розкриті SemiAnalysis, є правдивими (Nvidia не підтвердила цю інформацію публічно), чи означає це, що Nvidia, як основний покупець в інфраструктурі ШІ, зменшує свій попит на HBM?

Протягом останніх двох років, з швидким зростанням вимог до розширення ШІ, HBM стала найскладнішою частиною інфраструктури ШІ. Виробники чіпів, такі як Nvidia та AMD, постійно збільшували конфігурації HBM у прискорювачах ШІ, підвищуючи продуктивність компаній зі зберігання, таких як SK Hynix, Samsung і Micron, в той час як також зміцнювали свою цінову владу по всьому ланцюгу постачання.

Вибір Nvidia може вказувати на те, що виробники чіпів ШІ розглядають можливість оптимізації дизайну апаратного забезпечення, щоб зменшити залежність від високої ємності HBM для окремих чіпів. Якщо цей шлях виявиться здійсненним, можливості для виробників HBM продовжувати підвищувати ціни, ймовірно, будуть обмежені.

Будівництво інфраструктури ШІ врешті-решт відійде від ери "божевільного укладання та безглуздого підвищення цін", і тепер навіть Nvidia, що сидить на троні обчислювальної потужності, почала скорочувати свій бюджет.

Ціна --

--
--
--

Цей контент надано лише для загальних інформаційних цілей і не є фінансовою, інвестиційною, юридичною чи податковою консультацією. Події, нагороди, онлайн-акцій або пов’язану інформацію, згадана тут, не слід розглядати як рекомендацію, прохання чи запрошення до купівлі, продажу, торгівлі чи інших операцій з криптоактивами. Криптоактиви є дуже волатильними та можуть призвести до збитків. Доступність послуг, продуктів WEEX та пов’язаних із ними подій може відрізнятися залежно від регіону. Ви несете відповідальність за забезпечення відповідності вашої участі чинному місцевому законодавству та нормативним актам.

Вам також може сподобатися

Falcon створює канал випуску токенів GPU в Ель-Сальвадорі

Falcon Finance створила канал випуску, який з'єднує інфраструктуру обчислень GPU в Ель-Сальвадорі з фінансовими продуктами токенізації реальних активів (RWA). Перший продукт буде представлений як токенізований GPU...

Axcompute отримала аванс у 317 мільйонів доларів та прогнозує результати

Ринок знову аналізує Axcompute (AGPU). Засновник Liquid Capital, І Ліхуа, зазначає, що структура контрактів та фінансування компанії в другому кварталі...

Зарубіжні ЗМІ: Ігровий бізнес AMD навряд чи стане буфером для AI-бульбашки

Qwen 27B випереджає Claude Opus у деяких кодингових бенчмарках

Модель відкритого штучного інтелекту (ШІ) Qwen 27B перевищила Claude Opus 4.6 Max від Anthropic у деяких кодингових бенчмарках.

Біткоїн-майнінгові компанії розширюють бізнес у сфері AI-центрів даних та укладають контракт на 16,8 мільярда доларів

Біткоїн (BTC) майнінгові компанії розширюють свою діяльність у сфері інфраструктури AI-центрів даних, зосереджуючи увагу на підключенні до енергетичних мереж та великих земельних ділянках.

NVIDIA розширює програму фінансування AI до 500 мільярдів доларів

...

Вміст

Найновіші статті

Більше

Нещодавні лістинги монет на WEEX

iconiconiconiconiconicon
Підтримка клієнтів:@weikecs
Співпраця:@weikecs
Кількісна торгівля та маркетмейкінг:[email protected]
VIP-програма:[email protected]