NVIDIA може спростити конфігурацію Rubin Ultra через дефіцит HBM

0
500 views
NVIDIA може спростити конфігурацію Rubin Ultra через дефіцит HBM

Компанія NVIDIA може переглянути конфігурацію високошвидкісної пам’яті (HBM) для AI-прискорювачів Rubin Ultra, вихід яких очікується наступного року. За даними TrendForce, виробник оцінює можливість використання менш складних конфігурацій HBM, щоб забезпечити достатні обсяги виробництва на тлі дефіциту пам’яті для систем штучного інтелекту.

Rubin Ultra може отримати іншу конфігурацію HBM

Як повідомляє видання з посиланням на південнокорейських аналітиків, NVIDIA вивчає кілька варіантів оптимізації підсистеми пам’яті для прискорювачів Rubin Ultra.

Серед можливих змін називають:

  • перехід із HBM4E на стандартну HBM4;
  • використання стеків 8Hi HBM замість запланованих 12Hi HBM4E.

Поки що остаточного рішення компанія не ухвалила.

Чому NVIDIA може змінити плани

За оцінками аналітиків, одна з головних причин — невизначеність із сертифікацією та масовим виробництвом пам’яті HBM4E.

Найбільші виробники DRAM ще завершують процеси валідації нової пам’яті, тому існують ризики, що постачання HBM4E не встигнуть вийти на необхідні обсяги до старту виробництва Rubin Ultra.

Менше шарів — більше прискорювачів

Перехід із 12-шарових стеків (12Hi) на 8Hi дозволить ефективніше використовувати наявні виробничі потужності.

Оскільки для одного стеку потрібно менше кристалів DRAM, із тієї самої кількості пам’яті можна виготовити більше комплектів HBM і, відповідно, більше AI-прискорювачів.

Аналітики зазначають, що подібний підхід NVIDIA вже використовувала під час масштабування поставок модулів LPDDR5X SOCAMM2 для процесорної платформи Vera.

Пріоритет — пропускна здатність

У TrendForce вважають, що головною перевагою Rubin Ultra стане не стільки збільшення обсягу пам’яті, скільки підвищення швидкості вводу-виводу (I/O).

Саме тому зменшення висоти стеків HBM може стати компромісом, який майже не вплине на продуктивність у більшості AI-навантажень, але дозволить збільшити кількість доступних прискорювачів.

Не лише NVIDIA

Аналітики також зазначають, що аналогічний підхід сьогодні розглядають і деякі виробники спеціалізованих AI-прискорювачів (ASIC), які також стикаються з дефіцитом HBM-пам’яті.

Зростання попиту на інфраструктуру штучного інтелекту продовжує чинити тиск на ланцюги постачання, змушуючи виробників шукати компроміси між максимальною продуктивністю та доступністю компонентів.

HiTech Expert Take

Дефіцит HBM поступово стає одним із головних стримувальних факторів розвитку ринку AI-прискорювачів. Якщо раніше конкуренція точилася навколо обчислювальної потужності GPU, то сьогодні дедалі важливішим ресурсом стає саме високошвидкісна пам’ять.

Якщо інформація TrendForce підтвердиться, NVIDIA продемонструє прагматичний підхід: замість випуску обмеженої кількості максимально оснащених прискорювачів компанія може зробити ставку на масштабування поставок. Для операторів дата-центрів це може виявитися важливішим за незначне скорочення характеристик окремих моделей.

Водночас наразі йдеться лише про оцінку можливих конфігурацій. NVIDIA офіційно не підтверджувала зміну специфікацій Rubin Ultra.