Компанія NVIDIA розглядає можливість спрощення конфігурації високошвидкісної пам’яті для майбутніх AI-прискорювачів Rubin Ultra, запуск яких очікується наступного року. За даними TrendForce, виробник оцінює варіанти переходу на менш складні конфігурації HBM, щоб забезпечити достатні обсяги виробництва на тлі дефіциту пам’яті для систем штучного інтелекту.
З посиланням на південнокорейських аналітиків повідомляється, що NVIDIA вивчає кілька сценаріїв оптимізації підсистеми пам’яті Rubin Ultra. Серед можливих змін називають перехід із HBM4E на стандартну HBM4, а також використання стеків 8Hi HBM замість раніше запланованих 12Hi HBM4E. Остаточного рішення компанія поки не ухвалила.
Аналітики пояснюють, що однією з ключових причин може бути невизначеність із сертифікацією та масовим виробництвом пам’яті HBM4E. Найбільші виробники DRAM ще завершують процеси валідації цієї пам’яті, тому існує ризик, що постачання HBM4E не досягнуть потрібних обсягів до старту виробництва Rubin Ultra.
Перехід із 12-шарових стеків (12Hi) на 8-шарові (8Hi) дає змогу ефективніше використовувати наявні виробничі потужності: для одного стеку потрібно менше кристалів DRAM, тож із тієї самої кількості чипів можна виготовити більше комплектів HBM і, відповідно, більше AI-прискорювачів. Аналітики нагадують, що подібний підхід NVIDIA вже застосовувала під час масштабування поставок модулів LPDDR5X SOCAMM2 для процесорної платформи Vera.
У TrendForce вважають, що головною перевагою Rubin Ultra має стати не стільки збільшення обсягу пам’яті, скільки підвищення швидкості вводу-виводу (I/O). Тому зменшення висоти стеків HBM розглядають як компроміс, який майже не вплине на продуктивність у більшості AI-навантажень, але дозволить збільшити кількість доступних прискорювачів.
Аналітики також зазначають, що подібний підхід нині розглядають і деякі виробники спеціалізованих AI-прискорювачів (ASIC), які так само стикаються з дефіцитом HBM-пам’яті. Зростання попиту на інфраструктуру штучного інтелекту посилює тиск на ланцюги постачання та змушує виробників шукати баланс між максимальною продуктивністю та доступністю компонентів.
Експертна оцінка HiTech Expert вказує, що дефіцит HBM поступово перетворюється на один із головних стримувальних факторів розвитку ринку AI-прискорювачів. Якщо раніше конкуренція зосереджувалася на обчислювальній потужності GPU, то тепер критично важливим ресурсом стає саме високошвидкісна пам’ять. У разі підтвердження інформації TrendForce NVIDIA може зробити ставку на масштабування поставок замість випуску обмеженої кількості максимально оснащених прискорювачів, що для операторів дата-центрів може бути важливішим за незначне скорочення характеристик окремих моделей.
Водночас наразі йдеться лише про оцінку можливих конфігурацій, і NVIDIA офіційно не підтвердила зміну специфікацій Rubin Ultra.
Джерело: Expert
