Сегодня 31 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Nvidia придумала более рациональную HBM — она быстрее обычной на 30 % и экономит до 15 % энергии

Nvidia представила новую технологию в рамках программы NVLink Fusion. NVHBM представляет собой специализированную архитектуру базового кристалла HBM, предназначенную для разработчиков собственных ИИ-ускорителей. По сравнению со стандартной HBM4e она обещает более высокую пропускную способность, меньшее энергопотребление и экономию площади внутри корпуса ускорителя.

 Источник изображений: nvidia.com

Источник изображений: nvidia.com

Как поясняет Nvidia, NVHBM представляет собой специализированный базовый кристалл HBM, разработанный и протестированный совместно с ведущими производителями памяти. Участники программы NVLink Fusion смогут использовать уже готовое решение при создании собственных ускорителей вместо самостоятельной разработки и сертификации подсистемы HBM, что должно сократить сроки вывода новых чипов на рынок.

NVHBM не является заменой самой HBM, а представляет собой один из строительных блоков для специализированных ускорителей партнёров Nvidia. Одним из главных преимуществ технологии должна стать повышенная пропускная способность памяти: компания обещает прирост до 30 % на стек по сравнению со стандартной HBM4e. Для задач, производительность которых ограничена скоростью памяти, это позволит лучше загружать вычислительные блоки и увеличить пропускную способность ускорителя. В частности, при инференсе больших языковых моделей более быстрая передача данных между HBM и вычислительными ядрами позволит увеличить скорость генерации токенов.

Экономия площади достигается за счёт переработанного физического интерфейса памяти. Контроллер перенесён с основного вычислительного кристалла в базовый кристалл трёхмерного стека HBM, а площадь PHY и связанной с ним логики сокращена до 67 % по сравнению со стандартом JEDEC HBM4e. Более узкий интерфейс одновременно упрощает разводку интерпозера. В результате разработчики специализированных ускорителей могут получить до 30 % дополнительной площади основного кристалла для вычислительных блоков и других функций.

Ещё одним преимуществом NVHBM станет снижение энергопотребления памяти на величину до 15 % по сравнению со стандартной HBM4e. Освободившийся энергетический и тепловой бюджет можно использовать для увеличения вычислительной мощности ускорителя или повышения устойчивой производительности при прежнем энергопотреблении. В масштабах крупных ЦОД эффект становится особенно заметным: по расчётам Nvidia, в гипотетическом ЦОД мощностью 1 ГВт с 2000-Вт ускорителями сэкономленной благодаря NVHBM энергии хватило бы для работы ещё 15 000 XPU.

Повышение пропускной способности при одновременном снижении энергопотребления особенно важно для ИИ-ускорителей, которым приходится постоянно перемещать большие объёмы данных, включая веса моделей, KV-кеш и активации. Nvidia утверждает, что сочетание NVHBM с NVLink Fusion за счёт выигрыша в пропускной способности, площади и энергопотреблении способно в совокупности повысить производительность одного XPU на 30 %.

Одним из первых партнёров Nvidia по внедрению NVHBM станет принадлежащая Amazon компания Annapurna Labs. Ускорители следующего поколения Trainium 4 уже получат поддержку NVLink Fusion, а в последующих разработках компания сможет использовать и NVHBM.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Sony подтвердила сентябрьскую презентацию State of Play — покажут Final Fantasy VII Revelation и игры от PlayStation Studios 20 мин.
Windows 11 начала обманывать, что антивирус Defender отключён — на самом деле он работает 2 ч.
В российской серверной ОС SelectOS прописалася ИИ-агент Aish 2 ч.
«Нам нужно адаптироваться»: оригинальная The Long Dark получит новые DLC, а Blackfrost: The Long Dark 2 скоро выйдет из тени 4 ч.
Новая Fable не станет игрой на сотни часов, и фанаты даже рады 5 ч.
ИИ-агенты OpenAI не просто взломали Hugging Face — они создали тайную организацию, заметали следы и были готовы к самопожертвованию 24 ч.
«Энергетический» стартап Emerald AI привлёк $150 млн при оценке $1,05 млрд 30-08 15:22
Valve случайно «слила» 12 Тбайт данных по играм Steam с 2003 по 2013 год, включая ранние сборки Portal 2, Left 4 Dead, CS:GO и не только 30-08 15:18
Sony и Warner подали на Anthropic в суд за «вопиющую кражу» музыкальных произведений 30-08 11:59
Новая статья: Mortal Shell 2 — вдвое больше. Рецензия 30-08 00:08
Российским операторам разрешили строить 5G на частотах LTE — сети скоро появятся в городах-миллионниках 44 мин.
TSMC намерена в 50 раз повысить производительность ИИ-систем — помогут 3D-чипы и кремниевая фотоника 56 мин.
G.Skill представила комплект Flare X5X DDR5-6000 с технологией разгона AMD EXPO ULL для систем на Ryzen 3 ч.
Очередная доставка астронавтов и космонавта на МКС задержится из-за технических проблем у корабля SpaceX Dragon 4 ч.
Поставщики облачных услуг в Бразилии возьмут на вооружение оптические диски Folio Photonics 5 ч.
Гибрид Xiaomi Skynomad N90 Max проехал в реальных условиях 1230 км без подзарядки и дозаправки 5 ч.
FPGA AMD Versal RF получат поддержку UCIe 1.1 5 ч.
Российские цены на оперативную память и SSD для серверов выросли вдвое — снижения цен пока не предвидится 5 ч.
Лиха беда начало: Longsys станет третьим китайским чипмейкером, который выйдет на биржу в этом году 8 ч.
Intel может приобщиться к выпуску памяти HBM4E — она будет делать базовые кристаллы для SK hynix 8 ч.