Сегодня 04 июля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Nvidia внезапно представила ИИ-чип Rubin CPX со 128 Гбайт GDDR7 для обработки длинных контекстов

Компания Nvidia представила специализированный графический процессор Rubin CPX, оснащённый 128 Гбайт памяти. Rubin CPX — это GPU, предназначенный для задач вывода ИИ и работы с моделями, использующими длинный контекст.

 Источник изображения: VideoCardz

Источник изображения: VideoCardz

Rubin CPX использует монолитную конструкцию кристалла и основан на архитектуре Rubin. Nvidia заявляет о его оснащении 128 Гбайт памяти GDDR7 и производительности до 30 Пфлопс в операциях NVFP4. Графический процессор включает по четыре блока NVENC и NVDEC для обработки видео.

 Источник изображения здесь и ниже: Hardaweluxx

Источник изображения здесь и ниже: Hardaweluxx

По заявлениям Nvidia, Rubin CPX обеспечивает трёхкратное повышение производительности вычислений внимания по сравнению с GB300 NVL72 при обработке длинных контекстов.

Nvidia позиционирует серверные стойки Vera Rubin NVL144 (без CPX) как решения для обучения ИИ-моделей и для вывода данных. Они обеспечивают производительность 3,6 Эфлопса в операциях NVFP4, обладают пропускной способностью 1,4 Пбайт/с памяти HBM4 и быстрым хранилищем ёмкостью 75 Тбайт. Поставки стоек NVL144 запланированы на вторую половину 2026 года, а NVL144 CPX — на конец 2026 года. Nvidia сообщила, что приступила к квалификационному тестированию Rubin несколько недель назад.

Rubin CPX будет поставляться как часть платформы Vera Rubin NVL144 CPX вместе с графическими процессорами Rubin и центральными процессорами Vera. В их состав могут входить: 144 графических чипа Rubin CPX, 144 графических чипа Rubin GPU, 36 процессоров Vera (на одну стойку) и 100 Тбайт памяти с пропускной способностью 1,7 Пбайт/с. Вычислительная производительность составит 8 Эфлопс в операциях NVFP4. Сетевые и межсетевые решения будут основаны на NVLink 6 Gen, Spectrum-6 и ConnectX-9.

Архитектура Rubin Ultra, ожидаемая в 2027 году, увеличит плотность размещения графических процессоров до четырёх на модуль и будет использовать память HBM4E. Решения на архитектуре Feynman запланированы на 2028 год, вместе с переходом на NVLink 8, Spectrum-7 и ConnectX-10.

Источники:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Alibaba представила ИИ-агента для поиска сверхпроводников — он сразу открыл четыре новых 10 мин.
Ampera напечатала на 3D-принтере малый ториевый реактор для питания дата-центров 56 мин.
DriveNets представила коммутаторы 2600SL и 2601S с 64 портами на 1,6 Тбит/с 2 ч.
Учёные создали в лаборатории модель чёрной дыры и испарили её 2 ч.
Samsung нацелилась стать главным производителем ИИ-чипов — она привлекла Anthropic и Meta 2 ч.
Новые складные смартфоны Samsung будут дороже предшественников на €100–€280 5 ч.
Samsung в III квартале хочет повысить цены на DRAM на 20 % — LPDDR может подорожать сильнее 7 ч.
Вслед за Kioxia компания Sandisk объявила о начале поставок NAND-памяти, выпущенной по технологии BiCS10 7 ч.
Аукцион Sotheby’s выставит на благотворительные торги кожаную куртку с автографом основателя Nvidia Дженсена Хуанга 8 ч.
Meta использует DDR4 в серверных системах, изначально её не поддерживающих 9 ч.