Marvell представила линейку CXL‑решений, которые помогут справиться с нехваткой памяти в системах для тяжёлых ИИ‑задач. В состав серии вошли три типа устройств: контроллеры расширения памяти Structera X, ускорители Structera A и коммутаторы Structera S.
Контроллеры Structera X созданы с учётом потребностей гиперскейлеров и выпущены в коллаборации с крупнейшими игроками рынка облачных сервисов. В линейку включены модели Structera X 2404 (для DDR4) и Structera X 2504 (для DDR5).
Ускорители Structera A ориентированы на вычисления рядом с памятью (near‑memory). Ключевой продукт в этой категории — чип Structera A 2504: он оснащён 16 ядрами Arm Neoverse V2 с тактовой частотой 3,2 ГГц, поддерживает до 4 Тбайт памяти и обеспечивает пропускную способность до 200 Гбайт/с. Среди возможностей чипа — сжатие по алгоритму LZ4 и 256‑битное шифрование XTS‑AES. Устройство берёт на себя часть серверной нагрузки: выполняет ИИ‑инференс, обрабатывает модели рекомендаций на базе глубокого обучения (DLRM), проводит векторный поиск и управляет резидентными базами данных, тем самым снижая нагрузку на CPU.
Комбинация решений Structera X и Structera A даёт бизнесу готовые инструменты для эффективного масштабирования и тонкой настройки памяти в дезагрегированных ИИ‑инфраструктурах.
В линейку Structera S вошёл коммутатор 30260 — устройство на базе PCIe 6.0 / CXL 3.x с 260 линиями. Оно позволяет объединить до 16 или 32 CPU либо GPU в общий пул памяти ёмкостью до 48 Тбайт. Пропускная способность такого пула достигает 4 Тбайт/с, а задержки не превышают 460 нс. Коммутатор совместим с модулями DDR4 и DDR5. По данным Marvell, Structera S обеспечивает масштабируемость в 16 раз выше, чем у локальной памяти, и снижает задержки на 72 % относительно пулов на базе RDMA. В GPU‑конфигурациях пропускная способность при инференсе возрастает до 4,8 раза, а время до выдачи первого токена уменьшается на 82,7 %.
По материалам:
servernews