GigaIO представила новую ноду FabreX на 64 ускорителя PCI-express

от автора

Компания GigaIO, специализирующаяся на разработке системы распределенного интерконнекта FabreX, базирующейся на технологии PCI Express, установила новый стандарт, удвоив количество подключаемых PCIe-устройств в своей последней платформе с 32 до 64. Эта технология позволяет интегрировать значительно больше ускорителей в один или несколько серверов, превосходя возможности традиционных систем, при этом сохраняя высокую эффективность утилизации ускорителей.

Ранее в этом году GigaIO продемонстрировала систему с 16 ускорителями NVIDIA A100, а затем представила мини-кластер SuperNODE, способный включать в себя до 32 ускорителей AMD Instinct MI210 или 24 ускорителя NVIDIA A100, дополненных системой хранения данных емкостью 1 петабайт. Особенностью системы FabreX является отсутствие необходимости в специальной настройке перед началом работы.

Недавно GigaIO анонсировала новую версию своей HPC-системы под названием SuperDuperNODE, которая поддерживает вдвое больше ускорителей — до 64. Эта система ориентирована на использование в области генеративного ИИ и также подходит для ряда HPC-задач, включая вычислительную гидродинамику.

SuperNODE, предшественник SuperDuperNODE, смогла выполнить самую сложную в мире CFD-симуляцию за 33 часа, в ходе которой имитировался полет 62-метрового авиалайнера Конкорд. Симуляция включала расчет поведения 40 миллиардов ячеек в течение 67,268 временных отрезков. Из общего времени 29 часов были затрачены на расчет полета, а оставшиеся 4 часа — на рендеринг 3000 4К-изображений. Благодаря масштабируемости SuperDuperNODE время расчета удалось сократить почти вдвое.

FabreX отличается возможностью эффективного наращивания числа ускорителей и других мощных PCIe-устройств при почти идеальном масштабировании. В тесте HPL-MxP пиковый показатель утилизации составил 99,7% от теоретического максимума, в тестах HPL и HPCG — 95,2% и 88% соответственно.

Компания GigaIO также сообщила, что программное обеспечение FabreX достигло завершенного состояния и позволяет переключать режимы работы системы SuperNODE между Beast (система функционирует как один большой узел), Swarm (несколько узлов для различных нагрузок) и Freestyle Mode (каждой задаче выделяется отдельный узел с определенным количеством ускорителей). Начало поставок SuperDuperNODE планируется на конец года, при этом Dell и Supermicro выступают в роли партнеров, как и в случае с SuperNODE.



ссылка на оригинал статьи https://habr.com/ru/articles/773426/


Комментарии

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *