Сетевой адаптер Mellanox (NVIDIA) MCX556A-ECAT в практике: низколатентная передача RDMA/RoCE и сервер

March 10, 2026

последние новости компании о Сетевой адаптер Mellanox (NVIDIA) MCX556A-ECAT в практике: низколатентная передача RDMA/RoCE и сервер

В современную эпоху взрыва данных, корпоративные центры обработки данных сталкиваются с беспрецедентными проблемами: как достичь более высокой скорости передачи и более высокой пропускной способности сервера, обеспечивая при этом консистенцию данных.Особенно в таких сценариях, как финансовая торговля, высокочастотные аналитические системы и широкомасштабное распределенное хранилище, задержка, введенная традиционным стеком протоколов TCP/IP, стала основным узким горлом, ограничивающим развитие бизнеса.В этой статье рассматривается типичный случай применения на базе сетевого адаптера сервера Mellanox (NVIDIA) MCX556A-ECAT, демонстрируя, как он перестраивает архитектуру передачи с низкой задержкой с помощью технологии RDMA/RoCE.

Опыт и вызов: дилемма традиционной сетевой архитектуры

Крупное интернет-предприятие (далее именуемое "предприятие") имело основные виды деятельности, включающие анализ контроля рисков в режиме реального времени и массовую обработку журналов.Первоначальная сетевая архитектура центра обрабатывала стандартные 25GbE NIC с протоколом TCP/IPПо мере роста объемов работы процессоры часто заняты задачами по обработке сетевых пакетов, что приводит к значительному увеличению задержки ответа приложения.и пропускная способность серверов оставалась ниже уровня узкого горла в течение длительных периодовОдновременно задержка обмена данными между кластером хранения и вычислительными узлами достигала нескольких сотен микросекунд, что серьезно повлияло на эффективность обучения моделей ИИ.Предприятию срочно нужно было сетевое решение, способное к низкой задержке и низкому использованию процессора для поддержки своих приложений следующего поколения с интенсивным использованием данных.

В ходе своего расследования техническая группа определила технологию RDMA (Remote Direct Memory Access) как ключ к решению проблемы.традиционные решения InfiniBand были дорогими и сложными для интеграции с существующей средой Ethernet предприятияТаким образом, поиск высокопроизводительного NIC, который мог бы идеально поддерживать RoCE (RDMA по конвергированному Ethernet), стал основным требованием проекта.

Решение и развертывание: внедрение MCX556A-ECAT

После тщательных испытаний и оценки предприятие в конечном итоге выбрало Mellanox (NVIDIA) MCX556A-ECAT в качестве основного компонента для модернизации сети.Эта сетевая карта NVIDIA Mellanox MCX556A-ECAT, основанный на архитектуре ConnectX-5, поддерживает технологию RoCE v2, позволяющую использовать функциональность RDMA в стандартной инфраструктуре Ethernet и идеально сбалансировать производительность и стоимость.Команда развертывания установила эту карту адаптера MCX556A-ECAT Ethernet в ключевые вычислительные и хранилищные узлы, связывая их с существующими 100GbE коммутаторами.

Во время процесса развертывания инженеры в полной мере использовали интеллектуальные функции разгрузки этой карты сети PCIe с адаптером MCX556A-ECAT ConnectX.Позволяя QoS (Качество обслуживания) и PFC (Приоритетный контроль потока), они гарантировали низкую задержку для трафика RoCE даже во время перегрузки сети.что позволяет им получать выгоду от увеличения производительности RDMA без каких-либо изменений кода;.

Результаты и преимущества: двойной прорыв в низкой задержке и высокой пропускной способности

После развертывания производительность сети предприятия достигла качественного скачка.задержка доступа к данным между узлами хранения и вычисления упала с 200 микросекунд до менее 5 микросекундВо-вторых, благодаря мощным аппаратным возможностям MCX556A-ECAT,расходы на обработку протоколов сети сократились более чем на 90%Освобожденные вычислительные ресурсы были перераспределены на основные бизнес-приложения, что привело к общему увеличению пропускной способности сервера почти в три раза.

Согласно подробным спецификациям MCX556A-ECAT и фактическим данным мониторинга, NIC демонстрирует отличную производительность при обработке большого количества небольших пакетов данных,достижение скоростной передачи с нулевой потерей пакетовЭта характеристика имеет решающее значение для высокочастотного трейдинга и сценариев контроля рисков в режиме реального времени.Наше узкое место в сети было полностью устранено.Теперь мы можем уверенно расширять наши учебные кластеры ИИ, не опасаясь, что сеть станет слабым звеном".Этот случай дает ценную справку., доказывая, что это не просто аппаратное обеспечение, а проверенное решение для карты MCX556A-ECAT Ethernet.

Расширенные технические особенности: больше, чем просто улучшение производительности

Помимо основных преимуществ RDMA/RoCE, предприятие также обнаружило дополнительный потенциал MCX556A-ECAT во время его применения.используя встроенные функции виртуализации, значительно повышает плотность сети в виртуализированных средахЭти подробные оптимизации в совокупности формируют прочную основу для усилий по модернизации дата-центра предприятия.

Чтобы помочь другим потенциальным пользователям понять детали продукта, предприятие рекомендует обратиться к официальному листу данных MCX556A-ECAT,содержащий полные параметры производительности и списки совместимостиВ настоящее время этот MCX556A-ECAT для продажи доступен на мировом рынке, и конкретные детали цены MCX556A-ECAT можно получить, связавшись с официальными каналами NVIDIA на основе объема закупок.

Резюме и перспективы

Этот случай наглядно демонстрирует исключительную производительность Mellanox (NVIDIA) MCX556A-ECAT в решении проблем с низкой задержкой передачи и высокой пропускной способностью.Благодаря глубокому применению технологии RDMA/RoCE, это не только решает проблемы производительности традиционных сетевых архитектур, но и прокладывает путь для будущих инноваций, связанных с использованием данных.По мере приближения эры 400G/800G, концепция умного NIC, воплощенная в NVIDIA Mellanox MCX556A-ECAT, продолжит вести эволюцию сетей центров обработки данных в сторону большей эффективности и интеллекта.

Ключевой показатель Предварительное развертывание (25 Гбит TCP/IP) После развертывания (MCX556A-ECAT RoCE)
Задержка доступа к хранилищу ~200 мкм < 5 μs
Расходы на сеть процессора 30% < 3%
Эффективная производительность ~15 Гбит/с ~98 Гбит/с