NVIDIA Mellanox MCX4121A-ACAT в действии: трансформация задержки и пропускной способности с помощью RDMA/RoCE
March 9, 2026
История: Узкое место в современных центрах обработки данных
Поскольку интенсивные нагрузки на данные, такие как аналитика в режиме реального времени, распределенные базы данных и хранение NVMe-oF, становятся нормой, традиционные сетевые архитектуры изо всех сил пытаются идти в ногу.Недавно одна из ведущих финансовых фирм столкнулась с этой проблемой.: их существующая инфраструктура 10GbE вызывала насыщение процессора из-за чрезмерной перерывной обработки, что приводило к непредсказуемой задержке в их приложениях высокочастотного трейдинга (HFT).Основной проблемой была нагрузка на традиционный стек TCP/IP, который потреблял до 30% серверных циклов процессора, оставляя меньше ресурсов для критических алгоритмов торговли.
ИТ-архитекторы фирмы поняли, что простое обновление до 25 Гбит без устранения эффективности протокола только изменит узкое место.отгрузка сетевой обработки с хост-CPUЭто привело их к оценкеNVIDIA Mellanox MCX4121A-ACATсерверный адаптер, карта, специально разработанная для превосходства в средах RDMA и RoCE.
Решение: развертывание MCX4121A-ACAT ConnectX-4 Lx с двойным портом 25GbE SFP28
Развертывание было сосредоточено на замене устаревших NIC наКарта адаптера MCX4121A-ACAT EthernetВыбор был обусловлен поддержкой адаптера для RDMA через конвергентный Ethernet (RoCE), который обещал полностью обойти сетевой стек ядра.Развертывание было последовательное:
- Оценка инфраструктуры:Инженеры проверили, что их существующие переключатели верхней части стеллажа поддерживают контроль приоритета потока (PFC) и улучшенный выбор трансмиссии (ETS), предпосылки для безубыточной ткани RoCE.Совместимость MCX4121A-ACATПрирода с стандартной оптикой SFP28 позволила им повторно использовать существующие кабели, где это возможно.
- Оптимизация драйверов и стеков:Команда установила последние драйверы NVIDIA WinOF-2 и настроилаNVIDIA Mellanox MCX4121A-ACATКлючевые параметры, такие как размер MTU, умеренность прерывания и политика QoS, были настроены на соответствие требованиям к запросу, чувствительным к задержке.
- Интеграция хранилища:Компания развернула массив накопления данных NVMe-oF, используяРаствор карты адаптера Ethernet MCX4121A-ACATчтобы представить блок-хранилище через Ethernet ткань с ускорением RDMA.
Измеримые результаты: увеличение пропускной способности и снижение задержки
Последующие испытания показали значительное улучшение ключевых показателей производительности.Ниже приведено сравнение устаревшей установки 10GbE с новойMCX4121A-ACATКонфигурация:
| Метрический | Legacy 10GbE NIC | MCX4121A-ACAT с RoCE | Улучшение |
|---|---|---|---|
| Задержка между приложениями | ~ 25 мс | ~5 μs | Уменьшение в 5 раз |
| Использование процессора для сетевого ввода/вывода | ~30% | ~ 5% | 25% освобождены |
| Пропускная способность на ядро | ~2 Гбит/с | ~24 Гбит/с | 12 раз выше |
Эти результаты подтвердилиСпецификации MCX4121A-ACATФинансовая фирма достигла пропускной способности 25GbE при одновременном сокращении времени обработки транзакций.Освобожденные циклы процессора были перераспределены на основную бизнес-логикуДля команды хранения развертывание NVMe-oF над RoCE сократило окна резервного копирования на 60% и позволило быстрее восстановиться после катастрофы.
Заключение: Проект современной инфраструктуры
Это исследование показывает, чтоMCX4121A-ACATЭто больше, чем просто сетевой интерфейс; это основной компонент для создания высокопроизводительных, эффективных центров обработки данных.организации могут достичь низкой задержки и высокой пропускной способности, требуемой сегодняшними самыми требовательными приложениями. Для ИТ-менеджеров, ищущихЦена MCX4121A-ACATИмеется возможность использования адаптера для получения информации или оценки того, подходит ли этот адаптер для их окружения,Лист данных MCX4121A-ACATПоскольку все больше предприятий стремятся консолидировать ткани для хранения и вычислений,NVIDIA Mellanox MCX4121A-ACATвыделяется как проверенное, готовое к производству решение, которое выполняет обещание производительности 25GbE с интеллектуальными отгрузками.

