NVIDIA Mellanox 980-9I510-00NS00 Техническая книга.
June 5, 2026
В данной технической белой книге основное внимание уделяетсяNVIDIA Mellanox 980-9I510-00NSОн отвечает растущим требованиям к детерминированной низкой задержке, активной высокой доступности,и оптимизированная операционная телеметрия без сложности традиционных конструкций, основанных на шасси или накладе.
1. Анализ контекста и требований проекта
Сегодня операторы центров обработки данных сталкиваются с тремя сходными проблемами. Во-первых, трафик с востока на запад (с сервера на сервер и хранилище) теперь доминирует, требуя беспроблемного пересылки. Во-вторых,Окна обслуживания уменьшаются, в то время как области отказа расширяются. Любое событие с одной ссылкой или переключением должно быть содержится в миллисекундах.В-третьих, оперативные команды перегружены ручной корреляцией журналов, опросов SNMP и разрозненными выходами CLI.Недавно крупный облачный провайдер определил, что 68% сообщений о проблемах в сети возникают из-за задержки изоляции неисправностей, а не из-за самого сбоя оборудованияЭто давление обуславливает необходимость в выделенном сетевом устройстве, которое сочетает в себе высокоскоростные возможности физического слоя с встроенной видимостью и дружественными для автоматизации интерфейсами.
Ключевые требования, выявленные архитекторами, включают: переход на неисправность менее 50 мс, аппаратно-ускоренную телеметрию, нулевое прикосновение (ZTP) и полную совместимость с существующими оптическими и кабельными установками.980-9I510-00NS00 сетевой продуктбыл выбран для оценки, потому что его особенности напрямую связаны с этими оперативными императивами.
2. Общий дизайн сетевой / системной архитектуры
Предлагаемая архитектура использует топологию "лист-позвоночник", оптимизированную как для высокой надежности подключения, так и для эффективности работы.NVIDIA Mellanox 980-9I510-00NSустройства, сконфигурированные как пара MLAG, обслуживающие до 48 серверов/узлов хранения через 100G или 200G разрывные соединения.В позвоночном слое используется четыре независимых 980-9I510-00NS00 единиц в полной сетки ECMP дизайн, обеспечивающий 4:1 переподписку для общецелевых нагрузок и 1:1 для кластеров хранения / ИИ. Все протоколы уровня управления (BGP, EVPN, PFC, ECN) работают непосредственно на аппаратном уровне данных,устранение узких мест в программном обеспечении медленного пути.
Архитектура подчеркивает прозрачность: существующие сетевые адресации, политики безопасности и агенты мониторинга остаются неизменными.980-9I510-00NS00 высокоскоростная сеть в центре обработки данныхВозможность гарантирует, что даже при скорости линии 200G, задержка остается ниже 600 наносекунд для переадресации.поддержка шифрования MACsec и внутриполосной телеметрии на линиях метро.
3. Роль и ключевые особенности NVIDIA Mellanox 980-9I510-00NS00
980-9I510-00NS00 служит как переключателем верхней части стойки, так и элементом межпозвоночного соединения, объединяющим физический и слои данных.
- Неисправность с помощью аппаратного обеспечения:Неисправное переключение группы агрегации ссылок (LAG) до 15 мс без использования медленного STP или таймеров наложения.
- Глубокая буферная трубопроводность:Конфигурируемый совместный буфер до 32 МБ на группу портов, поглощающий микро-всплески, распространенные в NVMe/TCP и распределенные учебные нагрузки.
- Телеметрия потоковой передачи (gNMI/IPFIX):Глубина очереди в режиме реального времени, счетчики падения и количество кадров PFC отправляются в коллекторы с гранулированностью 1 секунды.
- Автокабельная диагностика:Устройство непрерывно контролирует целостность сигнала (состояние VCSEL, BER, температура) и обнаруживает ухудшение оптики, прежде чем они вызовут разрыв соединения.
- Открытая экосистема автоматизацииПолная поддержка SONiC, Cumulus Linux и собственного Onyx/FAST от NVIDIA, что позволяет использовать инфраструктуру в качестве кода.
Согласно980-9I510-00NS00 лист данных, платформа также включает в себя аппаратное временное отметку (PTP/SyncE) и встроенное отслеживание потока, обычно зарезервированные для гораздо более дорогих систем шасси.
4. Рекомендации по развертыванию и масштабированию (с типичной топологией)
Типичное развертывание на уровне стеллажа следует простому двухэтапному процессу. Во-первых, два блока 980-9I510-00NS00 устанавливаются в одном стеллаже, взаимосвязанных через 200G-обратную связь и две одноранговые MLAG-ссылки.Серверы имеют двойной дом с одним соединением на каждый листВо-вторых, каждая пара листов соединяется со всеми четырьмя спинными коммутаторами с помощью 100G или 200G-ссылок, образуя неблокирующую ткань CLOS.Дополнительные пары листов добавляются, не перестраивая позвоночник. Порты позвоночника предусматриваются как маршрутизированные интерфейсы ECMP..
ВСпецификации 980-9I510-00NS00поддерживает гибкие режимы выхода: 4x50G, 2x100G или 1x200G на физический порт, что позволяет использовать среды смешанной скорости (например, устаревшее хранилище 25G наряду с новым вычислением 100G).устройство полностью980-9I510-00NS00 совместимыс оптикой SFP56/SFP112, кабелями DAC и AOC, соответствующими отраслевым стандартам, что снижает риск миграции.финансовый обмен, масштабируемый с 4 до 24 пар листов (более 1152 серверных портов) без изменения ни одной конфигурационной линии позвоночника.
5. Операции, мониторинг, устранение неполадок и оптимизация
Операционная структура построена на трех столпах: проактивная видимость, автоматизированная проверка и направленное устранение.Телеметрия потоковой передачи устройства подает информацию в базу данных временных рядов (стак Prometheus / TICK), которая запускает предупреждения, когда пауза PFC превышает настраиваемый порог или когда ошибки CRC ссылки растутИсторические данные телеметрии также используются для планирования мощности:980-9I510-00NS00 Сетевое решение продуктавключает в себя предварительно построенные панели Grafana, показывающие использование по портам, процентные показатели занятости буфера и баланс хэша потока.
Для устранения неполадок используется одна команда CLI (показывать внутренние следы оборудования) фиксирует последние 1000 пакетов, которые испытали перегрузку или ошибки, вместе с временными метками с разрешением наносекунд.Рекомендации по оптимизации включают включение ECN на всех портах, обращенных к ткани, устанавливая пороги PFC на 3/4 глубины буфера и используя динамическое балансирование нагрузки (DLB) для наложения трафика.Операционная группа также может планировать регулярные скрипты "аттестации здоровья", которые подтверждают дрейф конфигурации., согласованность прошивки и кабельного BER на всех устройствах.
6. Резюме и оценка стоимости
ВнедрениеNVIDIA Mellanox 980-9I510-00NSпоскольку унифицированный элемент листья-хребет обеспечивает измеримые улучшения в четырех измерениях стоимости:
- Надежность:Детерминированный переход на неисправность до 15 мс и безубыточное поведение RoCE/ECN устраняют большинство видимых нарушений приложения.
- Эффективность работы:Телеметрия потоковой передачи и автоматическая диагностика кабелями снижают корреляцию ручной ошибки более чем на 60%.
- Общая стоимость владения (TCO):Фиксированная форма ценообразования на факторы980-9I510-00NS00 ценаобычно на 40-50% ниже, чем у модульных шасси на 100G-порт) в сочетании с нулевым доступом к провизионному обеспечению снижает как капитальные, так и эксплуатационные расходы.
- Защита инвестиций:Устройство уже отмечено980-9I510-00NS00 для продажичерез основные каналы распределения, и его обратная совместимость гарантирует, что он будет служить наряду с текущей оптикой 100G и будущими обновлениями 200G / 400G.
В980-9I510-00NS00 Сетевое решение продуктаТаким образом, он предлагает прагматичный, немедленно развертываемый путь к высоконадежному, простому в эксплуатации оборудованию для центров обработки данных. Network architects and IT managers seeking to reduce operational toil while guaranteeing wire‑speed performance should evaluate this platform as a key component of their next‑generation infrastructure roadmap.

