NVIDIA Mellanox 980-9I510-00NS00 Livro Branco Técnico

June 5, 2026

NVIDIA Mellanox 980-9I510-00NS00 Livro Branco Técnico

Este livro branco técnico concentra-se naNVIDIA Mellanox 980-9I510-00NS00como o bloco de construção principal para os modernos tecidos de rede de data center e de empresa.e telemetria operacional simplificada, sem a complexidade dos projetos tradicionais baseados em chassis ou sobrepostos.

1Análise dos antecedentes e requisitos do projecto

Os operadores de data centers de hoje enfrentam três desafios convergentes. Primeiro, o tráfego leste-oeste (servidor a servidor e armazenamento) agora domina, exigindo encaminhamento sem perdas e com baixo jitter.As janelas de manutenção encolhem enquanto os domínios de falha se expandem. Qualquer evento de ligação ou comutação deve ser contido em milissegundos.Em terceiro lugar, as equipas operacionais estão sobrecarregadas pela correlação manual de registos, pesquisas SNMP e saídas CLI dispares.Um grande fornecedor de nuvem quantificou recentemente que 68% dos tickets de problemas relacionados à rede provêm do isolamento atrasado de falhas, em vez de falha do próprio hardwareEstas pressões impulsionam a necessidade de um dispositivo de rede dedicado que combine capacidades de camada física de alta velocidade com visibilidade integrada e interfaces amigáveis à automação.

Os principais requisitos identificados pelos arquitetos incluem: failover inferior a 50 ms, telemetria acelerada por hardware, provisionamento zero-touch (ZTP) e total compatibilidade com as fábricas de óptica e cabos existentes.980-9I510-00NS00 produto de redeO projecto foi selecionado para avaliação porque as suas características correspondem directamente a estes imperativos operacionais.

2. Projeto geral de arquitetura de rede / sistema

A arquitetura proposta adota uma topologia de leaf-spine otimizada para conectividade de alta fiabilidade e eficiência operacional.NVIDIA Mellanox 980-9I510-00NS00Dispositivos configurados como um par MLAG, servindo até 48 nós de servidor/armazenamento através de ligações de ruptura 100G ou 200G.A camada da coluna utiliza quatro unidades independentes 980-9I510-00NS00 em um projeto ECMP de malha completa, proporcionando oversubscription 4:1 para cargas de trabalho de uso geral e 1:1 para clusters de armazenamento/IA. Todos os protocolos do plano de controle (BGP, EVPN, PFC, ECN) são executados diretamente no plano de dados de hardware,Eliminação dos estrangulamentos dos softwares de via lenta.

A arquitetura enfatiza a transparência "bump-in-the-wire": o endereçamento de rede, as políticas de segurança e os agentes de monitorização existentes permanecem inalterados.980-9I510-00NS00 rede de alta velocidade do centro de dadosA capacidade garante que, mesmo a uma taxa de linha de 200G, a latência permanece abaixo de 600 nanossegundos para encaminhamento cut-through.Suporte à criptografia MACsec e à telemetria em banda em ligações de metro.

3. Papel e Características Chave do NVIDIA Mellanox 980-9I510-00NS00

O 980-9I510-00NS00 serve tanto como o interruptor superior do rack quanto o elemento de interconexão da coluna vertebral, unificando as camadas física e de ligação de dados.

  • Failover assistido por hardware:Failover de grupo de agregação de ligações (LAG) de menos de 15 ms sem depender de temporizadores STP ou de sobreposição lentos.
  • Tubulação de amortecimento profundo:Buffer compartilhado configurável de até 32 MB por grupo de portas, absorvendo micro-explosões comuns em NVMe/TCP e cargas de trabalho de treinamento distribuídas.
  • Telemetria de transmissão (gNMI/IPFIX):A profundidade da fila em tempo real, os contadores de queda e as contagens de quadros PFC são enviados para os coletores com granularidade de 1 segundo.
  • Diagnóstico por cabo automático:O dispositivo monitora continuamente a integridade do sinal (estado do VCSEL, BER, temperatura) e sinaliza a deterioração da óptica antes de causar flaps de ligação.
  • Ecossistema de Automação Aberta:Suporte completo para SONiC, Cumulus Linux e Onyx/FAST da NVIDIA, permitindo infraestrutura como pipelines de código.

De acordo com oFicha de dados 980-9I510-00NS00, a plataforma inclui também características de marcação de tempo por hardware (PTP/SyncE) e rastreamento de fluxo em linha normalmente reservadas a sistemas de chassi de preço muito mais elevado.

4Recomendações de implantação e escalagem (com topologia típica)

Uma implementação típica no nível do rack segue um processo simples de duas etapas. Primeiro, duas unidades 980-9I510-00NS00 são instaladas em um único rack, interconectadas através de um link de backhaul 200G e dois peer-links MLAG.Os servidores são duplos, com uma ligação a cada folhaEm segundo lugar, cada par de folhas se conecta a todos os quatro switches de coluna vertebral usando ligações 100G ou 200G, formando um tecido CLOS não bloqueador.são adicionados pares de folhas adicionais sem reconfigurar a coluna vertebral. As portas vertebrais são pré-provisionadas como interfaces ECMP roteadas.

OEspecificações 980-9I510-00NS00Suporte a modos de interrupção flexíveis: 4x50G, 2x100G ou 1x200G por porta física, permitindo ambientes de velocidade mista (por exemplo, armazenamento 25G legado ao lado da nova computação 100G).o dispositivo está totalmente980-9I510-00NS00 compatívelcom óptica SFP56/SFP112, cabos DAC e AOC de padrão industrial, reduzindo o risco de migração.uma troca financeira escalada de 4 para 24 pares de folhas (mais de 1152 portas de servidor) sem alterar uma única linha de configuração da coluna vertebral.

5. Operações, Monitorização, Solução de Problemas e Optimização

O quadro operacional é construído em torno de três pilares: visibilidade proativa, validação automatizada e correção guiada.A telemetria de transmissão do dispositivo alimenta um banco de dados de séries temporais (Prometheus/TICK stack) que aciona alertas quando os quadros de pausa PFC excedem um limiar configurável ou quando os erros do CRC do link tendem a subirOs dados históricos de telemetria são também utilizados para o planeamento da capacidade:980-9I510-00NS00 solução de produto de redeInclui painéis Grafana pré-construídos que mostram a utilização por porta, percentil de ocupação do buffer e balanço de hash de fluxo.

Para solução de problemas, um único comando CLI (Mostrar rastreamento interno do hardware) captura os últimos 1.000 pacotes que sofreram congestionamento ou erros, juntamente com carimbos de tempo em resolução de nanossegundos.Recomendações de otimização incluem a habilitação da ECN em todas as portas viradas para o tecido, definindo limiares de PFC para 3/4 da profundidade do buffer e usando o equilíbrio de carga dinâmica (DLB) do hardware para o tráfego de sobreposição.A equipe de operações também pode agendar scripts regulares de "atestado de saúde" que validam a deriva de configuração, consistência do firmware e BER do cabo em todos os dispositivos.

6Resumo e Avaliação do Valor

Implementação doNVIDIA Mellanox 980-9I510-00NS00O elemento da espinha dorsal da folha unificada proporciona melhorias mensuráveis em quatro dimensões de valor:

  • Confiabilidade:A transição de falha determinística de menos de 15 ms e o comportamento RoCE/ECN sem perdas eliminam a maioria das perturbações visíveis nas aplicações.
  • Eficiência operacional:A telemetria de transmissão e o diagnóstico automático por cabo reduzem a correlação de falhas manuais em mais de 60%.
  • Custo total de propriedade (TCO):A fixação de preços por factor (o980-9I510-00NS00 preçoA utilização de um equipamento de fornecimento de dados (como um computador de computador) é tipicamente 40-50% menor do que o chassi modular por porta 100G) combinado com o provisionamento zero-touch reduz os custos de capital e operacional.
  • Protecção dos investimentos:O dispositivo já está marcado.980-9I510-00NS00 à vendaatravés dos principais canais de distribuição, e sua compatibilidade com versões anteriores garante que ele servirá ao lado das atuais ópticas 100G e futuras atualizações 200G/400G.

O980-9I510-00NS00 solução de produto de redeA utilização de tecidos de centro de dados de alta fiabilidade e fácil de operar oferece, assim, um caminho pragmático e imediatamente implantável. Network architects and IT managers seeking to reduce operational toil while guaranteeing wire‑speed performance should evaluate this platform as a key component of their next‑generation infrastructure roadmap.