NVIDIA Mellanox MCX4121A-ACAT Adaptador de servidor en acción.

July 22, 2026

últimas noticias de la compañía sobre NVIDIA Mellanox MCX4121A-ACAT Adaptador de servidor en acción.

NVIDIA Mellanox MCX4121A-ACAT Adaptador de servidor en acción.

Antecedentes y el desafío: Cuando 25GbE se encuentra con la pared de latencia

Un proveedor de servicios de nube de tamaño mediano, llamémoslos "CloudNova", se enfrentaba a un cuello de botella familiar pero doloroso.Pero el rendimiento de la aplicación contó una historia diferenteLa replicación de bases de datos se retrasó, los trabajos de aprendizaje automático distribuido se estancaron en la sincronización de gradientes, y las matrices de almacenamiento NVMe nunca entregaron sus IOPS prometidas. ¿El culpable?El overhead de pila TCP/IP tradicional estaba consumiendo más del 25% de los núcleos de CPU en sus nodos de cómputo, y los NIC existentes carecían de hardware para RDMA. Lo que necesitaban no era sólo más ancho de banda, sinoes útilSu búsqueda los llevó a laNVIDIA Mellanox MCX4121A-ACAT, también conocido como NVIDIAUna tarjeta diseñada precisamente para estos modernos centros de datos.

La solución: Despliegue de la tarjeta de adaptador Ethernet MCX4121A-ACAT

El equipo de arquitectura de CloudNova reemplazó sus NICs heredados de 10GbE con elTarjeta de adaptador Ethernet MCX4121A-ACATEl despliegue aprovechó el soporte nativo de RoCE v2 del adaptador para permitir el transporte Ethernet sin pérdidas,eliminando la necesidad de tejidos separados de InfiniBandLa clave de la solución fue laSe trata de un sistema de transmisión de datos que se utiliza para la transmisión de datos.diseño, que permitió el enlace activo-activo para un rendimiento agregado de 50Gb/s por servidor.El equipo configuró PFC (Priority Flow Control) y ECN (Explicit Congestion Notification) en el nivel del interruptor, garantizando que el tráfico de RoCE se mantuviera sin pérdidas incluso en situaciones de pico de carga.todo el tejido de almacenamiento y computación se ejecuta en RDMA, una transición hecha sin problemas por la compatibilidad del adaptador con el cableado SFP28 existente y los interruptores Mellanox Spectrum.

Desde el punto de vista operativo, elCompatible con MCX4121A-ACATLas tarjetas se integraron perfectamente con los servidores basados en Ubuntu de CloudNova y el clúster Kubernetes, requiriendo solo la instalación de controladores estándar.Se aplicarán las siguientes medidas:para afinar la asignación de búfer e interrumpir la configuración de la fusión, logrando un rendimiento óptimo para su entorno de carga de trabajo mixta que incluía grupos de MySQL, Spark analytics,y trabajos de entrenamiento de TensorFlow.

Resultados medibles: rendimiento, latencia y eficiencia de la CPU

La mejora del rendimiento fue inmediata y cuantificable.NVIDIA Mellanox MCX4121A-ACAT, también conocido como NVIDIA, el backend de almacenamiento vio caer la latencia de lectura de NVMe-oF de 85 μs a sólo 12 μs ∙ una mejora de 7x. El retraso de replicación de la base de datos entre los nodos primarios y de espera se redujo de 320 ms a menos de 2 ms,que permitan una transición de falla casi sincrónicaPara las cargas de trabajo de aprendizaje automático, el tiempo de sincronización total para la formación ResNet-50 disminuyó en un 62%, reduciendo el tiempo total de formación de 4.2 horas a 1.6 horas.

Más allá de la latencia, las ganancias de rendimiento del servidor fueron igualmente convincentes.y etiquetado de VLAN reducción de la utilización de la CPU para el procesamiento de la red del 28% a menos del 5% en todos los nodosEsto liberó más de 20 núcleos de CPU por servidor para la lógica de aplicaciones, aumentando directamente la densidad de contenedores en un 40%.Las especificaciones MCX4121A-ACAT, la tarjeta ofrece una velocidad de línea de 25GbE por puerto con latencia de menos de 1 μs, y los puntos de referencia internos de CloudNova confirmaron estos números en producción.

El método métrico Antes (NIC de legado) Después de (MCX4121A-ACAT) Mejora
NVMe-oF Lectura de la latencia 85 μs 12 μs 7.1 veces más rápido
Lag de replicación del DB 320 ms < 2 ms Reducción de 160 veces
Gastos generales de la red de la CPU El 28% 40,8% 83% más bajo
Tiempo de entrenamiento de ML (ResNet-50) 4.2 horas 1.6 horas 62% más rápido

Beneficios operativos: TCO y preparación futura

Si bien las cifras de rendimiento en bruto cuentan una historia convincente, las ganancias operativas fueron igualmente significativas.Solución de tarjeta de adaptador Ethernet MCX4121A-ACATredujo el costo total de propiedad al eliminar la necesidad de un tejido RDMA separado (ahorrando más de $ 180K en infraestructura de interruptores).Consumo de energía por servidor reducido en 8 W en comparación con los NIC anteriores, lo que se traduce en un ahorro anual de refrigeración de aproximadamente 15%.tráfico automáticamente fallido al puerto secundario con cero pérdida de paquetes, según lo verificado por los registros de telemetría del adaptador.

Para los gerentes de TI que evalúan laPrecio MCX4121A-ACATEn cuanto a las soluciones alternativas, el director financiero de CloudNova señaló que el período de amortización era inferior a 10 meses, impulsado en gran medida por el aumento de la utilización del servidor y la reducción de los tiempos de finalización del trabajo.El equipo también apreció la arquitectura orientada hacia el futuro.MCX4121A-ACAT para la ventaLa tecnología de hoy en día admite 25GbE hoy en día, pero puede reutilizarse para entornos de 10GbE o 40GbE con ópticas adecuadas, lo que garantiza la protección de la inversión para futuras actualizaciones.

Resumen y perspectivas: un plan para centros de datos listos para RDMA

El viaje de CloudNova con elNVIDIA Mellanox MCX4121A-ACAT, también conocido como NVIDIAmuestra un plan claro para las organizaciones que buscan liberar todo el potencial de la infraestructura 25GbE.y la integración perfecta con los ecosistemas existentes, elTarjeta de adaptador Ethernet MCX4121A-ACATTransforma las entradas y salidas de red de un cuello de botella en un facilitador de rendimiento, lo que resulta en una latencia de almacenamiento 7 veces menor, una reducción del 83% de los gastos generales de la CPU,y un 62% más rápido de formación de ML hablan de la capacidad del adaptador para ofrecer resultados comerciales medibles.

Mirando hacia el futuro, a medida que las cargas de trabajo de IA y el análisis en tiempo real continúan impulsando la demanda de redes deterministas, elSe trata de un sistema de transmisión de datos que se utiliza para la transmisión de datos.proporciona una base sólida para la adopción de RDMA sin actualizaciones de carretillas elevadoras. Para los arquitectos y líderes de TI que planean su próxima actualización de infraestructura, este adaptador no representa solo un componente,Pero un activo estratégicoLos parámetros de ajuste detallados y las mejores prácticas de despliegue están disponibles en la guía oficial.Se aplicarán las siguientes medidas:- una referencia esencial para cualquier despliegue serio.