NVIDIA Mellanox MCX631432AN-ADAB 기술 솔루션: RDMA/RoCE 저연속 전송 및 서버 처리량 상승

June 12, 2026

NVIDIA Mellanox MCX631432AN-ADAB 기술 솔루션: RDMA/RoCE 저연속 전송 및 서버 처리량 상승

이 기술 백서는 네트워크 아키텍트, 사전 판매 엔지니어 및 운영 리더를 대상으로합니다.NVIDIA 멜라녹스 MCX631432AN-ADAB서버 어댑터는 RDMA/RoCE 기반의 낮은 지연 전송을 가능하게 하고 현대 데이터 센터 환경에서 서버 처리량을 극적으로 향상시킵니다.

1프로젝트 배경 및 요구사항 분석

전통적인 TCP/IP 네트워크는 프로토콜 처리, 데이터 복사 및 인터럽트 처리로 인해 상당한 CPU 오버헤드를 부과합니다.서버 밀도가 증가하고 분산 스토리지 (Ceph) 와 같은 응용 프로그램으로, vSAN), in-memory 데이터베이스 (Redis, Aerospike) 및 AI 교육 프레임워크는 단자리 마이크로초 지연을 요구하며, 전통적인 네트워크 스택은 극복 할 수없는 병목이됩니다.주요 요구 사항은: 300μs 이하의 저장 액세스 지연, 네트워크 처리에 대한 CPU 활용률 10% 이하, 포트 당 25GbE 라인 레이트 처리량 및 기존 RoCE가 가능한 스위칭 인프라와 원활한 통합.

2전체 네트워크/시스템 아키텍처 설계

제안된 아키텍처는 RoCE v2 지원으로 차단되지 않는 척추 잎 토폴로지를 채택합니다. 각 컴퓨팅 또는 스토리지 노드는迈络思 (NVIDIA Mellanox) MCX631432AN-ADAB어댑터, 25GbE SFP28 광학을 통해 잎 스위치에 연결. 잎 스위치는 끝에서 끝까지 혼잡 통제를 위해 DCQCN (데이터 센터 정량화 혼잡 알림) 를 실행합니다.제어 플레인은 손실 우선 순위 대기열에서만 PFC를 활용합니다., RDMA 데이터 플레인은 레이어-3 경계를 가로질러 IP 라우팅과 함께 RoCE v2를 사용합니다. 이 디자인은 헤드 오브 라인 차단을 제거하고 최대 2000 노드에서 결정적 지연 시간을 보장합니다.

레이어 구성 요소 사양
계산 노드 MCX631432AN-ADAB 듀얼 포트 25GbE, PCIe 4.0 x8, RoCE v2
잎 스위치 NVIDIA SN3700 25GbE RoCE 기능, DCQCN 기능
척추 전환 NVIDIA SN4600 100GbE, 막지 않는 직물
3이 솔루션에서 MCX631432AN-ADAB의 역할과 주요 특징

MCX631432AN-ADAB 이더넷 어댑터 카드RDMA 출하의 중요한 최종점으로 작용합니다.MCX631432AN-ADAB 커넥트X-6 Lx 듀얼 포트 25GbE SFP28실리콘은 하드웨어 기반의 RoCE, 태그 매칭 및 오트 오브 오더 패킷 어셈블리를 통합합니다. 소프트웨어 iWARP 또는 커널 TCP에 비해 어댑터는 대기 시간을 70% 이상 줄입니다.건축가들은MCX631432AN-ADAB 데이터 시트, 주요 출하량은 다음을 포함합니다:

  • RoCE v2 하드웨어 출하:데이터 이동은 복사 없이, 포트에서 포트까지의 지연시간은 600ns 미만입니다.
  • 플렉스플로우 스티어링:곡성 흐름 분포를 위한 프로그래밍 가능한 패킷 파서
  • 인라인 암호화 엔진:CPU 참여 없이 IPsec/TLS 라인 레이트
  • 텔레메트리 및 ECN 표시:SPIFFY 카운터를 통해 실시간 혼잡 시야

평가할 때MCX631432AN-ADAB 사양, 카드가 25GbE 및 10GbE 속도를 지원하여 단계적 마이그레이션을 허용한다는 점에 유의하십시오.MCX631432AN-ADAB 호환성이 생태계는 모든 주요 서버 공급자를 포함하고 자격을 단순화합니다.

4배포 및 확장 권고 (토폴로지 설명)

500 노드 클러스터의 전형적인 2단층 토폴로지: 각 랙에는 20개의 서버가 있으며, 각 랙은 1개의NVIDIA 멜라녹스 MCX631432AN-ADAB(두 포트 모두 리던스 또는 대역폭 집적에 활성화됩니다.) 잎 스위치는 25GbE SFP28 DAC 케이블 ( 최대 5m) 또는 AOC 광학을 통해 더 긴 거리를 통해 서버에 연결됩니다.척추 계층은 4를 유지하기 위해 100GbE 업링크를 사용합니다스토리지 트래픽을 위해 RoCE로 Ceph 백엔드 트래픽에 어댑터당 1개의 포트를 전용하고, 두 번째 포트를 컴퓨팅 작업 부하에 예약합니다.2000개의 노드 이상으로 확장하려면 3단계 슈퍼 스핀 디자인이 필요합니다., BGP-EVPN로 RoCE 루트 전파를 위해 건축가들은MCX631432AN-ADAB 이더넷 어댑터 카드 솔루션상세한 케이블 매트리스와 전력 예산에 대한 가이드

5운영, 모니터링 및 문제 해결 우수 사례

배포 후, 운영 팀은 NVIDIA를 활성화해야 합니다mlx5ctl그리고에트툴실시간 포트 통계를 위해. 모니터링 할 주요 메트릭: RoCEv2 전송 중단 (PFC 폭풍을 나타냅니다), ECN 표시 된 패킷 비율 및 어댑터 열 판독. 높은 꼬리 지연을 해결하기 위해,확인합니다DCQCN 매개 변수(알파, 베타, 그리고 속도 감소 요인) 스위치 버퍼 프로파일과 정렬.MCX631432AN-ADAB 데이터 시트"out_of_seq"와 "retransmissions"와 같은 고급 카운터를 해석합니다./sys/class/infiniband/mlx5_*/ports/*/counter/비용 계획의 경우, 조달 팀은MCX631432AN-ADAB 가격추정 및 확인MCX631432AN-ADAB 판매허가 된 유통 업체 를 통해 목록; 100 단위 이상 주문에 대 한 볼륨 가격 사용 가능.

6요약 & 가치 평가

MCX631432AN-ADAB매력적인 가치 제안: 300μs 이하의 스토리지 지연, 25GbE 라인 레이트 트래픽에 대한 CPU 오버헤드 5% 미만, 애플리케이션 변경 없이 RoCE v2의 완전한 오프로드.레거시 TCP 스택을 RDMA 트랜스포트로 대체함으로써, 조직은 비즈니스-비판적 작업 부하를 위해 최대 30%의 핵심 용량을 복구 할 수 있습니다.ConnectX-6 Lx 아키텍처는 뛰어난 프로그래밍 파이프 라인 및 텔레미터 깊이를 제공합니다이 기술 솔루션은 클라우드 스토리지, HPC 시뮬레이션 및 실시간 분석을 아우르는 생산 환경에서 검증되었습니다.NVIDIA 멜라녹스 MCX631432AN-ADAB이는 저연속성, 높은 처리량 서버 네트워킹을 위한 미래형, 비용 효율적인 기반을 나타냅니다.