NVIDIA Mellanox 920-9B210-00FN-0D0 Báo cáo: Định nghĩa lại nền tảng mạng AI siêu quy mô với NDR 400Gb / s
August 27, 2026
NVIDIA Mellanox 920-9B210-00FN-0D0 Được công bố: Tái định nghĩa nền tảng mạng AI siêu quy mô với tốc độ NDR 400Gb/s
Khi các mô hình ngôn ngữ lớn mở rộng từ hàng trăm tỷ lên hàng nghìn tỷ tham số, các mạng HDR 200Gb/s truyền thống đang bộc lộ những hạn chế của chúng trong các tình huống giao tiếp tập thể dày đặc như all-to-all, nơi hiệu suất sử dụng GPU thường giảm mạnh do tắc nghẽn mạng. NVIDIA đã chính thức ra mắt NVIDIA Mellanox 920-9B210-00FN-0D0, một bộ chuyển mạch InfiniBand NDR 400Gb/s được thiết kế để cung cấp băng thông, mật độ và trí thông minh trong mạng cần thiết cho các khối lượng công việc AI và HPC đòi hỏi khắt khe nhất.
Thách thức: Khi HDR trở thành nút thắt cổ chai
Đối với các tổ chức mở rộng quy mô cụm GPU của họ vượt quá 2.000 nút, những hạn chế của HDR 200Gb/s ngày càng trở nên rõ ràng. Trong các hoạt động all-reduce và all-to-all — vốn là nền tảng cho việc đào tạo phân tán — tắc nghẽn mạng có thể làm giảm hiệu suất sử dụng GPU từ 85% xuống dưới 50%, lãng phí hàng triệu đô la đầu tư vào tính toán. Các kiến trúc sư mạng phải đối mặt với thách thức kép là cung cấp độ trễ xác định dưới micro giây trong khi duy trì hiệu suất không mất mát trên hàng nghìn điểm cuối.
Mã số đặt hàng (OPN) của bộ chuyển mạch InfiniBand 920-9B210-00FN-0D0 giải quyết những thách thức này bằng cách mang lại hiệu suất NDR 400Gb/s cho nền tảng OSFP 64 cổng, cung cấp không gian dự phòng và trí thông minh cần thiết để loại bỏ tình trạng dừng do mạng gây ra ngay cả trong môi trường đào tạo AI đòi hỏi khắt khe nhất.
Các tính năng kỹ thuật chính
Được xây dựng trên cùng một chip silicon với MQM9790-NS2F được áp dụng rộng rãi, nền tảng 920-9B210-00FN-0D0 MQM9790-NS2F 400Gb/s NDR cung cấp một bộ tính năng toàn diện được thiết kế cho các triển khai cấp exascale. Theo tờ dữ liệu 920-9B210-00FN-0D0, bộ chuyển mạch cung cấp:
- 64 cổng NDR 400Gb/s: Mỗi cổng OSFP hỗ trợ tốc độ 400Gb/s hai chiều với sửa lỗi chuyển tiếp (FEC), cung cấp dung lượng chuyển mạch tổng cộng 51,2 Tb/s.
- Độ trễ cực thấp: Độ trễ cắt ngang dưới 100ns, như được ghi lại trong thông số kỹ thuật 920-9B210-00FN-0D0, đảm bảo chi phí hoạt động tối thiểu cho các hoạt động RDMA và MPI.
- SHARPv3 tích hợp: Giảm tải các hoạt động tập thể (all-reduce, all-to-all, broadcast) trực tiếp lên cấu trúc liên kết mạng, giảm độ trễ giao tiếp tới 40% cho các tác vụ quy mô lớn.
- Định tuyến thích ứng và kiểm soát tắc nghẽn: Định tuyến lại lưu lượng truy cập động để tránh các điểm nóng, duy trì hiệu suất dự đoán được ngay cả dưới các mẫu lưu lượng truy cập bất lợi.
- Viễn trắc nâng cao: Bộ đếm cho từng luồng và từng cổng, cùng với giám sát mức chiếm dụng bộ đệm, cung cấp khả năng hiển thị sâu để quản lý chủ động.
tương thích 920-9B210-00FN-0D0 bao gồm một loạt các loại cáp OSFP, bộ thu phát quang và công cụ phần mềm được NVIDIA chứng nhận, đảm bảo tích hợp liền mạch vào môi trường HDR hiện có hoặc môi trường NDR mới. Đối với các tổ chức đang lên kế hoạch cho cơ sở hạ tầng thế hệ tiếp theo của họ, bộ chuyển mạch hỗ trợ các cấu trúc liên kết hỗn hợp HDR/NDR, cho phép nâng cấp theo giai đoạn mà không làm gián đoạn khối lượng công việc sản xuất.
Giải quyết nhu cầu triển khai thực tế
Đối với các kiến trúc sư mạng thiết kế các cụm đào tạo AI mới hoặc nâng cấp các cấu trúc liên kết HDR hiện có, giải pháp OPN của bộ chuyển mạch InfiniBand 920-9B210-00FN-0D0 mang lại một số lợi thế hấp dẫn. Mật độ 64 cổng của nó cho phép triển khai ở đỉnh giá đỡ với tối đa 64 máy chủ hai cổng trên mỗi bộ chuyển mạch, giảm số lượng bộ chuyển mạch và cáp cần thiết so với các giải pháp thay thế 40 cổng. Trong các cấu trúc lá-xương sống, điều này dẫn đến ít tầng xương sống hơn, độ trễ thấp hơn và giảm tổng chi phí sở hữu.
Bộ chuyển mạch cũng kế thừa các khả năng quản lý mạnh mẽ của danh mục InfiniBand của NVIDIA. Với Trình quản lý Cấu trúc Liên kết Hợp nhất (UFM) của NVIDIA, quản trị viên có thể có được khả năng hiển thị sâu về tình trạng cấu trúc liên kết, tự động hóa việc cung cấp và chủ động phát hiện các bất thường trước khi chúng ảnh hưởng đến khối lượng công việc sản xuất. Các bộ nguồn dự phòng kép và mô-đun quạt có thể thay thế nóng của bộ chuyển mạch đảm bảo tính khả dụng 99,999% cho các ứng dụng quan trọng.
Khi đánh giá giá 920-9B210-00FN-0D0 và tổng chi phí sở hữu, bộ chuyển mạch mang lại nền kinh tế hấp dẫn cho các triển khai quy mô lớn. Mặc dù chi phí ban đầu cao hơn các giải pháp thay thế HDR, chi phí trên mỗi cổng và chi phí mạng trên mỗi GPU thấp hơn đáng kể khi được phân bổ trên một cụm lớn, làm cho NDR trở thành một lựa chọn ngày càng hiệu quả về chi phí cho các dự án exascale. 920-9B210-00FN-0D0 để bán hiện có sẵn thông qua các đối tác kênh của NVIDIA, với các lô hàng khách hàng ban đầu đã được tiến hành.
Tóm tắt: Nền tảng NDR cho AI thế hệ tiếp theo
NVIDIA Mellanox 920-9B210-00FN-0D0 đại diện cho một bước tiến đáng kể trong mạng hiệu suất cao, cung cấp băng thông, mật độ và trí thông minh cần thiết cho thế hệ tiếp theo của các cụm AI và HPC. Bằng cách kết hợp tốc độ NDR 400Gb/s với mật độ OSFP 64 cổng và tính toán trong mạng SHARPv3, bộ chuyển mạch này cho phép các kiến trúc sư xây dựng các cấu trúc liên kết có thể mở rộng, xác định được, có thể theo kịp các khối lượng công việc có tham số nghìn tỷ đòi hỏi khắt khe nhất.
Đối với các tổ chức đang lên kế hoạch cho cơ sở hạ tầng thế hệ tiếp theo của họ, 920-9B210-00FN-0D0 cung cấp một con đường rõ ràng, hiệu suất cao phía trước — cho dù là triển khai mới hay nâng cấp chiến lược từ các cấu trúc liên kết HDR hiện có. Với bộ tính năng mạnh mẽ, khả năng quản lý cấp doanh nghiệp và khả năng tương thích liền mạch với hệ sinh thái NVIDIA rộng lớn hơn, bộ chuyển mạch này được định vị để trở thành nền tảng của mạng cấp exascale.

