Generatived (Beta) | Cung cấp tin tức và xu hướng mới nhất về AI sáng tạo

NVIDIA công bố NVLink thế hệ thứ 5 dành cho khối lượng công việc AI
Generatived
0:00 26/8/25
NVIDIA luôn đi đầu trong việc đáp ứng nhu cầu tính toán ngày càng tăng của các mô hình AI, với số lượng tham số tăng vọt từ hàng triệu lên hàng nghìn tỷ. Được giới thiệu vào năm 2016, công nghệ NVLink của công ty đóng vai trò then chốt trong việc tăng cường giao tiếp giữa các GPU và tạo ra một không gian bộ nhớ thống nhất, khắc phục những hạn chế của PCIe cho các tác vụ tính toán hiệu năng cao và AI. Sự phát triển của NVLink được đánh dấu bằng những cột mốc quan trọng, chẳng hạn như việc giới thiệu công nghệ chuyển mạch NVLink vào năm 2018, cung cấp băng thông 300 GB/giây giữa các GPU trong cấu trúc tám GPU. Bước tiến này đã đặt nền móng cho kỷ nguyên hiện tại của các nền tảng điện toán đa GPU.
Thế hệ mới nhất, Gen 5 NVLink, dự kiến ra mắt vào năm 2024, sẽ tự hào với tốc độ giao tiếp đa hướng đáng kinh ngạc lên đến 1.800 GB/giây giữa 72 GPU, mang lại tổng băng thông lên đến 130 TB/giây—gấp 800 lần so với thế hệ đầu tiên. Cam kết đổi mới của NVIDIA thể hiện rõ qua những cải tiến liên tục của NVLink, với việc phát hành các thế hệ mới hàng năm để đáp ứng nhu cầu tính toán và độ phức tạp ngày càng tăng nhanh chóng của các mô hình AI. Hiệu suất phần cứng được cải thiện nhờ Thư viện Giao tiếp Tập thể NVIDIA (NCCL), một thư viện mã nguồn mở được thiết kế để tối ưu hóa giao tiếp GPU và tích hợp liền mạch với các nền tảng học sâu lớn.
Để cải thiện năng suất của các nhà máy AI, phần cứng NVIDIA và công nghệ NVLink đóng vai trò then chốt trong việc đáp ứng nhu cầu tính toán của suy luận AI. Kiến trúc rack 72 GPU đóng vai trò then chốt trong việc đạt được hiệu suất suy luận tối ưu trong nhiều trường hợp sử dụng. Việc tối đa hóa doanh thu tại các nhà máy AI đòi hỏi sự cân bằng giữa thông lượng trên mỗi watt và latency, và diện tích dưới đường cong Pareto biên đóng vai trò là điểm chuẩn. Hiệu suất thay đổi đáng kể tùy thuộc vào cấu hình mở rộng quy mô, làm nổi bật tầm quan trọng của giao tiếp tốc độ cao NVLink trong việc cải thiện thông lượng và giảm latency.
Để hỗ trợ tốt hơn cho các hệ thống siêu quy mô, NVIDIA đã công bố NVLink Fusion, cung cấp quyền truy cập vào công nghệ NVLink scale-up fabric toàn diện. Giải pháp này cho phép tích hợp silicon tùy chỉnh vào kiến trúc rack-scale của NVIDIA, mang đến một giải pháp linh hoạt cho nhiều cấu hình khác nhau, bao gồm CPU và XPU tùy chỉnh. NVLink Fusion được cung cấp dưới dạng giải pháp mô-đun tương thích với kiến trúc rack MGX của Dự án Tính toán Mở (OCP), mang lại sự linh hoạt và khả năng tích hợp dễ dàng. Cấu hình XPU tùy chỉnh tận dụng IP Universal Chiplet Interconnect Express (UCIe) để giao tiếp, trong khi cấu hình CPU tùy chỉnh khuyến nghị tích hợp IP NVIDIA NVLink-C2C để kết nối với GPU NVIDIA.
NVLink Fusion được hỗ trợ bởi một hệ sinh thái đối tác mạnh mẽ, cho phép hỗ trợ rộng rãi và thiết kế nhanh chóng. Hệ sinh thái này, kết hợp với kiến trúc rack OCP MGX và khả năng đáp ứng của chuỗi cung ứng, cho phép khách hàng rút ngắn thời gian đưa sản phẩm ra thị trường. NVLink của NVIDIA là một bước tiến vượt bậc trong việc đáp ứng nhu cầu tính toán của suy luận AI, mang đến cho các nhà cung cấp dịch vụ siêu quy mô hiệu suất và các tùy chọn tùy chỉnh vượt trội.
Chia sẻ bài viết này:

%20(1).webp)