Generatived (Beta) | Cung cấp tin tức và xu hướng mới nhất về AI sáng tạo

NVIDIA công bố NVLink thế hệ thứ 5 dành cho khối lượng công việc AI
Generatived
0:00 26/8/25
NVIDIA luôn đi đầu trong việc đáp ứng nhu cầu tính toán ngày càng tăng của các mô hình AI, với số lượng tham số tăng vọt từ hàng triệu lên hàng nghìn tỷ. Được giới thiệu vào năm 2016, công nghệ NVLink của công ty đóng vai trò then chốt trong việc tăng cường giao tiếp giữa các GPU và tạo ra một không gian bộ nhớ thống nhất, khắc phục những hạn chế của PCIe cho các tác vụ tính toán hiệu năng cao và AI. Sự phát triển của NVLink được đánh dấu bằng những cột mốc quan trọng, chẳng hạn như việc giới thiệu công nghệ chuyển mạch NVLink vào năm 2018, cung cấp băng thông 300 GB/giây giữa các GPU trong cấu trúc tám GPU. Bước tiến này đã đặt nền móng cho kỷ nguyên hiện tại của các nền tảng điện toán đa GPU.
Thế hệ mới nhất, Gen 5 NVLink, dự kiến ra mắt vào năm 2024, sẽ tự hào với tốc độ giao tiếp đa hướng đáng kinh ngạc lên đến 1.800 GB/giây giữa 72 GPU, mang lại tổng băng thông lên đến 130 TB/giây—gấp 800 lần so với thế hệ đầu tiên. Cam kết đổi mới của NVIDIA thể hiện rõ qua những cải tiến liên tục của NVLink, với việc phát hành các thế hệ mới hàng năm để đáp ứng nhu cầu tính toán và độ phức tạp ngày càng tăng nhanh chóng của các mô hình AI. Hiệu suất phần cứng được cải thiện nhờ Thư viện Giao tiếp Tập thể NVIDIA (NCCL), một thư viện mã nguồn mở được thiết kế để tối ưu hóa giao tiếp GPU và tích hợp liền mạch với các nền tảng học sâu lớn.
Để cải thiện năng suất của các nhà máy AI, phần cứng NVIDIA và công nghệ NVLink đóng vai trò then chốt trong việc đáp ứng nhu cầu tính toán của suy luận AI. Kiến trúc rack 72 GPU đóng vai trò then chốt trong việc đạt được hiệu suất suy luận tối ưu trong nhiều trường hợp sử dụng. Việc tối đa hóa doanh thu tại các nhà máy AI đòi hỏi sự cân bằng giữa thông lượng trên mỗi watt và latency, và diện tích dưới đường cong Pareto biên đóng vai trò là điểm chuẩn. Hiệu suất thay đổi đáng kể tùy thuộc vào cấu hình mở rộng quy mô, làm nổi bật tầm quan trọng của giao tiếp tốc độ cao NVLink trong việc cải thiện thông lượng và giảm latency.
Để hỗ trợ tốt hơn cho các hệ thống siêu quy mô, NVIDIA đã công bố NVLink Fusion, cung cấp quyền truy cập vào công nghệ NVLink scale-up fabric toàn diện. Giải pháp này cho phép tích hợp silicon tùy chỉnh vào kiến trúc rack-scale của NVIDIA, mang đến một giải pháp linh hoạt cho nhiều cấu hình khác nhau, bao gồm CPU và XPU tùy chỉnh. NVLink Fusion được cung cấp dưới dạng giải pháp mô-đun tương thích với kiến trúc rack MGX của Dự án Tính toán Mở (OCP), mang lại sự linh hoạt và khả năng tích hợp dễ dàng. Cấu hình XPU tùy chỉnh tận dụng IP Universal Chiplet Interconnect Express (UCIe) để giao tiếp, trong khi cấu hình CPU tùy chỉnh khuyến nghị tích hợp IP NVIDIA NVLink-C2C để kết nối với GPU NVIDIA.
NVLink Fusion được hỗ trợ bởi một hệ sinh thái đối tác mạnh mẽ, cho phép hỗ trợ rộng rãi và thiết kế nhanh chóng. Hệ sinh thái này, kết hợp với kiến trúc rack OCP MGX và khả năng đáp ứng của chuỗi cung ứng, cho phép khách hàng rút ngắn thời gian đưa sản phẩm ra thị trường. NVLink của NVIDIA là một bước tiến vượt bậc trong việc đáp ứng nhu cầu tính toán của suy luận AI, mang đến cho các nhà cung cấp dịch vụ siêu quy mô hiệu suất và các tùy chọn tùy chỉnh vượt trội.
Chia sẻ bài viết này:
Tin tức mới nhất
NVIDIA chia sẻ hướng dẫn thiết kế phần cứng cho LLM.
0:00 14/7/26
NVIDIA đã phát hành một hướng dẫn thiết kế phác thảo các phương pháp thực hành nhận biết phần cứng cho các mô hình ngôn ngữ lớn.
Microsoft mở rộng chương trình Copilot với các đại lý dịch vụ bán hàng.
0:00 14/7/26
Microsoft đã công bố các khả năng AI hỗ trợ mới cho Microsoft 365 Copilot và Dynamics 365, giới thiệu Sales Agent và Service Agent nhằm giúp các đội ngũ bán hàng
NVIDIA nhấn mạnh tầm quan trọng của việc chuyển tải dữ liệu JAX Host cho chương trình đào tạo LLM.
0:00 14/7/26
NVIDIA đã trình bày cách thức giảm tải trên máy chủ (host offloading) trong JAX có thể giảm áp lực lên bộ nhớ băng thông cao của GPU trong quá trình huấn luyện mô hình ngôn ngữ quy mô lớn.
Copyright © 2024 Generatived - All right Reserved.
Chia sẻ bài viết này:
Chia sẻ bài viết này:
Danh mục
Tin tức
AI và luật/hệ thống/kinh tế/xã hội
Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.
Tin tức mới nhất
NVIDIA chia sẻ hướng dẫn thiết kế phần cứng cho LLM.
0:00 14/7/26
NVIDIA đã phát hành một hướng dẫn thiết kế phác thảo các phương pháp thực hành nhận biết phần cứng cho các mô hình ngôn ngữ lớn.
Microsoft mở rộng chương trình Copilot với các đại lý dịch vụ bán hàng.
0:00 14/7/26
Microsoft đã công bố các khả năng AI hỗ trợ mới cho Microsoft 365 Copilot và Dynamics 365, giới thiệu Sales Agent và Service Agent nhằm giúp các đội ngũ bán hàng
NVIDIA nhấn mạnh tầm quan trọng của việc chuyển tải dữ liệu JAX Host cho chương trình đào tạo LLM.
0:00 14/7/26
NVIDIA đã trình bày cách thức giảm tải trên máy chủ (host offloading) trong JAX có thể giảm áp lực lên bộ nhớ băng thông cao của GPU trong quá trình huấn luyện mô hình ngôn ngữ quy mô lớn.






