top of page

Generatived (Beta) | Cung cấp tin tức và xu hướng mới nhất về AI sáng tạo

logo.png

NVIDIA GB200 NVL72 cải thiện hiệu suất của các mô hình MoE

Generatived

0:00 5/12/25

10 mô hình mã nguồn mở thông minh hàng đầu, bao gồm Kimi K2 Thinking và DeepSeek-R1, sử dụng kiến trúc Hỗn hợp Chuyên gia (MoE), mô phỏng hoạt động kích hoạt vùng tác vụ cụ thể trong não người. Kiến trúc này cho phép tạo mã thông báo hiệu quả bằng cách chỉ kích hoạt các "chuyên gia" cần thiết cho mỗi mã thông báo AI, cải thiện hiệu suất mà không làm tăng đáng kể tải tính toán.

Hệ thống GB200 NVL72 của NVIDIA đóng vai trò quan trọng trong việc mở rộng quy mô các mô hình MoE, cung cấp các tối ưu hóa phần cứng và phần mềm giúp tăng cường hiệu suất và hiệu quả cao. Ví dụ, mô hình Kimi K2 Thinking đã đạt được hiệu suất cải thiện gấp 10 lần trên GB200 NVL72 so với các hệ thống trước đó, chứng minh tính hiệu quả của nền tảng suy luận toàn khối của NVIDIA trong việc tối ưu hóa kiến trúc MoE.

Mặc dù việc mở rộng quy mô các mô hình MoE thường gặp nhiều thách thức do tính phức tạp và quy mô lớn, hệ thống GB200 NVL72 của NVIDIA đã giải quyết những thách thức này thông qua thiết kế đồng bộ cực đại. Hệ thống này có 72 GPU được kết nối với nhau, cho phép xử lý song song ở cấp độ chuyên gia và giảm áp lực băng thông bộ nhớ. Thiết kế này cải thiện đáng kể khả năng giao tiếp giữa các chuyên gia và nâng cao hiệu suất tổng thể.

Các nhà cung cấp dịch vụ đám mây hàng đầu và đối tác đám mây của NVIDIA đã triển khai GB200 NVL72 và đang gặt hái những lợi ích trên phạm vi toàn cầu. Các công ty như CoreWeave và DeepL đang tận dụng hệ thống này để cải thiện hiệu suất và hiệu suất của các mô hình AI. Những tiến bộ của NVIDIA trong việc mở rộng các mô hình MoE đã thiết lập một tiêu chuẩn mới cho khả năng AI, hứa hẹn một tương lai mà các hệ thống AI vừa mạnh mẽ vừa hiệu quả.

Chia sẻ bài viết này:

Tin tức mới nhất
Palo Alto Tech công bố nền tảng AI có độ tin cậy cao.

Palo Alto Tech công bố nền tảng AI có độ tin cậy cao.

0:00 11/2/26

Palo Alto mới đây đã thông báo rằng nền tảng AI thời gian thực của họ đạt độ ổn định 99,99%, thiết lập một tiêu chuẩn mới về độ tin cậy của AI.

Công ty Mofy AI toàn cầu thông báo thành công về hiệu ứng hình ��ảnh (VFX) trong loạt phim hài.

Công ty Mofy AI toàn cầu thông báo thành công về hiệu ứng hình ảnh (VFX) trong loạt phim hài.

0:00 11/2/26

Công ty Global Mofy AI Limited mới đây đã thông báo rằng thương hiệu hiệu ứng hình ảnh (VFX) của họ, Mofy VFX, đã cung cấp dịch vụ VFX toàn diện cho loạt phim hài "No Pain No Gain".

Operant AI ra mắt giải pháp bảo mật Agent Protector.

Operant AI ra mắt giải pháp bảo mật Agent Protector.

0:00 10/2/26

SAN FRANCISCO, ngày 5 tháng 2 năm 2026 – Operant AI đã công bố Agent Protector, một giải pháp bảo mật mới được thiết kế riêng cho kỷ nguyên trí tuệ nhân tạo dựa trên tác nhân

NVIDIA công bố NVFP4 nhằm Enhance AI.

NVIDIA công bố NVFP4 nhằm Enhance AI.

0:00 10/2/26

NVIDIA đang tích cực theo đuổi thiết kế đồng bộ cực đỉnh để đáp ứng nhu cầu ngày càng tăng về hiệu năng tính toán AI với tốc độ vượt xa dự đoán của Định luật Moore.

Copyright © 2024 Generatived - All right Reserved.

Chia sẻ bài viết này:

Chia sẻ bài viết này:

Generatived AI Logo

Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.

  • Facebook
  • X

Hãy theo dõi chúng tôi

Ngôn ngữ

Tin tức mới nhất
Palo Alto Tech công bố nền tảng AI có độ tin cậy cao.

Palo Alto Tech công bố nền tảng AI có độ tin cậy cao.

0:00 11/2/26

Palo Alto mới đây đã thông báo rằng nền tảng AI thời gian thực của họ đạt độ ổn định 99,99%, thiết lập một tiêu chuẩn mới về độ tin cậy của AI.

Công ty Mofy AI toàn cầu thông báo thành công về hiệu ứng hình ảnh (VFX) trong loạt phim hài.

Công ty Mofy AI toàn cầu thông báo thành công về hiệu ứng hình ảnh (VFX) trong loạt phim hài.

0:00 11/2/26

Công ty Global Mofy AI Limited mới đây đã thông báo rằng thương hiệu hiệu ứng hình ảnh (VFX) của họ, Mofy VFX, đã cung cấp dịch vụ VFX toàn diện cho loạt phim hài "No Pain No Gain".

Operant AI ra mắt giải pháp bảo mật Agent Protector.

Operant AI ra mắt giải pháp bảo mật Agent Protector.

0:00 10/2/26

SAN FRANCISCO, ngày 5 tháng 2 năm 2026 – Operant AI đã công bố Agent Protector, một giải pháp bảo mật mới được thiết kế riêng cho kỷ nguyên trí tuệ nhân tạo dựa trên tác nhân

NVIDIA công bố NVFP4 nhằm Enhance AI.

NVIDIA công bố NVFP4 nhằm Enhance AI.

0:00 10/2/26

NVIDIA đang tích cực theo đuổi thiết kế đồng bộ cực đỉnh để đáp ứng nhu cầu ngày càng tăng về hiệu năng tính toán AI với tốc độ vượt xa dự đoán của Định luật Moore.

bottom of page