top of page

Generatived (Beta) | Cung cấp tin tức và xu hướng mới nhất về AI sáng tạo

logo.png

NVIDIA GB200 NVL72 cải thiện hiệu suất của các mô hình MoE

Generatived

0:00 5/12/25

10 mô hình mã nguồn mở thông minh hàng đầu, bao gồm Kimi K2 Thinking và DeepSeek-R1, sử dụng kiến trúc Hỗn hợp Chuyên gia (MoE), mô phỏng hoạt động kích hoạt vùng tác vụ cụ thể trong não người. Kiến trúc này cho phép tạo mã thông báo hiệu quả bằng cách chỉ kích hoạt các "chuyên gia" cần thiết cho mỗi mã thông báo AI, cải thiện hiệu suất mà không làm tăng đáng kể tải tính toán.

Hệ thống GB200 NVL72 của NVIDIA đóng vai trò quan trọng trong việc mở rộng quy mô các mô hình MoE, cung cấp các tối ưu hóa phần cứng và phần mềm giúp tăng cường hiệu suất và hiệu quả cao. Ví dụ, mô hình Kimi K2 Thinking đã đạt được hiệu suất cải thiện gấp 10 lần trên GB200 NVL72 so với các hệ thống trước đó, chứng minh tính hiệu quả của nền tảng suy luận toàn khối của NVIDIA trong việc tối ưu hóa kiến trúc MoE.

Mặc dù việc mở rộng quy mô các mô hình MoE thường gặp nhiều thách thức do tính phức tạp và quy mô lớn, hệ thống GB200 NVL72 của NVIDIA đã giải quyết những thách thức này thông qua thiết kế đồng bộ cực đại. Hệ thống này có 72 GPU được kết nối với nhau, cho phép xử lý song song ở cấp độ chuyên gia và giảm áp lực băng thông bộ nhớ. Thiết kế này cải thiện đáng kể khả năng giao tiếp giữa các chuyên gia và nâng cao hiệu suất tổng thể.

Các nhà cung cấp dịch vụ đám mây hàng đầu và đối tác đám mây của NVIDIA đã triển khai GB200 NVL72 và đang gặt hái những lợi ích trên phạm vi toàn cầu. Các công ty như CoreWeave và DeepL đang tận dụng hệ thống này để cải thiện hiệu suất và hiệu suất của các mô hình AI. Những tiến bộ của NVIDIA trong việc mở rộng các mô hình MoE đã thiết lập một tiêu chuẩn mới cho khả năng AI, hứa hẹn một tương lai mà các hệ thống AI vừa mạnh mẽ vừa hiệu quả.

Chia sẻ bài viết này:

Tin tức mới nhất
Các đối tác kênh phân phối hợp tác với ZETA AI để nâng cao trải nghiệm khách hàng.

Các đối tác kênh phân phối hợp tác với ZETA AI để nâng cao trải nghiệm khách hàng.

0:00 13/2/26

Công ty Channel Corporation (quận Chiyoda, Tokyo) đã phát triển công cụ giao tiếp khách hàng bằng trí tuệ nhân tạo "Channel Talk" và công bố hợp tác kinh doanh với ZETA

Kho dữ liệu AI tăng cường Cloudera

Kho dữ liệu AI tăng cường Cloudera

0:00 13/2/26

Cloudera (Chuo-ku, Tokyo) thông báo đã mở rộng Cloudera Data Warehouse, được hỗ trợ bởi Cloudera AI Inference và Trino, sang môi trường tại chỗ

Công nghệ đồng bộ hóa thế hệ ngược AI được cấp bằng sáng chế của Jitera

Công nghệ đồng bộ hóa thế hệ ngược AI được cấp bằng sáng chế của Jitera

0:00 13/2/26

Công ty Jitera (Tokyo) đã được cấp bằng sáng chế (Bằng sáng chế số 7789284) cho một quy trình kỹ thuật sử dụng Generative AI(LLM) độc quyền của mình.

Tăng cường thương mại điện tử thế hệ mới thông qua hợp tác kênh với ZETA.

Tăng cường thương mại điện tử thế hệ mới thông qua hợp tác kênh với ZETA.

0:00 13/2/26

ZETA (quận Setagaya, Tokyo) đã công bố hợp tác kinh doanh với Channel Corporation (quận Chiyoda, Tokyo).

Copyright © 2024 Generatived - All right Reserved.

Chia sẻ bài viết này:

Chia sẻ bài viết này:

Generatived AI Logo

Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.

  • Facebook
  • X

Hãy theo dõi chúng tôi

Ngôn ngữ

Tin tức mới nhất
Các đối tác kênh phân phối hợp tác với ZETA AI để nâng cao trải nghiệm khách hàng.

Các đối tác kênh phân phối hợp tác với ZETA AI để nâng cao trải nghiệm khách hàng.

0:00 13/2/26

Công ty Channel Corporation (quận Chiyoda, Tokyo) đã phát triển công cụ giao tiếp khách hàng bằng trí tuệ nhân tạo "Channel Talk" và công bố hợp tác kinh doanh với ZETA

Kho dữ liệu AI tăng cường Cloudera

Kho dữ liệu AI tăng cường Cloudera

0:00 13/2/26

Cloudera (Chuo-ku, Tokyo) thông báo đã mở rộng Cloudera Data Warehouse, được hỗ trợ bởi Cloudera AI Inference và Trino, sang môi trường tại chỗ

Công nghệ đồng bộ hóa thế hệ ngược AI được cấp bằng sáng chế của Jitera

Công nghệ đồng bộ hóa thế hệ ngược AI được cấp bằng sáng chế của Jitera

0:00 13/2/26

Công ty Jitera (Tokyo) đã được cấp bằng sáng chế (Bằng sáng chế số 7789284) cho một quy trình kỹ thuật sử dụng Generative AI(LLM) độc quyền của mình.

Tăng cường thương mại điện tử thế hệ mới thông qua hợp tác kênh với ZETA.

Tăng cường thương mại điện tử thế hệ mới thông qua hợp tác kênh với ZETA.

0:00 13/2/26

ZETA (quận Setagaya, Tokyo) đã công bố hợp tác kinh doanh với Channel Corporation (quận Chiyoda, Tokyo).

bottom of page