top of page
Generatived (Beta) | Cung cấp tin tức và xu hướng mới nhất về AI sáng tạo

NVIDIAがMoE高速化手法発表
Generatived
7:00 24/9/26
NVIDIA(米国カリフォルニア州)は、大規模言語モデルやバイオ基盤モデルに向けたMoE(Mixture-of-Experts)アーキテクチャの学習効率化手法を公開した。自社ライブラリ『Transformer Engine』を用い、分散処理時の計算負荷やメモリ消費を抑える技術群を提示したとされる。
複数のエキスパート演算を一本化する「GroupedLinear」や低精度量子化の「MXFP8」を適用し、最新ハードウェア『Blackwell』基盤での処理速度向上を図る仕組みだ。従来のオープンソース実装で生じていたカーネル起動オーバーヘッドを大幅に削減したと伝えられている。
実証実験では『B200』搭載環境において既存モデル比で最大2.21倍のスループットを記録した模様だ。同社はレシピの提供を通じて大規模モデルの学習コスト低減を後押しし、ゲノム解析や創薬研究における技術開発を強力に支援していく構想と報じられている。
Chia sẻ bài viết này:

