top of page

Generatived(Beta)|生成AIの最新ニュースとトレンドを提供

logo.png

NVIDIA、MoE学習性能を大幅向上

Generatived

26/6/22 9:00

NVIDIA(米カリフォルニア州サンタクララ)は、大規模AIモデルで採用が進むMixture-of-Experts(MoE)向けに、新たな融合MLPカーネルを発表した。CuTe DSLを活用し、メモリー転送や同期処理の負荷を削減したという。

同社によると、新カーネルはGEMM、活性化関数、量子化処理を単一カーネルへ統合することで、従来の非融合実装比で1.3~2倍のカーネル性能向上を実現した。CUDA Graphによる同期不要のMoE実行にも対応する。

DeepSeek-V3の事前学習環境では約8%、GPT-OSSの事前学習環境では最大93%のエンドツーエンド性能向上を確認したとしている。特にGLU系活性化関数やFP8、NVFP4量子化処理の効率化が寄与したという。

これらの技術はcuDNN Frontend、Transformer Engine、Megatron Coreから利用可能となっている。NVIDIAは今後、JAX対応やさらなる融合パターンの拡充、事前コンパイル機能などの開発を進める方針を示した。

この記事を共有:

最新のニュース
NVIDIAがAgent基盤開発

NVIDIAがAgent基盤開発

26/8/24 14:00

NVIDIA(サンフランシスコ)は、汎用コード生成エージェント「AVO」のアーキテクチャ概要および長時間の自律運用を可能にする制御機構を公表した模様だ。

NVIDIAがAIセキュリティ提案

NVIDIAがAIセキュリティ提案

26/8/24 14:00

NVIDIA(サンフランシスコ)は、自律型AIエージェントの安全性を確保するための階層型セキュリティモデルを提唱した模様だ。

MavenAGIが支援展開

MavenAGIが支援展開

26/8/24 14:00

Maven AGI(サンフランシスコ)は、Microsoft Azureの技術基盤を活用し、顧客の問い合わせを自動で完結させるAIエージェントプラットフォームを展開している模様だ。

Stampliが生成AI活用

Stampliが生成AI活用

26/8/24 14:00

Stampli(マウンテンビュー)は、CodexやChatGPT Workを活用して新製品「Deep Finance」の市場投入準備を劇的に短縮させた模様だ。

Copyright © 2024 Generatived - All right Reserved.

この記事を共有:

この記事を共有:

Generatived AI Logo

Generatived は、Generative AIに特化した情報やトレンドをお届けするサービスです。大きく変わりゆく世界の情報を全力でお届けします。

  • Facebook
  • X

フォローをお願いします

言語

最新のニュース
NVIDIAがAgent基盤開発

NVIDIAがAgent基盤開発

26/8/24 14:00

NVIDIA(サンフランシスコ)は、汎用コード生成エージェント「AVO」のアーキテクチャ概要および長時間の自律運用を可能にする制御機構を公表した模様だ。

NVIDIAがAIセキュリティ提案

NVIDIAがAIセキュリティ提案

26/8/24 14:00

NVIDIA(サンフランシスコ)は、自律型AIエージェントの安全性を確保するための階層型セキュリティモデルを提唱した模様だ。

MavenAGIが支援展開

MavenAGIが支援展開

26/8/24 14:00

Maven AGI(サンフランシスコ)は、Microsoft Azureの技術基盤を活用し、顧客の問い合わせを自動で完結させるAIエージェントプラットフォームを展開している模様だ。

Stampliが生成AI活用

Stampliが生成AI活用

26/8/24 14:00

Stampli(マウンテンビュー)は、CodexやChatGPT Workを活用して新製品「Deep Finance」の市場投入準備を劇的に短縮させた模様だ。

bottom of page