Generatived(Beta)|生成AIの最新ニュースとトレンドを提供

NVIDIA Nemotron 3 Ultra NVFP4公開
Generatived
26/6/29 9:00
NVIDIA(米国カリフォルニア州)は、550Bパラメータの大規模言語モデル「Nemotron 3 Ultra」をNVFP4形式へ量子化した新チェックポイントを公開したと発表。推論性能を高めながらBF16に近い精度を維持し、メモリー使用量も大幅に削減したという。
同社によると、量子化にはNVIDIA Model Optimizerを活用し、「Four-over-Six」スケーリングやAutoQuantizeなどの手法を組み合わせたという。モデルサイズはBF16比で約3.2分の1となり、BlackwellではW4A4、HopperではW4A16へ自動変換して動作すると説明。
また、Megatron-LMによる分散量子化にも対応し、16基のGPU環境では量子化処理時間を大幅に短縮できるとしている。独自レシピやYAML設定を利用することで、開発者が用途に応じた量子化構成を作成できる仕組みも提供するという。
さらに、GitHubで公開しているModel Optimizerを通じ、Hugging Faceモデルへの適用やエクスポートにも対応。量子化レシピやNVFP4チェックポイント、技術レポートを公開し、大規模モデル開発の効率化を支援するとしている。
最新のニュース
NVIDIAがAgent基盤開発
26/8/24 14:00
NVIDIA(サンフランシスコ)は、汎用コード生成エージェント「AVO」のアーキテクチャ概要および長時間の自律運用を可能にする制御機構を公表した模様だ。
MavenAGIが支援展開
26/8/24 14:00
Maven AGI(サンフランシスコ)は、Microsoft Azureの技術基盤を活用し、顧客の問い合わせを自動で完結させるAIエージェントプラットフォームを展開している模様だ。
Copyright © 2024 Generatived - All right Reserved.
ニュース
Generatived は、Generative AIに特化した情報やトレンドをお届けするサービスです。大きく変わりゆく世界の情報を全力でお届けします。
最新のニュース
NVIDIAがAgent基盤開発
26/8/24 14:00
NVIDIA(サンフランシスコ)は、汎用コード生成エージェント「AVO」のアーキテクチャ概要および長時間の自律運用を可能にする制御機構を公表した模様だ。
MavenAGIが支援展開
26/8/24 14:00
Maven AGI(サンフランシスコ)は、Microsoft Azureの技術基盤を活用し、顧客の問い合わせを自動で完結させるAIエージェントプラットフォームを展開している模様だ。


%20(1).webp)



