top of page
Generatif (Beta) |. Memberikan berita dan tren terkini dalam AI generatif
%20(1).webp)
NVIDIA実行層モデル発表
Generatived
10/8/26, 14.00
NVIDIA(サンタクララ)は、自律型AIエージェントの実行層に向けた軽量な言語モデル「Nemotron 3.5 Lightning」を発表したと報じられている。本モデルは総パラメータ数300億規模の構成を採用し、実際の処理時には30億パラメータのみを動かすことで高い処理速度と低遅延を実現しているとされる。
同システムはツール呼び出しや結果の検証といった頻度の高い定型処理に特化しており、大型モデルとの役割分担によりシステム全体の運用コスト低減を図る設計であると伝えられている。多様な端末環境に対応し、ローカル環境から大型計算基盤まで柔軟に配置できる模様である。
さらに同社は、処理要求の内容に応じて最適なモデルへ要求を自動配信するオープンソースライブラリ「NeMo Switchyard」の提供も開始したとされる。オープンな開発環境と連携エコシステムの拡充を通じて、高度な自律処理ツールの普及と運用効率の最大化を目指しているとみられている。
Bagikan artikel ini:

%20(1).webp)