top of page
Generatif (Beta) |. Memberikan berita dan tren terkini dalam AI generatif

NVIDIAが複数GPU推論機能を発表
Generatived
23/9/26, 07.00
NVIDIA(米国カリフォルニア州)は、生成AIの推論処理を複数のGPUに分散させて高速化する新機能「TensorRTマルチデバイス推論」およびその基盤となる「Dynamo-Triton」の最新版を公表した。単一のGPUではメモリ容量や計算能力が不足する問題に対応し、複数端末での連携処理を容易にする技術とされる。
本技術では動画生成モデル「Cosmos 3 Nano」を用いた実証が行われ、8基のGPU環境において従来の単一環境比で処理時間が約78%短縮された模様だ。アプリケーション側の複雑な制御コードを排除し、ネットワーク経由で単一のモデルエンドポイントを呼び出すだけで分散処理を実行できる構造が整えられたという。
利用側はインターフェースを変更することなく、GPUリソースを追加投入するだけで遅延時間を大幅に削減可能とのことだ。同社は生成AIメディアの編集や確認プロセスの短縮を後押しし、エンタープライズ領域における推論処理の効率化と高度な運用の定着を進めていく構想と報じられている。
Bagikan artikel ini:

