top of page
Generatived(Beta)|生成AIの最新ニュースとトレンドを提供

NVIDIAがモデル転送高速化技術を発表
Generatived
26/7/29 14:00
NVIDIA(米国カリフォルニア州)は、大規模AIモデルの重みデータをGPUへ高速転送する技術「ModelExpress」を発表した模様である。モデルのパラメータサイズ増大に伴う転送時間やストレージからのデータ読み込み待ち時間を短縮し、自律型エージェントなどの起動を加速させる目的があると伝えられている。
本技術は、稼働中の既存マシンからGPU間通信を介して直接データを移送する構造を採用している。オブジェクトストレージやローカルディスクを経由する従来の読み込み手順を省き、必要に応じてジャストインタイムでキャッシュを活用することで、大幅な時間縮小を実現するとされている。
AI基盤における計算資源の効率化に向けて、同社はデータ転送の最適化を重要視している。既存のフレームワークとの統合を進めることで、多様な環境下におけるワークロードの拡張性と処理速度向上を支援する方針であるとみられている。


