Generatived(Beta)|生成AIの最新ニュースとトレンドを提供

NVIDIAがモデル転送高速化技術を発表
Generatived
26/7/29 14:00
NVIDIA(米国カリフォルニア州)は、大規模AIモデルの重みデータをGPUへ高速転送する技術「ModelExpress」を発表した模様である。モデルのパラメータサイズ増大に伴う転送時間やストレージからのデータ読み込み待ち時間を短縮し、自律型エージェントなどの起動を加速させる目的があると伝えられている。
本技術は、稼働中の既存マシンからGPU間通信を介して直接データを移送する構造を採用している。オブジェクトストレージやローカルディスクを経由する従来の読み込み手順を省き、必要に応じてジャストインタイムでキャッシュを活用することで、大幅な時間縮小を実現するとされている。
AI基盤における計算資源の効率化に向けて、同社はデータ転送の最適化を重要視している。既存のフレームワークとの統合を進めることで、多様な環境下におけるワークロードの拡張性と処理速度向上を支援する方針であるとみられている。
最新のニュース
chezmoiでAI設定一元化
26/8/24 14:00
グループIT推進本部のRokiは、AIエージェントの共通設定を管理ツールchezmoiとAPMを用いて効率的に一元化・同期する手法を発表した模様だ。
Targetデータ基盤を統合
26/8/24 14:00
Target(ミネアポリス)は、大規模な商品データや顧客の検索意図を効率的に処理するため、データベース基盤をGoogle Cloudの「Spanner Graph」へ統合した模様だ。
Copyright © 2024 Generatived - All right Reserved.
ニュース
Generatived は、Generative AIに特化した情報やトレンドをお届けするサービスです。大きく変わりゆく世界の情報を全力でお届けします。
最新のニュース
chezmoiでAI設定一元化
26/8/24 14:00
グループIT推進本部のRokiは、AIエージェントの共通設定を管理ツールchezmoiとAPMを用いて効率的に一元化・同期する手法を発表した模様だ。
Targetデータ基盤を統合
26/8/24 14:00
Target(ミネアポリス)は、大規模な商品データや顧客の検索意図を効率的に処理するため、データベース基盤をGoogle Cloudの「Spanner Graph」へ統合した模様だ。






