top of page

Generatived(Beta)|生成AIの最新ニュースとトレンドを提供

logo.png

NVIDIAがモデル転送高速化技術を発表

Generatived

26/7/29 14:00

NVIDIA(米国カリフォルニア州)は、大規模AIモデルの重みデータをGPUへ高速転送する技術「ModelExpress」を発表した模様である。モデルのパラメータサイズ増大に伴う転送時間やストレージからのデータ読み込み待ち時間を短縮し、自律型エージェントなどの起動を加速させる目的があると伝えられている。

本技術は、稼働中の既存マシンからGPU間通信を介して直接データを移送する構造を採用している。オブジェクトストレージやローカルディスクを経由する従来の読み込み手順を省き、必要に応じてジャストインタイムでキャッシュを活用することで、大幅な時間縮小を実現するとされている。

AI基盤における計算資源の効率化に向けて、同社はデータ転送の最適化を重要視している。既存のフレームワークとの統合を進めることで、多様な環境下におけるワークロードの拡張性と処理速度向上を支援する方針であるとみられている。

この記事を共有:

最新のニュース
マイクロソフト、Claude Opus 5.5の提供を開始

マイクロソフト、Claude Opus 5.5の提供を開始

26/9/24 7:00

Microsoft(ワシントン州)は、Anthropicが開発した最新AIモデル「Claude Opus 5.5」を開発者向けプラットフォーム「Microsoft Foundry」上で一般提供開始した。

マイクロソフト、AIエージェント実行基�盤を提供

マイクロソフト、AIエージェント実行基盤を提供

26/9/24 7:00

Microsoft(ワシントン州)は、自律型AIエージェントの安全な実行と統制を両立する新機能「Azure Container Apps Sandboxes」の一般提供を開始した。

マイクロソフト、AI犯罪基盤を妨害

マイクロソフト、AI犯罪基盤を妨害

26/9/24 7:00

Microsoft(ワシントン州)は、サイバー犯罪プラットフォーム「EvilTokens」のインフラを妨害・無効化したと発表した。

NVIDIAがMoE高速化手法発表

NVIDIAがMoE高速化手法発表

26/9/24 7:00

NVIDIA(米国カリフォルニア州)は、大規模言語モデルやバイオ基盤モデルに向けたMoE(Mixture-of-Experts)アーキテクチャの学習効率化手法を公開した。

Copyright © 2024 Generatived - All right Reserved.

この記事を共有:

この記事を共有:

Generatived AI Logo

Generatived は、Generative AIに特化した情報やトレンドをお届けするサービスです。大きく変わりゆく世界の情報を全力でお届けします。

  • Facebook
  • X

フォローをお願いします

言語

最新のニュース
マイクロソフト、Claude Opus 5.5の提供を開始

マイクロソフト、Claude Opus 5.5の提供を開始

26/9/24 7:00

Microsoft(ワシントン州)は、Anthropicが開発した最新AIモデル「Claude Opus 5.5」を開発者向けプラットフォーム「Microsoft Foundry」上で一般提供開始した。

マイクロソフト、AIエージェント実行基盤を提供

マイクロソフト、AIエージェント実行基盤を提供

26/9/24 7:00

Microsoft(ワシントン州)は、自律型AIエージェントの安全な実行と統制を両立する新機能「Azure Container Apps Sandboxes」の一般提供を開始した。

マイクロソフト、AI犯罪基盤を妨害

マイクロソフト、AI犯罪基盤を妨害

26/9/24 7:00

Microsoft(ワシントン州)は、サイバー犯罪プラットフォーム「EvilTokens」のインフラを妨害・無効化したと発表した。

NVIDIAがMoE高速化手法発表

NVIDIAがMoE高速化手法発表

26/9/24 7:00

NVIDIA(米国カリフォルニア州)は、大規模言語モデルやバイオ基盤モデルに向けたMoE(Mixture-of-Experts)アーキテクチャの学習効率化手法を公開した。

bottom of page