top of page

Generatived(Beta)|生成AIの最新ニュースとトレンドを提供

logo.png

NVIDIA、大規模データセットを効率的に扱えるXGBoostツールを発表

Generatived

23/9/8 18:31

データサイエンティストは、多くの場合、広範なデータセットで大規模なモデルをトレーニングするというタスクに取り組んでいる。堅牢な勾配ブースティング フレームワークであるXGBoostは、大規模な表形式データに対する速度とパフォーマンスにより人気のあるツールだ。理論的には、複数のGPUを使用すると計算能力が大幅に向上し、モデルのトレーニングが高速化されるはずだ。ただし、多くのユーザーは、並列コンピューティング用の柔軟なオープンソースPythonライブラリーであるDask XGBoostを通じてこの機能を活用するのが難しいと感じている。Dask XGBoostのトレーニングでは、トレーニングデータのロード、DataFrameのXGBoostのDMatrix形式への変換、および実際のモデルのトレーニング中など、さまざまな段階でメモリー不足(OOM)エラーの処理が行われることがよくある。これらのメモリーの問題に対処するのは困難だが、マルチGPUトレーニングの潜在的な利点により、やりがいがある。この記事では、複数のGPUでDask XGBoostを最適化し、メモリーエラーを管理する方法について説明する。大規模なデータセットでXGBoostをトレーニングすると、さまざまな課題が生じる。例えば、1億8,000万行と152列があり、メモリーにロードされると合計110 GBになるOtto Group製品分類チャレンジデータセットは、OOM問題とその解決方法を示すために使用される。取り扱う問題には、最新バージョンのRAPIDSと正しいバージョンのXGBoostを使用したインストール、環境変数の設定、OOMエラーの処理、さらなる高速化のためのUCX-pyの利用などが含まれる。RapidsaiチャネルのXGBoostは、RMMプラグインを有効にして構築されており、マルチGPUトレーニングに関して最適なパフォーマンスを提供する。

この記事を共有:

最新のニュース
スタディメーター研修開始

スタディメーター研修開始

26/8/20 14:00

スタディメーター(東京都千代田区)は、複数のAIキャラクターとの対話や資料読解を通じて実務的な業務を疑似体験できるロールプレイ研修システムを正式に公開した模様だ。

Razorpayが決済AIモデル発表

Razorpayが決済AIモデル発表

26/8/20 14:00

Razorpay(バンガロール)は、インド市場におけるデジタル決済の安全性向上を目的とし、AI基盤モデル「Razorpay Vulcan」を発表した模様だ。

NVIDIAが多GPU対応UMAP機能提供

NVIDIAが多GPU対応UMAP機能提供

26/8/20 14:00

NVIDIA(サンフランシスコ)は、次元削減技術「UMAP」の全近傍グラフ構築手順を複数GPUへ分散処理させる機能をcuMLおよびcuVSに実装した模様だ。

NVIDIAがChatGPT活用

NVIDIAがChatGPT活用

26/8/20 14:00

NVIDIA(サンフランシスコ)は、社内における業務効率化と意思決定の迅速化を目的に「ChatGPT Work」を導入し、複数部署で実用化を進めている模様だ。

Copyright © 2024 Generatived - All right Reserved.

この記事を共有:

この記事を共有:

Generatived AI Logo

Generatived は、Generative AIに特化した情報やトレンドをお届けするサービスです。大きく変わりゆく世界の情報を全力でお届けします。

  • Facebook
  • X

フォローをお願いします

言語

最新のニュース
スタディメーター研修開始

スタディメーター研修開始

26/8/20 14:00

スタディメーター(東京都千代田区)は、複数のAIキャラクターとの対話や資料読解を通じて実務的な業務を疑似体験できるロールプレイ研修システムを正式に公開した模様だ。

Razorpayが決済AIモデル発表

Razorpayが決済AIモデル発表

26/8/20 14:00

Razorpay(バンガロール)は、インド市場におけるデジタル決済の安全性向上を目的とし、AI基盤モデル「Razorpay Vulcan」を発表した模様だ。

NVIDIAが多GPU対応UMAP機能提供

NVIDIAが多GPU対応UMAP機能提供

26/8/20 14:00

NVIDIA(サンフランシスコ)は、次元削減技術「UMAP」の全近傍グラフ構築手順を複数GPUへ分散処理させる機能をcuMLおよびcuVSに実装した模様だ。

NVIDIAがChatGPT活用

NVIDIAがChatGPT活用

26/8/20 14:00

NVIDIA(サンフランシスコ)は、社内における業務効率化と意思決定の迅速化を目的に「ChatGPT Work」を導入し、複数部署で実用化を進めている模様だ。

bottom of page