Generatived(Beta)|生成AIの最新ニュースとトレンドを提供
%20(1).webp)
NVIDIA、DGX Spark向けAIエージェント運用を簡素化
Generatived
26/6/3 0:00
NVIDIA(米カリフォルニア州サンタクララ)は、開発者がローカル環境で自律型AIエージェントを構築・運用しやすくするDGX Spark向けの新機能を発表した。NemoClawの導入手順を簡素化し、初期設定後数分でAIエージェントを稼働できる環境を提供するとしている。
同社によると、NemoClawはオープンモデル、エージェント実行基盤、セキュアな実行環境であるOpenShellを単一の導入フローに統合した設計となる。これにより、機密情報を端末内に保持しながら、自律型エージェントの安全な運用を支援すると説明している。
また、Qwen3.6-35B向け推論性能を強化し、vLLM環境で最大2.6倍のスループット向上を実現したという。加えて、複数のDGX Sparkを接続するクラスタリング機能を強化し、大規模モデルや複数エージェントの同時実行を支援するとしている。
さらに、NVIDIA Syncのクラスタアシスタントにより、最大4台のDGX Sparkを高帯域ネットワークで接続する設定を自動化した。これにより、開発者や企業は大規模AIモデルや分散型エージェントシステムの構築をより容易に進められる見通しという。
最新のニュース
NVIDIA、LLM向けGPU最適化設計指針公開
26/7/14 0:00
NVIDIA(米国カリフォルニア州)は、大規模言語モデル(LLM)の性能を最大限引き出すためのGPU最適化設計ガイドを公開したと発表した。
Microsoft、Copilotに営業・サービスAI強化
26/7/14 0:00
Microsoft(米国ワシントン州)は、Microsoft 365 CopilotとDynamics 365向けに営業・カスタマーサービス業務を支援する新たなエージェント機能を提供開始したと発表した。
NVIDIA、JAX向けHBM削減技術を紹介
26/7/14 0:00
NVIDIA(米国カリフォルニア州)は、JAXを用いた大規模言語モデル(LLM)の学習において、GPU高帯域幅メモリ(HBM)の使用量を抑える「Host Offloading」の活用方法を紹介した。
Copyright © 2024 Generatived - All right Reserved.
ニュース
Generatived は、Generative AIに特化した情報やトレンドをお届けするサービスです。大きく変わりゆく世界の情報を全力でお届けします。
最新のニュース
NVIDIA、LLM向けGPU最適化設計指針公開
26/7/14 0:00
NVIDIA(米国カリフォルニア州)は、大規模言語モデル(LLM)の性能を最大限引き出すためのGPU最適化設計ガイドを公開したと発表した。
Microsoft、Copilotに営業・サービスAI強化
26/7/14 0:00
Microsoft(米国ワシントン州)は、Microsoft 365 CopilotとDynamics 365向けに営業・カスタマーサービス業務を支援する新たなエージェント機能を提供開始したと発表した。
NVIDIA、JAX向けHBM削減技術を紹介
26/7/14 0:00
NVIDIA(米国カリフォルニア州)は、JAXを用いた大規模言語モデル(LLM)の学習において、GPU高帯域幅メモリ(HBM)の使用量を抑える「Host Offloading」の活用方法を紹介した。






