Generatived(Beta)|生成AIの最新ニュースとトレンドを提供

Nemotron向けAIエージェント最適化
Generatived
26/7/10 9:00
NVIDIAは、オープンソースのエージェントフレームワーク「LangChain Deep Agents」において、NVIDIA Nemotron 3 Ultra向けのエージェントハーネスプロファイルを最適化し、プロプライエタリな最先端モデルに匹敵する性能を実現する手法を紹介した。
従来、エージェントシステムでは高精度なモデルほどコストが高く、精度と運用コストの両立が課題となっていた。今回紹介された手法では、モデル自体をファインチューニングするのではなく、エージェントハーネスのプロンプトやミドルウェア、ツール設定を調整することで性能向上を図る。
チュートリアルでは、まず評価ベンチマークを実行して失敗事例を分析し、その結果を基にハーネスプロファイルを修正。さらにベンチマークを再実行して改善効果と回帰の有無を検証するプロセスを示している。
実例では、ファイル読み込み時のページネーション処理を補助するミドルウェアを追加することで、関連テストの成功率が改善し、総合評価スコアも127点中94点から96点へ向上した。
さらに、同社は この改善サイクルをエージェント自身が自動的に繰り返す仕組みも紹介。評価結果を基にプロファイル修正を提案し、複数回の検証を経て有効な変更のみを採用することで、過学習を抑えながら継続的な最適化を実現できるとしている。
最新のニュース
OpenAIが安全機能を公開
26/8/21 14:00
OpenAI(サンフランシスコ)は、ZDR対応顧客向けに単一のセッションを超えた不正検知を可能にする新機能「Private Safety Processing」のプレビューを開始した模様だ。
Copyright © 2024 Generatived - All right Reserved.
ニュース
Generatived は、Generative AIに特化した情報やトレンドをお届けするサービスです。大きく変わりゆく世界の情報を全力でお届けします。
最新のニュース
OpenAIが安全機能を公開
26/8/21 14:00
OpenAI(サンフランシスコ)は、ZDR対応顧客向けに単一のセッションを超えた不正検知を可能にする新機能「Private Safety Processing」のプレビューを開始した模様だ。





