top of page
Generatif (Beta) |. Memberikan berita dan tren terkini dalam AI generatif
logo.png

NVIDIAが新評価指標発表

Generatived

24/9/26, 07.00

NVIDIA(米国カリフォルニア州)は、推論サーバー向けソフトウェアにおけるAIコーディングエージェントの性能を測定する新評価指標『SWE-Serve』を発表した。オープンソースの推論エンジン「SGLang」への統合変更を基に構築された53の実行可能タスクで構成され、実際のサーバー稼働状態を模した総合的な検証を行う仕組みとされる。

実稼働検証を含む19のタスクでは、通常の検証を通過した修正パッチの約3割がライブサーバー環境でのテストで不合格になる実態が明らかになった模様だ。従来のローカルチェックのみでは検出できなかったモデルロード処理や排他的ルーティング、リアルタイムのレスポンス精度などの問題が可視化されたという。

主要な大規模言語モデル群を用いた検証では最高75.5%の成功率が記録されたものの、タスクの難易度やコスト面で大きな差異が確認されたとのことだ。同社は開発環境と実稼働環境の乖離を埋める評価基盤を提供し、推論エンジニアリング領域におけるAIエージェントの実用化と品質向上を後押ししていく構想と報じられている。

Bagikan artikel ini:

Tin tức mới nhất
Google Cloud基盤拡大

Google Cloud基盤拡大

23/9/26, 07.00

Google Cloud(米国カリフォルニア州)は、新興企業向けにおける「Gemini Enterprise」をはじめとしたAI基盤の利用拡大を発表した。

OpenAIが講師養成講習開始

OpenAIが講師養成講習開始

23/9/26, 07.00

OpenAI(サンフランシスコ)は、AIスキルの普及を目的とした『OpenAI Academy Community Trainer Program』の試行運用を発表した。

OpenAIのCEOが国連演説

OpenAIのCEOが国連演説

23/9/26, 07.00

OpenAI(サンフランシスコ)のCEOであるサム・アルトマン氏が、国連安全保障理事会において演説を行った。

OpenAIがAI会話ベンチマーク公開

OpenAIがAI会話ベンチマーク公開

22/9/26, 07.00

OpenAI(サンフランシスコ)は、メンタルヘルスに関するAIモデルの応答品質を測定するオープン評価指標『MentalHealthBench』を発表した。

Copyright © 2024 Generatived - All right Reserved.

Bagikan artikel ini:

Bagikan artikel ini:

Generatived

Hãy theo dõi chúng tôi

  • Facebook
  • X

Bahasa

Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.

Generatived AI Logo

Generatived adalah layanan yang memberikan informasi dan tren khusus dalam AI Generatif. Kami akan melakukan yang terbaik untuk menyampaikan informasi tentang dunia yang berubah dengan cepat.

  • Facebook
  • X

Ikuti kami

Bahasa

Berita terkini
Google Cloud基盤拡大

Google Cloud基盤拡大

23/9/26, 07.00

Google Cloud(米国カリフォルニア州)は、新興企業向けにおける「Gemini Enterprise」をはじめとしたAI基盤の利用拡大を発表した。

OpenAIが講師養成講習開始

OpenAIが講師養成講習開始

23/9/26, 07.00

OpenAI(サンフランシスコ)は、AIスキルの普及を目的とした『OpenAI Academy Community Trainer Program』の試行運用を発表した。

OpenAIのCEOが国連演説

OpenAIのCEOが国連演説

23/9/26, 07.00

OpenAI(サンフランシスコ)のCEOであるサム・アルトマン氏が、国連安全保障理事会において演説を行った。

OpenAIがAI会話ベンチマーク公開

OpenAIがAI会話ベンチマーク公開

22/9/26, 07.00

OpenAI(サンフランシスコ)は、メンタルヘルスに関するAIモデルの応答品質を測定するオープン評価指標『MentalHealthBench』を発表した。

bottom of page