top of page

Generatived(Beta)|生成AIの最新ニュースとトレンドを提供

logo.png

Galileo、言語学習モデルのHallucination Indexを発表

Generatived

23/11/17 13:21

著名な機械学習企業であ​​るGalileoは、主要な言語学習モデル(LLM)のユーザーが特定のアプリケーションで幻覚を引き起こす可能性が最も低いモデルを特定するのに役立つ幻覚インデックスを発表した。Galileo Labsが開発したこのIndexは、AIの幻覚によってもたらされる課題への対応策であり、AIは現実的に見える情報を生成するが、最終的には不正確であるか、文脈とは無関係だ。これは、LLMベースのアプリケーションを開発するあらゆる規模の企業にとって大きな障害となっているとのこと。

Hallucination Indexは、さまざまな開発者からの11個のLLMを評価し、一般的な生成AIタスクにおける各モデルの幻覚傾向を評価する。Indexからの重要な洞察には、検索なしの質問と回答タスクでトップの成績を収めたOpenAIのGPT-4が含まれており、印象的な精度と幻覚の可能性が最も低いことが実証されている。オープンソースモデルでは、MetaのLlama-2-70bがリードしているが、他のモデルは幻覚の傾向が高いことが示されたという。

検索付きの質疑応答タスクでは、OpenAIのGPT-4-0613が優れており、コスト効率が高く、より高速なGPT-3.5ターボモデルがそのパフォーマンスにほぼ匹敵した。興味深いことに、Hugging FaceのオープンソースモデルであるZephyr-7bは、Metaのより大きなLlama-2-70bを上回り、より大きなモデルが本質的に優れているという考えに異議を唱えました。長文テキスト生成では、OpenAIのGPT-4-0613が再びトップパフォーマンスとなり、幻覚の傾向が最も少ないことが示されたという。

この指数は、オープンソースモデルによるコスト削減の機会も強調している。例えば、長文テキスト生成タスクの場合、MetaのオープンソースLlama-2-13b-chatモデルは、Open AIのモデルの実行可能な代替手段となる。検索タスクを伴う質問と回答の場合、ユーザーはOpenAIの代わりにHugging FaceのZephyrモデルを自信を持って試すことができる。このIndexは、Galileo Labsが開発した幻覚検出手法であるChainPollを活用した、Galileo独自の評価指標である正確性とコンテキスト遵守によってサポートされているとのことだ。

この記事を共有:

最新のニュース
Univéが全社AI導入を発表

Univéが全社AI導入を発表

26/8/7 14:00

Univé(アペルドールン)は、組織全体の変革を目的とした人工知能基盤の構築を推進していると公表した模様だ。

OpenAI未解決数学問題解明

OpenAI未解決数学問題解明

26/8/7 14:00

OpenAI(サンフランシスコ)は、未公開の主要AIモデルの内部バージョンを活用し、数学および理論計算機科学における複数の未解決問題で新たな成果を挙げたと発表した模様である。

NVIDIAがモデル設計指指針を提示

NVIDIAがモデル設計指指針を提示

26/8/7 14:00

NVIDIA(カリフォルニア州サンタクララ)は、生成モデルにおけるアテンション機構の設計最適化指針を公表したと報じられている。

NVIDIAがAIエージェントの安全策提示

NVIDIAがAIエージェントの安全策提示

26/8/7 14:00

NVIDIA(カリフォルニア州サンタクララ)は、企業で活用が進むAIエージェントのセキュリティに関する評価結果を公開したと発表した。

Copyright © 2024 Generatived - All right Reserved.

この記事を共有:

この記事を共有:

Generatived AI Logo

Generatived は、Generative AIに特化した情報やトレンドをお届けするサービスです。大きく変わりゆく世界の情報を全力でお届けします。

  • Facebook
  • X

フォローをお願いします

言語

最新のニュース
Univéが全社AI導入を発表

Univéが全社AI導入を発表

26/8/7 14:00

Univé(アペルドールン)は、組織全体の変革を目的とした人工知能基盤の構築を推進していると公表した模様だ。

OpenAI未解決数学問題解明

OpenAI未解決数学問題解明

26/8/7 14:00

OpenAI(サンフランシスコ)は、未公開の主要AIモデルの内部バージョンを活用し、数学および理論計算機科学における複数の未解決問題で新たな成果を挙げたと発表した模様である。

NVIDIAがモデル設計指指針を提示

NVIDIAがモデル設計指指針を提示

26/8/7 14:00

NVIDIA(カリフォルニア州サンタクララ)は、生成モデルにおけるアテンション機構の設計最適化指針を公表したと報じられている。

NVIDIAがAIエージェントの安全策提示

NVIDIAがAIエージェントの安全策提示

26/8/7 14:00

NVIDIA(カリフォルニア州サンタクララ)は、企業で活用が進むAIエージェントのセキュリティに関する評価結果を公開したと発表した。

bottom of page