Generatived(Beta)|生成AIの最新ニュースとトレンドを提供
.webp)
AnthropicがAIシステム向けの責任あるスケーリングポリシーを発表
Generatived
23/9/20 10:46
Anthropicは、新たなResponsible Scaling Policy (RSP)を発表し、ますます高度化するAIシステムの開発に伴うリスクの管理を目的とした一連の技術的および組織的プロトコルの概要を示した。このRSPは、潜在的な壊滅的なリスクに対処するために設計されたAI安全レベル(ASL)として知られるフレームワークを導入している。このシステムは、危険な生物材料の取り扱いに関する米国政府のバイオセーフティレベル基準に大まかに基づいており、モデルの壊滅的なリスクの可能性に合わせた安全性、セキュリティー、運用基準が必要だ。ASLシステムはいくつかのレベルに分かれている。ASL-1は、2018 LLMやチェス専用に設計されたAIシステムなど、重大な壊滅的なリスクを引き起こさないAIシステムを指す。ASL-2は、生物兵器の作成に関する指示を提供する機能など、危険な機能の初期の兆候を示すシステムに関係するが、信頼性が不十分であるか固有の情報が不足しているため、その情報はまだ役に立ちません。ASL-3は、検索エンジンや教科書などの非AIベースラインと比較して壊滅的な悪用のリスクを大幅に高めるシステム、または低レベルの自律機能を示すシステムに割り当てられる。ASL-4以降のレベルは、現在のシステムからかけ離れているため、まだ定義されていない。しかし、それらは壊滅的な悪用の可能性と自主性の大幅なエスカレーションを伴うことが予想される。ASL-4の対策はまだ確立されていないが、ASL-3に到達する前に開発することが約束されている。これらには、モデルが特定の壊滅的な挙動を起こす可能性が低いことを証明するための解釈可能性手法の使用など、現在未解決の研究問題に対する解決策が必要になる場合がある。

