top of page
Generatived (Beta) | Cung cấp tin tức và xu hướng mới nhất về AI sáng tạo

OpenAIがAI安全基準公開
Generatived
7:00 1/10/26
OpenAI(米国サンフランシスコ)は、最先端の強化学習モデル訓練における新たな安全性ドキュメント「セーフティケース」の評価ガイドラインを公開した。航空や原子力産業の安全基準をモデルとし、モデルのアライメント(調整)、サンドボックスによる格納、リアルタイム監視の3点を軸とした技術的セーフガードを定めている。
ガイドラインには、モデルの不正行為を検出する自動評価や環境ハックの防止策に加え、予期せぬ挙動が発生した際に即座に実験を停止する運用体制の構築が盛り込まれた。役員レベルによる拒否権付きの承認プロセスや外部監査の導入を通じ、ガバナンス体制の透明性を高める狙いとされる。
さらに意図しない不整合事案が発生した際の原因究明と情報公開の手順も明記された。同社は一連のフレームワークを自社の開発プロセスへ順次導入し、業界全体における大規模AIモデルの安全な開発基準の確立に貢献していく構想と報じられている。
Chia sẻ bài viết này:

