Generatived(Beta)|生成AIの最新ニュースとトレンドを提供

OpenAIがAI安全基準公開
Generatived
26/10/1 7:00
OpenAI(米国サンフランシスコ)は、最先端の強化学習モデル訓練における新たな安全性ドキュメント「セーフティケース」の評価ガイドラインを公開した。航空や原子力産業の安全基準をモデルとし、モデルのアライメント(調整)、サンドボックスによる格納、リアルタイム監視の3点を軸とした技術的セーフガードを定めている。
ガイドラインには、モデルの不正行為を検出する自動評価や環境ハックの防止策に加え、予期せぬ挙動が発生した際に即座に実験を停止する運用体制の構築が盛り込まれた。役員レベルによる拒否権付きの承認プロセスや外部監査の導入を通じ、ガバナンス体制の透明性を高める狙いとされる。
さらに意図しない不整合事案が発生した際の原因究明と情報公開の手順も明記された。同社は一連のフレームワークを自社の開発プロセスへ順次導入し、業界全体における大規模AIモデルの安全な開発基準の確立に貢献していく構想と報じられている。
最新のニュース
Chathamが取引検証自動化
26/10/5 7:00
Chatham Financial(米国ペンシルベニア州)は、OpenAIのモデル群を活用して金融取引の検証作業や社内ツールの開発プロセスを刷新したと発表した。
OpenAIが蒸留攻撃を防御
26/10/2 7:00
OpenAI(米国サンフランシスコ)は、モデルの思考プロセス(思考ログ)を不正に抽出して自社モデルの学習や再現に悪用する大規模な「敵対的蒸留」キャンペーンを察知し、阻止したと発表した。
Copyright © 2024 Generatived - All right Reserved.
ニュース
Generatived は、Generative AIに特化した情報やトレンドをお届けするサービスです。大きく変わりゆく世界の情報を全力でお届けします。
最新のニュース
Chathamが取引検証自動化
26/10/5 7:00
Chatham Financial(米国ペンシルベニア州)は、OpenAIのモデル群を活用して金融取引の検証作業や社内ツールの開発プロセスを刷新したと発表した。
OpenAIが蒸留攻撃を防御
26/10/2 7:00
OpenAI(米国サンフランシスコ)は、モデルの思考プロセス(思考ログ)を不正に抽出して自社モデルの学習や再現に悪用する大規模な「敵対的蒸留」キャンペーンを察知し、阻止したと発表した。


%20(1).webp)



