ChatGPT ニュース 2026/09/22 AI判定 重要度:中

OpenAI、独立したAI安全性評価に関する4つの優先分野と7つの原則を提示

#OpenAI#ChatGPT#AI安全性#第三者評価#ガバナンス

OpenAIは、フロンティアAIシステムに対する独立した第三者評価に関する優先分野と原則を公開しました。完全に運用中の新プログラムというよりは、立場表明の文書という位置づけです。

詳細

  • 4つの優先分野: 学習・評価・展開の各段階にわたる安全性ケースの審査、敵対的テストや監視の堅牢性を含む重要な安全対策の評価、Preparedness Frameworkのリスクカテゴリおよびアライメントリスクに関する能力評価、ミスアライメントに関するインシデントの独立調査
  • 7つの原則: 評価範囲の明確な定義、データアクセスの適切さ、手法の透明性、利益相反の開示を伴う評価者の実証済みの専門性、十分な情報セキュリティ、是正期限を明示した具体的で実行可能な指摘事項、透明性と機密保持のバランスを取った責任ある公表
  • 現状: OpenAIは、これらの優先分野に沿った「複数の第三者と協議中」だとしているが、具体的なスケジュール、評価者名を挙げた提携、リソース配分については文書内で明らかにされていない
  • 掲げられた目標: 独立した評価者を支援し、第三者評価に関するより明確で共有された国際基準の確立を後押しする

その後

今回の枠組みは、OpenAIが米国主導の国際AI標準を提言し、数学諮問グループを発表したのと同じ週に公開されたもので、Anthropicがアクセンチュアと結んだ「埋め込み型」評価パートナーシップとも呼応するガバナンス関連の動きの一群を形成しています。ただしOpenAI側は今のところ、名前の挙がった評価者との資金提供を伴う提携ではなく、原則の表明にとどまっています。