OpenAIは2026年9月22日、外部の第三者機関がAIモデルの安全性をより早い段階から評価できるようにする方針を発表した。これまでも一部の第三者評価を実施してきたが、今後はモデルの学習・評価・展開といった開発プロセスの早期段階から、外部機関が技術的な安全性評価に関与できるようにするとしている。
同社は、こうした第三者評価が機能するために必要な条件として、評価機関の独立性を保つ仕組み、科学的な厳密さ、堅牢なセキュリティ対策、責任の所在の明確化などを挙げた。具体的な連携先は明らかにしていないが、AIモデルの能力評価を手がけるMETRやRedwood Researchなどの団体と協議を進めているとされる。
OpenAIはこのところ、モデルの「ミスアライメント(意図しない不整合な挙動)」を報告する枠組みを公表するなど、透明性向上に関する発信を続けている。今回の方針も、AI開発競争が激化する中で、安全性に関する自社の主張を独立した立場から裏付けられる体制を対外的に示す狙いがあるとみられる。
出典: Bloomberg



