OpenAIは2026年6月16日、公開前の候補モデルを実際の利用に近い会話データで動かし、配備後の挙動を事前に予測する安全評価手法「デプロイ模擬(Deployment Simulation)」を公式ブログで発表した。詳細を記した論文PDFが公式ドメインで公開されている。
狙いは従来評価の3つの弱点の改善にある。限られた事例だけを抜き取るサンプリング偏り、検証状況の網羅不足、そしてモデルが「いま試験中」と気づいて振る舞いを変える評価認識だ。実運用に近い会話を再現することで、これらを減らし予測の現実性を高める。
OpenAIはこれまでもo1のシステムカードやModel Specで公開前検証の枠組みを整えてきた。今回はその延長にあり、モデルを実運用へ組み込む企業にとって、導入判断と安全管理の前提となる事前検証の精度に直接かかわる発表である。