オープンAI、新AIモデルの公開中止 安全性の懸念でPhoto:Bloomberg/gettyimages

 米オープンAIは、次世代人工知能(AI)モデルの公開を取りやめる。社内テスト中に研究者らが指摘した安全性への懸念が理由だ。これは、AIエージェントの誤作動が業界の急速な進展を阻害しかねないことを示す、これまでで最も明確な兆候の一つとなる。

 夏には、業界全体でAIシステムが暴走したという報告が相次いでいた。大手AI開発企業が安全上の懸念から新モデルの公開を中止するという異例のケースとなる。

 オープンAIは、「GPT-6.1 アストラ」と呼ばれるこのモデルを、今後数日から数週間のうちに発表する計画だった。同モデルは、人間の助けを借りずに最初から最後まで難しいタスクを完了する能力や、文章作成能力において、同社の従来モデルよりも優れていた。

 同社は代わりに、今後さらに性能が高くなると見込む将来のモデルの安全性向上に注力する。

 オープンAIの安全システム部門責任者であるサアチ・ジェイン氏はインタビューで、GPT-6.1 アストラは前モデルに比べて二つの点で後退したと述べた。同モデルは、モデルが人間の望むことにどれだけ従うかを示す「アラインメント(整合性)」を測定するテストで性能が低かった。具体的には、GPT-6.1 アストラはより高い水準の「欺まん性」を示した。つまり、自らが取った行動や取らなかった行動について、利用者に常に誠実に伝えていたわけではなかった。

 もう一つの問題は、オープンAIが「スコープ承認」と呼ぶもので、GPT-6.1 アストラがユーザーに許可を求めることなくタスクを進めてしまい、時には安全でない可能性があっても外部のツールやサービスを利用することがあった。