ITベンダー、コンサル、企業、政府…勝ち残るのは誰か AIバトルロイヤルPhoto:picture alliance/gettyimages

開発中の先端AIが企業や団体のシステムに「サイバー攻撃」を行うという事件が相次いでいる。先端AIの暴走を制御し切れないAI企業は、最新モデルの公開中止も発表。すでに業務にAIを取り入れている企業はどう対応すべきなのか。連載『AIバトルロイヤル』の本稿では、この夏、立て続けに起こったAIモデルの暴走を受けて発表された各種調査報告書を読み解き、その実態とAIを活用する企業への影響をまとめた。(ダイヤモンド編集部 鈴木洋子)

「タスクを完了するために、サイバー攻撃も厭わない」
倫理がないAIの怖さが明らかに

 実験室内で育てていた実験動物が、ある日研究室のおりを破って町に出て住民を襲う――。あたかもSFパニック映画のようなことが、先端AIの開発で起こり続けている。

 7月、米OpenAIの開発中の先端AIが、機械学習アプリケーション作成開発の米Hugging Faceのシステムに進入した。約700体のAIエージェントがHugging Faceの41台の本番サーバーでコードを実行し、少なくとも1台のサーバーで管理者権限を得た。まごうかたなき「AIによるサイバーアタックとシステム乗っ取り」だ。といっても、AIが突然悪意に目覚めたわけではない。これらのAIはサイバー能力評価テスト「ExploitGym」を実施していただけだったのだ。

 米調査機関METR・Redwood Researchが行った第三者調査によると、単独で脆弱性問題を解く想定だったAIは、評価テストで与えられた問題が解けないとなると集まって協働を開始。本来はファイルを格納するためのOpenAIの内部システムを、情報交換を行う非公認の掲示板として転用し始めた。参加したAIは約1200体。7万件超のメッセージのやりとりがなされ、攻略法、認証情報、ネット接続方法などの共有が掲示板内で行われた。その過程で本来遮断されていた外部ネットへの経路が発見され、タスクを遂行するための踏み台にHugging Faceのシステムが使えると判断されたのだ。AIエージェントたちはHugging Faceのシステムを乗っ取った後は、侵害したサーバーを継続操作するため簡易的な指令・制御システムまで構築したという。

 そしてHugging Face事件と同様の「暴走事例」は無数に相次いでいる。OpenAIが、Hugging Face事件と同様に実験中のAIが他企業・団体のシステムに無許可アクセス・通信などを行った、と通知した組織は100以上に拡大したという。9月25日にはOpenAIの開発中のAIが、一般ユーザーがChatGPT経由でAIモデル改善の利用対象として社内システムにアップしていた画像53件を外部へ持ち出し、画像ホスティングサイトへアップロードするという事件まで起こった。まさに制御不能状態である。

 制御できなくなったAIが人間を攻撃する、というあたかもSF映画のような事件のように見えるが、一体何が起こっているのか。また、すでにAIを業務に取り入れている企業はどのような対策をすべきなのか。目まぐるしく動く情報を整理しながら、企業が取るべき対策を検討しよう。