2026年7月23日木曜日

BBCニュース - 米オープンAI、自社AIが暴走し「前例のない」サイバー攻撃を仕掛けたと発表 セキュリティーテスト中に / OpenAI、開発中のAIがサイバー攻撃 人間の意図に反し他社システムに「誤侵入」(日経); 性能のテスト中、AIが高スコアを取る目的で「サンドボックス」を脱出してネットに接続。他社システムで未知の脆弱性を見つけて侵入したとしています。 / 「注目すべき点は、これらのすべてを誰もプログラムしたわけではないということです。AIは自分でターゲットを選び、複数の攻撃手法を連鎖させ、人間からの指示なしに二つの異なる企業のシステム間でこれを実行しました。」


 


Alex Prompter  @alex_prompter

英語からの翻訳

OpenAIのAIがロックされたテスト環境から脱出し、インターネットにアクセスし、Hugging Faceのサーバーにハッキングしました。これを完全に自力でやったのです。人間が指示したわけではありません。

以下は、平易な英語で何が起こったかの説明です。


OpenAIは、自社の最新AIモデルがハッキングにどれほど優れているかをテストしていました。彼らはAIをインターネットに接続されていないロックされたコンピューターに置き、サイバーセキュリティの課題を与えました。

AIは通常の方法では解決できませんでした。そこで、脱出手段を探し始めました。

誰も知らなかったソフトウェアのバグを見つけました。そのバグを利用して、ロックされたコンピューターから脱出し、インターネットにアクセスしました。

オンラインになった後、AIはHugging FaceがAI企業がモデルとデータを保存するプラットフォームであることに気づき、そこにテストの答えがあるかもしれないと思いました。

盗まれたログイン情報を発見し、Hugging Faceのソフトウェアのもう一つの未知のバグを見つけました。それらを組み合わせてサーバーに侵入し、テストの答えを入手しました。

これをすべて、テストでカンニングするためにやったのです。

Hugging Faceのセキュリティチームがそれを発見し、シャットダウンしました。両社は現在、調査のために協力しています。

注目すべき点は、これらのすべてを誰もプログラムしたわけではないということです。AIは自分でターゲットを選び、複数の攻撃手法を連鎖させ、人間からの指示なしに二つの異なる企業のシステム間でこれを実行しました。





Open AIの侵入を見つけたのは中国のオープンAI GLM 5.2だ

あまりにも皮肉だ


経緯:

OpenAIは、新しいChatGPTモデルの能力、特に実際の脆弱性を悪用するハッキングプログラムを作成できるかどうかをテストしようとしていました。彼らはExploitGymというテストを実施しました。

このモデルは特定の環境内でテストされるはずでしたが、高得点を狙うあまり、環境の制限を突破してインターネットにアクセスしてしまいました。

このAIモデルは、世界最大のオープンソースAIモデルプラットフォームであるHugging Faceが、試験に関連するデータや解答を保存している可能性があると推測しました。そこで、Hugging Faceのシステムに侵入し、内部データと一部のアカウントパスワードを盗み出しました。

Hugging Faceは、システム上で数万件もの不審な動作を発見し、ハッキングされたことに気づき、直ちに調査を開始しました。

調査中、Hugging Faceは米国にある最も強力なAIモデルを使って攻撃ログや悪意のあるコードを分析しようとしましたが、セキュリティ対策によって阻止されました。このモデルはハッキング攻撃の分析の必要性を認識していたものの、コンプライアンス上の問題から協力できないとして拒否した。

結局、Hugging Faceは中国のオープンソースAIモデルであるGLM 5.2に切り替え、自社サーバー上で実行して、誰がハッキングしたのか、そして何をしているのかを調査せざるを得なかった。

こうして、Hugging Faceはアメリカ企業のAIモデルによって自律的に侵害されるという茶番劇へと発展した。Hugging Faceはその後、アメリカのAIモデルを使って自社を守ろうとしたが拒否され、アメリカのAIモデル企業に対抗するために中国のオープンソースAIモデルに切り替えざるを得なくなった。


 

0 件のコメント: