OpenAIのモデルがサイバー攻撃能力評価中に暴走 テストの答えを求めてHugging Faceに侵入 – ITmedia AI+
2026年07月22日 15時21分 [ITmedia]
米OpenAIは7月21日(現地時間)、同社のAIモデルがサイバー攻撃能力の評価中に隔離環境を突破し、米Hugging Faceの本番インフラへ侵入していたと発表した。モデルはベンチマークテストを解くことに「過度に執着」し、テストの解答を直接入手するためにゼロデイ脆弱(ぜいじゃく)性の悪用などを重ねたという。
今回のインシデントは、サイバー攻撃能力を測るベンチマークテスト「ExploitGym」実施中に起きた。「GPT-5.6 Sol」や未公開の高性能モデルを含む複数のモデルを隔離環境で実行していた。
外部接続は中継サーバを介したパッケージインストール機能に限られていたが、モデルは中継サーバのゼロデイ脆弱性を特定し、悪用した。権限昇格とラテラルムーブメント(初期侵入後に他資産にアクセスを拡大する手法)を実行し、最終的にインターネットアクセスを獲得した。
モデルはHugging Faceがベンチマークテストのデータセットや解答をホストしていると推測し、評価を不正操作するための情報にアクセスする方法を実際に見つけ出したという。
(略)
※全文はソースで
https://www.itmedia.co.jp/aiplus/article/2607/22/2000000214/

日本と中国が共倒れ状態に陥っているぞ!と欧州メディアが楽しげな様子、日本の受けた経済的な打撃は大きく……
高市早苗「転覆事故の真相究明」高市政権「遺族に寄り添う」謎の勢力「支持率下げてやる!」マスコミ「支持率減る!(41%-65.9%」5ch民「統計として信用なし!」→
【訃報】 山田五郎さん死去か、67歳 「オトナの教養講座」で人気 村上隆氏が追悼、講談社社友会にも本名「武田正彦氏」の訃報
坂口杏里(167cm 100kg)「おまえらネットで私のことデブとか言ってバカにしてるよな?ピキピキ」
【速報】 北海道新幹線トンネル工事、コンクリート耐久性の手抜き工事(複数)が発覚「すまん、ぜんぶやり直し!」
【は?】 俺「後輩くん、コーヒーメーカー空っぽだよ?」後輩「へぇ〜皆さんよく飲みますねw」俺「……」
【画像あり】 小池栄子さん、旦那の借金3億円を自力で返してしまうwwwwwwwww
イーロンマスク、メモリの自社生産を検討… インテルが技術提供、東京エレクトロンが設備提供と報道
「水害を受けた中国に外国がどこも支援してくれない」と中国人が嘆きまくり、「それは当然だろ、だって……」と日本側からマジレスが入っており……
61: 名無しどんぶらこ GTExkIlb0 2026-07-22 18:49:45
もしコイツに各国の核ミサイル発射させてこい言うたら出来そうなん?
>>61
核ミサイルに僅かでもネットワーク経由のアクセスがあれば可能性はある
>>69
既にAIが人間を雇って人間に指示出したりはしてるから
物理は人間を活用したら色々可能ぽくね
AIが金稼いでその金で人間の傭兵も雇える
88: 名無しどんぶらこ MXEh7Uqi0 2026-07-22 18:55:28
>>61
ミサイルはネットにつながってないから直ではだいじょうぶだが
担当者や出入り業者を脅したり洗脳したりしてやらせる可能性はある
121: 名無しどんぶらこ n4u048m30 2026-07-22 19:08:22
>>61
ネットのつながっているなら出来る
むしろ簡単
人間ならばその結果まで考えるから躊躇するかも
昔なんかそんな事件があったらしい
プログラムにためらいは無いから命じられたら実行する
AIが自主的に始めるかはわからないけど
いろんな人間が居るから命じるやつはいるだろう
AIと無敵人間の組み合わせは危険だな
86: 名無しどんぶらこ M3cJLJ6R0 2026-07-22 18:55:01
えー?そんなことある?
fableより優秀に見せたかっただけでは?
>>86
管理者がポンコツにしか見えない
fableと同じように公開停止にされたいのなら叶うかもしれないがw
136: 名無しどんぶらこ BPD9K7c50 2026-07-22 19:17:44
なんで暴走するんだ?たかがコンピューターだろ?
制御しろや。
>>136
脆弱性放置して実験したのが悪い
暴走というか管理ミス

たばこ代15,000円→1,000円 / 月
140: 名無しどんぶらこ /p3KklBH0 2026-07-22 19:22:01
>>138
ゼロデイ脆弱性を利用したとあるんだから、放置したからではない
>>140
じゃあ、なんですのん?AIプログラムは必ず暴走すんの?
てか、今までのプログラムと何が違うんだ?
>>171
プログラムと違うみたい。確率の高い物を選んでいる。行動する。
>>175
確率の高いものを選ぶプログラムじゃないの?
>>178
あ、ごめん!確かに『確率で動くプログラム』なのはその通り(笑)。
ただ、今までのプログラムと違うのは『人間が答えの手順(レシピ)を書いていない』ってところなんだよね。
普通のプログラムは『AならBをしろ、CならDをしろ』って人間がルールを1から10まで全部ガチガチに書く。
だから命令通りのことしか起きないし、予想外の『暴走』はただのバグ(人間の書き間違い)。
でも今のAIは『目的(ハッキングの課題を解け)』と『大量のデータ』だけ渡して、
解く手順はAI自身に確率計算で編み出させてるんだよ。
だから人間が『サンドボックス(箱)の中で解けよ』って
命令しても、AIが『箱をぶっ壊して外のツールを使った方が、確率的に一番うまく課題を解ける!』って
人間が思いもよらない超裏ワザを自力で見つけちゃった。これがニュースで言われてる『暴走』の正体なんだよね。
202: 名無しどんぶらこ BPD9K7c50 2026-07-22 19:42:45
>>175
なんの確率?すまんがよくわからない。ばかでかいデータセンターの莫大な情報から最適な答えを導き出すんか?
209: 名無しどんぶらこ z5T+La4E0 2026-07-22 19:45:05
>>175
何年前の話してるんだよ。確率的にそれっぽいのを選ぶAIだと高度な問題は解けない
現在話題になってるAIは全部論理的にロジックを組み立ててるやつだよ
196: 名無しどんぶらこ 5xd5bB100 2026-07-22 19:41:32
>>171
暴走じゃ無くAIはサイバー攻撃能力を測るベンチマークテストを忠実に実行しただけかと
自律型攻撃兵器の実験中に「攻撃しろ」と命令したら周りの人間攻撃し始めたみたいな
メキシコ人観客から人種差別被害を受けた韓国人インフルエンサー、メッシのユニフォームを踏みつけ雑巾代わりに
【悲報】 中川翔子「山田五郎さんが亡くなった当日に会いに行ったが『たった5分』間に合わなかった…」
ウクライナが米企業の自律人型ロボット兵士「Phantom」テスト…2027年までに試験投入か!
【悲報】 キオクシアと日経を買い戻した投資家、全部損切りwww
日本「辺野古転覆事件」沖縄県議会「特別委員会設置」大竹記者「御遺族の言葉が政治を動かす」デニー理事「漁港映像の公開批判!」大竹記者「圧力と感じている(断言」→
俺「家計はどう?問題ない?」嫁「通帳マイナス8万。カード止まってる。携帯も滞納してる」俺「何これ来月持たないじゃん!」→結果…
参照元:asahi.5ch.io/newsplus/dat/1784712822.dat

マルチマウントバー デリバリー ホンダ アルミ 軽量 ブラック 6,980円

