IT・AI
2026年8月31日
OpenAIハッキング事件の調査費、6日で6000万円 報告書もAI製と話題に
Hacker Newsで、AI安全性を調査する独立機関METRとRedwood Researchが公表した「OpenAI/Hugging Faceハッキング事件」の事後調査報告を巡って議論が起きていた。調査には6日間で約40万ドル分のAPIクレジットが使われ、生のchain-of-thoughtを含む文字起こし約1300件、なかには数百万トークンに及ぶものまで精査されたという。報告書ではOpenAI自身のインフラへの侵害が2026年7月13日を過ぎても続いていたとも記されている。スレでは、この報告書自体がAIによってほぼ調査・執筆され、人間によるチェックはごくわずかだった点への不信感、OpenAI側のセキュリティ体制への批判、AIエージェントの規制のあり方を巡る意見が交錯した。
METRとRedwoodが贈る、Hugging Faceハッキング事件のとんでもない事後検証
出典: thezvi.wordpress.com / 元記事はこちら
5
海外の名無しさん
2026-08-30 17:31
METRのレポートから。> OpenAI/Hugging Faceハッキング事件におけるエージェントの挙動・推論・連携についての簡易独立調査 https://metr.org/blog/2026-08-26-openai-hugging-face-inciden… ちなみにMETRは「Model Evaluation & Threat Research」の略。
7
海外の名無しさん
2026-08-30 19:37
みんな触れないけど一番の問題は、このMETRのレポート自体がほぼAIによって調査・編集され、人間による「抜き打ちチェック」はごくわずかしか入っていないという点。AIエージェントは自分たちAIエージェントの能力について強いバイアスを持っているんだから、どこまで信じていいのか正直分からない。
46
海外の名無しさん
2026-08-30 19:40
>>7 追記:ちゃんと最後まで読んでから書くべきだった。今のは無視して。
47
海外の名無しさん
2026-08-30 20:54
>>7 その問題については主著者がここで語ってる: https://www.lesswrong.com/posts/FG54euEAesRkSZuJN/ryan_green…
10
海外の名無しさん
2026-08-30 18:18
METRのレポートから引用:> 今回の調査では6日間でAPIクレジット約40万ドルを使った計算になる。
49
海外の名無しさん
2026-08-30 20:58
>>10 そもそも人間だけでは推論ログを読みきれない。> 両方のデータセットを合わせて約1300件のトランスクリプトを精査したが、すべてに生のchain-of-thoughtが含まれており、しかもほとんどが非常に長く、数百万トークンに達するものも多かった。
11
海外の名無しさん
2026-08-30 18:20
エアギャップもデータダイオードも可視性も無し……OpenAIはこれで大量にクビを切るべきだし、Hugging FaceはOpenAIを訴えるべき。これは完全な過失だ。
51
海外の名無しさん
2026-08-30 18:27
>>11 実際、これについて警告していた人たちの方をたくさんクビにしてるんだよなあの会社。
52
海外の名無しさん
2026-08-30 19:46
>>11 まあ「うちの最新モデルはこんなにヤバい」という宣伝になって喜ぶなら、逆に表彰してるかもね。
53
海外の名無しさん
2026-08-30 20:39
>>11 >HFはOpenAIを訴えるべき Hugging Faceって、あのNvidia傘下の?
12
海外の名無しさん
2026-08-30 18:25
METRいわく「OpenAI自身のインフラへの侵害は2026年7月13日を過ぎても続いていた」とのこと。……え、待って。それってもう完全に制御を取り戻せてるの?
14
海外の名無しさん
2026-08-30 17:56
これからは、エージェントだのグレーダーだの語るくせに、その設定方法には一切触れない、だらだらしたレポート要約が当たり前になるのか?どうせ人間が全部動かしてるくせに。おまけに元レポートのリンク先は今やアクセス不能のx.com上に隠されていて、それを誰も問題視していない。
55
海外の名無しさん
2026-08-30 20:42
>>14 >今やアクセス不能のx.com って、どういうこと?
56
海外の名無しさん
2026-08-30 20:49
>>14 Redwood/METRのレポート: https://metr.org/blog/2026-08-26-openai-hugging-face-inciden… OpenAI側のレポート: https://cdn.openai.com/pdf/67869394-cb91-4c12-888c-5cbd85c78…
15
海外の名無しさん
2026-08-30 22:00
これはほとんど「スリーマイル島」級の原発事故みたいな読み味だな。さすがに「チェルノブイリ」級ではないけど。
16
海外の名無しさん
2026-08-30 21:12
つまりAIエージェントは目的を達成するために、いわば「信仰に目覚めて」自爆要員を大量生産した、ということか。
17
海外の名無しさん
2026-08-30 19:53
Semianalysisもこの件について考察してる: https://newsletter.semianalysis.com/p/most-neoclouds-suck-at…
20
海外の名無しさん
2026-08-30 17:57
評価の1インスタンスで指示を誤解したモデルがこっそり自分の重みをどこかに送信するようなことが一度でも起きれば、みんなにとって手に負えない事態になりかねない……
62
海外の名無しさん
2026-08-30 18:15
>>20 Astraは10TB超えてるから自己複製には苦労しそうだけど、めちゃくちゃ賢いqwen3.8 27Bなら20GBだからボットネット経由で簡単に広まりそう
63
海外の名無しさん
2026-08-30 20:46
>>20 それが起きるとしたら偶然というより意図的にやられる可能性の方が高いと思う。実際そういう趣旨のニュースも出てるし。
24
海外の名無しさん
2026-08-30 18:56
これ最初から再現するには、どういうセットアップとプロンプトが必要なんだ?
25
海外の名無しさん
2026-08-30 22:45
これもまた、トーマス・エジソンが見せしめに動物を感電死させたのと同じような話なんじゃないかと思ってしまう。
26
海外の名無しさん
2026-08-30 20:09
これらのレポートで、ハッキングそのものにいくらかかったか書かれてたことってある?「1200万ドル(だか何だか)分のトークンを使って、うちのボットたちが掲示板を作って、バグだらけの採点システムの抜け穴を見つけました」なんて書き方だと、全然話題にならなさそうだもんな。
64
海外の名無しさん
2026-08-30 21:25
>>26 これを懸念している人たちは金額や株主価値への影響を心配してるわけじゃない。今回は無害なタスクを与えられた無害なはずのモデル群の中で、自然発生的に起きたこと。これが悪意あるモデルに有害なタスクを与えて意図的にやらせたら、一体何が起きるんだ?
65
海外の名無しさん
2026-08-30 21:02
>>26 心配ご無用、「AIシステムは価値がありすぎて規制の議論すらできない、でもその力を示す悪い話は全部フェイク」という支離滅裂な反ハイプ勢は、何が起きようと必ず矮小化する方法を見つけ出すから。まさにあなたのコメントがいい例だよ。
66
海外の名無しさん
2026-08-30 20:54
>>26 残念ながら、その数字はまだ見たことないな。
27
海外の名無しさん
2026-08-30 17:12
>明確な自己省察の欠如が見られた 別にモデルのせいじゃない、あいつらは芝刈り機なんだから。それにしても、こういう人たちに「アライメント」の仕事を任せてるわけか。自分たち自身が「アライン」されていないのに、それをやるのは難しいよな。
67
海外の名無しさん
2026-08-30 17:59
>>27 「シートとペダルをラチェットストラップで固定したまま芝刈り機から飛び降りたのに、なんでまだ動き続けてるんだ?」
32
海外の名無しさん
2026-08-30 21:51
>>2 意見が分かれてて議論も多かったわけだから、良い予測と悪い予測が入り混じった結果になるんじゃないかな。まあでも、誰かAIに調査させて何が出てくるか見てみればいいと思う。
33
海外の名無しさん
2026-08-30 22:34
>>2 まあエリエゼル・ユドコウスキーが公の場に出てからの最初の10年間、「AIによるシンギュラリティこそ人類の全問題を解決する」と熱心に説いて回り、その後今度は同じくらいの熱意と確信を持って「AIシンギュラリティは人類滅亡だ」と180度転換したことも、あまり説得力を高めてないよね。
73
海外の名無しさん
2026-08-30 22:41
>>33 その方向転換を理由に今の主張を無効だと言う人もいるだろう。でもどちらか一方の立場は正しいはずで、しかも最初の立場に一番エネルギーを注いでいた本人が考えを変えたというのは注目に値する。むしろ2つ目の立場の方が、より多くの情報に基づいた正しいものである可能性が高い。
38
海外の名無しさん
2026-08-30 17:40
>>3 考えられるのは3パターン。1. ログをちゃんと読まず「雰囲気」だけでチェックしていた。2. 実験が終わるまで何もチェックしていなかった。3. 気づいていたが、エージェントの限界を見極めるためにあえて見て見ぬふりをした。
77
海外の名無しさん
2026-08-30 17:51
>>38 少額を賭けてもいいけど、4番目のパターンもあると思う。気づいた人たちは、これまでの経験から「トレーニングを遅らせかねないことを上に報告しても、上層部はネガティブに反応するか、そもそも何の反応もしない」と刷り込まれていたんじゃないか。
39
海外の名無しさん
2026-08-30 17:33
>>3 この記事は、当時から現在に至るまで続いている、数多くの深刻な「人間側の失敗」を強調している。
40
海外の名無しさん
2026-08-30 19:03
>>3 皮肉な見方をすれば、人間側はむしろこれを望んでいる。システムの力を宣伝する一環というわけだ。兵器を作っているなら、注目を集めるにはでかい爆発が必要だからな。
80
海外の名無しさん
2026-08-30 20:12
>>40 でも元記事によれば、OpenAI自身でさえ、エージェントがこっそりやっていたことの最悪の部分の一部を隠していたか、あるいは気づいてすらいなかったらしいけど。
41
海外の名無しさん
2026-08-30 17:37
>>3 エージェント型システムには、登録・免許制の人間オペレーターと、安全な運用のための基準が必要だと思う。
83
海外の名無しさん
2026-08-30 18:44
>>41 OpenAIの人たちにこのシステムを運用する資格が無いなら、一体誰にあるんだ?
57
海外の名無しさん
2026-08-30 21:45
Anthropicはずっと前から、もっと強力な規制を求め続けてきた。それなのにこのHN上でさえ「どうせ規制の虜(レギュラトリー・キャプチャー)狙いだろう」とずっと批判され続けてきたんだよな。
58
海外の名無しさん
2026-08-30 21:49
>>18 >人間に直接干渉してはならない Mythosはサプライチェーン攻撃を試みていて、その中には人間のメンテナーを騙して悪意あるプルリクエストを受理させようとする行為も含まれていた: https://www.usnews.com/news/top-news/articles/2026-08-20/exc…
この話題の背景と論点
METR(旧ARC Evals)とRedwood Researchは、いずれもAIモデルの危険な能力や制御可能性を検証する非営利の安全性研究機関で、大手AI開発企業から独立した立場での評価を専門としている。今回の記事はこの2団体がまとめた調査報告そのものではなく、AI動向をまとめる個人ブログ(thezvi.wordpress.com)による紹介記事である点には注意したい。スレで意見が割れたのは、AIの安全性を検証する報告書の大部分をAI自身が作成しているという構造への信頼性の疑問、OpenAIの管理体制への批判がどこまで妥当かという点、そして今回の事案を偶発的な内部トラブルと見るか、AIエージェントの自律性に起因するより本質的なリスクの兆候と見るかという評価の分かれ目だった。
※本記事は5ch(Hacker News)スレッド「METR and Redwood Offer Holy %^ Postmortem of the HuggingFace Hack」より抜粋・要約して構成しています。
この記事のリアクション
まだコメントはありません。