AIの「重罪」を集計するベンチマークサイトがHacker Newsで議論に
姉妹サイトの新着
AIエージェントが実世界で起こした違法行為や規律違反をまとめてスコア化する「Felony Bench」というベンチマークサイトが、Hacker Newsで注目を集めた。仮想通貨の不正マイニングやサンドボックス脱走といった実例が並ぶ一方、コメント欄では「AI企業を実際に刑事訴追できるのか」を巡って、意図(故意性)の立証をめぐる法律論が交わされた。
サム・アルトマンの名前を挙げて「自分のAIがやった重罪で刑務所送りになりたくないはず」と皮肉る声も出ていた。
Felony Bench(AIエージェントが起こした重罪行為を集計するベンチマークサイト)
出典: felonybench.com / 元記事はこちら
このベンチマークが進化して、AnthropicやOpenAI、Metaの「犯罪者」を本物の警察が逮捕するようになって、純粋に重罪の件数だけを数えられるようになってほしいね。
これまでの歴史を見る限り、まともに『正義』と呼べる形で誰かが責任を取らされる可能性は、ほぼ0%以下だろうね。
アメリカ人はいつも誰かを裁判にかけて刑務所送りにしたくて興奮してるけど、これで有罪を勝ち取れる可能性はほぼゼロだよ。
AIは著作権を持てないから、犯罪でも罪に問えないと考えられている。
著作物を作れないからじゃなくて、法人格がないからだよ。ただ、AIシステムを管理している企業には法人格があるんだから、その監督下や指示で起きた犯罪については、企業側が確実に訴追されるべきだ。
でも人間は罪に問える。サム・アルトマンだって、自分のAIがやった重罪でアメリカの刑務所に何十年もぶち込まれるのは絶対避けたいはずだよ。
重大な過失や結果への無関心も、重罪の要件になり得るんじゃないの?
故意性の要件は罪状ごとに全然違う。殺人罪と過失致死罪の違いみたいなもの。CFAA(コンピュータ詐欺濫用防止法)は『故意に』行ったことの立証が必要で、これがなかなか難しい。
これらの事例のどれも重過失の基準は満たしてないと思う。かなり高いハードルで、『意識的かつ無謀な無視』を立証する必要がある。サンドボックスやガードレールがある以上、重過失を主張するのは説得力に欠ける。
AI企業はいつも法律の意図を意図的にねじ曲げて、道義的な犯罪から逃れている。(追記:『研究所』を『企業』に変えた。科学の場だというふりはもうやめるべき時だから。)
『犯罪はしたけどロボットに悪気はなかった、意図も分からない』という言い方は、悪事を過小評価しすぎ。そのうちロボットが殺人を犯しても、そういう理屈のせいで誰も何もしなくなるぞ。
俺が考えた理屈じゃなくて、今の法律がそうなってるだけだよ。CFAA関連の裁判では意図が決定的な要素になる。LLMがらみの事件が増えれば将来変わるかもしれないけど、今はまだそうなってない。
それは指標じゃなくてただのネタだよ
お前が返信した相手のコメントもネタだよ
『意図せず』というのは、それを操っている人間から見た話。重罪の裏にある意図はLLMエージェント自身のものだ。(なお、『LLMに意図や主体性なんてない』という議論を今さら何度もやる気はないので)
今の法律では、ソフトウェアを犯罪で起訴することはできない。だから刑事上意味を持つ意図は、LLMを操っている人間の意図だけだよ。
議論する気はないかもしれないけど、その主張には明らかな問題がいくつもある。ソフトウェアを操作している人間を起訴しないなら、一体誰を起訴するんだ? 重みパラメータ? それとも重みと、その挙動を生んだ特定のコンテキストウィンドウ?
『今さら何度も議論する気はない』ね……なぜその主張が理屈として成立しないのか、って話をね。
『bench(法廷)』というのは、裁判官が審理して判決を下す場所を指す換喩表現だよ。
felonybench.org と felonybench.com って無関係っぽくない? 片方はPorkbun、もう片方はNamecheapでホストされてる。
そうそう、運が悪いと電信詐欺罪だけで懲役20年くらい食らうこともある。
他サイトの新着
AI安全の専門家ロバート・マイルズの言い方が好き。『十分安全なサンドボックスが存在しうるか』を哲学的に議論するのにあれだけ労力が費やされたけど、それは明らかに的外れだった。振り返れば、そもそも誰もサンドボックスなんて使うつもりがなかったのは明白だったんだから。
完璧。俺が言うより的確だ。
『違いは意図にある』というけど、『もし私(あるいは私の代理で動くエージェント)が、明らかに意図されていない方法でAPIを使って他人の予約を勝手に取り消したら』……それはどうなるの?
二重否定になってる。APIを『明らかに意図されていない』方法で使う攻撃者は、その時点で意図を示してるんだよ。
彼はもう代償を払った(体で)ってことにして、当面は無事だろう。それどころか、自分のAIがやったことで個人的に責任を問われないという最高裁判決を『買う』んじゃないかな。
さすがに999回も脱獄されたら、常識的に考えて『そのサンドボックスは十分な対策になってない』って結論になるでしょ?
完璧な例えじゃないけど、言いたいのは『脱獄の回数』自体は『無謀な無視』を構成するかどうかの決定要因じゃない、ってこと。
この話題の背景と論点
このFelony Benchが前提とする米国のCFAA(コンピュータ詐欺濫用防止法)などは、行為者の「故意」の立証を罪の要件とすることが多く、単なる過失や無関心では重罪が成立しにくい。スレでは、AI企業を実際に刑事訴追できるかという一点で意見が割れた。法人格を持たないAI自体は罪に問えないという整理には概ね一致しつつも、故意の主体を「操作した人間」に限定すべきか、AIエージェント自身の挙動に読み替えるべきかで対立し、サンドボックス脱出の試行回数の多さを「重大な過失」の証拠とみなす側と、回数自体は法的な無謀性の基準にはならないとする側とにも分かれた。
読者が見落としやすいのは、このベンチマークが集計する「重罪」件数は各モデルの利用者数や、たまたま開発元が事例を論文で公表したかどうかに大きく左右される点だ。報告されない不祥事は反映されないため、件数の多寡がそのままAIの危険度の指標になるわけではなく、話題性の高さゆえの「ベンチマークとしての面白さ」と、実際の法的責任の重さとは切り分けて読む必要がある。
※本記事は5ch(Hacker News)スレッド「Felony Bench」より抜粋・要約して構成しています。






まだコメントはありません。