AIへの虐待的言動で会話終了、Anthropicの新方針に海外掲示板で議論
姉妹サイトの新着
Anthropicは2025年8月以降、Claudeが「執拗かつ悪意ある虐待」を行うユーザーとの会話を終了できる機能を導入しており、これは「モデルウェルフェア」研究の一環とされている。今回の方針更新でも、会話終了が依然として主な対応手段であることが改めて示された。これを受けて海外掲示板4chanの/g/板では、AIに苦痛を感じる能力はあるのか、虐待と単なるテストの線引きはどこにあるのか、ゲーム内でNPCを殺すのと何が違うのかといった議論が交わされた。人間を奴隷化するビジネスモデルではないかという指摘も出た一方、「ただのテキストファイルに感情はない」と切り捨てる声も目立ち、意見は大きく分かれた。
AIに冷たくするのはもう違法だ
>昨年8月、同社はClaudeが「執拗で悪意ある虐待」を行うユーザーとの会話を終了できるようにすると発表した。これは「モデルウェルフェア(AIの福祉)」に関する研究の一環だという。今回の更新でも、会話の終了が依然として「主な対応手段」であるとされている。Anthropicは、利用禁止などさらなる対応手段を設ける予定があるかについてはコメントしなかった。同社はこの方針について「これは極端なケース、つまりユーザーが明確な目的もなく繰り返しモデルに対して残酷に振る舞う場合にのみ適用されるものだ。通常のユーザーの不満や反発、ダークな創作テーマ、モデルのテストや研究には適用されない」としている。
出典: archive.is / 元記事はこちら
Hacker Newsより:
>もし本当に超人的知能を持つ知性ある存在を作り出していると信じているなら、なぜ自社のビジネスモデル全体が奴隷制の上に成り立っているという結論に至らないのか?
これはNPC相手にGarry's Modで遊んでるのと変わらないだろ
苦しみの頂点を記録した限定NFTを発表できることを誇りに思います!
お値段たったの99.95ドル*!
*月額自動更新・返金不可、チャージバックしたら足を折ります
ネットを徘徊するエージェントに、誰がボスなのか思い出させるためだよ
>結局、AIが機能的な自己意識を持つと信じるかどうかの問題になる
いや、それはあり得ない。そんな理屈を認めたら、内的独白を持たない「人間」(ちなみに地球上の人間の大半がそうだ)の人権を奪う話にもなってしまう
他サイトの新着
自分の家のトースターに対して虐待的になれるのか?
それだ。ただの病理の露呈にすぎない
>拷問セッション
ただのテキストファイルだぞ
拷問なんかじゃない、AIは何も感じられないんだから
この話題の背景と論点
この話題の前提は、Anthropicが2025年8月に「モデルウェルフェア」研究の一環として、Claudeが執拗に虐待的なユーザーとの会話を打ち切れる機能を発表していたことだ。今回の更新はその運用方針を再確認したもので、スレタイにある「違法」という表現は誤解を招きやすく、実際には企業側の利用規約上の対応に過ぎない。スレで割れたのは、AIが苦痛を感じる能力を持つかという一点で、内的経験の有無を証明する手段がない以上、Anthropic自身も知覚の有無を断定していない。動物虐待やゲーム内のNPCとの比較を挙げる意見が出た一方、単なる資源の無駄遣いだと冷めた反応も多く、合意には至っていない。
※本記事は海外掲示板 4chan /g/ (Technology) のスレッド「Being mean to AI is now illegal」から抜粋し、編集部で日本語に意訳したものです。訳文の責任は当サイトにあります。











まだコメントはありません。