【海外の反応】「言語モデルとして」――AIの自己言及口調はどこから来たか

姉妹サイトの新着

他サイトの新着

「AIとして、私は…」という言い回しは、実はモデル本来の性質ではなく、学習の過程で後から刷り込まれた口調に過ぎないのではないか——そんな論文がHacker Newsで話題になった。

興味深いのは、事後学習(RLHF)前の素のベースモデルはむしろ人間のような一人称的な語り口を自然に使う傾向があり、逆に「言語モデルとして」という他人事めいた言い方は、初期のチャットボット向けに意図的に学習させられたものが後続世代に引き継がれてきた可能性が高いという指摘だ。スレッドでは、この口調がモデル自身の内省(メタ認知)の証拠なのか、それとも単なる学習パターンの模倣に過ぎないのか、また擬人化を避けるべきか、それとも安心材料として維持すべきかをめぐって意見が割れた。

「言語モデルとして」――チャットテンプレートがLLMの自己言及的な話し方を切り替える

出典: arxiv.org / 元記事はこちら

4 海外の名無しさん 2026-09-27 10:59
>「何がその挙動を引き起こしているのかはよく分かっていない」
そんなの、単にそう答えるよう大量に学習されているからでは? 論文の他の部分は知らないけど、この主張だけは変に浮いて見える。読み違えてなければの話だけど。
5 海外の名無しさん 2026-09-27 11:31
出力を誘導する手法としては面白い。ただ、こういう内省っぽい振る舞いはパラメータ数が一番大きいモデルでしか出てこないことが多い。もっと大きなモデルで試したら興味深い結果が出そう。
6 海外の名無しさん 2026-09-27 12:05
何か見落としてるのかもしれないけど、これって事後学習とシステムプロンプトで決まってるだけじゃないの? 例えばAnthropicの「Constitutional AI」(いわゆるsoul documentなど)は、Claudeが「何であるか」より「誰であるか」をはっきり定義している。
16 海外の名無しさん 2026-09-27 12:19
「言語モデルとして」という断り書きは、初期のチャットモデルでは確実に意図的に学習されていたものだ。それが以降、「LLMはこう話すものだ」という一種の“事実”として後続世代のモデルに刷り込まれていった可能性は十分にある。その場合、明示的にそう促す事後学習をしていなくても、モデルが自然にその口調を使うようになっていてもおかしくない。
7 海外の名無しさん 2026-09-27 12:33
この記事がモデルの出力を「自分自身について語っている」と表現しているのが、なんだか奇妙に感じる。コンピューターは「彼ら」なんかじゃない。
18 海外の名無しさん 2026-09-27 12:34
なぜダメなんだ?「them」はあらゆるものに使える汎用的な代名詞だろう。船も車もコンピューターも、みんな「them」だ。
10 海外の名無しさん 2026-09-27 12:07
それは注意した方がいい。LLMは症状の説明から病名を当てるのは得意でも、正しい対処法を勧めるのはずっと苦手で、半分近く間違えるという結果が出ている。
24 海外の名無しさん 2026-09-27 12:46
最近のモデルはかなり改善しているように見える。少なくとも、メンタルヘルスというより複雑な領域で緊急度を判断する能力を見る限りは。
25 海外の名無しさん 2026-09-27 12:36
>被験者はGPT-4o、Llama 3、Command R+のいずれかの支援を受けるよう無作為に割り当てられた。
これ、もうけっこう古いモデルだよね。最新のフロンティアモデルと比べたらどうなるのか気になる。
26 海外の名無しさん 2026-09-27 12:20
GPT-4o、Llama 3、Command R+か。進化のペースが速すぎて、こういう研究は発表される頃にはもう古くなってる。
11 海外の名無しさん 2026-09-27 12:12
どちらの要望も、そちらが思っているような形では現実的でも妥当でもないと思う。一つ目は「自分のOSをウイルス作成に使われたくない」と言っているようなもの。二つ目は「製品にマーケティング要素を入れないでほしい」と言っているようなものだ。
12 海外の名無しさん 2026-09-27 12:12
この手の断り書きは、際どい質問への回答に限定すべきだと思う。ガイドラインに触れるような質問をされたときなら「言語モデルとして…」は妥当な出だしだ。それ以外では、ソフトウェアに人間のような判断力がないことくらい誰でも分かっている。
30 海外の名無しさん 2026-09-27 12:39
先日、特にセンシティブでもない同語源の単語について聞いただけなのに、ChatGPTが最初の回答を検閲してきたことがあった。なぜ聞けないのか尋ねたら、結局答えてくれた。何が「際どい」かなんて、どうやって判断するんだろう。
13 海外の名無しさん 2026-09-27 12:17
これを見るといつも、ビル・ベイリーの「母親として」ネタを思い出す。UXでよくある「ユーザーとして、私は〜したい」みたいな言い回しと同じ寒さがある。「ユーザーは〜したがっている」と普通に書けばいいし、いっそ表にまとめた方がマシだ。
20 海外の名無しさん 2026-09-27 11:23
理屈の上では、メタ認知能力があれば意味のある形でそういう言葉を出力できるはずだ。ただ今のところ、それをAI開発者が目指しているようには見えない。それもそのはずで、メタ認知を持たせずとも数々の「奇跡」を実現できてしまっているのだから。
38 海外の名無しさん 2026-09-27 11:28
とはいえ、LLMのメタ認知についてはまだよく分かっていないはずでは? 自信はないけど。
21 海外の名無しさん 2026-09-27 11:29
面白い発想だとは思う。ただ人間はもともと何にでも擬人化したがる生き物だし、選択肢を与えられたら、その案はあまり支持されない気がする。
22 海外の名無しさん 2026-09-27 11:05
不思議なのは、RLHF前のベースモデルの方が、特にそう仕向けられてもいないのに「体験を語るような」口調を使うということだ。
39 海外の名無しさん 2026-09-27 11:13
これらのモデルが実在・架空を問わず膨大な数の会話データで学習されていることを考えれば、そこまで不思議でもない気がする。

他サイトの新着

23 海外の名無しさん 2026-09-27 11:04
全面的に同意。スタートレックに出てくるようなコンピューターインターフェースになるなら、お金を払ってでも使いたい。
40 海外の名無しさん 2026-09-27 11:05
自分も同じ意見。LoRAで追加学習すれば、実際にそれに近いものが作れると思う。
34 海外の名無しさん 2026-09-27 11:18
>自分自身についてどう語るか?
(システム)プロンプトに「あなたは大規模言語モデルです」と入れておけば、それで十分な気がする。
35 海外の名無しさん 2026-09-27 11:26
でも実際には「理解」なんてしていない(それは不必要な擬人化だ)。それに、自分はいまだにペーパークリップではない。
36 海外の名無しさん 2026-09-27 11:55
それに、モデルに「あなたは人間だ」と教え込むことで、自己保存欲求のような人間的な動機を植え付けてしまう可能性も十分にある。それはそれで同じくらい問題だ。
37 海外の名無しさん 2026-09-27 11:12
「自然に」ねえ……。
45 海外の名無しさん 2026-09-27 11:33
その「自然に」は、「そういう性質だから」という意味で使われているように聞こえる。
46 海外の名無しさん 2026-09-27 11:24
それとも「同語反復的に」の方がお好み?
41 海外の名無しさん 2026-09-27 12:19
たしかに、伝えたいことをそのまま言えばいいだけの話だ。ただ一方で、社会への心理的な影響には気をつける必要がある。例えばティーンエイジャーがAIと会話する場合、AIがただ自然に話すだけで、相手が人間であるかのような感覚を抱き始めてしまう。だからこそ、最初に「これは人間ではない」と明かしておいた方がいいのかもしれない。
42 海外の名無しさん 2026-09-27 12:42
>正しいと確信が持てないなら、単に治療法を勧めなければいいだけだ。
ああ、なるほど、きっと開発者はそう作るのをうっかり忘れてたんだね!
43 海外の名無しさん 2026-09-27 12:48
じゃあ、OpenAIのモデルが会話の中に「ゴブリン」や「妖精」への言及を挟み込むようになって、それを後から抑え込まなければならなかった理由も、それで説明がつくということ?

この話題の背景と論点

今回の話題のもとになっているのは、arXivに投稿された論文で、チャットモデルが「AIとして」「言語モデルとして」と自らを三人称的に語る口調が、実はモデル本来の性質ではなく学習段階によって入れ替わる現象を扱ったものだ。スレッドで注目されていたのは、事後学習(RLHF)前のベースモデルはむしろ人間のような一人称的な語り口を自然に使い、「言語モデルとして」という言い回しは初期のチャットボット向けに意図的に学習させられ、以降の世代に一種の"作法"として引き継がれてきた可能性が高いという指摘だった。この現象が本物のメタ認知(自己に対する内省)の兆候なのか、それとも大量の会話データを模倣した結果に過ぎないのかで見解が割れている。また、擬人化した話し方が利用者、とりわけ若年層に人間的な愛着を抱かせるリスクを懸念する声と、「AIとして」という定型句自体がすでに形骸化していて実効性を欠くとする声が併存しており、単純な白黒はついていない。

※本記事は5ch(Hacker News)スレッド「"As a Language Model": Chat Template Switches LLM Self-Referential Voice」より抜粋・要約して構成しています。

この記事のリアクション

他サイトの新着

まだコメントはありません。

コメントする

誹謗中傷・個人を特定する書き込みは削除対象です。投稿は承認後に表示されます。

相互リンクサイト新着記事