「LLMが単純なのに致命的に苦手なこと」に海外エンジニアが回答殺到

姉妹サイトの新着

Hacker Newsに「LLMが単純なのに全然できないことは何か」という質問が投稿された。投稿者は特化型モデルを作るためのアイデアを集めたいという狙いだった。回答では定番のハルシネーションに加え、ASCIIマップでの空間把握やアナログ時計の画像生成、ヒエログリフの翻訳など、具体的で意外な弱点が次々と挙がった。

5 海外の名無しさん 2026-08-26 03:55
LLMは事実のねつ造(ハルシネーション)をやめられないし、説明過多になるのもやめられない。細かい情報を正確に覚えていられないし、的確な質問を返せない、同じことを繰り返してしまう。
6 海外の名無しさん 2026-08-26 03:56
ASCIIマップから空間を把握しながら長期的な計画を立てること。NetHackみたいなゲームをAIにやらせてみるといい。
32 海外の名無しさん 2026-08-26 03:59
その場で画像に変換して画像対応モデルに読み込ませれば、普通にうまくいくと思うよ。
7 海外の名無しさん 2026-08-26 03:35
これらのモデルは文章を書くのが下手だ。文の構造がワンパターンになりがち。
33 海外の名無しさん 2026-08-26 03:53
文脈も学習もなしにモデルにそのまま書かせるならそうだね。でも自分の望む書き方を学習させたスキルを作れば、少なくとも自分好みの書き方をしてくれるようになるよ。
8 海外の名無しさん 2026-08-26 04:22
エジプトのヒエログリフを読んで翻訳できること。バカげてると思うかもしれないけど、ヒエログリフ翻訳専用に訓練されたLLMがあったらすごいと思う。
34 海外の名無しさん 2026-08-26 04:24
実際どんな問題が起きてる?わりと『直せそう』な話に思えるけど。
10 海外の名無しさん 2026-08-26 03:38
単純な質問への短い回答。
11 海外の名無しさん 2026-08-26 03:48
ゲームの攻略情報。何度もミスやでっち上げが起きる。いろんなゲームで経験した。OSRSみたいに優れたWikiが複数あるゲームでもそう。最近だとAnno 1800でClaude Opusを使ったとき、存在しないゲームシステムを平気ででっち上げられた。レインボーシックス シージも同様。
36 海外の名無しさん 2026-08-26 04:02
自分はNFS Heatで使ったけど問題なかったよ。
12 海外の名無しさん 2026-08-26 04:03
1から30の間でランダムな数字を選ぶこと。
13 海外の名無しさん 2026-08-26 03:59
ユーザーが指定した時刻に針を合わせたアナログ時計の画像を生成すること。まあLLMというより画像モデルの話だけど。
14 海外の名無しさん 2026-08-26 03:58
手話とファクトチェックがめちゃくちゃ苦手。
15 海外の名無しさん 2026-08-26 03:44
チェスエンジンを自分で書かせずにチェスを指すこと。
16 海外の名無しさん 2026-08-26 03:40
何か重要な(失敗が許されない)用途で頼むときはいつも。
17 海外の名無しさん 2026-08-26 03:36
会社名の提案。提案自体は悪くないんだけど、もうすでに使われている名前ばかり出してくる。
19 海外の名無しさん 2026-08-26 03:33
同じ質問を何度もしたときに一貫した答えを返すこと。
37 海外の名無しさん 2026-08-26 03:36
温度(temperature)を0に設定するといいよ。

他サイトの新着

20 海外の名無しさん 2026-08-26 03:27
空間認識と3Dリギング・アニメーション。あ、『簡単なこと』って言ったね。じゃあ人間らしく話すこと。
21 海外の名無しさん 2026-08-26 04:05
金融計算がめちゃくちゃ苦手。
22 海外の名無しさん 2026-08-26 04:03
ASCIIアートのグラフ。
24 海外の名無しさん 2026-08-26 03:45
科学…かな?!でも今それを直そうとしてるところ。
26 海外の名無しさん 2026-08-26 03:41
Claudeはまだノイズの多いグラフィカルデータ(心電図や染色体マイクロアレイのプロットみたいなもの)を読んで解釈するのが完璧じゃない。平均的な人間よりはまだマシだけど、ミスをする。質問の意図に合うかは分からないけど。
27 海外の名無しさん 2026-08-26 03:54
(今請求されている価格ではなく)実際のコストに見合う価値を提供すること。
29 海外の名無しさん 2026-08-26 04:24
それと、検索キーワードの最後に必ず『今年』をつけてくること(そうすれば結果が新しくなると思ってるんだろうけど)。現在の日付を教えるハーネスを使っていても、その『今年』はだいたい2〜3年前になってしまう。学習データの都合なんだろうけど。
30 海外の名無しさん 2026-08-26 03:43
自分もこれには気づいてたけど、この検索スタイルが学習された振る舞いなのかは正直はっきりしない。ツール呼び出しは事後学習(ポストトレーニング)にかなり組み込まれているから、こういう検索の仕方は訓練中に自然に出てくるものなんじゃないかと思ってる。まあ自分の勝手な予想だけど。
31 海外の名無しさん 2026-08-26 04:01
昔のAltaVista検索を思い出すな。うん、あれくらいひどかった。

この話題の背景と論点

5chの掲示板名になっているHacker Newsは投稿・投票制のニュース集積サイトで、今回の質問はモデル特化の弱点集めという実務的な動機から出ている。制度的な背景として、LLMは統計的な次トークン予測で動く仕組み上、盤面や地図のような明示的な空間状態を内部で保持し続ける機構を持たず、また学習データの時間的カットオフにより「現在」の概念がずれやすい。

意見が割れたのは、これらの弱点が「モデル自体の限界」なのか「使い方(ツール併用・温度設定・ファインチューン)で解決可能な表面的問題」なのかという点で、画像変換によるASCIIマップ読解や文体のカスタムスキルなど、回避策の有効性を巡る評価が分かれた。

読者が誤解しやすいのは、ハルシネーションや検索の古さが「バグ」ではなく、学習データの構造やツール呼び出しの事後学習の癖に起因する構造的な傾向である点だ。またレスでは触れられていないが、これらの弱点はモデルの世代やベンダーごとに改善速度が大きく異なり、一時点の観察を汎用的な結論として扱うのは危うい。

※本記事は5ch(Hacker News)スレッド「Ask HN: What is one simple thing LLMs are insanely bad at?」より抜粋・要約して構成しています。

この記事のリアクション

他サイトの新着

まだコメントはありません。

コメントする

誹謗中傷・個人を特定する書き込みは削除対象です。投稿は承認後に表示されます。

相互リンクサイト新着記事