数学は解けてもチェスは弱い、LLM懐疑論のブログに海外で賛否

姉妹サイトの新着

他サイトの新着

海外のブログに投稿された「ナビエ・ストークスの難問が解決した後も、私はLLMに懐疑的だ」と題する記事が、Hacker Newsで大きな反響を呼んだ。筆者は、現行の最先端モデルでも単純な作業に念入りな監視とガードレールが必要だと指摘し、チェスをまともに指せないことなどを根拠に慎重な立場を示している。これに対しコメント欄では、数学分野での強さを認めつつ自律型AIへの懐疑に賛同する声と、検証対象のモデルがすでに旧世代でフェアではないという反論が交錯し、AI業界全体の資金規模やオープンウェイトモデルの安全性にまで話が広がった。

ナビエ・ストークスの難問が解決した後も、私はLLMに懐疑的だ

出典: dank.systems / 元記事はこちら

3 海外の名無しさん 2026-09-16 07:30
いい記事なんだけど、文の頭が全部小文字だから読みづらいのが正直つらい。話がずれてたらすまないけど、投稿者本人がここにいるみたいだからフィードバックも受け付けてくれるだろうと思って言わせてもらった。
51 海外の名無しさん 2026-09-16 07:47
>>3
このJSをコンソールに貼れば文頭を大文字化できるよ(完璧じゃないけど役には立つはず)。
Array.from(document.body.querySelectorAll('p,li')).filter(e=>e.innerText).map(e=>e.innerText = e.innerText.split('. ').map(s=>s[0].toUpperCase() + s.slice(1)).join('. '))
52 海外の名無しさん 2026-09-16 10:35
>>3
サイト全体を見てみたけど、全部このスタイルで統一されてた。まあ……個性的ではあるね。
53 海外の名無しさん 2026-09-16 08:24
>>3
自分も同じこと思った。経験則だけど、全部小文字で書かれた文章って大抵思いつきの放言だから読む価値がないことが多いんだよね。要するに『小文字だから読まない』ってやつ(笑)
8 海外の名無しさん 2026-09-15 23:22
端的で分かりやすい指摘。オープンで安価なモデルは大手ラボを継続的に食っていくはずで、巨額の投資契約の支払いが迫ってきたときの被害は相当なものになるだろうね。
65 海外の名無しさん 2026-09-16 00:41
>>8
オープンモデルもそう長くはオープンでいられないと思う。ゼロデイ攻撃を連鎖させられるようなモデルを誰も公開しないだろうし、中国だってそこまで無謀じゃない。自分たちに跳ね返ってくるだけだから。
66 海外の名無しさん 2026-09-15 23:41
>>8
同意はするけど、オープンウェイトモデルの安全性はやっぱり心配。アライメント済みのものも、そうでないものも含めて。
67 海外の名無しさん 2026-09-15 23:58
>>8
まるでOpenAIみたいなラボがそれを知らなくて、値下げ競争を防ぐ手を常に打ってないみたいな言い方だね
11 海外の名無しさん 2026-09-15 22:43
現在のAIの能力を頭ごなしに否定するわけでもない、この抑えたトーンの意見はありがたいね。
73 海外の名無しさん 2026-09-15 23:02
>>11
『最先端のモデルでさえ、単純な作業にすら念入りな監視とガードレールが必要』ってくだり、これはまさに現在の能力を否定してるように読めるけど
74 海外の名無しさん 2026-09-15 22:53
>>11
ありがとう(笑)。実際毎日使ってて楽しんでるし、今の性能は本当にすごいと思う。ただ最先端モデルの値段がバカ高すぎるだけで。
18 海外の名無しさん 2026-09-16 10:05
というか、なんで『LLM』を大文字表記にしてるの?
23 海外の名無しさん 2026-09-15 22:44
正確に言うと、LLM全般に懐疑的なんであって、純粋数学におけるLLMには懐疑的じゃないってことね。
86 海外の名無しさん 2026-09-15 22:53
>>23
そう、純粋数学やそれに近い分野ではかなり強い。
26 海外の名無しさん 2026-09-15 23:48
自分はAIに強気だよ。いずれ本物のブレイクスルーが来ると思ってる。
28 海外の名無しさん 2026-09-15 23:34
『2025年以降コードなんて一行も書いてない、LLMがすごすぎてもう誰も要らない』みたいな延々続くガスライティングの中で、こういう意見は新鮮でいいね
32 海外の名無しさん 2026-09-16 00:19
いいね、自律型LLMはうまくいかないってことか。それは実はベストな結果だよ。人間が指示を出せば驚くほどよく働くわけで、自律性なんて要らないし、人類滅亡もない。まさに全部勝ちじゃん。
33 海外の名無しさん 2026-09-15 17:37
サーバー落ち(hug of death)に備えてアーカイブのリンクも貼っとくね(笑) https://archive.ph/Z4gxF
34 海外の名無しさん 2026-09-15 23:28
終末論者は結局いつも終末論を言う
35 海外の名無しさん 2026-09-15 23:57
全部のウェブサイトに『要約』ボタンを付けてほしい。
90 海外の名無しさん 2026-09-16 04:53
>>35
それはブラウザ側でやるべき機能じゃない?
36 海外の名無しさん 2026-09-15 23:36
>>2
『最先端モデル』として挙げてるのがGemini 2.5 Pro、O3、Claude Sonnet 3.7、ChatGPT 4.1か。これらと本当の意味での現行最先端モデルとの間には、ものすごい性能差がある。この検証の結論をそのまま信用する気にはなれないな。
91 海外の名無しさん 2026-09-16 00:40
>>36
自分でもAstra xhighを弱いボット相手に試してみた(lichessのスタディはこちら)。チェスはまだかなり弱いけど、反則手を指すまでの手数は前より長くなってた。
40 海外の名無しさん 2026-09-16 07:32
>>2
そもそもLLMは『トークン列』以外の意味でのルール(文法)に従うようには作られていない。それに、知的なエージェントにとってルールに従うことが本当に必要なのかもはっきりしない。もちろん、外側の仕組み(ハーネス)で簡単に補正はできるけど。
43 海外の名無しさん 2026-09-15 23:36
>>2
今のモデルだったらどうなるんだろうね。検証で使われたモデルはもうかなり古い。
44 海外の名無しさん 2026-09-15 23:44
>>2
知能ってそういうものじゃないと思う。LLM自身が推論だけでチェスを指せなくても、チェスを指すプログラムを書いて実行させればいい。人間の知能も同じ。自分では飛べないけど、飛行機は作れる。
45 海外の名無しさん 2026-09-15 23:28
>>2
話はそんなに単純じゃない。結局はタスク次第ってことだよ。チェスの棋譜を大量に学習できるか? できない。数学の論文を大量に学習できるか? できる。この差が大きい。

他サイトの新着

47 海外の名無しさん 2026-09-16 00:49
>>2
なんでモデルがStockfishをツールとして呼び出しちゃダメなんだろう。複雑な数式計算のためにPythonを実行できない、って言ってるのと同じに聞こえるけど。
49 海外の名無しさん 2026-09-16 00:44
>>2
それのどこが大問題なのか分からない。そもそもチェスにLLMを使う人なんていないし、使うにしてもハーネスの一部としてStockfishを持たせればいい。ツールを使いこなせる賢さがあれば、全部自分でやる必要はないんだから。
50 海外の名無しさん 2026-09-16 07:34
>>2
専用の訓練をしていないのにチェスを指せること自体が驚きだし、他の多くの人がそれを驚きだと思わないという事実こそ、AIがどれだけ速く進歩してきたかを物語ってる。
54 海外の名無しさん 2026-09-16 09:03
>>3
『文頭の大文字化がされてなくて読みづらい』って言うけど、ちゃんと大文字化されてたらされてたで、今度は『LLMで書かれた文章だ』って叩かれるんだよ。どっちにしても勝ち目がない……
60 海外の名無しさん 2026-09-16 00:42
>>4
その通りだと思う。AI市場に流れ込む資金の大半はOpenAIとAnthropic経由で、両社は株式売却と顧客からの収益の両方でそれを集めている。7〜8兆ドルという数字も、結局そこから派生したものにすぎない。
61 海外の名無しさん 2026-09-16 01:49
>>5
Anthropicの偉い人たちいわく、AIが人類を滅ぼす確率は10%超えらしい。それが本当なら君は間違ってるし、嘘なら嘘でAnthropicは不誠実な会社ってことになる。不誠実な会社の企業価値なんてどうして信用できるんだ?
70 海外の名無しさん 2026-09-16 10:12
>>10
ナビエ・ストークスの件って、ある研究者の非公開チャットログを勝手に流用して『解いた』ことになってたんじゃなかったっけ?
75 海外の名無しさん 2026-09-16 01:52
>>12
『カスタマーサポート』が何を指すか次第だね。普通はナレッジベースからの情報検索か、ユーザーには見えない管理画面の操作を意味することが多い。
76 海外の名無しさん 2026-09-16 03:30
>>12
自分もまさにそれを言いに来た。実際、これがカスタマーサービス分野でAI活用があまり進んでいない理由だと思うし、たまに導入されてても大抵イライラさせられる出来になってる。
77 海外の名無しさん 2026-09-16 01:23
>>14
Elizaだって、ちゃんと筋の通った英文を書いてたよ。
80 海外の名無しさん 2026-09-15 23:20
>>15
『これって人間の学習の仕方と本当に違うのか?』うん、違う。
81 海外の名無しさん 2026-09-15 23:32
>>15
それに、GPT-6 AstraのARC-AGI-2での高スコアって、この主張と矛盾してない? 各問題はルールが全然違う、それぞれ独立したゲームみたいなものなのに。
87 海外の名無しさん 2026-09-16 03:36
>>24
つまり、モデルが『何をするか』を心配してるってことなら、まあそうだね。

この話題の背景と論点

タイトルにある「ナビエ・ストークス」は、AIが数学分野で成果を上げたとされる出来事を指しているとみられるが、スレ内にその詳細を裏付ける情報はなく、事実関係の確認はできない。議論の軸は、論文データが豊富な数学分野でLLMが強さを見せる一方、学習データの乏しいチェスのような領域では弱さが目立つという指摘で、これを「Stockfishのようなツールを呼べば解決する話」とみるか「それ自体が限界の証拠」とみるかで意見が割れている。またAnthropicの研究者がAIによる人類滅亡リスクに言及しているという指摘も出ているが、真偽や出典の検証は本スレでは行われていない。検証に使われたモデルがすでに旧世代だという批判も複数あり、AIの能力評価はどの世代のモデルを前提にするかで結論が大きく変わりうる点には注意が必要だ。

※本記事は5ch(Hacker News)スレッド「Why I’m still bearish on LLMs after Navier-Stokes」より抜粋・要約して構成しています。

この記事のリアクション

他サイトの新着

まだコメントはありません。

コメントする

誹謗中傷・個人を特定する書き込みは削除対象です。投稿は承認後に表示されます。

相互リンクサイト新着記事