小型AIでクラウド大手は終わるか、海外で激論
「小型の言語モデル(SLM)が実用レベルに達すれば、AWSやGoogleなどクラウド大手(ハイパースケーラー)の需要は失われる」とする投資家のブログ記事が、Hacker Newsで議論を呼んだ。
コメント欄では「ローカルで動くモデルなど所詮フロンティアモデルに勝てない」という反論と、「全タスクで勝つ必要はなく、日常利用の半分がローカルに流れるだけで巨大クラウドの収益は打撃を受ける」という擁護派が真っ向から対立した。
これが本当なら、ハイパースケーラーは終わりだ
出典: klementoninvesting.substack.com / 元記事はこちら
その理屈はおかしいと思う。みんなが小型モデル(SLM)で十分だと言うなら、ハイパースケーラー側もより効率のいいモデルを中央集約でホストすればいいだけで、規模のメリットと利便性でローカル運用に勝てるはずだ。
>>4
ハイパースケーラーの株価評価は、『ローカルで動くものより多少効率がいい』程度では支えられない。そこにも市場はあるが、それはコモディティの薄利ビジネスの話だ。今の株価は独占的なプレミアム商品としての値付けがされている。
ハイパースケーラーの株価評価は、『ローカルで動くものより多少効率がいい』程度では支えられない。そこにも市場はあるが、それはコモディティの薄利ビジネスの話だ。今の株価は独占的なプレミアム商品としての値付けがされている。
>>4
僕がおかしいと思う理由は逆で、SLMはそもそもLLMほどの情報量を保持できないからだ。SLMとデータベース(ツールとして)を組み合わせればうまくいくかもしれないが、それはまず誰かが実証すべきことだ。
僕がおかしいと思う理由は逆で、SLMはそもそもLLMほどの情報量を保持できないからだ。SLMとデータベース(ツールとして)を組み合わせればうまくいくかもしれないが、それはまず誰かが実証すべきことだ。
CNBCやBloombergテレビの『専門家』があまりに頻繁に『ハイパースケーラー』という言葉を使うのを見て、自分はこの言葉を使う人間の発言は一切信用しないことにしている。
>>7
2週間前、CNBCがSpaceX専門とかいう『専門家』を呼んでいたが、その人は『軌道上に1000万機の衛星がある』と言っていた。これが『専門』金融チャンネルの今の実力だ…
2週間前、CNBCがSpaceX専門とかいう『専門家』を呼んでいたが、その人は『軌道上に1000万機の衛星がある』と言っていた。これが『専門』金融チャンネルの今の実力だ…
小型言語モデルが医療分野の出力で100%満足のいく結果を出した、と?
動画モデル、ワールドモデル、ロボティクスのシミュレーション、そしてマトリックスもある…
でもこれって2025年10月時点のデータだよね? もちろん状況は常に動いているけど、11月にリリースされたOpus 4.5は能力面で明確な飛躍だったと評価されている。最新版での比較が見てみたい。
その論文は『ワットあたりの知能(IPW)』という指標でSLMとLLMを比較している。起こりうるのは、市場のどれだけかの割合が、iPhoneやMacBookで動くSLMに流れて、LLM側の収益を食っていくパターンだ。誰もが常に最強のLLMを必要としているわけではないから。
いいね、自分が普段LLMチャットボットに頼んでいるような『複雑な計算をやらせて、自分の専門知識でざっと結果を確認する』系のタスクで高得点を出してる。これなら10年後には5年落ちのノートPCでSLMを動かして、Googleか誰かに全部吸い上げられずに済むかもしれない。
ローカルモデルやオープンウェイトモデルに成功してほしいとは思うが、今のところ有料のフロンティアモデルに勝てるものはない。そうでないと主張する人は、単にそうしたモデルを日常的に使っていないだけだ。この『投資家』も、実際に色々なLLMを使ってみる時間を取った方がいい。
>>19
論点は『ローカルモデルの方が優れている、あるいは同等だ』ということじゃない。タスクの50%以上をローカルでこなせるなら、それだけデータセンターの計算として捕捉されないトークンが50%生まれる、という話だ。
論点は『ローカルモデルの方が優れている、あるいは同等だ』ということじゃない。タスクの50%以上をローカルでこなせるなら、それだけデータセンターの計算として捕捉されないトークンが50%生まれる、という話だ。
>>19
論旨を完全に読み違えている。提示された数字が裏付けているのは、日常的な推論の大部分がハイパースケーラーから切り離せるということだ。
論旨を完全に読み違えている。提示された数字が裏付けているのは、日常的な推論の大部分がハイパースケーラーから切り離せるということだ。
>>19
今のローカルモデルは、12か月前や24か月前の最高のフロンティアモデルと比べてどうなんだ?
今のローカルモデルは、12か月前や24か月前の最高のフロンティアモデルと比べてどうなんだ?
>>10
『ローカルで小さめのモデルを試したけど、自分には使い物にならなかった』とのことだけど、ハードウェアさえあれば、例えばQwen 3.6 35B A3BやGemma 4 26B A4BをMacBook Proで動かせば、速度でも品質でも十分実用的だ。体感では、QwenをTypeScriptやGoの日常的なコーディング作業に、詰まることなく使えている。
『ローカルで小さめのモデルを試したけど、自分には使い物にならなかった』とのことだけど、ハードウェアさえあれば、例えばQwen 3.6 35B A3BやGemma 4 26B A4BをMacBook Proで動かせば、速度でも品質でも十分実用的だ。体感では、QwenをTypeScriptやGoの日常的なコーディング作業に、詰まることなく使えている。
>>25
Qwen 3.8 27Bを試しているところだけど、フルコンテキストを扱えるハードウェアさえあればメインのコーディングモデルとして十分使えると思う。Opusレベルである必要はなくて、過保護なお目付け役みたいにならずに、頼んだタスクをちゃんとこなしてくれればそれでいい。
Qwen 3.8 27Bを試しているところだけど、フルコンテキストを扱えるハードウェアさえあればメインのコーディングモデルとして十分使えると思う。Opusレベルである必要はなくて、過保護なお目付け役みたいにならずに、頼んだタスクをちゃんとこなしてくれればそれでいい。
>>25
でもコメントの中に『hickups』ってタイプミスが一つ紛れ込んでるよ。
でもコメントの中に『hickups』ってタイプミスが一つ紛れ込んでるよ。
>>10
『市場が爆発的に伸びると予測が言い続けて、実際には全く伸びなかった回数を数えるのをやめた。ああいう予測屋は壊れた時計みたいなものだ』というけど、この発言の論理性とリスク管理のなさがあまりに酷くて、いっそ人間は全員さっさとLLMに置き換わってほしいとすら思う。もうそうしてしまおう…
『市場が爆発的に伸びると予測が言い続けて、実際には全く伸びなかった回数を数えるのをやめた。ああいう予測屋は壊れた時計みたいなものだ』というけど、この発言の論理性とリスク管理のなさがあまりに酷くて、いっそ人間は全員さっさとLLMに置き換わってほしいとすら思う。もうそうしてしまおう…
>>26
『もうそうしてしまおう』というフレーズ、たぶん意図してないと思うけど、自分はある映画のワンシーンを即座に連想してしまった。
『もうそうしてしまおう』というフレーズ、たぶん意図してないと思うけど、自分はある映画のワンシーンを即座に連想してしまった。
>>39
いい映画だよね…うん、実はそのシーンに影響されてたと思う(笑)
いい映画だよね…うん、実はそのシーンに影響されてたと思う(笑)
>>10
『ローカルで小さめのモデルを試したけど、自分には使い物にならなかった』というのは、たぶんそっちの腕の問題では。
『ローカルで小さめのモデルを試したけど、自分には使い物にならなかった』というのは、たぶんそっちの腕の問題では。
>>15
『大規模言語モデルの残る優位性は、大きくなるほど幻覚(ハルシネーション)が減る傾向にあることだ』というけど、それは初耳だし、あまり正しくない。関連論文として『Understanding Why Language Models Hallucinate』『Calibrated Language Models Must Hallucinate』『TruthfulQA』などが参考になる。
『大規模言語モデルの残る優位性は、大きくなるほど幻覚(ハルシネーション)が減る傾向にあることだ』というけど、それは初耳だし、あまり正しくない。関連論文として『Understanding Why Language Models Hallucinate』『Calibrated Language Models Must Hallucinate』『TruthfulQA』などが参考になる。
>>15
他にも『いいアイデアだけどまだやり方が分からない』ものとして、LLMの回答をどこまで信用していいか分かる『信頼区間』があればいいよね。もっと夢を見るなら、学習データに関係なく常に全てを知っている、みたいなのもいいけど。『しっかりしたものがあれば』の部分は想像するのは簡単だけど、実装するのは難しい(笑)
他にも『いいアイデアだけどまだやり方が分からない』ものとして、LLMの回答をどこまで信用していいか分かる『信頼区間』があればいいよね。もっと夢を見るなら、学習データに関係なく常に全てを知っている、みたいなのもいいけど。『しっかりしたものがあれば』の部分は想像するのは簡単だけど、実装するのは難しい(笑)
>>20
自分はローカルで動かしたいとは全く思わない。同じものがどこか他所で動いていて、自分の全デバイスからアクセスできる方がいい。Grok Botみたいなものを見ればわかるけど、あれをローカルで動かす人なんていない。今だってほとんど何でもセルフホストできるのに、大半の個人や企業はそうしていない。
自分はローカルで動かしたいとは全く思わない。同じものがどこか他所で動いていて、自分の全デバイスからアクセスできる方がいい。Grok Botみたいなものを見ればわかるけど、あれをローカルで動かす人なんていない。今だってほとんど何でもセルフホストできるのに、大半の個人や企業はそうしていない。
>>34
そうだね、でもそれは10兆ドル規模のビジネスにはならない。
そうだね、でもそれは10兆ドル規模のビジネスにはならない。
>>22
でも、デュラン・デュランのディスコグラフィーを丸ごと記憶して常時RAMに載せておくようなモデルが、本当に必要なのか?
でも、デュラン・デュランのディスコグラフィーを丸ごと記憶して常時RAMに載せておくようなモデルが、本当に必要なのか?
>>35
でも自分が本当にデュラン・デュランを愛してたらどうするんだ???
でも自分が本当にデュラン・デュランを愛してたらどうするんだ???
>>35
それはまた別の話だ。おそらく必要ない。ただ、1. 大量の情報で大きなモデルを学習させてから『不要な』情報を削ぎ落として小型モデルを得る、というアプローチはまだ誰も実証していない。2. 小型モデルを学習させて、データベースをツールとして使わせることで、データベースなしの大型モデルと同等のスコアを出す、というアプローチもまだ誰も実証していない。
それはまた別の話だ。おそらく必要ない。ただ、1. 大量の情報で大きなモデルを学習させてから『不要な』情報を削ぎ落として小型モデルを得る、というアプローチはまだ誰も実証していない。2. 小型モデルを学習させて、データベースをツールとして使わせることで、データベースなしの大型モデルと同等のスコアを出す、というアプローチもまだ誰も実証していない。
>>33
opencodeで使うQwen 3.8のコーディング品質は、6〜9か月前のClaudeやGPTと同じくらいだと感じている。ただしかなり遅い。
opencodeで使うQwen 3.8のコーディング品質は、6〜9か月前のClaudeやGPTと同じくらいだと感じている。ただしかなり遅い。
※本記事は5ch(Hacker News)スレッド「If this is true, the hyperscalers are toast」より抜粋・要約して構成しています。






まだコメントはありません。