新型Mac StudioでローカルAI、RTX5090との速度比較が海外で議論に

姉妹サイトの新着

他サイトの新着

Hacker Newsで、新型Mac Studio(M5 Ultra)を使ったローカルAIエージェント向けレビュー記事が話題になっていた。記事ではQwen3.8などのモデルについて、RTX 5090搭載PCとの生成速度比較データが示されており、コメント欄では「5090の方が速い」「比較対象のモデルが違う」といった反論が相次いだ。テスト機の価格が1万8000ドル前後だったことから、クラウドAIサービスの利用料と比べてどちらが得かという価格論争にも発展した。

M5 Ultra Mac Studioレビュー:ローカルAIエージェントのための理想のMac

出典: macstories.net / 元記事はこちら

2 海外の名無しさん 2026-09-21 14:32
一番気になった数字は記事の下の方にひっそり載っているグラフだった。Mac StudioとRTX 5090の速度比較(Qwen3.8 27Bのトークン生成速度、単位tok/s):
プロンプトサイズ 8K 64K 128K 256K
RTX 5090 PC 59 51 44 該当なし
M5 Ultra 48 39 32 24
M3 Ultra 31 23.5 20 15
この項目には他にもたくさん比較データが載っている(リンク先参照)。
20 海外の名無しさん 2026-09-21 15:07
そのRTX 5090の数字はひどいな。ninferでNVFP4とMTPを使えば200tps以上出せるのに。
21 海外の名無しさん 2026-09-21 15:05
27Bの密なモデルはMacで動かす意味があまりない。帯域はそこそこでもメモリが大量にあるなら、MoEの方がずっと理にかなっている。
22 海外の名無しさん 2026-09-21 16:07
それは密なモデルだから遅くて当然だ。じゃあQwen 3.8 NextモデルをRTX 5090で動かして、TPSがどうなるか教えてほしい(ヒント:5090のVRAMは32GBしかなく、元記事のM5の256GBには収まらないから、ほぼ0になるはずだ)。
9 海外の名無しさん 2026-09-21 14:36
Appleのサイトによると512GBメモリ構成は10月に登場するらしい。そこまで上げると追加で4000〜6000ドルはかかりそうだ。となると2TBストレージ搭載のUltraは1万5000ドルを超える計算になる。OpenAI Proのサブスク12年分くらいだな。
29 海外の名無しさん 2026-09-21 15:54
ハードウェアの話をしているのでついでにコメントするけど、この記事(リンク)で公開されているSSDのテスト結果はなかなか興味深かった。もう既出の話かもしれないけど。
31 海外の名無しさん 2026-09-21 14:44
同感。しかも今なら半額を払うだけで、OpenAI Proのサービス提供を12年間途切れず保証する『鉄壁の契約』が結べるわけだしね。
32 海外の名無しさん 2026-09-21 14:48
そうだね、ローカルAIで節約できると思っている人は、少しでもまともに使えるモデルを動かしたいなら、たぶんがっかりすることになる。ローカルAIにワクワクする理由は他にたくさんあるけど、コストはその一つじゃないと思う。
12 海外の名無しさん 2026-09-21 14:42
テストに使われた構成は1万8000ドルだ。まさかこれのせいで5090がお買い得に見えてくるとは思わなかった。
33 海外の名無しさん 2026-09-21 16:10
5090のVRAMは32GBだ。Qwen 27Bみたいな小さいモデルを動かすためだけに1万8000ドルの機種を買うのは馬鹿げている。実際にはGLM FlashやQwen Nextのような、5090一枚には収まらないモデルを使うためのものだ。
16 海外の名無しさん 2026-09-21 14:31
1万2299ドル
34 海外の名無しさん 2026-09-21 15:40
その値段だと月200ドルのトークン代5年分くらいか。一方でRTX 5090搭載PCならその半額くらいで済む…うーん、でもこのトークン代がいつまで持続可能なのかは気になるところ。トークン代が値上がりしていくなら、長期的には自前のハードウェアを持つ方が安上がりになるかもしれない(ついでにハードウェアがまた安くなってくれるといいけど)。
17 海外の名無しさん 2026-09-21 14:48
『まず本題に触れておこう。クラウドの最先端モデルの方が優れていて大抵は速いのに、なぜわざわざローカルAIにこだわるのか?』とあるけど、本当の本題は『時間5ドルでGPUを借りられるのに、なぜわざわざローカルAIにこだわるのか?』の方だと思う。答えは、趣味のプロジェクトに注ぎ込む金が有り余っているのでない限り、こだわる必要はない、ということだ。
35 海外の名無しさん 2026-09-21 16:18
『趣味のプロジェクトに注ぎ込む金が有り余っているのでない限り』とあるけど、世の中には金のかかる趣味を持つ人がたくさんいるよ。例えばヨットレースとか。
18 海外の名無しさん 2026-09-21 15:08
データセンターに1兆ドルもつぎ込んだ後にこの記事を読む姿を想像してみてくれ。OpenAIにとっては悪夢のネタだろう。
36 海外の名無しさん 2026-09-21 15:13
99.99%の人にとって、Qwen 3.8をローカルで動かすためだけにMac Studioに1万5000ドルを払うなんて、そもそも選択肢に入らない。
51 海外の名無しさん 2026-09-21 15:54
本当にインパクトを与えるのはM5 Ultra自体じゃなくて、M7やM9の世代だろう。99%の人は無料で使えるAIを使うだけだ。多額の金を払う意思と余裕がある、高度なヘビーユーザーこそが推論コストのコントロールに関心を持つ層になる。今のところM5 Ultraが意味を持つ層はごくわずかだけど、それは今後大きく広がるかもしれない。
52 海外の名無しさん 2026-09-21 16:15
15トークン/秒でね
24 海外の名無しさん 2026-09-21 16:04
忘れちゃいけないのは、RTX5090の消費電力が600W以上あるってこと。それに対してMacはせいぜいその半分くらいじゃないかな?
41 海外の名無しさん 2026-09-21 16:06
たしかに。でも消費電力2倍で性能10倍なら、それだけの価値はあると思う。大抵の場合はね。
25 海外の名無しさん 2026-09-21 15:07
これはありがたい情報。AppleにはTTFT(最初のトークンが出るまでの時間)の改善にもっとシリコン設計を注力してほしいけど、M3 Proから見ても、5090のNvidia製TensorCoreと比べるとまだ見劣りする。Appleが何か買収でもすればこのバランスが変わるかもね。
38 海外の名無しさん 2026-09-21 16:04
確認できた。なんでみんなこれやSparkにあんな大金を払うのか分からない。5090ならQwen 3.8を200tps以上で動かせるんだから!1〜2桁は速い。
53 海外の名無しさん 2026-09-21 16:09
みんな27Bモデルを動かすためにSparkやM5 Ultraを買うわけじゃない。このM5が真価を発揮したQwen NextのようなMoEモデルを動かすために買うんだ。
54 海外の名無しさん 2026-09-21 16:08
セイコーの方が実用性が高いのに、みんな大金を払ってロレックスを買うのと同じ理由だよ(テック業界の人間だって虚栄心とは無縁じゃない)。
40 海外の名無しさん 2026-09-21 16:12
意外なことに、Redditでは32GiBの5090+128GiBのRAM構成で50〜60トークン/秒という報告が上がっていて、PCIeのボトルネックとDDR5の帯域の狭さがあるにもかかわらず、M5 Ultraのベンチマークと同水準になっている(リンク)。(なお、これはアクティブパラメータが6Bしかないスパースなmoeモデルであることに注意)
55 海外の名無しさん 2026-09-21 16:24
参考になった、ありがとう。ただしそれはDDR5 6000のRAMへCPUオフロードした場合の数字で、そのRAMだけで少なくとも3000〜4000ドルはするよ。

他サイトの新着

42 海外の名無しさん 2026-09-21 15:20
Appleのプロセッサロードマップに関する噂では、AI関連の理由でM7世代に集中するために、M6のPro/Max等のバリエーション(これまでの世代は全てProとMaxを持ち、一部はUltraもあった)を飛ばすらしい。M7で具体的に何が改善されるのかは誰にも分からない。(リンク)
56 海外の名無しさん 2026-09-21 15:52
結局それはTSMC次第だと思う。NvidiaがA18かA16ノードを丸ごと予約したらしい。Appleは今2nmで、M7で一気にA14に飛ぶことになる…とAIにざっと調べてもらった限りでは。
64 海外の名無しさん 2026-09-21 16:02
それはAIが生成したもっともらしいデタラメにしか聞こえない。AppleはN2に移行したばかりで、すぐにまた大きな移行をするとは思えない。それにTSMC自身のロードマップを見ても、その『妄想』が現実になるのはどう見ても何年も先のことで、それも年一ペースで製品を出しているところの話だ。(リンク)
43 海外の名無しさん 2026-09-21 15:40
でも5090を8枚InfiniBandでつないだ構成だとどうなるんだろう?価格的にはMacと同じくらいで、大きなMoEモデルの性能では大幅に上回れるんじゃないか?スペースや発熱、騒音の問題があるのは分かるけど、価格面でも思ったほど割に合わないかもしれない。(NVIDIA製ハードウェアの入手が難しいことと、6000 Proの価格競争力が低いことには同意する)
57 海外の名無しさん 2026-09-21 16:27
電気代がとんでもないことになりそうだな。
58 海外の名無しさん 2026-09-21 15:54
すごく格好良さそうだけど、それを実際に組んで維持する人が、モールで買えてお弁当箱サイズに収まる機械と比べてどれだけいるんだろう?
59 海外の名無しさん 2026-09-21 16:02
いや、4万ドルは1万ドルと比較にならないよ。
46 海外の名無しさん 2026-09-21 15:41
HNにはいつもこういう無理やりな反論があるよな。LLMプロバイダーの利用を妨げるような事態が現実的に起こると本気で思っているのか?元のコメントは文字通り12年という意味じゃなくて、Mac miniを代替に使うのがどれだけ高くつくかを示したかっただけじゃないのか?
61 海外の名無しさん 2026-09-21 16:07
民衆による大反乱でデータセンターが焼き払われ、光ファイバーが切断される、とかね。
65 海外の名無しさん 2026-09-21 16:17
そう、まさにそんな感じだよね。最先端の研究所は人類の知の限界を押し広げ、無私の心で人類を暗黒時代から救い出そうとしているというのに。無知な民衆はそれを知らずに現代文明を焼き払おうとする。データセンターと光ファイバーが現代経済の生命線だって分かっていないのか?
47 海外の名無しさん 2026-09-21 14:47
それが皮肉であることを願うよ。
62 海外の名無しさん 2026-09-21 15:19
『鉄壁』ね(笑)

この話題の背景と論点

この記事の論点は大きく二つに分かれる。一つはベンチマークの前提で、Qwen3.8 27Bのような密なモデルではGPUが有利だが、Qwen NextのようなMoE(専門家混合)モデルは総パラメータが大きくてもアクティブ部分は小さいため、メモリ容量の大きいMac Studioの方が動かしやすいという技術的な違いがある。RTX 5090のVRAMは32GBしかなく、256GBのメモリを積んだM5 Ultraとは想定する用途がそもそも異なる。もう一つは費用対効果で、クラウドのAPI利用料と比べて自前のハードウェアが得かという議論は、電気代やモデルの進化速度、GPUの供給不足といった不確定要素が絡むため、単純な損益分岐点の計算では結論が出ていない。

※本記事は5ch(Hacker News)スレッド「M5 Ultra Mac Studio Review: The Dream Mac for Local AI Agents」より抜粋・要約して構成しています。

この記事のリアクション

他サイトの新着

まだコメントはありません。

コメントする

誹謗中傷・個人を特定する書き込みは削除対象です。投稿は承認後に表示されます。

相互リンクサイト新着記事