GLMが独自の推論基盤を構築、価格改定や蒸留疑惑で議論に

姉妹サイトの新着

他サイトの新着

中国のAI企業z.aiが、自社モデルGLM-5.3-Flash向けに10万基以上の中国製AIアクセラレータを使った独自の推論基盤を構築したとブログで発表した。Hacker Newsではこれをきっかけに、コーディングプランの中位料金が月20ドルから80ドル前後へ値上げされた件や、744B規模のGLM-5.3をMacBook ProのSSDストリーミングだけで動かした事例、さらにAnthropicのOpus 4.8から違法に蒸留したのではという疑惑まで、複数の話題に議論が枝分かれした。

GLM、自前の推論基盤を構築

出典: z.ai / 元記事はこちら

2 海外の名無しさん 2026-09-17 10:07
中国製AIアクセラレータ10万基以上のクラスタ上に、本番運用レベルの推論サービスをゼロから構築した。GLM-5.3-Flashの本番推論はすべてこのシステム上で動いている。
9 海外の名無しさん 2026-09-17 10:46
>>2
100兆トークンを無料提供すると発表した時点で、みんな薄々こうなるだろうと予想してたよ。
4 海外の名無しさん 2026-09-17 10:10
みんなのコーディングプランの使い心地を聞こうと思ったんだけど、そもそも料金が大幅に上がってないか?中位プランが今は月80ドル前後になってる気がするけど、前は月20ドルくらいだったよね?今の最安プランが月20ドル前後。こんなに急に値上げしたということは、スケーリングでよほど厳しい壁にぶつかったんだろう。
11 海外の名無しさん 2026-09-17 10:22
>>4
自分はMaxプランを年間360ドルで契約して、フロンティアモデルのGLM-5.3で1日平均10億トークンくらい使ってた。あれは明らかに彼らにとって採算が合わなかったわけで、実際そのプラン自体もう廃止されてる。
12 海外の名無しさん 2026-09-17 10:23
>>4
自分の見方だと、あのコーディングプランはデータを保持せず学習にも使わないから、自分にとってはむしろ安い部類のプランだよ。 https://docs.z.ai/legal-agreement/privacy-policy
13 海外の名無しさん 2026-09-17 10:13
>>4
そう、他社と比べてお得だったのが、割に合わないレベルになった感じ。ちょうどいい落としどころを見つけてほしい。
6 海外の名無しさん 2026-09-17 10:40
同じモデルを別の切り口で見ると、フル版のGLM-5.3(744B、MoE、4bit量子化のexpert、ディスク上434GB)は、メモリに全部載せる代わりにNVMe SSDからexpertをストリーミングすることで、128GB搭載のMacBook Pro M5 Max単体でも動く。SSD1台なら約2 tok/s、4台にストライピングすると出力はビット単位で同一のまま3.5 tok/sまで伸び、まだ未公開のパッチを当てた自分たちの最良の内部ビルドでは4.2 tok/s出ている。手法と数値はこちら: https://github.com/argonautlabsai/argodrive (antirez/ds4がベース)
17 海外の名無しさん 2026-09-17 10:58
>>6
実用にならないくらい遅く感じるけど、それって短いコンテキストの話?
7 海外の名無しさん 2026-09-17 10:17
まあ、Anthropicの有料ユーザー何百万人分ものリクエストをOpus 4.8経由で違法に流して蒸留した、というインフラの話は置いておいて…
18 海外の名無しさん 2026-09-17 11:03
>>7
ダリオ(Anthropic CEO)がそんな利用規約への破滅的な攻撃に苦しめられたとは、涙を禁じ得ないね。
19 海外の名無しさん 2026-09-17 10:45
>>7
個人的にはそれはただのデマだと思う。参考までに、AnthropicやOpenAIは自社モデルの『thinking』トークンの出力を暗号化してるけど、中国系のラボはそうしていない。むしろ実態としては、みんなオープンウェイトモデルを合成学習データの生成パイプラインに使っている可能性の方が高い。トークン列から蒸留するより、logitsから蒸留する方がずっと簡単だからね。 https://x.com/EricSimons/status/2099252922098061714
20 海外の名無しさん 2026-09-17 10:20
>>7
それのどこが『違法』なわけ?
8 海外の名無しさん 2026-09-17 10:35
この記事を読んで真っ先に浮かんだ疑問は『そもそもGLMって何?』ということ。正直z.aiが何なのかも分からない(AI搭載エディタのZedなら知ってるけど、あれはzed.dev)。誰もが自分たちの製品を知ってて当然、という書き方はちょっと図々しいんじゃないかな…
22 海外の名無しさん 2026-09-17 10:55
>>8
世界トップクラスのオープンウェイトLLMってだけの話だよ。 https://artificialanalysis.ai/#intelligence-category-tabs
24 海外の名無しさん 2026-09-17 10:46
>>8
CodexやGemini、Claudeみたいなポジションのモデルファミリーだよ。GLM-5.3-Flashはその中で最新の『軽量・高速』版。
25 海外の名無しさん 2026-09-17 10:41
>>8
『GLMを開発していると、モデルが私たちを驚かせ、時には不安にさせるほどの能力を見せることがある』だって。いやいや、それはさすがに…あと、自社のブログでなんで自己紹介する必要があるんだ?
15 海外の名無しさん 2026-09-17 10:32
>>5
これだけのペースで進化してるのに、それのどこが正気の沙汰じゃないって話になるの?
31 海外の名無しさん 2026-09-17 10:45
>>15
進化のペース自体、もうかなり停滞してるからじゃない?
40 海外の名無しさん 2026-09-17 11:03
>>31
そうそう、ミレニアム懸賞問題が解かれてからもう1週間以上経ってるもんな。AIは完全に壁にぶつかったよ(皮肉)。
42 海外の名無しさん 2026-09-17 10:47
>>31
雰囲気やいい加減なベンチマークじゃなくて、それを裏付けるちゃんとした根拠はあるの?
26 海外の名無しさん 2026-09-17 10:45
>>11
1日10億トークン!? 自分はこの2週間GLM-5.3でかなり作業したつもりだけど、合計でようやく3億トークンを超えたところ。一体何にそんなにトークンを使ってるのか聞いてもいい?
34 海外の名無しさん 2026-09-17 11:11
>>26
この手のモデルの使い方は基本的に二つあって、ペアプログラミングか、完全自動で投げっぱなしのコード生成か。後者はほぼ入力が要らないから、使えるトークン量は実質APIの速度だけで決まるようなもの。
35 海外の名無しさん 2026-09-17 10:52
>>26
たぶんこんな感じのことをしてるんじゃない: https://youtu.be/U-Rqv9dOB1U
36 海外の名無しさん 2026-09-17 10:53
>>26
2週間で3億トークンって意外と少ないね。そんなに少なくて済む使い方って何をしてるの?
28 海外の名無しさん 2026-09-17 10:25
>>12
こういう企業のどこかが法律なんて気にしてると本気で思ってる?彼らが気にしてるのは勝つことと、自己改善するAIを一刻も早く作ることだけだよ。
37 海外の名無しさん 2026-09-17 11:03
>>28
自分のデータを学習に使わないと明言している企業の方が、それすら言わない企業よりは信用できると思ってる。あとMetaが評価されてる理由もそこで、学習ありきの利用に安い料金を設定してるからだよ。
38 海外の名無しさん 2026-09-17 10:29
>>28
自分も懐疑的ではあるけど、乗っかってみるよ。少なくともオープンウェイトの後押しにはなってるし。
29 海外の名無しさん 2026-09-17 10:26
>>13
これは、モデル提供者たちが本当に利益を出さなきゃいけなくなった時に、みんなが払うことになる金額の片鱗に過ぎない。『インフラに10ドルかかるところを1ドルだけ請求する』という時代は急速に終わりつつある。それにGLMも今なおとんでもなく補助金漬けなのは間違いない、AnthropicやOpenAIほど極端じゃないというだけで。
39 海外の名無しさん 2026-09-17 10:35
>>29
それは違う。NeuralwattやFriendliみたいな、推論APIを補助金や赤字覚悟で提供する理由が特にないプロバイダー経由でもGLM 5.3は使える。
47 海外の名無しさん 2026-09-17 11:00
>>39
ただそれはそれで、手を抜いたり過剰に量子化したりする別のインセンティブが生まれる。
30 海外の名無しさん 2026-09-17 10:26
>>13
今どこのプロバイダーを使ってるの?
32 海外の名無しさん 2026-09-17 10:48
>>15
アルゴリズムに置き換えられる程度の仕事だったなら、そもそもどれだけ役に立ってたのって話じゃない?
43 海外の名無しさん 2026-09-17 11:03
>>32
めちゃくちゃ役に立ってたよ。というか変な質問だな。

他サイトの新着

33 海外の名無しさん 2026-09-17 10:27
>>20
Anthropicの利用規約違反であり、ユーザーを欺いてることになる。
44 海外の名無しさん 2026-09-17 10:44
>>33
利用規約違反自体は違法ではない。単にサービス提供を拒否する根拠になったり、事業者側が損害を請求できる条件を定めているだけのもの。
45 海外の名無しさん 2026-09-17 10:38
『法なくして罰なし』ってやつか?(ラテン語の法諺)
49 海外の名無しさん 2026-09-17 10:50
>>42
それ、自分で自分の論点を証明しちゃってない?ASI(人工超知能)を否定する側にベンチマークを求めてるけど、そんなSF的な概念こそ、証明責任は肯定する側にあるべきでしょ。
50 海外の名無しさん 2026-09-17 10:56
>>49
いや、彼が求めてたのは『モデル開発が停滞している』ことを示す信頼できる指標の方だよ。ASIの話をしてるのは君だけ。
51 海外の名無しさん 2026-09-17 11:04
>>50
いや、その人はその程度の飛躍は平気でしてるよ。RSI(再帰的自己改善)っていうのは、SF的なシンギュラリティの新しいマーケティング用語だから。
52 海外の名無しさん 2026-09-17 11:10
>>51
>>進化のペースがかなり停滞してるからじゃない?
>雰囲気やいい加減なベンチマークじゃない根拠はあるの?
この流れは明らかにRSIの話じゃなくて、モデル開発が全般的に停滞しているという話をしてるんだよ。

この話題の背景と論点

GLMは中国のz.aiが開発する大規模言語モデルで、無料枠として100兆トークンを提供するなど普及を優先させてきた経緯がある。今回の値上げは、推論コストを自前インフラで賄う体制へ移行する過程で採算ラインを見直した結果とみられ、実際に年契約のMaxプランなど利用量の多いプランは廃止されている。スレで意見が割れたのは「蒸留疑惑」の扱いで、Anthropicの利用規約違反を指摘する声がある一方、AnthropicやOpenAIが推論過程(thinkingトークン)を暗号化しているため、実際はオープンウェイトモデルの出力を学習データ生成に使う手法の方が一般的だとする反論も出ていた。真偽が確定した話ではない点には注意が必要。また「AI開発が停滞している」という主張も、具体的な根拠が示されないまま議論が続いており、決着はついていない。

※本記事は5ch(Hacker News)スレッド「GLM Built Its Own Inference Infrastructure」より抜粋・要約して構成しています。

この記事のリアクション

他サイトの新着

まだコメントはありません。

コメントする

誹謗中傷・個人を特定する書き込みは削除対象です。投稿は承認後に表示されます。

相互リンクサイト新着記事