GLMが独自の推論基盤を構築、価格改定や蒸留疑惑で議論に
姉妹サイトの新着
他サイトの新着
- 5chまとめMAP映画ちいかわ…146億円で天気の子抜いて歴代21位になるwww
- ニュース速報まとめMAP【ボクシング】まさかの元世界王者が有印私文書偽造で有罪!?薬師寺保栄、何してんねんw
- なんJ傑作まとめアンテナMAP【困惑】藤川球児監督が明言する「自分たちに制限をかけながらする野球」、虎党から叩かれるwwwwwwwwww
- アニメ声優まとめアンテナMAP【画像】トリコの三虎さん、フローゼの服を常時着ている変態だった
- VTuberまとめアンテナMAP【にじさんじ】9/24(木)18:00から、月ノ美兎の誕生日を記念した『誕生日グッズ&ボイス2026』販売決定!
- だめぽアンテナ【悲報】ブラックマジシャンガール、ナーフされるwwwww
- ヌルポあんてな食料品の消費税1%へ→外食は10%のまま…業界から「客離れ」懸念
- 2chまとめアプリ+コンビニの若い女店員に恋をしたんだが
- News人【オーバーロード】AFORCE「オーバーロード」トレフィグ【予約開始】他
- ブルーアンテナ【潤うるる・若月もあ】《エロ動画×人妻・寝取り》可愛い顔して中身は獣な甥っ子たちに拘束されて無限潮吹きさせられる美人叔母
- ウマーあんてな宇都宮行くんやが…
- アナグロあんてな【画像】森山みなみアナ ノースリーブで胸を寄せる!!【GIF動画あり】
- まとめクローラ【朗報】相棒プロデューサー「相棒の歴史が動く」
- 2ちゃんねるアンテナ【正論?】「人に意見を押し付けるな」←でもこれ自体が意見の押し付けじゃね?
- Ask Reddit まとめ海外「バック・トゥ・ザ・フューチャーの2015年に届いたのは、浮かないうえに燃えるホバーボードだった」10年前の“未来”はどこへ…?
- 海外反応・海外ニュースまとめ【海外の反応】ソニーがPS5世代で作った新規IPは4本→うち2本はもう閉鎖済み
- Red4 海外の反応まとめ【海外の反応】「日本はそこまで発展していないと感じた」特定の食習慣に対応する商品の少なさが話題に
- 海外の反応ジャーナル「1941年のウェーク島の戦い(日本軍対アメリカ軍)はこのようなものだった」海外の反応
- ハゲリシャス速報【ハゲ速報】ダイエットで糖尿病治療薬「マンジャロ」使ったマンさんの末路www
- アニメ・漫画アンテナ「キテレツ大百科」で明らかにヤバいキャラクター
中国のAI企業z.aiが、自社モデルGLM-5.3-Flash向けに10万基以上の中国製AIアクセラレータを使った独自の推論基盤を構築したとブログで発表した。Hacker Newsではこれをきっかけに、コーディングプランの中位料金が月20ドルから80ドル前後へ値上げされた件や、744B規模のGLM-5.3をMacBook ProのSSDストリーミングだけで動かした事例、さらにAnthropicのOpus 4.8から違法に蒸留したのではという疑惑まで、複数の話題に議論が枝分かれした。
GLM、自前の推論基盤を構築
出典: z.ai / 元記事はこちら
100兆トークンを無料提供すると発表した時点で、みんな薄々こうなるだろうと予想してたよ。
自分はMaxプランを年間360ドルで契約して、フロンティアモデルのGLM-5.3で1日平均10億トークンくらい使ってた。あれは明らかに彼らにとって採算が合わなかったわけで、実際そのプラン自体もう廃止されてる。
自分の見方だと、あのコーディングプランはデータを保持せず学習にも使わないから、自分にとってはむしろ安い部類のプランだよ。 https://docs.z.ai/legal-agreement/privacy-policy
そう、他社と比べてお得だったのが、割に合わないレベルになった感じ。ちょうどいい落としどころを見つけてほしい。
実用にならないくらい遅く感じるけど、それって短いコンテキストの話?
ダリオ(Anthropic CEO)がそんな利用規約への破滅的な攻撃に苦しめられたとは、涙を禁じ得ないね。
個人的にはそれはただのデマだと思う。参考までに、AnthropicやOpenAIは自社モデルの『thinking』トークンの出力を暗号化してるけど、中国系のラボはそうしていない。むしろ実態としては、みんなオープンウェイトモデルを合成学習データの生成パイプラインに使っている可能性の方が高い。トークン列から蒸留するより、logitsから蒸留する方がずっと簡単だからね。 https://x.com/EricSimons/status/2099252922098061714
それのどこが『違法』なわけ?
世界トップクラスのオープンウェイトLLMってだけの話だよ。 https://artificialanalysis.ai/#intelligence-category-tabs
CodexやGemini、Claudeみたいなポジションのモデルファミリーだよ。GLM-5.3-Flashはその中で最新の『軽量・高速』版。
『GLMを開発していると、モデルが私たちを驚かせ、時には不安にさせるほどの能力を見せることがある』だって。いやいや、それはさすがに…あと、自社のブログでなんで自己紹介する必要があるんだ?
これだけのペースで進化してるのに、それのどこが正気の沙汰じゃないって話になるの?
進化のペース自体、もうかなり停滞してるからじゃない?
そうそう、ミレニアム懸賞問題が解かれてからもう1週間以上経ってるもんな。AIは完全に壁にぶつかったよ(皮肉)。
雰囲気やいい加減なベンチマークじゃなくて、それを裏付けるちゃんとした根拠はあるの?
1日10億トークン!? 自分はこの2週間GLM-5.3でかなり作業したつもりだけど、合計でようやく3億トークンを超えたところ。一体何にそんなにトークンを使ってるのか聞いてもいい?
この手のモデルの使い方は基本的に二つあって、ペアプログラミングか、完全自動で投げっぱなしのコード生成か。後者はほぼ入力が要らないから、使えるトークン量は実質APIの速度だけで決まるようなもの。
たぶんこんな感じのことをしてるんじゃない: https://youtu.be/U-Rqv9dOB1U
2週間で3億トークンって意外と少ないね。そんなに少なくて済む使い方って何をしてるの?
こういう企業のどこかが法律なんて気にしてると本気で思ってる?彼らが気にしてるのは勝つことと、自己改善するAIを一刻も早く作ることだけだよ。
自分のデータを学習に使わないと明言している企業の方が、それすら言わない企業よりは信用できると思ってる。あとMetaが評価されてる理由もそこで、学習ありきの利用に安い料金を設定してるからだよ。
自分も懐疑的ではあるけど、乗っかってみるよ。少なくともオープンウェイトの後押しにはなってるし。
これは、モデル提供者たちが本当に利益を出さなきゃいけなくなった時に、みんなが払うことになる金額の片鱗に過ぎない。『インフラに10ドルかかるところを1ドルだけ請求する』という時代は急速に終わりつつある。それにGLMも今なおとんでもなく補助金漬けなのは間違いない、AnthropicやOpenAIほど極端じゃないというだけで。
それは違う。NeuralwattやFriendliみたいな、推論APIを補助金や赤字覚悟で提供する理由が特にないプロバイダー経由でもGLM 5.3は使える。
ただそれはそれで、手を抜いたり過剰に量子化したりする別のインセンティブが生まれる。
今どこのプロバイダーを使ってるの?
アルゴリズムに置き換えられる程度の仕事だったなら、そもそもどれだけ役に立ってたのって話じゃない?
めちゃくちゃ役に立ってたよ。というか変な質問だな。
他サイトの新着
Anthropicの利用規約違反であり、ユーザーを欺いてることになる。
利用規約違反自体は違法ではない。単にサービス提供を拒否する根拠になったり、事業者側が損害を請求できる条件を定めているだけのもの。
それ、自分で自分の論点を証明しちゃってない?ASI(人工超知能)を否定する側にベンチマークを求めてるけど、そんなSF的な概念こそ、証明責任は肯定する側にあるべきでしょ。
いや、彼が求めてたのは『モデル開発が停滞している』ことを示す信頼できる指標の方だよ。ASIの話をしてるのは君だけ。
いや、その人はその程度の飛躍は平気でしてるよ。RSI(再帰的自己改善)っていうのは、SF的なシンギュラリティの新しいマーケティング用語だから。
>>進化のペースがかなり停滞してるからじゃない?
>雰囲気やいい加減なベンチマークじゃない根拠はあるの?
この流れは明らかにRSIの話じゃなくて、モデル開発が全般的に停滞しているという話をしてるんだよ。
この話題の背景と論点
GLMは中国のz.aiが開発する大規模言語モデルで、無料枠として100兆トークンを提供するなど普及を優先させてきた経緯がある。今回の値上げは、推論コストを自前インフラで賄う体制へ移行する過程で採算ラインを見直した結果とみられ、実際に年契約のMaxプランなど利用量の多いプランは廃止されている。スレで意見が割れたのは「蒸留疑惑」の扱いで、Anthropicの利用規約違反を指摘する声がある一方、AnthropicやOpenAIが推論過程(thinkingトークン)を暗号化しているため、実際はオープンウェイトモデルの出力を学習データ生成に使う手法の方が一般的だとする反論も出ていた。真偽が確定した話ではない点には注意が必要。また「AI開発が停滞している」という主張も、具体的な根拠が示されないまま議論が続いており、決着はついていない。
※本記事は5ch(Hacker News)スレッド「GLM Built Its Own Inference Infrastructure」より抜粋・要約して構成しています。






まだコメントはありません。