中国AI「GLM-5.3-Flash」が話題に 正体は覆面テスト中の「Ox Alpha」だった

中国Zhipu AIが新型言語モデル「GLM-5.3-Flash」を発表し、Hacker Newsで反応が集まった。前モデルGLM-5.2を上回る性能を10分の1の価格で実現したとする発表内容に加え、これまで正体不明として話題だった覆面モデル「Ox Alpha」が実は本モデルだったことが判明し、価格やベンチマークのグラフの見せ方を巡って議論になった。

GLM-5.3-Flash(Zhipu AIが発表した新型AIモデル)

出典: z.ai / 元記事はこちら

3 海外の名無しさん 2026-08-26 14:19
> こんな大量のトラフィックが中国製AIチップで捌かれているとは
Nvidia株主のご冥福をお祈りします
22 海外の名無しさん 2026-08-26 14:38
>>3
米国政府の政策がまた自分の首を絞めた例だね。中国はいずれ半導体の自給自足を実現していたと思うけど、輸出規制がやったことと言えば(1)中国の開発を加速させ、(2)本来NVIDIAやAMDに入るはずだった収益を逃しただけだ。
23 海外の名無しさん 2026-08-26 14:21
>>3
NVIDIA株を空売りできたらよかったのに
25 海外の名無しさん 2026-08-26 14:37
>>3
やった、的中した!(別のスレッドで言ってたやつ)
6 海外の名無しさん 2026-08-26 14:24
> ベンチマークや実際のワークロードでGLM-5.2を上回り、価格は10分の1。コーディングやエージェント系ベンチマークではClaude Opus 4.8に迫るらしい
出典が偏ってるとはいえ、本当ならすごい話だ。GLM 5.2は自分もかなり良い結果だった。
サブスクのページを見ると、一番小さいプランで5.3は週97Mトークンなのに5.3 Flashは292M。10倍とまではいかないね。
28 海外の名無しさん 2026-08-26 14:38
>>6
最近出た少し小型のDSv4 FlashもGLM 5.2相当(かそれに近い)だよ
29 海外の名無しさん 2026-08-26 14:28
>>6
> 出典が偏ってるとはいえ、本当ならすごい話だ。GLM 5.2はかなり良かった
Ox Alphaでの実行結果を見る限り、少なくとも近い性能はある(上回ってはいなくても)。この価格なら間違いなく良い。
7 海外の名無しさん 2026-08-26 14:46
こういう発表を読むときは、グラフをよく見た方がいい。例えば「エージェントコーディング性能(努力レベル別)」のグラフはY軸を0〜20で切ってる。これだとY軸があまり伸びていないせいで、GLM-5.3-Flashが主張以上の伸びを見せたように見える(ビジネス資料でよくある姑息な手口)。
Oxの動作は自分の環境では悪くなかったし、SOTAに近いオープンウェイトモデルが出てきたのはローカルで試したくなる材料になる(VRAMがもっとあればの話だけど)
30 海外の名無しさん 2026-08-26 14:54
>>7
GPT 5.6 Lunaとの比較が意図的に外されてるのも気になる。スコアは低いけど安いモデルだ。MiMo 2.5はもう比較対象として妥当じゃないし
追記: 訂正、Artificial Analysisの散布図にはグレーアウトで載ってた。それより気になるのは、そのグラフのコストがだいぶズレてること。実際のグラフではGLM 5.3 Flashは$0.09なのに、向こうの資料では$0.045になってる…
8 海外の名無しさん 2026-08-26 14:20
読んでない人のために補足すると、これが謎の「Ox Alpha」モデルの正体だった
31 海外の名無しさん 2026-08-26 14:32
>>8
API経由でも今はこう出る。model: stealth/ox-alpha → 404 Not Found「Ox Alphaのステルステストにご参加いただきありがとうございました。このモデルはZAIのGLM-5.3 Flashでした。今すぐこちらで使えます→ openrouter.ai/z-ai/glm-5.3-flash」
32 海外の名無しさん 2026-08-26 14:42
>>8
そうそう、Ox Alphaの性能の良さに『これは新興グループが作ったモデルにしては出来すぎてる』と怪しんでた
9 海外の名無しさん 2026-08-26 14:26
パラメータ数はたった320B。ローカルで動くフロンティアAIが、思ったより早く近づいてきてる。
33 海外の名無しさん 2026-08-26 14:37
>>9
待ち遠しい!
10 海外の名無しさん 2026-08-26 14:32
> 最新の30兆トークンのマルチモーダル事前学習コーパスと組み合わせて…
学習の最適比率って今もモデルパラメータの20倍のトークン数なんだっけ?だとしたら1.5兆パラメータのGLMが出てくるってこと?
11 海外の名無しさん 2026-08-26 14:17
関連: news.ycombinator.com/item?id=49446422 (281ポイント、118コメント)
13 海外の名無しさん 2026-08-26 14:21
記事によると、オープンソースモデルのパレートフロンティアは今やGLMがほぼ独占してるらしい。
37 海外の名無しさん 2026-08-26 14:45
>>13
同じ日に出たQwen3.8-Flash-Nextがどこに落ち着くか気になるところ。面白い時代になったもんだ!
15 海外の名無しさん 2026-08-26 14:18
GLM-5.3-FlashのAPI標準料金(100万トークンあたり)
– 入力: $0.15
– 出力: $0.50
– キャッシュ入力: $0.03
38 海外の名無しさん 2026-08-26 14:20
>>15
DS4 Flashより安いってこと?
44 海外の名無しさん 2026-08-26 14:25
>>38
安いかどうかはともかく、0XAlphaに戻れて正直ホッとした。堂々巡りの推論を何度も繰り返して結局出力が返ってこないこともあるくらい遅かったから。とにかくタスクを終わらせたいなら無料モデルから有料モデルに乗り換えるレベルで、正直どうかしてる。
45 海外の名無しさん 2026-08-26 14:48
>>38
DS4のオフピーク料金より更に安いくらい。DeepSeekもかなりの強敵に直面してるみたいだね
20 海外の名無しさん 2026-08-26 14:22
>>2
> それなりの値段でSparkを4台手に入れた
どこでどうやって買ったのか教えてほしい
40 海外の名無しさん 2026-08-26 14:24
>>20
ASUS GX10の1TBモデルを4台買った。なぜかこのシリーズの中でこれだけ異常な値段が付いてないんだよね。$200引きクーポンで一時的にセールになってたけど、たまに在庫処分でも出てくる。
46 海外の名無しさん 2026-08-26 14:47
>>40
Amazonで1台約$4000、ケーブルが$175。
47 海外の名無しさん 2026-08-26 14:44
>>40
> シリーズの中でこれだけ異常な値段じゃない
$4000が『異常じゃない』の…?うわあ
27 海外の名無しさん 2026-08-26 14:35
>>4
これでM5 Ultra Studioの納期がまた延びそうだ。今でも10〜12週間待ちなのに、これ以上どこまで伸びるんだろう。
43 海外の名無しさん 2026-08-26 14:45
>>27
M3 Ultraの時と同じで、そのうち普通の客は買えなくなりそう。

他サイトの新着

42 海外の名無しさん 2026-08-26 14:23
>>23
今日は決算発表日だからね…
49 海外の名無しさん 2026-08-26 14:29
>>42
それで良かった試しなんて9割ないけどね(株価の反応的に)。
50 海外の名無しさん 2026-08-26 14:27
>>44
ぶっちゃけ無料トークン目当てのアクセスが殺到してたのも遅さの一因だと思う
52 海外の名無しさん 2026-08-26 14:41
>>50
それも影響してたとは思うけど、たぶん別の話。自分が言ってたのは、リクエストの処理の仕方そのもので、やたらループして考え込んでたってこと。
51 海外の名無しさん 2026-08-26 14:46
>>47
合計で$4000だと思ってた。いや違う、1台$4000+税か…。ユーロ換算でも似たようなもんか。うわ。
53 海外の名無しさん 2026-08-26 14:51
>>51
そうそう、あの小さなクラスター、新車のDacia Sandero1台分くらいの値段だよ。

※本記事は5ch(Hacker News)スレッド「GLM-5.3-Flash」より抜粋・要約して構成しています。

この記事のリアクション

他サイトの新着

まだコメントはありません。

コメントする

誹謗中傷・個人を特定する書き込みは削除対象です。投稿は承認後に表示されます。

相互リンクサイト新着記事