格安AI「GLM-5.3-Flash」がSonnet 5に迫る性能で海外掲示板が沸く

新しいAIモデル「GLM-5.3-Flash」が1Mトークンあたり0.075〜0.25ドルという安さで登場し、海外の技術系掲示板で話題になった。ベンチマーク上ではAnthropicの高価格帯モデル「Sonnet 5」に迫る性能を示しているとされ、価格対性能比を巡って賛否が分かれている。

一方で「スコアが100点じゃなければ意味がない」という懐疑的な意見や、「pareto frontier」という言葉が最近やたら使われるようになったことへの違和感を語るレスもあり、スレは単なる新モデル紹介から評価指標そのものへの議論に広がった。

1 海外の名無しさん 2026-08-26 17:18
ピンクの枠内にあるモデルは、GLM-5.3-Flashのせいで軒並みオワコンだ
5 海外の名無しさん 2026-08-26 17:26
>>3
100万トークンあたり0.075〜0.25ドルで、Sonnet 5のmax effortを完全に凌駕してる
格安AI「GLM-5.3-Flash」がSonnet 5に迫る性能で海外掲示板が沸く
6 海外の名無しさん 2026-08-26 17:27
>>5
エージェント用途だと、スコアの差はさらに開いてこっちが有利
格安AI「GLM-5.3-Flash」がSonnet 5に迫る性能で海外掲示板が沸く
23 海外の名無しさん 2026-08-26 18:37
>>5
>>6
まだ試せてないけど、本当にそこまで良いならまた大手(FAGMAN)にとっての天安門級の衝撃ってことだな
格安AI「GLM-5.3-Flash」がSonnet 5に迫る性能で海外掲示板が沸く
28 海外の名無しさん 2026-08-26 19:17
200〜400GBの高速メモリでも持ってない限り、どのみちサーバー上で動くモデルの話をしてるんだよな。
Luna(max)の方が安くてDeepSWEスコアも上だし、
Gemini 3.7 flash(medium)の方が速くてDeepSWEスコアも上。
>>18
>このモデルは実際良いのか
DS0731からは改善してるけど、OAIのサブスクには絶対勝てない
8 海外の名無しさん 2026-08-26 17:30
スコアが100点じゃない限りこんなのどうでもいい。そしてどうせ100点にはならない
9 海外の名無しさん 2026-08-26 17:32
>>4
いや、やっぱ考え直した。これ普通に悪くないわ
13 海外の名無しさん 2026-08-26 17:37
定義上、フロンティアライン上にないものは全部『最適ではない』んだよ。このグラフの仕組み自体がそうなってる。あの四角を書き足す意味も、値引き価格でイキる意味も正直分からん
15 海外の名無しさん 2026-08-26 17:52
>>13
>要するに『1Mトークン0.25ドルでほとんどのことは十分こなせる、ちょっと劣るモデル』を試すくらいなら、予算全部を1Mトークン50ドルのAnthropicモデルに突っ込めってことか
27 海外の名無しさん 2026-08-26 18:58
>>13
>定義上、フロンティアライン上にないものは全部最適ではない
その理屈、人生の他のことにも当てはめてるのか?
もし自分が量産型Webサービスの会社を持ってたら、年収6万ドルの適当なエンジニアを雇うのか、それとも数年前にMetaから数十億ドル規模の契約を取った、より優秀なプログラマーを引き抜くのか?
14 海外の名無しさん 2026-08-26 17:50
>>1
ベンチマークもどきのゴミ(BENCHODESLOP)
17 海外の名無しさん 2026-08-26 17:59
>>1
>GEMINI 3.7
いやああ何日も思わせぶりな投稿してたのに
Google信者、一体どうなってんだ
18 海外の名無しさん 2026-08-26 18:05
>>1
で、このモデルは実際良いのか、それともベンチマーク特化(ベンチマックス)なだけなのか?
モデルをどこまで小さく安くしても、今のSOTA並みの性能を保てるのか気になる
19 海外の名無しさん 2026-08-26 18:19
>>18
問題は、今の市場がいわゆる『glowie(諜報機関がらみ)』の資金でかなり歪んでるせいで、効率化が経済的に意味を持つまでにはまだ時間がかかるってこと。
そのせいで小型モデルを作るインセンティブが失われてる
20 海外の名無しさん 2026-08-26 18:24
Gemmaの名前出た!
21 海外の名無しさん 2026-08-26 18:29
>>1
またしても『vibeGOD』の勝利
22 海外の名無しさん 2026-08-26 18:32
>>19
Cohereっていう、学習も推論も効率重視のモデルに力を入れてる会社があるけど、あそこも北極圏用ドローンのエッジAI判断システムが欲しいカナダの諜報機関がらみの資金が入ってるんだよな
24 海外の名無しさん 2026-08-26 18:42
>>1
>fp8チェックポイントで306GB
MoEモデルなのは分かるけど、これはさすがにローカルで動かせる代物じゃないな。
今さら聞くのもあれだけど、『ロールプレイ』に強いエキスパートだけ抜き出す方法とかないのか? それとも、全エキスパートが揃ってないと正常に動かないタイプのMoEなのか?
26 海外の名無しさん 2026-08-26 18:47
>>24
>ローカルで動かせない
スパース(sparx)なGPUでも何台か買えばいいだけだろ
25 海外の名無しさん 2026-08-26 18:44
>>1
>OpusがFableより上
www

他サイトの新着

29 海外の名無しさん 2026-08-26 19:29
>>28
(画像を貼るだけの投稿)
格安AI「GLM-5.3-Flash」がSonnet 5に迫る性能で海外掲示板が沸く
30 海外の名無しさん 2026-08-26 19:32
>>29
>回答拒否してもペナルティなし
Anthropicは『Reactでゴミみたいな一般消費者向けランディングページを作れ』程度以上の依頼をすると、モデルにユーザーをハッキング呼ばわりさせることでベンチマークを盛ってるんだろ
31 海外の名無しさん 2026-08-26 19:42
>>2
そうだな、maxバージョンはローカルじゃ絶対動かせない
ただ27bバージョンなら、ミドルレンジのゲーミングPCでもたぶん動く
32 海外の名無しさん 2026-08-26 19:45
>>2
>Qwen3.8 Max
>2.4兆トークン
でも今日出たばかりのQwen3.8 Flash Nextはベンチマークがかなり良くて、ここの結構な人数にとって現実的に動かせるサイズなんだよな
34 海外の名無しさん 2026-08-26 20:15
>>1
>Luna maxが赤枠のギリギリ内側
まあ、それなりに悪くない
35 海外の名無しさん 2026-08-26 21:06
>>1
>pareto frontier
この言葉、最近やたら見かけるけど何か理由あるのか? 2024年より前は聞いたこともなかったのに、今じゃ毎月見る
37 海外の名無しさん 2026-08-26 21:12
Googleは自分たちで恥をさらしてるな。このペースじゃ新型Proは一生出ない
38 海外の名無しさん 2026-08-26 21:39
Qwen 3.7のmaxとplusをよく使ってる。いろんなプラットフォームでタダで使えるし、普通に良いモデルで変な返しもしてこない

※本記事は海外掲示板 4chan /g/ (Technology) のスレッド「New LLM Nuke Just Dropped」から抜粋し、編集部で日本語に意訳したものです。訳文の責任は当サイトにあります。

この記事のリアクション

他サイトの新着

まだコメントはありません。

コメントする

誹謗中傷・個人を特定する書き込みは削除対象です。投稿は承認後に表示されます。

相互リンクサイト新着記事