話題
2026年9月10日
DeepSeek新型Flash、旧Proより高性能・安価に 無断切替に賛否
DeepSeekは2026年9月10日(北京時間)、新モデル「V4.1 Flash」を正式リリースすると発表した。性能・コスト・速度のすべてで従来の上位モデル「V4 Pro」を上回ったとして、Proへのリクエストは当面すべてFlashに自動転送され、Flashの安い料金で課金される仕様になる。この告知はHacker Newsで大きな反応を呼び、「有料で使い込んだProを勝手に差し替えるのは顧客軽視だ」という批判と、「非決定的なLLMのバージョンに固執する方がおかしい」という擁護論がぶつかった。あわせて、オフピークとピークで2倍差がある価格体系の読み違いや、他の中国製軽量モデルとの比較、言語が勝手に切り替わる不具合の指摘など、話題は多方面に広がった。
4
海外の名無しさん
2026-09-09 11:53
出典はどうやらhttps://platform.deepseek.com/usage のバナー告知のようだ。数分探し回ってしまった…
52
海外の名無しさん
2026-09-09 12:17
>>4 投稿の最初に貼ったつもりだったんだけど。コピペするときに見落としたみたい!
6
海外の名無しさん
2026-09-09 13:34
「Proへのリクエストはすべて V4.1 Flashにルーティングされ、Flashの価格で課金される」…もし自分がProに対して丁寧にプロンプトを調整・最適化していたら、このニュースは正直あまり嬉しくない。APIのモデル提供元は、新モデルがどれだけ「良く」なろうとも、お金を払っている顧客のモデルを勝手に差し替えるべきではないと思う。
53
海外の名無しさん
2026-09-09 15:52
>>6 容量(キャパシティ)の問題か何かでこうしてるんだと思う。Proは後で再開すればいいだけだし、その間は既存のFlashモデルをちょっとベンチマーク盛りして表向きの理由にしている。既存のPro利用者に影響が出ないなんて考えるほど呑気ではないはずだが</陰謀論>
54
海外の名無しさん
2026-09-09 13:38
>>6 でもある企業が、中国の得体のしれないヘッジファンド系のAPIを重要な業務フローの中心に据えると決めたなら、それは早めに学んでおいたほうがいい教訓だ。
7
海外の名無しさん
2026-09-09 12:37
ここ数カ月、自分のニーズにはほぼ中国製の「flash」系モデルしか使っていない。快適だし、1回の応答あたりのコストも小銭程度で済む。よくやってくれている。
55
海外の名無しさん
2026-09-09 16:05
>>7 そうそう、最近の256GB未満で動く中国製モデル群は本当に良くなっている。Claudeより素っ気なくないし、Opusにかなり近いくらい優秀。サブスクを全部解約して中国製モデルをローカルで動かすようにした(節約のためではなく)。
56
海外の名無しさん
2026-09-09 12:47
>>7 自分は正直、他のどのフロンティアモデルよりもこのリリースの方が楽しみだ。新しい数学を発明できるようなモデルは要らない。速くて、安くて、安定して動くものが欲しい。それさえあれば作って拡張していける。
59
海外の名無しさん
2026-09-09 13:19
>>7 最近、自分のハーネスをカスタマイズして、Astraがサイバーセキュリティ関連のフラグを立てたらFlashに処理を回すようにした。Astraはゲーム内のUDPパケットの話をするだけで及び腰になるので。うまく機能している。フロンティア勢が神経質すぎるときに頼れる、もう少し「検閲の緩い」ものがあるのはありがたい。
8
海外の名無しさん
2026-09-09 14:01
ベータテスターの報告では400TPS超えとのこと。https://www.geeky-gadgets.com/deepseek-v4-1-flash-review/ この速度向上が本番環境にもそのまま反映されるといいんだが。
61
海外の名無しさん
2026-09-09 14:03
>>8 それこそがDeepSeekの本当の強みになるはず。他の中国製モデルは軒並み遅いから。
10
海外の名無しさん
2026-09-09 12:13
オープンウェイトで、今のv4 flash visionと同じアーキテクチャ・サイズだといいな。あれはおそらく128GBのデバイスで動かせる最良のLLMだと思う。
64
海外の名無しさん
2026-09-09 12:26
>>10 それは意外。てっきり大きすぎて載らないと思っていた。どの量子化(quant)とコンテキストサイズで動かしてる?
19
海外の名無しさん
2026-09-09 12:08
このペースでFlashが前世代のProを追い越し続けてくれるなら、いい時代になりそうだ
70
海外の名無しさん
2026-09-09 13:54
>>19 AnthropicやOpenAIが蒸留対策(anti-distillation)を強化してくるかもしれないけどね。
20
海外の名無しさん
2026-09-09 12:22
v4 proはまともな出来だったのに、もう安くて速い上位互換が出てくるのか?消費者としては、自分がヘンゼルとグレーテルで、DeepSeekが(お菓子の家で誘い込む)魔女に見えてくる。
71
海外の名無しさん
2026-09-09 12:34
>>20 前例がないわけじゃない。GLM 5.3 FlashもGLM 5.2より良くて安かった。
72
海外の名無しさん
2026-09-09 12:44
>>20 自分の個人プロジェクトの大半ではv4 flashが十分うまく機能していて、一番複雑なタスクや(バイブコーディングの)全体進捗チェックのときだけv4 proやKimi 3を使う程度。
28
海外の名無しさん
2026-09-09 13:13
それで、visionには対応するのか?(deepseek-v4-flash-vision-expベース?)
74
海外の名無しさん
2026-09-09 14:12
>>28 もうAPI上でdeepseek-v4.1-flash-expires-on-0910としてvision付きで使えるよ。
31
海外の名無しさん
2026-09-09 12:59
でも誰も触れていないのは、価格が0.16ドルから0.60ドルに上がっているという点。つまりほぼ4倍値上げしてるってこと。
75
海外の名無しさん
2026-09-09 13:41
>>31 _aavaa_も言ってるけど、比較する数字がちゃんと対応しているか確認したほうがいい。キャッシュヒット、キャッシュミス、出力トークンでそれぞれ別料金だから。オフピーク時で見ればむしろ安くなっている。ピーク時はオフピークの2倍というのは確かに割高だけど、それは今後下がっていくかもしれない。
76
海外の名無しさん
2026-09-09 13:01
>>31 何の話をしてるんだ?現行のFlashの出力価格は0.66ドルで、それが0.60ドルに下がるんだが。
32
海外の名無しさん
2026-09-09 13:32
これがGLM 5.3 flashを超えるなら、即決で使う
77
海外の名無しさん
2026-09-09 14:08
>>32 超えると思う。プレビュー後のds4-flashもすでに十分優秀だったし、自分の体感ではGLM 5.3 flashより知的だった。
34
海外の名無しさん
2026-09-09 14:47
>>2 普段ならすごく同意するところだけど、そもそもこの手のものは決定論的じゃないんだから、それが問題になるなら選び方自体が間違っているんじゃないかな。
79
海外の名無しさん
2026-09-09 15:55
>>34 サイコロを振るのも非決定論的だ。6面ダイスを8面ダイスに差し替えても、やっぱり非決定論的なことに変わりはない。だからといって、ゲームの途中でサイコロをすり替えていいことにはならない。
36
海外の名無しさん
2026-09-09 14:24
>>2 計算資源(コンピュート)が必要なんだと思う。同じ計算資源でユーザーを増やせればシェアを広げられるから。とはいえ言いたいことには同意する。自分もv4-flash-0731でうまく動いていた雑なワークフローがあって、たぶん今は新しいモデルにルーティングされていて、それが壊れている気がする。
83
海外の名無しさん
2026-09-09 14:56
>>36 4.1のリリースは明日だから、今はまだ同じ旧モデルが使われているはずだよ。
38
海外の名無しさん
2026-09-09 15:29
>>2 LLMはただでさえワークフローに十分な非決定性を持ち込むのに、ユーザーに知らせずにモデルを差し替えると、それがさらに大きく積み増しされる。
84
海外の名無しさん
2026-09-09 15:32
>>38 ROIを求めるものを何であれクラウドモデルに依存させるのは、緩んだ首吊り縄を自分の首にかけるようなものだ。
42
海外の名無しさん
2026-09-09 14:53
>>2 そもそもLLMの本番ビルド番号を、プロダクトチェーンの中で固定できる静的な依存関係だと考えること自体が無理筋だから、これは問題にすらならない。
85
海外の名無しさん
2026-09-09 15:18
>>42 いや、固定して考えるべきだし、そうすべきだ。プロバイダーはモデルのサポート終了時期についてSLAを定めていて、これはLLM以前のAPIでも昔からずっとそうだった。例えばhttps://platform.claude.com/docs/en/about-claude/model-depre… やhttps://developers.openai.com/api/docs/deprecations を見てほしい。
86
海外の名無しさん
2026-09-09 14:58
>>42 こういうコメントを見ると、本番アプリケーションでこれらのモデルを実際に運用したことがない人だとすぐ分かる。
43
海外の名無しさん
2026-09-09 14:58
>>3 Flash系のLLMは全部この問題を抱えている。Geminiもそう。新しいチャットを始めてドイツ語で書くと、急に英語で返してくることがある。無料版のChatGPTでもポーランド語で書いたら急に英語になった。
87
海外の名無しさん
2026-09-09 15:19
>>43 Redditでも同じ現象を見かける。ボットアカウントが突然ドイツ語やフランス語、イタリア語でコメントして、それに反応する別のボットアカウントも気にせず英語で返信する。まるでそれが一番自然なことであるかのように。
44
海外の名無しさん
2026-09-09 12:51
>>3 自分もこれにハマったことがあるけど、「in English」と付け加えれば誘導できるよ
88
海外の名無しさん
2026-09-09 14:22
>>44 何カ月も色々試したけど、結局昨日アプリをアンインストールした。昨日、「DeepSeekは誤って中国語で答えてしまう問題を修正したか?」と聞いたら、中国語で返してきた。
45
海外の名無しさん
2026-09-09 13:53
>>3 ウェブチャットだけの話じゃない。V4 Flash 7/31はコーディングハーネスの中でも、無限ループ、幻覚、途中終了、無効なツール呼び出しなど、かなり問題のある挙動を起こす。
90
海外の名無しさん
2026-09-09 14:00
>>45 自分はompでV4 FlashをDeepSeek経由で使っていて、そういう問題には遭遇していない。どのコーディングハーネスと推論プロバイダーを使ってる?
この話題の背景と論点
DeepSeekは中国のヘッジファンドHigh-Flyer系列のAI企業で、無料に近い価格と高速な応答を売りにする「Flash」系モデルと、より高性能な「Pro」系モデルを併売してきた。今回話題になったのは、新型Flashが旧Proの性能を上回った結果、Proへのリクエストを黙ってFlashに転送し、Flash料金で課金するという運用方針で、スレではこの「無断切替」の是非が最大の争点になった。OpenAIやAnthropicはモデル廃止時期を事前告知するSLAを公開しており、それとの対比で「本番運用でモデルバージョンに依存するのは間違い」派と「SLAがある以上依存して当然」派が割れている。また価格表示を巡っては、オフピーク単価とピーク単価(2倍)の見落としから一時「実質値上げでは」という誤読も広がった。なお回答が英語チャットの途中で急に中国語や他言語に切り替わる不具合は、DeepSeekに限らず軽量なFlash級モデル全般で報告されている既知の傾向で、この点はスレ内でも複数人が経験を共有していた。
※本記事は5ch(Hacker News)スレッド「DeepSeek launching v4.1 flash cheaper and more capable than v4 pro」より抜粋・要約して構成しています。
この記事のリアクション
まだコメントはありません。