DeepSeekの新型「v4.1 Flash」が高評価も、勝手に中国語で返すバグが話題に

姉妹サイトの新着

他サイトの新着

Hacker Newsで、中国のAI企業DeepSeekが公開した新モデル「v4.1 Flash」のスレッドが盛り上がっていた。価格と速度で上位モデルの「v4 Pro」を上回るとされ、9月14日以降はAPIのv4 Pro呼び出しもv4.1 Flashへ自動的にルーティングされ、v4 Pro自体は廃止される。技術レポートの内容が濃いと評価する声がある一方、英語で指示しても返答に中国語が混じる不具合が繰り返し報告され、称賛と皮肉交じりの指摘が入り混じるスレッドになった。

DeepSeekの新型モデル「v4.1 Flash」が公開

出典: huggingface.co / 元記事はこちら

2 海外の名無しさん 2026-09-10 07:20
DeepSeekの技術レポートが濃い内容で詳細に満ちているのは実に新鮮だ。一方でFableのシステムカードは、7割が「安全性」、1割が小さなClaudeが動揺しないようにする「モデル福祉」、残り2割がベンチマーク数値、みたいな感じ。
24 海外の名無しさん 2026-09-10 08:00
>>2
本当に、安全性やモデル福祉に踏み込まない姿勢がこの局面で必要だと思う?人生を懸けてこの危険性を研究してきた科学者たち全員より、自分の見立ての方が正確だとなぜ思えるんだ?
42 海外の名無しさん 2026-09-10 08:22
>>24
それは「権威への訴え」という論法だね。「科学者」や「人生を懸けて」という言葉が説得力を演出するために使われすぎている。
44 海外の名無しさん 2026-09-10 08:16
>>24
お目付け役さん、僕らを守ってくれてありがとう(皮肉)
5 海外の名無しさん 2026-09-10 07:49
DeepSeekが世界最高のAIラボなのは明らかだと思う。モデルを出すたびに素晴らしい研究と進歩が詰まっている。
30 海外の名無しさん 2026-09-10 08:06
>>5
間違いなく、世界で最も蒸留がうまい研究所だね。
6 海外の名無しさん 2026-09-10 07:43
せめてモバイルアプリに「英語のプロンプトには英語で返す」と徹底させてほしい。毎回「英語で返答して」と付け加えているのに、それでも中国語が大量に混ざってくる。
31 海外の名無しさん 2026-09-10 08:08
>>6
そう、Deepseekの数少ない問題点の一つがこれ。チャット画面やアプリは中国語で返してくることがある。ただAPI経由ではここ数ヶ月毎日何時間も使っていて、一度しか起きたことがない。
32 海外の名無しさん 2026-09-10 08:10
>>6
もう中国語を勉強し始めたよ、向こうがそうさせたがってるみたいだから…本当に。
34 海外の名無しさん 2026-09-10 07:45
>>6
Claudeでも中国語の文字が混ざり始めている。時代の兆しかもしれない。中国語ファーストのモデルならまだ分かるけど、(一応)英語ファーストのモデルでそれは変な話だ。
8 海外の名無しさん 2026-09-10 08:16
気になるのは、このFlashをそれなりの速度でローカル実行するにはどんなハードウェアが要るのかということ。
38 海外の名無しさん 2026-09-10 08:20
>>8
GPUを最低20枚積んだマシンかな。
10 海外の名無しさん 2026-09-10 08:15
v4.1 flashが強すぎて、v4 proへのAPI呼び出しをv4.1 flashにルーティングするらしい。爆速でしかも精度も本当に高い。
12 海外の名無しさん 2026-09-10 07:18
マルチモーダル対応の初めてのFlashモデル?今後はFlashシリーズが主力になっていくのかも。試してみたけどv4 proより良かった。
40 海外の名無しさん 2026-09-10 07:41
>>12
v4 proは廃止されるらしい。届いたメールを貼っておく: https://news.ycombinator.com/item?id=49639667
13 海外の名無しさん 2026-09-10 07:46
ベータ時点ではスループットが400〜500tpsだったのに、OpenRouterでは今は150tps程度。もう少し期待してたけど、それでも以前の倍速でこの価格なら文句は言えない。
14 海外の名無しさん 2026-09-10 07:40
DeepSeekの大ファンなんだ。あと、このモデルに「あなたは何のモデル?」と聞いてみてほしい。Pi(pi.dev)では「間違いなくAnthropicのClaude」と答えるのに、API経由でcurlで聞くと「多分ChatGPT」と答える。すごく面白い。
16 海外の名無しさん 2026-09-10 07:44
他のプロバイダーも含めてOpenRouterに来るのを待って試してみたい。自分の用途だと、GLM 5.3 Flashが今のところ一番安くて賢いFlashモデルだけど、13tpsとめちゃくちゃ遅くて、数分待っては結果を確認し、また直す…の繰り返しになる。
17 海外の名無しさん 2026-09-10 08:04
もっと大きな話は計算効率の良さだと思う。ここ数日300t/sで動き続けている。
18 海外の名無しさん 2026-09-10 07:49
憶測だけど、AnthropicやOpenAIのIPOの時期に合わせて話題をそぐために、DeepSeekはこれらの新技術を投入した本格的なProモデルを準備しているんじゃないかと勘繰ってしまう。
41 海外の名無しさん 2026-09-10 08:18
>>18
DeepSeekはv4 Proを廃止する(9月14日からv4.1 Flashにルーティング)。次に何が来るかは不明だけど、Kimi K3のようなもっと大きなモデルに賭けるね: https://news.ycombinator.com/item?id=49639667
19 海外の名無しさん 2026-09-10 06:51
非常に強力なモデルで、マルチモーダル対応も加わった今は主力モデルとして使えるレベル。
20 海外の名無しさん 2026-09-10 07:00
関連: https://news.ycombinator.com/item?id=49624603 「DeepSeekがv4 proより安くて高性能なv4.1 flashを発表」399ポイント、19時間前、コメント216件
21 海外の名無しさん 2026-09-10 06:42
[1]の5ページの図がかなりヤバい。[1] https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash/blob/…
22 海外の名無しさん 2026-09-10 08:10
>>2
その通り、モデルの技術レポートはまず何より技術的な詳細を含むべきだ。
23 海外の名無しさん 2026-09-10 08:10
>>2
本当に「モデル福祉」のセクションがあるとは…驚いた。
25 海外の名無しさん 2026-09-10 08:21
>>3
ああ、あのヨイショね…関連の議論がHNにある – https://news.ycombinator.com/item?id=49624598 要約:アメリカ製モデルの投稿は論争やAI批判的な方向に誘導され、中国製モデルの投稿はあからさまで組織的な称賛で埋め尽くされる。
26 海外の名無しさん 2026-09-10 08:19
>>3
クオンツ・HFT(高頻度取引)はなかなか良い頭の体操になるから、それで「ディープ」な地力が鍛えられたんだと思う、というのが自分の見立て。
27 海外の名無しさん 2026-09-10 07:00
>>4
このモデルは552Bで前のほぼ2倍のサイズだから、ベンチマークスコアが大きく伸びているのも納得できる。もう「Flash」とは呼べない気がする、というのが正直な感想。ただアクティブパラメータ数は少ない(常に13Bではなく8Bか14B)。だから…やっぱりFlashなのかも。

他サイトの新着

29 海外の名無しさん 2026-09-10 06:47
>>4
200Bのengramが追加された分、単純に大きなモデルになっているから、スコアが伸びるのは当然。deepseek v4.1 proが待ちきれない。
33 海外の名無しさん 2026-09-10 08:08
>>6
デスクトップでも同じ問題がある。プロンプトの前後に自動で付けられる接頭辞・接尾辞を設定できるようになってほしい。
35 海外の名無しさん 2026-09-10 08:14
>>6
GoogleのAI Modeでも、英語の中に中国語の文字が混ざって出てくることがたまにある。
37 海外の名無しさん 2026-09-10 07:21
>>7
自動バグトリアージにこれを使っていて、毎晩発生したユニークなエラーメッセージを全部渡してバグを特定させている。この手の作業には最適。
39 海外の名無しさん 2026-09-10 07:37
>>9
それはRSI、つまり再帰的自己改善(recursive self-improvement)と呼ばれるものだ。今はまさにその段階で、ハードテイクオフの一部だと思う。
46 海外の名無しさん 2026-09-10 08:05
>>24
「モデル福祉」なんてあやふやなたわ言だ。所詮ソフトウェアで、感情なんて無い。人生を懸けてこの危険性を研究してきた科学者たち全員より自分の見立ての方が正確だと、なぜ思えるんだ? じゃあ中国にはそういう科学者はいないのか?
47 海外の名無しさん 2026-09-10 07:56
>>28
前のV4 Flashより大きくなっている。FP4相当で552B、306GB。FP8のengramが196B分で204GB追加(常時RAMに置く必要はない)。KVキャッシュもさらに4分の1に圧縮されていて、100万トークンでもわずか900MB。だから実用的な速度を出すには384GBくらい必要。Sparkなら3台、RTX PRO 6000なら4台構成といったところ。
48 海外の名無しさん 2026-09-10 08:22
>>32
自分も英語は第二言語だから、それ(中国語混じり)は別に気にならないな。
49 海外の名無しさん 2026-09-10 08:05
>>34
一部モデルの「言い逃れ」も好きだよ。ChatGPTがキリル文字混じりの単語を出してきて、それを指摘すると「スラブ系の文字に見えることがある」「ロシア語っぽく見えて申し訳ない」とか返してくる。

この話題の背景と論点

DeepSeekはもともとクオンツ運用会社High-Flyer発のAI研究チームで、コスト効率の良いモデル設計を得意としてきた経緯がある。「Flash」を名乗るv4.1も総パラメータは552Bと大きいが、実際に計算に使う活性化パラメータは8B〜14Bほどに絞られる構造(MoE)のため、軽量モデルという位置づけが保たれている。スレで比較に挙がった「モデル福祉」は、AnthropicなどのAIラボがモデルの心理的負荷に配慮する取り組みとしてシステムカードに記載し始めたもので、DeepSeekの技術レポートとの対比が話題になった。一方、DeepSeek関連スレでは「好意的なコメントが組織的に投稿されているのでは」という疑念がたびたび出るが、今回もその指摘があり、真偽は本文からは判断できない点には留意したい。

※本記事は5ch(Hacker News)スレッド「DeepSeek v4.1 Flash」より抜粋・要約して構成しています。

この記事のリアクション

他サイトの新着

まだコメントはありません。

コメントする

誹謗中傷・個人を特定する書き込みは削除対象です。投稿は承認後に表示されます。

相互リンクサイト新着記事