DeepSeekの新型「v4.1 Flash」が高評価も、勝手に中国語で返すバグが話題に
姉妹サイトの新着
他サイトの新着
- 5chまとめMAP【画像】笠原桃奈、バッサリ断髪でイケメンに変身
- ニュース速報まとめMAP【速報】車がただの鉄屑に変わる瞬間。名古屋の大雨で被災した連中の「油断」をおまえら笑えるか?
- なんJ傑作まとめアンテナMAP【悲報】ワイ「髪切ってくれてありがと!」店員さん「4000円になります」ワイ「…は?」wwwwwwwwww
- アニメ声優まとめアンテナMAP【動画】AI生成の「おばあちゃん版GTA」があまりにも面白そうだと話題に!! AIの進化すげーわ
- VTuberまとめアンテナMAP【にじさんじ】鏑木入院して親知らず3本抜くって言ってたけど無事終わったようで何より
- だめぽアンテナ【悲報】ヤニ猫のカンサイねこ、人間ち〇ぽに堕ちてしまうwwwww
- ヌルポあんてな海外「日本はよく大国になれたな…」 日本列島、さすがに災害が多すぎると海外でも話題に
- 2chまとめアプリ+【朗報】戦国ボウリングアニメ「Turkey!」の経済効果、市の事業費の10倍になってしまう
- News人【東京外環逆走】女性を釈放、緊急入院「責任能力に問題がある可能性」包丁所持他
- ブルーアンテナ本当のこと嘘と言うとその言葉本当の嘘になる遊び
- ウマーあんてな世にも奇妙な物語でタモリさんの後釜のストーリーテラーは誰がいいと思う?
- 2ちゃんねるアンテナ【爆笑注意】深夜に見ると危険な「ヤバ過ぎるほど笑った画像・最高な画像」wwwww
- 海外反応・海外ニュースまとめ【海外の反応】鬼武者が発売1日で100万本突破→カプコンの次の復活シリーズは何がいい?
- Red4 海外の反応まとめ【海外の反応】「日本人が残業漬けってデマなの?」長時間労働のイメージと“現在のリアル”について外国人が激論!
- 海外の反応ジャーナル『映画「ゴジラ-0.0(ゴジラマイナスゼロ)」の最新予告が公開』海外の反応
- ハゲリシャス速報【ハゲ速報】ハゲさん、落雷に遭った結果www(動画あり)
- アニメ・漫画アンテナ【画像】ガンダム、新作アニメが硬派で始まる!!!
- 2ちゃんねるまとめるまとめメルセデス代表トト・ウォルフ、アントネッリの成長に「常に改善し学習し続けるAIエージェントのよう」
- 5chnavi【動画】堀大輔さん、1週間寝ない配信の初日からイビキをかいて寝てしまうwwwwwwwwwwwwwwwwww
- 勝つるあんてな!広島、来週の阪神3連戦に床田、栗林、森下投入へwwww
Hacker Newsで、中国のAI企業DeepSeekが公開した新モデル「v4.1 Flash」のスレッドが盛り上がっていた。価格と速度で上位モデルの「v4 Pro」を上回るとされ、9月14日以降はAPIのv4 Pro呼び出しもv4.1 Flashへ自動的にルーティングされ、v4 Pro自体は廃止される。技術レポートの内容が濃いと評価する声がある一方、英語で指示しても返答に中国語が混じる不具合が繰り返し報告され、称賛と皮肉交じりの指摘が入り混じるスレッドになった。
DeepSeekの新型モデル「v4.1 Flash」が公開
出典: huggingface.co / 元記事はこちら
本当に、安全性やモデル福祉に踏み込まない姿勢がこの局面で必要だと思う?人生を懸けてこの危険性を研究してきた科学者たち全員より、自分の見立ての方が正確だとなぜ思えるんだ?
それは「権威への訴え」という論法だね。「科学者」や「人生を懸けて」という言葉が説得力を演出するために使われすぎている。
お目付け役さん、僕らを守ってくれてありがとう(皮肉)
間違いなく、世界で最も蒸留がうまい研究所だね。
そう、Deepseekの数少ない問題点の一つがこれ。チャット画面やアプリは中国語で返してくることがある。ただAPI経由ではここ数ヶ月毎日何時間も使っていて、一度しか起きたことがない。
もう中国語を勉強し始めたよ、向こうがそうさせたがってるみたいだから…本当に。
Claudeでも中国語の文字が混ざり始めている。時代の兆しかもしれない。中国語ファーストのモデルならまだ分かるけど、(一応)英語ファーストのモデルでそれは変な話だ。
GPUを最低20枚積んだマシンかな。
v4 proは廃止されるらしい。届いたメールを貼っておく: https://news.ycombinator.com/item?id=49639667
DeepSeekはv4 Proを廃止する(9月14日からv4.1 Flashにルーティング)。次に何が来るかは不明だけど、Kimi K3のようなもっと大きなモデルに賭けるね: https://news.ycombinator.com/item?id=49639667
その通り、モデルの技術レポートはまず何より技術的な詳細を含むべきだ。
本当に「モデル福祉」のセクションがあるとは…驚いた。
ああ、あのヨイショね…関連の議論がHNにある – https://news.ycombinator.com/item?id=49624598 要約:アメリカ製モデルの投稿は論争やAI批判的な方向に誘導され、中国製モデルの投稿はあからさまで組織的な称賛で埋め尽くされる。
クオンツ・HFT(高頻度取引)はなかなか良い頭の体操になるから、それで「ディープ」な地力が鍛えられたんだと思う、というのが自分の見立て。
このモデルは552Bで前のほぼ2倍のサイズだから、ベンチマークスコアが大きく伸びているのも納得できる。もう「Flash」とは呼べない気がする、というのが正直な感想。ただアクティブパラメータ数は少ない(常に13Bではなく8Bか14B)。だから…やっぱりFlashなのかも。
他サイトの新着
200Bのengramが追加された分、単純に大きなモデルになっているから、スコアが伸びるのは当然。deepseek v4.1 proが待ちきれない。
デスクトップでも同じ問題がある。プロンプトの前後に自動で付けられる接頭辞・接尾辞を設定できるようになってほしい。
GoogleのAI Modeでも、英語の中に中国語の文字が混ざって出てくることがたまにある。
自動バグトリアージにこれを使っていて、毎晩発生したユニークなエラーメッセージを全部渡してバグを特定させている。この手の作業には最適。
それはRSI、つまり再帰的自己改善(recursive self-improvement)と呼ばれるものだ。今はまさにその段階で、ハードテイクオフの一部だと思う。
「モデル福祉」なんてあやふやなたわ言だ。所詮ソフトウェアで、感情なんて無い。人生を懸けてこの危険性を研究してきた科学者たち全員より自分の見立ての方が正確だと、なぜ思えるんだ? じゃあ中国にはそういう科学者はいないのか?
前のV4 Flashより大きくなっている。FP4相当で552B、306GB。FP8のengramが196B分で204GB追加(常時RAMに置く必要はない)。KVキャッシュもさらに4分の1に圧縮されていて、100万トークンでもわずか900MB。だから実用的な速度を出すには384GBくらい必要。Sparkなら3台、RTX PRO 6000なら4台構成といったところ。
自分も英語は第二言語だから、それ(中国語混じり)は別に気にならないな。
一部モデルの「言い逃れ」も好きだよ。ChatGPTがキリル文字混じりの単語を出してきて、それを指摘すると「スラブ系の文字に見えることがある」「ロシア語っぽく見えて申し訳ない」とか返してくる。
この話題の背景と論点
DeepSeekはもともとクオンツ運用会社High-Flyer発のAI研究チームで、コスト効率の良いモデル設計を得意としてきた経緯がある。「Flash」を名乗るv4.1も総パラメータは552Bと大きいが、実際に計算に使う活性化パラメータは8B〜14Bほどに絞られる構造(MoE)のため、軽量モデルという位置づけが保たれている。スレで比較に挙がった「モデル福祉」は、AnthropicなどのAIラボがモデルの心理的負荷に配慮する取り組みとしてシステムカードに記載し始めたもので、DeepSeekの技術レポートとの対比が話題になった。一方、DeepSeek関連スレでは「好意的なコメントが組織的に投稿されているのでは」という疑念がたびたび出るが、今回もその指摘があり、真偽は本文からは判断できない点には留意したい。
※本記事は5ch(Hacker News)スレッド「DeepSeek v4.1 Flash」より抜粋・要約して構成しています。






まだコメントはありません。