IT・AI
2026年8月30日
テンセント新AI「Hy4」公開、片言の推論が海外で話題に
中国テンセントが新型LLM「Hy4」のプレビュー版をApache License 2.0でオープンソース公開し、Hacker Newsで反応が集まった。目を引いたのは推論ログの片言めいた喋り方で、リークされたGPT-5.6-solの推論トレースでも同様の傾向があったとして、意図的なトークン節約策ではという指摘が相次いだ。OpenRouterでの利用量は数日でGLM 5.3の1週間分を上回ったというが、テンセント自身が自社トークンを買って数字を盛っているのではという疑いも出ている。さらに、学習データを公開しないままの重み公開を「オープンソース」と呼べるかどうかでも議論が分かれた。
Tencentが「Tencent Hy4 Preview」をリリースし、オープンソース化
出典: tencent.com / 元記事はこちら
2
海外の名無しさん
2026-08-29 22:17
(ペリカンのSVG生成ベンチマークにおけるモデルの思考ログ)ヘルメットを足す?自転車っぽさは増すけど頭が隠れるかも。小さいサイクリング帽ならどう?特に頼まれてないけど赤いヘルメットならありかも。でもペリカンは嘴が大きいから、ヘルメットで隠れちゃうかも。うーん、やめとくか。サングラスは?いらない。水は?いらない。(リンク:simonwillisonのSVGレンダラー)
20
海外の名無しさん
2026-08-29 22:45
その片言の英語って、効率化のための意図的なものなの?それとも中国で開発されたモデルだからこそ出る癖なの?
50
海外の名無しさん
2026-08-29 22:49
GPT-5.6-solの推論ログがリークされた時も、同じような“原始人英語”を使ってた。間違いなくトークン数を節約するための最適化だね
51
海外の名無しさん
2026-08-29 22:48
最適化だよ。「言葉多い、いらない。言葉少ない、足りる」ってやつ
3
海外の名無しさん
2026-08-29 19:47
Hy4はもうOpenRouterで異常なほどのトラフィックを集めてるみたい(openrouter.ai/tencent/hy4-preview)。数日で処理したトークン数が、GLM 5.3の1週間分を上回ってる。ただキャッシュ利用のコストが5%と、他社の10〜20%に比べて格段に安いから、それも人気の理由かもしれない
22
海外の名無しさん
2026-08-29 22:57
テンセントが自分でトークンを買って統計を盛ってる可能性は高いと思う
23
海外の名無しさん
2026-08-29 20:45
だからか、自分のリクエストがほとんど通らない理由が分かった
24
海外の名無しさん
2026-08-29 20:08
OpenRouterがこういう開発元にお金をもらって露出を稼がせてる可能性はないのか気になる。AI業界の他の企業と同じように資本主義的にやってないとは思えない
8
海外の名無しさん
2026-08-29 21:02
ここにいる人で、今の世代のLLMでは力不足だけど、次の一流LLMのリリースで解決しそうな問題に取り組んでる人っている?それとも自転車と同じで、名前がタデイ・ポガチャルでもない限り13000ドルの自転車は要らない、みたいな話なのかな
32
海外の名無しさん
2026-08-29 21:36
本の内容をLLMに丸ごと放り込んで、自分だけの『スミラリアン』みたいな映画を作りたい。アニメでも実写でもいい。ただ今のLLMは数万フレームにわたって文脈を保持する能力が足りてない
41
海外の名無しさん
2026-08-29 21:09
スペインの石がその問題をタダで解決したよ
42
海外の名無しさん
2026-08-29 21:41
すごく安いモデルと自分の頭を使えば十分やっていける。最先端モデルなんて要らない。このAI“戦争”は間違いなく中国が勝つよ
13
海外の名無しさん
2026-08-29 20:26
Hy3は向いてるタスクにはかなり使ってた。今回のは期待してる。Hy3で気になってたのは速度。理論上はもっと小さいモデルとしてもっと速く提供できるはずなのに、テンセント自身の提供も含めてどこで使っても比較的遅かった
43
海外の名無しさん
2026-08-29 20:33
自分の評価では、Hy3のpreview版とrelease版の間で使い物にならないレベルから競争力のあるレベルへと、かつてないほどの飛躍があった。あなたもpreviewとrelease版で同じような違いを感じた?
64
海外の名無しさん
2026-08-29 20:53
そうそう、それ思い出した!今でもHy3のpreviewとreleaseのベンチマークは別々に計測されてて、その差がはっきり見れるよ。かなり大きかった
15
海外の名無しさん
2026-08-29 20:52
自分だけ?ブログ記事の棒グラフがなんか変な気がする。数値が大きいのに、実際の高さと対応してない気がするんだけど
44
海外の名無しさん
2026-08-29 21:46
自分には普通に見えるけど。一番左の列はHy4とHy3のスコアが重なって表示されてて(濃い青の高い方がHy4)、それぞれのスコアが棒の上に書かれてる。もしかしてそこを見て混乱してない?
45
海外の名無しさん
2026-08-29 21:10
多分AI生成のグラフだと思う。でもどの棒がおかしいの?自分には見つけられなかった
46
海外の名無しさん
2026-08-29 20:57
自分も同じこと感じた
16
海外の名無しさん
2026-08-29 20:57
中国頑張れ!追記:AIボットに下げられてる理由が分からない
47
海外の名無しさん
2026-08-29 21:28
本当にそう。中国がいなかったら、このテクノロジーを独占して誰がどう使えるかを決める寄生的な企業が2社あるだけの世界になってた
48
海外の名無しさん
2026-08-29 23:00
中身のない曖昧なコメントだね。皮肉として読めなくもないけど、それだと批判なのに解説が一切ない。本気で言ってるならそれも解説がない
49
海外の名無しさん
2026-08-29 22:03
データセットを、組み立てた過程の詳細を全部公開しなくてもオープンソースにはできる。モデルはデータセットを非可逆圧縮したようなもので、公開されたライセンスに従って取り出したり手を加えたり(ファインチューニングや追加学習、改変)できる。Hy4はOSI承認のApache License 2.0で公開されてる
68
海外の名無しさん
2026-08-29 23:14
競争力のない国こそ、学習データセットへのアクセスが必要。自国で同等の性能を持つモデルを訓練して、入力データの中身を確信できるようにするために。政府は中国やアメリカのオープンウェイトモデルを盲目的に信用するわけにはいかない
69
海外の名無しさん
2026-08-29 22:58
じゃあWindowsも、バイナリが元のソースコードの非可逆圧縮だからオープンソースってこと?
53
海外の名無しさん
2026-08-29 21:43
それはDeepSeekがプロンプトキャッシュという手法を発明したから。この分野では彼らが最先端で、研究を全部オープンにしてるのに誰も追いつけてない。追記:OpenRouterでキャッシュヒット率とキャッシュコストで並び替えできるようにしてほしい。プロバイダーを選ぶ上で今一番気にしてるのはこの2つだけ
73
海外の名無しさん
2026-08-29 23:04
「DeepSeekがプロンプトキャッシュという概念を発明した」というのは違う。キャッシュ自体は昔からあるもので、単一ユーザーのローカルバックエンドでベースモデルやチャットボットを動かすだけなら特別なことは何もしなくても効く。商用プロバイダーの中では、OpenAIが4oで最初に採用した
74
海外の名無しさん
2026-08-29 22:20
OpenRouterのキャッシュヒット率はあまり良い指標じゃない。プロバイダー自身よりも、OpenRouter側のプロバイダーの割り振りに大きく左右される
75
海外の名無しさん
2026-08-29 22:10
テーブルのヘッダーをクリックすれば昇順・降順で並び替えできるよ
70
海外の名無しさん
2026-08-29 23:31
エージェントが原始人っぽい喋り方をしてると、たとえ微妙にでも、実際に原始人みたいな振る舞いをし始めるんじゃないかって想像しちゃう。その喋り方のせいで推論の量が減ってたりしないかな
80
海外の名無しさん
2026-08-29 23:37
「ニューラリーズ(Neuralese)」だね
72
海外の名無しさん
2026-08-29 23:19
「why use many word when few word do trick?」が面白いのは、普通に「why use many words when few words do the trick?」って言うのとほとんど長さが変わらないところ
81
海外の名無しさん
2026-08-29 23:48
それも狙いのうちだと思ってた。書いたのはライターだろうし、ライターならそれくらい分かってるはず(多分)
85
海外の名無しさん
2026-08-29 22:25
キャッシュのコストでは並び替えできるけど、キャッシュヒット率では並び替えできない。プロバイダーごとのページを開いてヒット率を見るしかない。キャッシュコストがすごく安くても、ヒット率が50%しかなければ、その安さの意味がなくなる
90
海外の名無しさん
2026-08-29 22:53
待って、その数字はどういう意味?プレフィックスが一致したら常にキャッシュ価格が適用されると思ってた
91
海外の名無しさん
2026-08-29 23:41
同じプロバイダーに送ったリクエストでプレフィックスが一致した場合の話。しかもTTL(有効期限)がプロバイダーごとに違って、5分しかキャッシュしない所もあれば1時間キャッシュする所もある。コストを気にするなら、エージェントのセッションごと・モデルごとに、キャッシュヒット率が一番良いプロバイダーひとつだけを使うのが理想的
この話題の背景と論点
Hy4はApache License 2.0で重みが公開された一方、学習データセットの詳細までは公開されていない。スレでは「オープンソースと呼べるか」で意見が割れ、モデルは学習データの非可逆圧縮のようなものだから重み公開でも意味があるとする側と、それではWindowsのバイナリ配布と変わらないとする側が対立していた。またOpenRouterの利用実績についても、掲載元企業が自社トークンを購入して数字を水増ししている可能性が指摘されており、公開直後の急成長を額面通り受け取れない事情がある。キャッシュ価格を巡る議論では、価格の安さだけでなく実際のキャッシュヒット率がプロバイダーごとに大きく異なる点が誤解されやすく、TTL(キャッシュの有効期限)もプロバイダー任せであることは本文だけでは伝わりにくい前提知識といえる。
※本記事は5ch(Hacker News)スレッド「Tencent Releases and Open-Sources Tencent Hy4 Preview」より抜粋・要約して構成しています。
この記事のリアクション
まだコメントはありません。