「普段使うAIモデルは?」海外エンジニアの回答が見事に割れる

姉妹サイトの新着

他サイトの新着

海外の技術者向け掲示板Hacker Newsで、「普段使っているデフォルトのAIモデルは何で、その理由は?」という質問がスレッドを呼んだ。返ってきた答えはClaudeのOpusやSonnet、Gemini、GLM、DeepSeek、Qwen、Grok、Terra、Astraなど多岐にわたり、月3ドルのプロモプランから月200ドルの上位プランまで料金の話も交錯した。コストの安さを誇る声もあれば、上限をすぐ使い切る不満やベンチマークと体感のズレを指摘する声もあり、最後には「LLMは一切使わない」という回答まで飛び出した。

1 海外の名無しさん 2026-09-12 14:58
普段使っているデフォルトのAIモデルは?その理由は?
自分はほとんどClaudeを使っている。Fableは自分には明らかにオーバースペックで、4つのエージェントを使ったモバイルアプリの初期プランニングをしただけで、Maxプランのセッション上限をものの数分で使い切ってしまう(!)。6時間後にタイムアウト明けで作業を再開したら、キャッシュが切れていて1分足らずでセッションの2%を溶かしてしまった。今の主力はOpus 4.8で、乗り換える理由が見つかるまで5は避けるつもり。4.8は自分の用途には『十分』で、コスパもいい。だいたい正しい結果を返してくれる。やっているのは主にWebとモバイル、クラウドバックエンド周り。
9 海外の名無しさん 2026-09-12 15:58
ここに集まった回答のバラつきを見ると、そもそもそんなに違いがあるのか疑問に思えてくる。バイク乗り集団に『どのオイルを使ってる?』って聞いたときみたいだ。
12 海外の名無しさん 2026-09-12 15:32
Qwen 3.8 flash-nextかGemma 26B。LLMの責任ある持続可能な使い方を気にしているので。
15 海外の名無しさん 2026-09-12 15:55
ここ数週間はAntigravityデスクトップ経由のGemini 3.8 flashがメイン。ローカル用途にはDeepSeek V4 flashとQwen 3.6 MoEも使ってる。
17 海外の名無しさん 2026-09-12 15:57
Sonnet。トークン予算が長持ちするし、自分は考える役に回って、定型作業はLLMに任せたい派。OpusやFableの方が賢いのは間違いないけど、自分のワークフローにはあまり影響しない。他社のモデルはそこまで詳しくないけど、前にGeminiを使ったときはProとFlashで感触はあまり変わらなかった。
19 海外の名無しさん 2026-09-12 15:49
ZAI/GLM。友人が気前よくAPIキーを分けてくれたから。その友人は他にも契約してるし、勤め先からの分もたくさんある。1日前に、地元企業とのGoogleの提携経由でGoogle AI Proを無料で使えるようになった(その企業のサービス自体は有料で使ってるけど、全然高くない)。これも使い始める予定。特にこれといった選定理由はなく、他を選ばない理由も特にない。
22 海外の名無しさん 2026-09-12 15:25
Claude。別に他より優れているからじゃない。deepseek flashも同じくらいの品質だと思う。ただ、Claudeはめちゃくちゃ補助が効いて安いから。
23 海外の名無しさん 2026-09-12 15:36
少し前にglm-5.3-flashが出るまでは、いろんなオープンウェイトモデルを渡り歩いていた。glm-5.3-flashは冗長だし最速でもないけど、能力は非常に高くて安い。自分のハーネスの全エージェントに割り当てていて、ちゃんと仕事をこなしてくれる。時々ちゃんと舵取りしてやる必要はあるけど、頼れる働き者。
24 海外の名無しさん 2026-09-12 15:51
このスレでは少数派っぽいけど、自分にとってTerraは本当にすごくて、Sonnetを完全に凌駕してる。会社がClaude代を払ってくれるので職場ではSonnetを使うけど、家ではTerraを使っていて、まともなコードを一発で書いてくれる確率がずっと高い。
25 海外の名無しさん 2026-09-12 15:47
このスレを読んでいて気づいたけど、中国のAI研究所のモデルを使っている人はあまり多くないんだな…
26 海外の名無しさん 2026-09-12 15:50
個人的には、Geminiが一番『変な癖がない』というか、素直なモデル系統だと思う。自分にはすごく合ってる。
27 海外の名無しさん 2026-09-12 15:21
ほぼ何でもAstra lowで済ませてる。5x Maxプランなら1週間分の作業に余裕を持って足りる。
51 海外の名無しさん 2026-09-12 15:32
>>27 そのトークン管理、どうやってるの? こっちは月200ドルの『20x Pro』プランでAstra lowを使っても、1日しか持たない。
28 海外の名無しさん 2026-09-12 15:33
自分はGlm-5.3-flash。最後まで自分も作業に関わっていたいので、速いモデルが好み。エージェントに全部丸投げすると、最終的な結果を理解しづらくなるから、完全な制御は渡さないようにしてる。
29 海外の名無しさん 2026-09-12 15:58
だいたいの実装はTerra Medium/High。難しいバグ追跡や複雑なシステムの設計にはSol Highを使う。
30 海外の名無しさん 2026-09-12 15:34
gpt-5.6-Lunaとglm-5.3-flashをよく使ってる。Astraは本当に素晴らしいけど高すぎる。月平均で50〜90Bトークンくらい使ってる。
52 海外の名無しさん 2026-09-12 15:37
>>30 Lunaは好きだけど、コンテキストが13万トークンを超えると急に頭が悪くなる。
32 海外の名無しさん 2026-09-12 15:30
・デフォルト: CodexとTerra Max(べらぼうに安いから)
・好みで使うなら: Claude CodeとOpus 5 Medium
33 海外の名無しさん 2026-09-12 15:35
Muse Spark 1.3 Contrib。100万トークンあたりの価格性能比が圧倒的: 入力0.10ドル、出力0.20ドル、キャッシュ入力0.002ドル。
34 海外の名無しさん 2026-09-12 16:12
個人の趣味用途にはGLM 5.3 Flash。自分にとって初めて『デフォルト級』と呼べるくらい実力があるローカル寄りモデルで、しかもかなり安い。将来消費者が再びRAMを手に入れられるようになったら理論上は自分でも動かせるクラスのオープンウェイトLLMに依存する方が、誰にも取り上げられない分マシだと思ってる。ローカルではDeepseek Flash、Qwen3.8-Next-Flash、Gemma 4を、生成速度をどれだけ我慢できるかで使い分けてる。
35 海外の名無しさん 2026-09-12 16:02
最近Grok 4.6 (High)をClaude Opus 5 (High)と並行して試している。Grokも十分な能力はあるけど、Opusと比べるとやや物足りない。ベンチマーク上は両者ほぼ同等なのに、体感ではかなりの実力差を感じるので、ベンチマークそのものにちょっと懐疑的になった。
36 海外の名無しさん 2026-09-12 16:11
Gemini 3.8 + antigravity。難しい作業にはantigravity上でOpusも使う。
37 海外の名無しさん 2026-09-12 15:38
gemma 4 12BとQwen 3.8 9Bを使ってる。
38 海外の名無しさん 2026-09-12 15:54
Qwen3.8。
39 海外の名無しさん 2026-09-12 15:52
Glm 5.3 FlashとDeepSeek 4.1 Flash。
40 海外の名無しさん 2026-09-12 15:19
opusplan。理由は前の人と同じ。
41 海外の名無しさん 2026-09-12 15:42
GLM5.3。かなり昔からのプランに入っているので、実質使い放題……それに加えて、セカンドオピニオンが欲しいときは他のモデルも少し混ぜて使う。
42 海外の名無しさん 2026-09-12 16:14
自分はどんな理由があっても、いかなる時もLLMを一切使わない。
45 海外の名無しさん 2026-09-12 15:50
>>4 同じく。今は月3ドルのプロモプランに入っていて、ほぼOpus級のモデルが、速度も速く、上限も相当緩く使える。今のところGemini Proに相当するものが無いので、もっと高度な処理が必要なら20ドルのOpenAIプランと組み合わせる必要がある。
54 海外の名無しさん 2026-09-12 16:24
>>45 それは確かに。ただ最新のGeminiは、けっこう厄介なタスクでもかなり優秀だよ。Bowers & WilkinsのFoundationアプリをリバースエンジニアリングして、スマホじゃなくノートPCからWiFi経由で曲をキューに入れられるようにしてもらった(AirPlay 2の圧縮もRoonの課金も無し)。数か月前ならもっと大きなモデルが必要だった作業が、今ではFlashと的確な指示だけで数時間でできる。

他サイトの新着

46 海外の名無しさん 2026-09-12 15:50
>>8 その『Dark Software Factory』ってどういう構成なの? 何を作ってるの?
47 海外の名無しさん 2026-09-12 17:06
>>10 月200ドル払ってるけど、Codex+Proチャットで使用量が尽きたことは一度も無い。DeepSeekより良いし、少なくとも米国企業を支えることになる。あなたの苦労なんて自分には関係ない。
48 海外の名無しさん 2026-09-12 16:36
>>10 具体的に何が辛いの? ここで挙がってる投稿や傾向、ツールの選び方で気になるものある?
49 海外の名無しさん 2026-09-12 15:38
>>20 まさか本当にHaikuを使ってるの? 信じられない。
56 海外の名無しさん 2026-09-12 15:44
>>49 Web検索や簡単なコマンド、ちょっとした調査、ログを渡して解析させるくらいなら十分すぎるくらい。スクリプトはこれ→ https://github.com/mariocesar/dotfiles/blob/main/common/.loc…
53 海外の名無しさん 2026-09-12 15:47
mimo-v2.5を無料で使えるところってどこ?
58 海外の名無しさん 2026-09-12 16:18
>>53 opencode zenで。
57 海外の名無しさん 2026-09-12 15:44
>>51 正直、狙ってやっても20xプランを1日で使い切るのは無理な気がする。一体何をしたらそんなにトークンを消費するの?
59 海外の名無しさん 2026-09-12 17:06
>>55 こっちもDS41で満足してる一人。Claudeを契約してる友人と話しても、自分より特に高度なことも良い結果を出してるわけでもないのに、法外な金額を払ってる。
60 海外の名無しさん 2026-09-12 17:06
>>55 家賃が月20ドルだったらいいのに!
61 海外の名無しさん 2026-09-12 15:52
>>56 それいいアイデアだね。共有してくれてありがとう!

この話題の背景と論点

この手のスレが成立する背景には、AIコーディング支援の料金体系が「月額固定+使用量上限」のサブスクに集約されている事情がある。月3ドルの促進価格から月200ドルの上位プランまで幅があり、同じ「使い放題」でも1日で溶ける人と1週間持つ人がいるほど消費量の差が大きい。論点が割れたのは価格と性能のどちらを優先するかで、GLMやDeepSeek、Qwenなど安価なモデルを選ぶ層と、多少高くても精度を取る層に分かれた。またGrokとOpusを比較した投稿(35番)のように、ベンチマークのスコアが近くても体感の実力差は別、という指摘は見落とされがちな点で、数字だけでモデルの優劣を判断できないことを示している。なお本スレの回答は2026年9月時点のもので、モデルのラインナップや価格は数か月単位で入れ替わる点には留意したい。

※本記事は5ch(Hacker News)スレッド「Ask HN: What default model do you use and why?」より抜粋・要約して構成しています。

この記事のリアクション

他サイトの新着

まだコメントはありません。

コメントする

誹謗中傷・個人を特定する書き込みは削除対象です。投稿は承認後に表示されます。

相互リンクサイト新着記事