Claude新モデル「Opus 5.5」海外の反応 1回500ドルの声も

姉妹サイトの新着

Anthropicの新モデル「Opus 5.5」について、Hacker Newsで活発な議論が交わされていた。多くのエンジニアが、長時間の自律的なコーディング作業やデバッグでの精度の高さを評価する一方、「やる気過剰で使いにくい」という反対意見や、旧モデルOpus 4.6を好む声、料金プランへの不満も目立った。特に話題を集めたのは、あるユーザーが1回のセッションでトークン換算約500ドルを消費したという報告で、AIの実行コストの高さが浮き彫りになった。本筋とは離れて、Claudeがよく使う「wall-clock」という言い回しが昔からある技術用語かどうかで細かい論争も起きた。

ClaudeとClaude CodeでOpus 5.5を最大限に活用する方法

出典: claude.dev / 元記事はこちら

3 海外の名無しさん 2026-10-03 22:09
フロントエンド作業がすごく得意。特に画像を参考資料として渡すと威力を発揮する。デザイン参考画像を渡して『流れるようなSVGに注力して』と指示したら、スタートレックのコンピューター風レイアウトを完璧に仕上げてきた: https://html.non.io/lcars-opus-5.5
7 海外の名無しさん 2026-10-03 22:07
ここで一人だけ反対意見を言わせてもらうと、自分はまだ『やる気過剰』で使いにくいと感じている。
8 海外の名無しさん 2026-10-03 22:01
Anthropicは50ドルプランを出してくれないかな。100ドルは払いたくないけど、20ドルプランだと足りない。
10 海外の名無しさん 2026-10-03 21:51
すごいモデルだと思う。ただ、推奨のワークスタイルをClaude Codeのハーネスにガイドとして組み込んで、外れたい人は無視できるようにすればいいのに、なぜそうしないのか分からない。
27 海外の名無しさん 2026-10-03 21:58
(>>10へ)『外れたい人は無視できるように』って言うけど、この会社は『我々が一番分かってる』という高慢な人たちが運営してて、しかもClaudeの出力をちゃんと読まずに盲信してる節がある。Linuxカーネルの『ハッキング』神話を、Linux側からついに語った話が目から鱗だった:
11 海外の名無しさん 2026-10-03 21:37
いまだにClaudeにサブエージェントを立ち上げるよう指示する必要があるのか? Opus 5.5が質問ごとにどれだけ慎重に考えるか自分で判断できるなら、サブエージェントを使うかどうかも自分で判断できるはずでは。GPT-6系は少なくともこのエージェント管理を自動でやっているように見える。
12 海外の名無しさん 2026-10-03 21:15
『返答で推論過程を見せるように頼むな』と言いつつ『この方法を選んだ理由を3文で説明して』と頼む——これで全部言い表せてる。
14 海外の名無しさん 2026-10-03 21:06
Opus 5.5が優れたモデルだという点には同意。1時間を超える長時間タスクで初めて信頼できると感じたモデル。
30 海外の名無しさん 2026-10-03 21:18
(>>14へ)デバッグもすごい。PowerShellからMSYS2上のlldbセッションを操作させてみたけど、アドレスを読んで根本原因を分析していく様子が素晴らしい。あれは本来かなり頭を使う作業。作業を見ているだけで実際にテクニックを教わっている気分になる。
31 海外の名無しさん 2026-10-03 21:19
(>>14へ)GPT-4.5が人類史上最高のモデルだったと今でも思っている。今は安く済ませるために思考の連鎖(COT)を100倍回すような、質を落としたモデルばかり出てきている。
16 海外の名無しさん 2026-10-03 20:40
とんでもないモデル。何をしたのか分からないけど、20ドルプランでこれだけのことができるようになった。
32 海外の名無しさん 2026-10-03 21:07
(>>16へ)優れている理由は、自分が書いたコード用のテストハーネスまで書けるように訓練されているからだと思う。渡されたコードが不完全でもテストできる。
33 海外の名無しさん 2026-10-03 21:28
(>>16へ)大きな理由の一つは、Opus 5.5ではキャッシュ読み込みの価格が入力の5%になっていること。これまでのモデルは10%だった。
34 海外の名無しさん 2026-10-03 20:45
(>>16へ)みんながこれを言い続けたら、そのうち性能を落とされるんだろうな。
17 海外の名無しさん 2026-10-03 21:32
文句なく今まで使った中で最高のモデル。すごい。この1週間でかなりの量をこなせた、普段の3ヶ月分くらいの作業量だと思う。
18 海外の名無しさん 2026-10-03 21:50
今週おかしなことが起きたのは、VSCodeのモデル選択が『auto』に戻ってしまって、別のモデルが頑張っていたときだけだった。自分はOpus 5.5に固定した。自分の用途ではFableでも物足りなく感じる。
19 海外の名無しさん 2026-10-03 21:47
これがうまくいくのは、目標がきちんと定義されていて測定可能だからだと思う。自分もOpus 5.5を最適化探索(hill-climbing)的な作業に使ったことがあるけど、そっちはもっと誘導が必要だった。評価自体が難しいから。
22 海外の名無しさん 2026-10-03 20:54
(>>2へ)9時間も!?
35 海外の名無しさん 2026-10-03 20:59
(>>22へ)そう。複数のサブエージェントを立ち上げていろいろな実験を走らせてベンチマークを取ったり、過去のCIログを調べたりしていた。最終的にはキャッシュの方式の変更、各種コード品質チェック、テストランナーの高速化など、いろいろな改善につながった。
23 海外の名無しさん 2026-10-03 21:18
(>>2へ)うーん…Opus 4.6がまだ選択肢に残っているのには理由がある。プロは分かっている、これらは低コスト版のモデルだと。
36 海外の名無しさん 2026-10-03 21:52
(>>23へ)Opus 4.6も好きだけど、5.5をmediumかlowで使う方がコスパは良いと思う。4.6はもっと誘導が必要で、タスクの足場をいろいろ作ってやる必要がある。5.5は頼んだことをそのままやってくれる。視覚的な空間推論も5.5でかなり改善された。
24 海外の名無しさん 2026-10-03 21:18
(>>2へ)『wall-clock』って、Claudeが使う前から実際にみんなが使ってた用語なの? 自分はこのモデルが使うまで聞いたことがなくて、正直苦手。
37 海外の名無しさん 2026-10-03 21:21
(>>24へ)かなり古い用語で、CPU時間などと区別するために使われる。30年前から普通に使われていた。15年前の例: https://stackoverflow.com/questions/7335920/what-specificall…
38 海外の名無しさん 2026-10-03 21:28
(>>24へ)年寄りだと言いたいのか? 自分くらいの年齢(40代以上)ではごく普通に使われてる言葉。『聞いたことがない表現』を即『AIが使ってる言葉に違いない』にしないでほしい。
41 海外の名無しさん 2026-10-03 21:21
(>>24へ)『wall time』はシステム系ではよく使われる用語(全体の実行時間とカーネル時間を比較するときなどに出てくる)。『wall clock time』などの表現をAI特有の言い回しだとは思わない。
26 海外の名無しさん 2026-10-03 21:53
一方で、自分が自信満々に間違った前提を話していたとき、頼んでもいないのに証拠を見つけてそれを指摘してきたこともある。
29 海外の名無しさん 2026-10-03 21:57
『grilling』スキルを調べてみるといい。さらに良くするには、AskUserQuestion機能を使うようにClaudeに改造させるといい。plan modeよりずっと優秀。 0. https://github.com/mattpocock/skills/blob/main/skills/produc…
42 海外の名無しさん 2026-10-03 21:23
(>>24へ)『wall clock』は長年使っている言葉で、普通は処理を並列化する話でCPU時間と比較するときに使う。CPU時間は増えても、wall clock timeは減ることがある。
43 海外の名無しさん 2026-10-03 21:50
(>>24へ)いや…めちゃくちゃ普通に使う言葉。例えばプログラムの時間を測ると、ユーザーCPU時間とwall clock timeが出てきて、この2つは全然違う数字になることがある。

他サイトの新着

44 海外の名無しさん 2026-10-03 21:47
(>>24へ)いやいや、本当に今まで誰も言ってるのを聞いたことがなかったの?
46 海外の名無しさん 2026-10-03 22:06
(>>32へ)自分が使っているオープンウェイトモデルは何ヶ月も前からそれをやっている。Opus 5.5の新しいパターンなのかは分からない、もしかして逆に蒸留して取り込んだのかも? 😡
47 海外の名無しさん 2026-10-03 21:37
(>>35へ)コストは怖くて聞けない。自分は1時間16分のタスクで60ドル溶かしたことがある。
50 海外の名無しさん 2026-10-03 21:44
(>>47へ)自分は月100ドルのサブスクに入ってるけど、このセッションはトークン換算で500ドル相当かかった。(全部Opus 5.5というわけではなく、Fable 5.1をアドバイザー役に、機械的な変更にはSonnet 5.5を使うような構成にしている。)
52 海外の名無しさん 2026-10-03 22:05
(>>50へ)値段が早く下がってほしい。補助がなくなったら、こういう使い方は元々お金を持っている人以外には手が出せなくなる。
53 海外の名無しさん 2026-10-03 21:59
(>>50へ)上位プランだと自動で作業が再開されるの? 自分は20ドルプランだけど自動再開はされなくて、毎回戻って『resume』と入力するかボタンを押す必要がある。
51 海外の名無しさん 2026-10-03 22:04
(>>49へ)オープンモデルを応援したい気持ちはあるけど、SOL 6.1とOpus 5.5は月100ドルのサブスクで考えると本当によく働いてくれる。ただその心配は自分も共有していて、オープンモデルが追いついて大手2社のサブスク価格と渡り合えるようになってほしいと本気で思っている。
54 海外の名無しさん 2026-10-03 22:07
(>>51へ)自分はもっと安く済むワークホース的なモデルを使っている。モデル選びは世間で言われているほど重要じゃない。長期的に見れば、トークンを売るだけのベンダーに未来はない。

この話題の背景と論点

Opus 5.5はAnthropicの最上位モデルの最新版で、スレでは主にコーディング支援としての評価が語られていた。好意的な声の背景には、キャッシュ読み込みの料金が従来モデルの10%から5%に下がった点や、不完全なコードに対して自らテスト用のハーネスを書く挙動などが挙げられている。一方で「やる気過剰」という批判や、旧モデルのOpus 4.6を好む声もあり、評価は一様ではない。注意したいのは、1回のセッションで500ドル相当というレスは、Opus 5.5単体の費用ではなく、Fable 5.1やSonnet 5.5など複数モデルを組み合わせた構成での合計だとレス主自身が説明している点で、Opus 5.5だけのコストと誤解しないほうがよい。また「wall-clock」という語についての論争は、コンピュータサイエンスでは数十年前から使われている一般的な用語で、AIが作った言い回しではないという指摘が複数の参加者から出ていた。

※本記事は5ch(Hacker News)スレッド「Getting the most out of Opus 5.5 in Claude and Claude Code」より抜粋・要約して構成しています。

この記事のリアクション

他サイトの新着

まだコメントはありません。

コメントする

誹謗中傷・個人を特定する書き込みは削除対象です。投稿は承認後に表示されます。

相互リンクサイト新着記事