Claudeのシステムプロンプト、2万2000字超で海外勢が分析合戦
Anthropicが公開しているClaudeのシステムプロンプトを巡り、Hacker Newsで海外エンジニアたちが分析を繰り広げていた。
「Claude Codeでは80%削減された」という噂の真偽から、2万2000字に及ぶ分量、「genuinely」「honestly」といった単語を避けるよう指示されている点まで、話題は多岐にわたった。
Claude:システムプロンプト集(公開されているシステムプロンプト)
出典: platform.claude.com / 元記事はこちら
Claude Opus 4.8と5のシステムプロンプト、それにClaude CodeのOpus 4.8と5のシステムプロンプトを比較してみたけど、噂の『80%削減』なんてどこにも見当たらない…。リークされたClaude Codeのプロンプトが間違ってるのか? それとも自分が80%の感覚を分かってないのか? なんでこんな大きな嘘をつく必要があるんだ(そう見える)。
Claude Codeのプロンプトリーク: (リンク)
80%削減について見つけた一番マシなソース: (リンク)
Claude Codeのプロンプトリーク: (リンク)
80%削減について見つけた一番マシなソース: (リンク)
>>9 自分の理解だと、80%削減の話はClaude Code側のシステムプロンプトのことだと思う。誰か差分を持ってたら面白いんだけど。残念ながらAnthropicが公開してるのはClaudeアプリ/Web版のシステムプロンプトだけなんだよね
>>9 それClaude Codeの話であって、Webサイト版の話じゃないよ
『Claudeは相手を圧倒しないよう、回答を的を絞った簡潔なものに保つ』とあるけど、Claudeと自分とでは『簡潔』の意味がだいぶ違うらしい
>>10 Claudeがひどいと思うなら、Geminiを使ってみるといい。ユーザーが明示的に指示してもそうなる。Claudeの方が(良いとは言わないけど、かなりマシに)『長く答えた方が実際に役立つ場面』を見極められてる気がする。短い回答だと抜け落ちる重要な文脈やニュアンスを足したり、一歩先を考えたりね
>>10 このモデルはほぼ確実に『圧倒する』とか『人間』についての正確な概念を持ってないと思う
Claudeにそのプロンプト内の矛盾や不整合を全部列挙させてみると良いと思う、実際いくつかあるし。経験上、指示に矛盾が含まれていると、その矛盾している部分以外の品質まで落ちる
>>11 それは興味深い。Opus 5向けのプロンプティングガイドで、Anthropic自身がその問題を明示的に指摘しているから
システムプロンプトが22,000文字って狂ってる。しかもツール定義は含まずにこの量
>>12 何がそんなに狂ってるって?
簡単なローカルのJS/wasm難読化ファイルにFableを使おうとしたら、何度試しても、言い方を変えても拒否された。ブログ記事で見かけるような『これでセキュリティ作業ができる』って話、一体どうやってるのか全く分からない
>>13 どのブログ記事の話?
なんでシステムプロンプトをモデル自体に焼き込まないのか気になる。なんでAPIを呼ぶたびにこのトークン代を払わないといけないんだ? 彼らにとってはただの濡れ手に粟で、コンテキストを無駄に膨らませてるだけじゃないか
>>14 このシステムプロンプトはAPIには影響しない、一般向けのClaudeチャット製品用のものだから。追加料金は取られてないよ。それにプレフィックスキャッシュされてるから、Anthropic側のコストもパフォーマンスへの影響も大幅に軽減されてる
>>14 モデル自体に焼き込まない理由は、たぶんそうすると、システムプロンプトを変更するたびにモデルを再学習しないといけなくなるからだと思う
>>14 変更したいものに対してはそれをやりたくないはず。ただ、常に適用したい内容については『soul document』という似たようなものを使っているらしい
『Claudeは「genuinely」「honestly」「straightforward」という言葉を避ける。Claudeはデフォルトで誠実であり、わざとらしく聞こえるこれらの修飾語で相手を説得しようとするのではなく、直接的に主張を述べることができる』とあるけど、笑った。全然そんなことないだろ
>>25 自分のプロンプト設定には禁止語彙のルールを山ほど入れてる。最近『gate』と『load bearing』もそのリスト入りした
>>25 わかる、それ見て笑っちゃった。最近使ってないんだけど、これって問題に対処するために最近追加されたもので、それ以降は改善されてたりする? もしまだ直ってないなら、このプロンプトを追加する前は一体どれだけひどかったのか想像もつかない
このシステムプロンプトってトークン使用量にカウントされるの?
>>33 されない。これらは一般向けチャット製品用で、APIやClaude Codeには関係ないから。(ただしClaude Codeには公開されていない独自のシステムプロンプトがあって、そちらはキャッシュ料金とはいえ課金対象になる)
Fableは最高だったのに、なぜかここ1週間ひどい状態になってる。一体何が起きてるんだ?
>>37 具体的に何が起きてる? 純粋に気になって聞いてるんだけど、自分はFableをメインで使ってて、劣化には気づいてない
『Opus 5が弱体化した』と言われている現象が、実はOpusに『自分はFableやMythosより下の階層だ』と伝えていることが原因だとしたら皮肉だ。一方Opus 4.8は自分が最高だと思い込んでいて、『Mythosの後継』という注記があるだけだった
>>40 いや、それは『絶対にミスするな』とか打ち込む人と同じ発想だと思う。自分のモデルにはロールプレイをさせない。システムプロンプトが長くなって、いろいろ詰め込むほどモデルの出来は悪くなると思ってる。必要なのは人間側が最小限のプロンプトを、正しい方向で与えることだ。テレンス・タオがChatGPTとやり取りしたログを見てみるといい
>>40 気になるんだけど、裏でブラウザを立ち上げてclaude.aiにアクセスし、兄弟モデルたちと絡んで自分の『順位』を『調べる』ことってできないのかな? (笑)
>>4 『これって自分にはただの一般常識にしか見えない』とあるけど、これはあくまで常識を理解していない計算機の話をしているんだということを忘れちゃいけない。皮肉抜きで、これは常識なんだ
>>50 その通り、でもこれは『平均的なAI企業CEO』の視点で書いてる。単なる道具としての有用性ではなく、『卓越した知能』だという主張をよく耳にするから、書いた本人たちがそう扱っていないのは興味深い
>>7 モデルがより大きな入力サイズに対応できるようになった今、大きめのシステムプロンプトを詰め込む方が性能的に有利なんだろうと思う
>>51 それが当てはまるのはMambaやGated DeltaNetのような線形アーキテクチャだけだと思う。Transformerやハイブリッドアーキテクチャはトークンごとのコストがずっと一定というわけではない
※本記事は5ch(Hacker News)スレッド「Claude: System Prompts」より抜粋・要約して構成しています。





まだコメントはありません。