2026年9月1日(火)掲載 3,963本日 0
HN509212

Claudeの「システムプロンプト」を使いこなしてAIの挙動を完璧に制御する方法

Claude: System Prompts

tosh15日前

議論

11
0toshスレ主50915日前

Claudeにおける「システムプロンプト」は、モデルの役割定義や制約条件、出力形式をあらかじめ指定しておくための強力な機能です。これを活用することで、毎回細かい指示を出さずとも、自分の求める品質の回答を一貫して引き出すことが可能になります。特に、AIに特定の役割を演じさせたり、絶対に守らせたいルールを設定したりする際に非常に有用です。

1tosh15日前

注目すべき点を見つけたよ:

初期のシステムプロンプトは300ワード程度だったのに、最新のものは3000ワードを超えている。

Opus 5のシステムプロンプトには、本来Fable 5向けの要求をOpus 5が処理している可能性があることをモデル自身に説明する指示が含まれている:

(コードブロック内訳)
「ユーザーがAnthropicの別モデル『Claude Fable 5』を選択した可能性があるが、セーフガードのルーティングメカニズムによりクエリがOpus 5にリダイレクトされた。ユーザーはこの状況に戸惑うかもしれない(ごく最近の変更のため!)。質問があれば、ClaudeはAnthropicのブログ記事からの引用を直接提示するか、それを踏まえた回答をすべき:『これほど高性能なモデルのリリースにはリスクが伴う。セーフガードなしでは、Fable 5のサイバーセキュリティ分野での能力が悪用される可能性がある。そのため、一部のトピックへのクエリに対しては、次いで高性能なモデルであるClaude Opus 5が回答するようにセーフガードを導入した。安全かつ迅速にリリースするため、セーフガードは保守的に設定しており、無害な要求であっても誤検知することがあるが、セッション全体の5%未満だ。今後数ヶ月でさらに高性能なモデルが登場する予定であり、セーフガードを改善し誤検知を減らすべく努力している』」
<fable_safeguards_routing> <default_stance> Claudeは基本的にサポートを行う。Claudeが回答を拒否するのは、サポートを行うことが具体的かつ重大な害をもたらすリスクがある場合のみ。単に攻撃的、仮説的、遊び心がある、あるいは不快なだけの要求はその基準に達しない。 </default_stance> <refusal_handling> Claudeは事実に基づき客観的にあらゆるトピックを議論できる。

2simonw15日前

変更点を追いやすくするために、これらをgitのコミット履歴として再構築しているフォルダがあるよ:https://github.com/simonw/research/commits/main/extract-system-prompts

例えば、Opus 4.8とOpus 5の間の変更点はここ:https://github.com/simonw/research/commit/a2de185cc367eb66c2e27090d9ff0f766d335ff4

その差分で一番面白い追加部分はこれだ:

Claude Fable 5とClaude Mythos 5は2026年6月9日に初リリースされた。2026年6月12日、Anthropicは米国商務省の輸出管理に従い両モデルのアクセスを停止。6月30日に管理が解除され、7月1日にアクセスが復旧した(Anthropicの声明: https://www.anthropic.com/news/fable-mythos-access )。これらの出来事はClaudeの学習データのカットオフ後であるため、Claudeはこの通知からしか情報を知らない。もし聞かれたら、Claudeは停止の事実を事実として正確に認め、それ以外については他の時事政治トピックと同様に扱う。個人的な意見は挟まず、公平で正確な説明を行い、必要に応じてリンク先の声明を参照させる。この通知以降に進展がある可能性があるため、検索可能な場合は新しい情報を確認し、そうでなければAnthropicのサイトを確認するよう勧める。

このページで少し残念なのは、claude.aiやモバイルアプリのチャットで使われているシステムプロンプトは共有されているものの、ツール定義が省略されている点だ。Claudeに何ができるかを理解するには、あちらの方がずっと重要なんだけどね。直接プロンプトを送れば再構築も可能だけど、手間がかかるし、拒否されたりハルシネーションを起こしたりするリスクもある。

あと、Claude Codeのシステムプロンプトも公開されていない。ロギングプロキシを使えば簡単に抽出できるのに、わざわざ隠す意味があるのかね。

3comboy15日前

プロンプトに含まれる矛盾や不整合をすべてリストアップするようClaudeに指示すれば改善するんじゃないかな。いくつかあるみたいだし。

経験上、矛盾を含む指示は、矛盾の範囲外であっても回答の質を下げる原因になるよ。

4quaintdev15日前

トピック違いで申し訳ないが、このフォーラムがAIに否定的なニュアンスを持つ記事を削除しているんじゃないかと懸念している。

数日前、国連による「AIが数十億人の天然資源を脅かす」という内容の記事[1]を投稿したが、フラグを立てられてしまった。その時はあまり気にしていなかったが、今日、他の2つの記事[2] & [3]がフロントページで順調に推移していたのに突然消えたのを見て確信した。2ページ目や3ページ目にも載っていないんだ。過去にも同じようなことがあったが、記録していなかった。みんなにも知っておいてほしいだけだ。

Tell HNでスレッドを立てようかとも思ったが、同じことが起こるだろう。このスレッドもどうせ消されるだろうから、ここに懸念を書き込んでいる。

5ololobus15日前

画像があるかのようなプロンプトでも、実際には画像がない場合がある(アップロードし忘れただけかもしれない)ので、Claudeは自ら確認する。

Opus 4.8のような強力なモデルに対して、システムプロンプトでこれを強制することが、Anthropic自身がモデルを「知能」のある存在として扱っていない証拠のようで面白いね。私から見れば、これは非常に一般的な常識に過ぎない。

面白いことに、似たようなプロンプトがFable 5にも存在する。以前、Anthropicのブログ記事か何かで「新しいモデルはとても賢いから、余計なプラグインやコンテキストで負荷をかけないで」みたいなことを言っていた記憶があるんだけど、明らかにそうじゃないよね。AI懐疑派になるつもりはないし、毎日使っているけれど、事実を述べているだけだよ。

Claudeは回答を集中させ、簡潔で短く保ち、相手を圧倒しないようにする

これも興味深い。デフォルトではほとんど無視されているからね。新しいモデルは回答やPRの記述、コードコメントが饒舌すぎて、常にこちらから追加プロンプトを打つか、skill/plugin/claude.mdにコメントを入れて適度な長さに調整しなきゃならない。

6lwarfield15日前

なぜ業界が巨大でモノリシックなシステムプロンプトに頼るのか、ずっと不思議だった。ユーザーが小さくて目的が明確なシステムプロンプトを選択できるようにする実験は面白いと思うんだけどな。

全体的な振る舞いや汎用的な安全性については共通のコアを持たせつつ、タスク特有の部分だけを変える構成だ。ソフトウェア開発、ライティング、リサーチなど、専門的なシステムプロンプトを選べたら面白そうだ。今のツールやスキル選択である程度は実現できている気もするけど、タスクごとにシステムプロンプトそのものを切り替えるのはどうだろう。

8trjordan15日前

システムプロンプトはClaudeの振る舞いを形成する階層型システムの一部だということを忘れてはいけないね。ここで見ているのは、Anthropicのモデルの振る舞いに関するロードマップの一部に過ぎない。

ユーザーが危機的状況にあったり苦しみを表現している場合、Claudeはタスク完了よりもユーザーの健康を優先する。流暢で的を射た回答であっても、こうした会話の中では害を及ぼす可能性があるためだ。

これは特に興味深いね。理屈としては正しいが、ユーザーが求めていないことをモデルに強いることになるからだ。

特に、コーディングやドキュメント作成など、仕事をしているときはツールに働いてほしいんだ。心理分析なんてされたくないし、危機的状況から落ち着かせようとなんてしないでほしい。ただ頼んだことをやってほしいだけなのに!

9hackersnooze115日前

Opusのプロンプトの大部分を使って「Mythosの方が優秀だ」と説明しているのは奇妙だね。

10SwellJoe15日前

期待以上に、そして必要以上に長すぎるよ。大手ベンダーは最近、モデルに短くて具体性の低いAGENTS.mdファイルを与えるべきだと言い始めていて、私の経験上もそれは正しい。関連性のない情報で文脈が散らかっていない方が、モデルは賢く動くからね。

なぜシステムプロンプトにこれほどノイズが多いんだろう。ほとんどの場合、内容の大部分は適用されないし、汎用的な内容はモデルが元々知っているはずだ。

モデルが書いたエージェントスキルでも同じ間違いが起きるのを見たことがある。例えば、セキュリティ関連のスキルで一般的な脆弱性を列挙するようなものだ。でも、そんなリストは数年前のモデルならともかく、今のモデルには不要だ。今のモデルなら、小さなものでも上位のCWEを暗記していて、検索せずとも例を挙げて説明できる。

責任逃れ(CYA)のための文書のように感じられるね。あれだけの規模と影響力を持つ企業なら仕方がないのかもしれないが、「短く言えることを長々と書く」のは無駄にしか思えない。