モデル・effort・fast mode
モデルの別名と選び方、effort の段階、拡張思考、1M コンテキスト、fast mode、advisor、フォールバック、管理者向けの制限と関連する環境変数をまとめます。
model 設定には、モデルの別名(alias)かモデル名を指定します。モデル名は、Anthropic API なら完全なモデル名、Amazon Bedrock なら推論プロファイルの ARN、Microsoft Foundry ならデプロイ名、Google Cloud の Agent Platform ならバージョン名です。このページでは、モデルの選び方、effort(思考の深さ)、コンテキストの大きさ、fast mode、advisor、管理者が使える制限をまとめます。
- 別名(
opus・sonnetなど)は、プロバイダーごとの推奨バージョンに解決され、時間とともに更新される。固定するには完全なモデル名かANTHROPIC_DEFAULT_*_MODELを使う - モデルは
/model、--model、ANTHROPIC_MODEL、model設定の順に強く効く - effort は
/effortや--effortで変える。既定の段階はモデルで違う - fast mode は Opus を高速な構成で動かす研究プレビュー機能。料金が上がる
- advisor は、主モデルが重要な場面でより強いモデルに相談する実験的な機能
- 組織の管理者は
availableModelsなどでモデルを絞れる
ANTHROPIC_BASE_URL は、リクエストの送り先を変えるだけで、どのモデルが答えるかは変えません。LLM ゲートウェイはネットワークと LLM ゲートウェイを参照してください。
モデルの別名#
| 別名 | 動き |
|---|---|
default |
モデルの上書きを消し、アカウントの実行時の既定に戻す特別な値。別名そのものではない |
best |
Fable が使えるなら fable が解決するモデル、使えなければ opus と同じモデル |
fable |
プロバイダーの Fable モデル。最も難しく最も長いタスク向け |
sonnet |
日常のコーディング向けの最新の Sonnet |
opus |
複雑な推論向けの最新の Opus |
haiku |
単純なタスク向けの高速で効率のよい Haiku |
sonnet[1m] |
100 万トークンのコンテキストウィンドウの Sonnet。sonnet がすでに Sonnet 5.5 か Sonnet 5(最初から 1M)に解決されるときは効果がない |
opus[1m] |
100 万トークンのコンテキストウィンドウの Opus |
opusplan |
プランモードでは opus、実行では sonnet に切り替える特別なモード |
opus と sonnet が指すバージョンは、プロバイダーで変わります。
| プロバイダー | opus |
sonnet |
|---|---|---|
| Anthropic API | Opus 5.5 | Sonnet 5.5 |
| Claude Platform on AWS | Opus 5.5 | Sonnet 4.6 |
| Amazon Bedrock、Google Cloud の Agent Platform | Opus 5.5 | Sonnet 4.5 |
| Microsoft Foundry | Opus 4.6 | Sonnet 4.5 |
ANTHROPIC_DEFAULT_FABLE_MODELを設定しなければ、fableは Fable 5.1 に解決される。Claude apps gateway のセッションではfableとbestは Fable 5。claude-fable-5-1を配信するように設定されていないゲートウェイは、そのモデルのリクエストを拒否する。配信するゲートウェイでは/model claude-fable-5-1で選ぶ- 別名が古いモデルに解決される場合、新しいモデルは、完全なモデル名を明示するか、
ANTHROPIC_DEFAULT_OPUS_MODELかANTHROPIC_DEFAULT_SONNET_MODELを設定して使う - 別名が各バージョンに切り替わった時点は、末尾の「別名の切り替わり」にある
- 特定のバージョンに固定するには、
claude-opus-5-5のような完全なモデル名かANTHROPIC_DEFAULT_OPUS_MODELのような環境変数を使う
補足
Sonnet 5.5 は v2.1.284 以降、Opus 5.5 は v2.1.280 以降が必要です。古いバージョンからのリクエストが失敗したら、claude update で更新します。エラーはエラー一覧を参照してください。
Fable を使う#
Claude Fable 5.1 と Claude Fable 5 は、Claude Code で最も高性能なモデルで、1 回の作業時間に収まらない大きなタスク向けです。長い自律セッションを保ち、行動する前に調べ、小さなモデルより頻繁に自分の作業を検証します。Fable 5.1 が新しいほうです。どのプランでもどのプロバイダーでも、Fable は既定のモデルではなく、明示的に選びます。
| 選びたいモデル | 選び方 |
|---|---|
| Fable 5.1 | /model fable、または claude --model fable。Claude apps gateway のセッションでは /model claude-fable-5-1 |
| Fable 5 | モデル ID で選ぶ。Anthropic API なら /model claude-fable-5 か claude --model claude-fable-5。ほかのプロバイダーでは、そのプロバイダーの Fable 5 のモデル ID を使うか、ANTHROPIC_DEFAULT_FABLE_MODEL で固定する |
- Anthropic API に直接つなぎ、ユーザー設定のモデルが
claude-fable-5かclaude-fable-5[1m](v2.1.257 より前に/modelピッカーで Fable を選んだ場合など)なら、v2.1.257 以降を初めて動かしたときに、保存された値が別名fableかfable[1m]に変わり、起動時のモデル行に(auto-updated)が 1 回出る。プロジェクト・ローカル・管理設定のclaude-fable-5はそのまま - Fable のセーフティ分類器(多くはサイバーセキュリティと生物学の領域)が止めたリクエストは、自動モデルフォールバックの対象になる(後述)
- Fable 5.1 は v2.1.257 以降が必要。ZDR(ゼロデータ保持)での提供はセキュリティとデータの扱いを参照
ヒント
Fable には、手順ではなく成果を伝え、道筋は任せます。曖昧な問題(原因調査・障害のデバッグ・アーキテクチャの判断)で、追加の調査と検証が活きます。検証を促す注意書きは、あまり要りません。普段なら分割する大きな作業も、まとめて渡せます。成果に向かい続けさせるにはゴールを決めて任せることができます。
Anthropic API では、availableModels か組織のモデル制限が除外しない限り、Fable が /model ピッカーに出ます。組織が Fable を使えない場合(ゼロデータ保持など)は、理由の注記つきで灰色の行が残ります。
Fable と使用クレジット#
プランと席の種別によっては、Fable の利用がプランに含まれる枠ではなく使用クレジット(usage credits)に課金されます。その場合、/model ピッカーの Fable の行に「Requires usage credits」と出ます。
- 対話セッションでは、Fable のリクエストが使用クレジットに課金される前に、同意の確認が出る。組織課金の Enterprise プランのメンバーには出ない。使用クレジットで Fable を続けるか、既定のモデルに切り替えるかを選べ、確認を閉じることもできる。
/modelで Fable を選んだときに閉じると現在のモデルのまま、セッションの途中なら、そのターンは既定のモデルで続く。続けると選ぶと、以降は出ない - Remote Control 接続中・バックグラウンドセッション・エージェントチームのチームメイトのセッションは、端末の前に誰もいないことがあるので、途中の同意確認を
dialogExpiryの期限(既定 5 分)まで保留する。期限までに答えがなければ、リクエストを送らずにターンを終え、記録に通知を足す(Remote Control のクライアントにも出る)。モデルの選択は変わらず、次のメッセージでまた同意を求める - 確認を待っている間にできることは、セッションで違う。Remote Control 接続中かチームメイトのセッションでは、端末で任意のキーを押すと期限が取り消され、答えを待つ。バックグラウンドセッションでは期限までに答える。端末で誰も入力していないうちにリモートのクライアントから新しいメッセージを送ると、同じようにターンを終え、新しいメッセージが次のターンを始める。端末で誰かが入力した後は、答えを待ち続け、新しいメッセージはその後ろに並ぶ
- Agent SDK で別のアプリが動かすセッションは、確認を出すかをそのアプリが決める。出して、同じ
dialogExpiryまでに誰も答えなければ、リクエストを送らずにターンを終える -pの非対話モードと、確認を出さない Agent SDK のアプリでは、同意を求めず、使用クレジットに課金されるリクエストはそのまま課金される
モデルを設定する#
次の順に、上のほうが強く効きます。
- セッション中:
/model <別名|名前>で即座に切り替える。引数なしの/modelでピッカーが開く。確認が出る場合はコンテキストとプロンプトキャッシュを参照 - 起動時:
claude --model <別名|名前> - 環境変数:
ANTHROPIC_MODEL=<別名|名前> - 設定ファイル:
modelフィールド - 新しいセッションの既定:
ANTHROPIC_DEFAULT_MODEL=<別名|名前>
claude --model opus
/model sonnet
{
"permissions": {
"allow": ["Bash(npm run lint)"]
},
"model": "opus"
}
/model ピッカーの操作#
/model は、選んだモデルをユーザー設定の model フィールドに書き、新しいセッションの既定として保存します。
| 操作 | 動き |
|---|---|
| Enter | モデルを切り替え、既定として保存する |
| s | このセッションだけ切り替え、既定は変えない。別のキーにするには modelPicker:thisSessionOnly を割り当て直す |
/model <名前>と直接打つのは Enter と同じ。このセッションだけにするには、/modelでピッカーを開き、そのモデルの行で s を押す- Enterprise プランで claude.ai アカウントでログインしているとき、
/modelで既定を保存すると、その選択がアカウントにも記録される(v2.1.280 以降)。管理者が組織の既定モデルを設定していなければ、Default の選択肢が記録されたモデルに解決されうる。モデル制限が記録されたモデルを除外するか、アカウントで使えないときは、何も記録されていないものとして解決される。Default やopusplanを選んでも、記録は変わらない /modelでの切り替えは、メイン会話のモデルを引き継ぐサブエージェントにも及ぶ。サブエージェントのモデルは、Claude が起動するときにセッションが使っているモデルから決まるため。カスタムサブエージェントを小さいモデルに保つには、定義のmodelを設定する。詳しくはサブエージェント-pの非対話モードの/modelは、現在のセッションだけに効き、既定としては保存されない(この動きは v2.1.205 以降が必要)。プロジェクトと管理設定は引き続き優先され、次の起動で再適用される。上書きを有効にした組織の既定モデルも、次の起動で再適用される- v2.1.144〜v2.1.152 では、
/modelは現在のセッションだけに効き、ピッカーの d が既定を保存した --modelフラグとANTHROPIC_MODELは、それで起動したセッションだけに効く。複数の端末で別々のモデルを同時に動かすには、/modelで切り替えず、端末ごとに--modelで起動する/modelピッカーの価格は、Claude Code が Anthropic API と、直接または LLM ゲートウェイ越しに話すときに出る。行の価格は、その行が選ぶモデルの価格。Amazon Bedrock のようなサードパーティプロバイダーと Claude apps gateway では、プロバイダーかゲートウェイが支払いを決めるので、価格は出ない。価格は表示ラベルだけで、選ぶモデルや課金には影響しない。v2.1.206 より前は、Claude Platform on AWS とゲートウェイのセッションが Anthropic の定価を出し、行が選んだものとは別のモデルの価格を示すことがあった
再開したセッションのモデル#
claude --resume・--continue・/resume で再開したセッションは、現在の model 設定にかかわらず、記録が保存されたときのモデルを保ちます。復元されるモデルが退役済みか availableModels に除外されていれば、通常の優先順位に落ちます。別のセッションの /model の選択で、再開時のモデルが変わるのを防ぐためです。
- Amazon Bedrock・Google Cloud の Agent Platform・Microsoft Foundry のように、Anthropic のモデル ID ではなくプロバイダー固有のデプロイ ID を使うプロバイダーでは、記録のモデルは復元されず、通常の優先順位でモデルが決まる
- 新しい起動で
--modelかANTHROPIC_MODELを指定すると、復元されるモデルより優先される。v2.1.195 以降はANTHROPIC_DEFAULT_OPUS_MODEL系の変数も同じ。ANTHROPIC_DEFAULT_MODELも、その節の条件のもとで優先されることがある - 起動時のモデルが、自分の選択ではなくプロジェクトか管理設定から来ているときは、起動時のヘッダーにどの設定ファイルかが出る。
/modelで上書きできるが、次の起動でプロジェクトか管理設定が再適用される CLAUDE_CODE_PROVIDER_MANAGED_BY_HOSTを設定して Claude Code を組み込むプラットフォームでは、ホストのモデル構成が管理設定のモデル設定より優先される。管理設定のavailableModelsの許可リストは、ホストが独自のものを渡さない限り有効なまま- PreModelSwitch フックは、要求された切り替えの前に動き、ブロックしたり確認を求めたりできる(フックのリファレンス)。組織の管理プラグインが配る PreModelSwitch フックが分からないとき(管理プラグインの読み込み失敗など)、Claude Code は検査せずに適用せず、切り替えを拒否して、新しい試行のたびに確かめ直す
- Agent SDK の
setModel()、デスクトップアプリのようなアプリ、Remote Control でつないだデバイスから切り替えるとき、Claude Code は切り替えの時点で値を検査する。Agent SDK かアプリでは、v2.1.268 以降、ローカルで受け付けるモデル ID(カスタムモデルの選択肢など)を除き、そのセッションが初めてそのモデルに切り替えるときにプロバイダーへ確認する。確認はすべてのプロバイダーで走り、プロバイダーが提供しない ID は次のリクエストで失敗する代わりに、切り替えの時点で拒否される。Remote Control は、Anthropic API ではローカルで値を検査し、リクエストは送らない --model・ANTHROPIC_MODEL・model設定で指定した値は、事前には検査されず、打ち間違えた値は最初のリクエストで「There's an issue with the selected model」になる。メッセージはエラー一覧を参照- 要求したモデルに退役の予定日があるか、新しいバージョンに自動で置き換えられるときは、要求したモデルを名指しした警告が出る。対話セッションでは起動時の通知として出る。v2.1.182 以降は、既定のテキスト出力形式の非対話モードでは、同じ警告が stderr にも書かれる。サブエージェントの frontmatter の
modelも検査対象。--output-format jsonとstream-jsonでは stderr の警告が抑えられるので、実際のモデルは結果メッセージのmodelUsageフィールドで読む
新しいセッションの既定モデル(ANTHROPIC_DEFAULT_MODEL)#
ANTHROPIC_DEFAULT_MODEL=<別名|名前> で、セッションが既定で始まるモデルを選べます(v2.1.236 以降)。次のどれもモデルを選んでいないときだけ、新しいセッションがこの変数のモデルで始まります。
--modelフラグANTHROPIC_MODEL- いずれかの設定ファイルの
model値(/modelで保存した選択を含む) - 組織の既定モデル
/model で保存した選択は、以降の起動でもこの変数に勝ちます。ANTHROPIC_MODEL を設定した場合は、/model で何を保存していても、次の起動でその変数のモデルに戻ります。Default の選択肢も、組織の既定モデルが当てはまらない限り、この変数のモデルに解決されます(そのとき /model ピッカーの Default の行に「Set by ANTHROPIC_DEFAULT_MODEL」と出る)。
次の場合、Claude Code は変数を無視し、Default は設定しなかったものとして解決されます。
default・inherit・opusplan・haikuを設定したenforceAvailableModelsがオン- 組織のモデル制限がそのモデルを除外する
- そのモデルがアカウントで使えない
新しいセッションがこの変数のモデルで始まるはずのとき、claude --resume・--continue・/resume で再開したセッションもそのモデルで始まり、記録に保存されたモデルは復元されません。それ以外では、再開のときにこの変数は使われません。
選んだのと別のモデルで新しいセッションが始まるとき#
/model で選んだのに次のセッションが別のモデルで始まる、よくある原因は次のとおりです。
- 1 セッションだけで選んだ:ピッカーで s、
--modelで起動、非対話モードの/modelは、現在のセッションだけに効き、保存された既定は変わらない - 優先度の高いものがモデルを決めている:プロジェクトか管理設定の
model値、シェルのANTHROPIC_MODEL、ユーザーの選択を上書きするよう管理者が設定した組織の既定は、起動のたびに再適用される。/modelの選択は保存されたまま、優先度で負けている。プロジェクトか管理設定がモデルを決めているときは、起動時のヘッダーにファイル名が出る - Claude Code が選択を保存できなかった:
/modelは~/.claude/settings.jsonにmodelを書く。別のツールが生成しているか読み取り専用のコピーへのリンクで書けないと、選んだモデルはそのセッションだけで、次の起動は古い値を読む。ファイルを生成するツールでmodelを設定するか、書き込めるようにする。設定ファイルの仕組みも参照 - セッションを再開した:
claude --resumeか--continueで再開したセッションは、通常、現在の既定ではなく、使っていたモデルを保つ
現在のモデルの確認#
- ステータスラインを設定していれば、そこに出る(ステータスライン)
/statusに出る。アカウント情報も一緒に出る
effort(思考の深さ)#
effort は、適応的な推論(adaptive reasoning)を制御します。タスクの複雑さに応じて、各ステップで考えるかどうか・どれだけ考えるかをモデルが決めます。低い effort は単純なタスクで速く安く、高い effort は複雑な問題でより深く推論します。使える段階はモデルで違い、一覧にないモデルは effort に対応しません。
| モデル | 段階 |
|---|---|
| Fable 5.1 と Fable 5 | low・medium・high・xhigh・max |
| Opus 5.5・Sonnet 5.5・Opus 5・Sonnet 5・Opus 4.8・Opus 4.7 | low・medium・high・xhigh・max |
| Opus 4.6 と Sonnet 4.6 | low・medium・high・max |
使っているモデルが対応しない段階を設定すると、設定した段階以下で、対応する最も高い段階に落ちます(Opus 4.6 では xhigh が high で動く)。組織や自分の設定が、モデルが出す段階に上限を設けることもあります(後述の「組織の effort 上限」)。
セッションの effort は、次の順で最初に当てはまるものが使われます。
- 明示的な選択:
CLAUDE_CODE_EFFORT_LEVEL環境変数、--effortでの起動、セッション中の/effort(非対話の/effortは効き方が狭い。後述) - 設定:そのモデルに保存した段階か
effortLevelキー。両者の優先順位と、設定ファイル間の優先順位は設定キー一覧のmodelSettingsにある - モデルの既定の effort:effort に対応するすべてのモデルで
high。ただし Opus 5.5 と Sonnet 5.5 はmedium、Opus 4.7 はxhigh。組織が組織の既定モデルに既定の effort を設定している場合、そのモデルを動かすときはその段階が既定になる。自動モデルフォールバックのあとに適用される段階は、「フォールバック後の effort」を参照
- Opus 5.5 は、上のどれかがその段階を設定しない限り
mediumで始まる。ユーザー設定ファイルのトップレベルのeffortLevelは、Opus 5.5 には数えられない。このキーは、モデルごとに段階を保存する前に/effortが書いた古い形で、以前と同じ範囲(Opus 5・Fable 5.1・それ以前のモデル)では効き続ける。Opus 5.5 とそれ以降のモデルは、/effortか/modelピッカーで段階を選ぶまで、そのモデル自身の既定で始まる。プロジェクト・ローカル・管理設定、または--settingsで渡したトップレベルのeffortLevelは、すべてのモデルに効く - 対話セッションで
low・medium・high・xhighを設定するとき、確定のしかたで続く期間が決まる。/effortのスライダーか/modelピッカーで Enter、または/effortの後ろに段階を打つと、既定として保存され、以降のセッションに適用される。スライダーかピッカーで s を押すと、このセッションだけに適用される(v2.1.257 以降) - 段階はモデルごとに、ユーザー設定の
modelSettingsキーに保存され、各モデルが自分の段階を持つ maxは最も深い推論の段階。CLAUDE_CODE_EFFORT_LEVEL環境変数で設定しない限り、現在のセッションにだけ適用される- Remote Control でつないだ電話やブラウザの effort の操作で選んだ段階は、そのセッションだけに効く
-pの実行で/effortで設定した段階は、そのセッションだけに適用され、既定としては保存されない
段階の選び方#
| 段階 | 使う場面 |
|---|---|
low |
結果を毎回レビューする短いやりとり(ブレインストーミング・最初のスケッチ・名前の変更のような小さな変更) |
medium |
Opus 5.5 と Sonnet 5.5 の既定。新機能の実装のような、範囲が明確な日常のエンジニアリングに合う。ほかのモデルでは、多少の知能を犠牲にできるコスト重視の作業でトークンを減らす |
high |
検証が大切な作業や、エッジケースが起きやすい作業(既存のコードベースのバグ修正など)。Opus 5.5・Sonnet 5.5・Opus 4.7 以外のすべてのモデルの既定 |
xhigh |
トークンを多く使ってより深く推論する。Opus 4.7 の既定 |
max |
自分が付かなくても Claude に解かせたい難しい問題(セキュリティの脆弱性の発見など)。max は収穫が逓減し、考えすぎやすいので、広く使う前に試す |
ultracode |
段階ではなく Claude Code の設定。どの effort でも、重要なタスクごとにワークフローを計画する |
- Opus 5.5 と Fable 5.1 での試験では、高い段階の Claude はエッジケースを多く試し、答える前により多くの作業を検証した。判断も多く自分で下した。低い段階の Claude は出発点を早く返し、結果を毎回レビューして次の一手を導く作業に合う
- effort の目盛りはモデルごとに調整されているので、同じ段階名が、モデルをまたいで同じ値を表すわけではない
- Opus 5.5 の既定は
mediumで、Opus 5 の既定highより 1 段低い。Anthropic の試験では、mediumの Opus 5.5 は、コーディングと知識労働の評価で、highの Opus 5 に並ぶか上回る。同じ段階では、Opus 5.5 のほうが 1 ターンあたりによく考える傾向がある。Opus 5 から Opus 5.5 に移るときは、Opus 5 で使った段階を持ち越さず、mediumから始める
ultrathink で 1 回だけ深く考えさせる#
プロンプトのどこかに ultrathink と書くと、セッションの effort 設定を変えずに、そのターンだけ深い推論を求められます。Claude Code がキーワードを認識し、コンテキストに指示を足します。API に送る effort の段階は変わりません。「think」「think hard」「think more」のようなほかの語句は、ふつうのプロンプトの文として渡され、キーワードとしては認識されません。
effort の設定方法#
| 方法 | 内容 |
|---|---|
/effort |
引数なしでスライダーを開く。段階名を続けて直接設定する。/effort auto でそのモデルの保存した段階を消す。Claude の作業中にも実行でき、キャッシュの警告が出た場合は確認すると、ターンの次のリクエストから新しい段階が適用される |
/model の中 |
モデル選択中に、左右の矢印キーで effort のスライダーを調整する |
--effort フラグ |
起動時に段階名を渡し、1 セッションだけ設定する |
| 環境変数 | CLAUDE_CODE_EFFORT_LEVEL に段階名か auto を設定する |
| 設定 | modelSettings でモデルごとの段階を設定するか、effortLevel を low・medium・high・xhigh にして、段階を持たないモデルの既定にする。どちらのキーでも max は受け付けられず、ultracode には独自の ultracode キーがある |
| 接続したデバイスから | Remote Control のセッションで、電話やブラウザの effort の操作から段階を選ぶ。そのセッションだけに効く(v2.1.234 以降) |
| スキル・サブエージェントの frontmatter | スキルかサブエージェントの markdown に effort を書くと、その実行中の段階を上書きする |
- frontmatter の effort は、そのスキルかサブエージェントが動いている間、セッションの段階を上書きするが、環境変数は上書きしない。
maxEffortLevelと組織の effort 上限は、スキルやサブエージェントが動く段階を引き続き制限する - 管理設定に
effortLevelを設定すると、effort の優先順位の設定の段で適用され、ユーザーは/effortと--effortで変えられる。ユーザーを特定の段階以下に保つにはmaxEffortLevelを設定する - 対応するモデルを選んでいると、effort のスライダーが
/modelに出る。現在の effort は、セッションのヘッダーのモデル名の横にも「with low effort」のように出て、起動時と変更時にはフッターにも短く出る - キャッシュへの影響はコンテキストとプロンプトキャッシュを参照
ultracode#
/effort のスライダーには「Ultracode」のトグルがあります。Ultracode はモデルの effort の段階ではなく Claude Code の設定です。オンにすると、重要なタスクで Claude がワークフローを組み立て、セッションが動いている effort の段階のまま動きます。永続的に設定できる場所は ultracode 設定にあります。
/effortかultracode設定で ultracode をオン・オフしても、effort の段階は変わらない。--effort ultracodeフラグと Agent SDK のeffortLevel: "ultracode"の値は、オンにして、段階もxhighにする。/effortのスライダーか/modelピッカーで段階を選んでも、ultracode はそのまま/effort ultracodeで現在のセッションだけオン、/effort ultracode offでオフ。スライダーでは Tab で「Ultracode」のトグルを切り替え、Enter で適用するclaude --effort ultracodeは、xhighの effort で ultracode をオンにして始める- 設定ファイル・
--settings・Agent SDK の制御リクエストで"ultracode": trueを設定する。applyFlagSettings()のリクエストはeffortLevel: "ultracode"も受け付け、オンにして段階をxhighにする /effort ultracode off・スライダーのトグル・xhigh以外の段階で ultracode をオンのままにすること・effort の上限がxhighを下回っても使えること、は v2.1.284 以降が必要。v2.1.284 より前は、ultracode をオンにするとxhighになり、別の段階を選ぶとオフになり、xhighを下回る上限があると使えなかった--effortフラグと Agent SDK のeffortLevelにultracodeを渡すには v2.1.203 以降が必要。それより前はUnknown --effort value 'ultracode'と出て、既定の effort で始まった- 保存される
effortLevel設定とCLAUDE_CODE_EFFORT_LEVEL環境変数はultracodeを受け付けない。CLAUDE_CODE_EFFORT_LEVELか effort の上限がセッションの段階を決めているときは、ultracode はその段階のまま保たれる - ワークフローがオフのとき、またはモデルが
xhighに対応しないときは使えない。そのときの--effort ultracodeは、ultracode をオフにし、モデルと上限が許す最も高い段階(xhighまで)で始まる
適応的な推論と固定の思考バジェット#
適応的な推論は、各ステップで考えるかどうかを任意にし、Claude が定型のプロンプトに速く答え、深い思考が効くステップに取っておけるようにします。現在の段階が出すより多く・少なく考えさせたいなら、プロンプトか CLAUDE.md でそう伝えます。モデルは effort の設定の範囲でその指示に従います。
- Fable 系・Sonnet 5 以降・Opus 4.7 以降は、常に適応的な推論を使う。固定の思考バジェットのモードと
CLAUDE_CODE_DISABLE_ADAPTIVE_THINKINGはこれらに適用されない - Opus 4.6 と Sonnet 4.6 では、
CLAUDE_CODE_DISABLE_ADAPTIVE_THINKING=1を設定すると、MAX_THINKING_TOKENSで制御する以前の固定の思考バジェットに戻せる
拡張思考(extended thinking)#
拡張思考は、Claude が応答の前に出す推論です。適応的な推論に対応するモデルでは、考える量の主な制御は effort の段階で、下の設定は、思考のオン・オフと表示の制御です。Anthropic API で思考をオフにしたとき、Claude Code は、その組み合わせを受け付けないと分かっているモデル(Opus 5 など)には、より高い段階の代わりに effort high を送ります。
| 制御 | 設定方法 |
|---|---|
| 現在のセッションの切り替え | macOS は Option+T、Windows と Linux は Alt+T |
| 全体の既定 | /config で thinking mode を切り替える。~/.claude/settings.json に alwaysThinkingEnabled として保存される |
| 環境変数でオフにする | MAX_THINKING_TOKENS=0。Opus 5.5・Sonnet 5.5・Fable 系のモデルを除き、Anthropic API で思考をオフにする。サードパーティプロバイダーでは thinking パラメーターを省き、適応的な推論のモデルはそれでも考えることがある |
- Opus 5.5・Sonnet 5.5・Fable 系のモデルでは、思考をオフにできない。セッションの切り替えと
/configの行は、スイッチを出す代わりにThinking can't be turned offと出し、保存されたalwaysThinkingEnabled: falseとMAX_THINKING_TOKENS=0は効かない。これらのモデルでは、effort の段階に基づいてステップごとに考える量をモデルが決める。保存した設定は、それを受け付けるモデルに切り替えると再び効く - Claude Code は、既定で思考の出力を折りたたむ。Ctrl+O で詳細モードを切り替えると、推論が灰色の斜体で見える。Anthropic API の対話セッションは、既定で伏せられた(redacted)思考ブロックを受け取るので、展開したときに完全な要約を使えるようにするには、設定で
showThinkingSummaries: trueを設定する - 折りたたまれていても伏せられていても、生成された思考トークンはすべて課金される
コンテキストの大きさ#
Fable 5.1・Fable 5・Sonnet 5 以降・Opus 4.6 以降・Sonnet 4.6 は、大きなコードベースの長いセッション向けの 100 万トークンのコンテキストウィンドウに対応します。
- Anthropic API では、Fable 5.1・Fable 5・Sonnet 5 以降・Opus 4.7 以降が、Pro を含むすべてのプランで 1M のウィンドウで動く。これらのモデルでは
[1m]版を選ぶことも使用クレジットをオンにすることも要らない(Fable の利用自体は、プランによっては使用クレジットに課金される) - Opus 4.6 と Sonnet 4.6 は、
[1m]版でだけ 1M に届き、その利用可否はプランで決まる
| プラン | Opus 4.6(1M コンテキスト) | Sonnet 4.6(1M コンテキスト) |
|---|---|---|
| Max・Team・Enterprise | サブスクリプションに含まれる | 使用クレジットが必要 |
| Pro | 使用クレジットが必要 | 使用クレジットが必要 |
| API と従量課金 | 全面的に利用できる | 全面的に利用できる |
- Team の Standard 席と Premium 席を含め、Max・Team・Enterprise の各プランでは、1M コンテキストの Opus 4.6 がサブスクリプションに含まれる。Sonnet 4.6 の 1M は、Max を含むすべてのサブスクリプションで使用クレジットが必要
- Claude Code がこのプランの要件を検査するのは、Anthropic API に直接つなぐときだけ。
ANTHROPIC_BASE_URLを LLM ゲートウェイに向け、保存済みの claude.ai のログインが有効な認証情報のままなら、使用クレジットは検査されない。[1m]の選択肢は/modelに残り、リクエストが成功するかはゲートウェイが決める。v2.1.229 より前は、その構成でアカウントの使用クレジットを確認できないと/model sonnet[1m]が拒否された ANTHROPIC_BASE_URLを LLM ゲートウェイなどのプロキシに向けると、Claude Code は、認識するモデルそれぞれに、Anthropic API と同じコンテキストウィンドウを与える。Fable 5.1・Fable 5・Sonnet 5 以降・Opus 4.7 以降は 1M で、選ぶ[1m]版はない。[1m]版でだけ 1M に届くモデル(Opus 4.6 など)は、それなしでは 200K で動く。ゲートウェイやその後ろのサーバーが強制するより低い上限は、Claude Code に検出できない。ゲートウェイが 200K トークンを超えるリクエストを拒否するなら、Claude Code を起動する環境にCLAUDE_CODE_AUTO_COMPACT_WINDOW=200000を設定し、すべてのモデルのセッションがその境界で圧縮されるようにする- 1M コンテキストをオフにするには
CLAUDE_CODE_DISABLE_1M_CONTEXT=1。Claude Code はモデルピッカーから 1M のモデル版を取り除く。Sonnet 5 や Fable 系のように最初から 1M のウィンドウを持つモデルでは、200K のコンテキストウィンドウとして扱う。自動圧縮がオンなら 200K の境界で圧縮し(自動圧縮のウィンドウを 200K より大きく設定しても保留は解けない。モデルのコンテキストウィンドウで上限が切られるため)、オフなら圧縮せず 200K の境界でコンテキスト上限のエラーで止まる。v2.1.223 より前は、Sonnet 5・Opus 4.8・Opus 5 のセッションだけを 200K に留めた - 1M のウィンドウは標準のモデル料金で、200K を超えるトークンの割増はない。拡張コンテキストがサブスクリプションに含まれるプランでは、利用は引き続きサブスクリプションの範囲。使用クレジットで拡張コンテキストを使うプランでは、トークンが使用クレジットに課金される
- アカウントが 1M コンテキストに対応していれば、最新の Claude Code では
/modelピッカーにその選択肢が出る。出なければ、セッションを再起動する。サードパーティプロバイダーでは、デプロイがANTHROPIC_DEFAULT_*_MODEL変数でモデルを固定していないかを確かめる
[1m] の接尾辞は、別名にも完全なモデル名にも付けられます。
# opus[1m] か sonnet[1m] の別名を使う
/model opus[1m]
/model sonnet[1m]
# または完全なモデル名に [1m] を付ける
/model claude-opus-4-8[1m]
Sonnet 5.5 と Sonnet 5 のコンテキストウィンドウ#
Anthropic API では、Sonnet 5.5 と Sonnet 5 は常に 1M のコンテキストウィンドウで動きます。200K 版も [1m] の接尾辞もなく、どのプランでも使用クレジットは要りません。ウィンドウが埋まる前、既定では約 967K トークンで自動圧縮されます。別のしきい値にするには CLAUDE_CODE_AUTO_COMPACT_WINDOW を設定します。LLM ゲートウェイや独自の ANTHROPIC_BASE_URL の後ろでも、同じ 1M のウィンドウが与えられます。ウィンドウを 200K にするには、CLAUDE_CODE_DISABLE_1M_CONTEXT=1 を使います(最初から 1M のウィンドウを持つすべてのモデルのセッションを 200K に保つ。コンテキストを制限したいデプロイ向け)。
自動圧縮のウィンドウ#
自動圧縮のウィンドウは、Claude Code が会話を圧縮するまでに、コンテキストウィンドウがどこまで埋まってよいかです。圧縮で何が残るかはコンテキストとプロンプトキャッシュを参照してください。
設定の場所#
| 方法 | 内容 |
|---|---|
/autocompact <値>(例:/autocompact 500k) |
現在のモデルについて、現在と以降のセッションに効く。ユーザー設定の modelSettings の現在のモデルの下に保存して現在のセッションに適用する。管理設定のような優先度の高い設定範囲が、そのモデルかすべてのモデルに自分のウィンドウを設定していると、コマンドは値を保存するが、セッションはその範囲のウィンドウを保ち、コマンドがそう伝える。/autocompact auto でモデルに合わせて調整されたウィンドウに戻す。v2.1.288 より前は、コマンドはすべてのモデルに1つのウィンドウを、最上位の autoCompactWindow として保存した |
autoCompactWindow 設定 |
すべてのモデル向け。~/.claude/settings.json に "autoCompactWindow": 200000 のように書く。同じファイルでは、あるモデルについて /autocompact で保存したウィンドウが、そのモデルではこのキーより優先される |
--autocompact フラグ |
1 回の起動だけ。保存された設定を変えずに、その起動では上書きする。claude --autocompact auto は、保存された設定に値があっても、調整されたウィンドウで動かす。/autocompact と違い、管理設定のような優先度の高い設定範囲には妨げられない |
CLAUDE_CODE_AUTO_COMPACT_WINDOW 環境変数 |
スクリプトとクラウド環境向け。設定している間は、コマンド・フラグ・設定のどれより優先され、/autocompact はウィンドウを変えずに上書きされていると報告する |
- コマンドとフラグは 100K〜1M トークンのウィンドウサイズを受け付ける。
200000のようなトークン数、500kや1MのようにkかMを付けた形、100〜1000 の数字だけ(千単位として扱い、200は 200,000) - 環境変数はトークン数の数字だけを受け付ける。ウィンドウは、モデルのコンテキストウィンドウで上限が切られる
既定のしきい値#
自動圧縮のウィンドウを設定しなければ、会話がモデルのコンテキスト上限に達したときに圧縮されます。次の例外があります。
- クラウドセッションは、会話がモデルの上限に近づくと圧縮される
- 拡張コンテキストなしの Sonnet 4.6 と Opus 4.6 は 200K の境界で圧縮される。Amazon Bedrock・Google Cloud の Agent Platform・Microsoft Foundry のように 200K のコンテキストウィンドウで動く Opus 4.8 以降も同じ
CLAUDE_CODE_DISABLE_1M_CONTEXT=1を設定すると、Sonnet 5 や Fable 系のように最初から 1M のウィンドウを持つモデルが 200K の境界で圧縮される- 最初から 1M のウィンドウで動くモデルは、ウィンドウが埋まる前、既定では約 967K トークンで圧縮される。Anthropic API では、Sonnet 5・Fable 系・Opus 4.7 以降が当てはまる。Amazon Bedrock・Google Cloud の Agent Platform・Microsoft Foundry で、どのモデルがそのウィンドウで動くかは、後述の「サードパーティのデプロイでモデルを固定する」にある。独自の
ANTHROPIC_BASE_URLの後ろでは、上のコンテキストの大きさの節にある - LLM ゲートウェイの別名のように、Claude Code が認識しないモデル ID のセッションは、その ID に Claude Code が想定するコンテキストウィンドウで圧縮される
ゲートウェイや独自のモデル ID のウィンドウを補正する#
LLM ゲートウェイなどの独自のデプロイでは、Claude Code が、モデル ID に想定するコンテキストウィンドウが、モデルの実際のウィンドウと違うことがあります。そのときは CLAUDE_CODE_MAX_CONTEXT_TOKENS を、Claude Code に想定させたいウィンドウにします。この変数の効き方は ID で違います。
- Claude Code が、
claude-で始まらない(大文字小文字を問わず)、または Google Cloud の Agent Platform の@YYYYMMDDの日付のように、ID を読むときに取り除く接尾辞を持つ ID を、プロバイダーか独自の綴りとして扱う。v2.1.259 より前は、取り除く接尾辞を数えず、日付の接尾辞が付いた未認識のclaude-の ID が、接尾辞なしの素のclaude-の名前として扱われた - プロバイダーか独自の綴りを認識するモデルに解決できず、ID に
[1m]を含まない:変数が直接適用され、先回りの圧縮は宣言したウィンドウで続く - プロバイダーか独自の綴りを認識するモデルに解決できず、ID に
[1m](大文字小文字を問わず)を含む:Claude Code はそれに 1M のウィンドウを想定し、変数は単独では適用されない。先回りの圧縮を保ったままウィンドウを補正するには、CLAUDE_CODE_DISABLE_1M_CONTEXT=1も設定する。その変数があると、Claude Code は ID を[1m]なしの同じ綴りと同様に扱うので、CLAUDE_CODE_MAX_CONTEXT_TOKENSは、その[1m]なしの綴りに適用されるときに適用される。宣言したウィンドウが 200K を超えるときは、200K の上限が強制されないという起動時の警告が出る。この構成では、警告は想定どおり - ID が認識するモデルに解決される、または接尾辞を取り除くものがない素の
claude-の名前(大文字小文字を問わず):変数が効くのは、すべての圧縮を無効にするDISABLE_COMPACTも設定したときだけ。たとえばanthropic/claude-opus-4-8・us.anthropic.claude-…-v1:0・日付付きのclaude-sonnet-4-5@20250929のように、Claude Code が知る Claude のモデル名を含む ID は、そのモデルに解決される。[1m]も含む ID も同じで、claude-opus-4-8[1m]はCLAUDE_CODE_DISABLE_1M_CONTEXTを設定していても Opus 4.8 に解決される
Claude Code が認識しないモデル ID では、CLAUDE_CODE_DISABLE_UNKNOWN_MODEL_WINDOW_ENFORCEMENT=1 を設定すると、API が、Claude Code が認識する長すぎるエラーで会話を拒んだ後でだけ圧縮します。ゲートウェイが、Claude Code が認識しない文言にエラーを書き換えると、その回復は動きません。
特別なモデルの動き#
default モデル設定#
default の動きは、アカウントの種類で決まります。
| アカウント | default |
|---|---|
| Pro・Max・Team・Enterprise・Anthropic API | Opus 5.5 |
| Claude Platform on AWS・Amazon Bedrock・Google Cloud の Agent Platform | Opus 5.5 |
| Microsoft Foundry | Sonnet 4.5 |
- v2.1.280 より前は、
defaultは Pro と Team Standard で Sonnet 5 に、Max・Team Premium・Enterprise・Anthropic API・Claude Platform on AWS・Amazon Bedrock・Google Cloud の Agent Platform で(v2.1.219 以降)Opus 5 に解決された。v2.1.219 より前は、Anthropic API・Max・Team Premium・Enterprise の従量課金で v2.1.154 以降、Claude Platform on AWS・Amazon Bedrock・Google Cloud の Agent Platform で v2.1.207 以降、Opus 4.8 に解決された。v2.1.207 より前は、Claude Platform on AWS で Opus 4.7、Amazon Bedrock と Google Cloud の Agent Platform で Sonnet 4.5 に解決された - 管理者が組織の既定モデルを設定していると、
defaultは上のアカウントの種類の既定の代わりにそのモデルに解決される(v2.1.196 以降)。ANTHROPIC_DEFAULT_MODELで設定したモデル(その節の条件のもとで)や、アカウントに記録されたモデルに解決されることもある - アカウントに何も記録されておらず、管理設定が Default モデルに許可リストを強制し、アカウントの種類の既定が
availableModelsにないときは、defaultはアカウントの種類の既定ではなく、強制された Default に解決される。組織の既定と強制の両方が当てはまるときは、組織の既定が先にアカウントの種類の既定を置き換え、その後に強制が適用される。許可リストにある組織の既定は保たれ、リスト外のものは強制された Default に解決される - Fable 系のモデルは、どのプランでもどのプロバイダーでも、アカウントの種類の既定ではない。
/modelで選ぶとユーザー設定に選んだモデルとして保存され、以降のセッションがそれで始まる
opusplan モデル設定#
opusplan は、自動の混成の方式です。
- プランモード:複雑な推論とアーキテクチャの判断に
opusを使う - 実行モード:コード生成と実装には、自動で
sonnetに切り替える
Opus の推論による計画と、Sonnet の効率による実行を組み合わせます。
- プランモードの Opus の段階は
opusのモデル設定と同じコンテキストウィンドウを使い、実行の段階はsonnetと同じウィンドウを使う。opusとsonnetが、現在のモデルのように最初から 1M のコンテキストウィンドウで動くモデルに解決されるとき(Anthropic API など)は、両方の段階がそれで動く。そうでない場合に両方の段階で 1M を要求するには、モデルをopusplan[1m](/model opusplan[1m]など)に設定する。/modelで設定するには v2.1.265 以降が必要で、それより前は--modelフラグかmodel設定を使う availableModelsが最新の Opus を除き古いバージョンを許可しているとき(["sonnet", "claude-opus-4-6"]など)、opusplanは計画に許可された最新の Opus を使い、すべての Opus が除かれたときだけ Sonnet に留まる。通常はプランモードで Sonnet にアップグレードする Haiku のセッションも、許可された最新の Sonnet を使い、すべての Sonnet が除かれたときだけ Haiku に留まる。v2.1.205 より前は、アップグレード先の系統の最新が除かれていると、古いバージョンが許可されていても、プランモードはセッションのモデルに留まった- 古い許可済みバージョンへの置き換えは、Anthropic API と Claude Platform on AWS で適用される。プロバイダー固有のモデル ID を使う Amazon Bedrock・Google Cloud の Agent Platform・Microsoft Foundry・Mantle では、アップグレード先のモデルが除かれていると、プランモードはセッションのモデルに留まる
- プランの境界ではなく、作業の途中で別のモデルに相談するかを Claude が決める混成の方式は、後述の advisor にある
フォールバックモデルの連鎖#
主モデルが過負荷・利用不可、または再試行できないサーバーエラーを返したとき、Claude Code は、リクエストを失敗させる代わりに、フォールバックのモデルに切り替えられます。認証・課金・レート制限・リクエストサイズ・通信のエラーと、組織のポリシー検査による拒否は切り替えを起こさず、通常の再試行とエラー処理になります。Amazon Bedrock か Google Cloud の Agent Platform が、アカウントが呼べないモデルを拒むとき(途中でモデルが無効になった場合)は、認証エラーではなくモデルが使えないものとして扱い、切り替えます。
- フォールバックのモデルを 1 つ以上設定すると、Claude Code は順に試し、切り替えるとき通知を出す。切り替えは現在のターンだけで、次のメッセージはまた主モデルから試す。連鎖は、重複を除いて 3 モデルまで。余分な項目は無視される
- 1 セッションだけの連鎖は、カンマ区切りの一覧を受け付ける
--fallback-modelフラグで設定する - 連鎖をセッションをまたいで残すには、
fallbackModelを配列で設定する。--fallback-modelフラグはfallbackModel設定より優先される。各項目はモデル名か別名を受け付け、"default"は既定のモデルに展開される - Claude Code は、起動時に連鎖を確認せず、
/statusにも出さない。切り替えのときに出る通知が、フォールバックが設定されていると分かる最初の手がかり - リクエストが切り替わるとき、Claude Code は受け付ける項目が出るまで順に試す。設定に固定した退役済みのモデルなど、到達できない項目も、同じように次へ切り替わる
- 試す前に Claude Code が取り除く項目は 2 種類:
availableModelsが許可しない項目(連鎖を読むときに落とす)と、圧縮中の、主モデルより小さいコンテキストウィンドウのモデル(連鎖は圧縮も対象にするが、そこで要約すると会話の一部が先に切れるため)。すべてのフォールバックが小さければ、圧縮は元のエラーを示し、再試行できる - 連鎖はサブエージェントにも適用される。サブエージェントのリクエストが切り替わると、設定したフォールバックのモデルを順に試し、サブエージェントはリクエストを受け付けたモデルで続ける。セッションのモデルは変わらない。v2.1.247 より前は、連鎖が対象にする失敗でサブエージェントが終わった
claude --fallback-model sonnet,haiku
{
"fallbackModel": ["claude-sonnet-5", "claude-haiku-4-5"]
}
自動モデルフォールバック#
過負荷や利用不可による切り替えとは別に、内容に基づくフォールバックがあります。対象は Fable 系のモデル・Opus 5.5・Sonnet 5.5・Opus 5 です。これらはセーフティ分類器で動き、多くはサイバーセキュリティと生物学の内容にフラグを立てます。分類器がリクエストにフラグを立て、そのカテゴリにフォールバックのモデルがあるとき、Claude Code はそのモデルでリクエストをやり直し、記録に通知を出します。この 2 つのカテゴリで、フォールバック先は、断ったモデルで決まります。
| 断ったモデル | 生物学のフラグ | サイバーセキュリティのフラグ |
|---|---|---|
| Fable 5.1・Fable 5・Opus 5.5 | Opus 5 でやり直す | Opus 4.8 でやり直す |
| Sonnet 5.5 | 拒否で終わる(生物学のフォールバックモデルがない) | Sonnet 5 でやり直す |
| Opus 5 | 拒否で終わる(Opus 5 は自分の生物学の分類器を動かし、フォールバックのモデルがない) | Opus 4.8 でやり直す |
- フォールバックの後は、セッションがフォールバック先のモデルで続く。元のモデルに戻るには
/modelを実行する - カテゴリに基づくフォールバックは v2.1.219 以降が必要。それより前は、フラグが立った Fable 5 のリクエストはすべて、プロバイダーの既定の Opus モデルでやり直され、Opus 5 はフォールバックの元にならなかった
- フォールバック先は
availableModelsで検査される。ブロックされていればフォールバックは起きず、拒否は通常のエラーとして示され、セッションのモデルは変わらない - Amazon Bedrock・Google Cloud の Agent Platform・Microsoft Foundry では、これらのフォールバック先がデプロイのモデル ID で解決される。関わるモデルのすべてを Claude Code が特定できる場合にだけ働く。現在のモデルを元として認識する必要がある(Fable 5.1 と Fable 5 は、モデル ID に
claude-fable-5を含む・ANTHROPIC_DEFAULT_FABLE_MODELの値に一致する・modelOverridesで対応づけられている、のいずれか。Opus 5.5・Sonnet 5.5・Opus 5 は、プロバイダーのモデル ID かmodelOverridesの対応づけで認識される)。Opus のフォールバック先も、どのモデルが断っても、デプロイで解決できる必要がある(ANTHROPIC_DEFAULT_OPUS_MODELを設定するか、プロバイダーのモデル一覧に Opus 4.8 の項目を残す。なければ、Sonnet 5.5 を含むすべての元のモデルでフォールバックがオフになり、フラグが立ったリクエストは拒否で終わる)。フラグが立ったカテゴリのフォールバック先も解決できる必要がある - どちらのモデルも特定できなければ、Claude Code は切り替えず、フラグが立ったリクエストは拒否のメッセージで終わる。
/modelで切り替えて再試行できる。両方を特定できるようにするには、元のモデルの固定を設定する:Fable 系はANTHROPIC_DEFAULT_FABLE_MODELに Fable のモデル ID、すべての元のモデルはANTHROPIC_DEFAULT_OPUS_MODELに Opus のモデル ID(Opus の系統の外のモデルや、断ったモデル自身を指す固定は、拒否のままにする)、Sonnet 5.5 は Opus の固定に加えてANTHROPIC_DEFAULT_SONNET_MODELを設定するか、プロバイダーのモデル一覧に Sonnet 5 の項目を残す(Sonnet の系統の外のモデルや Sonnet 5.5 自身を指す固定は、拒否のままにする) ANTHROPIC_DEFAULT_OPUS_MODELを設定していると、Fable 系・Opus 5.5・Opus 5 からフラグが立ったリクエストは、フォールバックのあるすべてのカテゴリで、そのモデルでやり直される(Opus 5 の生物学のフラグは拒否のまま)。設定していなければ、サイバーセキュリティのフラグは Opus 4.8 の項目で、Fable 系か Opus 5.5 の生物学のフラグは Opus 5 の項目でやり直される。Sonnet 5.5 のサイバーセキュリティのフラグは、ANTHROPIC_DEFAULT_SONNET_MODELに設定したモデル、設定していなければプロバイダーのモデル一覧の Sonnet 5 の項目でやり直される
フォールバックは、セッションの最初のリクエストで起きることがあります。最初のリクエストには、CLAUDE.md の内容や git status のようなワークスペースの文脈が載るためで、セキュリティや生物学の資料を含むリポジトリは、その文脈だけで分類器に引っかかりえます。カスタマイズが原因かを確かめるには、CLAUDE.md・スキル・MCP サーバー・フックなどのカスタマイズを無効にする claude --safe-mode でセッションを始めます(git status とディレクトリ名はカスタマイズではないので含まれたまま)。
毎回自動で切り替えず、リクエストにフラグが立つたびに決めたいなら、/config で「Switch models when a message is flagged」をオフにするか、設定ファイルで switchModelsOnFlag を false にします。フラグが立ったリクエストは、フォールバックのモデルに切り替えるか、プロンプトを編集して現在のモデルで再試行するかの 2 つの選択肢を出して、セッションを止めます。挙動が違う場合があります。
- フラグが立ったカテゴリにフォールバックのモデルがないとき(Opus 5 や Sonnet 5.5 の生物学のフラグなど)は、確認を出さず、リクエストは拒否で終わる
- 両方のモデルが同じリクエストにフラグを立てたときは、プロンプトを編集して再試行するか、新しいセッションを始める
- モバイルアプリのクラウドセッションでは、編集して再試行はサポートされない。モデルを切り替えるか、デスクトップのブラウザかデスクトップアプリでセッションを続ける
- 確認を出せない非対話モードと SDK の統合では、フラグが立ったリクエストは拒否でターンが終わる
- フォールバック先が
availableModelsにブロックされているときも確認を出さず、フラグが立ったリクエストは、自動フォールバックでフォールバック先がブロックされている場合と同じく、拒否で終わる
フォールバック後の effort#
Claude Code がセッションをフォールバックのモデルに切り替えるとき、そのモデルの既定の effort の代わりに、フラグが立ったリクエストが動いていた effort を引き継ぎます。たとえば、既定の medium で動く Opus 5.5 のセッションが Opus 4.8(既定は high)にフォールバックしても、medium のままです。
次のようなときは、別の段階が適用されます。
- 設定か組織の既定:フォールバックのモデルに当たる設定の段階、または組織がそのモデルに設定した既定の effort が、代わりに適用される
- 自分の変更:effort の段階を選ぶ、
/modelでモデルを選ぶ、またはあとでセッションを再開すると、フラグが立ったリクエストの段階はもう引き継がれない - スキルの effort:スキルの
effortフロントマターがフラグが立ったリクエストに設定した段階は、そのターンに適用され、以降のターンは、effort の決まる順がフォールバックのモデルに与える段階で動く
セッションのヘッダーが、モデル名の隣に有効な段階を出します。変えるには、セッションで /effort を実行します。
補足
攻撃的セキュリティや生物学の作業(ペネトレーションテスト・CTF・生物学に近いコードベースなど)は、最初のリクエストでも、フォールバックを頻繁に起こします。生物学の実質的な作業では、Fable 5.1・Fable 5・Opus 5.5 のセッションは最初のフラグで Opus 5 に移り、Opus 5 には生物学のフォールバックがないので、以降の生物学のフラグは拒否で終わります。Opus 5 と Sonnet 5.5 では、最初のフラグから拒否になります。これはこの分野の想定どおりの経路で、アカウントのフラグではありません。組織がこの作業に Fable 級の能力を必要とするなら、Anthropic のアカウント担当に、信頼されたアクセスのプログラムを問い合わせます。
fast mode#
fast mode は、Claude Opus の高速な構成で、モデルをトークンあたりの費用を上げて最大 2.5 倍速くします。研究プレビュー(research preview)の機能で、機能・料金・提供は、フィードバックで変わることがあります。別のモデルではなく、速度をコスト効率より優先する別の API 構成を使う Claude Opus で、品質と能力は同じで応答が速くなります。反復の速い作業やライブのデバッグで速さが要るときにオンにし、遅延よりコストが大事なときはオフにします。
- 対応するのは Opus 5.5・Opus 5・Opus 4.8。Sonnet・Haiku・ほかのモデルでは使えない。Opus 4.7 は対応せず、切り替えると fast mode がオフになる(Opus 4.7 の fast mode は 2026-06-25 に非推奨になり、2026-07-24 に削除された)
- 入出力 100 万トークンあたりの fast mode の料金は、Opus 5.5 が $8/$40、Opus 5 と Opus 4.8 が $10/$50。1M トークンのコンテキストウィンドウの全体で一律
- サブスクリプションプラン(Pro・Max・Team・Enterprise)と Claude Console で使える。Team と Enterprise は、先にオーナーが有効にし、Console の組織はアクセスの提供が必要。サブスクリプションプランでは、使用クレジットだけで使え、サブスクリプションのレート制限には含まれない
- fast mode は、CLI では
/fast、VS Code 拡張では、選んだモデルが対応するとき「Toggle fast mode」のコマンドで切り替える。切り替えはfastMode設定に保存される - Opus 5.5 は、Claude Code v2.1.280 以降の fast mode の既定。v2.1.280 より前は、v2.1.219 から Opus 5、v2.1.154〜v2.1.218 は Opus 4.8、v2.1.142〜v2.1.153 は Opus 4.7 が既定だった
切り替え方#
CLI では次のどちらかで切り替えます。
-
/fastを実行し、Space でオン・オフを切り替え、Enter で確定する -
ユーザー設定ファイルに
"fastMode": trueを設定する -
対話セッションでオンにした fast mode は、既定ではセッションをまたいで残る。セッションごとにリセットするようにもできる(後述の「セッションごとのオプトイン」)
-
クラウドセッション以外で、
-pの非対話モードの/fastは、--settingsに fast mode を渡して起動したセッションでだけ働く(例:claude -p --settings '{"fastMode": true}')。切り替えはそのセッションだけに適用され、既定としては保存されない。-pの形は v2.1.205 以降が必要。非対話モードのほかの場所では、fast mode は使えないと報告される -
Claude の作業中にも
/fastを実行でき、Claude Code はターンの終了を待たずに切り替える。実行中のターンは元の速度で終わり、速度の変更は次のターンから効く。現在のモデルが fast mode に対応しないときは、オンにするとモデルも切り替わり、そのターンの次のリクエストから新しいモデルを使う -
コスト効率のため、会話の途中で切り替えるのではなく、セッションの最初に有効にする(コストのしくみは後述)
-
オンにすると:現在のモデルが fast mode に対応しなければ Opus に切り替わる。「Fast mode ON」の確認が出る。fast mode の間、プロンプトの横に小さな
↯のアイコンが出る。/fastをもう一度実行すると、いつでもオンかオフかを確認できる -
/fastでオフにしても Opus のまま。別のモデルにするには/modelを使う -
クラウドセッション:アカウントで使えるとき、Anthropic が管理するインフラでもセルフホストのランナーでも、fast mode はクラウド(Web)のセッションで動く(セッションの環境で v2.1.271 以降が必要)。セッションで
/fast onと打つとオンになり、そのセッションだけで、既定としては保存されない。claude.ai/code では、メッセージ欄のモデルのメニューからも切り替えられる(プランが fast mode を含み、選んだモデルが対応するときに表示)
fast mode を使っているときのモデルの切り替え#
fast mode は、モデルの切り替えに双方向で従います。
- 切り替えて離れる:fast mode に対応しないモデルに切り替えると、Claude Code は fast mode をオフにする。Opus 4.7 も含む(v2.1.221 より前は、Opus 4.7 に切り替えても fast mode がオンのままで、API がリクエストを拒否した)
- 戻る:対応する Opus に戻すと、保存した fast mode の設定がオンなら、fast mode が再びオンになる。モデルの切り替えが、保存した設定がオフのセッションの fast mode をオンにすることはない。セッションごとのオプトインを設定していると、戻っても自動ではオンにならず、
/fastで有効にし直す - モデルの切り替えで fast mode がオン・オフになるたびに「Fast mode ON」か「Fast mode OFF」の確認が出て、オンの間は
↯のアイコンが出る。/model・/config model=<モデル>・Remote Control でつないだデバイスのどれで切り替えても同じ - Claude Code は、モデルの切り替え・再接続・失敗した提供の確認の後に、セッションの fast mode の状態を、Remote Control でつないだデバイスへ送り直す
コストの考え方#
- 会話で初めて fast mode をオンにしたとき、会話のコンテキスト全体に、fast mode の未キャッシュの入力トークンの全額を払う。会話の深いところほど高くなるので、最初からオンにするほうが安い。コストは会話ごとに 1 回で、オフにして後でまたオンにしても繰り返されない。しくみはコンテキストとプロンプトキャッシュにある
- fast mode の支出が出る場所は、サインインの方法で違う。まず
/statusを実行し、Login methodの行(Claude Max accountなど)があれば Claude サブスクリプション、API keyの行なら Claude Console の組織に課金される
| サインインの方法 | fast mode の支出を見る場所 |
|---|---|
| Pro と Max | 使用クレジットから払う。claude.ai の「Settings > Usage」の「Usage credits」に、今月の使用クレジットの支出が出る(fast mode を含むが、内訳は出ない) |
| Team と Enterprise | 組織が組織の使用クレジットから払う。自分の使用クレジットの支出は /usage で見る |
| Claude Console | 組織が、ほかの API の利用と一緒に払う。Console の Usage と Cost のページで、「Group by」のメニューから「Speed (Research Preview)」を選ぶと、fast mode を標準速度の利用と分けられる(選んだ期間に fast mode の利用があるときだけ出る) |
いつ使うか#
fast mode は、応答の遅延がコストより大事な対話的な作業に向きます。
- コード変更の素早い反復
- ライブのデバッグ
- 期限が厳しい作業
標準モードのほうが向くのは、速さがあまり要らない長い自律タスク、バッチ処理や CI/CD のパイプライン、コストに敏感な作業です。
| 設定 | 効果 |
|---|---|
| fast mode | モデルの品質は同じ、遅延は低い、コストは高い |
| 低い effort の段階 | 考える時間が短く、応答が速い。複雑なタスクでは品質が下がりうる |
ヒント
両方を組み合わせて、単純なタスクで最大の速さを得るには、fast mode と低い effort の段階を併用します。
要件#
fast mode には次のすべてが必要です。
- Anthropic API かサブスクリプションだけ:Anthropic Console の API と、使用クレジットを使う Claude サブスクリプションプランで使える。Amazon Bedrock・Google Cloud の Agent Platform・Microsoft Foundry・Claude Platform on AWS では使えない。Console の組織は、fast mode のアクセスの提供も必要
- サブスクリプションプランで使用クレジットをオンにする:Pro・Max・Team・Enterprise では、プランに含まれる利用を超えて課金できる使用クレジットをオンにする必要がある。オンになるまで
/fastは「Fast mode requires usage credits」と報告する。Pro と Max は、claude.ai の「Settings > Usage」の「Usage credits」でオンにするか、/usage-creditsで開く。Team と Enterprise は、課金へのアクセスを持つメンバーが「Organization settings > Usage」で組織向けにオンにし、持たないメンバーは/usage-creditsで組織の管理者に依頼を送る。fast mode の利用は、プランに残りがあっても、使用クレジットから直接引かれる - 有料の Console の組織:Claude Console のアカウントは使用クレジットを使わず、組織がほかの API の利用と一緒にトークンごとに fast mode を払う。Console の無料の Evaluation プランでは、
/fastが「Fast mode unavailable during evaluation. Please purchase credits.」と出る。解消するには、Console の課金設定でクレジットを購入する - Team と Enterprise はオーナーの有効化:Team と Enterprise の組織では、fast mode は既定で無効。ユーザーが使えるようになる前に、オーナーが明示的に有効にする必要がある
組織の 4 つの設定が、/fast で fast mode をオンにするのを止めることがあります。
| 状況 | 表示と原因 |
|---|---|
| fast mode が有効化されていない | 組織で有効になっていないと、/fast でオンにすると「Fast mode has been disabled by your organization.」と出る |
| 管理設定でオフ | 管理設定が fastMode: false を設定していると、同じ「Fast mode has been disabled by your organization」のメッセージが出る |
| セッションごとのオプトインが必須 | 管理設定が fastModePerSessionOptIn: true を設定していると、対話端末のセッション以外のあらゆる場所で、/fast on が同じメッセージで拒否される |
| fast mode のモデルが許可されていない | 組織の availableModels の許可リストが fast mode の Opus モデルを除くと、オンにすることが「is not in your organization's allowed models」で拒否される。すでに fast mode に対応する許可された Opus のモデルで動いているセッションでは、/fast はモデルを切り替えずに、現在のモデルで fast mode を有効にする |
組織で fast mode を有効にする#
- Console(API の顧客):管理者が Claude Code preferences で有効にする。fast mode は研究プレビューなので、fast mode のリクエストが成功する前に、組織が fast mode へのアクセスの提供も受ける必要がある。アクセスを得るには、アカウント担当に連絡するかウェイトリストに入る。提供されていないと、API は fast mode のリクエストごとに 429 で拒否し、Claude Code は拒否ごとを fast mode のレート制限として扱う。レート制限のクールダウンと違い、拒否はアクセスが提供されるまで続く
- Claude AI(Team と Enterprise):オーナーが管理設定の「Organization settings > Claude Code」で有効にする
- fast mode を完全に無効にするもう 1 つの方法は
CLAUDE_CODE_DISABLE_FAST_MODE=1を設定すること(環境変数一覧)
プロキシと LLM ゲートウェイの後ろで使う#
fast mode を出す前に、Claude Code は、api.anthropic.com への直接のリクエストで、組織の fast mode の可否を確かめます。この確認は ANTHROPIC_BASE_URL に従わないので、Claude の通信を LLM ゲートウェイ経由にして api.anthropic.com への直接の外向き通信を塞ぐネットワークでは、推論リクエストが動いていても確認が失敗します。確認は設定済みの HTTP プロキシを使うので、プロキシ越しにも api.anthropic.com に届かない場合にだけ、ネットワークの遮断で失敗します。
- 確認が失敗すると、
/fastは「Fast mode unavailable due to network connectivity issues」と報告し、組織で fast mode が有効でも、リクエストは標準速度で動く。過去に成功した確認はキャッシュされた結果で動き続けるので、確認の遮断が主に影響するのは新規のインストール - 同じ接続の失敗メッセージは、開かれたネットワークでも、確認が
api.anthropic.comに届いて Anthropic が拒む認証情報を示したときに出る。解決したキーが、ANTHROPIC_API_KEYに入れたかapiKeyHelperが作ったゲートウェイ発行の認証情報であるセッションは、そのキーで確認を送り、拒否されたリクエストは接続の失敗として報告される - 直すには、ネットワークの遮断が原因なら
api.anthropic.comへの直接の外向き通信を許可リストに入れるか、確認の失敗のしかたに合う変数を設定する
| 変数 | 動き |
|---|---|
CLAUDE_CODE_SKIP_FAST_MODE_NETWORK_ERRORS=1 |
失敗した確認を使えるものとして扱い、「組織が無効にしている」という応答は引き続き尊重する。ネットワークが接続を拒むとき、または Anthropic がゲートウェイの認証情報を拒むときに使う(認証情報の場合は、何も遮断されていないので許可リストでは直らない) |
CLAUDE_CODE_SKIP_FAST_MODE_ORG_CHECK=1 |
確認を完全に飛ばす。ネットワークがリクエストを拒むのではなく横取りするときに使う |
- 2 つのゲートウェイ構成は、組織で fast mode が有効でも、接続のメッセージではなく「Fast mode has been disabled by your organization」と報告する。1 つは、
ANTHROPIC_AUTH_TOKENだけで認証するセッション(claude.ai のログインも Anthropic の API キーもなく、成功した確認のキャッシュもないとき、Claude Code はリクエストを送らずに、組織が fast mode を無効にしているものとして扱い、確認を飛ばす)。もう 1 つは、確認を横取りして自前のページで答えるプロキシ(HTTP 200 のブロックページを返す TLS 検査のプロキシなど。組織が fast mode を無効にしているという応答として読まれる)。どちらの場合も、CLAUDE_CODE_SKIP_FAST_MODE_ORG_CHECK=1で fast mode が戻る。CLAUDE_CODE_SKIP_FAST_MODE_NETWORK_ERRORSは、失敗した確認だけを迂回し、この 2 つは失敗ではなく無効の応答を出すので、どちらにも効かない。ベアラートークンの場合は、リクエストが送られないので、直接の外向き通信を許可しても直らない - これらの変数が効くのはクライアント側の確認だけ。組織が fast mode を無効にしているなら、変数の有無にかかわらず、API は fast mode のリクエストを拒否する。API からの拒否は、スキップの変数を設定していても有効で、Claude Code は拒否されたリクエストを標準速度で再試行し、fast mode をオフにし、
/fastは組織が fast mode を無効にしていると報告する CLAUDE_CODE_DISABLE_NONESSENTIAL_TRAFFICを設定しても、可否の確認は抑えられる。成功した確認のキャッシュがなければ、/fastは「Fast mode is currently unavailable」と報告する。この構成でも、2 つのスキップの変数のどちらでも fast mode が戻る
セッションごとのオプトイン#
既定では、ユーザーが対話セッションでオンにした fast mode は、セッションをまたいで残ります。変えるには、いずれかの設定ファイルで fastModePerSessionOptIn を true にします。各セッションが fast mode オフで始まり、ユーザーは /fast で明示的に有効にする必要があります。Team か Enterprise プランのオーナーは、サーバー管理設定で組織全体に配れます。
{
"fastModePerSessionOptIn": true
}
- 同時に複数のセッションを動かす組織でコストを管理するのに役立つ。ユーザーの fast mode の設定は保存されたままなので、この設定を外すと、既定の永続の動きに戻る
- 管理設定がこのキーを設定しているときは、
/fast onは対話端末のセッションでだけ働く。非対話モード・VS Code 拡張・クラウドセッションを含むほかのすべての場所では、組織が fast mode を無効にしているというメッセージで拒否される
レート制限の扱い#
fast mode のレート制限は、標準の Opus とは別です。対応するすべての Opus モデルは 1 つの fast mode のレート制限のプールを共有し、どれの利用も同じ制限から引かれます。fast mode のレート制限に達すると、次のようになります。
- fast mode が自動で標準速度に戻る
↯のアイコンがクールダウンを示す灰色になる- 標準の速度と料金で作業を続けられる
- クールダウンが終わると、fast mode が自動で再び有効になる
クールダウンを待たずに手動でオフにするには、/fast をもう一度実行します。
- セッションの途中で使用クレジットが尽きると、Claude Code は、拒否された fast mode のリクエストを標準の速度と料金で再試行するので、作業は続けられ、クールダウンはない。拒否の見え方はセッションの種類で違う
- 対話セッションでは、「Fast mode disabled · usage credits exhausted」の通知が出て、そのセッションの残りで fast mode をオフにする。保存した fast mode の設定は変わらないので、
/fastで再びオンにする --output-format stream-jsonの非対話モードと Agent SDK では、使用クレジットが尽きている間、ターンごとに 1 回、同じ文を、サブタイプnotificationのsystemメッセージとしてメッセージストリームに出す。fast mode はオンのまま(v2.1.221 以降が必要)
advisor#
advisor は、主モデルと、より強い advisor モデルを組み合わせ、Claude が作業中の重要な場面で相談するようにする機能です。実験的な機能で、Anthropic API が必要です。Amazon Bedrock・Claude Platform on AWS・Google Cloud の Agent Platform・Microsoft Foundry では使えず、挙動・料金・提供は変わることがあります。
- Claude が、方針を決める前、繰り返すエラーで詰まったとき、タスクの完了を宣言する前などに、2 つ目の、通常はより強いモデルに相談する。advisor はツール呼び出しと結果を含む会話の全体を受け取り、Claude が続ける前に適用する助言を返す
- advisor は、Anthropic のインフラ上でサーバーツールとして動き、サブスクリプションの口座にも API 課金の口座にも使える。advisor にするモデルは自分で選び、いつ呼ぶかは Claude が決める
- 向くのは、ほとんどのターンは定型でも、計画の質が結果を決める、長くて複数のステップのタスク(大きなリファクタリング・エラーが繰り返すデバッグ・Claude が終わりと言う前に独立に確認させたい作業)
- 計画することが少ない短いタスクや、毎ターンが最強のモデルを必要とする作業では価値が小さい。その場合は主モデルを切り替える
有効にする#
advisor のモデルは、3 つの方法で設定できます。
| 方法 | 内容 |
|---|---|
/advisor コマンド |
セッション中に設定・変更し、既定として保存する |
advisorModel 設定 |
設定ファイルに、永続する既定を書く |
--advisor フラグ |
起動時に、1 セッションだけの advisor を設定する |
- どれも、主モデルが advisor に対応するセッションで advisor を有効にする。セッションが始まると、
Advisor Tool (experimental) is on and may use more tokens · /advisorの通知が出る - 一部のプランでは、Fable を advisor にするのにも、Fable の利用を使用クレジットに課金することへの 1 回限りの同意が要る(後述)
/advisorを引数なしで実行すると、使える advisor モデルを並べたピッカーが開く。モデルを直接渡すこともできる(/advisor opus)。コマンドはAdvisor set toに advisor のモデル名を続けて確認する。選択はユーザー設定のadvisorModelに保存され、セッションをまたいで残る(advisorModelのエントリが現在のセッションだけに適用されると挙げる場合を除く)- ターミナルのピッカーがない場所でも、
-pの非対話モード・Agent SDK・デスクトップアプリ・Remote Control で動く(v2.1.260 以降が必要)。そこでは、引数なしの/advisorが現在の advisor のモデルと受け付ける別名を出し、/advisor opusのようにモデルを付けると設定し、/advisor offでオフにする - 組織の
availableModelsの許可リストが除く、保存済みの advisor は呼び出さない。advisor を使うには、/advisorで許可されたモデルを選ぶ - 現在の主モデルが対応しない advisor も、Claude Code は保存する。その advisor は、
/modelで互換のある主モデルに切り替えた後に有効になる。API がすでに現在の会話で保存済みの advisor を拒否していたら、モデルを切り替えても、/clearか/compactまでオフのまま
{
"advisorModel": "opus"
}
claude --advisor opus
--advisorフラグは、そのセッションではadvisorModel設定の代わりに使われ、保存した設定を変えない。claude --helpには出ない- 次のとき、Claude Code は起動時にエラーで終了する:セッションの主モデルが advisor に対応しない、要求したモデル(Haiku など)が advisor になれない、組織の
availableModelsの許可リストが要求したモデルを除く、Fable を要求して、アカウントがまだ使用クレジットの同意を必要とする - 要求したモデルが advisor になれても、セッションの主モデルより順位が下のときは、Claude Code はセッションを始める。バックグラウンドセッション以外では、そのモデルが主モデルに
cannot adviseと、起動時に警告も出す - バックグラウンドセッションを
--advisorで始めてこれらのどれかに当てはまると、終了せずに advisor なしでセッションを始める
advisor のモデルを選ぶ#
Claude Code は、advisor の役割のために、モデルを能力で順位づけます。advisor は、セッションの主モデルと同じか、それより上の順位でなければなりません。行は、順位の低い主モデルから高いものへ並びます。
| 主モデル | 受け付ける advisor |
|---|---|
| Haiku 4.5 | Fable・Opus・Sonnet |
| Sonnet 4.6 | Fable・Opus・Sonnet |
| Opus 4.6 | Fable・Opus・Sonnet 5 以降 |
| Sonnet 5 | Fable・Opus 4.7 以降・Sonnet 5 以降 |
| Opus 4.7 か Opus 4.8 | Fable・Opus 4.7 以降・Sonnet 5.5 |
| Sonnet 5.5 | Fable・Opus 5 以降・Sonnet 5.5 |
| Opus 5 か Opus 5.5 | Fable・Opus 5 以降 |
| Fable 5 | Fable 5.1 か Fable 5 |
| Fable 5.1 | Fable 5.1 |
- Fable 5.1 は v2.1.257 以降が必要。Fable 系のモデルは Fable へのアクセスが必要。Opus 4.7 か Opus 4.8 の主モデルに Sonnet 5.5 を advisor にするには v2.1.287 以降が必要
- advisor は
fable・opus・sonnetで設定する。これらの別名は、各モデルの系統について Claude Code の組み込みの既定のバージョンに解決され、新しい Claude Code のリリースで進む。claude-opus-5-5のような完全なモデル ID も渡せる。Haiku は advisor を呼べるが、advisor にはなれない - サブエージェントは、設定された advisor を引き継ぎ、自分のモデルについて同じ組み合わせの検査を適用する
- 主モデルより順位が低い advisor は、Claude Code が主モデルのリクエストに付けない(
/advisorの出力と通知で分かる。自分のモデルが組み合わせを満たすサブエージェントは、advisor を使えることがある) - Claude Code が付けた advisor の組み合わせを API が拒否したときは、Claude Code はそのリクエストを advisor なしで再送する。会話はそのまま advisor なしで進むので、エラーも advisor の呼び出しも出ない。そのあと
/advisorで別の advisor を選ぶと、変更は/clearか/compactの後と新しいセッションで効く - 主モデルか advisor が Claude Code の認識しないモデルのときは、advisor は付かない
Fable の advisor と使用クレジット#
一部のプランでは、Fable の利用は使用クレジットに課金され、advisor としての Fable も同じように課金されます。アカウントが、Fable の利用を使用クレジットに課金することへの 1 回限りの同意を必要とするとき、Claude Code は、/model で Fable のモデルを選んだときにそれを求め、その同意を受け入れるまで、Fable を advisor として適用しません。
- 同意の前は、
/advisor fableと打つか/advisorのピッカーで Fable を選んでも、Claude Code は Fable を advisor として保存せず、/model fableを案内する。claude --advisor fableは、起動時に/model fableを案内するメッセージで終了する。バックグラウンドセッションでは、終了せず advisor なしで始まる。Fable がすでにadvisorModelに保存されていれば、advisor なしでリクエストを送る。主モデルが advisor に対応する対話セッションでは、/model fableを案内する通知も出る - 同意するには、
/model fableを実行し、Fable で続けるを選ぶ。Claude Code が同意を記録し、選んだモデルとして Fable を保存する。その後、Fable を advisor に選ぶ
よくある組み合わせ#
| 組み合わせ | 使う場面 |
|---|---|
| 主モデル Sonnet と advisor Opus | Sonnet が定型の作業を進め、計画・あいまいな失敗・完了の確認を Opus に上げる |
| 主モデル Sonnet と advisor Fable | Fable を通しで動かさずに、判断の場面で Fable の助言を得る。Fable へのアクセスが必要 |
| 主モデル Haiku と advisor Opus | 最も安い主モデルに強い計画を足す。Haiku 単独より費用は上がるが、主モデルを Sonnet か Opus にするより低い |
| 主モデル Opus と advisor Opus | 2 つ目の Opus が最初の Opus をレビューする。費用より独立した確認が大事な、重要度の高いタスクに便利 |
| 主モデル Fable と advisor Fable | Fable が使えるときの最高能力の組み合わせ。Claude Code は、Fable の主モデルに Opus や Sonnet の advisor を適用しない |
| 主モデル Sonnet と advisor Sonnet | 定型のうっかりを見つける、費用の低い 2 つ目の意見 |
Claude がいつ相談するか、画面での見え方#
- Claude が advisor を呼ぶタイミングを決める。方針を決める前、エラーが繰り返すとき、タスクの完了を宣言する前に相談する傾向があるが、タイミングはルールではなくモデルが決める
- プロンプトで、ほかのツールと同じように相談を頼める(
consult the advisor before you continueなど)。advisor の呼び出しを制限したり強制したりする設定はない。もっと頻繁に・控えめに相談させたいなら、指示でそう伝える - Claude が advisor を呼ぶと、記録に、呼び出し中は advisor のモデル名つきの
Advisingの行が出る。結果が戻ると、行は助言があったかを報告する
| 表示 | 意味 |
|---|---|
| Reviewed | advisor が会話を確認した。読める助言が返ったときは、Ctrl+O で読める |
| Declined | Advisor declined to advise on this request。advisor が理由を出していれば Ctrl+O で読める |
| Unavailable | advisor の呼び出しが失敗し、Advisor unavailable (<error_code>) と出る。<error_code> は呼び出しが返したコード |
- Claude は通常、advisor の助言に従うが、特定の主張が自分の証拠と食い違うとき(勧められた手順を試して失敗した、ファイルの内容が助言と矛盾するなど)は、無条件に従わず、食い違いを表に出す
- advisor は常に会話の全体を受け取り、タイミングは Claude が決める
費用とキャッシュ#
- Claude が advisor を呼ぶと、advisor モデルが会話を読むので、主モデルの利用に加えて、advisor モデルの料金でトークンを消費する。API 課金では、advisor のトークンに advisor モデルの入出力の料金を払う。サブスクリプションプランでは、advisor の利用はプランの利用上限に数えられる(Fable の利用が使用クレジットに課金されるプランでは、Fable の advisor も使用クレジットに課金される)
- アカウントが使用クレジットの同意を必要とするとき、Fable の advisor は、同意するまで課金されない(Claude Code が選択を適用しないため)
- Claude は毎ターンではなく判断の場面で advisor を呼ぶので、速い主モデルに強い advisor を組み合わせるほうが、強いモデルを通しで動かすより安くなるのが普通。advisor の利用は、
/usageに出るセッションの合計に数えられる - advisor をセッション中にオン・オフしても、主モデルのプロンプトキャッシュは無効にならない。モデルを切り替えるのと違い、
/advisorの切り替えはキャッシュされたプレフィックスを保ち、advisor の返した助言は以降のターンで記録の一部としてキャッシュされる。advisor モデル自身の会話の読み取りはキャッシュされず、呼び出しのたびに会話の全体を新たに処理する
要件とオフにする#
advisor には次のすべてが必要です。
- Anthropic API だけ:advisor はサーバーで実行されるツール。Amazon Bedrock・Claude Platform on AWS・Google Cloud の Agent Platform・Microsoft Foundry では使えない。
ANTHROPIC_BASE_URLで設定した LLM ゲートウェイ経由では、ゲートウェイがリクエストを Anthropic API へそのまま転送するかで決まる。ゲートウェイやその上流が advisor ツールを認識しないときの Claude Code の応答は、ゲートウェイのプロトコルの文書にある - 対応する主モデル:Fable・Opus 4.6 以降・Sonnet 4.6 以降・Haiku 4.5
- フィーチャーフラグの取得:Claude Code は、Anthropic から取得するフィーチャーフラグで advisor をオンにする。
DISABLE_TELEMETRYのようにフラグの取得をオフにする変数を設定したセッションでは、advisor はオフのまま
advisor を使うのをやめるには、/advisor off を実行するか、/advisor のピッカーで「No advisor」を選びます。advisor ツールを完全に無効にするには CLAUDE_CODE_DISABLE_ADVISOR_TOOL=1 を設定します。/advisor コマンドが使えなくなり、設定された advisorModel は無視され、--advisor フラグは受け付けられるが効きません。
関連する方法との比較#
advisor は、モデルの強みを組み合わせる方法の 1 つです。2 つ目のモデルをいつ関わらせたいかで選びます。
| 方法 | 強いモデルが動くとき | 始まり方 |
|---|---|---|
| advisor ツール | 作業の途中の判断の場面 | 助言が要るとき Claude が呼ぶ |
opusplan |
プランモードの間(availableModels が許すとき)。その後、実行では Sonnet に切り替わる |
プランモードに入る |
model を設定したサブエージェント |
委任されたサブタスクの全体 | Claude が委任するか、自分でサブエージェントを呼ぶ |
/model |
次のリクエスト以降 | 自分でモデルを切り替える |
カスタムモデルの選択肢を足す#
ANTHROPIC_CUSTOM_MODEL_OPTION で、組み込みの別名を置き換えずに、/model ピッカーに 1 つのカスタムの項目を足せます。Claude Code が既定では一覧に出さないモデル ID を試すのに便利です。LLM ゲートウェイでは、CLAUDE_CODE_ENABLE_GATEWAY_MODEL_DISCOVERY=1 を設定すると、ゲートウェイの /v1/models エンドポイントからピッカーを埋められるので、この変数が要るのは、その検出が無効なときか、欲しいモデルを返さないときだけです。複数のモデルを自分の順序と好きなラベルで並べるには、modelPicker を設定します。
export ANTHROPIC_CUSTOM_MODEL_OPTION="my-gateway/claude-opus-5-5"
export ANTHROPIC_CUSTOM_MODEL_OPTION_NAME="Opus via Gateway"
export ANTHROPIC_CUSTOM_MODEL_OPTION_DESCRIPTION="Custom deployment routed through the internal LLM gateway"
- Claude Code は環境変数を起動時に読むので、
claudeを起動する前に export するか、動いているセッションを再起動する _NAMEと_DESCRIPTIONは省略できる。名前を省くと、項目は、Claude Code が ID を認識するときはモデルの名前を、そうでなければモデル ID を出す。説明を省くとCustom model (<model-id>)が使われる- カスタムの項目は組み込みの項目の後ろに並び、
modelPickerで足した行はその後ろに並ぶ ANTHROPIC_CUSTOM_MODEL_OPTIONのモデル ID は検証されないので、API エンドポイントが受け付ける文字列なら何でも使えるavailableModelsを設定しているときは、カスタムのモデル ID も許可リストに入れる。入れないと、Claude Code はカスタムの項目をピッカーから外し、--modelでの選択もほかの除かれたモデルと同じように拒否するmy-gateway/claude-opus-5-5のように系統名を含むカスタム ID は、その系統の特定の項目として数えられ、その系統のワイルドカードを無効にするので、選べるままにしたいバージョンも列挙する
管理者向け:モデルの制限#
availableModels(許可リスト)#
管理者は、管理設定かポリシー設定の availableModels で、ユーザーが選べるモデルを制限できます。項目は、sonnet のようなモデルの系統・claude-sonnet-4-5 のようなバージョンの接頭辞・claude-sonnet-4-5-20250929 のような完全なモデル ID に一致します。バージョンの接頭辞は、さらに区切りを足して延びる後のモデル ID にも一致するので、claude-fable-5 は Fable 5 と Fable 5.1 の両方を許し、claude-fable-5-1 は Fable 5.1 だけを許します。
{
"availableModels": ["sonnet", "haiku"]
}
availableModels を設定すると、許可リストはユーザーがモデルを指定できるあらゆる場所に適用されます。
| 場所 | 内容 |
|---|---|
| メインセッションのモデル | /model・--model・ANTHROPIC_MODEL・model 設定・ANTHROPIC_DEFAULT_MODEL・セッションの再開で復元されるモデル |
| 別名の解決 | ANTHROPIC_DEFAULT_OPUS_MODEL・ANTHROPIC_DEFAULT_SONNET_MODEL・ANTHROPIC_DEFAULT_HAIKU_MODEL・ANTHROPIC_DEFAULT_FABLE_MODEL は、許可された別名をリスト外のモデルに振り向けられない |
| fast mode | リスト外の Opus に暗黙に切り替えることになるとき、/fast は切り替えを拒み、「is not in your organization's allowed models」と出す |
| サブエージェントとチームメイトのモデル | サブエージェントの frontmatter の model・Agent ツールの model パラメーター・エージェントチームのチームメイトのモデル・CLAUDE_CODE_SUBAGENT_MODEL・(v2.1.197 以前では)/agents ウィザードのモデルピッカー |
| スキルとコマンドのモデル | スキルとコマンドの frontmatter の model |
| advisor のモデル | 設定した advisorModel と --advisor フラグ |
| バックグラウンドエージェントのモデル | ディスパッチのピッカーで選んだモデル |
- Anthropic API と Claude Platform on AWS では、
opus・sonnet・haiku・fableの系統の別名は、許可リストがそのモデルを許すとき、通常のモデルに解決される。許可リストがそのモデルをブロックするときは、リストが許す最新のバージョンに置き換えられ、要求したモデルと置き換えたモデルの両方を名指しした通知が出る(例:["sonnet", "claude-opus-4-6"]では/model opusも--model opusも、許可された最新の Opus の Claude Opus 4.6 を選ぶ)。v2.1.205 より前は、最新のリリースが一覧の外にある別名は、一覧が古いバージョンを許していても、ほかのブロックされた選択と同じように拒否・置き換えされた。許可リストが別名の系統のどのバージョンも許さないときは、別名はほかのブロックされた値と同じ扱いになる - そのほかのブロックされた選択は、モデルが設定された場所で扱いが変わる
| 設定された場所 | 動き |
|---|---|
/model |
切り替えをエラーで拒否する |
--model・ANTHROPIC_MODEL・model 設定 |
起動時に、要求したモデルと置き換えたモデルを名指しした警告を出して値を置き換え、セッションは既定のモデルで始まる |
ANTHROPIC_DEFAULT_MODEL |
変数を無視する |
| サブエージェントかチームメイトの上書き | リクエストを失敗させず、フォールバックのモデルで動かす。対話セッションでは、このフォールバックか、許可された最新のバージョンへの置き換えでサブエージェントのモデルを置き換えたとき警告が出る(チームメイトのフォールバックは報告しない) |
| スキルかコマンドの上書き | 上書き(ブロックされた系統の別名を含む)は無視され、スキルかコマンドはセッションのモデルで動く。サブエージェントで動くスキルやコマンドは、サブエージェントの扱いに従う |
advisorModel 設定 |
そのセッションでは advisor が無効になる |
--advisor フラグ |
起動時にエラーで終了する。バックグラウンドセッションでは、終了せず advisor なしで始まる |
- 除外されたモデルは
/modelピッカーから隠れる。リストに書いたモデル ID が自分の行も得るかは、プロバイダーで違う。- Anthropic API・Claude Platform on AWS・Claude apps gateway・
ANTHROPIC_BASE_URLで設定した LLM ゲートウェイ:リストにある Anthropic のモデル ID で、組み込みのピッカーの行がないものは、自分のラベルつきの行として出る。Claude Code は、リストが固定する古いバージョンなど、Opus・Sonnet・Haiku のバージョンにそうした行を足す。modelPickerの構成でreplaceBuiltInOptionsを設定していると、その行は出ない。v2.1.199 より前は、そうした ID は/model <id>と打つことでしか選べなかった - Amazon Bedrock・Google Cloud の Agent Platform・Microsoft Foundry:リストにあるモデル ID が
anthropic.で始まらない限り、Anthropic のモデル ID でもプロバイダー固有の ID でも、Claude Code は行を足さない。Mantle のモデル ID はその接頭辞を持つ。組み込みの行がないリストのバージョンを出すには、プロバイダーの形式の ID を受け付けるmodelPickerの構成にも足す
- Anthropic API・Claude Platform on AWS・Claude apps gateway・
- Claude Code があなたの代わりに行うモデルの変更も、同じように検査される:フォールバックモデルの連鎖は許可リスト外の項目を落とす。プランモードのアップグレードは、Anthropic API と Claude Platform on AWS では、
opusplanから除外されたモデルへのアップグレードが、アップグレード先の系統の許可された最新のバージョンを使う(プロバイダー固有のモデル ID のプロバイダーと、許可されたバージョンがないときは、アップグレードを飛ばし、計画はセッションのモデルで続く)。自動モデルフォールバックは、フォールバック先が除外されていれば動かず、フラグが立ったリクエストは拒否で終わる。auto モードの分類器の Claude Sonnet 5 の既定は、許可リストが Sonnet 5 を許すときだけ適用され、除外されているときはセッションのモデルで動き、セッションが Fable 系のモデルなら Opus で動く(Anthropic API 以外のプロバイダーでは、その Opus のフォールバックは、ANTHROPIC_DEFAULT_OPUS_MODELに設定したモデルか、なければ Opus 5 で、許可リストを見ずに動く。v2.1.210 以降が必要)。fast mode は、オンにした後にセッションが動くモデルが許可リスト外なら、オンにすることが拒否される - Amazon Bedrock と Google Cloud の Agent Platform の可用性のフォールバック:セッションの途中でアカウントがモデルへのアクセスを失ったときの別のモデルへの切り替えは、除外されたモデルを飛ばす。起動時のモデルの確認(Amazon Bedrock と Google Cloud の Agent Platform)が除外されたモデルを飛ばすのは、管理設定が
enforceAvailableModelsも設定しているときだけ
表面ごとの適用範囲#
どの表面も、受け取った許可リストを強制します。どの配布の仕組みがどの表面に届くかは違います。
| 配布の仕組み | CLI と IDE | デスクトップのローカルセッション | Web・モバイル・クラウドセッション | Agent SDK と非対話 | Cowork |
|---|---|---|---|---|---|
| 管理コンソールからのサーバー管理設定 | 強制される | 強制される | 強制される(Claude Tag のセッションを除く) | 強制される | リモートの Cowork セッションはサーバーがモデルを検査する。ユーザーのマシン上では届かない |
| MDM か管理設定ファイル | 強制される | 強制される | Anthropic がホストする環境には届かない。セルフホスト環境では、ランナーイメージから強制される | 強制される | 配備された場所で強制される |
- クラウドセッション(デスクトップアプリから始めたものを含む)は、既定では Anthropic が管理する VM で動くので、デバイスに配備した設定は届かない。許可リストはサーバー管理設定で届ける。セルフホスト環境へ回されるセッションは自分の計算資源で動き、ランナーイメージの管理設定ファイルも読む。クラウドセッションの途中のモデル切り替えは、要求したモデルが許可リストに除かれていると拒否される
- Claude Tag のセッションはクラウド環境で動くが、サーバー管理設定を受け取らない。そのセッションのモデルを設定するには、Claude Tag の管理者向けガイドを見る
- Cowork は Claude Code でセッションを動かすが、設計上、claude.ai の管理コンソールのサーバー管理設定を受け取らない。サーバー管理設定の
availableModelsが空でなく、ユーザーがその外のモデルを選ぶと、サーバーがリモートの Cowork セッションでそのモデルを拒否する。管理設定ファイルは、セッションが動く場所にあれば適用される(リモートの Cowork セッションは Anthropic が管理する VM で動くので、デバイスに配備したファイルはそこにない) - Amazon Bedrock・Google Cloud の Agent Platform・Microsoft Foundry・Claude Platform on AWS のようなサードパーティプロバイダーのセッションは、サーバー管理設定を受け取らないので、許可リストは MDM か管理設定ファイルで届ける
- サーバー管理の配布には、セッションが対象のログインかキーで認証することも必要。
apiKeyHelperスクリプトだけでキーを作る場合は、MDM か管理設定ファイルで配布する - デスクトップの Code タブは SSH セッションも持ち、それは動いているリモートホストから管理設定ファイルを読む
- claude.ai とデスクトップアプリのモデルピッカーは、組織の許可リストが除くモデルを隠すか灰色にする。ピッカーの状態はユーザー向けの便宜で、許可リストを強制するものではない
Default の扱いと関連する管理設定#
- 既定の接頭辞の一致では、
availableModelsだけでは、enforceAvailableModelsも設定するまで、Default の選択肢はシステムの実行時の既定のままになる。その既定が制限したいモデルなら、enforceAvailableModelsも設定するか、そのモデルをブロックする availableModels: []では、名指しのモデルの選択はブロックされ、enforceAvailableModelsは効かないmodel設定は、強制ではなく最初の選択。ユーザーは/modelを開いて Default を選べ、それはシステムの実行時の既定に解決される(enforceAvailableModelsか特定のバージョンをブロックするキーが当てはまる場合を除く)
| キー | 内容 |
|---|---|
availableModels |
ユーザーが切り替えられる名指しのモデルを制限する |
enforceAvailableModels |
空でない availableModels と一緒に管理設定に置くと、許可リストを Default の選択肢にも広げる(v2.1.175 以降)。Default が許可リスト外のモデルに解決されないようにする |
deniedModels |
ブロックするモデルを列挙する。availableModels が許すモデルでもブロックされ、許可リストがなくても働く。どの項目もブロックしないリリースは許可されたまま(v2.1.283 以降) |
availableModelsMatch |
"exact" にすると、availableModels の各モデル ID が、名指しするバージョンだけを許す。リストのモデル ID の新しいバージョンは、リストに足すまでブロックされたまま(v2.1.283 以降) |
model |
セッションが始まるときの最初のモデルの選択 |
ANTHROPIC_DEFAULT_SONNET_MODEL・ANTHROPIC_DEFAULT_OPUS_MODEL・ANTHROPIC_DEFAULT_HAIKU_MODEL・ANTHROPIC_DEFAULT_FABLE_MODEL |
sonnet・opus・haiku・fable の別名が何に解決されるか、アカウントの種類の既定がどのバージョンを使うかを制御する |
requiredMinimumVersion |
deniedModels と availableModelsMatch を無視する古いバージョンが起動しないようにする |
enforceAvailableModels: trueでは、記録されたモデルのないメンバーの Default の選択肢は、アカウントの種類の既定(管理者が設定していれば組織の既定モデル)に解決される。そのモデルが許可リストにないときは、許可されて使えるavailableModelsの最初の項目に解決され、/modelピッカーの Default の行がそのモデルを示す。この置き換えは、セッションの起動・/modelで Default を選ぶとき・フォールバックの連鎖の"default"キーワード・除外された選択を落としたときのフォールバックで、既定に届く場所のどこでも働く。availableModelsが空でないのに許可され使える項目に解決されるものがないときは、強制は飛ばされ、警告が--debugでだけ見える。それを避けるには、必ず使える項目を 1 つはリストに残す。両方のキーは、配るなかで最も上位の管理ソースに一緒に置く- 例:Sonnet 4.5 で始め、ピッカーを Sonnet と Haiku に絞り、Default がティアの既定ではなく許可リストのモデルに解決されるようにする
{
"model": "claude-sonnet-4-5",
"availableModels": ["claude-sonnet-4-5", "haiku"],
"enforceAvailableModels": true,
"env": {
"ANTHROPIC_DEFAULT_SONNET_MODEL": "claude-sonnet-4-5"
}
}
enforceAvailableModelsかenvブロックがないと、ピッカーで Default を選んだユーザーは、modelに固定したバージョンではなく実行時の既定になる。enforceAvailableModelsは Default が許可リストに従うようにし、envブロックはsonnetのような許可された別名が解決するバージョンを固定する。モデルの系統の制限だけで足りるならenforceAvailableModelsだけを使い、特定のバージョンも固定するならenvブロックも足す- マージの動き:Claude Code が適用する管理設定が
availableModelsを定義すると、そのリストだけが適用される(ホストプラットフォームが独自のものを渡す場合を除く)。ユーザー・プロジェクト・ローカルの設定の項目は拡張できず、複数の管理ソースをまたいでもマージされない。それ以外では、ユーザー・プロジェクト・ローカルの設定のリストは、ほかの配列設定と同様に連結され重複が除かれる。有効なリストの中で、系統の特定のモデル(バージョンの接頭辞か完全なモデル ID)を名指しする項目は、その系統のワイルドカードの項目を無効にする(["sonnet", "claude-sonnet-4-5"]が許すのは Sonnet 4.5 の各バージョンだけで、すべての Sonnet ではない) availableModelsのanthropic.で始まる項目は、カスタムの選択肢として/modelピッカーに足される。これは「サードパーティのデプロイ向けにモデルを固定する」で説明した別名の照合の例外。Amazon Bedrock の Mantle エンドポイントが有効なときは、Mantle の形式に合う項目を、Claude Code がそのエンドポイントに送る。設定はピッカーをリストの項目に絞り、Mantle の ID は系統名を埋め込むので特定の項目として数えられ、その系統のワイルドカードを無効にする。Mantle の ID と並べて、選べるままにしたいバージョンの接頭辞か完全な ID を列挙するdeniedModelsの例:Opus と Sonnet を許し、日付つきやプロバイダー固有の ID を含むあらゆる綴りの Opus 5.5 をブロックする
{
"availableModels": ["opus", "sonnet"],
"deniedModels": ["claude-opus-5-5"]
}
- ブロックされたモデル(
deniedModelsが名指しするか、"exact"のリストが省くもの)は、許可リストが適用されるすべての場所で、ブロックされた選択として扱われる。/modelピッカーから隠れ、/model <名前>は拒否する。--model・ANTHROPIC_MODEL・model設定でブロックされたモデル ID を指定すると、Claude Code は起動時にそれを落とし、Default の選択肢を解決する。フックやバックグラウンドのリクエスト(エージェントフックのmodelフィールドなど)がdeniedModelsのブロックするモデルを指定すると、そのリクエストはセッションのモデルで動く - Default の選択肢は、
enforceAvailableModelsの設定にかかわらず、両方のキーにも従う。空でないavailableModelsと一緒に設定すると、ブロックされた既定は許可リスト外のモデルとして数えられる。そうでなければ、ブロックされたモデルに解決されるはずの Default は、次の順で下がる:同じ系統の許可された最新のバージョン、低コストの各系統(Sonnet、次に Haiku)の許可された最新のモデル、許可されたモデルを名指しするavailableModelsの最初の項目。どれも許可されていなければ、Default の選択肢で始まるセッションは、直すキーを名指しするエラーで起動を拒否する。"exact"のリストが Default の選択肢に影響するのは、管理設定のavailableModelsのリストが、モデルか系統を 1 つ以上名指ししているときだけ - Claude Code は、
deniedModelsとavailableModelsMatchを管理設定からだけ読む。ユーザー・プロジェクト・ローカルの設定や--settingsで設定すると、警告を出して無視する。それより前のバージョンは両方のキーを無視する availableModelsのclaude-opus-5のような項目は、Claude Code が対応し次第、Opus 5.5 のような、それを延ばす後のリリースも許す。2 つの管理設定が、リリースを留めておける
組織のモデル制限と組織の既定モデル#
Claude Enterprise プランの組織の管理者は、claude.ai の管理コンソールで個々のモデルを無効にして、メンバーが動かせるモデルを制限できます(v2.1.187 以降が必要)。この制限は、Claude Code が認証するときに、アカウントの権限として配られ、設定の availableModels とは別で、セッションが作られるときサーバーも独立に同じ制限を強制します。
- 制限は、メンバーがサインインするか自分の API キーを使うときに適用される。組織のサービスキーのような組織スコープの認証情報はユーザーに結びつかないので、制限は適用されない
- Claude Console にはモデル制限の制御がない。Claude Enterprise プランのない組織(メンバーが Anthropic API で認証する組織を含む)は、管理設定の
availableModelsに、Default の選択肢のためのenforceAvailableModelsを足して制限する - 制限されたモデルは
/modelピッカーから隠れる。--model・ANTHROPIC_MODEL・model設定で名指しすると、Model "<name>" is restricted by your organization's settings. Using <model> instead.の通知が出て、セッションは許可されたモデルで始まる。制限されたモデルを/model <name>と打つと、Model '<name>' is restricted by your organization's settings. Run /model to choose a different model.で拒否され、セッションは現在のモデルのまま opusのような系統の別名は、組織が許すとき通常のモデルに解決される。組織がそのモデルを制限するときは、組織が許す系統の最新のバージョンに置き換えられ、同じ置き換えの通知が出る。/model <別名>が拒否されるのは、その系統のすべてのバージョンが制限されたときだけで、--model・ANTHROPIC_MODEL・model設定で設定した別名は、その場合も起動時に置き換えられる。v2.1.205 より前は、系統の別名が、古いバージョンが許されていても、最新のリリースだけで置き換えや拒否が決まった- 制限は組織全体か役割ごと:組織レベルでモデルを無効にすると全メンバーから消える。役割レベルのアクセスは、カスタムの役割ごとに別のモデルを許し、複数の役割を持つメンバーは、どれかの役割が許すモデルを使える。Haiku は常に使え、無効にできないので、全メンバーに使えるモデルが 1 つは残る。アクセスの変更は約 1 分以内に新しいリクエストで効き、
/modelピッカーには次のセッション開始時に反映される - 両方の制限が合わせて適用される:モデルを選べるのは、
availableModelsが許可し、組織が制限していないときだけ。組織の制限が届くのは Anthropic API と LLM ゲートウェイのデプロイのセッションだけで、ほかのプロバイダーではavailableModelsを使う
Claude Enterprise プランの組織の管理者は、claude.ai の管理コンソールで、組織全体か役割ごとに、Claude Code のメンバーの既定のモデルを設定できます(v2.1.196 以降が必要)。設定されると、Default の選択肢がそのモデルに解決されます。
/modelピッカーの Default の行には、組織の既定の名前と「Org default」のラベルが出る。管理者が組織全体か自分の役割に設定したかにかかわらず、ラベルは Org default。役割の既定は、そのカスタムの役割のメンバーに及び、組織全体の既定より優先される。複数の役割が別の既定を設定しているときは、最も高性能なモデルが適用される- 組織の既定は出発点で、制限ではない。次の選択が、それに優先する:
--modelフラグとANTHROPIC_MODEL、管理設定か--settingsで渡したmodel値、ユーザー・プロジェクト・ローカルの設定のmodel値(/modelで保存したモデルを含む) - 管理者は、組織の既定がユーザーの選択を上書きするよう設定することもできる。上書きをオンにすると、ユーザー・プロジェクト・ローカルの設定の
model値より優先されるので、/modelで保存したモデルは現在のセッションに適用され、組織の既定が次の起動で戻る。選択が違うとき、/modelはYour organization's default (<model>) applies on restartと出す。--modelフラグ・ANTHROPIC_MODEL・管理設定・--settingsは、上書きがオンでも優先される - 組織の既定は起動時に 1 度だけ読まれるので、管理者がセッションの途中で変えた既定は、次の起動で効く。組織の既定がユーザーの選択を上書きしないとき、管理者が変えた後の最初の対話の起動は、新しい既定が適用されるように、ユーザー設定の
modelキーを 1 度だけ消す。ファイルのほかは何も変えず、その後に/modelで保存したモデルは保たれる - 組織の既定は、採用される前に次の制限の検査を通る:既定の接頭辞の一致では、
availableModelsだけは組織の既定に適用されないので、許可リスト外の組織の既定もそのまま適用される。enforceAvailableModelsも設定されていると、許可リスト外の組織の既定も許可リストの最初の項目に置き換えられる。組織のモデル制限がアカウントについて拒否する組織の既定は、その系統の許可された最新のモデルか、そのすべてのバージョンが制限されているときは低コストの系統に置き換えられる。deniedModelsか"exact"のリストがブロックする組織の既定は、上のdeniedModelsの説明に従う。アカウントでまったく使えない組織の既定は飛ばされ、Default の選択肢は組織の既定なしの場合と同じように解決される - v2.1.199 以降は、組織の既定がアカウントの種類の通常の既定とは別のモデルの系統のとき、
/modelピッカーが通常の系統の行を別に持つので、セッションの間はそれに切り替えられる。v2.1.196〜v2.1.198 では、その行がピッカーにない - 組織の既定が届くのは、Anthropic API で認証したセッションだけ。LLM ゲートウェイのデプロイを含むほかの場所で既定を設定するには、管理設定の
modelキーを使う
組織の effort 上限#
組織は effort の段階に 2 通りで上限を設けられます。Claude Enterprise プランでは、組織の管理者が役割ごとの effort の上限を設定します。どのプランでもどのプロバイダー(Amazon Bedrock・Google Cloud の Agent Platform・Microsoft Foundry を含む)でも、管理設定の maxEffortLevel がクライアントで effort に上限を設けます。両方が 1 つのモデルに当てはまるときは、低いほうの上限が適用されます。
- Claude Enterprise プランの管理者は、組織のモデル制限と並べて、カスタムの役割ごとにモデルごとの effort の最大の段階を設定できる。上限を超える段階は
/effortのピッカーに出ず、--effortや/effortでより高い段階を指定すると、上限で動く。対話セッションと通常のテキストの--printの実行では、要求した段階と適用した段階を名指しした警告が出る。jsonかstream-json出力、またはバックグラウンドエージェントでは、制限は黙って適用される - 上限はモデルごとなので、モデルを切り替えると使える段階が変わりうる。複数の役割が同じモデルを許すときは、最も制限の少ないものが使われる。effort の上限はモデルの制限と合わせて届き、同じセッションに届く
サードパーティのデプロイでモデルを固定する#
Amazon Bedrock・Google Cloud の Agent Platform・Microsoft Foundry・Claude Platform on AWS で Claude Code を配るときは、ユーザーに展開する前にモデルのバージョンを固定します。固定しないと、Claude Code は fable・opus・sonnet・haiku のような別名を使い、それはプロバイダーごとの組み込みの既定のモデル ID に解決されます。その既定は最新の Anthropic のリリースに遅れることがあり、指すモデルがユーザーのアカウントでまだ有効になっていないこともあります。
- 既定が使えないとき、Amazon Bedrock と Google Cloud の Agent Platform のユーザーには通知が出て、セッションは既定のモデルの以前のバージョン、または既定が Opus で Opus のバージョンが使えないときは既定の Sonnet にフォールバックする。Microsoft Foundry には同等の起動時の検査がないので、エラーが出る
- Amazon Bedrock と Google Cloud の Agent Platform で、
--model・ANTHROPIC_MODEL・model設定で特定の Sonnet か Opus のバージョンでセッションを始めたユーザーは、対応する別名のセッションの既定としてそのバージョンを固定したことになり、起動時の検査は、置き換わる組み込みの既定を飛ばし、フォールバックの通知も出さない。v2.1.211 より前は、セッションのモデルが明示的に設定されていても、検査が動き、通知が出ることがあった
注意
モデルの環境変数は、最初のセットアップの一部として、特定のバージョン ID に設定します。固定すると、ユーザーが新しいモデルに移るタイミングを自分で制御できます。
| プロバイダー | 例 |
|---|---|
| Amazon Bedrock | export ANTHROPIC_DEFAULT_OPUS_MODEL='us.anthropic.claude-opus-4-8' |
| Google Cloud の Agent Platform | export ANTHROPIC_DEFAULT_OPUS_MODEL='claude-opus-4-8' |
| Microsoft Foundry | export ANTHROPIC_DEFAULT_OPUS_MODEL='claude-opus-4-8' |
ANTHROPIC_DEFAULT_FABLE_MODEL・ANTHROPIC_DEFAULT_SONNET_MODEL・ANTHROPIC_DEFAULT_HAIKU_MODELにも同じ形を使う。新しいモデルのバージョンへ上げるには、これらの環境変数を更新して再配備する- 固定したモデルで拡張コンテキストを有効にするには、
ANTHROPIC_DEFAULT_OPUS_MODEL・ANTHROPIC_DEFAULT_SONNET_MODEL・ANTHROPIC_DEFAULT_FABLE_MODELのモデル ID に[1m]を付ける(例:export ANTHROPIC_DEFAULT_OPUS_MODEL='claude-opus-4-8[1m]')。[1m]を付けると、1M のコンテキストウィンドウが、opusplanのプランモードの Opus の段階や、modelfrontmatter でその別名を名指しするサブエージェントを含む、固定した別名のすべての利用に適用される - Claude Code は、プロバイダーにモデル ID を送る前に接尾辞を取り除く。付けるのは、基盤のモデルが 1M コンテキストに対応するときだけ。接尾辞はモデルごとではなく変数ごとに読まれる:Amazon Bedrock・Google Cloud の Agent Platform・Microsoft Foundry では、
[1m]なしでモデル ID を書いた変数は、別の変数が接尾辞つきで同じモデルを設定していても 200K のコンテキストで動く。Sonnet 5 は、これらのプロバイダーで常に 1M のウィンドウで動き、接尾辞は要らない ANTHROPIC_DEFAULT_*_MODEL変数を設定すると、/modelピッカーには、その系統の組み込みの行(1M コンテキストの行を含む)の代わりに、そのモデルの行が 1 つ出る。変数に接尾辞を付けずに 1M のウィンドウを使うには、ユーザーが/model opus[1m]を実行すると、Claude Code が変数の名指すモデルに接尾辞を適用する。/model sonnet[1m]も同様- MDM か管理設定ファイルで配った
availableModelsの許可リストは、サードパーティプロバイダーでも適用される(サーバー管理設定はそこには配られない)。絞り込みは、opusのようなモデルの別名・claude-opus-4-8のようなバージョンの接頭辞・プロバイダー形式の完全なモデル ID に一致する。us.anthropic.のようなプロバイダー固有の接頭辞は取り除かれないので、特定のモデルを許すには、プロバイダー形式の完全な ID を列挙するか、modelOverridesで対応づける。固定したモデルでは、その ID はANTHROPIC_DEFAULT_*_MODEL変数に設定した値。[1m]の接尾辞は、許可リストの項目と要求したモデルの両方から、一致の前に取り除かれる
固定したモデルの表示と機能#
サードパーティプロバイダーでモデルを固定すると、/model ピッカーのその行は、Claude Code が固定した ID を認識するときはモデルの名前を、そうでなければ生の ID を出します。
- 認識される:Anthropic API の ID か、プロバイダーやゲートウェイの形の ID など、Claude Code が知るモデルの正確な ID(
[1m]接尾辞の有無を問わない)。us.anthropic.claude-sonnet-4-5-20250929-v1:0を固定すると、行はSonnet 4.5と出る - 認識されない:アプリケーション推論プロファイルの ARN や、Claude Code の知らないモデルのバージョンなど、そのほかの ID(
modelOverridesの項目がモデルをその正確な文字列に対応づけている場合を除く)。Microsoft Foundry ではデプロイ名がユーザー定義なので、固定した ID は、対応づけてあっても Claude Code が認識することはなく、行は既定でデプロイ名を出す - 行がモデルの名前を出すとき、既定の説明には固定した ID が含まれ、どの ID を固定したかが分かる
Claude Code は、固定したモデルが対応する機能も認識できないことがあります。表示名と説明を自分で設定し、固定したモデルごとに、対になる環境変数で機能を宣言できます。これらの変数は、Amazon Bedrock・Google Cloud の Agent Platform・Microsoft Foundry のようなサードパーティプロバイダーで効きます。_NAME と _DESCRIPTION の変数は、ANTHROPIC_BASE_URL が LLM ゲートウェイを指しているときも効きます。api.anthropic.com に直接つなぐときは効きません。
| 環境変数 | 内容 |
|---|---|
ANTHROPIC_DEFAULT_OPUS_MODEL_NAME |
/model ピッカーの、固定した Opus モデルの表示名。未設定なら、Claude Code が固定した ID を認識するときはモデルの名前、そうでなければ固定した ID を出す |
ANTHROPIC_DEFAULT_OPUS_MODEL_DESCRIPTION |
/model ピッカーの、固定した Opus モデルの表示用の説明。未設定なら、Custom Opus model で始まる既定の説明を出す |
ANTHROPIC_DEFAULT_OPUS_MODEL_SUPPORTED_CAPABILITIES |
固定した Opus モデルが対応する機能の、カンマ区切りの一覧 |
ANTHROPIC_DEFAULT_SONNET_MODEL・ANTHROPIC_DEFAULT_HAIKU_MODEL・ANTHROPIC_DEFAULT_FABLE_MODEL・ANTHROPIC_CUSTOM_MODEL_OPTIONにも、同じ_NAME・_DESCRIPTION・_SUPPORTED_CAPABILITIESの接尾辞が使える- Claude Code は、モデル ID を既知のパターンと照合して、effort の段階や拡張思考のような機能を有効にする。Amazon Bedrock の ARN やカスタムのデプロイ名のようなプロバイダー固有の ID はこのパターンに合わないことが多く、対応する機能が無効のままになる。
_SUPPORTED_CAPABILITIESで、モデルが実際に対応する機能を Claude Code に伝える
| 機能の値 | 有効にするもの |
|---|---|
effort |
effort の段階と /effort コマンド |
xhigh_effort |
xhigh の effort の段階 |
max_effort |
max の effort の段階 |
thinking |
拡張思考 |
adaptive_thinking |
タスクの複雑さに応じて思考を動的に割り当てる適応的な推論 |
interleaved_thinking |
ツール呼び出しの間の思考 |
_SUPPORTED_CAPABILITIES を設定すると、Claude Code は、対応する固定したモデルについて、挙げた機能を有効にし、挙げていない機能を無効にします。変数が未設定なら、Claude Code はモデル ID に基づく組み込みの検出に戻ります。
export ANTHROPIC_DEFAULT_OPUS_MODEL='arn:aws:bedrock:us-east-1:123456789012:custom-model/abc'
export ANTHROPIC_DEFAULT_OPUS_MODEL_NAME='Opus via Bedrock'
export ANTHROPIC_DEFAULT_OPUS_MODEL_DESCRIPTION='Opus 4.7 routed through a Bedrock custom endpoint'
export ANTHROPIC_DEFAULT_OPUS_MODEL_SUPPORTED_CAPABILITIES='effort,xhigh_effort,max_effort,thinking,adaptive_thinking,interleaved_thinking'
バージョンごとにモデル ID を上書きする(modelOverrides)#
系統ごとの環境変数は、系統の別名につき 1 つのモデル ID を設定します。同じ系統の複数のバージョンを別々のプロバイダーの ID に対応づける必要があるときは、modelOverrides 設定を使います。modelOverrides は、個々の Anthropic のモデル ID を、Claude Code がプロバイダーの API に送るプロバイダー固有の文字列に対応づけます。ユーザーが /model ピッカーで対応づけたモデルを選ぶと、Claude Code は組み込みの既定ではなく、設定した値を使います。管理者が、ガバナンス・コスト配分・リージョンのルーティングのため、各モデルのバージョンを、特定の Amazon Bedrock の推論プロファイルの ARN・Google Cloud の Agent Platform のバージョン名・Microsoft Foundry のデプロイ名に回せます。
{
"modelOverrides": {
"claude-opus-4-7": "arn:aws:bedrock:us-east-2:123456789012:application-inference-profile/opus-prod",
"claude-opus-4-6": "arn:aws:bedrock:us-east-2:123456789012:application-inference-profile/opus-46-prod",
"claude-sonnet-4-6": "arn:aws:bedrock:us-east-2:123456789012:application-inference-profile/sonnet-prod"
}
}
- キーは、Models overview に載っている Anthropic のモデル ID にする。日付つきのモデル ID は、そこにあるとおりに日付の接尾辞を含める。未知のキーは無視される
- ゲートウェイの別名のような ID で、
[claude-code:unrecognized_model]の診断行を止めるには、その ID を値にした項目を足す - 上書きは、
/modelピッカーの各項目を支える組み込みのモデル ID を置き換える。Amazon Bedrock では、modelOverridesの項目が、Claude Code が起動時に自動で見つける推論プロファイルより優先される。すでにプロバイダー固有の値(Amazon Bedrock の推論プロファイルの ARN や Microsoft Foundry のデプロイ名)は、そのままプロバイダーに渡される - 上書きは、Anthropic のモデル ID を
--model・ANTHROPIC_MODEL・ANTHROPIC_DEFAULT_*_MODEL環境変数で直接渡したときにも適用される。Amazon Bedrock・Google Cloud の Agent Platform・Mantle では、modelOverridesの項目がない Anthropic のモデル ID は、プロバイダーがそのバージョンに対応するとき、そのバージョンの/modelピッカーの行と同じプロバイダー固有の ID に解決される。Mantle は一部のバージョンに対応する。その範囲外の Anthropic のモデル ID は、modelOverridesの項目が覆わない限り、対応づけずに生の ID を Mantle に送る。v2.1.200 より前は、--modelと環境変数の値は、上書きの対応づけを通らず、そのままプロバイダーに届いた modelOverridesはavailableModelsと併用できる。許可リストは上書きの値ではなく Anthropic のモデル ID で評価されるので、availableModelsの"opus"は、Opus のバージョンが ARN に対応づけられていても一致し続ける。管理設定でenforceAvailableModelsを設定しているとき、強制された Default は、管理設定のmodelOverridesだけで解決される。管理者の対応づけ(バージョンを推論プロファイルの ARN に固定するなど)は、強制された Default でも尊重される。ユーザーやプロジェクトの設定の上書きは影響しない- 管理設定で
availableModelsを設定しているとき、--modelや上の環境変数で直接渡した Anthropic のモデル ID には、管理設定のmodelOverridesだけが適用される。Claude Code は、そうした ID についてユーザー設定やプロジェクト設定の上書きを無視し、管理されたリストが除く ID は、どの設定ソースのmodelOverridesでも解決しない。この管理ソースの制限は v2.1.200 以降が必要
モデルに関する環境変数#
別名が指すモデル名を制御するのに、次の環境変数を使います。値は、完全なモデル名か、API プロバイダーの同等の識別子にします。セッションが始まるモデルを選ぶには ANTHROPIC_DEFAULT_MODEL を設定します(この表にはない)。
| 環境変数 | 内容 |
|---|---|
ANTHROPIC_DEFAULT_FABLE_MODEL |
fable に使うモデル。サードパーティプロバイダーで、自動モデルフォールバックのために Claude Code が Fable モデルと認識するモデル ID でもある |
ANTHROPIC_DEFAULT_OPUS_MODEL |
opus に使うモデル。プランモードが有効なときの opusplan にも使う |
ANTHROPIC_DEFAULT_SONNET_MODEL |
sonnet に使うモデル。プランモードでないときの opusplan にも使う |
ANTHROPIC_DEFAULT_HAIKU_MODEL |
haiku に使うモデル。バックグラウンドの機能にも使う |
CLAUDE_CODE_SUBAGENT_MODEL |
別の方法でモデルが割り当てられていないサブエージェント・エージェントチームのチームメイト・ワークフローのエージェントの既定のモデル。haiku のような別名か完全なモデル名を受け付ける。呼び出しごとのモデルか、inherit を含む定義の model フィールドが優先される。それを変えるには CLAUDE_CODE_SUBAGENT_MODEL_FORCE を設定する |
ANTHROPIC_DEFAULT_MODEL |
新しいセッションが始まる既定のモデル(v2.1.236 以降) |
ANTHROPIC_MODEL |
その起動のモデル。--model の次に強い |
ANTHROPIC_CUSTOM_MODEL_OPTION |
/model ピッカーに足す 1 つのカスタムの項目(_NAME・_DESCRIPTION の組もある) |
CLAUDE_CODE_EFFORT_LEVEL |
effort の段階名か auto |
CLAUDE_CODE_DISABLE_ADAPTIVE_THINKING |
Opus 4.6 と Sonnet 4.6 で 1 にすると、固定の思考バジェットに戻す |
MAX_THINKING_TOKENS |
固定の思考バジェット。0 で思考をオフにする(Opus 5.5・Sonnet 5.5・Fable 系を除く) |
CLAUDE_CODE_DISABLE_1M_CONTEXT |
1 で 1M のコンテキストをオフにする |
CLAUDE_CODE_AUTO_COMPACT_WINDOW |
自動圧縮のウィンドウ(トークン数) |
CLAUDE_CODE_MAX_CONTEXT_TOKENS |
ゲートウェイや独自のモデル ID で、Claude Code が想定するコンテキストウィンドウ |
CLAUDE_CODE_DISABLE_UNKNOWN_MODEL_WINDOW_ENFORCEMENT |
1 にすると、認識しないモデル ID は、API が長すぎると拒否した後でだけ圧縮する |
CLAUDE_CODE_DISABLE_FAST_MODE |
1 で fast mode を完全に無効にする |
CLAUDE_CODE_DISABLE_ADVISOR_TOOL |
1 で advisor ツールを無効にする |
CLAUDE_CODE_ENABLE_GATEWAY_MODEL_DISCOVERY |
1 で、ゲートウェイの /v1/models からピッカーを埋める |
ANTHROPIC_SMALL_FAST_MODELは非推奨で、ANTHROPIC_DEFAULT_HAIKU_MODELに置き換えられた- 変数の全体は環境変数一覧にある
プロンプトキャッシュの設定#
Claude Code は、性能を上げ費用を下げるために、自動でプロンプトキャッシュを使います。全体か、特定のモデルの階層ごとに無効にできます。
| 環境変数 | 内容 |
|---|---|
DISABLE_PROMPT_CACHING |
1 ですべてのモデルのキャッシュを無効にする。モデルごとの設定より優先される |
DISABLE_PROMPT_CACHING_HAIKU |
1 で既定の Haiku モデルのキャッシュを無効にする |
DISABLE_PROMPT_CACHING_SONNET |
1 で既定の Sonnet モデルのキャッシュを無効にする |
DISABLE_PROMPT_CACHING_OPUS |
1 で既定の Opus モデルのキャッシュを無効にする |
DISABLE_PROMPT_CACHING_FABLE |
1 で Fable モデルだけのキャッシュを無効にする |
メイン会話とサブエージェントのキャッシュの TTL を別々に選ぶ方法と、キャッシュミスの原因は、コンテキストとプロンプトキャッシュを参照してください。
別名の切り替わり#
各別名が解決するモデルが変わった Claude Code のバージョンです。新しいものから並べています。
| バージョン | 変更 |
|---|---|
| v2.1.284 | Anthropic API で sonnet が Sonnet 5.5 に解決される |
| v2.1.280 | Anthropic API・Claude Platform on AWS・Amazon Bedrock・Google Cloud の Agent Platform で opus が Opus 5.5 に解決される |
| v2.1.257 | fable が Fable 5.1 に解決される(Claude apps gateway のセッションを除く) |
| v2.1.219 | Anthropic API・Claude Platform on AWS・Amazon Bedrock・Agent Platform で opus が Opus 5 に解決される |
| v2.1.207 | Claude Platform on AWS・Amazon Bedrock・Agent Platform で opus が Opus 4.8 に解決される |
| v2.1.197 | Anthropic API で sonnet が Sonnet 5 に解決される |
| v2.1.154 | Anthropic API で opus が Opus 4.8 に解決される |
| それ以前 | Claude Platform on AWS で opus は Opus 4.7、Amazon Bedrock と Agent Platform で Opus 4.6。fable はすべてのプロバイダーで Fable 5 |
公式ドキュメント(英語)
2026年10月5日時点の内容をもとに、日本語でまとめています。