case_1174

Claude Codeのコンテキスト確認と節約|上限・リセットの手順

Claude Codeのコンテキスト確認と節約|上限・リセットの手順

Claude Codeのコンテキストは/contextで確認できます。Sonnet 5.5などの上限は100万トークン、既定の自動圧縮は約96万7,000トークン。/clearと/compactの違い、節約法を公式情報で整理しました。

2026年10月6日時点の公式ドキュメントで確認した結論から書く。Claude Codeのコンテキストの使用量は /context で見る。Anthropic APIで Sonnet 5.5、Sonnet 5、Opus 4.7以降、Fableモデルを使っているなら、コンテキストの上限は100万トークンで、何も設定しなければ約96万7,000トークンで自動圧縮が走る。別の作業に移る時は /clear で空にし、同じ作業を続ける時は /compact で要約する。

コンテキストの量は、上限に当たるかどうかだけの話ではない。Claude Codeはリクエストのたびに会話の全体を送るので、コンテキストが大きいまま作業を続けると、短い質問1つでもプランの使用量を多く使う。確認、リセット、節約の手順を順に押さえておくと、上限のエラーと使用量の減り方の両方を抑えられる。

この記事の要点

  • 確認:/context で内訳を見る。費用と上限は /usage、常時表示はステータスライン。
  • 上限:Anthropic APIでは Sonnet 5.5、Sonnet 5、Opus 4.7以降、Fableモデルが100万トークン。Opus 4.6 と Sonnet 4.6 は通常20万トークン。
  • 自動圧縮:100万トークンのモデルは既定で約96万7,000トークンで圧縮。/autocompact で変えられる。
  • リセット:別の作業なら /clear、続けるなら /compact、戻るなら /rewind。
  • 節約:大きな読み取りはサブエージェントへ、使わないMCPサーバーは止める、CLAUDE.md は200行以内。
  • 対象読者:長いセッションで作業する開発者、プランの上限によく当たる人。
  • 今日やること:何も頼む前に /context を実行する。

コンテキストに入るもの|入力する前から積まれている

コンテキストは、Claudeがその時点で見ている情報の全体だ。公式の「Explore the context window」は、何がいつ積まれるかを順に説明している(Claude Code公式ドキュメント)。

CLAUDE.md・自動メモリ・MCPツールの名前・スキルの説明が下の層に積まれ、作業中にパスを指定したルールやフックの分が足され、サブエージェントからは要約だけが戻ることを示した図
入力する前から積まれるものと、作業中に足されるもの

会話を始める前に読み込まれるもの

何も入力していない時点で、CLAUDE.md、自動メモリ、MCPツールの名前、スキルの説明が読み込まれている。AGENTS.md を使っていればそれも入る。出力スタイルや --append-system-prompt の文を足していれば、それもここに積まれる。

作業中に増えるもの

Claudeがファイルを読むたびに、その中身がコンテキストに足される。パスを指定したルールは、対象のファイルを読んだ時に一緒に読み込まれる。フックが足した出力も残る。サブエージェントに調べものを任せた場合は、サブエージェントが自分のコンテキストで読み、要約と少しの付帯情報だけが戻ってくる。

毎回のリクエストに全部乗る

公式の「Manage costs effectively」によると、Claude Codeはリクエストのたびに会話の全体を送り、ツールを使うたびにその結果を載せた別のリクエストも送る。プロンプトキャッシュが効いていれば履歴はキャッシュの料金で読み直されるが、1日開いたままのセッションでの1行の質問でも使用量は消費される(Claude Code公式ドキュメント)。

確認する|/contextと/usageとステータスライン

コンテキストの状態は3つの場所で見られる。使い分けは、内訳を見るなら /context、費用と上限を見るなら /usage、作業しながら常に見るならステータスラインだ。

コンテキストを中心に、/contextで内訳、/usageでプランの上限、ステータスラインで常時表示、/memoryでファイルを直すことを示した図
内訳は /context、費用と上限は /usage、常時表示はステータスライン

/context で内訳を見る

/context は、いまのコンテキストの使用量を色分けしたマス目で表示する。項目ごとの内訳に加えて、容量を食っているツールやメモリの肥大化への改善の提案、容量の警告も出る。どの CLAUDE.md と自動メモリのファイルが読み込まれたかもここで分かり、中身を直すなら /memory で開く。会話が上限を超えている時は、どれだけ超えているかと、空きを作るコマンドが警告として出る。フルスクリーン表示では内訳がたたまれるので、/context all で広げる(Commands)。

/usage で費用と上限への影響を見る

/usage はセッションの費用、プランの上限、利用状況を表示する。/cost と /stats は同じコマンドの別名だ。Pro、Max、Team、Enterprise のプランでは、プランの上限に何が効いているかの内訳も出て、直近の使用量の10%以上を占める使い方(長いコンテキストやキャッシュのミスなど)には減らし方の助言が付く。

ステータスラインで常に見る

作業しながら残りを見たいなら、ステータスラインにコンテキストの使用量を出す設定ができる。公式は「Customize your status line」で、コンテキストウィンドウの使用量を表示する方法を案内している(Claude Code公式ドキュメント)。

上限はいくつか|モデルと接続先で20万か100万

上限はモデルと接続先で決まる。Anthropic APIに直接つないでいる場合を、公式の「Model configuration」から整理すると次のとおりだ(Claude Code公式ドキュメント)。

モデル コンテキストの上限 自動圧縮の既定
Sonnet 5.5、Sonnet 5 100万トークン(20万トークンの版はない) 約96万7,000トークン
Fable 5.1、Fable 5、Opus 4.7以降 100万トークン(Proを含む全プラン) 約96万7,000トークン
Opus 4.6、Sonnet 4.6 20万トークン([1m] の付いた版は100万トークン) [1m] なしなら20万トークンの境目

100万トークンの料金と条件

100万トークンのコンテキストは通常のモデル料金で使え、20万トークンを超えた分に割増はない。Sonnet 5.5、Sonnet 5、Opus 4.7以降、Fableモデルは、[1m] の版を選んだり使用量クレジットを有効にしたりしなくても100万トークンで動く(Fableモデルの利用そのものが使用量クレジットに請求されるプランはある)。一方、Opus 4.6 と Sonnet 4.6 の [1m] の版はプランによって扱いが違い、Sonnet 4.6 の100万トークンはどのプランでも使用量クレジットが必要になる。

Bedrockなどの接続先とゲートウェイの場合

Amazon Bedrock、Google Cloud の Agent Platform、Microsoft Foundry では、Opus 4.8以降が20万トークンで動く場合があり、その時は20万トークンの境目で圧縮する。ANTHROPIC_BASE_URL で社内のゲートウェイにつないでいる場合、Claude Codeが知っているモデルには Anthropic APIと同じ上限が割り当てられる。v2.1.285 で、Opus 4.7以降、Sonnet 5以降、Fableモデルにはゲートウェイ越しでも100万トークンを使うよう変わった。ゲートウェイ側が20万トークンで止まるなら、CHANGELOG の案内どおり圧縮の時期を20万トークンに下げる(CHANGELOG)。

100万トークンを使わない設定

コンテキストを20万トークンまでに抑えたい組織は、環境変数 CLAUDE_CODE_DISABLE_1M_CONTEXT=1 を設定する。モデルの選択肢から100万トークンの版が消え、Sonnet 5 や Fableモデルのように元から100万トークンのモデルも20万トークンとして扱われる。自動圧縮が有効なら20万トークンの境目で圧縮され、無効ならそこで上限のエラーになって止まる。

リセットする|/clearと/compactと/rewindの選び分け

コンテキストを軽くするコマンドは3つあり、残したいものによって選ぶ。

コンテキストを軽くする時に、関係のない作業に移る時は/clear、同じ作業を続ける時は/compact、途中の時点に戻りたい時は/rewindを選び、/clearの後は/resumeで戻れることを示した図
残したいものでコマンドを選ぶ
コマンド 起きること 使う場面
/clear(別名 /reset、/new) 空のコンテキストで新しい会話を始める 関係のない作業に移る時
/compact [指示] ここまでの会話を要約して空きを作る 同じ作業を続ける時
/rewind 会話やコードを前の時点に戻す。途中から先だけ、途中までだけの要約もできる 途中の時点に戻りたい時

/clear は前の会話を捨てない

/clear の後も、前の会話は /resume で再開できる。/clear 名前 のように名前を付けると、/resume の一覧でその名前が前の会話のラベルになる。公式は、片付ける前に /rename で名前を付けておき、後で /resume で戻る使い方も案内している。

/compact で残るもの

圧縮の後も、プロジェクトの直下の CLAUDE.md と自動メモリはディスクから入れ直される。読んだり編集したりしたファイルは、更新の新しい順に5つまで読み直される。パスを指定したルールやサブディレクトリの CLAUDE.md は要約に含まれて消え、対象のファイルを読んだ時にまた読み込まれる。圧縮の細かい挙動と長時間の作業での使い方は/compactの使い方の記事、/rewind での戻し方はrewindの記事で扱っている。

節約する|コンテキストを軽くする5つの手

公式の「Manage costs effectively」と「Explore the context window」に載っている方法から、効く順に5つ挙げる。

古い会話・大きなログ・MCPサーバー・CLAUDE.mdで重くなった状態を、/clear・サブエージェント・/mcp・スキルに置き換えて軽くすることを比べた図
重くしているものを1つずつ置き換える

1. 作業が変わったら /clear

関係のない作業に移る時は /clear で始め直す。公式は、古い会話が次に必要なファイルの場所を奪い、送るメッセージのたびにトークンを使うと説明している。

2. 大きな読み取りはサブエージェントに渡す

テストの実行、ドキュメントの取得、ログの処理のような出力の多い作業はサブエージェントに渡す。長い出力はサブエージェントのコンテキストに残り、メインの会話には要約だけが戻る。ただしサブエージェントのリクエストも使用量に数えられる。進め方はサブエージェントの並列実行の記事にまとめている。

3. MCPサーバーを絞る

MCPツールの定義は既定で後から読み込まれ、使うまではツールの名前とサーバーの説明だけがコンテキストに入る。それでも数が増えれば積み上がる。gh、aws、gcloud のようなCLIがあるならそちらのほうがコンテキストを使わないので、使っていないサーバーは /mcp で止める。

4. CLAUDE.md を短くし、手順はスキルに移す

CLAUDE.md は会話の始めに毎回読み込まれる。PRのレビューやデータベースの移行のような特定の作業の手順を書いていると、関係のない作業の時もその分を使い続ける。スキルは呼ばれた時だけ読み込まれるので、作業ごとの手順はスキルに移す。公式は CLAUDE.md を200行以内に収めるよう勧めている。書き方はCLAUDE.md設計・運用ガイドを参照。

5. 圧縮する前に残すものを指定する

/compact に指示を付けると、要約で何を残すかを決められる。公式の例は /compact Focus on code samples and API usage だ。プロジェクトの直下の CLAUDE.md に「# Compact instructions」という見出しで、圧縮の時に重視することを書いておく方法もある。

自動圧縮のタイミングを変える|/autocompactと設定

自動圧縮が走るまでの量(自動圧縮のウィンドウ)は変えられる。早めに圧縮したい時や、ゲートウェイの上限に合わせたい時に使う。

CLAUDE_CODE_AUTO_COMPACT_WINDOW、--autocompact、/autocompact、autoCompactWindowの順に優先され、指定できる範囲が10万から100万トークンであることを示した図
自動圧縮のウィンドウを決める4つの場所と優先順位

4つの設定場所と優先順位

設定場所 効く範囲 優先順位
環境変数 CLAUDE_CODE_AUTO_COMPACT_WINDOW 設定している間のすべてのセッション いちばん高い
起動時の --autocompact その起動の間だけ 保存した設定より高い
/autocompact いまのモデルで、このセッションと次から 同じファイルの autoCompactWindow より高い
設定ファイルの autoCompactWindow すべてのモデル いちばん低い

/autocompact で保存した値は、ユーザー設定の中でモデルごとに記録される。モデルごとに分けて保存するようになったのは v2.1.288 からだ。引数なしで /autocompact を実行すると、いまのウィンドウが表示される。

指定できる値

コマンドとフラグには、10万から100万トークンまでの値を指定できる。/autocompact 500000 のようにトークン数で書くほか、100から1000までの数字は千単位として読まれ、/autocompact 200 は20万トークンになる。環境変数はトークン数の形だけを受け付ける。どの方法でも、モデルの上限より大きくはできない。元の値に戻すなら /autocompact auto を使う。

いっぱいになった時のエラーと直し方

自動圧縮があるので、ふつうはコンテキストがいっぱいになってもセッションは終わらない。止まるのは、圧縮しても空きができない時と、自動圧縮を切っている時だ。

自動圧縮の後に大きなファイルがすぐコンテキストを埋めるAutocompact is thrashingの繰り返しと、行の範囲・/compact・サブエージェントで抜け出すことを示した図
圧縮してもすぐ埋まる繰り返しと、抜け出す3つの方法

「Autocompact is thrashing」が出た時

Autocompact is thrashing: the context refilled to the limit... は、圧縮には成功したが、大きなファイルやツールの出力がすぐにまたコンテキストを埋める状態が何度か続いたことを示す。Claude Codeは、進まない繰り返しでAPIの呼び出しを無駄にしないよう、再試行を止める。公式の「Troubleshooting」が示す直し方は3つだ(Claude Code公式ドキュメント)。

  1. 大きなファイルを、行の範囲や関数のような小さな単位に分けて読ませる
  2. 大きな出力を捨てる指示を付けて圧縮する(例:/compact keep only the plan and the diff)
  3. 大きなファイルを扱う作業をサブエージェントに移す

上限を超えた時

自動圧縮を切っている時などは、上限でエラーになって止まる。/context を実行すると、どれだけ超えているかと空きを作るコマンドが表示されるので、その案内に沿って /compact か /clear を使う。

長い会話で使用量が増える理由

コンテキストが大きいと、上限に当たる前にプランの使用量が先に減る。公式の「Manage costs effectively」は、長く開いたセッションで使用量が増える理由を挙げている。

主な理由

  • 長いコンテキスト:リクエストのたびに会話の全体を送るので、1行の質問でも履歴の分を使う
  • キャッシュのミス:キャッシュの有効期間より長く間を空けた後の最初のメッセージは、コンテキストの全体を処理し直す。有効期間はサブスクリプションなら1時間で、使用量クレジットを使っている間とAPIキーやクラウド事業者経由では5分になる
  • 定期実行とサブエージェント:定期実行のタスクは待機中でも決まった間隔で全体を送り、サブエージェントはメインの会話とは別にリクエストを送る
  • 圧縮そのもの:/compact は要約する会話を読むので、大きなコンテキストの圧縮はそれ自体が大きなリクエストになる。続きが要らないなら /clear は費用がかからない

キャッシュの効き方はトークン使用量とプロンプトキャッシュの記事、上限に当たった後の対処はsession limitの対処法で扱っている。

想定シナリオ|大きなリポジトリの調査で上限に近づいた時

ここからは構成例で、実在の企業の事例や実測値ではない。社内の業務システムの改修を担当するエンジニアが、午前中に障害の原因調査、午後に別の機能の実装をする日を想定する。

午前|調査はサブエージェントに読ませる

調査を始める前に /context を実行し、会話を始める前の時点の内訳を見る。MCPツールの分が大きければ、今日使わないサーバーを /mcp で止める。ログの読み込みと集計はサブエージェントに渡し、メインの会話には要約だけを戻す。原因が分かったら、修正方針と差分だけを残す指示を付けて /compact する。

午後|別の作業は /clear で始め直す

午後の実装は午前の調査と関係がないので、/rename で午前の会話に名前を付けてから /clear で始め直す。午前の続きが必要になったら /resume で戻る。こうしておけば、午後のリクエストに午前のログの要約まで毎回載ることがない。

よくある失敗パターン

❌ 長い会話のまま別の作業を頼む

⭕ 関係のない作業に移る時は /clear。前の会話の分が、次の作業のリクエストにも毎回載り続ける。

❌ 何でも /compact で済ませる

⭕ 続きが要る時だけ /compact を使う。圧縮は会話を読んで要約するので、それ自体が大きなリクエストになる。

❌ 大きなログを丸ごと読ませる

⭕ 行の範囲を指定するか、サブエージェントに読ませる。丸ごと読ませると、圧縮してもすぐ埋まる「Autocompact is thrashing」の原因になる。

❌ 自動圧縮のウィンドウを上げれば長く使えると考える

⭕ ウィンドウはモデルの上限を超えられない。CLAUDE_CODE_DISABLE_1M_CONTEXT=1 を設定している時は、ウィンドウを20万トークンより大きくしても20万トークンで圧縮される。

今日やる3つ

  1. 何も頼む前に /context を実行し、会話を始める前の時点の内訳を見る。
  2. 使っていないMCPサーバーを /mcp で止め、CLAUDE.md が200行を超えていないか確かめる。
  3. 作業が変わるたびに /rename してから /clear する流れを1日試す。

よくある質問

Claude Codeのコンテキストの残りはどこで見る?

/context で、いまの使用量を内訳つきで見られる。作業しながら常に見たいなら、ステータスラインにコンテキストの使用量を出す設定をする。

コンテキストをリセットするには?

/clear を実行する。別名は /reset と /new だ。前の会話は消えず、/resume で戻れる。

コンテキストウィンドウの大きさは?

Anthropic APIでは、Sonnet 5.5、Sonnet 5、Opus 4.7以降、Fableモデルが100万トークン。Opus 4.6 と Sonnet 4.6 は通常20万トークンで、[1m] の版が100万トークンになる。Bedrockなどの接続先では、モデルによって20万トークンで動く。

コンテキストがいっぱいになるとどうなる?

上限に近づくと自動圧縮が走り、会話が要約されてセッションは続く。100万トークンのモデルでは、既定で約96万7,000トークンの時点で圧縮される。

100万トークンにすると料金は上がる?

通常のモデル料金で使え、20万トークンを超えた分の割増はない。ただし会話が大きいほど1回のリクエストで使うトークンは増える。Sonnet 4.6 の100万トークンの版は、どのプランでも使用量クレジットが必要になる。

/compact と /clear はどちらを使う?

同じ作業を続けるなら /compact、関係のない作業に移るなら /clear を使う。/clear は費用がかからず、前の会話は /resume で戻れる。

あわせて読みたい

運営元 Uravation よりこの事例を自社の業務で試す場合のテーマ選定・評価・本番移行の確認項目を、無料のチェックリストにまとめています。 Claude Code業務自動化PoCチェックリストを受け取る(無料)

参考・出典

Next Step

この事例を、自社の業務に置き換える。

対象業務、利用データ、評価基準、社内展開の順番まで整理すると、AI開発ツール導入の失敗を減らせます。

導入を相談する

チームで学ぶなら: Claude Code 法人研修(2日間ハンズオン) / 1人で習得するなら: 個別指導(週1マンツーマン)