Stacknot ロゴ
さくらのクラウドAIAWSCDNCloudflareGCPセキュリティ開発仕事効率化info

目次

  • この記事はこんな人向け
  • 1. まず「精度が落ちた」を一文にする
  • 2. 発生時点と現在の状態を保存する
  • 3. 圧縮の前後で残った情報を比べる
  • 4. 指示ファイルとMCPが実際に読み込まれたか確認する
  • 5. 大きな出力と長い指示を減らす
  • 6. 新しいセッションで同じ条件を再現する
  • 一度の改善だけで原因を決めない
  • 直らないときに残す記録
  • 今回確認できた範囲
  • 参考資料
  • まとめ
目次を開く

カテゴリ

AI仕事効率化開発

見出し

  • この記事はこんな人向け
  • 1. まず「精度が落ちた」を一文にする
  • 2. 発生時点と現在の状態を保存する
  • 3. 圧縮の前後で残った情報を比べる
  • 4. 指示ファイルとMCPが実際に読み込まれたか確認する
  • 5. 大きな出力と長い指示を減らす
  • 6. 新しいセッションで同じ条件を再現する
  • 一度の改善だけで原因を決めない
  • 直らないときに残す記録
  • 今回確認できた範囲
  • 参考資料
  • まとめ
記事一覧に戻る
Claude Codeの精度が落ちたと感じたときに確認する6項目
2026/09/18
AI仕事効率化開発

Claude Codeの精度が落ちたと感じたときに確認する6項目

執筆・運営
EC

EastCloud株式会社

クラウドの設計・構築・運用

Stacknotの編集方針会社情報
国産クラウド総合支援

導入・運用を実務に合わせて支援

要件整理から運用改善までご相談ください。

相談はこちらサービス詳細

Claude Codeを長く使っていると、前より指示を外す、必要なファイルを読まない、途中で作業を終えるように見えることがあります。

この記事が答える問いは、「Claude Codeの精度が落ちたと感じたとき、モデルの能力低下と決める前に何を確認すればよいか」です。

確認するのは、症状、発生時点、会話の圧縮、指示と接続、大きな出力、新しいセッションでの再現という6項目です。

この記事はこんな人向け

  • 長いセッションの途中から回答や実装が雑になったと感じる
  • /compactの後に要件や禁止事項が抜けたように見える
  • CLAUDE.mdやSkills(定型手順を再利用する機能)を用意したのに指示が反映されない
  • MCP(外部ツールとの接続)を追加した後から、ツールを使わない、途中で省略する症状が出た
  • 不具合報告やチーム共有の前に、再現条件をそろえたい

1. まず「精度が落ちた」を一文にする

「精度が落ちた」だけでは、次に何を調べるか決まりません。観測した症状を、他の人が確認できる書き方へ変えます。

症状観測できる書き方最初に確認すること
誤答既存実装を読まず、存在しないAPIを提案した読んだファイル、モデル、セッション状態
指示逸脱変更禁止と伝えたファイルを書き換えたCLAUDE.mdの読み込み、指示の競合
途中省略テスト前に完了と答えた会話の残量、ツールエラー、承認待ち
古い前提訂正済みの仕様を再び使った再開した会話、圧縮後に残った情報
ツール未使用検索やMCPを使わず推測で答えた接続状態、権限、利用できるツール
再現しない失敗同じ依頼でも成功したり失敗したりする固定できていない条件、実行回数

利用者からは、長いセッションで制約が抜けたという報告、再開後にMEMORY.mdの内容が失われたという報告、長いセッションで手順の後半が省略されたという報告があります。いずれも利用者報告であり、原因が確定した事例や、現在のすべての環境で起こる不具合を示すものではありません。

Claude Codeの精度低下を、症状、発生時点、圧縮、指示と接続、大きな出力、新しいセッションの6項目で確認する図
図1:上から順に確認します。どの項目も、モデル能力の低下を自動的に証明するものではありません。

2. 発生時点と現在の状態を保存する

新しい会話を始める前に、症状が出た直後の状態を残します。

  • Claude Codeのバージョンと選択したモデル
  • /contextで見える現在のコンテキスト(現在参照している会話・指示・ツール情報)
  • 作業ディレクトリとコミット
  • /compactの前か後か、再開した会話か
  • 直前に大きなログ、差分、検索結果を読んだか
  • MCPやSkillsを追加・変更した直後か
  • いつまでは期待どおりで、どの操作の後から変わったか

Claude Codeの公式デバッグ資料では、/context、/doctor、/hooks、/mcpを使って、読み込まれた設定や接続状態を確認できます。

ただし、/contextの表示だけでは、内部で各情報がどの程度重視されたかまでは分かりません。

3. 圧縮の前後で残った情報を比べる

/compactは、長い会話をそのまま全量保持する操作ではありません。圧縮後は、重要な要件が残ったか、必要なファイルを読み直したかを確認します。

確認するもの圧縮前圧縮後
中心の目的一文で説明できる同じ目的を説明できる
禁止事項回答に反映された同じ禁止を守る
対象ファイル読んだ履歴がある必要なら読み直した
下位のCLAUDE.md対象範囲で読まれた該当ファイルを読んだ後に反映された
完了条件テストや確認まで含む省略されていない

公式資料では、プロジェクト最上位のCLAUDE.mdは圧縮後に読み直され、下位ディレクトリのCLAUDE.mdは、その範囲のファイルを読んだときに読み込まれると説明されています。

内部の要約全文や、情報ごとの保持率を確認できない場合は、想像で補わず、目的・禁止事項・対象ファイル・完了条件を短く再提示します。

4. 指示ファイルとMCPが実際に読み込まれたか確認する

ファイルを置いたことと、その実行で読み込まれたことは別です。

  1. 現在の作業ディレクトリとプロジェクト最上位を確認する。
  2. /contextで読み込まれた指示を確認する。
  3. /mcpで接続状態と利用できるツールを確認する。
  4. /doctorと/hooksで設定やフックの問題を確認する。
  5. 短い目印となる指示を置き、対象範囲で読まれたことを確かめる。

MCPが「接続済み」でも、利用できるツールが0件なら使えません。また、下位の指示ファイルは、対象ファイルを読むまで読み込まれない場合があります。

5. 大きな出力と長い指示を減らす

長いログ、巨大な差分、多数のMCPツール、長い指示書を一度に入れても、必ず良くなるわけではありません。診断中だけ、次の順に小さくします。

  1. 巨大なツール出力を、要点と参照先へ置き換える。
  2. 今回使わないMCPサーバーやツールを対象から外す。
  3. 長い指示から、目的・禁止事項・完了条件を抜き出す。
  4. 必要なファイルを明示して読み直させる。
  5. 同じ症状が残るか確認する。

この最小化で症状が消えても、1回だけでは原因を確定できません。どの長さやツール数から悪化するかという共通の境界値も、タスクと版が違えば変わります。

6. 新しいセッションで同じ条件を再現する

現在のセッションだけを直し続けると、何が効いたか分かりません。履歴を保存してから、新しいセッションを作ります。

固定する条件記録する内容
入力実際に渡した依頼文
コードコミット、未保存の変更
実行環境Claude Codeの版、OS、シェル、作業ディレクトリ
モデル表示名、確認できる実体、別モデルへの切り替え
指示CLAUDE.md、Skills、追加した依頼文
ツールMCP、フック、権限、承認設定
判定期待する変更、禁止変更、テスト、確認手順

新しいセッションでは、同じ依頼文、同じコミット、同じ版、同じモデル、同じツールと権限を使います。回答だけでなく、読んだファイル、ツール履歴、差分、テスト、停止理由も比べます。

Claude Codeの症状を保存し、条件をそろえ、新しいセッションで再実行し、履歴と成果物を比較する流れ
図2:新しいセッションは履歴を消して終わるためではなく、保存した症状と同じ条件で比べるために使います。

一度の改善だけで原因を決めない

新しいセッションで改善しても、それだけで「長い会話が原因だった」とは言えません。偶然の出力差、モデルの切り替え、更新、権限、作業状態の違いでも結果は変わります。

反復回数と合格条件を先に決め、一つの条件だけを変えます。再現した条件だけを原因候補にし、確認できない項目は「不明」と残します。

直らないときに残す記録

不具合報告やチーム共有では、次を残します。

項目内容
症状何が期待と違ったか
発生時点更新、圧縮、再開、MCP変更のどの後か
期待結果合格と判断する条件
環境Claude Codeの版、モデル、OS、シェル、コミット
読み込まれた指示CLAUDE.md、Skills、その他の指示
ツールMCPの接続状態、利用できるツール、使用履歴
結果回答、差分、テスト、停止理由
不明取得できない情報と、それによって判断できないこと

今回確認できた範囲

公開仕様から、/contextなどの診断コマンド、圧縮後のCLAUDE.mdの扱い、MCPの接続確認、大きなMCP出力への注意を確認できます。Anthropicは過去の品質問題で、モデル以外の設定やセッション状態が原因だった事例も報告しています。

一方、今回の調査ではClaude Codeを使った比較実行を行っていません。新しいセッションでの改善率、再現率、速度差、費用差は不明です。公開Issueと手元の症状が同じ原因かどうかも、版とログを照合するまで分かりません。

参考資料

  • Claude Code:Manage Claude’s memory
  • Claude Code:Debug your configuration
  • Claude Code:Connect Claude Code to tools via MCP
  • Anthropic:April 23 quality postmortem
  • 利用者報告:長いセッションで制約が抜けた
  • 利用者報告:再開後にMEMORY.mdの内容が失われた
  • 利用者報告:長いセッションで手順の後半が省略された

上のIssueはいずれも利用者報告であり、原因が確定した一次資料ではありません。症状を比べる手掛かりとして使い、対象の版と実行記録で確かめます。

まとめ

Claude Codeの精度が落ちたと感じたら、最初にモデルの能力低下と決めないでください。

症状、発生時点、会話の圧縮、指示と接続、大きな出力、新しいセッションでの再現という6項目を順に確認します。履歴と成果物を残し、一つだけ条件を変えて比べると、体感を再確認できる問題へ変えられます。

記事をシェアする

記事一覧に戻る
タグ
AIAI開発Claude Code

AI基盤を国産クラウドで動かす構成、要件整理から相談できます

設計や移行で迷っている構成があれば、要件が固まりきっていない段階から相談として受けています。状況を共有いただければ、優先度付けから一緒に進められます。

クラウド相談をする

要件が固まりきっていない段階でも、状況を共有いただければ優先度付けから一緒に進められます。

EC

EastCloud株式会社 — さくらのクラウドを中心に、官公庁・自治体のクラウド導入と運用を支援しています

Stacknotは EastCloud株式会社が運営しています

さくらのクラウドを中心に、公共・法人のクラウド導入と運用を支援しています。(新しいタブで開きます)

テーマから探す

AI仕事効率化開発AI開発Claude Code
国産クラウド総合支援

導入・運用を実務に合わせて支援

要件整理から運用改善までご相談ください。

相談はこちらサービス詳細
Stacknot

技術を結ぶメディア

記事一覧|編集方針|サイトマップ|お問い合わせ

Copyright Stacknot.