Claude Code の /code-review を実装から読む ─ effort レベルで何が変わるか
Claude Code には /code-review という組み込みスキルがあり、差分を読んでコード上のバグと、再利用・簡素化・効率まわりのクリーンアップを指摘する。ヘルプには「effort レベルを選べる」とだけ書いてあるが、内部で何が変わるのかまでは書かれていない。そこで Claude Code 2.1.251 のバイナリからプロンプトを読んで、各レベルが実際に何をしているのか逆算した結果をまとめたのがこの記事だ。結論から言うと、effort レベルは「考える時間の長さ」ではなく、探索の角度数・候補数・検証パスの有無・報告件数の上限をまるごと切り替えるスイッチだった。medium と high は正確性 3 つ + クリーンアップ 3 つ + 抽象度 1 つ + 規約 1 つの 8 角度。xhigh と max は正確性 5 つ + クリーンアップ 3 つ + 抽象度 1 つ + 規約 1 つの 10 角度。正確性が増えると削除行の不変条件チェックや呼び出し元をまたぐ影響追跡も入る。プロンプト自体も書き分けられていて、medium は「メンテナが実際に直す指摘だけを出せ」と精度を重視する一方、high 以上は「見逃すより出せ」と再現率を重視する。AIの鬼として注目すべきは、「高いレベルほど誤検出が混ざる」という設計方針だ。xhigh / max では、検証で 1 票でも REFUTED でなければ通す、という指示まで入っている。つまり報告件数が増えるのは「品質が落ちた」のではなく「取りこぼし率を下げるため」という意図的な選択だということだ。このレベルの使い分けを「努力度」の問題だと誤解すると、高レベル = 高品質という単純な連想になってしまう。実務的には本番前チェック(high)と不可逆変更(xhigh)で十分で、max / ultra は特殊な場面だけだ。中小企業が明日から効く一言に落とすなら、「コードレビューを自動化するなら、誤検出の多さを『品質低下』と誤解しない目利きが必須」ということだ。高いレベルで返ってくる指摘リストが長いのは、工数を減らすためではなく、見逃しを最小化するための設計。その指摘の 3 割が最終的に「やる必要ない」と判定されるかもしれない。けれどリスク最小化という文脈では、その取捨選択の手間そのものが価値なのだ。
※ 上記は配信元記事をもとにAIの鬼編集部が要約・再構成したものです。正確な内容は出典元をご確認ください。
このニュースの全文は、配信元でお読みいただけます。 Zenn AIで元記事を読む →

