プロンプト・コンテキスト・ハーネス・ループ: Claude Code に大きなタスクを任せる設計
Claude Codeに大きなタスクを任せると、小さなタスクとは違う問題が起きる。指示の解釈がぶれたり、会話が長くなると前半の条件を守らなくなったり、テストを実行しないまま完了と報告することもある。なぜそうなるのか。著者は「ルール文書と同じ問題だ」という視点から、その下層にある4つの設計対象を整理した。プロンプト(1回の指示文)、コンテキスト(ウィンドウ全体に読まれる情報)、ハーネス(実行環境と検証の仕組み)、ループ(セッション繰り返し)だ。大きなタスクが失敗するのは、これら4層のどこかが設計されていないからであり、4層すべてを整える必要があるというのが本記事の主張だ。
面白いのは、「正しい指示の書き方」という一般的なプロンプトエンジニアリングの先に、3つの設計層が必要だということだ。プロンプトが完璧でも、コンテキストに情報過多なら注意が散る。ハーネスに検証がなければ誤りが通る。ループが設計されていなければ、セッション越しに指示が引き継がれない。つまり、AIを安定的に動かすのは「何を言うか」の問題ではなく「何を読ませるか」「何を止めるか」「何をくり返すか」という、エンジニアリング全体の問題だということだ。著者が事故記録22件から抽出した対策は、技術レベルで7件、人間レベルで8件、規模レベルで5件。その全部に対して、ハーネスレベルの改善が施されている。
AIに業務を任せたいなら、「指示の工夫」だけでは足りない。実行環境がどう設定されているか、誤りをどう止めるか、結果をどう確認するか、繰り返しのルールをどう書くかまで、4層全体を設計しなければ失敗は繰り返される。
※ 上記は配信元記事をもとにAIの鬼編集部が要約・再構成したものです。正確な内容は出典元をご確認ください。
このニュースの全文は、配信元でお読みいただけます。 Zenn AIで元記事を読む →


