AIにAIのコードを敵対的レビューさせたら6割叩き直された話 — 64億トークンのログが明かす『コンテキスト分離』の威力
1. はじめに:AIに自分で自分のコードをチェックさせる限界 「AIエージェントにコードを書かせ、そのまま『自分でテストしてセルフチェックして問題なければマージして』と指示する」——こうしたプロンプト駆動の自律開発を試したことがある人は多いのではないだろうか。 しかし、単一のエージェントセッションでコードを実装させ、そのままセルフチェックを行わせると、AIは自分が書いたコードの論理バグや消し忘れにきわめて盲目になる。どれだけ「厳しくチェックしてほしい」とプロンプトで指示しても、実装時の会話履歴やコンテキスト(思考のバイアスやツール実行のログ)を背負った状態では、人間と同じように「自分...
出典: Zenn AI(配信元の紹介文より引用)
このニュースの全文は、配信元でお読みいただけます。 Zenn AIで元記事を読む →


