AIの鬼
#新モデル Zenn AI

【Claude Opus 5】ベストプラクティスをルール25本に当てたら、穴が3つ出た

【Claude Opus 5】ベストプラクティスをルール25本に当てたら、穴が3つ出た(内容を表す図ではないイメージ画像)
イメージ

モデル更新のたびに、自分が書いたエージェント指示(25本、4000行以上)を棚卸しする人がいます。新しい Claude Opus 5 が出たときも、「明示的な検証指示は削除してください」という公式ガイドに対して、自分のルール群が当てはまるか実測で確認しました。grep で該当表現を探したら 2 件しかヒットしなかった。削る作業だと思ったのに、出てきたのは足りないものでした。具体的には 3 つの空白が見つかった。委譲するかどうかの起動判定がなかったこと、ディスク上に出力するファイルの長さについて規律がなかったこと、effort 軸の定義が曖昧だったこと。削除は 0 件、追加が 3 つ。ここが面白いのは、これが決して技術的なバグではなく、指示が「陳腐化」している現象だということです。去年の自分が「もっと委譲させよう」と書いたルールが、今年のモデル(元々委譲しがちな傾向)の前では逆向きに働く。文法的には同じテキストが、モデルの進化に伴って別の意味に変わる。中小企業が AI ツールを導入するとき、このギャップに気づきにくい。ChatGPT の新バージョンが出ても、「以前と同じやり方」で使い続けている企業は多い。が、実際には前バージョン向けに設計されたプロンプトやルールが、新バージョンではことなる挙動をしている。完全には壊れていないから気づかない。むしろ妙に効率が落ちている、という程度で終わる。モデルアップデートのたびに、自社の「使い方」をも再検査する習慣があると、隠れたポテンシャルが出てくる。この人の実測は、その習慣の大切さを物語っています。

※ 上記は配信元記事をもとにAIの鬼編集部が要約・再構成したものです。正確な内容は出典元をご確認ください。

御社でもAIを使ってみませんか
まずはここから 御社でもAIを使ってみませんか? 御社の実際の業務を題材に、AIで何ができるかを一緒に考えます。 「ChatGPTの使い方」を教えるだけの研修ではありません。 AI研修・AI活用相談 →