AIの鬼
#新モデル Zenn AI

AIを褒めると性能は上がるのか?――文脈・メモリ・重み更新・RLHFを分けて考える

AIを褒めると性能は上がるのか?――文脈・メモリ・重み更新・RLHFを分けて考える(内容を表す図ではないイメージ画像)
イメージ

LLMに「今の回答は良かった。その方向で続けて」と返すと、後続の回答が改善することがあります。 この現象を「褒めたことでAIが学習した」と説明すると直感的ですが、技術的には複数の異なる仕組みを混同しています。 本記事では、少なくとも次の4層を分離します。 推論時のコンテキストによる条件付け 会話履歴・外部メモリの再投入 学習によるモデルパラメータの更新 RLHFなど、開発時に人間の評価を利用する訓練 結論から言えば、 会話中の称賛が後続出力へ影響することはある。しかし、それだけを根拠に「その場でモデルの重みが更新された」とは言えません。 1. まず、推論と学習を分ける Trans...

出典: Zenn AI(配信元の紹介文より引用)
御社でもAIを使ってみませんか
まずはここから 御社でもAIを使ってみませんか? 御社の実際の業務を題材に、AIで何ができるかを一緒に考えます。 「ChatGPTの使い方」を教えるだけの研修ではありません。 AI研修・AI活用相談 →