言語モデルの誠実性を守る『告白』メソッド
OpenAIの研究者らは、モデルが自らの過ちや望ましくない行動を認めるよう学習させる『告白』というメソッドをテストしており、AIの正直性、透明性の向上とモデル出力への信頼醸成に役立つとしている。
出典: OpenAI(配信元の紹介文より引用)
このニュースの全文は、配信元でお読みいただけます。 OpenAIで元記事を読む →
OpenAIの研究者らは、モデルが自らの過ちや望ましくない行動を認めるよう学習させる『告白』というメソッドをテストしており、AIの正直性、透明性の向上とモデル出力への信頼醸成に役立つとしている。
出典: OpenAI(配信元の紹介文より引用)
このニュースの全文は、配信元でお読みいただけます。 OpenAIで元記事を読む →