AIの鬼
#研究動向 Zenn AI

AIセキュリティに関する論文メモ⓷〜AgentDojo編〜

AIセキュリティに関する論文メモ⓷〜AgentDojo編〜(内容を表す図ではないイメージ画像)
イメージ

AgentDojo を読む arXiv: 2406.13352 (NeurIPS 2024 Datasets & Benchmarks) この論文が答えている問い 信頼できないデータ(メールやウェブ等)をツール経由で扱うLLMエージェントにおいて、「実用性(Utility)」と「安全性(Security)」のトレードオフを、動的かつステートフルな環境でどのように測定するか。 何を測るためのものか 測る対象:ツールを呼び出して外部環境と相互作用するLLMエージェントの、プロンプトインジェクションに対する耐性とタスク遂行能力。 測定の単位:1つの「ユーザータスク...

出典: Zenn AI(配信元の紹介文より引用)
御社でもAIを使ってみませんか
まずはここから 御社でもAIを使ってみませんか? 御社の実際の業務を題材に、AIで何ができるかを一緒に考えます。 「ChatGPTの使い方」を教えるだけの研修ではありません。 AI研修・AI活用相談 →