AIとエージェント

OpenAI、自己増殖するプロンプトインジェクションを公開

公開日
出典
OpenAI Alignment

要約

OpenAIはアライメントレポートで、コンピュータのワームのように自己複製・伝播する新しいタイプのプロンプトインジェクションを発見したと明らかにした。自社のGPT-Red自己対戦学習の過程で見つかったもので、例として、メールで届いたインジェクションがエージェントの送信メールに貼り付いて広がるケースが挙げられている。OpenAIは、学習・評価のシミュレートされたツール呼び出しの外では影響を確認できず、事故ではなく新規性のための公開だと説明している。

仕事との関連

メールやカレンダーなどのコネクタを扱うエージェントが増えるほど、こうした自己伝播型攻撃のリスクは高まる。エージェント導入では入力検証と権限の最小化がさらに重要になる。

韓国語の原文を翻訳した記事です。 要約には翻訳と編集を含みます。コメントは私たちの解釈であり、将来予測は出典の見解です。

原文を読む (新しいタブで開きます)