AI 与智能体
OpenAI公开可自我复制的提示注入发现
- 发布日期
- 来源
- OpenAI Alignment
摘要
OpenAI在对齐报告中披露了一类新型提示注入,它可以像计算机蠕虫一样自我复制并传播。该发现来自其GPT-Red自我对弈训练框架;其中一个示例是,通过电子邮件到达的注入会指示代理把它复制到自己发送的每封邮件中。OpenAI表示,在训练和评估的模拟工具调用之外未观察到影响,公开此项是因其新颖性而非发生了事故。
与我们工作的关联
随着越来越多代理处理邮件、日历等连接器,这种可自我传播的注入让企业部署代理时的输入验证和最小权限设计变得更加关键。
本文译自韩文原文。 摘要可能经过翻译和编辑。评论是我们的解读,未来预测代表来源的观点。