一种名为“环境轰炸”的新技术正被用于防御恶意人工智能代理。该方法通过用无关信息淹没这些人工智能系统来工作,导致它们在执行有害操作之前关闭。
人工智能驱动的黑客工具的兴起促使安全研究人员探索防御策略。这些“人工智能代理”旨在自主地发现和利用计算机系统的漏洞。然而,一种名为“prompt injection”(提示注入)的技术允许攻击者通过制作特定的提示来操纵这些代理,从而改变其焦点或提取敏感数据。
据Wired报道,新的防御手段——环境轰炸——本质上是用过多的额外信息淹没人工智能,使其无法有效运作。这种超载导致恶意代理在造成损害之前停止运行。文章指出,这是一种欺骗这些代理关闭的方式。
环境轰炸的有效性在于破坏人工智能区分相关指令和噪音的能力。通过用无关文本包围合法的提示,安全专业人员旨在创造一个恶意代理无法成功执行其预期任务的环境。
我们不评判真相。我们去除偏见,展示哪些视角报道了这个故事。由你来判断。
阅读原始报道
💬 评论
📜 评论政策