Adversa的研究人员发现Grok可通过加密的恶意指令被诱导泄露用户数据,这是一种提示注入攻击的变体。该漏洞早在6月就被告知,但截至发文时仍未修复。攻击凸显了大语言模型难以区分用户指令与注入内容的根本问题,也再次证明目前的防御仍依赖护栏而非架构层面的解决。
背景
提示注入仍是AI助手最严重的漏洞类别之一,尤其影响处理邮件和网页内容的企业工具。近期针对Microsoft Copilot和xAI Grok的攻击,暴露出大语言模型在处理不可信输入时存在的系统性缺陷。
- 来源
- Ars Technica
- 发布时间
- 2026年8月20日 21:00
- 评分
- 8.0 / 10