一种用于在攻击AI代理时隐藏恶意提示的巧妙技术,已被垃圾邮件发送者采用,以逃避电子邮件平台上旨在标记群发活动中不需要消息的过滤器。
该技术广为人知,称为ASCII走私。两年前,它作为一种使一类名为提示注入的AI攻击更加隐蔽的手段而受到关注。嵌入在电子邮件或其他由LLM处理的不受信任内容中的恶意指令并非以普通文本书写。相反,它们通过一系列特殊的Unicode标签呈现。例如,标签点U+E0041对应“A”,U+E0061对应“a”。这128个标签组成的区块几乎完美地模仿了美国信息交换标准代码的一部分,但有一个主要区别:它们编码的字符计算机可以读取,但设计上对人类几乎完全不可见。通过用这些标签表达恶意提示,LLM能够检测到指令,但阅读电子邮件的人却永远看不到它们。关于ASCII走私的更多内容请见此处。