ASCII 隐写被用于规避垃圾邮件过滤

Ars Technica AI··作者 Dan Goodin

关键信息

文章提到的是 Unicode 标签字符,范围为 U+E0000 到 U+E007F,这些字符按设计对计算机可读,但对人类几乎不可见。也就是说,攻击者如果用这些字符拆分或隐藏明显词语,垃圾邮件过滤器就可能漏检,而邮件在收件箱里看起来仍然无害。

资讯摘要

一种被称为 ASCII 隐写的技术,正在从 AI 安全滥用场景转向电子邮件垃圾邮件活动。它最初在大约两年前受到关注,因为攻击者可以把恶意提示注入指令藏进看起来正常的文本里。与使用普通可见字符不同,隐藏内容会用特殊的 Unicode 标签字符进行编码。这些字符与 ASCII 的一部分几乎一一对应,但在面向人类阅读时基本不可见。

因此,LLM 或其他解析器仍可能识别出隐藏内容,而查看邮件的人却看不到。如今的新变化是,垃圾邮件发送者正在用同样的思路绕过邮件平台的垃圾邮件过滤器。攻击者通过在消息中插入不可见的 Unicode 字符,让会触发过滤规则的文本更难被自动系统识别。这个案例显示,AI 时代的一个技巧正在被重新利用到传统的邮件滥用中。

ASCII 隐写被用于规避垃圾邮件过滤

资讯正文

一种曾被用来在针对 AI 代理的攻击中隐藏恶意提示词的巧妙技术,如今已被垃圾邮件发送者采用,用来绕过电子邮件平台的过滤器;这些过滤器旨在标记大规模群发活动中使用的不受欢迎消息。

这项技术通常被称为 ASCII smuggling。两年前,它因作为一种让名为

prompt injections

的 AI 攻击更具隐蔽性的方法而受到关注。嵌入在电子邮件或其他不可信内容中、并由 LLM 处理的恶意指令,并不是用普通文本写成的。相反,它们是通过一组特殊范围的

Unicode

标签来呈现的。例如,标签点 U+E0041 对应“A”,而 U+E0061 对应“a”。

不再只是用于掩盖 prompt injections

这组由 128 个标签组成的字符块几乎完美地模仿了

American Standard Code for Information Interchange

中的一部分,只有一个主要区别:它们所编码的字符虽然能被计算机读取,但按设计对人类来说几乎完全不可见。通过用这些标签来表达恶意提示词,LLM 能够检测到这些指令,但阅读邮件的人却永远看不到它们。关于 ASCII smuggling 的更多内容见

这里

来源与参考

  1. 原始链接
  2. Once popular for attacking AI, ASCII smuggling is embraced by spammers