跳到正文
北京时间
原文
Hacker News 热门(buzzing.cc 中文翻译)· justswim·· 2026-07-12精选AI 评分75

Ghost Font:一种人类能读懂但AI无法识别的反AI字体

幽灵字体:一种人类能读懂但人工智能无法识别的字体

AI 导读

Ghost Font 是一种利用运动、视频、噪点和诱饵来隐藏文字的反AI字体。用户输入文字后可生成并下载视频片段,视频中的字母由与背景完全相同的点组成,单帧截图无法显示任何信息。该字体生成的视频被传递给Claude Fable和GPT Sol 5.6 Ultra等前沿模型时,这些模型即使具备编程能力也无法解码移动信息,直到被提示具体技术。视频中还包含一条诱饵信息,使模型误以为找到真实内容。项目灵感来自2013年Sang Mun设计的ZXX字体,但现代AI已能轻松读取ZXX。Ghost Font目前为本地原型,数据不发送至任何服务器。作者计划未来将视频生成代码开源,并探索将其用于CAPTCHA系统或AI视觉感知基准测试。

推荐理由

这个项目用视频中运动的光点传递文字,还加了假消息陷阱,让顶级视觉模型集体失败。对抗AI感知的探索很少这么直观,做CAPTCHA和对抗样本的值得看。

正文 · AI 翻译

幽灵字体

一种反 AI 字体,人类可以阅读,但主流 AI 模型无法识别。在下方输入你的文字,然后下载并分享包含你信息的视频片段。

Ghost Font animation preview · 前往原文使用

什么是幽灵字体?

幽灵字体是一种反 AI 字体,它通过运动来书写信息。结合运动、视频、噪点和诱饵,这是一种与其他真实人类分享信息的独特方式。我想严格来说,它并不是传统意义上的 TTF 字体文件。但幽灵字体是一种实验,探索以 AI 难以轻易理解的格式进行图形化书面交流的方式。虽然它不像普通文字那样易读,但字母对人类眼睛来说仍然可以即时辨认,然而即便是主流 AI 模型也难以轻易破译。

视频封面视频 · 前往原文观看
使用幽灵字体生成的示例视频。

使用幽灵字体生成的视频随后被传递给 Claude Fable 和 GPT Sol 5.6 Ultra 等主流 AI 模型。即便是这些具备编程能力的近期智能体,也难以解码运动中的信息,直到被提示需要寻找的确切技术方法。

GPT-Sol 5.6 Ultra attempting to decode a message written with Ghost Font. The model reads the hidden decoy message, but fails to read the actual moving message.
GPT-Sol 5.6 Ultra 尝试解码用幽灵字体书写的信息。该模型读出了隐藏的诱饵信息,但未能读出实际运动中的信息。
Claude Fable with Max reasoning attempting to decode a message written with Ghost Font. The model reads the hidden decoy message, but fails to read the actual moving message.
Claude Fable 以 Max reasoning 尝试解码用幽灵字体书写的信息。该模型读出了隐藏的诱饵信息,但未能读出实际运动中的信息。

上面的演示只是这个概念的一个原型。输入几个词,字母就会出现,但这只是因为点的运动对人眼可见。

当视频暂停时,静态的点会融为一体,仅凭观察单帧画面已无法分辨图像中嵌入了什么信息。这意味着对页面截图不会泄露该信息。

这个实验在本地运行——输入信息并实时预览,或下载视频分享并自行测试。数据不会被共享或发送到任何服务器。

关于这个项目

2013 年,设计师 Sang Mun 发布了一款名为 ZXX 的字体。这是一款包含四种字型的字体,设计目标是让人能读懂,但光学字符识别(OCR)软件读不出来。字母被噪点伪装、被划掉、被埋在虚假标记之下。当时,这款字体被认为是"防监控"的——但快进到今天,现代 AI 智能体可以轻松读取用 ZXX 渲染的文本。

Example of the ZXX font
ZXX 字体示例

虽然这在 2013 年或许能击败 OCR 软件,但现代 AI 模型可以相当轻松地读取 ZXX 中的文本。我把这张图片复制到 ChatGPT 5.5 的 Instant 模式下,它仍然能在单次提示词中读出这些词,甚至包括一些细节:

ChatGPT easily reads the text in this image
ChatGPT 轻松读取了这张图片中的文本

然而,用 Ghost Font 进行同样的处理就不会那么轻松了。对 Ghost Font 截取一张截图,只会得到一张完全静态、没有任何可读文字的图像。这是因为 Ghost Font 中的每个字母都由与背景看起来完全一样的点组成,因此视频中的任何单帧图像都不会泄露关于该信息的任何内容:

Trying ChatGPT 5.5 Pro with Ghost Font
用 Ghost Font 试用 ChatGPT 5.5 Pro

经过 19 分钟的分析,ChatGPT 5.5 Pro 幻觉出了一条并不存在的信息。

然而,仅仅把信息隐藏在视频中并非完美的解决方案。虽然在线模型环境可能无法从单帧图像中获取它,但一个拥有本地代码执行环境的专用智能体仍然可以分析这些点的运动并解码出信息。Ghost Font 以另一种分层的方式解决了这个问题:每次生成视频时都会包含一条诱饵信息。

这条诱饵信息是对执着的智能体设下的最后一道诡计。当它寻找隐藏信息时,可能会先找到诱饵信息,并以为那就是视频中真正嵌入的信息。正因如此,Ghost Font 甚至能够对 Fable 和 GPT Sol 5.6 Ultra 这类最强的思考型模型隐藏信息。

归根结底,真正隐藏信息的方法是使用加密,或者某种密钥。没有任何 AI 能够读取一条需要只有人类才知道的特定密码才能解锁的信息。不过,这个项目探索的是:是否有可能创建一种包含视觉信息的可分享文件,而 AI 模型无法轻易读取它。

我们创建这个实验,是为了探索 AI 感知的极限,同时保留一些属于人类的东西。随着 AI 接管字体生成,我们希望人类能继续拥有独特的创造性声音。

接下来是什么?

Ghost Font 有一些影响,我认为值得继续探索。例如,将 Ghost Font 融入 CAPTCHA 系统会很有意思,因为如今大多数系统都能被 AI 轻松破解。在视频中运用动态效果,可以让自动化机器人更难破解,但对人类来说仍然相对容易阅读。

Ghost Font 或许也是一种有趣的方式,用来衡量 AI 在视觉感知方面的进展。目前,多模态模型是基于图像的,即使传入视频,它们通常也会把视频拆分成帧,再逐帧分析。在不久的将来,我猜想会出现一种原生视频模型,能够直接读取文本。

最后一个教训是,AI 确实变得非常强了。虽然 Ghost Font 对 AI 来说很难读,但对人类来说也相当难读!差距仍在不断缩小。在 AI 感知和多模态模型方面,未来会怎样,将会很有意思。

下一步,我计划将视频生成的代码作为开源项目发布——敬请期待!我还希望扩大规模,并处理更长的文本字符串。希望你喜欢这个实验,我很想听听你的想法。你可以在 X 上找到我:@ericlu。

- Eric

来源:Hacker News 热门(buzzing.cc 中文翻译) · mixfont.com