提示词一句话攻破反AI字体,动态视觉仍是模型短板
一句话提示词就能让AI看懂人类专属动态字体,揭示运动感知是当前模型的明显盲区。
开发者用动态噪点视频创造「幽灵字体」,人眼靠运动感知秒读,但AI逐帧分析只会掉进诱饵。提示工程大牛仅用一句方向提示,就让GPT-5.6成功解码。这暴露了当前多模态模型缺乏运动感知能力,也说明人类自以为安全的壁垒可能不堪一击。
正文摘录
 新智元报道  【新智元导读】 人眼秒懂、顶级 AI 全瞎的「幽灵字体」一夜爆火 1700 万播放,结果一句提示词就让 GPT-5.6 破防了。 人类好不容易「赢了」一回,结果不到一天又被 AI 反杀! 事情是这样的,开发者 Eric Lu 发布了一个叫做 「Ghost Font」 (幽灵字体)的视频。 结果刚发出来就爆了。 视频一夜播放 1700 万 +。  它是一种用动态噪点视频写字的 「反 AI 字体」 实验:你在网页上敲几个字,系统会生成一段视频,组成字母的像素统一往上滑,背景噪点统一往下滑。 人眼靠运动感知秒懂。 但 AI 逐帧看,全是雪花。 Eric 直接拿当前最强的两个模型开刀:Claude Fable 和 GPT-5.6 Sol Ultra。 结果双双翻车——两个模型都自信满满地读出了信息,但读出来的全是作者故意埋的诱饵文字,真正的隐藏消息连门都没摸到。 GPT-Sol 5.6 Ultra 尝试解码用幽灵字体书写的消息。该模型读取了隐藏的诱饵消息,但未能读取实际的运动消息。