🎭 文本混淆器

使用 Unicode 同形字和零宽字符混淆文本。在保持视觉相似的同时伪装纯文本。

关于文本混淆器

本工具伪装纯文本,使其在人类读者看来几乎完全相同,但在技术上由不同的 Unicode 码点组成。它通过将 ASCII 字母替换为其他脚本中视觉相似的字符(同形字)和/或在字母之间插入不可见的零宽字符来实现。本工具完全在浏览器中运行——不会上传任何数据。

工作原理

  • 同形字替换 —— 每个 ASCII 字母被替换为另一个 Unicode 块中视觉相同的字符(通常是西里尔字母)。例如,拉丁 a(U+0061)变为西里尔 а(U+0430)。文本读起来相同,但底层字节不同。
  • 插入零宽空格 —— 在每个字符之间插入零宽空格(U+200B)。文本仍然看起来相同,但每个字母现在被一个不可见标记分隔,使简单的字符串匹配失效。
  • 组合 —— 同时应用同形字替换和零宽插入,实现最大程度的混淆。
  • 规范化(去混淆) —— 使用 Unicode NFKC 规范化将相似字符转换回 ASCII 等效字符,并移除零宽字符。适用于本工具混淆的文本或任何包含同形字的文本。

使用场景

  • 绕过精确匹配 ASCII 字节的关键词过滤和内容审核。
  • 防止自动抓取或抄袭检测匹配你的文本。
  • 创建用户名、话题标签或显示名称的样式变体。
  • 教育演示 Unicode 同形字攻击和钓鱼风险。

常见问题

混淆后的文本可搜索吗? 不可。由于底层字符不同,搜索引擎、页内查找和 grep 都无法将混淆文本与原始 ASCII 查询匹配。

混淆文本在任何地方都看起来一样吗? 大部分情况下是的,但某些字体可能渲染西里尔字母与拉丁相似字符略有不同。请在目标环境中测试。

混淆可以反转吗? 可以——使用"规范化"按钮。NFKC 规范化将大多数同形字映射回 ASCII 并移除零宽字符。

这是加密吗? 不是。它是混淆——隐藏文本使其不被简单匹配发现,但无法防止知道如何规范化或扫描非 ASCII 字符的人。不要用于安全目的。

这个工具会上传我的文本吗? 不会。所有处理都在本地浏览器中完成。