🎭 文本混淆器
使用 Unicode 同形字和零宽字符混淆文本。在保持视觉相似的同时伪装纯文本。
关于文本混淆器
本工具伪装纯文本,使其在人类读者看来几乎完全相同,但在技术上由不同的 Unicode 码点组成。它通过将 ASCII 字母替换为其他脚本中视觉相似的字符(同形字)和/或在字母之间插入不可见的零宽字符来实现。本工具完全在浏览器中运行——不会上传任何数据。
工作原理
- 同形字替换 —— 每个 ASCII 字母被替换为另一个 Unicode 块中视觉相同的字符(通常是西里尔字母)。例如,拉丁
a(U+0061)变为西里尔а(U+0430)。文本读起来相同,但底层字节不同。 - 插入零宽空格 —— 在每个字符之间插入零宽空格(U+200B)。文本仍然看起来相同,但每个字母现在被一个不可见标记分隔,使简单的字符串匹配失效。
- 组合 —— 同时应用同形字替换和零宽插入,实现最大程度的混淆。
- 规范化(去混淆) —— 使用 Unicode NFKC 规范化将相似字符转换回 ASCII 等效字符,并移除零宽字符。适用于本工具混淆的文本或任何包含同形字的文本。
使用场景
- 绕过精确匹配 ASCII 字节的关键词过滤和内容审核。
- 防止自动抓取或抄袭检测匹配你的文本。
- 创建用户名、话题标签或显示名称的样式变体。
- 教育演示 Unicode 同形字攻击和钓鱼风险。
常见问题
混淆后的文本可搜索吗? 不可。由于底层字符不同,搜索引擎、页内查找和 grep 都无法将混淆文本与原始 ASCII 查询匹配。
混淆文本在任何地方都看起来一样吗? 大部分情况下是的,但某些字体可能渲染西里尔字母与拉丁相似字符略有不同。请在目标环境中测试。
混淆可以反转吗? 可以——使用"规范化"按钮。NFKC 规范化将大多数同形字映射回 ASCII 并移除零宽字符。
这是加密吗? 不是。它是混淆——隐藏文本使其不被简单匹配发现,但无法防止知道如何规范化或扫描非 ASCII 字符的人。不要用于安全目的。
这个工具会上传我的文本吗? 不会。所有处理都在本地浏览器中完成。