无需登录 数据私有 本地保存

文本混淆防复制 - 生成不可选中的展示

111
0
0
0
术语解释
零宽字符(Zero-Width Character)Unicode标准中的特殊控制字符,在文本中不占据任何显示宽度,肉眼完全不可见。常见的零宽字符包括U加200B零宽空格、U加200C零宽不连字、U加200D零宽连字、U加FEFF字节序标记、U加2060词连接符等。这些字符在文本编辑器中不可见但可以被复制和传输。
同形字符(Homoglyph)来自不同Unicode区块但外观极其相似的字符。例如拉丁字母a和西里尔字母a在大多数字体中看起来几乎完全一样,但计算机将它们视为完全不同的字符。同形字符替换正是利用这一视觉相似性实现文本混淆保护。
零宽空格(ZWSP)Unicode编码U加200B,全称Zero Width Space,是最常用的零宽字符之一。它在文本中完全不可见,但会被复制粘贴操作携带到剪贴板中,常用于文本混淆防复制技术中增加复制结果的异常程度。
零宽连字(ZWJ)Unicode编码U加200D,全称Zero Width Joiner。原本用于控制相邻字符的连字渲染行为,在现代Unicode中也用于emoji组合序列。在文本混淆中被用作额外的不可见插入字符,增加混淆后的文本异常程度。
零宽不连字(ZWNJ)Unicode编码U加200C,全称Zero Width Non-Joiner。用于阻止相邻字符的连字渲染效果,常见于波斯语和阿拉伯语排版中。在文本混淆技术中与其他零宽字符配合使用,作为不可见的填充字符。
BOM(字节序标记)Unicode编码U加FEFF,Byte Order Mark,原本用于标识文本文件的字节序是大端序还是小端序。在零宽字符混淆中它常被用作不可见的填充字符,因为大多数文本编辑器和显示系统不会渲染它。
user-select: noneCSS属性,设置为none时可阻止用户通过鼠标或触控操作选中元素中的文本内容。常与零宽字符混淆技术配合使用,提供前端层面的额外文本保护层,从交互层面防止用户直接选中文本进行复制。
Unicode国际通用的字符编码标准,最新版本收录了超过十四万个字符,涵盖世界上几乎所有文字和特殊符号。Unicode为零宽字符和同形字符提供了统一的编码基础和跨平台兼容性支持,是文本混淆技术的核心依赖标准。
文本混淆(Text Obfuscation)通过技术手段使文本在视觉上保持可读性但在机器处理或复制粘贴时产生异常的技术。目的是增加文本被自动化采集工具和普通用户通过简单复制方式盗用的难度,保护原创内容的版权和商业价值。
内容保护(Content Protection)泛指保护网页原创内容不被轻易复制、爬取或盗用的技术手段集合。文本混淆是前端内容保护策略的一种实现方式,通常与CSS防护、JavaScript反调试、服务器端限流等其他技术手段配合使用,构建多层次的内容保护体系。
文本膨胀率混淆后文本的字节数与原始文本字节数的比率。零宽字符注入会增加文件大小但不影响显示,同形替换通常不改变字符数量。文本膨胀率是评估混淆强度的参考指标之一。