粘贴你的一段样例文本,或选一份内置示例;勾选要处理的实体类型,切换脱敏策略,右侧立刻显示结果。整个过程只发生在你当前的浏览器标签页里。
可逆性说明:占位符可逆与 LLM token 可逆并非靠占位符本身反猜原文,而是靠本机映射库(每个占位令牌对应唯一原文)。下方演示为了视觉整齐,同类实体生成相同短码;真实引擎对每个实体生成唯一哈希(如 [PERSON_a3f7c8]),确保可精确还原。FPE(格式保持加密)则靠密码学密钥直接解密,无需映射库。演示中前三种策略可实时切换;第四种 FPE 因涉及密钥管理未接入浏览器演示,以灰显卡展示。
提示:把鼠标移到绿色高亮处可查看原始值。本演示引擎为前端简化版,仅用于展示脱敏方法;真实产品在本机使用「规则引擎 + 模型校验 + 人工复核」三层识别 22 类实体,识别效果提供评测脚本可自行验证,且文件全程不离开你的电脑。
以下为当前生产版本文本层已支持的能力(所见即所得)。
仅对数字 ID 类(手机 / 身份证 / 银行卡 / 邮箱)做部分遮蔽,如 138****5678。可读性最好,适合内部核对。对姓名 / 公司 / 地址等中文实体,引擎无专用掩码函数,会降级为占位符(见②)。
对全部 22 类实体统一替换为占位令牌(如 [PERSON_hid]、[COMPANY_hid]),原文存入本机映射库、凭映射精确可逆还原。这是真实引擎的默认脱敏方式,也是「脱敏后仍能复扫 / 审计 / 喂 AI」的核心能力。
对全部类型生成带结构属性的令牌(如 [COMPANY_1:深圳-科技]、[PERSON_1:北京]),凭映射库可逆还原,且保留字段属性更利于下游 AI 分析。
采用 FF1 格式保持加密(密码学),脱敏后保持原数据格式(手机号仍是 11 位数字、可继续做格式校验),原文凭本机密钥可逆还原、无需映射库。真实引擎已实现,目前仅支持 手机 / 身份证 / 银行卡 / 邮箱 4 类,默认关闭——需 企业版授权 + 功能开关 开启。文本泛化 / 整段删除仍为规划能力。
ℹ️ 能力边界(真实引擎现状):文本层已支持 4 种脱敏方式——掩码、占位符可逆、LLM token 可逆、格式保持加密 FPE(FF1,仅 4 类,默认关闭需企业版授权)。文本泛化、整段删除 仍为规划能力,引擎尚未接入;本演示仅展示已落地能力,所见即所得。
为什么可逆脱敏是我们重点推荐的? 脱敏不等于报废数据。影数鹏真实引擎对全部 22 类实体采用映射表可逆——脱敏后文本以占位令牌 / 带属性 token 呈现,原文锁在本机映射库,凭映射精确还原。同一份文档脱敏后,你仍能在本机做二次复扫、审计追溯、把干净数据喂给下游 AI 分析。对「既要合规、又要用数据」的审计与财务场景,这是兼顾安全与价值的最优解。
真实引擎文本层已支持四种策略,下表为默认可用三种的可用方式与默认行为:
[TYPE_<唯一短码>],凭本机映射库精确还原,真实引擎默认方式。| 字段类型 | 真实支持的策略 | 默认 | 备注 |
|---|---|---|---|
| 身份证 / 手机 / 银行卡 / 邮箱 | 掩码 · 占位符可逆 · LLM token 可逆 | 掩码 | 数字 ID 专用部分遮蔽,保留格式 |
| 姓名 | 占位符可逆 · LLM token 可逆 | 占位符 | 掩码模式对中文实体降级为占位符 |
| 公司 / 机构 | 占位符可逆 · LLM token 可逆 | 占位符(带属性) | LLM token 保留行业 / 地域 |
| 地址 | 占位符可逆 · LLM token 可逆 | 占位符 | LLM token 保留省市级 |
| 绝密字段 | 当前版本无整段删除策略;建议用占位符模式,且脱敏产物与映射库分离保管 | ||
下方为当前生产版本文本层全量支持的实体类型(按识别方式分组)。上方演示框内实时展示 7 类代表性实体,其余类型由真实引擎在本机离线识别与脱敏。