为什么选择零信脱敏?不只是因为识别准确率
自发布以来,零信脱敏已服务银行、医院、律师事务所和财税服务机构等客户,并应用于政务相关材料处理场景,也获得了美国、波兰等海外企业客户的选择。
这些客户处理的往往不是普通文件,而是合同、卷宗、标书、病历、财务资料和内部文档。材料数量大、敏感信息密集,对安全、准确率、处理效率和售后响应都有更高要求。
脱敏工具很多,为什么他们最终选择零信脱敏?
我们的答案不是一句“更专业”,而是下面这些可以实际验证的产品能力。
安全感不只来自承诺,更来自本地离线
零信脱敏的全部脱敏处理流程都在用户电脑本机完成,包括文件读取、敏感信息识别、人工审阅、脱敏导出和代号还原。原始文件、识别结果和处理记录不会因为使用脱敏处理功能而上传到我们的服务器。
软件激活同样采用离线方式,不需要处理文件的电脑连接授权服务器;安装后可在内网、无公网或断网环境中使用。
用户可以在断网环境下直接运行,也可以通过网络监控工具自行验证。
对于银行、医院、律所等需要处理敏感材料的机构来说,少一次上传,就少一段数据流转链路;文件始终留在自己的设备和管理边界内,也更容易满足内部安全要求。
零信脱敏不提供需要上传文件后在线处理的网页版。原因很直接:当文件必须先上传到第三方服务器才能处理时,安全边界就从一台受控设备扩大到了网络、服务器、存储和运维链路。我们选择让全部脱敏处理流程留在用户本机,从产品架构上避免不必要的数据流转,减少由文件上传和云端处理带来的额外风险。
准确率是基础,覆盖敏感信息才是目的
脱敏首先要找得准,更重要的是尽量少漏掉真正需要保护的内容。
零信脱敏持续训练和评测自己的实体识别模型。当前模型在内部独立测试集上,严格实体级 F1 达到 98.25%,敏感信息覆盖率达到 99.26%;在正式 benchmark 上,严格实体级 F1 达到 97.48%,敏感信息覆盖率达到 99.04%。
正式 benchmark 中,姓名、机构和地址的严格 F1 分别为 97.80%、98.15%和 95.07%,地址敏感信息覆盖率为 97.52%。
“严格实体级”意味着只有实体类别和起止边界全部正确才算识别正确,并不是识别到一部分文字就计为成功。相比一个笼统的“准确率”,这种口径更严格,也更接近真实脱敏中的审阅要求。
我们同样清楚,任何模型都不应该承诺绝对无遗漏。扫描清晰度、OCR质量、复杂版式和上下文歧义都会影响实际效果。因此,零信脱敏不仅提供自动识别,也提供完整的审阅工作台,让用户能够检查、修改和确认结果后再导出脱敏副本。
面对几百页、几千甚至上万页的材料,效率必须真正可用
专业机构面对的经常不是一两页文件,而是数百页卷宗、成批标书,甚至数千上万页业务材料。
零信脱敏从一开始就围绕完整文档和批量材料设计,而不是只处理一段文本。我们持续优化大文件解析、识别和导出性能,尽量让处理进入真正可用的时间范围。
处理速度会受到文件类型、页数、图片数量、OCR需求和电脑配置影响,因此我们不会用单个案例承诺所有文件都能达到相同速度。但对大型文档材料的持续优化,是零信脱敏长期明确的产品方向。
客服由工程师直接参与,减少沟通阻力
用户遇到的很多问题,并不是查阅一份标准话术就能解决。
为什么某个地址没有完整识别?为什么一份扫描件排版异常?为什么某类材料需要新的规则?这些问题往往同时涉及文档解析、OCR、模型、规则和导出流程,需要真正理解产品实现的人参与判断。
因此,零信脱敏的产品支持由工程师直接参与。用户反馈不需要经过多层转述,问题能够直接进入研发任务列表,由能够定位和解决问题的人继续跟进。
官网目前承诺:常规问题通常在 2 个工作日内修复更新;复杂问题、系统适配和定制需求单独评估。我们不希望用一句“已收到”结束沟通,而是尽可能给出明确判断、处理结果和版本更新。
高频更新不是为了堆版本号
用户反馈能够快速进入产品,是零信脱敏保持高频更新的原因。
仅 7 月 22 日至 30 日,零信脱敏就从 26.7.4 更新至 26.7.14。期间陆续改进了识别准确率、自定义规则、原文标注版导出、在线更新、识别准确率提升、以及 OCR 优化。
这些更新不是为了制造“日更”的表象,而是因为真实材料不断暴露出更具体的需求。一个值得保留的反馈,会进入分析、实现、验证和发布流程;涉及识别模型的改进,不会针对单个案例简单打补丁,而会经过数据复核、模型训练和多组独立测试,确认整体识别效果稳定后才会发布。
更新频率只是结果,背后真正重要的是:产品是否持续解决真实问题。
产品体验不是功能越多越好
脱敏软件的目标不是把按钮和配置堆满界面,而是帮助用户在复杂材料中快速确认三件事:识别到了什么、哪里需要调整、最终导出了什么。
零信脱敏围绕这一过程设计了审阅工作台。用户可以在原文上下文中检查命中项,修改实体范围和类型,选择遮盖、代号替换等不同方式,再导出保留原始版式的脱敏副本。需要把材料交给 AI 或外部协作方时,还可以使用代号保留上下文,并在本机根据映射还原返回内容。
每一个功能、交互和视觉层级都应该服务于审阅效率。我们会继续增加真正有价值的能力,也会克制那些只会让界面更复杂的功能。
试用不是走流程,购买也不是服务的终点
我们不评价其他产品,也不要求用户只相信宣传。
零信脱敏提供免费试用。用户可以直接拿自己的真实材料,在自己的电脑上比较识别效果、处理效率、导出质量和审阅体验,确认满足需求后再决定是否购买。
很多服务也从试用阶段就已经开始。只要反馈对应真实业务需求,工程师就会认真分析;能够提升产品整体价值的问题,也会进入后续版本。
购买意味着正式服务关系的开始,而不是一次转化的结束。持续更新、问题响应和真实场景优化,本身就是产品的一部分。
最后
选择脱敏工具,本质上不是只选择一个识别程序。
它同时意味着选择一种数据安全边界、一套识别与审阅流程、一支遇到问题能够直接沟通的团队,以及一个是否愿意持续对结果负责的产品。
本地离线是零信脱敏的安全基础,识别模型是技术基础,审阅体验决定它是否真正好用,而持续更新和工程师直接服务,决定它能否长期解决真实问题。
这就是我们对“为什么选择零信脱敏”的回答。
