本地脱敏 · 文档安全处理台

VibeMySpace 精选 的头像VibeMySpace 精选@vibemyspace-curated

编辑介绍

本地脱敏工作台将合同、裁判文书、研究笔记和访谈记录的导入、实体识别、人工确认、脱敏预览、映射表与报告导出放进一套本机流程。用户可先检查右侧识别结果和中间预览,再导出可分享版本;映射表保持为独立还原材料,避免敏感原文在提交给外部工具前直接暴露。

AI 用途:本地规则与 ModelScope 中文 RaNER 识别敏感实体,可选 PaddleOCR 处理扫描 PDF;用于文档提交给大模型前的脱敏。

使用方式:内置本地模型

模型信息:ModelScope iic/nlp_raner_named-entity-recognition_chinese-base-generic;可选 PaddleOCR;无 LLM。

原帖正文

这段时间我自己用 vibe coding 做了一个小工具:八股仙人的本地脱敏工作台。

简单说,就是一个在本机运行的中文文档脱敏工作台。做它的原因也很具体:合同、裁判文书、法律文章、研究笔记、访谈记录这些材料,在发给别人或者发给 AI 之前,经常夹着姓名、电话、邮箱、身份证号、机构名、地址、案号等敏感信息。

这个工具目前已经做到可用状态,所以我把它开源分享出来。它不是一个完美产品,更像是一个面向真实工作流的小工具:先解决“发出去之前别裸奔”这个问题。

项目主页也放在这里: https://gitee.com/szzzcode/szzz-redact-desk。你可以把这个地址发给 WorkBuddy、Codex、Claude Code 这类能操作本地电脑的 Agent,然后告诉它: “请根据这个说明文件,帮我下载、安装并启动这个项目。说明文件的地址为https://gitee.com/szzzcode/szzz-redact-desk/raw/agent-download-note/AGENT_DOWNLOAD_INSTALL.txt” Agent 会按说明下载源码包、安装后端和前端依赖。如何启动和使用,也可以询问agent。

建议安装 PDF/OCR 依赖,处理 PDF 或扫描件。 建议安装 NER 模型识别依赖,增强中文实体识别效果。

Github也有同源镜像:https://github.com/szzzcode/szzz-redact-desk 欢迎加☆ 感谢支持

打开本地页面后,把需要处理的合同、判决书、文章或笔记导入进去;先看右侧识别结果,再看中间的脱敏预览,确认没漏掉明显敏感信息后再导出。 这里一定要说清楚局限:自动识别不可能 100% 准确。尤其是复杂版式、扫描件、特别长的材料,正式对外发送前还是要人工复核。 另外,映射表 JSON 是还原文件的关键材料,相当于“原文和脱敏内容的对照表”,不要随便发给别人。

欢迎大家试用,也欢迎反馈 bug、使用场景和改进建议。

#howto用好AI# #vibecoding# #律师# #howto用AI手搓APP# #AI# #工具# #提升生产力# #脱敏工具#

来源与作者

  • 原作者:八股仙人
  • 发布平台:小红书
  • 原帖:查看原帖
  • 权利说明:VibeMySpace 仅作带来源的整理展示,内容与图片权利归原作者。

开源信息

已开源。