DataInfra-RedactionEverything 完全指南:如何用本地 LLM 和 VLM 实现文档脱敏
DataInfra-RedactionEverything 完全指南如何用本地 LLM 和 VLM 实现文档脱敏【免费下载链接】DataInfra-RedactionEverythingDataInfra Series. Redact EVERYTHING with local llms and vlms.项目地址: https://gitcode.com/gh_mirrors/da/DataInfra-RedactionEverythingDataInfra-RedactionEverything 是一款基于本地大语言模型LLM和视觉语言模型VLM的文档脱敏工具能够帮助用户轻松实现文本和图像中敏感信息的识别与处理。本指南将带您了解如何快速上手这款强大工具保护您的隐私数据。 开始使用从单文件处理到批量操作首次使用时建议从处理单个文件开始熟悉工具的基本功能和配置流程。工具提供了直观的用户界面引导您完成文件上传、识别、标记和输出的全过程。单文件处理步骤上传文件支持 Word、PDF、扫描件和图片等多种格式配置识别规则选择需要脱敏的内容类型如姓名、身份证号、电话号码等预览和调整查看系统自动识别的敏感信息手动调整标记结果导出处理结果下载脱敏后的文件⚙️ 核心功能灵活配置满足不同需求批量处理功能当您需要处理大量文件时可以使用批量处理功能一次性完成多个文件的脱敏操作。系统支持混合文件类型处理统一应用相同的脱敏规则提高工作效率。自定义脱敏规则工具允许您根据实际需求自定义脱敏规则包括文本和图像两种类型。您可以选择不同的脱敏方式如替换为星号、模糊处理或自定义文本还可以调整脱敏强度。敏感信息类型设置系统内置了多种常见的敏感信息类型您可以根据需要启用或禁用特定类型的识别。每种类型都可以单独配置处理方式确保脱敏结果符合您的预期。 结构化数据处理从文件到数据库的完整流程DataInfra-RedactionEverything 不仅支持文档脱敏还提供了结构化数据处理能力帮助您将脱敏后的数据直接交付到数据库中。文件表导入您可以导入 CSV、Excel、JSONL 或 SQL 等格式的结构化文件系统会自动识别数据结构并进行脱敏处理。数据策略与字段复核在处理结构化数据时您可以设置数据策略对特定字段进行复核确保脱敏结果的准确性。系统提供了数据预览功能让您在保存前可以查看脱敏效果。库表交付脱敏完成后您可以将处理后的数据直接交付到数据库中支持多种数据库类型和交付模式满足不同的业务需求。 历史记录与管理工具会自动记录您的处理历史方便您随时查看、下载或对比脱敏结果。您可以通过搜索功能快速找到需要的记录提高工作效率。 更多资源官方文档docs/操作手册.md性能与质量白皮书docs/性能与质量白皮书.md项目源码backend/ 和 frontend/ 总结DataInfra-RedactionEverything 提供了一套完整的文档脱敏解决方案通过本地 LLM 和 VLM 模型在保护数据隐私的同时确保处理效率和准确性。无论是单个文件还是批量数据无论是文本还是图像都能轻松应对。现在就开始使用体验高效、安全的文档脱敏之旅吧要开始使用请克隆仓库git clone https://gitcode.com/gh_mirrors/da/DataInfra-RedactionEverything【免费下载链接】DataInfra-RedactionEverythingDataInfra Series. Redact EVERYTHING with local llms and vlms.项目地址: https://gitcode.com/gh_mirrors/da/DataInfra-RedactionEverything创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考