
Papermerge 安装指南30分钟部署你的免费开源扫描文档管理系统【免费下载链接】papermergeOpen Source Document Management System for Digital Archives (Scanned Documents)项目地址: https://gitcode.com/gh_mirrors/pa/papermerge一堆扫描的 PDF、TIFF 躺在硬盘里想查内容却搜不到Papermerge 是免费开源的文档管理系统自动对扫描件做 OCR、建索引支持全文检索。照本文操作用 Docker 三步完成 Papermerge 安装部署再配上目录结构和标签半小时就能把纸堆变成可搜索的数字档案。 项目速览先说清楚 Papermerge 能帮你干什么判断它适不适合你的场景。OCR 自动提取文字→ 扫描件变可搜索文本发票、合同里的关键字都能直接搜到全文检索→ 不需要记住文件名搜文档内容本身就能定位双面板浏览器 分层文件夹→ 接近桌面文件管理器的操作习惯拖拽即可整理标签、文档类型、自定义字段→ 给文档打颜色标签、按类型附加元数据分类不靠人脑记页面级管理→ 删除、拆分、重排 PDF 页面处理扫描杂页很方便格式支持 PDF、TIFF、JPEG、PNG核心用途是扫描文档的长期归档存储。 部署前检查部署前确认环境满足下表能省掉后面 90% 的报错。组件最低要求推荐配置Docker Docker Compose20.10最新稳定版内存2GB4GB 及以上磁盘空间5GB 可用20GB 及以上端口8000 未被占用—准备就一件事装好 Docker 和 Docker Compose确认 8000 端口空闲。Papermerge 的 Web 服务、数据库、OCR 工作进程全部跑在容器里宿主机不需要装 Python 环境。 部署流程整个部署分三个阶段拉代码、起容器、验证服务。全程不需要手动建库、建用户首次启动会自动完成。拉取代码获取部署所需的全部配置与编排文件git clone https://gitcode.com/gh_mirrors/pa/papermerge cd papermerge成功后当前目录下能看到docker/子目录里面是本次部署要用的编排文件 docker/docker-compose.yml。启动全部服务一条命令拉起 Web 服务、PostgreSQL、Redis 和 OCR worker 共 4 个容器docker-compose -f docker/docker-compose.yml up -d首次启动会先拉取镜像耐心等完。容器启动脚本会自动执行数据库迁移、收集静态文件并根据 docker/scripts/create_user.py 创建一个默认管理员账号不需要你手动跑 migrate 或 createsuperuser。验证部署结果检查 4 个服务是否都在运行docker-compose -f docker/docker-compose.yml ps成功标志app、db、redis、worker四个服务状态都是Up。如果app反复重启用docker-compose -f docker/docker-compose.yml logs app看日志定位。 首次进入系统浏览器打开http://localhost:8000用默认账号admin / admin登录——这就是刚才自动创建的管理员登录后第一件事是在偏好设置里改掉密码。登录后是双面板界面左侧列文件夹和文档右侧显示当前文档的预览、标签、类型和自定义字段。空库状态下先别慌界面本身会引导你建第一个文件夹。 上手路径拿到系统后建议按顺序做这三件事价值最快建文件夹骨架 标签。按年份 / 文档类型建两层文件夹如2026/发票、2026/合同再建几个常用颜色标签。后面上传的文档才有地方放、能被筛出来。拖入一批扫描件观察 OCR 过程。左侧面板支持拖拽批量上传上传后 worker 容器会异步做 OCR稍等片刻文档就出现在列表中且内容可搜索。用全文搜索验证。在顶部搜索框输入一份文档正文里的某个词能命中就说明 OCR 和索引链路全通了——这是判断部署是否真正成功的最终标准。️ 踩坑速查8000 端口被占用页面打不开→ 改 docker/docker-compose.yml 里app服务的端口映射为8080:8000之类再docker-compose -f docker/docker-compose.yml up -d重建容器。上传超过 20MB 的文件被拒→ Web 服务单次上传上限默认 20MB大文件先拆分或改启动脚本里的--limit-request-body参数。OCR 识别结果语言不对→ worker 镜像默认按德语识别已装 eng、deu、fra、spa、rus、ron 六种语言包。进 worker 容器把/opt/etc/papermerge.conf.py里的OCR_DEFAULT_LANGUAGE改成eng英文文档重启 worker 后重新处理文档。忘记管理员密码→ 命令行重置不用重装docker-compose -f docker/docker-compose.yml exec app python manage.py changepassword admin。迁移服务器后数据没了→ 文档本体在media_root卷、元数据在postgres_data7卷备份这两个具名卷即可完整迁移。 下一步基础跑通后这几个方向最值得折腾配置文档类型 自定义字段把发票号客户这类元数据结构化调用 OpenAPI 规范的 REST API把导入环节接进你自己的流程用页面管理功能拆分、重排杂乱的 PDF 扫描页开多用户账号按团队分配文档权限更多配置项OCR 语言、导入目录、元数据解析规则参考仓库根目录的 papermerge.conf.py.example版本演进看 changelog.md。到这里纸堆已经变成可搜索的数字档案——剩下要做的只是往里扔文档。【免费下载链接】papermergeOpen Source Document Management System for Digital Archives (Scanned Documents)项目地址: https://gitcode.com/gh_mirrors/pa/papermerge创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考