SnapOtter PDF工具箱:合并、拆分、OCR、电子签名,34个必会操作详解
【免费下载链接】SnapOtterOpen-source, self-hosted file-processing tool. Convert, compress, OCR, transcribe & run local AI across image, video, audio, PDF & documents, via UI, REST API & pipelines. Your files never leave your network.项目地址: https://gitcode.com/gh_mirrors/st/SnapOtter
SnapOtter 是一个开源、自托管的PDF 工具箱与文件处理平台,一个 Docker 命令即可部署,内置34 个 PDF 操作:合并、拆分、压缩、OCR 文字识别、电子签名、加水印、加密保护、格式互转等等。最关键的一点是——你的文件永远不会离开自己的服务器,无需上传到任何第三方 SaaS,隐私完全可控 🦦
为什么需要自托管 PDF 工具箱?
日常处理 PDF 时,你可能遇到过这些烦恼:
- 在线网站免费额度有限,文件隐私没有保障
- 每次都要复制、粘贴、上传、下载,效率低下
- 扫描件无法搜索文字、无法批量处理
SnapOtter 把CloudConvert、SmallPDF、TinyPNG等在线服务的功能搬到了你自己的硬件上。它覆盖图像、视频、音频、PDF、文档五大模态共 200+ 工具,其中 PDF 领域提供完整的 34 个操作,且所有处理都在本地完成。
一分钟部署:Docker 一键安装
部署只需一条命令:
docker run -d --name SnapOtter -p 1349:1349 -v SnapOtter-data:/data snapotter/snapotter:latest然后打开http://localhost:1349,使用默认账号admin/admin登录(首次登录会要求修改密码)。生产环境推荐三容器 Compose 方案(应用 + Postgres 17 + Redis 8),完整配置示例见 README.md 和 docker-compose.yml。
34 个 PDF 操作全清单
按使用场景分组如下,所有工具的源码都在 apps/api/src/routes/tools/ 目录下:
📑 页面操作(合并/拆分/整理)
| 操作 | 说明 | 源码文件 |
|---|---|---|
| 合并 PDF | 多文件拖拽排序后合并 | merge-pdf.ts |
| 拆分 PDF | 按范围拆成多个文件 | split-pdf.ts |
| 提取页面 | 抽取指定页码 | extract-pages.ts |
| 删除页面 | 移除不需要的页 | remove-pages.ts |
| 整理 PDF | 页面重排、旋转 | organize-pdf.ts |
| 旋转 / 裁剪 | 整页旋转、页面裁剪 | rotate-pdf.ts、crop-pdf.ts |
🎯 压缩与格式转换
| 操作 | 说明 |
|---|---|
| 压缩 PDF | 降低体积,适合邮件发送 |
| PDF 转 JPG / PNG / TIFF | 逐页导出图片 |
| Word / Excel / PPT / HTML / Markdown 转 PDF | 办公文档一键变 PDF |
| PDF 转 Word / 纯文本 | 反向提取,方便编辑 |
| PDF/A 转换 | 生成适合长期存档的标准格式 |
🔐 安全与隐私
| 操作 | 说明 |
|---|---|
| 加密保护 | 设置打开/打印密码 |
| 解锁 PDF | 移除密码保护 |
| 敏感信息涂黑 | 真正擦除文字,而非覆盖 |
| 移除/编辑元数据 | 清除作者、设备等隐私信息 |
| 扁平化 PDF | 固化表单与批注 |
✍️ 签名与标注
| 操作 | 说明 |
|---|---|
| 电子签名 | 拖拽签名到任意位置 |
| 加水印 | 文字或图片水印,支持"机密"样式 |
| 添加页码 | 页眉/页脚自动编号 |
| N-Up 拼版 | 一页拼 2/4/6/9 页,节省纸张 |
| 小册子模式 | 自动生成双面印刷折页 |
四大核心操作详解
合并 PDF:拖拽排序,一步搞定
把多个 PDF 拖入工具页,直接拖动卡片调整顺序,点击合并即可输出单个文件。底层由 pdfcpu 等本地二进制驱动,无需任何在线服务。
拆分 PDF:按范围灵活提取
支持"每 N 页拆一个文件""提取第 3-10 页"等多种模式,处理合同、扫描书籍时特别好用。
PDF OCR:让扫描件可搜索
OCR 工具(ocr-pdf.ts)会为扫描版 PDF 添加不可见的文字层,原外观不变,但从此可以搜索、复制文字。官方镜像内置 Fast OCR 运行时(约 25 MiB),高精度模型包可按需安装,配置参考 ocr-runtime-models.json。
PDF 电子签名:合同不再需要打印
上传签名图片或直接绘制签名,拖拽到目标页面即可。整个流程在本地完成,签过的合同不用上传任何网站,这是自托管方案最大的价值之一。
进阶玩法:批量处理与管道自动化
- 批量模式:一次处理多个文件,发布版批量数量无上限
- 管道(Pipelines):把"OCR → 加水印 → 压缩"等工具串成 20 步工作流,支持 JSON 导入导出,重复性工作流一次配置永久复用
- REST API:每个工具都可通过 API 调用,使用 API Key 认证,交互式文档在
/api/docs,便于接入自己的业务系统
工具注册与开关逻辑见 tools/index.ts,API 结构可参考 openapi.yaml。
常见问题
需要联网吗?不需要。除模型下载外,所有处理均在本地完成,支持离线使用。
支持树莓派/Apple Silicon 吗?支持。镜像提供 AMD64 与 ARM64 双架构,可直接运行在树莓派上。
界面支持中文吗?支持,内置 21 种语言界面,含简体中文、繁体中文与阿拉伯语 RTL 布局。
免费吗?核心功能基于 AGPLv3 完全免费开源,商用授权为可选。
总结
如果你想要一个不上传文件、不限次数、可批量自动化的 PDF 工具箱,SnapOtter 的 34 个 PDF 操作(合并、拆分、压缩、OCR、电子签名、加密、水印等)配合 Docker 一键部署,足以替代多个在线 PDF 网站。更多操作指引可参考官方文档 apps/docs/zh-CN/guide/getting-started.md,各语言部署细节见 apps/docs/ 目录。
【免费下载链接】SnapOtterOpen-source, self-hosted file-processing tool. Convert, compress, OCR, transcribe & run local AI across image, video, audio, PDF & documents, via UI, REST API & pipelines. Your files never leave your network.项目地址: https://gitcode.com/gh_mirrors/st/SnapOtter
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考