[{"data":1,"prerenderedAt":35},["ShallowReactive",2],{"blog-zh-private-pdf-tools-contracts-transcripts-local":3},{"slug":4,"locale":5,"title":6,"description":7,"date":8,"author":9,"tags":10,"keywords":15,"h1":16,"image":17,"imageAlt":18,"imageWidth":19,"imageHeight":20,"readingTime":21,"html":22,"recommendedTools":23,"faqs":34},"private-pdf-tools-contracts-transcripts-local","zh","PDF 本地处理：合同、成绩单怎么压缩和转换","合同、成绩单和报价单怎么在浏览器本地压缩、合并、拆页和转换？聊聊 DocCrunch 的实际用法，以及文字保留、扫描件 OCR 和数字签名需要注意的地方。","2026-09-09","DocCrunch Team",[11,12,13,14],"PDF 本地处理","PDF 压缩","PDF 合并","扫描件转 Word",[11,12,13,14],"合同和成绩单，我已经不太敢丢给“免费 PDF 网站”了","\u002Fblog\u002Fcompress-pdf-before-email-online\u002Fdoccrunch-pdf-compress-tool.png","DocCrunch PDF 压缩工具英文界面，显示三档设置及本地处理说明",1440,1100,7,"\u003Cp>PDF 这东西很怪。平时想不起来，一用就是急件：学校要电子版成绩单，客户要合并后的报价，财务说附件不能超过 10MB，对方又临时提出，扫描件最好能转成可以复制文字的 Word。\u003C\u002Fp>\n\u003Cp>赶时间的时候，最容易点进搜索结果里熟悉的网站。选文件、等进度、下载，几步就完事。用得顺手了，反而不太会想：这份带公章的文件传去了哪里？处理完之后，服务器上还留不留副本？\u003C\u002Fp>\n\u003Cp>我不是认定这些网站有问题。只是为了把文件缩小一点，就要把整份合同、地址和账号交出去，总觉得不太划算。现在碰到这类小事，我会先看看能不能在浏览器里处理。\u003C\u002Fp>\n\u003Ch2>先想清楚要改什么\u003C\u002Fh2>\n\u003Cp>多数时候，需要做的其实很具体：附件太重，就压缩；几份文件要一起交，就合并；只交其中几页，就拆分或删页。扫描方向不对，转过来；页序乱了，重新排一下。只有对方明确要求 Word、Excel 或 PPT 时，才需要转换。\u003C\u002Fp>\n\u003Cp>DocCrunch 把这些操作拆成了独立页面。我一般从 \u003Ca href=\"\u002Fzh\u002Fpdf-compress\u002F\">PDF 压缩\u003C\u002Fa> 或 \u003Ca href=\"\u002Fzh\u002Fpdf-merge\u002F\">PDF 合并\u003C\u002Fa> 进去，不必先注册账号，也不用为了删两页装一整套软件。\u003C\u002Fp>\n\u003Cp>压缩页一次最多选 10 个 PDF，单个小于 500MB，有清晰、均衡、极小三档。这是文件选择上限，不是说普通电脑同时处理十个接近 500MB 的文件也能轻松跑完。页数多、图片大，浏览器会吃内存，先拿一份试更稳妥。\u003C\u002Fp>\n\u003Ch2>压小了，还要确认文件能不能照常用\u003C\u002Fh2>\n\u003Cp>文字为主的 PDF 本来可能就不大，再压一遍未必能省多少。扫描件和图片很多的资料，通常更有压缩空间，但也得看原来已经压到什么程度。不能指望选了均衡档就一定跨过 10MB 的门槛。\u003C\u002Fp>\n\u003Cp>当前工具会比较结构优化和整页图片重建两种结果，选体积较小的一份；如果仍然不比原文件小，就保留原文件。这里有个容易忽略的地方：\u003Cstrong>如果最后采用的是图片重建版，原本能选中、搜索的文字可能就不再是文字了。\u003C\u002Fstrong> 链接、表单等功能也不能默认保留。\u003C\u002Fp>\n\u003Cp>所以压完我会看两件事：体积够不够小，文件还够不够用。放大检查小字和印章，需要复制文字就试着选一下，需要点击的链接也点一下。极小档如果把字边压糊了，就退回一档。原件另存，压缩版用来发送；印刷件、带数字签名的正式文件，不拿处理后的副本直接替代原件。\u003C\u002Fp>\n\u003Ch2>几份变一份，或者只留该交的页\u003C\u002Fh2>\n\u003Cp>\u003Ca href=\"\u002Fzh\u002Fpdf-merge\u002F\">PDF 合并\u003C\u002Fa> 按列表顺序拼接文件，可以用上移、下移按钮调整。报价正文、附件、补充说明，合之前排好，合完再翻一遍接缝处。\u003C\u002Fp>\n\u003Cp>\u003Ca href=\"\u002Fzh\u002Fpdf-split\u002F\">PDF 分割\u003C\u002Fa> 则把每一页输出成单独的 PDF，最后打成 ZIP。只想从一份长文件里去掉几页，直接用 \u003Ca href=\"\u002Fzh\u002Fpdf-remove-pages\u002F\">删除 PDF 页面\u003C\u002Fa> 往往更省事。扫描件倒着放，用 \u003Ca href=\"\u002Fzh\u002Fpdf-rotate\u002F\">PDF 旋转\u003C\u002Fa>；封面跑到最后，用 \u003Ca href=\"\u002Fzh\u002Fpdf-reorder\u002F\">PDF 页面重排\u003C\u002Fa>。\u003C\u002Fp>\n\u003Cp>删页是删整页，不是给页面上的账号、地址做涂黑脱敏。要隐藏某一页里的信息，需要另外做可靠的脱敏处理，不能把裁掉视野或盖个色块当作已经删除。\u003C\u002Fp>\n\u003Ch2>“转成 Word”和“转完就能交”隔着一段距离\u003C\u002Fh2>\n\u003Cp>先试试 PDF 里的字能不能选中。有文字层的文件，可以用 \u003Ca href=\"\u002Fzh\u002Fpdf-to-word\u002F\">PDF 转 Word\u003C\u002Fa> 或 \u003Ca href=\"\u002Fzh\u002Fpdf-to-excel\u002F\">PDF 转 Excel\u003C\u002Fa> 提取现有文字。当前实现会按页面和位置整理文本，不是完整复刻版式。多栏、跨行表格、复杂表头，都可能需要重新整理。\u003C\u002Fp>\n\u003Cp>纯扫描件要走另一条路。\u003Cstrong>当前 PDF 转 Word／Excel 不直接做 OCR。\u003C\u002Fstrong> 可以先用 \u003Ca href=\"\u002Fzh\u002Fpdf-to-image\u002F\">PDF 转图片\u003C\u002Fa> 导出需要的页面，再交给 \u003Ca href=\"\u002Fzh\u002Fimage-to-word\u002F\">图片转 Word\u003C\u002Fa> 或 \u003Ca href=\"\u002Fzh\u002Fimage-to-excel\u002F\">图片转 Excel\u003C\u002Fa> 识别。已经带有 OCR 文字层的扫描 PDF，则可以先试直接提取。\u003C\u002Fp>\n\u003Cp>印章压住字、纸张歪了、反光、复印件太灰，都会影响识别。金额、账号、姓名、日期，我会对着原件逐项检查。少敲一遍字已经省了时间，核对这一步省不了。\u003C\u002Fp>\n\u003Cp>\u003Ca href=\"\u002Fzh\u002Fpdf-to-ppt\u002F\">PDF 转 PPT\u003C\u002Fa> 也要先讲清楚：它把每页渲染成图片，再放进一张幻灯片。适合把讲义放到演示里翻页讲，但不会把标题、图表、正文拆成能分别编辑的对象。想重做演示稿，仍然要自己排版。\u003C\u002Fp>\n\u003Ch2>本地处理的好处很具体，边界也很具体\u003C\u002Fh2>\n\u003Cp>这些操作在自己的浏览器里完成，原文件和结果不需要上传到处理服务器。这是我处理合同、成绩单、客户资料时会优先考虑它的原因。\u003C\u002Fp>\n\u003Cp>但本地处理不等于完全不用网络。页面、脚本，以及 OCR 需要的识别资源，首次使用时仍可能下载。大文件会占内存，复杂加密文件可能打不开。要保留数字签名、交互表单、精确色彩或印刷要求时，还是该用能验证这些内容的专业工具。\u003C\u002Fp>\n\u003Cp>共享电脑、浏览器插件，以及处理完又把文件发到哪里，也是另外的事。它解决的是这一步不用交出原文件，不是替后面每一步兜底。\u003C\u002Fp>\n\u003Ch2>真用起来，不必记一长串功能\u003C\u002Fh2>\n\u003Cp>我会先留原件，再看对方到底要什么。只是附件超限，试压缩；只收一份，先合并；只要几页，就删掉不交的部分或拆页。如果还要提取文字，先从保留文字层的原件做，别等压成图片之后再绕回 OCR。\u003C\u002Fp>\n\u003Cp>手机拍的发票也能接上：用 \u003Ca href=\"\u002Fzh\u002Fimage-to-pdf\u002F\">图片转 PDF\u003C\u002Fa> 整成文档，再和已有的对账单合并。原始照片太大，可以先参考\u003Ca href=\"\u002Fzh\u002Fblog\u002Fphone-photos-too-large-local-browser-tools\u002F\">上一篇的本地图片处理方法\u003C\u002Fa>，但金额和小字要留清楚。\u003C\u002Fp>\n\u003Cp>这套工具适合的就是这些临时小活。不是每份文件都能靠浏览器解决，也不是每个在线服务都不值得信任。只是下次要处理带章的扫描件时，可以先停一下：我需要的究竟是云端引擎，还是把文件变小、少两页、提取几段文字？\u003C\u002Fp>\n\u003Cp>如果只是附件太大，从 \u003Ca href=\"\u002Fzh\u002Fpdf-compress\u002F\">PDF 压缩\u003C\u002Fa> 试一份就行。下载后打开检查，再发出去。\u003C\u002Fp>\n",[24,26,28,30,32],{"slug":25},"pdf-compress",{"slug":27},"pdf-merge",{"slug":29},"pdf-split",{"slug":31},"pdf-to-word",{"slug":33},"pdf-to-excel",[],1789443131158]