在浏览器中合并PDF:你的文件到底去了哪里

在线合并PDF时,文件到底去了哪里?
把两个PDF拖进在线合并工具,按下按钮后,很容易想象文件飞到了某台你看不见的服务器。对于桌面端常见的PDF和图片合并,这种想象并不正确。遇到已签署的合同或身份证扫描件时,这个差别尤其重要。
Batch Printer的合并工具在常见使用场景下不会上传任何内容。这篇文章会按步骤说明工具实际做了什么:哪些操作在你自己的机器上完成,服务器真正参与的两个时刻,以及在添加文件之前如何判断文件会走哪条路径。
“上传后合并”背后的默认想法
大多数PDF合并页面会先接收你的文件,再放到自己的服务器上处理。对Web应用来说,这是一种合理的默认方式,但也意味着每份文档的每一页都会被复制到一台你无法控制的机器上。如果只是随手丢弃的草稿,没人会在意。可一旦文件里有姓名、签名或账号,上传这一步就是主要风险,而标准合并时这个工具跳过的正是这一步。
合并PDF时,你的设备上发生了什么
在笔记本上打开 /tools/pdf/merge 合并工具,添加两个或更多PDF后,合并会在浏览器标签页内完成。工具用pdf-lib库加载每个PDF,按屏幕上显示的顺序复制每一页,然后写出一个名为batch-printer-merge.pdf的新PDF。为了完成这件事,任何页面都不会被发送到别处。合并后的文件在内存中组装好,然后直接交给你下载。
- 每个源PDF会以原始字节读入内存,不会上传。
- 页面会按照你在屏幕上看到的顺序,一页一页复制到新文档中。
- 完成后的文件会在本地保存为batch-printer-merge.pdf。
- 关闭标签页后,一切都会清除,没有需要删除的服务器副本。
图片如何变成一页
照片和扫描件走的是同一条本地路径,只是多了一步。JPG会直接放到PDF页面上;PNG会通过自己的路径嵌入;WebP或GIF这类格式会先绘制到隐藏画布上,再转换成PNG数据。每张图片都会变成且只变成一页,尺寸按图片自身的像素大小来定。所以一张竖长的手机照片和一张横向扫描件,可能在同一个文件里呈现出很不一样的页面形状。
服务器会参与的两个时刻
只有两种情况会打破纯浏览器处理的规则,而且都值得知道。Office文件,Word、Excel、PowerPoint、HWP,不能在浏览器里合并,所以需要先发送到Batch Printer的转换服务器变成PDF,这项功能属于付费方案。手机和平板也会把整个任务交给服务器,因为移动浏览器不擅长处理大型内存合并。如果桌面浏览器读不了损坏的PDF,它还会把那个文件转到服务器上重试,作为备用路径。
- 你添加了必须先转换的Office文档(.docx, .xlsx, .pptx, .hwp)。
- 你是在手机或平板上合并,而不是桌面设备。
- PDF损坏到浏览器无法解析,只能退回到服务器处理。
如何判断文件会走哪条路径
预测路径不需要读代码。文件类型和设备会决定结果。笔记本上的一组敏感PDF和照片会全部留在本地。只要加入一个Word文件,那个文件就会前往转换服务器,旁边的PDF则不会。
- 桌面设备加上只有PDF和图片 → 完全在浏览器中处理。
- 文件组里有任何Office文件 → 该文件会先在服务器上转换。
- 手机或平板 → 整个合并在服务器上运行。
- 想让所有内容都留在本地?先自己把Office文件转换成PDF,再在桌面端合并。
开始前值得知道的限制
浏览器的空间不如服务器充裕,所以工具设置了实用上限。上传器一次最多接收20个文件,至少添加2个文件后合并按钮才会启用。访客单次合并总量最高为100MB,登录后上限提高到1GB。如果文件组更大,可以分两次合并,再把两个结果合并起来。
- 上传器每次合并最多20个文件。
- 至少添加2个文件后,合并按钮才会启用。
- 访客总量为100MB;登录后总量为1GB。
- 合并Office文件需要付费方案;普通PDF和图片合并不需要。
关于浏览器端合并的常见问题
- 在这里合并PDF会上传文件吗? 在桌面设备上,不会。标准PDF和图片合并会在浏览器中运行。
- 为什么要求我登录? 可能是总量超过100MB,或者你添加了需要付费方案的Office文件。
- 我可以在手机上合并吗? 可以,但移动端会把合并交给服务器,而不是浏览器。
- 页面顺序有保证吗? 页面会严格按照合并前屏幕上从上到下的顺序排列,所以请先排好顺序。