Bạn có vài tệp PDF — một hợp đồng đã ký chia thành nhiều trang, một bộ hóa đơn, một biểu mẫu đã quét — và bạn cần chúng thành một tệp. Bạn tìm "gộp PDF", nhấp vào một trang trông sạch sẽ, kéo tệp của bạn vào, và tải kết quả đã gộp về. Nó chạy được. Nhưng trong vài giây đó, tài liệu của bạn gần như chắc chắn đã được gửi tới máy chủ của một công ty và gộp ở đó. Hầu hết các trang không bao giờ nói to điều đó ra.
Với một tờ rơi công khai thì chẳng sao. Với những tài liệu người ta thường gộp — thỏa thuận lao động, tờ khai thuế, hồ sơ y tế, sao kê ngân hàng, một hộ chiếu chụp lại — thì đáng dừng lại một chút. Hướng dẫn này giải thích vì sao gộp trực tuyến thường nghĩa là tải lên, và cách tránh nó.
Vì sao "trực tuyến" gần như luôn nghĩa là "đã tải lên"

Từ trực tuyến giấu đi phần quan trọng. Trên một công cụ PDF thông thường, nhấp "gộp" chuyển các byte thô của mọi tệp qua internet tới máy chủ của nhà cung cấp. Máy chủ khâu chúng lại và gửi về một PDF. Bản gốc của bạn giờ nằm, ít nhất trong chốc lát, trên phần cứng bạn không kiểm soát.
Thiết kế đó tồn tại vì một lý do đơn giản: trong nhiều năm, máy chủ là thứ duy nhất có thể phân tích và viết lại một PDF. Trình duyệt thì không thể. Nên cả loại công cụ này lớn lên quanh việc tải lên, và thói quen bám lại ngay cả sau khi nó thôi cần thiết.
Các hệ quả thực dụng cũng chính là những cái áp dụng cho bất kỳ lần tải lên nào:
- Truyền đi qua mạng, nơi một kết nối yếu có thể bị chặn bắt.
- Lưu trữ, ít nhất tạm thời, trên các ổ đĩa của nhà cung cấp — đôi khi vài phút, đôi khi lâu hơn nhiều.
- Có khả năng bị ghi nhật ký hoặc lưu đệm, chi phối bởi một chính sách riêng tư mà gần như không ai đọc.
Không cái nào trong đó vốn dĩ nham hiểm. Nhưng bạn thường gộp đúng những tệp bạn ít muốn bị sao chép đi đâu nhất, và "chúng tôi xóa nó sau một giờ" là một lời hứa, không phải một cơ chế.
Phương án dựa trên trình duyệt

Các trình duyệt hiện đại đã thay đổi điều gì là khả thi. Dùng WebAssembly và các thư viện mã nguồn mở, một trình duyệt giờ có thể phân tích cấu trúc PDF thật, sao chép trang giữa các tài liệu, và viết ra một tệp mới — tất cả trên thiết bị của bạn. Không có bước tải lên vì không có máy chủ nào làm việc; chính CPU của bạn làm điều đó.
Đó là cách tiếp cận công cụ Gộp PDF của IMG.DIY áp dụng. Bạn thả tệp vào, nó liệt kê từng tệp với số trang và dung lượng, bạn đặt thứ tự bằng mũi tên lên/xuống và gỡ bất cứ thứ gì bạn thêm nhầm, rồi nó gộp và tải về một PDF duy nhất. Không gì rời khỏi máy của bạn. Không tài khoản, không giới hạn theo ngày, và một khi trang đã tải nó chạy với mạng tắt hoàn toàn.
Khác biệt là tức thì. Một lần gộp hai mươi trang không bò rề sau một thanh tải lên. Không có trần dung lượng tệp do máy chủ áp đặt. Và không có gì để rò rỉ, vì không có gì được truyền đi hay lưu trữ ngay từ đầu.
Nó làm gì và không làm gì
Thành thật về phạm vi là quan trọng. Công cụ này gộp cả tệp, theo thứ tự bạn đặt — nó nối chúng, từ trên xuống dưới. Nó chưa tách PDF, chưa xóa hay xoay từng trang, cũng chưa sắp lại thứ tự các trang bên trong một tệp. Việc sắp thứ tự là ở cấp tệp. Nếu thứ tự trang bên trong một tài liệu bị sai, hãy sửa tài liệu đó trước, rồi gộp.
Một điều cần lưu ý: một PDF bị khóa bằng mật khẩu mở (loại hỏi trước khi hiển thị) không đọc được trong trình duyệt — hãy gỡ mật khẩu trước, rồi gộp bản đã mở khóa. Các tệp có hạn chế chỉ dành cho chủ sở hữu thường vẫn gộp được.
Điểm mấu chốt
Trước khi bạn kéo một PDF riêng tư lên một trang bất kỳ, hãy hỏi một câu: cái này có cần rời khỏi thiết bị của tôi không? Với việc gộp, câu trả lời là không. Một công cụ dựa trên trình duyệt làm cùng công việc, nhanh hơn, và giữ tài liệu của bạn đúng nơi chúng thuộc về — với bạn.
