Memisahkan PDF adalah salah satu tugas penanganan dokumen yang paling umum, dan pendekatan yang tepat bergantung pada apakah Anda menginginkan satu subkumpulan halaman, semua halaman sebagai file terpisah, atau beberapa grup bernama. Alat ini mengimplementasikan ketiga mode (Ekstrak Halaman, Pisahkan Semua, Pisahkan berdasarkan Rentang) seluruhnya di browser menggunakan pdf-lib, yang berarti file Anda tidak pernah meninggalkan perangkat Anda. Bagian di bawah ini menjelaskan kapan harus menggunakan setiap mode, cara menangani kasus edge seperti PDF yang dilindungi kata sandi, dan bagaimana pendekatan berbasis browser dibandingkan dengan layanan cloud untuk dokumen sensitif privasi.
Ekstrak Halaman vs Pisahkan Semua vs Pisahkan berdasarkan Rentang
Ketiga mode tersebut menangani berbagai tugas pemisahan di dunia nyata, dan memilih mode yang tepat akan membuat alur kerja lebih cepat. Ekstrak Halaman adalah untuk mengeluarkan subset tertentu: Anda ingin halaman 1-3, 5, dan 7-9 dari dokumen yang lebih besar sebagai satu PDF baru. Ini adalah mode yang tepat untuk mengambil satu bab dari sebuah buku, satu bagian dari laporan, atau beberapa halaman tanda tangan dari sebuah kontrak. Outputnya adalah satu PDF dengan halaman yang diminta dalam urutan aslinya. Split All adalah untuk memecah setiap halaman menjadi filenya sendiri: berguna ketika satu PDF yang dipindai sebenarnya berisi banyak dokumen yang terpisah secara logis (misalnya, 25 formulir pajak yang dipindai yang kebetulan berada dalam satu file multi-halaman). Outputnya adalah ZIP dengan satu halaman PDF per halaman sumber. Dibagi berdasarkan Rentang adalah jalan tengahnya: Anda ingin membagi menjadi beberapa grup bernama, di mana setiap grup dapat berisi beberapa halaman. Kasus penggunaan yang umum adalah laporan 200 halaman yang perlu dikirimkan sebagai 8 bab PDF — Anda menentukan rentang seperti "Bab 1: 1-24, Bab 2: 25-48, ..." dan mendapatkan 8 PDF bernama dalam ZIP. Sebagian besar alat hanya mengimplementasikan dua mode pertama, namun Split by Ranges adalah yang paling praktis untuk alur kerja pengorganisasian dokumen yang file sumbernya memiliki pengelompokan logis alami.
Privasi dan Mengapa Pemisahan Berbasis Browser Itu Penting
Sebagian besar layanan pemisahan PDF online mengunggah file Anda ke server mereka, melakukan pemisahan di sana, dan mengirimkan hasilnya kembali. Alur kerja ini memiliki tiga masalah bagi siapa pun yang menangani dokumen sensitif: file menyentuh server yang tidak Anda kendalikan (artinya praktik keamanan operator dan praktik keamanan penyedia cloud keduanya memengaruhi data Anda); file biasanya disimpan di penyimpanan server tersebut selama 24 jam atau lebih sesuai kebijakan penyimpanan operator sebelum dihapus; dan pelanggaran keamanan apa pun pada layanan akan mengekspos file Anda secara surut. Untuk kontrak, rekam medis, pengembalian pajak, dokumen hukum, dokumen karyawan, atau apa pun yang tunduk pada kewajiban kerahasiaan, model unggahan cloud ini benar-benar berisiko. Alat ini menggunakan pdf-lib untuk melakukan seluruh pemisahan secara lokal di memori browser Anda — PDF Anda dibaca ke dalam RAM, dimanipulasi di sana, dan hasilnya dikumpulkan dalam RAM sebelum tombol Unduh menulisnya ke disk lokal Anda. Tidak ada yang diunggah di mana pun. Anda dapat memverifikasi ini dengan memutuskan sambungan dari internet setelah halaman alat dimuat: alat terus bekerja dengan sempurna karena tidak memiliki ketergantungan jaringan di luar pemuatan halaman awal. Untuk dokumen sensitif apa pun, alur kerja khusus lokal ini adalah pilihan yang tepat.
Menangani Kasus Edge dan Kesalahan Umum
Beberapa kasus ekstrem cukup sering muncul sehingga memerlukan panduan khusus. PDF yang dilindungi kata sandi tidak dapat dibaca oleh pdf-lib atau perpustakaan PDF berbasis browser apa pun, karena enkripsi memerlukan kata sandi untuk mendekripsi. Anda harus membuka kunci PDF terlebih dahulu menggunakan Adobe Acrobat, Pratinjau di macOS, atau alat penghapus kata sandi khusus; setelah dibuka kuncinya, versi yang didekripsi berfungsi dengan baik di sini. File yang sangat besar (100+ MB) mungkin memerlukan waktu yang cukup lama untuk dimuat dan dipecah — ini terikat pada memori, bukan terikat pada CPU, sehingga perangkat dengan RAM yang lebih besar memiliki kinerja yang lebih baik. PDF yang rusak gagal dibuka dengan pesan kesalahan yang jelas; tidak ada langkah pemulihan dalam alat ini, jadi Anda perlu menggunakan utilitas perbaikan PDF pada sumbernya sebelum memisahkan. Satu kesalahan umum: jumlah halaman mode Ekstrak relatif terhadap dokumen asli, bukan subset mana pun. Jika sumber Anda memiliki halaman 1-100 dan Anda mengekstrak halaman 10-20, PDF keluaran memiliki halaman bernomor 1-11 — bukan 10-20 seperti nomor aslinya. Jika penomoran halaman asli penting untuk penggunaan hilir (misalnya, kutipan resmi yang merujuk pada nomor halaman tertentu), ingatlah untuk memberi anotasi pada pemetaan tersebut sebelum membagikan ekstraknya. Terakhir: pemisahan tidak mengkodekan ulang konten, sehingga gambar, font, kolom formulir, dan grafik vektor dipertahankan sedikit demi sedikit dari sumbernya.