Sensor PDF
Hapus teks dan gambar untuk selamanya, bukan sekadar menutupinya.
Alat ini berjalan sepenuhnya di browser Anda. Berkas Anda tidak pernah diunggah, dan Anda bisa membuktikannya sendiri di tab jaringan browser. Buktikan sendiri: buka tab jaringan di browser Anda dan perhatikan. Anda akan melihat satu permintaan kecil yang menanyakan sisa jatah - nama alat dan sebuah hash, bukan berkasnya.
Apa yang dilakukan alat ini
Menyensor di sini berarti membuang isinya, bukan menutupinya. Setiap halaman yang membawa sensor disusun ulang dari piksel: kotaknya digambar masuk ke halaman, halamannya dirender pada resolusi yang Anda pilih, lalu hasil render itu menjadi halaman yang baru. Aliran isi aslinya dibuang, bukan disunting, jadi tidak ada apa pun di baliknya yang bisa diseleksi, disalin, atau dicari. Halaman yang tidak disensor disalin lewat begitu saja.
Setiap kali sebuah dokumen harus keluar dengan sebagian isinya dihilangkan: nama di berkas perkara, angka gaji di paparan direksi, nomor rekening di sebuah faktur, data pasien di rekam medis, atau catatan internal di kontrak yang akan dikirim ke pihak lawan.
Cara kerjanya
- Jatuhkan PDF ke halaman ini lalu gambar kotak di atas apa pun yang harus hilang. Tiap kotak adalah satu sensor.
- Tambahkan sebuah frasa di cari dan sensor untuk menjaring setiap kemunculan sebuah nama atau nomor di mana pun ia berada, alih-alih memburunya halaman demi halaman.
- Atur resolusi halaman yang disusun ulang. 200 dpi enak dibaca di layar dan masih layak dicetak; 300 lebih baik untuk cetak dan menghasilkan berkas yang lebih besar.
- Biarkan pertahankan dokumen bisa dicari tetap aktif kecuali Anda punya alasan sebaliknya, dan biarkan hapus metadata tetap aktif juga - properti dokumen kerap menyimpan justru nama yang baru saja Anda buang dari halaman.
- Tekan Sensor, lalu buka hasilnya dan coba seleksi teks yang tersensor. Tidak akan ada apa-apa di sana.
Menggambar persegi hitam di atas teks bukan menyensor, dan kekeliruan itu sudah membocorkan berkas perkara, rekam medis, dan dokumen pemerintah berulang kali selama dua puluh tahun. Persegi itu hanyalah instruksi menggambar yang ditambahkan di atas; teks di bawahnya masih duduk di aliran isi halaman, tempat siapa pun bisa menyeleksinya, menyalinnya, atau mencabutnya dengan skrip dua baris. Memotong halaman pun sama saja.
Menyusun ulang dari piksel adalah satu-satunya pendekatan yang sungguh aman yang bisa dilakukan sebuah browser, dan ia sengaja dibuat tumpul. Kotaknya digambar ke dalam dokumen lebih dulu, baru halamannya dirender - bukan sebaliknya - supaya tidak ada pembulatan di ruang raster yang menyisakan sesabit piksel isi asli di tepi kotaknya. Tidak ada bagian bawahnya, karena bagian bawahnya sudah dibuang.
Kehilangan kemampuan mencari akan terasa mahal, jadi teks yang selamat dikembalikan. Lapisan teksnya diambil sebelum apa pun digambar, tiap penggal yang jatuh di dalam kotak sensor dibuang, dan sisanya digambar ulang secara tak terlihat di atas gambarnya. Dokumennya tetap bisa dicari dan kata-kata yang disensor benar-benar tidak ada lagi - gabungan yang orang kira didapat dari blok hitam padahal hampir tidak pernah.
Ongkosnya adalah ukuran dan ketajaman pada halaman yang Anda sentuh. Halaman vektor yang berubah menjadi JPEG 200 dpi biasanya beberapa kali lebih besar, dan tautan, isian formulir, serta anotasi di halaman itu tidak selamat dari penyusunan ulangnya - karena itulah hanya halaman yang terdampak yang disusun ulang. Periksa hasilnya, jangan sekadar percaya: cari kata yang Anda buang, lalu seleksi melintasi kotaknya dan tempelkan ke tempat lain.
Yang tidak bisa dilakukan alat ini
- Halaman yang memuat sensor diganti gambar pada resolusi yang Anda pilih, jadi ia membesar, tidak lagi tajam saat diperbesar, dan kehilangan tautan, isian formulir, atau anotasi yang dibawanya.
- Cari dan sensor mencocokkan teks di dalam satu penggal, jadi frasa yang terpotong pindah baris atau berganti huruf bisa terlewat. Baca dulu hasilnya sebelum Anda mengirimkannya.
- Dokumen hasil pindai tidak punya lapisan teks, jadi cari dan sensor tidak punya apa pun untuk digeledah. Gambar sendiri kotaknya, atau jalankan OCR PDF dulu.
- Sensor membuang apa yang ada di halaman. Isi di bagian lain berkasnya - lampiran, judul bookmark, catatan XMP tertanam - adalah urusan tersendiri; penghapusan metadata ditawarkan di sini, dan Bersihkan PDF melangkah lebih jauh.
Pertanyaan yang sering diajukan
- Ini sensor sungguhan atau cuma kotak hitam?
- Sungguhan. Halaman yang Anda sensor dirender menjadi gambar dengan kotaknya sudah tercat di dalamnya, lalu gambar itu menggantikan halamannya, sehingga objek teks aslinya sama sekali tidak ada di berkas keluaran. Persegi hitam yang digambar di atas teks meninggalkan teksnya duduk di bawah sana, dan begitulah kegagalan sensor berakhir jadi berita.
- Bagaimana saya bisa yakin teksnya benar-benar hilang?
- Buktikan sendiri, dengan dua cara yang cuma butuh beberapa detik. Buka keluarannya lalu cari kata yang tersensor: seharusnya tidak ada satu pun kecocokan. Setelah itu seleksi melintasi area yang tersensor, salin, dan tempelkan ke penyunting teks: seharusnya tidak ada apa pun yang datang.
- Bisakah ia menyensor setiap kemunculan sebuah nama?
- Bisa. Ketik frasanya di cari dan sensor, dan setiap penggal teks yang cocok akan dikotaki, di seluruh dokumen atau di dalam rentang halaman yang Anda tentukan. Pencocokannya mengabaikan besar kecil huruf, dan tersedia ekspresi reguler untuk pola seperti nomor rekening. Karena pencocokan bekerja per penggal, frasa yang terbelah pergantian baris bisa terlewat.
- Kenapa berkas saya jadi lebih besar?
- Karena halaman yang tersensor kini berupa gambar. Halaman berisi teks vektor itu ringkas; halaman yang sama sebagai JPEG 200 dpi biasanya beberapa kali lebih besar. Hanya halaman yang membawa sensor yang diubah, jadi dampaknya sebanding dengan seberapa banyak yang Anda sensor. Menurunkannya ke 150 dpi cukup membantu.
- Apakah properti dokumennya ikut dibersihkan?
- Ya, secara bawaan. Metadata rutin menyimpan nama penulis, jalur berkas aslinya, dan perangkat lunak yang membuatnya - kadang persis nama yang baru saja Anda buang dari halaman. Sakelarnya bisa dimatikan kalau propertinya memang harus tetap utuh.
- Apakah berkasnya diunggah untuk disensor?
- Tidak, dan untuk alat ini justru di situlah seluruh argumennya. Dokumen yang Anda sensor menurut definisinya berisi sesuatu yang sensitif, dan mengirimkannya ke server supaya bagian sensitifnya dibuang jelas terbalik. Perenderan, penutupan, dan penulisan ulangnya semua berjalan di Web Worker di browser Anda.