Tambah dan Edit Tautan
Buat alamat web di dalam dokumen jadi bisa diklik, atau cabut semua tautan keluarnya.
Alat ini berjalan sepenuhnya di browser Anda. Berkas Anda tidak pernah diunggah, dan Anda bisa membuktikannya sendiri di tab jaringan browser. Buktikan sendiri: buka tab jaringan di browser Anda dan perhatikan. Anda akan melihat satu permintaan kecil yang menanyakan sisa jatah - nama alat dan sebuah hash, bukan berkasnya.
Apa yang dilakukan alat ini
Alamat web yang tercetak di dalam PDF biasanya bukan tautan. Ia cuma teks yang bentuknya mirip tautan, karena program yang menghasilkan dokumen itu menulis huruf-hurufnya dan tidak pernah membuat anotasi yang membuatnya bisa diklik. Alat ini menemukan alamat semacam itu dan menjadikannya tautan sungguhan, membiarkan Anda menggambar tautan sendiri di atas apa pun, dan sanggup mencabut tautan yang sudah ada. Tautan adalah anotasi yang dihamparkan di atas sebuah persegi, jadi tampilan halaman tidak berubah sedikit pun ke arah mana pun.
Kasus paling sering adalah dokumen hasil ekspor dari perangkat lunak desain atau hasil scan dari cetakan, ketika semua alamat web di dalamnya jadi teks mati. Arah sebaliknya sama pentingnya: mencabut tautan keluar dari dokumen sebelum ia dikirim ke pihak yang belum tentu tepercaya, atau sebelum dipublikasikan, supaya tidak ada yang mengikuti alamat pelacak yang tadinya aman dipakai secara internal.
Cara kerjanya
- Jatuhkan PDF ke halaman ini.
- Biarkan pendeteksian otomatis aktif untuk putaran pertama. Setiap alamat web dan email yang ditemukan di dalam teks ditampilkan lengkap dengan nomor halamannya.
- Gambar persegi di atas apa pun yang juga perlu bisa diklik, lalu beri alamat web, atau nomor halaman kalau lompatannya di dalam dokumen ini sendiri.
- Nyalakan penggantian tautan lama kalau dokumen memang sudah membawa tautan dan Anda lebih suka mulai bersih.
- Tekan Simpan tautan, lalu unduh hasilnya.
Mendeteksi tautan lebih rumit daripada sekadar mencocokkan pola pada teks halaman, dan itu sebabnya kebanyakan alat yang menawarkannya melewatkan separuh tautan. PDF kerap memecah satu alamat menjadi beberapa potongan teks, sehingga pemindaian naif cuma menemukan https://con dan toh.com/laporan lalu tidak menautkan keduanya. Di sini potongan-potongan dalam satu baris disatukan dulu sebelum dicocokkan, sehingga alamatnya ditemukan utuh. Tanda baca di ujung kemudian dipangkas - titik yang mengakhiri kalimat, bukan titik di dalam nama domain - dan kurung tutup hanya dibuang kalau ia memang tidak berpasangan, sebab banyak alamat sungguhan berakhir dengan kurung tutup dan memotongnya justru menghasilkan tautan yang tidak menuju ke mana-mana.
Apa yang sengaja tidak ditautkan sama pentingnya dengan apa yang ditautkan. Nama host telanjang tanpa titik ditolak, karena dalam kalimat sehari-hari potongan seperti dsb dan yg jauh lebih sering muncul daripada http://localhost, dan tautan yang salah lebih merugikan daripada tautan yang tidak ada. Alamat yang diawali www. diberi https:// di depannya, sebab host telanjang bukan URI yang sah dan pembaca akan menampilkan anotasinya sebagai rusak. Alamat email menjadi tautan mailto:, dan alamat email yang berada di dalam sebuah URL tidak ditautkan dua kali.
Tautan ditulis tanpa garis tepi dan dengan penanda cetak dinyalakan. Yang pertama mencegah pembaca menggambar kotak hitam di sekeliling tiap tautan, ciri khas dokumen tahun sembilan puluhan itu; yang kedua menjaga tautannya tetap hidup ketika seseorang mencetak dokumen ini kembali menjadi PDF. Lompatan di dalam dokumen ditulis sebagai tujuan eksplisit yang mempertahankan perbesaran pembaca dan mendarat di puncak halaman tujuan, bukan sebagai tujuan bernama, yang langsung rusak begitu ada orang memisah atau menggabung berkasnya.
Menjalankan pendeteksian dua kali pada dokumen yang sama akan menambahkan anotasi kedua di atas kata yang sama, kecuali Anda menyalakan dulu penggantian tautan lama. Dua tautan yang bertumpuk berkelakuan tidak menentu - pembaca memilih mana pun yang lebih dulu ditemukannya - jadi nyalakan opsi itu untuk putaran kedua, dan biarkan mati kalau dokumen sudah membawa tautan buatan tangan yang ingin Anda pertahankan.
Mencabut tautan keluar adalah putaran tersendiri dan ia mengabaikan semua pengaturan lain: setiap tautan yang menuju alamat web dihapus sedangkan lompatan antar halaman dipertahankan, sehingga dokumen tetap punya navigasi internalnya dan kehilangan kemampuannya mengirim pembaca ke luar. Bersihkan PDF adalah versi yang lebih luas dari ini, yang sekalian membuang JavaScript, aksi peluncuran, dan berkas sisipan. Pendeteksian sendiri butuh teks dokumen, yang dibaca di browser Anda oleh PDF.js, sementara anotasinya ditulis pdf-lib di dalam Web Worker. Tidak ada satu pun alamat di dokumen Anda yang dibuka, ditelusuri, atau diperiksa ke mana pun - yang juga berarti tautan menuju halaman yang sudah tidak ada tetap ditulis persis seperti tercetak.
Yang tidak bisa dilakukan alat ini
- Pendeteksian hanya bisa menemukan apa yang ada di lapisan teks. Hasil scan tidak punya teks sampai dilewatkan OCR PDF, dan alamat yang terpotong ke baris berikutnya terbaca sebagai dua penggalan, sehingga tidak ada satu pun dari keduanya yang ditautkan.
Pertanyaan yang sering diajukan
- Kenapa alamat web di PDF saya tidak bisa diklik sejak awal?
- Karena tautan di dalam PDF berupa anotasi - sebuah persegi dengan aksi yang menempel padanya - dan bukan sifat dari teksnya. Word dan kebanyakan perangkat lunak desain membuatnya otomatis saat Anda menempelkan alamat, tetapi jalur ekspor tertentu menghilangkannya, dan hasil scan memang tidak pernah punya: yang ada cuma gambar dari sebuah alamat web. Pendeteksian otomatis membaca teksnya, menemukan alamatnya, lalu menuliskan anotasi yang hilang itu di atasnya.
- Bisakah saya menautkan satu halaman ke halaman lain di dokumen yang sama?
- Bisa. Gambar sebuah persegi lalu beri nomor halaman, bukan alamat web. Lompatannya ditulis sebagai tujuan eksplisit yang mempertahankan tingkat perbesaran pembaca dan mendarat di puncak halaman tujuan. Untuk membuat daftar isi utuh, Edit Bookmark biasanya pilihan yang lebih tepat - ia memberi pembaca panel di sisi jendela, bukan teks yang harus diklik satu per satu.
- Bagaimana cara menghapus tautan dari sebuah PDF?
- Ada dua cara dan keduanya berbeda hasilnya. Menyalakan penggantian tautan lama akan menghapus semua tautan sebelum yang baru ditulis, jadi kalau Anda tidak menambahkan apa-apa, semuanya bersih. Mencabut tautan keluar hanya membuang yang menuju web dan membiarkan lompatan antar halaman tetap utuh - dan itulah yang biasanya Anda inginkan untuk dokumen yang akan keluar dari organisasi.
- Sebagian alamat saya cuma terdeteksi separuh. Ada apa?
- Hampir selalu karena pergantian baris. Pendeteksi menyatukan potongan teks di dalam satu baris sebelum mencocokkan, jadi alamat yang terpecah menjadi beberapa potongan pada satu baris tetap ditemukan utuh - tetapi alamat yang membungkus ke baris berikutnya datang sebagai dua penggalan dan tidak satu pun tampak seperti alamat kalau berdiri sendiri. Gambar yang seperti itu dengan tangan: satu persegi untuk tiap baris, keduanya diberi alamat yang sama.
- Apakah tautannya diperiksa atau dikirim ke suatu tempat?
- Dua-duanya tidak. Tidak ada alamat yang dibuka, diambil, atau divalidasi, dan dokumennya juga tidak pernah diunggah - baik pengambilan teks maupun penulisan anotasi berlangsung di browser Anda. Konsekuensinya, salah ketik pada alamat yang tercetak akan menjadi tautan dengan salah ketik yang sama, jadi periksa sendiri daftar tautan yang tampak jelas keliru sebelum Anda menyimpannya.