Cara mengubah PDF menjadi teks
- Masukkan PDF Anda. Letakkan file ke kotak di atas, atau ketuk kotak untuk memilihnya.
- Tentukan halamannya. Biarkan Semua halaman, atau ketuk Pilih halaman dan ketik halaman yang Anda perlukan, misalnya 1-3, 5 atau 8-.
- Tandai pergantian halaman bila perlu. Aktifkan Tandai awal setiap halaman untuk menambahkan baris seperti ----- Halaman 3 ----- di depan setiap halaman.
- Tekan Ambil teks. Bilah progres menunjukkan halaman yang sedang dibaca.
- Salin atau simpan. Tekan Salin untuk menempelkan teks di aplikasi lain, atau Unduh .txt untuk menyimpannya sebagai file teks UTF-8.
Fitur
- Hasil yang enak dibaca. Kata-kata disusun kembali menjadi baris, dan baris kosong ditambahkan di antara paragraf serta di antara halaman.
- Halaman dua kolom dibaca per kolom, tidak dicampur baris demi baris. Judul yang membentang di atas kedua kolom tetap di tempatnya.
- Tabel tetap terpisah. Jarak lebar di dalam satu baris menjadi tab, sehingga baris tabel rapi saat ditempel ke spreadsheet.
- Rentang halaman, termasuk rentang terbuka seperti 8- untuk halaman 8 sampai akhir.
- Penanda halaman opsional yang bisa dinyalakan atau dimatikan setelah teks diambil, tanpa membaca ulang file.
- Jumlah karakter, kata, dan halaman tampil di atas kotak teks.
- Deteksi halaman hasil scan. Halaman tanpa lapisan teks disebutkan nomornya, jadi Anda tahu halaman mana yang perlu OCR.
- Dukungan teks kanan ke kiri untuk bahasa Arab, Urdu, Persia, dan Ibrani.
Mengapa mengambil teks PDF dengan Fileora
Menyalin teks langsung dari aplikasi pembaca PDF sering merepotkan. Blok seleksi melompat ke kolom sebelah, baris terpotong di tengah kalimat, dan di HP hampir mustahil memilih lebih dari satu paragraf. Dengan mengambil seluruh teks sekaligus, Anda mendapat bahan yang bersih untuk dikutip, diterjemahkan, dicari, diringkas, atau dipakai ulang, misalnya saat menyusun skripsi dari jurnal, menyalin pasal dari peraturan, atau memindahkan isi laporan ke dokumen baru.
Fileora membaca PDF di browser Anda, sehingga kontrak, rekening koran, dan soal ujian tidak pernah keluar dari perangkat. Tidak perlu daftar akun, tidak ada watermark, dan tidak ada batas halaman. Alatnya bekerja sama baiknya di HP maupun laptop. Setelah teks didapat, tempelkan ke penghitung kata untuk mengecek panjang tulisan dan perkiraan waktu bacanya.
Kalau teksnya tidak keluar
Sebuah PDF bisa terlihat seperti teks di layar padahal isinya hanya gambar. Hasil scan dari HP, faks, dan fotokopi yang disimpan sebagai PDF termasuk jenis ini. Jika tidak ada satu halaman pun yang berisi teks, alat ini memberi tahu Anda. Jika hanya sebagian halaman yang hasil scan, nomor halamannya disebutkan. Untuk membaca halaman seperti itu, ubah dulu dengan PDF ke JPG, lalu proses gambarnya dengan Gambar ke Teks (OCR).
Jika muncul permintaan kata sandi, berarti PDF tersebut terenkripsi. Buka dengan Buka Kunci PDF memakai kata sandi yang Anda ketahui, lalu coba lagi.
Ada juga PDF yang memakai font tanpa peta karakter yang benar. Teksnya tampak normal di layar, tetapi saat diambil berubah menjadi simbol aneh atau tidak muncul sama sekali. Karakter seperti itu tidak bisa dipulihkan dari file-nya, jadi OCR adalah jalan keluarnya.
Yang perlu Anda ketahui tentang hasilnya
Hasilnya berupa teks polos, jadi huruf tebal, miring, warna, tautan, dan gambar tidak ikut. Header, footer, dan nomor halaman termasuk bagian dari teks halaman, sehingga ikut muncul di hasil. Kata yang dipenggal dengan tanda hubung di akhir baris tetap terpenggal. Tata letak yang rumit, seperti halaman majalah dengan kotak teks dan keterangan foto yang tersebar, bisa keluar dengan urutan tak terduga, karena urutan baca disusun ulang dari posisi kata di halaman.