Cara mengubah gambar menjadi teks
- Tambahkan gambar Anda. Letakkan file JPG, PNG, WebP, BMP, atau GIF ke kotak, ketuk untuk memilihnya, atau salin tangkapan layar lalu tempel dengan Ctrl+V (⌘+V di Mac).
- Pilih bahasa teks. Di bagian Bahasa teks, Bahasa Indonesia sudah terpilih. Ketuk bahasa lain yang juga ada di gambar, misalnya English, Español, Português, atau Urdu (tertulis dalam aksara Urdu). Pilih lebih dari satu untuk teks campuran.
- Tekan Ambil teks. Bilah progres menunjukkan mesin yang sedang dimuat dan gambar yang sedang dibaca. Anda bisa menekan Hentikan kapan saja.
- Periksa dan perbaiki hasilnya. Teks muncul di kotak Teks yang diambil yang bisa diedit. Perbaiki kata yang salah terbaca langsung di sana.
- Salin atau unduh. Tekan Salin untuk memindahkan teks ke papan klip, atau Unduh .txt untuk menyimpannya sebagai file teks biasa.
Fitur
- Lima bahasa, sesuai bahasa situs ini, dan kombinasi apa pun untuk gambar berisi beberapa bahasa.
- Pembacaan massal: tambahkan beberapa gambar dan dapatkan semua teksnya di satu tempat, masing-masing di bawah nama filenya.
- Tempel dari papan klip: ambil tangkapan layar dan langsung tempel, tanpa perlu menyimpannya dulu.
- Hasil yang bisa diedit, dengan tombol salin sekali ketuk dan unduhan teks biasa.
- Tampilan kanan ke kiri untuk Urdu, jadi teks Urdu hasil pembacaan tampil dengan arah yang benar.
- Persiapan gambar otomatis: gambar kecil seperti potongan tangkapan layar diperbesar sebelum dibaca agar teks kecil lebih mudah dikenali, dan PNG transparan diberi latar putih supaya teks gelap tidak hilang.
- Tombol Hentikan untuk antrean panjang, dengan teks yang sudah terbaca tetap disimpan.
Mengapa mengambil teks dari gambar dengan Fileora
Sebagian besar layanan OCR online mengunggah gambar Anda ke server lalu membacanya di sana. Itu kurang cocok untuk hal-hal yang paling sering perlu disalin teksnya: foto KTP dan KK, surat dari bank, struk belanja, hasil laboratorium, dan tangkapan layar percakapan pribadi. Fileora menjalankan pengenalan teks di browser Anda dengan mesin sumber terbuka (Tesseract), sehingga gambar tetap di HP atau komputer Anda. Tidak perlu akun, tidak ada batas harian, dan tidak ada watermark.
Karena tidak ada yang diunggah, antrean gambar yang banyak juga tidak perlu melewati koneksi yang lambat. Setelah mesin dan file bahasa tersimpan di browser, pembacaan tetap cepat meskipun Anda memakai kuota data seluler.
Cara mendapatkan hasil terbaik
Kualitas foto adalah faktor terpenting. Pegang kamera tepat di atas halaman agar baris teks lurus, isi bingkai dengan teks yang Anda perlukan, dan pastikan cahaya merata tanpa bayangan tangan atau HP. Gambar yang buram, miring, atau kontrasnya rendah adalah penyebab kesalahan yang paling umum.
Jika Anda hanya butuh satu paragraf dari halaman yang ramai, potong dulu dengan potong gambar. Semakin sedikit gangguan, semakin sedikit karakter nyasar. Tangkapan layar biasanya terbaca hampir sempurna karena hurufnya tajam dan lurus.
Pilih hanya bahasa yang memang ada di gambar. Setiap bahasa tambahan sedikit memperlambat pembacaan dan bisa membuat mesin ragu di antara huruf yang mirip. Untuk teks Indonesia dengan beberapa istilah bahasa Inggris, Bahasa Indonesia saja biasanya sudah cukup; untuk dokumen dwibahasa yang berisi paragraf lengkap dalam dua bahasa, pilih keduanya.
Foto dari iPhone yang tersimpan sebagai HEIC mungkin tidak bisa dibuka di semua browser. Ubah dulu dengan HEIC ke JPG, lalu tambahkan file JPG-nya di sini.
Kemampuan dan batasan OCR
Optical character recognition mengubah bentuk huruf menjadi teks yang bisa diedit. OCR sangat baik untuk teks cetak yang bersih dan makin menurun ketika gambar jauh dari kondisi itu. Tabel keluar sebagai baris teks biasa, bukan spreadsheet. Kolom di koran dan brosur bisa terbaca dengan urutan tak terduga. Logo, judul bergaya, dan teks di atas foto hasilnya untung-untungan. Tulisan tangan sebagian besar di luar kemampuannya.
Untuk bahasa Urdu ada catatan khusus: data bahasanya lebih banyak dilatih dengan huruf gaya Naskh, sehingga teks Urdu di layar dengan font web umum terbaca baik, sedangkan huruf Nastaliq dari buku dan koran sering terpecah atau tersambung keliru.
Setelah teks didapat, Anda bisa menghitung kata dan karakternya dengan penghitung kata. Untuk dokumen yang sudah berbentuk PDF, PDF ke Teks lebih cepat dan hasilnya persis selama PDF itu berisi teks asli, bukan gambar hasil scan.