JPEG ke TXT (OCR)

Ekstrak teks dari foto dan gambar JPEG menggunakan OCR. Konversikan dokumen hasil foto, kwitansi, dan papan tulis menjadi file teks polos untuk disunting dan dicari.

Pilih bahasa teks agar alfabet yang tepat dikenali. Mode otomatis mengenali sendiri alfabet di setiap halaman.

JPG

atau seret dan lepas file di sini

Unggah gambar JPEG Anda

Konversi cepatPemrosesan amanTanpa pendaftaran

Mengubah Foto JPEG Menjadi TXT

Unggah PDF hasil pindai, foto, atau gambar. OCR membaca teks dari piksel dan mengubahnya menjadi karakter yang bisa disunting. Bekerja dengan teks cetak dalam berbagai bahasa. Menangani hasil pindai berkualitas rendah, halaman miring, dan font yang beragam.

Karena foto mengandung lebih banyak derau visual daripada tangkapan layar digital—bayangan, sedikit kemiringan, tekstur kertas—tahap pengenalan harus mengatasi hal itu terlebih dahulu sebelum menghasilkan file teks. Hasilnya sendiri tetap berupa daftar baris dan kata yang sederhana, tanpa upaya meniru kolom, indentasi, atau spasi dari halaman asli yang difoto.

Mengapa Mengubah Foto Menjadi File Teks

Dokumen hasil pindai hanyalah gambar. Anda tidak bisa mencarinya, menyalin teks darinya, atau menyuntingnya. OCR mengubah gambar menjadi teks sungguhan. Membuat arsip kertas lama bisa dicari. Memungkinkan Anda mengekstrak data dari formulir hasil pindai. Mengonversi materi cetak menjadi file yang bisa disunting.

Penting untuk mendigitalkan kontrak, kwitansi, dokumen historis, halaman buku. Pembaca layar membutuhkan teks sungguhan untuk dibacakan—OCR membuat dokumen hasil pindai bisa diakses. Menghemat waktu berjam-jam dibanding mengetik ulang secara manual.

Noise Pada Foto Versus Teks Yang Bersih

Kompresi JPEG dan kondisi kamera sama-sama memengaruhi seberapa akurat foto berubah menjadi teks: fokus yang lembut, motion blur, atau JPEG yang disimpan dengan kualitas rendah bisa menyatukan guratan halus yang membedakan huruf-huruf serupa, sehingga menghasilkan lebih banyak karakter yang salah baca dibandingkan hasil pindaian atau screenshot yang setara. Karena file .txt menghilangkan semua gaya tampilan, tidak ada tanda visual apa pun yang menandai kata yang salah baca begitu itu terjadi.

Cahaya yang merata, sudut yang lurus, dan foto yang fokus memberikan perbedaan terbesar pada hasil .txt, lebih besar daripada jumlah megapiksel kamera. Foto tajam dari kamera ponsel biasa yang diambil cukup dekat sehingga teks memenuhi bingkai umumnya akan mengungguli foto lebar dan jauh dari kamera kelas atas di mana teks hanya menempati sebagian kecil gambar.

Memotret Untuk Hasil TXT Yang Bersih

Dekatkan kamera cukup dekat sehingga teks memenuhi sebagian besar bingkai, karena foto yang jauh memaksa proses pengenalan bekerja dengan lebih sedikit piksel per huruf dibandingkan foto yang dekat dan sudah terpotong rapat. Bidik lurus ke bawah ke arah halaman, bukan dari sudut miring, dan gunakan cahaya siang alami atau cahaya ruangan yang merata, bukan satu lampu yang membuat salah satu sisi halaman lebih gelap dari sisi lainnya.

Pegang kamera dengan stabil, atau sandarkan pada sesuatu yang kokoh, karena sedikit saja motion blur bisa melembutkan tepi huruf hingga membingungkan huruf-huruf serupa seperti m dan rn, atau l dan 1. Untuk dokumen dengan beberapa halaman, ambil satu foto per halaman alih-alih mencoba memuat seluruh tumpukan dalam satu foto lebar, lalu konversi masing-masing secara terpisah untuk hasil file teks yang lebih bersih.