Gambar ke teks (OCR)

Ambil teks dari foto atau screenshot.

Jalan di browser kamu. File kamu tidak pernah keluar dari perangkat.

Cara mengambil teks dari gambar

  1. Taruh foto atau screenshot di sini.
  2. Tunggu beberapa detik saat teksnya dibaca.
  3. Salin atau unduh hasilnya.

Apa yang bisa dibaca OCR dengan baik

SumberHasil
Screenshot bersih dari teks ketikanSangat baik, biasanya keyakinan 95% atau lebih
Hasil scan dokumen cetakSangat bagus
Foto tanda atau halaman, tegak lurusBagus
Foto miring, buram, atau cahaya kurangKurang baik, banyak kesalahan
Tulisan tanganTidak konsisten, paling baik untuk tulisan cetak yang rapi

Cara kerja skor keyakinan

Mesin OCR mengembalikan persentase keyakinan untuk keseluruhan hasil ekstraksi, perkiraannya sendiri tentang seberapa yakin ia terhadap teks yang ditemukan. Di atas sekitar 90, hasilnya biasanya akurat. Di bawah 70, baca hasilnya sambil membandingkan dengan gambar aslinya sebelum dipercaya, terutama untuk nama, angka, dan tanggal yang bisa berubah arti kalau salah baca sedikit saja.

Cara mendapatkan hasil yang lebih baik

  • Crop bagian yang bukan teks sebelum mengupload, seperti latar yang ramai atau foto, karena OCR mencoba membaca pola di semuanya.
  • Luruskan foto yang diambil dari sudut dulu dengan alat Rotate gambar TabbyKit. Teks yang miring membingungkan langkah deteksi baris.
  • Resolusi lebih tinggi membantu sampai batas tertentu. Foto resolusi tinggi yang buram tetap terbaca lebih buruk dibanding foto resolusi lebih rendah yang tajam.
  • Pencahayaan yang baik dan rata tanpa silau mengalahkan foto yang lebih terang tapi pencahayaannya tidak merata.
  • Hasil scan halaman yang rata dan lurus hampir selalu mengungguli foto halaman yang sama diambil dengan tangan, bahkan dari kamera yang bagus.

Cara kerja mesin OCR ini

Alat ini menjalankan Tesseract, mesin OCR open source yang awalnya dikembangkan di HP dan sekarang dikelola Google, sepenuhnya di dalam browser kamu sebagai WebAssembly. Model pengenalan teks bahasa Inggrisnya diunduh sekali, lalu setiap foto setelah itu dibaca di perangkatmu tanpa server yang terlibat.

FAQ Gambar ke teks

Bahasa apa saja yang didukung alat ini?

Alat ini saat ini membaca teks bahasa Inggris. Hasil terbaik didapat dari teks cetak atau ketikan yang jelas.

Bisakah ini membaca tulisan tangan?

Kadang bisa membaca tulisan tangan yang sangat rapi, tapi OCR dibuat untuk teks cetak dan kesulitan membaca tulisan sambung atau yang berantakan.

Apa arti skor keyakinan?

Itu perkiraan mesin OCR sendiri tentang seberapa yakin ia terhadap teksnya, dari 0 sampai 100. Di atas sekitar 90 hasilnya biasanya akurat; di bawah 70, periksa lagi dengan gambar aslinya.

Kenapa screenshot terbaca lebih baik daripada foto?

Screenshot dan hasil scan punya pencahayaan rata dan tepi tajam. Foto yang diambil dari sudut, dengan bayangan atau blur, memberi lebih sedikit bahan bagi OCR untuk bekerja.

Apakah gambarku diupload ke server?

Tidak. Mesin OCR-nya diunduh sekali ke browser kamu, dan setiap foto setelah itu dibaca di perangkatmu sendiri.

Kenapa gagal membaca gambarku?

Ini jarang terjadi, hanya kalau file gambarnya sendiri tidak bisa di-decode. Coba foto lain atau screenshot langsung, bukan foto dari layar.

Bisakah aku menyalin cuma sebagian teks hasil ekstraksi?

Bisa. Hasilnya muncul di kotak teks yang bisa diedit, jadi kamu bisa memilih, menyalin, atau mengedit bagian mana pun sebelum mengunduhnya.

Apakah ini bekerja untuk PDF?

Tidak langsung. Ambil screenshot halaman PDF-nya atau ekspor jadi gambar dulu, lalu taruh gambar itu di sini.

Bisakah aku memakai ini di HP?

Bisa. Semuanya jalan di browser, termasuk Safari dan Chrome di HP, meski foto yang sangat besar mungkin butuh beberapa detik ekstra di HP lama.

Alat terkait