Gambar ke teks (OCR)
Ambil teks dari foto atau screenshot.
Jalan di browser kamu. File kamu tidak pernah keluar dari perangkat.
- Jalan sepenuhnya di browser kamu
- Skor keyakinan disertakan
- Salin atau unduh teksnya
Cara mengambil teks dari gambar
- Taruh foto atau screenshot di sini.
- Tunggu beberapa detik saat teksnya dibaca.
- Salin atau unduh hasilnya.
Apa yang bisa dibaca OCR dengan baik
| Sumber | Hasil |
|---|---|
| Screenshot bersih dari teks ketikan | Sangat baik, biasanya keyakinan 95% atau lebih |
| Hasil scan dokumen cetak | Sangat bagus |
| Foto tanda atau halaman, tegak lurus | Bagus |
| Foto miring, buram, atau cahaya kurang | Kurang baik, banyak kesalahan |
| Tulisan tangan | Tidak konsisten, paling baik untuk tulisan cetak yang rapi |
Cara kerja skor keyakinan
Mesin OCR mengembalikan persentase keyakinan untuk keseluruhan hasil ekstraksi, perkiraannya sendiri tentang seberapa yakin ia terhadap teks yang ditemukan. Di atas sekitar 90, hasilnya biasanya akurat. Di bawah 70, baca hasilnya sambil membandingkan dengan gambar aslinya sebelum dipercaya, terutama untuk nama, angka, dan tanggal yang bisa berubah arti kalau salah baca sedikit saja.
Cara mendapatkan hasil yang lebih baik
- Crop bagian yang bukan teks sebelum mengupload, seperti latar yang ramai atau foto, karena OCR mencoba membaca pola di semuanya.
- Luruskan foto yang diambil dari sudut dulu dengan alat Rotate gambar TabbyKit. Teks yang miring membingungkan langkah deteksi baris.
- Resolusi lebih tinggi membantu sampai batas tertentu. Foto resolusi tinggi yang buram tetap terbaca lebih buruk dibanding foto resolusi lebih rendah yang tajam.
- Pencahayaan yang baik dan rata tanpa silau mengalahkan foto yang lebih terang tapi pencahayaannya tidak merata.
- Hasil scan halaman yang rata dan lurus hampir selalu mengungguli foto halaman yang sama diambil dengan tangan, bahkan dari kamera yang bagus.
Cara kerja mesin OCR ini
Alat ini menjalankan Tesseract, mesin OCR open source yang awalnya dikembangkan di HP dan sekarang dikelola Google, sepenuhnya di dalam browser kamu sebagai WebAssembly. Model pengenalan teks bahasa Inggrisnya diunduh sekali, lalu setiap foto setelah itu dibaca di perangkatmu tanpa server yang terlibat.
FAQ Gambar ke teks
Bahasa apa saja yang didukung alat ini?
Alat ini saat ini membaca teks bahasa Inggris. Hasil terbaik didapat dari teks cetak atau ketikan yang jelas.
Bisakah ini membaca tulisan tangan?
Kadang bisa membaca tulisan tangan yang sangat rapi, tapi OCR dibuat untuk teks cetak dan kesulitan membaca tulisan sambung atau yang berantakan.
Apa arti skor keyakinan?
Itu perkiraan mesin OCR sendiri tentang seberapa yakin ia terhadap teksnya, dari 0 sampai 100. Di atas sekitar 90 hasilnya biasanya akurat; di bawah 70, periksa lagi dengan gambar aslinya.
Kenapa screenshot terbaca lebih baik daripada foto?
Screenshot dan hasil scan punya pencahayaan rata dan tepi tajam. Foto yang diambil dari sudut, dengan bayangan atau blur, memberi lebih sedikit bahan bagi OCR untuk bekerja.
Apakah gambarku diupload ke server?
Tidak. Mesin OCR-nya diunduh sekali ke browser kamu, dan setiap foto setelah itu dibaca di perangkatmu sendiri.
Kenapa gagal membaca gambarku?
Ini jarang terjadi, hanya kalau file gambarnya sendiri tidak bisa di-decode. Coba foto lain atau screenshot langsung, bukan foto dari layar.
Bisakah aku menyalin cuma sebagian teks hasil ekstraksi?
Bisa. Hasilnya muncul di kotak teks yang bisa diedit, jadi kamu bisa memilih, menyalin, atau mengedit bagian mana pun sebelum mengunduhnya.
Apakah ini bekerja untuk PDF?
Tidak langsung. Ambil screenshot halaman PDF-nya atau ekspor jadi gambar dulu, lalu taruh gambar itu di sini.
Bisakah aku memakai ini di HP?
Bisa. Semuanya jalan di browser, termasuk Safari dan Chrome di HP, meski foto yang sangat besar mungkin butuh beberapa detik ekstra di HP lama.