Chuyển ảnh thành văn bản (OCR)
Lấy chữ ra khỏi một ảnh chụp hoặc ảnh chụp màn hình.
Chạy ngay trên trình duyệt. File của bạn không bao giờ rời khỏi thiết bị.
- Chạy hoàn toàn trên trình duyệt
- Kèm điểm độ tin cậy
- Sao chép hoặc tải văn bản về
Cách trích chữ từ một ảnh
- Thả ảnh chụp hoặc ảnh chụp màn hình vào đây.
- Chờ vài giây trong khi công cụ đọc chữ.
- Sao chép hoặc tải kết quả về.
OCR đọc tốt với loại ảnh nào
| Nguồn | Kết quả |
|---|---|
| Ảnh chụp màn hình sạch của chữ đánh máy | Xuất sắc, thường đạt độ tin cậy 95% trở lên |
| Bản quét tài liệu in | Rất tốt |
| Ảnh chụp biển hiệu hoặc trang giấy, thẳng góc | Tốt |
| Ảnh chụp nghiêng góc, mờ, hoặc thiếu sáng | Kém, nhiều lỗi |
| Chữ viết tay | Không đáng tin cậy, tốt nhất với chữ in rất gọn gàng |
Điểm độ tin cậy hoạt động thế nào
Công cụ OCR trả về một tỷ lệ phần trăm độ tin cậy cho toàn bộ kết quả trích xuất, là ước tính riêng của nó về mức độ chắc chắn với văn bản tìm được. Trên khoảng 90, kết quả thường chính xác. Dưới 70, hãy đọc lại kết quả so với ảnh gốc trước khi tin tưởng, nhất là với tên riêng, số và ngày tháng mà chỉ một lỗi đọc nhỏ cũng làm sai lệch.
Để có kết quả tốt hơn
- Cắt bỏ những gì không phải chữ trước khi tải lên, như nền rối mắt hay một bức ảnh, vì OCR sẽ cố đọc mọi hoa văn.
- Làm thẳng ảnh chụp bị nghiêng trước bằng công cụ Xoay ảnh của TabbyKit. Chữ bị nghiêng làm rối bước nhận diện dòng.
- Độ phân giải cao hơn có ích đến một mức nào đó. Một ảnh mờ độ phân giải cao vẫn đọc kém hơn một ảnh sắc nét độ phân giải thấp hơn.
- Ánh sáng tốt, đều, không bị lóa sẽ tốt hơn một ảnh sáng hơn nhưng chiếu sáng không đều.
- Một bản quét phẳng, thẳng góc của một trang gần như luôn cho kết quả tốt hơn ảnh chụp cùng trang đó bằng tay, kể cả từ máy ảnh tốt.
Công cụ OCR này hoạt động như thế nào
Công cụ này chạy Tesseract, một công cụ OCR mã nguồn mở ban đầu được phát triển tại HP và nay do Google duy trì, hoàn toàn bên trong trình duyệt của bạn dưới dạng WebAssembly. Mô hình nhận diện chữ tải về một lần, sau đó mọi ảnh tiếp theo được đọc ngay trên thiết bị của bạn mà không cần máy chủ nào.
Câu hỏi thường gặp về Chuyển ảnh thành văn bản
Công cụ này hỗ trợ những ngôn ngữ nào?
Công cụ đọc được 17 ngôn ngữ: Tiếng Anh, Tiếng Tây Ban Nha, Tiếng Bồ Đào Nha, Tiếng Pháp, Tiếng Đức, Tiếng Italy, Tiếng Indonesia, Tiếng Thổ Nhĩ Kỳ, Tiếng Nhật, Tiếng Nga, Tiếng Việt, Tiếng Ba Lan, Tiếng Hà Lan, Tiếng Hàn, Tiếng Thái, Tiếng Ukraina và Tiếng Ả Rập. Ngôn ngữ của trang được chọn sẵn theo mặc định, chọn ngôn ngữ khác trong danh sách Ngôn ngữ văn bản trước khi thêm ảnh. Kết quả tốt nhất với chữ in hoặc chữ đánh máy rõ nét.
Nó có đọc được chữ viết tay không?
Đôi khi nó đọc được chữ viết tay rất gọn gàng, nhưng OCR được xây dựng cho chữ in và gặp khó với chữ viết tay kiểu chữ thảo hoặc lộn xộn.
Điểm độ tin cậy nghĩa là gì?
Đó là ước tính riêng của công cụ OCR về mức độ chắc chắn với văn bản tìm được, từ 0 đến 100. Trên khoảng 90 thì kết quả thường chính xác, dưới 70 thì hãy đối chiếu với ảnh gốc.
Vì sao ảnh chụp màn hình đọc tốt hơn ảnh chụp?
Ảnh chụp màn hình và bản quét có ánh sáng đều và cạnh sắc nét. Một ảnh chụp nghiêng góc, có bóng hoặc mờ sẽ cho OCR ít dữ liệu để xử lý hơn.
Ảnh của tôi có bị tải lên máy chủ không?
Không. Công cụ OCR tải về trình duyệt của bạn một lần, và mọi ảnh sau đó được đọc ngay trên thiết bị của bạn.
Vì sao nó đọc ảnh của tôi thất bại?
Điều này hiếm khi xảy ra, chỉ khi bản thân file ảnh không giải mã được. Hãy thử một ảnh khác hoặc chụp màn hình trực tiếp thay vì chụp ảnh một màn hình.
Tôi có thể sao chép chỉ một phần văn bản trích xuất không?
Được. Kết quả hiện trong một ô văn bản có thể chỉnh sửa, nên bạn có thể chọn, sao chép hoặc sửa bất kỳ phần nào trước khi tải xuống.
Nó có hoạt động trên file PDF không?
Không trực tiếp. Hãy chụp màn hình trang PDF hoặc xuất nó ra ảnh trước, rồi thả ảnh đó vào đây.
Tôi có thể dùng cái này trên điện thoại không?
Được. Mọi thứ chạy trong trình duyệt, kể cả Safari và Chrome trên di động, dù một ảnh rất lớn có thể mất thêm vài giây trên điện thoại đời cũ.