Cách công cụ Ảnh sang văn bản hoạt động
Thả ảnh chụp một tài liệu, ảnh chụp màn hình hoặc trang quét vào, và chữ trong đó sẽ được nhận dạng và lưu thành văn bản thuần mà bạn có thể sao chép, chỉnh sửa và tìm kiếm. Đây là OCR, nhận dạng ký tự quang học, được thực hiện bởi Tesseract, bộ máy mã nguồn mở mà nhiều ứng dụng quét tài liệu sử dụng, chạy ngay trong thẻ này.
Chọn ngôn ngữ của văn bản trước khi chuyển đổi, trong số 64 ngôn ngữ: tiếng Anh và các ngôn ngữ chính ở châu Âu, tiếng Nga, tiếng Ả Rập, tiếng Ba Tư, tiếng Urdu và tiếng Do Thái, tiếng Hindi, tiếng Bengal, tiếng Tamil và các hệ chữ lớn khác của Ấn Độ, tiếng Trung, tiếng Nhật và tiếng Hàn (viết ngang hoặc dọc), tiếng Thái, tiếng Việt và nhiều ngôn ngữ khác. Chỉ mô hình của ngôn ngữ bạn chọn được tải xuống, từ khoảng 0.4 MB với tiếng Ba Tư đến 5.7 MB với tiếng Phạn và khoảng 3 MB với tiếng Anh, và được lưu vào bộ nhớ đệm cho lần sau, cũng như bộ máy OCR khoảng 4 MB.
Chữ in rõ ràng ở cỡ bình thường được đọc rất chính xác. Kết quả kém hơn với chữ viết tay, phông chữ rất nhỏ hoặc trang trí, ánh sáng yếu, ảnh mờ và ảnh chụp xiên. Bố cục không được giữ lại: đầu ra là các từ theo thứ tự đọc, có xuống dòng, không phải bản sao thiết kế của trang.
Vì việc nhận dạng diễn ra trên thiết bị của bạn, công cụ phù hợp với hóa đơn, giấy tờ tùy thân, thư từ và các hình ảnh khác mà bạn không muốn tải lên.
Tệp văn bản được đặt tên theo ảnh. Có thể đọc nhiều ảnh trong một lần, mỗi ảnh cho ra một tệp văn bản riêng, phù hợp với một xấp hóa đơn hoặc các trang của một tài liệu được chụp ảnh. Độ chính xác tốt nhất với chữ tối trên nền sáng ở cỡ chữ in bình thường hoặc lớn hơn. Ảnh chụp màn hình trang web và tài liệu được đọc gần như hoàn hảo, vì chữ trong đó vốn đã sắc nét.
Giải thích các tùy chọn của công cụ Ảnh sang văn bản
| Ngôn ngữ | 64 ngôn ngữ, bao gồm tiếng Anh, tiếng Tây Ban Nha, tiếng Pháp, tiếng Đức, tiếng Nga, tiếng Ả Rập, tiếng Hindi, tiếng Bengal, tiếng Trung, tiếng Nhật và tiếng Hàn, cùng các mô hình chữ dọc cho tiếng Trung, tiếng Nhật và tiếng Hàn. |
|---|---|
| Đầu ra | Một tệp văn bản thuần, UTF-8. |
| Đọc cả từ tiếng Anh | Đọc bằng ngôn ngữ đã chọn cùng với tiếng Anh, cho văn bản pha trộn. |
| Bộ máy | Tesseract, khoảng 4 MB, cộng với mô hình ngôn ngữ đã chọn (khoảng 3 MB với tiếng Anh), được lưu vào bộ nhớ đệm. |
| Bố cục | Không được giữ lại; các từ ra theo thứ tự đọc. |
Khi nào nên dùng
Dùng OCR để sao chép một câu trích dẫn từ ảnh chụp màn hình, để lấy chữ của một lá thư đã quét mà không phải gõ lại, để tìm kiếm trong ảnh chụp ghi chú, để dịch biển hiệu hoặc thực đơn bằng cách dán chữ vào công cụ dịch, hoặc để dùng lại chữ từ ảnh trong một tài liệu.
Hãy cắt khung ảnh chỉ còn phần chữ trước khi chuyển đổi, và chụp thẳng góc trong điều kiện đủ sáng. Cả hai điều này đều tạo khác biệt lớn về độ chính xác.
Về công cụ chuyển đổi này
Trang này là lối tắt đến một trong những chuyển đổi phổ biến nhất, nhận mọi định dạng nguồn có thể chuyển sang cùng một định dạng đích. Trang dùng cùng các bộ máy như phần còn lại của trang web: ffmpeg được biên dịch sang WebAssembly cho video và âm thanh, và Tesseract để đọc chữ từ hình ảnh, cả hai đều chạy trong trình duyệt của bạn. Các bộ máy được tải xuống ở lần đầu bạn nhấn nút và được lưu vào bộ nhớ đệm cho những lần truy cập sau. Nếu bạn biết chính xác các định dạng liên quan, các trang riêng, như MP4 sang GIF hoặc JPG sang TXT, giải thích chi tiết của cặp định dạng đó, nhưng kết quả từ trang này là như nhau.
Khắc phục sự cố công cụ Ảnh sang văn bản
"Không nhận dạng được văn bản nào"
Ảnh có thể bị mờ, quá nhỏ hoặc ở ngôn ngữ khác. Hãy thử ảnh sắc nét hơn, cắt khung vừa phần chữ, và chọn đúng ngôn ngữ.
Chữ cái bị sai
Kiểm tra cài đặt ngôn ngữ, rồi thử ảnh có độ phân giải cao hơn. Phông chữ trang trí và chữ viết tay khó đọc hơn.
Tôi cần lấy chữ từ tệp PDF
Nếu tệp PDF có chữ chọn được, hãy dùng PDF sang TXT. Nếu đó là bản quét, hãy chuyển một trang sang JPG trước rồi dùng ở đây.
Cách dùng công cụ Ảnh sang văn bản, từng bước
- Nhấn "Chọn ảnh" hoặc kéo tệp vào ô.
- Đặt tùy chọn nếu cần; cài đặt mặc định phù hợp với hầu hết mục đích.
- Nhấn "Trích xuất văn bản". Mọi việc diễn ra trên thiết bị của bạn.
- Lưu kết quả bằng nút tải xuống.
Làm việc này trực tuyến có an toàn không?
Với hầu hết công cụ trực tuyến, "trực tuyến" nghĩa là tệp của bạn được tải lên máy chủ của một công ty, xử lý ở đó và được giữ lại một thời gian trước khi bị xóa. Ở đây thì không. Trang tải mã của công cụ về trình duyệt của bạn, và tệp được đọc và xử lý ngay trong thẻ trên thiết bị của bạn. Tệp không bao giờ được gửi đến TapToConvert hay bất kỳ ai khác.
Bạn có thể tự kiểm chứng: khi trang và bộ máy của nó đã tải xong, hãy tắt Wi-Fi và công cụ vẫn hoạt động. Điều đó cũng có nghĩa là không có hàng chờ, không giới hạn hằng ngày và không có mức trần kích thước tệp do máy chủ đặt ra; giới hạn duy nhất là bộ nhớ trình duyệt cấp cho một thẻ.
Câu hỏi thường gặp về công cụ Ảnh sang văn bản
Chuyển ảnh sang văn bản có miễn phí không?
Có, không giới hạn số lượng ảnh.
Công cụ có đọc được chữ viết tay không?
Chữ viết tay gọn gàng đôi khi đọc được, nhưng Tesseract được xây dựng cho chữ in, nên sẽ có lỗi.
Những định dạng ảnh nào dùng được?
JPG, PNG, WebP, HEIC, GIF, BMP, TIFF và AVIF.
Ảnh của tôi có bị tải lên không?
Không. Việc nhận dạng chạy ngay trong trình duyệt của bạn.
Có miễn phí không?
Có. Không cần đăng ký, không hình mờ và không giới hạn sử dụng. TapToConvert được duy trì nhờ quảng cáo.
Tệp của tôi có bị tải lên không?
Không. Mọi thứ diễn ra trong thẻ trình duyệt, trên chính thiết bị của bạn.