Jak działa Obraz na tekst
Upuść zdjęcie dokumentu, zrzut ekranu lub zeskanowaną stronę, a słowa zostaną rozpoznane i zapisane jako zwykły tekst, który możesz kopiować, edytować i przeszukiwać. To OCR, czyli optyczne rozpoznawanie znaków, wykonywane przez Tesseract, silnik open source używany przez wiele skanerów dokumentów, działający w tej karcie.
Przed konwersją wybierz język tekstu spośród 64 języków: angielskiego i głównych języków europejskich, rosyjskiego, arabskiego, perskiego, urdu i hebrajskiego, hindi, bengalskiego, tamilskiego i innych głównych pism indyjskich, chińskiego, japońskiego i koreańskiego (poziomo lub pionowo), tajskiego, wietnamskiego i innych. Pobierany jest tylko model wybranego języka, od około 0.4 MB dla perskiego do 5.7 MB dla sanskrytu i około 3 MB dla angielskiego, i jest zapisywany w pamięci podręcznej na następny raz, podobnie jak silnik OCR o rozmiarze około 4 MB.
Wyraźny drukowany tekst o normalnym rozmiarze jest odczytywany bardzo dokładnie. Wyniki są gorsze przy piśmie odręcznym, bardzo małych lub ozdobnych czcionkach, słabym oświetleniu, rozmyciu i zdjęciach robionych pod kątem. Układ nie jest zachowywany: wynik to słowa w kolejności czytania, z podziałami wierszy, a nie kopia projektu strony.
Ponieważ rozpoznawanie odbywa się na twoim urządzeniu, nadaje się do paragonów, dokumentów tożsamości, listów i innych obrazów, których wolisz nie przesyłać.
Plik tekstowy otrzymuje nazwę obrazu. Kilka obrazów można odczytać za jednym razem, a każdy daje własny plik tekstowy, co pasuje do stosu paragonów lub stron sfotografowanego dokumentu. Dokładność jest najlepsza przy ciemnym tekście na jasnym tle w rozmiarze normalnego druku lub większym. Zrzuty ekranu stron internetowych i dokumentów są odczytywane niemal bezbłędnie, ponieważ ich tekst jest już ostry.
Obraz na tekst: opcje
| Języki | 64, w tym angielski, hiszpański, francuski, niemiecki, rosyjski, arabski, hindi, bengalski, chiński, japoński i koreański, z modelami pionowymi dla chińskiego, japońskiego i koreańskiego. |
|---|---|
| Wynik | Zwykły plik tekstowy, UTF-8. |
| Odczytuj też angielskie słowa | Odczytuje wybranym językiem i angielskim jednocześnie, dla tekstu mieszanego. |
| Silnik | Tesseract, około 4 MB, plus model wybranego języka (około 3 MB dla angielskiego), zapisywane w pamięci podręcznej. |
| Układ | Nie jest zachowywany; słowa wychodzą w kolejności czytania. |
Kiedy go używać
Używaj OCR, aby skopiować cytat ze zrzutu ekranu, uzyskać tekst zeskanowanego listu bez przepisywania, przeszukiwać zdjęcia notatek, przetłumaczyć tablicę lub menu, wklejając tekst do tłumacza, albo ponownie wykorzystać tekst z obrazu w dokumencie.
Przed konwersją przytnij obraz do samego tekstu i rób zdjęcia na wprost przy dobrym świetle. Oba te kroki mają duży wpływ na dokładność.
O tym konwerterze
Ta strona to skrót do jednej z najczęstszych konwersji, który przyjmuje każdy format źródłowy, jaki da się skonwertować do tego samego formatu docelowego. Korzysta z tych samych silników co reszta witryny: ffmpeg skompilowanego do WebAssembly dla wideo i audio oraz Tesseract do odczytywania tekstu z obrazów, oba działające w twojej przeglądarce. Silniki pobierają się przy pierwszym naciśnięciu przycisku i są zapisywane w pamięci podręcznej na kolejne wizyty. Jeśli znasz dokładne formaty, dedykowane strony, takie jak MP4 na GIF lub JPG na TXT, wyjaśniają szczegóły danej pary, ale wynik z tej strony jest taki sam.
Obraz na tekst: rozwiązywanie problemów
„Nie rozpoznano tekstu”
Obraz może być rozmyty, zbyt mały lub w innym języku. Spróbuj ostrzejszego obrazu, przytnij go do tekstu i wybierz właściwy język.
Litery są błędne
Sprawdź ustawienie języka, a potem spróbuj obrazu o wyższej rozdzielczości. Ozdobne czcionki i pismo odręczne trudniej odczytać.
Potrzebuję tekstu z pliku PDF
Jeśli plik PDF ma tekst do zaznaczania, użyj PDF na TXT. Jeśli to skan, najpierw skonwertuj stronę na JPG i użyj jej tutaj.
Jak używać narzędzia Obraz na tekst krok po kroku
- Naciśnij „Wybierz obrazy” lub przeciągnij pliki na pole.
- W razie potrzeby ustaw opcje; ustawienia domyślne sprawdzają się w większości zastosowań.
- Naciśnij „Wyodrębnij tekst”. Praca odbywa się na twoim urządzeniu.
- Zapisz wynik jego przyciskiem pobierania.
Czy robienie tego online jest bezpieczne?
W większości narzędzi online „online” oznacza, że twój plik jest przesyłany na serwer firmy, tam przetwarzany i przechowywany przez jakiś czas, zanim zostanie usunięty. Tutaj tak nie jest. Strona pobiera kod narzędzia do twojej przeglądarki, a twój plik jest odczytywany i przetwarzany w karcie, na twoim własnym urządzeniu. Nigdy nie jest wysyłany do TapToConvert ani do nikogo innego.
Możesz to sprawdzić sam: gdy strona i jej silnik się załadują, wyłącz Wi-Fi, a narzędzie nadal działa. Oznacza to również brak kolejki, brak dziennego limitu i brak limitu rozmiaru pliku narzuconego przez serwer; jedynym ograniczeniem jest pamięć, jaką przeglądarka przydziela jednej karcie.
Obraz na tekst: najczęstsze pytania
Czy obraz na tekst jest darmowy?
Tak, bez limitu liczby obrazów.
Czy potrafi odczytać pismo odręczne?
Staranne pismo odręczne czasem się udaje, ale Tesseract jest stworzony do tekstu drukowanego, więc spodziewaj się błędów.
Jakie formaty obrazów działają?
JPG, PNG, WebP, HEIC, GIF, BMP, TIFF i AVIF.
Czy moje obrazy są przesyłane?
Nie. Rozpoznawanie odbywa się w przeglądarce.
Czy to jest darmowe?
Tak. Bez rejestracji, bez znaku wodnego i bez limitu użycia. TapToConvert utrzymuje się z reklam.
Czy moje pliki są przesyłane?
Nie. Wszystko odbywa się w karcie przeglądarki, na twoim własnym urządzeniu.