PDF σε Κείμενο — Δωρεάν Online Εξαγωγέας Κειμένου
Αφαιρέστε το κείμενο από ένα ψηφιακό ή σαρωμένο PDF, ακριβώς στον περιηγητή σας. Δωρεάν, χωρίς εγγραφή και το PDF δεν φεύγει ποτέ από τη συσκευή σας.
Θέλετε να μας ευχαριστήσετε; Πείτε στους φίλους σας για το LeanImg!
Πώς να Μετατρέψετε ένα PDF σε Κείμενο
Επιλέξτε το PDF σας
Ρίξτε το αρχείο στο κουτί ή επιλέξτε το από τη συσκευή σας. Ψηφιακά PDFs, σαρωμένα PDFs και αρχεία που συνδυάζουν τα δύο λειτουργούν όλα.
Επιλέξτε μια γλώσσα και εξαγάγετε
Επιλέξτε τη γλώσσα του εγγράφου, στη συνέχεια ξεκινήστε την εξαγωγή. Σελίδες με επίπεδο κειμένου διαβάζονται αμέσως. Σελίδες που χρειάζονται OCR αναγνωρίζονται η μία μετά την άλλη, με την πρόοδο να εμφανίζεται καθώς κάθε μία προσγειώνεται.
Αντιγράψτε ή κατεβάστε το κείμενο
Διαβάστε το αποτέλεσμα, αντιγράψτε το στο πρόχειρο σας ή αποθηκεύστε το ως αρχείο .txt με τις σελίδες επισημασμένες.
Πώς λειτουργεί η εξαγωγή PDF σε κείμενο
Ένα PDF είναι ένα δοχείο, και αυτό που βρίσκεται μέσα του καθορίζει πώς βγαίνει το κείμενο. Ένα αρχείο που εξάγεται από έναν επεξεργαστή κειμένου, έναν περιηγητή ή μια εφαρμογή λογιστικής φέρει ένα επίπεδο κειμένου. Οι χαρακτήρες αποθηκεύονται ως χαρακτήρες, μαζί με τη θέση τους στη σελίδα. Η ανάγνωση αυτού του επιπέδου σας δίνει το κείμενο ακριβώς όπως το αποθηκεύει το αρχείο. Δεν εκτελείται κανένα βήμα αναγνώρισης, οπότε δεν υπάρχει τίποτα που να μπορεί να πάει στραβά.
Ένα σαρωμένο PDF είναι κάτι διαφορετικό που φοράει την ίδια επέκταση αρχείου. Ένας σαρωτής ή μια κάμερα τηλεφώνου παρήγαγε μια εικόνα κάθε σελίδας, και η εικόνα τυλίχτηκε σε ένα PDF. Δεν υπάρχουν χαρακτήρες στο αρχείο, μόνο πίξελ που μοιάζουν με χαρακτήρες για το ανθρώπινο μάτι. Η εξαγωγή λέξεων από αυτό απαιτεί OCR, το οποίο αποδίδει τη σελίδα και ταιριάζει σχήματα με ένα εκπαιδευμένο μοντέλο για τη γλώσσα που επιλέγετε.
Ο extractor ελέγχει κάθε σελίδα πριν αποφασίσει. Αν η σελίδα έχει ένα χρήσιμο επίπεδο κειμένου, αυτό το επίπεδο διαβάζεται και το αποτέλεσμα είναι ακριβές. Αν δεν έχει, η σελίδα αποδίδεται ως εικόνα και περνάει από την ίδια μηχανή OCR που τροφοδοτεί τον extractor εικόνας. Αρχεία που συνδυάζουν τα δύο λαμβάνουν και τις δύο θεραπείες, μία σελίδα τη φορά, και η σύνοψη στο αποτέλεσμα λέει ποια μέθοδος χρησιμοποιήθηκε για κάθε σελίδα. Κάθε αρχείο διαβάζεται μέχρι 25 σελίδες ανά PDF.
Τραπεζικές δηλώσεις, ταυτότητες και συμβόλαια παραμένουν στη συσκευή σας
Τα έγγραφα από τα οποία οι άνθρωποι θέλουν περισσότερο να εξάγουν κείμενο είναι αυτά που θα έπρεπε να είναι λιγότερο πρόθυμοι να ανεβάσουν. Τραπεζικές δηλώσεις, αποδείξεις πληρωμής, φορολογικές δηλώσεις, υπογεγραμμένα συμβόλαια, ιατρικές επιστολές και σαρώσεις διαβατηρίων ή ταυτοτήτων. Κάθε ένα από αυτά είναι ένα αρχείο που δεν θα στέλνατε μέσω email σε έναν ξένο, και η παράδοσή του σε μια ιστοσελίδα που βρήκατε σε ένα αποτέλεσμα αναζήτησης είναι η ίδια πράξη με λιγότερα βήματα.
Αυτός ο extractor δεν έχει σημείο ανέβασμα. Το PDF σας διαβάζεται από το δίσκο στη σελίδα, ανοιγμένο από έναν αναγνώστη PDF που εκτελείται στον περιηγητή σας και μετατρέπεται σε κείμενο στη μνήμη. Οι αιτήσεις που κάνει η σελίδα είναι για τη δική της μηχανή: τον αναγνώστη αυτόν και, όταν μια σελίδα χρειάζεται OCR, τη μηχανή αναγνώρισης και το γλωσσικό μοντέλο. Όλα αυτά εξυπηρετούνται από αυτήν την ιστοσελίδα και ταξιδεύουν μόνο προς εσάς.
Δεν χρειάζεται να το πιστέψετε αυτό. Ανοίξτε την καρτέλα δικτύου του περιηγητή σας πριν ξεκινήσετε μια εκτέλεση, στη συνέχεια παρακολουθήστε την καθώς το κείμενο εμφανίζεται. Θα δείτε τη μηχανή να φτάνει και τίποτα να μην μεταφέρει το έγγραφό σας μακριά. Αυτό είναι μια δήλωση που μπορείτε να ελέγξετε σε λιγότερο από ένα λεπτό, κάτι που είναι περισσότερο από ό,τι σας δίνει μια πολιτική απορρήτου.
Τι δεν κάνει αυτό το εργαλείο
Αυτή η σελίδα πηγαίνει μόνο σε μία κατεύθυνση. Διαβάζει ένα PDF και σας δίνει απλό κείμενο. Δεν γράφει ένα PDF. Δεν επιστρέφει ένα αναζητήσιμο PDF με ένα επίπεδο κειμένου προστιθέμενο. Δεν ανακατασκευάζει το έγγραφό σας ως αρχείο επεξεργαστή κειμένου με την αρχική διάταξη ανέπαφη. Αυτό που παίρνετε είναι οι λέξεις.
Δεν συγχωνεύει, δεν χωρίζει, δεν περιστρέφει, δεν συμπιέζει ή προστατεύει με κωδικό πρόσβασης τίποτα επίσης. Υπάρχουν ιστοσελίδες για όλα αυτά, και οι περισσότερες από αυτές χρειάζονται το αρχείο σας στον διακομιστή τους για να κάνουν τη δουλειά. Αυτός είναι ο εμπορικός στόχος που έχει κατασκευαστεί αυτή η σελίδα για να αποφύγει.
Αν θέλετε να πάτε προς την άλλη κατεύθυνση και να μετατρέψετε φωτογραφίες ή σαρώσεις σε ένα ενιαίο PDF, ο μετατροπέας JPG σε PDF σε αυτήν την ιστοσελίδα το κάνει αυτό. Λειτουργεί στον περιηγητή ακριβώς όπως αυτή η σελίδα. Αν η πηγή σας είναι ένα στιγμιότυπο οθόνης ή μια φωτογραφία αντί για ένα PDF, ο extractor εικόνας είναι η σελίδα που θέλετε.
Γιατί LeanImg;
Το PDF διαβάζεται στη συσκευή σας, σελίδα προς σελίδα, και το κείμενο παραμένει εκεί μαζί του. Εξερευνήστε όλα τα δωρεάν εργαλεία εικόνας μας για να διατηρήσετε το υπόλοιπο της ροής εργασίας σας στον περιηγητή επίσης.
Δεν Ανεβαίνει Τίποτα
Οι τραπεζικές καταστάσεις, οι ταυτότητες και τα συμβόλαια είναι ακριβώς τα αρχεία που δεν πρέπει να στείλετε σε διακομιστή ξένου. Αυτό το εργαλείο δεν έχει διακομιστή για να τα στείλει.
Ακριβές Όπου Μπορεί
Τα ψηφιακά PDFs διαβάζονται από το επίπεδο κειμένου τους αυτολεξεί. Μόνο οι σαρωμένες σελίδες περνούν από OCR, και κάθε αποτέλεσμα λέει ποια μέθοδος χρησιμοποιήθηκε.
Δωρεάν και Απεριόριστο
Χωρίς εγγραφή, χωρίς πιστώσεις, χωρίς υδατογραφήματα και χωρίς πληρωμένη βαθμίδα. Μέχρι 25 σελίδες ανά PDF, όσες περισσότερες PDFs χρειάζεστε.
Πώς φαίνονται οι αριθμοί
Τέσσερα PDFs πέρασαν από αυτόν τον extractor με το κείμενό τους γνωστό εκ των προτέρων. Η βαθμολογία είναι μια σύγκριση χαρακτήρα προς χαρακτήρα της εξόδου με αυτό το κείμενο. Τρία από τα αρχεία ήταν ψηφιακά, εξαγόμενα απευθείας από έναν περιηγητή, οπότε οι χαρακτήρες ήταν ήδη μέσα τους. Το σαρωμένο έγινε σπρώχνοντας μια στιγμιότυπο οθόνης μέσω του δικού μας μετατροπέα JPG σε PDF, ο οποίος αφήνει μια εικόνα μιας σελίδας και κανέναν χαρακτήρα. Η τελευταία γραμμή είναι ένα αρχείο 28 σελίδων. Δημιουργήθηκε για να ξεπεράσει το όριο σελίδων, οπότε κανένα από αυτά δεν βαθμολογήθηκε για ακρίβεια.
| Στοιχείο | Σελίδες | Μέθοδος | Ομοιότητα |
|---|---|---|---|
| Ψηφιακό PDF | 1 από 1 | Επίπεδο κειμένου | 100.0% |
| Σαρωμένο PDF | 1 από 1 | OCR | 100.0% |
| Ψηφιακό PDF τριών σελίδων | 3 από 3 | Επίπεδο κειμένου | 100.0% |
| Υπερμεγέθες PDF | 25 από 28 | Επίπεδο κειμένου | Δεν βαθμολογήθηκε |
Δύο μέθοδοι παρήγαγαν αυτές τις γραμμές, και το αρχείο αποφασίζει ποια θα εκτελεστεί. Κάθε σελίδα ελέγχεται πρώτα για ένα επίπεδο κειμένου, και όταν οι χαρακτήρες είναι εκεί διαβάζονται αυτολεξεί χωρίς κανένα βήμα αναγνώρισης. Εκεί είναι που ανήκει η λέξη ακριβές, και πουθενά αλλού σε αυτή τη σελίδα. Μια σελίδα χωρίς χρήσιμο επίπεδο κειμένου αποδίδεται ως εικόνα και παραδίδεται στην ίδια μηχανή OCR που διαβάζει στιγμιότυπα οθόνης, οπότε φέρει την ακρίβεια και τις αποτυχίες αυτής της μηχανής. Αρχεία που αναμειγνύουν τα δύο λαμβάνουν και τις δύο θεραπείες, μία σελίδα τη φορά.
Το αποτέλεσμα σας λέει ποιο συνέβη. Ένα PDF που διαβάζεται εξ ολοκλήρου από το επίπεδο κειμένου του επισημαίνεται ως ακριβές, και η κάρτα δεν φέρει καμία βαθμολογία εμπιστοσύνης γι' αυτό. Οποιοδήποτε έγγραφο με μια σελίδα OCR σε αυτό δείχνει μια βαθμολογία. Ένα έγγραφο με περισσότερες από μία σελίδες φέρει επίσης μια γραμμή που μετρά τις σελίδες που διαβάστηκαν από το επίπεδο κειμένου σε σχέση με τις σελίδες που πέρασαν από OCR. Αυτή η βαθμολογία είναι μια μέση τιμή βαρύνου χαρακτήρα σε ολόκληρο το έγγραφο, και οι σελίδες του επιπέδου κειμένου εισέρχονται σε αυτήν με 100. Σε ένα μικτό αρχείο, διαβάστε το ως πόσο αξιόπιστο είναι το κείμενο, όχι ως πόσο καλά τα πήγε το OCR. Η γραμμή συνοψίσεως ανά σελίδα είναι αυτή που σας λέει πόσες σελίδες αναγνωρίστηκαν καθόλου.
Τι κατεβαίνει κατά την πρώτη χρήση
Και οι δύο μηχανές εκτελούνται στη μηχανή σας, οπότε πρέπει να φτάσουν εκεί πρώτα. Το άνοιγμα ενός PDF φέρνει τον εργάτη pdf.js, ο οποίος είναι περίπου 1.3 MB. Η μηχανή OCR και ένα γλωσσικό μοντέλο έρχονται μαζί του, περίπου 6 MB συνολικά, και έρχονται ακόμη και όταν κάθε σελίδα αποδεικνύεται ψηφιακή και καμία αναγνώριση δεν εκτελείται ποτέ. Αυτό είναι μια σπατάλη λήψης σε ένα ψηφιακό αρχείο. Είναι ένας τρέχων περιορισμός και η διόρθωσή του είναι στη λίστα.
Όλα σερβίρονται από αυτόν τον ιστότοπο και τίποτα από μια τρίτη CDN. Ο περιηγητής σας αποθηκεύει όλα αυτά, οπότε το επόμενο PDF σε αυτή τη γλώσσα ξεκινά χωρίς τίποτα να αναζητήσει. Έγγραφα που κατασκευάζονται με ασυνήθιστες γραμματοσειρές τραβούν ένα ακόμη μικρό αρχείο για τους χάρτες χαρακτήρων, και μόνο αυτά τα έγγραφα το κάνουν. Τίποτα δεν ταξιδεύει προς την άλλη κατεύθυνση. Το PDF σας διαβάζεται από τον δίσκο στη σελίδα και ανοίγεται στη μνήμη, και κανένα αίτημα δεν το μεταφέρει έξω.
Πού είναι οι περιορισμοί
Ένα PDF έχει 25 σελίδες. Το υπερμεγέθες στοιχείο κρατά 28 από αυτές, και η εκτέλεση πήρε τις πρώτες 25 και το είπε στην κάρτα αποτελέσματος. Ένα μεγαλύτερο έγγραφο σας δίνει ακόμα κάτι, και ο τρόπος είναι να χωρίσετε το αρχείο σε έναν αναγνώστη PDF και να στείλετε τις υπόλοιπες σελίδες ως δεύτερη εκτέλεση.
Ένα PDF που προστατεύεται με κωδικό απορρίπτεται. Δεν μπορεί να ανοιχτεί χωρίς τον κωδικό του, και αυτή η σελίδα δεν θα σας ζητήσει έναν. Ο extractor λέει ακριβώς αυτό και σταματά. Ανοίξτε το αρχείο στον αναγνώστη που ήδη χρησιμοποιείτε, αποθηκεύστε ένα αντίγραφο με τον κωδικό αφαιρεμένο και εκτελέστε αυτό το αντίγραφο.
Η σειρά ανάγνωσης είναι ο πιο ήσυχος περιορισμός. Ένα επίπεδο κειμένου καταγράφει πού κάθε σειρά χαρακτήρων βρίσκεται στη σελίδα και τίποτα για το τι σημαίνει οτιδήποτε από αυτά, οπότε στήλες, πλαϊνές γραμμές και υποσημειώσεις μπορεί να επιστρέψουν σε μια σειρά που το μάτι σας δεν θα έπαιρνε ποτέ. Οι πίνακες χάνουν το πλέγμα και φτάνουν ως το περιεχόμενο των κελιών τους στη σειρά. Η ευθεία πρόζα είναι σχεδόν πάντα καλή. Μια συμπληρωμένη φόρμα ή μια σελίδα δύο στηλών αξίζει να διαβαστεί πριν βασιστείτε σε αυτήν.
Το χειρόγραφο σε μια σάρωση βρίσκεται εκτός αυτής της μηχανής. Είναι εκπαιδευμένο σε εκτυπωμένους χαρακτήρες, και μια χειρόγραφη γραμμή επιστρέφει ως θόρυβος που έχει σχήμα κειμένου. Μια σάρωση που αναμειγνύει εκτύπωση με χειρόγραφο σας δίνει το εκτυπωμένο μέρος και ανοησίες στη θέση της γραφής.
Ένας ακόμη περιορισμός που αξίζει να γνωρίζετε: μια σάρωση που έχει ήδη υποβληθεί σε OCR από άλλο λογισμικό φέρει το αόρατο επίπεδο κειμένου αυτού του λογισμικού, και αυτό το εργαλείο το διαβάζει αυτολεξεί. Το αποτέλεσμα είναι ακριβές στο αρχείο, όχι απαραίτητα στο χαρτί από το οποίο σαρώθηκε.
Συχνές Ερωτήσεις
Ποια είναι η διαφορά μεταξύ ενός ψηφιακού PDF και ενός σαρωμένου PDF;
Ένα ψηφιακό PDF παράγεται από λογισμικό, οπότε περιέχει τους χαρακτήρες αυτούς καθαυτούς. Ένα σαρωμένο PDF είναι μια στοίβα εικόνων σελίδων που παράγονται από έναν σαρωτή ή μια κάμερα, οπότε δεν περιέχει καθόλου χαρακτήρες. Αυτή η διαφορά καθορίζει τα πάντα σχετικά με το αποτέλεσμα. Το ψηφιακό αρχείο σας δίνει ακριβές κείμενο. Το σαρωμένο αρχείο πρέπει να αναγνωριστεί, και η αναγνώριση είναι πολύ καλή σε καθαρές σαρώσεις και λιγότερο καλή σε στραβές, θολές ή κακώς φωτισμένες. Συνήθως μπορείτε να καταλάβετε ποιο είδος έχετε ανοίγοντας το αρχείο σε έναν αναγνώστη PDF και προσπαθώντας να επιλέξετε μια γραμμή κειμένου με το ποντίκι σας. Αν η επιλογή επισημαίνει λέξεις, υπάρχει ένα επίπεδο κειμένου.
Είναι το εξαγόμενο κείμενο ακριβές για ψηφιακά PDFs;
Για σελίδες με πραγματικό επίπεδο κειμένου, ναι. Οι χαρακτήρες διαβάζονται από το αρχείο αντί να αναγνωρίζονται από μια εικόνα, οπότε δεν εκτελούνται διαδικασίες OCR σε αυτούς και δεν υπάρχει τίποτα για να διαβαστεί λανθασμένα. Η σειρά ανάγνωσης είναι το μόνο πράγμα που μπορεί ακόμα να σας εκπλήξει, επειδή το επίπεδο κειμένου αποθηκεύει πού κάθε σειρά χαρακτήρων βρίσκεται και όχι τι σημαίνει, οπότε μια σελίδα με στήλες ή πλαϊνές γραμμές μπορεί να βγει σε μια σειρά που δεν ταιριάζει με τον τρόπο που κινείται το μάτι σας. Οι λέξεις αυτές είναι οι λέξεις στο αρχείο. Σελίδες χωρίς επίπεδο κειμένου περνούν από OCR αντίθετα, και αυτές φέρουν την συνήθη ακρίβεια αναγνώρισης.
Πόσες σελίδες μπορώ να εξάγω ταυτόχρονα;
Μέχρι 25 σελίδες ανά PDF. Ένα μεγαλύτερο αρχείο εξακολουθεί να γίνεται αποδεκτό: οι πρώτες 25 σελίδες εξάγονται και μια ειδοποίηση στο αποτέλεσμα σας λέει πόσες σελίδες αποκλείστηκαν. Το όριο υπάρχει επειδή η εργασία εκτελείται στον δικό σας υπολογιστή, και ένα μεγάλο σαρωμένο έγγραφο σημαίνει μία διαδικασία OCR ανά σελίδα μέσα στην καρτέλα του προγράμματος περιήγησής σας. Αν χρειάζεστε το υπόλοιπο, χωρίστε το αρχείο σε έναν αναγνώστη PDF και εκτελέστε τις υπόλοιπες σελίδες ως δεύτερο αρχείο.
Μπορώ να εξάγω κείμενο από ένα PDF που προστατεύεται με κωδικό;
Όχι. Ένα κρυπτογραφημένο PDF δεν μπορεί να ανοιχτεί χωρίς τον κωδικό του, και αυτή η σελίδα δεν σας ζητάει έναν ή προσπαθεί να παρακάμψει την προστασία. Αντί αυτού, λαμβάνετε ένα σαφές σφάλμα αντί για ένα κενό αποτέλεσμα. Ανοίξτε το αρχείο στον αναγνώστη που χρησιμοποιείτε κανονικά, αυθεντικοποιήστε με τον τρόπο που κάνετε συνήθως, αποθηκεύστε ένα αντίγραφο με τον κωδικό αφαιρεμένο και εκτελέστε αυτό το αντίγραφο εδώ.
Ανεβαίνει το PDF μου σε έναν διακομιστή;
Όχι. Το αρχείο διαβάζεται από τον δίσκο σας στη σελίδα και ανοίγεται από έναν αναγνώστη PDF που εκτελείται στον περιηγητή σας. Δεν υπάρχει σημείο ανάρτησης σε αυτόν τον ιστότοπο για να το παραλάβει. Αυτό είναι το όλο νόημα για τα έγγραφα που οι άνθρωποι φέρνουν πραγματικά σε ένα εργαλείο σαν αυτό: τραπεζικές καταστάσεις, αποδείξεις πληρωμής, φορολογικές δηλώσεις, υπογεγραμμένα συμβόλαια και σαρώσεις μιας ταυτότητας. Παρακολουθήστε την καρτέλα δικτύου κατά τη διάρκεια μιας εκτέλεσης και θα δείτε τον αναγνώστη και το μοντέλο OCR να φτάνουν, και τίποτα να φεύγει με το έγγραφό σας.
Ποιες γλώσσες μπορεί να διαβάσει;
Η πλευρά OCR διαβάζει Αγγλικά, Ισπανικά, Ρουμανικά, Αραβικά, Ελληνικά, Τουρκικά, Ινδονησιακά, Ρωσικά και Ιαπωνικά. Επιλέξτε τη γλώσσα πριν εξάγετε, επειδή η μηχανή ταιριάζει τα σχήματα με το μοντέλο που επιλέγετε και το λάθος μοντέλο διαβάζει κακά. Σελίδες που έχουν ήδη ένα επίπεδο κειμένου αγνοούν εντελώς τη ρύθμιση, καθώς αυτοί οι χαρακτήρες διαβάζονται από το αρχείο όπως είναι, όποιο σενάριο και αν είναι γραμμένο.
Μπορώ να εξάγω κείμενο από αρκετά PDFs ταυτόχρονα;
Ναι. Επιλέξτε μια παρτίδα και τα αρχεία επεξεργάζονται διαδοχικά αντί παράλληλα. Κάθε αποτέλεσμα εμφανίζεται μόλις ολοκληρωθεί το αρχείο του, οπότε μπορείτε να αρχίσετε να διαβάζετε ενώ τα υπόλοιπα εξακολουθούν να εκτελούνται. Η ζώνη πτώσης δείχνει το όριο για μια μόνο εκτέλεση. Η διαδοχική επεξεργασία διατηρεί τη χρήση μνήμης προβλέψιμη, κάτι που έχει σημασία περισσότερο σε ένα τηλέφωνο.
Διατηρεί πίνακες και διάταξη;
Όχι. Η έξοδος είναι απλό κείμενο, οπότε ένας πίνακας επιστρέφει ως το περιεχόμενο των κελιών του αντί για ένα πλέγμα, και οι τίτλοι, οι υποσημειώσεις και οι λεζάντες δεν επισημαίνονται ως τίποτα. Η σειρά ανάγνωσης μπορεί επίσης να διαφέρει από τη οπτική διάταξη, επειδή η θέση είναι αυτό που αποθηκεύει το αρχείο και το νόημα δεν είναι. Η ευθεία πρόζα έρχεται σχεδόν πάντα στην σωστή σειρά. Μια σελίδα με πλαϊνές γραμμές, πολλές στήλες ή μια συμπληρωμένη φόρμα είναι εκεί που θα πρέπει να διαβάσετε την έξοδο πριν βασιστείτε σε αυτήν.
Μπορεί να διαβάσει χειρόγραφα σε ένα σαρωμένο PDF;
Όχι, και θα προτιμούσαμε να το πούμε εδώ παρά να σας αφήσουμε να το ανακαλύψετε με ένα αρχείο που έχει σημασία. Η μηχανή OCR είναι εκπαιδευμένη σε εκτυπωμένους χαρακτήρες. Το χειρόγραφο, οι υπογραφές και τα χειρόγραφα πεδία φόρμας βρίσκονται εκτός αυτού που μπορεί να κάνει, και αυτό που επιστρέφεται από αυτά είναι θόρυβος που έχει σχήμα κειμένου. Μια σαρωμένη σελίδα που αναμειγνύει εκτύπωση με χειρόγραφο σας δίνει το εκτυπωμένο μέρος και ανοησίες εκεί που είναι η γραφή.
Σε ποια μορφή είναι το εξαγόμενο κείμενο;
Απλό κείμενο. Αντιγράψτε το στο πρόχειρο σας με ένα κουμπί ή κατεβάστε το ως αρχείο .txt, με τις σελίδες χωρισμένες και επισημασμένες ώστε να μπορείτε να βρείτε τη θέση σας σε ένα μεγάλο έγγραφο. Δεν υπάρχει αρχείο επεξεργαστή κειμένου, δεν υπάρχει αναζητήσιμο PDF και δεν υπάρχει μορφοποίηση που να μεταφέρεται. Αν χρειάζεστε τις λέξεις κάπου αλλού, επικολλήστε τις σε ένα έγγραφο, ένα υπολογιστικό φύλλο ή έναν μεταφραστή.
Πώς μπορώ να μετατρέψω εικόνες σε PDF αντίθετα;
Αυτή είναι η άλλη κατεύθυνση, και έχει τη δική της σελίδα σε αυτόν τον ιστότοπο. Ο μετατροπέας JPG σε PDF παίρνει φωτογραφίες ή σαρώσεις και τις γράφει σε ένα μόνο PDF, στον περιηγητή σας, χωρίς να ανεβάσει τίποτα. Χρησιμοποιήστε το όταν έχετε εικόνες και χρειάζεστε ένα έγγραφο. Χρησιμοποιήστε αυτή τη σελίδα όταν έχετε ένα έγγραφο και χρειάζεστε τις λέξεις από αυτό.
Είναι ο μετατροπέας PDF σε κείμενο πραγματικά δωρεάν;
Ναι, δωρεάν χωρίς λογαριασμό και χωρίς μετρητή χρήσης. Δεν υπάρχει εγγραφή, δεν υπάρχει υδατογράφημα στο κείμενο, δεν υπάρχουν πιστώσεις και δεν υπάρχει πληρωμένη βαθμίδα που να κρατά πίσω μια καλύτερη έκδοση. Η εξαγωγή εκτελείται στον δικό σας υπολογιστή, οπότε δεν υπάρχει κόστος ανά αρχείο διακομιστή για εμάς να σας μεταφέρουμε.
Εργάζεστε με εικόνες αντί; Εξαγάγετε κείμενο από εικόνες διαβάζει στιγμιότυπα οθόνης, σαρώσεις και φωτογραφίες εγγράφων. Πηγαίνοντας προς την άλλη κατεύθυνση; Μετατρέψτε εικόνες σε PDF με τον μετατροπέα JPG σε PDF.