edittext.ai

Γιατί το AI γράφει λάθος κείμενο σε εικόνες και πώς να το διορθώσετε

Γιατί οι γεννήτριες εικόνων AI δεν ξέρουν ορθογραφία; Σχεδιάζουν γράμματα ως σχήματα και όχι κείμενο. Μάθετε τις αιτίες και πώς να διορθώσετε τις λέξεις.

Οι γεννήτριες εικόνων AI δυσκολεύονται με την ορθογραφία επειδή σχεδιάζουν εικόνες και όχι κείμενο. Μαθαίνουν πώς μοιάζουν τα γράμματα ως σχήματα και μοτίβα από pixel και δεν πληκτρολογούν ποτέ μια λέξη γράμμα προς γράμμα, οπότε ένα μικρό σφάλμα μπορεί να κάνει το «BAKERY» «BAKRERY». Πολλές από αυτές διαβάζουν επίσης το prompt σας σε κομμάτια λέξεων και όχι σε μεμονωμένα γράμματα, κάτι που κάνει την ακριβή ορθογραφία ακόμη πιο δύσκολη.

Οι νεότερες γεννήτριες χειρίζονται το σύντομο κείμενο πολύ καλύτερα από τις πρώτες, αλλά τα μεγάλα αποσπάσματα, τα μικρά γράμματα, τα ασυνήθιστα ονόματα και τα μη λατινικά συστήματα γραφής εξακολουθούν να προκαλούν λάθη. Αν έχετε ήδη μια εικόνα με χαλασμένες λέξεις, μπορείτε συχνά να διορθώσετε το κείμενο σε εικόνες δημιουργημένες από AI χωρίς να ξεκινήσετε από την αρχή. Ο οδηγός εξηγεί γιατί συμβαίνουν τα λάθη, πώς να ζητήσετε καλύτερο κείμενο και πώς να το επισκευάσετε αργότερα, είτε η εικόνα προήλθε από το Midjourney, το ChatGPT, το Gemini, το Stable Diffusion είτε από άλλη γεννήτρια.

Πώς οι γεννήτριες εικόνων AI φτιάχνουν μια εικόνα

Πολλές δημοφιλείς γεννήτριες εικόνων χρησιμοποιούν μια μέθοδο που λέγεται μοντέλο διάχυσης. Το μοντέλο ξεκινά από τυχαίο θόρυβο, παρόμοιο με τα παράσιτα σε μια οθόνη, και αφαιρεί λίγο από αυτόν τον θόρυβο σε καθένα από πολλά βήματα. Το prompt σας καθοδηγεί κάθε βήμα, οπότε ο θόρυβος σιγά σιγά μετατρέπεται σε μια εικόνα που ταιριάζει με την περιγραφή σας. Ολόκληρη η εικόνα βελτιώνεται μαζί: ο ουρανός, τα πρόσωπα και τα γράμματα παίρνουν σχήμα την ίδια στιγμή.

Δεν λειτουργούν όλες οι γεννήτριες έτσι. Ορισμένες χτίζουν την εικόνα ως μια ακολουθία από μικρά κομμάτια. Γενικά όμως, τα μοντέλα μετατροπής κειμένου σε εικόνα έχουν ένα σημαντικό κοινό χαρακτηριστικό: προβλέπουν πώς πρέπει να μοιάζει η εικόνα. Δεν υπάρχει βήμα όπου το μοντέλο διαλέγει μια γραμματοσειρά και πληκτρολογεί «B», έπειτα «A», έπειτα «K». Τα γράμματα εμφανίζονται μόνο ως σχήματα που φαίνονται σωστά, γι’ αυτό μπορεί να βγουν σχεδόν σωστά αλλά όχι ακριβώς.

Γιατί το κείμενο είναι τόσο δύσκολο για τις γεννήτριες εικόνων

Αρκετές αιτίες συνδυάζονται. Καθεμία κάνει πιο πιθανό ένα μικρό λάθος και το κείμενο είναι ένα σημείο όπου τα μικρά λάθη φαίνονται εύκολα.

Τα γράμματα είναι μικρές λεπτομέρειες με αυστηρούς κανόνες

Ένα δέντρο μπορεί να έχει οποιονδήποτε αριθμό κλαδιών και να μοιάζει ακόμη με δέντρο. Μια λέξη έχει ακριβώς μία σωστή ορθογραφία. Το κείμενο έχει επίσης κανόνες που ισχύουν σε ολόκληρη τη λέξη: κάθε γράμμα χρειάζεται το ίδιο στιλ και ύψος, τα διαστήματα πρέπει να είναι ομοιόμορφα και τα γράμματα πρέπει να κάθονται στην ίδια γραμμή. Μια επιπλέον γραμμή, ένα γράμμα που λείπει ή ένα διπλασιασμένο γράμμα φαίνεται αμέσως σε όποιον διαβάζει τη γλώσσα, ακόμη κι όταν η υπόλοιπη εικόνα μοιάζει αληθινή.

Το μοντέλο μπορεί να μη δει ποτέ τα γράμματα που πληκτρολογήσατε

Πριν μια γεννήτρια μπορέσει να χρησιμοποιήσει το prompt σας, ένα στοιχείο που λέγεται κωδικοποιητής κειμένου (text encoder) το μετατρέπει σε αριθμούς. Πολλοί κωδικοποιητές κειμένου χωρίζουν πρώτα το prompt σε tokens. Οι κοινές λέξεις γίνονται συχνά ένα μόνο token, ενώ οι σπανιότερες σπάνε σε πολλά κομμάτια. Μια ευρέως χρησιμοποιούμενη μέθοδος για τη δημιουργία αυτών των κομματιών είναι η κωδικοποίηση ζευγών byte (byte-pair encoding). Η προσέγγιση είναι αποδοτική, αλλά το μοντέλο λαμβάνει ένα αναγνωριστικό για κάθε κομμάτι και όχι τα γράμματα μέσα σε αυτό. Πρέπει να μάθει από παραδείγματα ότι ένα συγκεκριμένο κομμάτι σχεδιάζεται ως μια συγκεκριμένη σειρά γραμμάτων.

Μια εργασία της Google Research με τίτλο Character-Aware Models Improve Visual Text Rendering μελέτησε αυτό το ζήτημα άμεσα. Οι ερευνητές συνέκριναν κωδικοποιητές κειμένου που βλέπουν μεμονωμένους χαρακτήρες («character-aware») με κωδικοποιητές που βλέπουν μόνο κομμάτια λέξεων («character-blind»). Τα μοντέλα εικόνας με κωδικοποιητές character-aware απέδιδαν το οπτικό κείμενο με μεγαλύτερη ακρίβεια και ήταν ιδιαίτερα δυνατά στις σπάνιες λέξεις. Η εργασία διαπίστωσε επίσης ότι πολύ μεγάλα γλωσσικά μοντέλα character-blind μπορούν να μάθουν να γράφουν με σωστή ορθογραφία, αλλά ότι αυτή η ικανότητα δεν μεταφερόταν καλά πέρα από τα αγγλικά και εμφανιζόταν μόνο σε μοντέλα πολύ μεγαλύτερα από τους κωδικοποιητές κειμένου που χρησιμοποιούσαν συνήθως οι γεννήτριες εικόνων εκείνη την εποχή.

Οι εικόνες εκπαίδευσης συχνά δείχνουν το κείμενο με κακή ποιότητα

Οι γεννήτριες μαθαίνουν από πολύ μεγάλες συλλογές εικόνων σε συνδυασμό με περιγραφές. Σε αυτές τις εικόνες, το κείμενο είναι συχνά μικρό, θολό, κομμένο, φαίνεται υπό γωνία ή είναι εν μέρει κρυμμένο και εμφανίζεται σε τεράστια ποικιλία γραμματοσειρών και στιλ. Η περιγραφή που συνοδεύει μια εικόνα μπορεί να μην αναφέρει καθόλου το κείμενό της. Έτσι το μοντέλο βλέπει πολλά παραδείγματα για το πώς μοιάζει γενικά το κείμενο, αλλά λιγότερα καθαρά παραδείγματα για το πώς ακριβώς γράφεται μια συγκεκριμένη λέξη.

Το μικρό κείμενο έχει πολύ λίγα pixel

Ένας τίτλος μπορεί να εκτείνεται σε εκατοντάδες pixel, ενώ μια λέξη με μικρά γράμματα μπορεί να παίρνει μόνο λίγα pixel ανά γράμμα. Πολλές γεννήτριες δουλεύουν επίσης σε μια συμπιεσμένη εκδοχή της εικόνας και ξαναχτίζουν την εικόνα πλήρους μεγέθους στο τέλος, κάτι που αφήνει ακόμη λιγότερο χώρο για μικρές λεπτομέρειες. Οι λεπτές γραμμές, όπως η οριζόντια γραμμή σε ένα πεζό «e», χάνονται εύκολα.

Γιατί τα νεότερα μοντέλα γράφουν καλύτερο κείμενο

Οι γεννήτριες εικόνων έχουν γίνει πολύ καλύτερες σε σύντομους τίτλους και ετικέτες. Γενικά, τα νεότερα συστήματα χρησιμοποιούν ισχυρότερα γλωσσικά μοντέλα για να κατανοούν το prompt και οι προγραμματιστές έχουν δώσει μεγαλύτερη προσοχή στο κείμενο κατά την εκπαίδευση. Η έρευνα παραπάνω δείχνει προς την ίδια κατεύθυνση: τα μοντέλα που λαμβάνουν καλύτερες πληροφορίες για τα γράμματα σχεδιάζουν το κείμενο με μεγαλύτερη ακρίβεια.

Η βελτίωση είναι πραγματική αλλά άνιση. Μια γεννήτρια που γράφει σωστά έναν τίτλο τριών λέξεων μπορεί να δυσκολεύεται ακόμη με μια παράγραφο, ένα μενού ή μια ετικέτα σε γλώσσα που είδε σπανιότερα κατά την εκπαίδευση.

Πού οι γεννήτριες εικόνων AI εξακολουθούν να δυσκολεύονται

  • Μεγάλο κείμενο. Παράγραφοι, μενού και λίστες, όπου κάθε επιπλέον λέξη είναι μια ακόμη ευκαιρία για λάθος
  • Μικρό κείμενο. Μικρά γράμματα, ετικέτες και κείμενο μακριά μέσα σε μια σκηνή
  • Ασυνήθιστες λέξεις. Ονόματα, επινοημένες λέξεις, νέοι όροι και μεγάλοι αριθμοί όπως αριθμοί τηλεφώνου ή κωδικοί
  • Μη λατινικά συστήματα γραφής. Αραβικά, κινεζικά, χίντι, ιαπωνικά, κορεατικά, ταϊλανδικά και άλλα συστήματα γραφής, καθώς και γράμματα με τόνους
  • Πολλά μπλοκ κειμένου. Αφίσες και infographics με αρκετά ξεχωριστά κομμάτια κειμένου
  • Καμπύλες ή πλάγιες επιφάνειες. Κείμενο σε ένα μπουκάλι, μια σημαία ή μια πινακίδα που φαίνεται από το πλάι
  • Συνέπεια. Η διατήρηση της ίδιας ακριβώς διατύπωσης σε μια σειρά εικόνων

Αυτά είναι συνηθισμένα μοτίβα και όχι σταθεροί κανόνες· διαφέρουν από γεννήτρια σε γεννήτρια και από έκδοση σε έκδοση.

Πώς να πάρετε καλύτερο κείμενο όταν δημιουργείτε μια εικόνα

  1. Βάλτε τις ακριβείς λέξεις μέσα σε εισαγωγικά. Για παράδειγμα, ζητήστε μια αφίσα με τον τίτλο «NIGHT MARKET» και όχι μια αφίσα για μια νυχτερινή αγορά.
  2. Κρατήστε το κείμενο σύντομο. Λίγες λέξεις σε μεγάλο μέγεθος είναι ευκολότερο να βγουν σωστές από μια ολόκληρη πρόταση. Βάλτε το μεγαλύτερο κείμενο σε μια λεζάντα ή σε μια ιστοσελίδα.
  3. Πείτε πού μπαίνει το κείμενο. Περιγράψτε τη θέση και το μέγεθος, όπως «μεγάλος τίτλος σε όλο το πάνω μέρος» ή «μικρή ετικέτα στο βάζο».
  4. Ζητήστε απλά γράμματα. Τα έντονα, καθαρά κεφαλαία γράμματα σε απλή περιοχή είναι ευκολότερο για ένα μοντέλο να τα σχεδιάσει από καλλιγραφικά διακοσμητικά γράμματα πάνω από φόντο με πολλές λεπτομέρειες.
  5. Φτιάξτε αρκετές εκδοχές. Δημιουργήστε μερικές επιλογές, διαλέξτε αυτή με την καλύτερη ορθογραφία και διορθώστε μόνο ό,τι απομένει.
  6. Προσθέστε το ακριβές κείμενο αργότερα όταν έχει σημασία. Για ένα μενού, έναν τιμοκατάλογο ή οτιδήποτε έχει μικρά γράμματα, δημιουργήστε την εικόνα με κενό χώρο και στήστε το κείμενο σε ένα εργαλείο σχεδίασης. Έτσι η διατύπωση πληκτρολογείται και δεν σχεδιάζεται.

Πώς να διορθώσετε το κείμενο μετά

Αν η εικόνα είναι σωστή αλλά οι λέξεις είναι λάθος, έχετε τέσσερις βασικές επιλογές, ταξινομημένες εδώ από τη μικρότερη έως τη μεγαλύτερη προσπάθεια.

ΜέθοδοςΠροσπάθειαΤι άλλο μπορεί να αλλάξειΙδανική όταν
Νέα δημιουργία της εικόναςΧαμηλήΤα πάντα, επειδή παίρνετε νέα εικόναΟλόκληρη η εικόνα είναι λάθος ή δεν σας πειράζει να χάσετε αυτή την εκδοχή
Επιλογή και επεξεργασία στη γεννήτριαΧαμηλήΜπορεί να σχεδιαστούν ξανά και κοντινές περιοχέςΘέλετε μια γρήγορη διόρθωση στο ίδιο εργαλείο
Εργαλείο αντικατάστασης κειμένου με AIΧαμηλή έως μέτριαΗ περιοχή του κειμένου σχεδιάζεται ξανά, γι’ αυτό ελέγξτε το αποτέλεσμαΗ εικόνα είναι σωστή και μόνο οι λέξεις είναι λάθος
Χειροκίνητη διόρθωση σε πρόγραμμα επεξεργασίας εικόναςΥψηλήΜόνο ό,τι αλλάξετεΧρειάζεστε πλήρη έλεγχο, για παράδειγμα για εκτύπωση ή δουλειά για πελάτες

Δημιουργήστε ξανά την εικόνα

Η νέα δημιουργία θέλει λίγη προσπάθεια, αλλά το αποτέλεσμα είναι τυχαίο. Μια νέα προσπάθεια μπορεί να διορθώσει τη λέξη και να χαλάσει κάτι άλλο, όπως ένα πρόσωπο, ένα χέρι ή τη διάταξη. Χρησιμοποιήστε την όταν δεν έχετε ξοδέψει ακόμη πολύ χρόνο σε αυτή ακριβώς την εικόνα.

Επιλέξτε και επεξεργαστείτε μέσα στη γεννήτρια

Ορισμένες γεννήτριες σάς αφήνουν να σημειώσετε μια περιοχή και να περιγράψετε μια αλλαγή. Στο ChatGPT, για παράδειγμα, μπορείτε να επισημάνετε το κείμενο με ένα εργαλείο επιλογής και να πληκτρολογήσετε τι πρέπει να λέει. Το κέντρο βοήθειας της OpenAI σημειώνει ότι οι επισημάνσεις δεν είναι πάντα ακριβείς, οπότε μπορεί να αλλάξουν και λεπτομέρειες κοντά στο κείμενο. Για πιο προσεκτική ματιά, δείτε αν μπορεί το ChatGPT να αλλάξει κείμενο σε εικόνα.

Χρησιμοποιήστε ένα εργαλείο αντικατάστασης κειμένου με AI

Ένα εργαλείο αντικατάστασης κειμένου αναγνωρίζει το κείμενο της εικόνας για εσάς, οπότε πληκτρολογείτε μόνο τη σωστή ορθογραφία. Με το EditText.ai, για παράδειγμα, αλλάζετε κείμενο σε εικόνα γραμμή προς γραμμή και κάθε γραμμή σχεδιάζεται ξανά με την εμφάνιση των αρχικών γραμμάτων και του φόντου. Για ένα μόνο λάθος γράμμα ή λέξη, δείτε πώς να διορθώσετε ένα τυπογραφικό λάθος σε εικόνα. Για τίτλους και διακοσμητικά γράμματα σε σχέδια εκδηλώσεων, δείτε πώς να αλλάξετε το κείμενο σε αφίσα ή φυλλάδιο.

Πριν: ρετρό εικονογράφηση που δημιουργήθηκε από AI, με έναν δρόμο της Νέας Υόρκης τη νύχτα και μια ψηλή κόκκινη επιγραφή νέον που γράφει το ακατανόητο NEYAHRD
Μετά: η ίδια εικονογράφηση με την κόκκινη επιγραφή νέον να γράφει πλέον THEATER, ενώ τα κτίρια του ορίζοντα, τα ταξί και ο τίτλος NEW YORK μένουν ίδια

Πριν και μετά: μια αλλοιωμένη επιγραφή νέον σε μια εικόνα AI, διορθωμένη πληκτρολογώντας THEATER στο EditText.ai.

Τα αποτελέσματα μπορεί να διαφέρουν, ειδικά με ασυνήθιστα γράμματα ή λεπτομερή φόντα. Επειδή και η νέα σχεδίαση γίνεται από μοντέλο εικόνας, διαβάστε κάθε νέα λέξη γράμμα προς γράμμα σε πλήρες μέγεθος. Κάθε αναγνώριση κειμένου μπορεί επίσης να διαβάσει λάθος αλλοιωμένα γράμματα, γι’ αυτό βεβαιωθείτε ότι κάθε γραμμή που αναγνωρίστηκε είναι αυτή που θέλατε να αλλάξετε.

Διορθώστε το χειροκίνητα

Στο Photoshop, στο Photopea ή σε παρόμοιο πρόγραμμα επεξεργασίας, αφαιρείτε τα χαλασμένα γράμματα, ξαναχτίζετε το φόντο και στήνετε νέο κείμενο σε μια γραμματοσειρά. Αυτό σάς δίνει τον μεγαλύτερο έλεγχο και ταιριάζει σε δουλειές εκτύπωσης ή σε δουλειές για πελάτες, αλλά απαιτεί δεξιότητα και χρόνο. Τα γράμματα που φτιάχνει το AI συχνά δεν είναι πραγματική γραμματοσειρά, οπότε ένα εργαλείο εύρεσης γραμματοσειράς μπορεί να μη βρει αντιστοίχιση. Διαβάστε πώς να αναγνωρίσετε γραμματοσειρά από εικόνα για τρόπους να βρείτε μια κοντινή αντικατάσταση.

Ένας απλός κανόνας βοηθά στην επιλογή: αν ολόκληρη η εικόνα είναι λάθος, δημιουργήστε την ξανά. Αν μόνο οι λέξεις είναι λάθος, διορθώστε τις λέξεις.

Άλλες επιλογές

Μπορείτε επίσης να αφαιρέσετε κείμενο από εικόνα εντελώς και να στήσετε πραγματικό κείμενο πάνω στο καθαρό φόντο σε ένα εργαλείο σχεδίασης, μια καλή προσέγγιση για μενού και τιμοκαταλόγους. Μόλις η διατύπωση είναι σωστή, μπορείτε να μεταφράσετε κείμενο σε εικόνα για να φτιάξετε εκδοχές σε άλλες γλώσσες.

Επεξεργαστείτε μόνο εικόνες που σας ανήκουν ή που έχετε άδεια να αλλάξετε, μην αφαιρείτε υδατογραφήματα ή αναφορές δημιουργών και κρατήστε τυχόν ετικέτες εικόνων AI που απαιτεί μια πλατφόρμα.

Διορθώστε τις λέξεις και κρατήστε την εικόνα

Αν η εικόνα είναι σωστή αλλά η ορθογραφία είναι λάθος, δεν χρειάζεται να ξεκινήσετε από την αρχή. Μεταφορτώστε την εικόνα σας για να διορθώσετε το κείμενο σε εικόνες AI με το EditText.ai, πληκτρολογήστε τις σωστές λέξεις για κάθε γραμμή και ελέγξτε το αποτέλεσμα πριν το κατεβάσετε.

Συχνές ερωτήσεις

Γιατί το AI χαλάει το κείμενο στις εικόνες;

Οι γεννήτριες εικόνων AI σχεδιάζουν το κείμενο ως σχήματα αντί να το πληκτρολογούν ως γράμματα και πολλές διαβάζουν τα prompts σε κομμάτια λέξεων και όχι σε μεμονωμένους χαρακτήρες. Το κείμενο είναι επίσης μια μικρή λεπτομέρεια με αυστηρούς κανόνες, οπότε μια λάθος γραμμή ξεχωρίζει. Οι εικόνες εκπαίδευσης δείχνουν συχνά κείμενο που είναι μικρό, θολό ή υπό γωνία, κάτι που δίνει στα μοντέλα λιγότερα καθαρά παραδείγματα για να μάθουν.

Γιατί το AI γράφει ακατανόητο κείμενο αντί για πραγματικές λέξεις;

Όταν ένα μοντέλο δεν είναι σίγουρο για το πώς γράφεται μια λέξη, σχεδιάζει παρ’ όλα αυτά σχήματα που μοιάζουν με γράμματα, επειδή έτσι μοιάζει το κείμενο στις εικόνες εκπαίδευσής του. Το αποτέλεσμα μπορεί να είναι σημάδια που θυμίζουν γράμματα, μικτά αλφάβητα ή επινοημένες λέξεις. Συμβαίνει περισσότερο με μεγάλο κείμενο, μικρά γράμματα και ασυνήθιστες λέξεις και λιγότερο με μια σύντομη φράση μέσα σε εισαγωγικά.

Ποια γεννήτρια εικόνων AI είναι η καλύτερη στο κείμενο;

Δεν υπάρχει μόνιμη απάντηση, επειδή τα μοντέλα αλλάζουν συχνά και κάθε νέα έκδοση μπορεί να συμπεριφέρεται διαφορετικά. Γενικά, οι πρόσφατες γεννήτριες χειρίζονται το σύντομο, μεγάλο κείμενο καλύτερα από τις παλαιότερες. Το πιο χρήσιμο τεστ είναι το δικό σας prompt: δημιουργήστε την ίδια σύντομη φράση στα εργαλεία που έχετε πρόσβαση και έπειτα ελέγξτε την ορθογραφία γράμμα προς γράμμα πριν διαλέξετε ένα.

Μπορώ να διορθώσω ανορθόγραφο κείμενο σε εικόνα AI χωρίς να τη δημιουργήσω ξανά;

Ναι. Μπορείτε να επιλέξετε την περιοχή και να περιγράψετε τη διόρθωση στην ίδια γεννήτρια, να ξαναγράψετε το κείμενο στο χέρι σε ένα πρόγραμμα επεξεργασίας όπως το Photoshop ή το Photopea ή να χρησιμοποιήσετε ένα εργαλείο αντικατάστασης κειμένου που αναγνωρίζει τις λέξεις ώστε να πληκτρολογήσετε τη σωστή ορθογραφία. Όποια μέθοδο κι αν χρησιμοποιήσετε, συγκρίνετε το αποτέλεσμα με το πρωτότυπο για να εντοπίσετε αλλαγές κοντά στο κείμενο.

Γιατί ένα εργαλείο εύρεσης γραμματοσειράς δεν αναγνωρίζει τα γράμματα της εικόνας AI μου;

Οι γεννήτριες AI συνήθως σχεδιάζουν γράμματα από μοτίβα που έμαθαν και όχι από ένα εγκατεστημένο αρχείο γραμματοσειράς. Τα γράμματα μπορεί να συνδυάζουν χαρακτηριστικά από πολλές γραμματοσειρές ή να αλλάζουν σχήμα από γράμμα σε γράμμα. Ένα εργαλείο αναγνώρισης γραμματοσειράς μπορεί παρ’ όλα αυτά να προτείνει παρόμοιες γραμματοσειρές, κάτι που βοηθά αν σκοπεύετε να ξαναγράψετε το κείμενο, αλλά μια ακριβής αντιστοίχιση συχνά δεν υπάρχει.