AI генератори слика имају проблема са правописом јер цртају слике, а не текст. Они уче како слова изгледају као облици и обрасци пиксела и никада не куцају реч слово по слово, па мала грешка може да претвори „BAKERY” у „BAKRERY”. Многи од њих ваш упит читају и у деловима речи, а не у појединачним словима, што тачан правопис чини још тежим.
Новији генератори много боље обрађују кратак текст него први генератори, али дуги пасуси, ситна слова, необична имена и нелатинична писма и даље изазивају грешке. Ако већ имате слику са поквареним речима, често можете да исправите текст на AI сликама а да не почињете испочетка. Овај водич објашњава зашто грешке настају, како да формулишете упит за бољи текст и како да га исправите након тога, без обзира на то да ли је слика настала помоћу Midjourney, ChatGPT, Gemini, Stable Diffusion или другог генератора.
Како AI генератори слика стварају слику
Многи популарни генератори слика користе метод који се зове дифузиони модел. Модел креће од насумичног шума, налик сметњама на екрану, и у сваком од многих корака уклања мало тог шума. Ваш упит води сваки корак, па се шум полако претвара у слику која одговара вашем опису. Цела слика се усавршава заједно: небо, лица и слова добијају облик истовремено.
Не ради сваки генератор на овај начин. Неки уместо тога граде слику као низ малих делова. Али генерално, модели за претварање текста у слику деле једну важну особину: они предвиђају како слика треба да изгледа. Не постоји корак у коме модел бира фонт и куца „B”, затим „A”, па „K”. Слова се појављују само као облици који делују исправно, због чега могу испасти скоро исправна, али не сасвим.
Зашто је текст толико тежак за генераторе слика
Неколико узрока делује заједно. Сваки од њих чини малу грешку вероватнијом, а текст је место где се мале грешке лако виде.
Слова су ситни детаљи са строгим правилима
Дрво може да има било који број грана и да и даље изгледа као дрво. Реч има тачно један исправан правопис. Текст има и правила која важе за целу реч: свако слово мора да има исти стил и висину, размак мора бити уједначен, а слова морају да стоје на истој линији. Један сувишан потез, слово које недостаје или удвојено слово очигледни су свакоме ко чита тај језик, чак и када остатак слике изгледа стварно.
Модел можда никада не види слова која сте откуцали
Пре него што генератор може да употреби ваш упит, компонента која се зове текстуални енкодер претвара га у бројеве. Многи текстуални енкодери прво поделе упит на токене. Уобичајене речи често постају један токен, док се ређе речи разбијају на неколико делова. Широко коришћен метод за прављење ових делова је byte-pair encoding. Приступ је ефикасан, али модел за сваки део добија ознаку (ID), а не слова унутар њега. Мора да учи из примера да се одређени део исцртава као одређени низ слова.
Ово је директно проучавано у раду Google Research-а, Character-Aware Models Improve Visual Text Rendering. Истраживачи су упоредили текстуалне енкодере који виде појединачне знакове („character-aware”) са енкодерима који виде само делове речи („character-blind”). Модели за слике са енкодерима који виде знакове тачније су исцртавали текст на слици, а посебно су били јаки код ретких речи. Рад је такође открио да веома велики језички модели типа „character-blind” могу да науче да правилно пишу речи, али да се та способност није добро пренела ван енглеског и појавила се само у моделима далеко већим од текстуалних енкодера које су генератори слика у то време обично користили.
Слике за обуку често лоше приказују текст
Генератори уче из веома великих збирки слика упарених са описима. На тим сликама текст је често мали, мутан, одсечен, снимљен под углом или делимично скривен и појављује се у огромном броју фонтова и стилова. Опис упарен са сликом можда уопште не помиње њен текст. Зато модел види много примера тога како текст уопште изгледа, али мање јасних примера тога како тачно треба написати одређену реч.
Ситан текст има врло мало пиксела
Наслов може да се протеже на стотине пиксела, док реч ситним словима може да добије само неколико пиксела по слову. Многи генератори раде и на компримованој верзији слике, а слику пуне величине обнављају на крају, што оставља још мање простора за ситне детаље. Танке линије, као што је пречка у малом слову „e”, лако се изгубе.
Зашто новији модели боље пишу текст
Генератори слика су постали много бољи у кратким насловима и ознакама. Генерално, новији системи користе јаче језичке моделе да разумеју упит, а програмери су током обуке посветили више пажње тексту. Горе наведено истраживање указује у истом правцу: модели који добијају бољу информацију о словима тачније исцртавају текст.
Побољшање је стварно, али неуједначено. Генератор који исправно напише наслов од три речи и даље може да се мучи са пасусом, менијем или ознаком на језику који је током обуке видео ређе.
Где AI генератори слика и даље греше
- Дуг текст. Пасуси, менији и листе, где је свака додатна реч нова прилика за грешку
- Ситан текст. Ситна слова, ознаке и текст далеко у сцени
- Необичне речи. Имена, измишљене речи, нови појмови и дугачки бројеви као што су бројеви телефона или кодови
- Нелатинична писма. Арапско, кинеско, хинди, јапанско, корејско, тајландско и друга писма, као и слова са акцентима
- Много блокова текста. Плакати и инфографике са неколико одвојених делова текста
- Закривљене или накошене површине. Текст на флаши, застави или натпису виђеном са стране
- Доследност. Задржавање истог текста идентичним у низу слика
Ово су уобичајени обрасци, а не чврста правила, и разликују се од једног генератора и верзије до следеће.
Како да добијете бољи текст када стварате слику
- Тачне речи ставите под наводнике. На пример, затражите плакат са насловом „NIGHT MARKET”, а не плакат о ноћној пијаци.
- Текст нека буде кратак. Неколико речи у великој величини лакше је исправно добити него цела реченица. Дужи текст уместо тога ставите у натпис или на веб-страницу.
- Реците где текст иде. Опишите положај и величину, на пример „велики наслов преко врха” или „мала етикета на тегли”.
- Затражите једноставна слова. Подебљана, чиста велика слова на једноличној површини моделу је лакше нацртати него украсно рукописно писмо преко позадине пуне детаља.
- Направите неколико верзија. Генеришите неколико опција, изаберите ону са најбољим правописом и исправите само оно што је остало.
- Тачан текст додајте касније када је важан. За мени, ценовник или било шта са ситним словима генеришите слику са празним простором и поставите текст у алату за дизајн. Тако је текст откуцан, а не нацртан.
Како да исправите текст након тога
Ако је слика добра, а речи нису, имате четири главне опције. Ево их од оне која тражи најмање труда до оне која тражи највише.
| Метод | Труд | Шта се још може променити | Најбоље када |
|---|---|---|---|
| Поновно генерисање слике | Мало | Све, јер добијате нову слику | Цела слика је погрешна или вам не смета да изгубите ову верзију |
| Избор и измена у генератору | Мало | Оближње области могу бити поново исцртане | Желите брзу исправку у истом алату |
| Алат за замену текста помоћу AI | Мало до средње | Област текста се поново исцртава, зато проверите резултат | Слика је добра, а само су речи погрешне |
| Ручна исправка у уређивачу слика | Много | Само оно што промените | Потребна вам је потпуна контрола, на пример за штампу или рад за клијенте |
Поново генеришите слику
Поновно генерисање тражи мало труда, али је резултат насумичан. Нови покушај може да исправи реч, а да поквари нешто друго, као што су лице, рука или распоред. Користите га када још нисте потрошили много времена на баш ову слику.
Изаберите и измените у самом генератору
Неки генератори вам омогућавају да означите област и опишете промену. У ChatGPT-у, на пример, можете да алатком за избор обележите текст и упишете шта треба да пише. Центар за помоћ компаније OpenAI наводи да обележене области нису увек прецизне, па се и детаљи близу текста могу променити. За детаљнији увид погледајте може ли ChatGPT да измени текст на слици.
Користите алат за замену текста помоћу AI
Алат за замену текста сам препознаје текст на слици, па само уписујете исправан правопис. У EditText.ai, на пример, мењате текст на слици ред по ред, а сваки ред се поново исцртава у изгледу оригиналних слова и позадине. За једно погрешно слово или реч погледајте како да исправите словну грешку на слици. За наслове и украсна слова на дизајнима за догађаје погледајте како да измените текст на плакату.


Пре и после: изобличен неонски натпис на AI слици, исправљен уписивањем THEATER у EditText.ai.
Резултати могу да се разликују, посебно код необичних слова или детаљних позадина. Пошто поновно исцртавање такође обавља модел за слике, прочитајте сваку нову реч слово по слово у пуној величини. Свако препознавање текста може и да погрешно прочита изобличена слова, зато проверите да ли је сваки препознати ред баш онај који сте желели да промените.
Исправите ручно
У програмима Photoshop, Photopea или сличном уређивачу уклањате поломљена слова, обнављате позадину и постављате нови текст фонтом. Ово вам даје највећу контролу и погодно је за штампу или рад за клијенте, али захтева вештину и време. Слова која створи AI често нису прави фонт, па алат за препознавање фонтова можда неће пронаћи одговарајући фонт. Прочитајте како препознати фонт са слике за начине да пронађете блиску замену.
Једноставно правило помаже да изаберете: ако је цела слика погрешна, поново је генеришите. Ако су погрешне само речи, исправите речи.
Остале опције
Можете и да потпуно уклоните текст са слике и на чистој позадини у алату за дизајн поставите прави текст, што је добар приступ за меније и ценовнике. Када је текст исправан, можете да преведете текст на слици да направите верзије за друге језике.
Уређујте само слике које поседујете или за чију измену имате дозволу, не уклањајте водене жигове и ознаке ауторства и задржите све ознаке за AI слике које платформа захтева.
Исправите речи и задржите слику
Ако је слика добра, а правопис погрешан, не морате да почињете испочетка. Отпремите је да бисте у EditText.ai исправили текст на AI сликама, упишите исправне речи за сваки ред и проверите резултат пре него што га преузмете.
Честа питања
Зашто AI квари текст на сликама?
AI генератори слика исцртавају текст као облике уместо да га куцају као слова, а многи читају упите у деловима речи, а не у појединачним знаковима. Текст је и ситан детаљ са строгим правилима, па један погрешан потез упада у очи. Слике за обуку често приказују текст који је мали, мутан или под углом, што моделима даје мање јасних примера из којих уче.
Зашто AI пише бесмислице уместо правих речи?
Када модел није сигуран како се нека реч пише, ипак исцртава облике који личе на слова, јер тако текст изгледа на његовим сликама за обуку. Резултат могу бити знакови налик словима, помешана писма или измишљене речи. Најчешће се дешава код дугог текста, ситних слова и необичних речи, а ређе код кратке фразе под наводницима.
Који AI генератор слика је најбољи у раду са текстом?
Не постоји трајан одговор, јер се модели често мењају, а свака нова верзија може да се понаша другачије. Генерално, новији генератори боље обрађују кратак, крупан текст него старији. Најкориснији тест је ваш сопствени упит: генеришите исту кратку фразу у алатима којима имате приступ, па проверите правопис слово по слово пре него што изаберете један.
Могу ли да исправим погрешно написан текст на AI слици без поновног генерисања?
Да. Можете да изаберете област и опишете исправку у истом генератору, да текст ручно поново откуцате у уређивачу као што је Photoshop или Photopea или да употребите алат за замену текста који препознаје речи да бисте уписали исправан правопис. Који год метод да користите, упоредите резултат са оригиналом да бисте уочили промене поред текста.
Зашто алат за проналажење фонтова не може да препозна слова на мојој AI слици?
AI генератори обично исцртавају слова на основу образаца које су научили, а не из инсталиране датотеке фонта. Слова могу да мешају особине неколико фонтова или да мењају облик од слова до слова. Алат за препознавање фонтова и даље може да предложи сличне фонтове, што помаже ако планирате да поново откуцате текст, али тачан одговарајући фонт често не постоји.