AI 이미지 생성기가 철자를 자주 틀리는 이유는 텍스트가 아니라 그림을 그리기 때문입니다. 글자를 모양과 픽셀 패턴으로 학습하고 단어를 한 글자씩 입력하는 일은 하지 않으므로, 작은 실수 하나가 “BAKERY”를 “BAKRERY”로 바꿔 놓을 수 있습니다. 많은 생성기가 프롬프트도 개별 글자가 아니라 단어 조각 단위로 읽기 때문에 정확한 철자는 더 어려워집니다.
최신 생성기는 초기 모델보다 짧은 텍스트를 훨씬 잘 다루지만, 긴 문장, 작은 글자, 흔치 않은 이름, 라틴 문자가 아닌 문자에서는 여전히 실수가 생깁니다. 이미 글자가 깨진 이미지가 있다면 처음부터 다시 만들지 않고 AI 이미지 속 깨진 글자를 수정할 수 있는 경우가 많습니다. 이 가이드는 오류가 생기는 이유, 더 나은 글자를 얻기 위한 프롬프트 작성법, 나중에 고치는 방법을 설명하며, 이미지가 Midjourney, ChatGPT, Gemini, Stable Diffusion, 그 밖의 어떤 생성기에서 나왔든 적용됩니다.
AI 이미지 생성기가 그림을 만드는 방식
인기 있는 이미지 생성기 중에는 확산 모델이라는 방식을 쓰는 것이 많습니다. 이 모델은 화면에 지지직거리는 잡음 같은 무작위 노이즈에서 시작해, 여러 단계를 거치며 단계마다 노이즈를 조금씩 제거합니다. 프롬프트가 모든 단계를 이끌기 때문에 노이즈는 서서히 설명과 맞는 그림으로 바뀝니다. 이미지 전체가 함께 다듬어져서 하늘, 얼굴, 글자가 동시에 형태를 갖춥니다.
모든 생성기가 이렇게 작동하는 것은 아닙니다. 이미지를 작은 조각의 연속으로 만드는 방식도 있습니다. 하지만 일반적으로 텍스트-이미지 모델에는 한 가지 중요한 공통점이 있습니다. 그림이 어떤 모습이어야 하는지 예측한다는 점입니다. 모델이 폰트를 고르고 “B”, “A”, “K”를 차례로 입력하는 단계는 없습니다. 글자는 그럴듯해 보이는 모양으로만 나타나기 때문에 거의 맞지만 완전히 맞지는 않은 글자가 나올 수 있습니다.
이미지 생성기에게 글자가 그렇게 어려운 이유
여러 원인이 함께 작용합니다. 각각 작은 오류가 생길 가능성을 높이는데, 글자는 작은 오류가 눈에 잘 띄는 곳입니다.
글자는 엄격한 규칙이 있는 작은 디테일입니다
나무는 가지가 몇 개든 여전히 나무처럼 보입니다. 하지만 단어의 올바른 철자는 정확히 하나뿐입니다. 글자에는 단어 전체에 적용되는 규칙도 있습니다. 모든 글자의 스타일과 높이가 같아야 하고, 간격이 고르며, 글자들이 같은 줄 위에 놓여야 합니다. 획이 하나 더 붙거나, 글자가 빠지거나, 같은 글자가 두 번 들어가면 이미지의 나머지가 사실적으로 보여도 그 언어를 읽는 사람이라면 누구나 바로 알아봅니다.
모델은 내가 입력한 글자를 아예 보지 못할 수도 있습니다
생성기가 프롬프트를 사용하려면 먼저 텍스트 인코더라는 구성 요소가 프롬프트를 숫자로 바꿉니다. 많은 텍스트 인코더는 먼저 프롬프트를 토큰으로 나눕니다. 흔한 단어는 토큰 하나가 되는 경우가 많고, 드문 단어는 여러 조각으로 쪼개집니다. 이 조각을 만드는 데 널리 쓰이는 방법이 바이트 페어 인코딩입니다. 효율적인 방식이지만 모델은 각 조각 안의 글자가 아니라 조각마다 부여된 ID를 받습니다. 어떤 조각이 어떤 글자 배열로 그려지는지는 예시를 통해 배워야 합니다.
Google Research의 논문 Character-Aware Models Improve Visual Text Rendering이 이 문제를 직접 연구했습니다. 연구진은 개별 문자를 보는 텍스트 인코더(“character-aware”)와 단어 조각만 보는 인코더(“character-blind”)를 비교했습니다. 문자를 인식하는 인코더를 쓴 이미지 모델이 이미지 속 텍스트를 더 정확하게 그렸고, 드문 단어에서 특히 강했습니다. 또한 아주 큰 character-blind 언어 모델은 철자를 잘 배울 수 있지만 이 능력이 영어 밖으로는 잘 이어지지 않았고, 당시 이미지 생성기가 주로 쓰던 텍스트 인코더보다 훨씬 큰 모델에서만 나타났다는 점도 확인했습니다.
학습용 이미지에는 글자가 제대로 담겨 있지 않은 경우가 많습니다
생성기는 설명이 붙은 아주 큰 이미지 모음으로 학습합니다. 그런 이미지 속 글자는 작거나, 흐리거나, 잘려 있거나, 비스듬히 보이거나, 일부가 가려진 경우가 많고, 폰트와 스타일도 매우 다양합니다. 이미지에 붙은 설명이 그 글자를 전혀 언급하지 않을 수도 있습니다. 그래서 모델은 글자가 대체로 어떻게 생겼는지에 대한 예시는 많이 보지만, 특정 단어의 정확한 철자에 대한 선명한 예시는 적게 봅니다.
작은 글자는 픽셀이 아주 적습니다
제목은 수백 픽셀에 걸칠 수 있지만, 작은 글씨 한 단어는 글자당 몇 픽셀밖에 쓰지 못할 수 있습니다. 많은 생성기는 이미지를 압축한 버전으로 작업한 뒤 마지막에 원래 크기로 복원하기 때문에 작은 디테일이 들어갈 자리가 더 줄어듭니다. 소문자 “e”의 가로획 같은 가는 선은 사라지기 쉽습니다.
최신 모델이 글자를 더 잘 쓰는 이유
이미지 생성기는 짧은 제목과 라벨을 훨씬 잘 쓰게 되었습니다. 일반적으로 최신 시스템은 프롬프트를 이해하는 데 더 강력한 언어 모델을 쓰고, 개발자들이 학습 과정에서 글자에 더 많은 관심을 기울였습니다. 위의 연구도 같은 방향을 가리킵니다. 글자에 관한 더 좋은 정보를 받는 모델이 글자를 더 정확하게 그립니다.
개선은 분명하지만 고르지는 않습니다. 세 단어짜리 제목은 정확하게 쓰는 생성기도 문단, 메뉴, 학습 중에 덜 접한 언어로 된 라벨에서는 여전히 어려움을 겪을 수 있습니다.
AI 이미지 생성기가 여전히 어려워하는 경우
- 긴 글. 문단, 메뉴, 목록처럼 단어가 하나 늘 때마다 오류가 생길 기회도 늘어나는 경우
- 작은 글자. 작은 글씨, 라벨, 장면 속 멀리 있는 글자
- 흔치 않은 단어. 이름, 지어낸 단어, 새로운 용어, 전화번호나 코드 같은 긴 숫자
- 라틴 문자가 아닌 문자. 아랍어, 중국어, 힌디어, 일본어, 한국어, 태국어 등 다른 문자 체계와 악센트가 붙은 글자
- 여러 개의 텍스트 블록. 따로 떨어진 글자 덩어리가 여러 개 있는 포스터와 인포그래픽
- 휘어지거나 비스듬한 면. 병, 깃발, 옆에서 본 간판 위의 글자
- 일관성. 연속된 여러 이미지에서 같은 문구를 똑같이 유지하는 일
이는 고정된 규칙이 아니라 흔한 경향이며, 생성기와 버전에 따라 다릅니다.
이미지를 생성할 때 글자를 더 잘 얻는 방법
- 정확한 문구를 따옴표 안에 넣으세요. 예를 들어 야시장에 관한 포스터를 요청하는 대신, 제목이 “NIGHT MARKET”인 포스터를 요청하세요.
- 글자는 짧게 유지하세요. 큰 크기의 몇 단어는 완전한 문장보다 정확하게 얻기 쉽습니다. 더 긴 글은 캡션이나 웹 페이지에 넣으세요.
- 글자가 들어갈 위치를 말하세요. “상단 전체에 걸친 큰 제목”이나 “병에 붙은 작은 라벨”처럼 위치와 크기를 설명하세요.
- 단순한 글자체를 요청하세요. 굵고 깔끔한 대문자를 단순한 영역 위에 놓는 편이 복잡한 배경 위의 장식적인 필기체보다 모델이 그리기 쉽습니다.
- 여러 버전을 만드세요. 몇 가지 결과를 생성해 철자가 가장 정확한 것을 고르고, 남은 부분만 고치세요.
- 중요한 글자는 나중에 정확하게 추가하세요. 메뉴, 가격표, 작은 글씨가 있는 것이라면 빈 공간을 둔 채 이미지를 생성하고 디자인 도구에서 글자를 입력하세요. 그러면 문구가 그려지는 것이 아니라 입력됩니다.
나중에 글자를 고치는 방법
그림은 맞는데 글자가 틀렸다면 크게 네 가지 선택지가 있습니다. 손이 가장 적게 가는 순서부터 소개합니다.
| 방법 | 필요한 노력 | 달라질 수 있는 다른 부분 | 가장 알맞은 경우 |
|---|---|---|---|
| 이미지 다시 생성 | 낮음 | 새 그림이 나오므로 전부 | 이미지 전체가 잘못됐거나 이 버전을 잃어도 괜찮을 때 |
| 생성기에서 선택해 수정 | 낮음 | 주변 영역도 다시 그려질 수 있음 | 같은 도구에서 빠르게 고치고 싶을 때 |
| AI 글자 교체 도구 | 낮음~중간 | 글자 영역이 다시 그려지므로 결과를 확인해야 함 | 그림은 맞고 글자만 틀렸을 때 |
| 이미지 편집기에서 직접 수정 | 높음 | 바꾼 부분만 | 인쇄물이나 고객 작업처럼 모든 것을 직접 제어해야 할 때 |
이미지 다시 생성하기
다시 생성하는 데는 노력이 거의 들지 않지만 결과는 무작위입니다. 새로 시도하면 단어는 고쳐져도 얼굴, 손, 레이아웃 같은 다른 부분이 망가질 수 있습니다. 이 이미지에 아직 시간을 많이 들이지 않았을 때 쓰세요.
생성기 안에서 선택해 수정하기
일부 생성기는 영역을 표시하고 변경 내용을 설명할 수 있게 해 줍니다. 예를 들어 ChatGPT에서는 선택 도구로 글자를 강조 표시하고 어떻게 써야 하는지 입력할 수 있습니다. OpenAI 도움말 센터는 강조 표시가 항상 정확하지는 않아서 글자 근처의 디테일도 바뀔 수 있다고 안내합니다. 자세한 내용은 ChatGPT로 이미지 글자를 수정할 수 있을까를 참고하세요.
AI 글자 교체 도구 사용하기
글자 교체 도구는 이미지 속 글자를 대신 감지해 주므로 올바른 철자만 입력하면 됩니다. 예를 들어 EditText.ai에서는 줄 단위로 이미지 글자 수정을 하며, 각 줄은 원래 글자와 배경의 모양에 맞춰 다시 그려집니다. 글자 하나나 단어 하나만 틀렸다면 이미지 오타 수정 방법을 참고하세요. 행사 디자인의 제목이나 디스플레이 글자는 포스터 문구 수정 방법을 참고하세요.


수정 전후: AI 이미지 속 깨진 네온사인을 EditText.ai에서 THEATER를 입력해 바로잡았습니다.
특히 독특한 글자 모양이나 복잡한 배경에서는 결과가 달라질 수 있습니다. 다시 그리는 작업도 이미지 모델이 하므로 새로 쓴 단어를 실제 크기로 한 글자씩 읽어 보세요. 텍스트 감지는 깨진 글자를 잘못 읽을 수도 있으므로, 감지된 줄이 내가 바꾸려던 줄인지 확인하세요.
직접 고치기
Photoshop, Photopea 같은 편집기에서는 깨진 글자를 지우고 배경을 복원한 다음 폰트로 새 글자를 입력합니다. 모든 것을 가장 세밀하게 직접 제어할 수 있어 인쇄물이나 고객 작업에 알맞지만 기술과 시간이 필요합니다. AI가 만든 글자는 실제 폰트가 아닌 경우가 많아서 폰트 찾기 도구가 일치하는 폰트를 찾지 못할 수 있습니다. 비슷한 대체 폰트를 찾는 방법은 이미지에서 폰트 찾는 방법에서 확인하세요.
간단한 기준이 있습니다. 이미지 전체가 잘못됐다면 다시 생성하고, 글자만 잘못됐다면 글자를 고치세요.
그 밖의 방법
이미지 글자 지우기로 글자를 완전히 없앤 다음 깨끗해진 배경 위에 디자인 도구에서 진짜 글자를 입력할 수도 있으며, 메뉴나 가격표에 좋은 방법입니다. 문구가 정확해지면 이미지 속 글자 번역으로 다른 언어 버전을 만들 수 있습니다.
내가 소유했거나 변경할 권리가 있는 이미지만 편집하고, 워터마크나 제작자 크레딧을 지우지 말며, 플랫폼이 요구하는 AI 이미지 표시는 그대로 유지하세요.
그림은 그대로 두고 글자만 고치기
이미지는 맞는데 철자만 틀렸다면 처음부터 다시 만들 필요가 없습니다. EditText.ai에 업로드해 AI 이미지 속 깨진 글자를 수정하고, 줄마다 올바른 문구를 입력한 다음 다운로드하기 전에 결과를 확인하세요.
자주 묻는 질문
AI는 왜 이미지 속 글자를 망치나요?
AI 이미지 생성기는 글자를 문자로 입력하는 대신 모양으로 그리고, 많은 생성기가 프롬프트를 개별 문자가 아니라 단어 조각 단위로 읽습니다. 글자는 엄격한 규칙이 있는 작은 디테일이라서 획 하나만 틀려도 눈에 띕니다. 학습용 이미지에는 작거나 흐리거나 비스듬한 글자가 자주 나와서 모델이 배울 선명한 예시가 적습니다.
AI는 왜 실제 단어 대신 의미 없는 글자를 쓰나요?
모델은 단어의 철자를 확신하지 못해도 글자처럼 보이는 모양을 그립니다. 학습용 이미지 속 글자가 그렇게 생겼기 때문입니다. 그 결과 글자 비슷한 무늬, 뒤섞인 알파벳, 지어낸 단어가 나올 수 있습니다. 긴 글, 작은 글자, 흔치 않은 단어에서 가장 자주 생기고, 따옴표로 묶은 짧은 문구에서는 덜 생깁니다.
글자를 가장 잘 쓰는 AI 이미지 생성기는 무엇인가요?
영구적인 답은 없습니다. 모델이 자주 바뀌고 새 버전마다 동작이 달라질 수 있기 때문입니다. 일반적으로 최근 생성기는 이전 생성기보다 짧고 큰 글자를 더 잘 다룹니다. 가장 유용한 시험은 내 프롬프트로 해 보는 것입니다. 쓸 수 있는 도구에서 같은 짧은 문구를 생성한 다음, 하나를 고르기 전에 철자를 한 글자씩 확인하세요.
AI 이미지의 철자가 틀린 글자를 다시 생성하지 않고 고칠 수 있나요?
네. 같은 생성기에서 영역을 선택해 수정 내용을 설명하거나, Photoshop이나 Photopea 같은 편집기에서 직접 글자를 다시 입력하거나, 글자를 감지해 올바른 철자를 입력할 수 있게 해 주는 글자 교체 도구를 쓸 수 있습니다. 어떤 방법을 쓰든 결과를 원본과 비교해 글자 근처의 변화를 확인하세요.
폰트 찾기 도구가 내 AI 이미지의 글자를 알아내지 못하는 이유는 무엇인가요?
AI 생성기는 대개 설치된 폰트 파일이 아니라 학습한 패턴으로 글자를 그립니다. 글자가 여러 서체의 특징을 섞고 있거나 글자마다 모양이 달라질 수 있습니다. 폰트 찾기 도구가 비슷한 폰트를 추천해 줄 수는 있으며 글자를 다시 입력할 계획이라면 도움이 되지만, 정확히 일치하는 폰트는 없는 경우가 많습니다.