글자 깨짐 복구
café를 café로 되돌리는 것처럼 UTF-8 바이트가 서양 단일 바이트 인코딩으로 잘못 읽힌 경우를 복구합니다. 사용자가 원래 잘못 적용된 인코딩과 복구 횟수를 지정하며, 모든 문자 깨짐을 자동으로 고치는 도구는 아닙니다.
주요 기능
- Latin-1 또는 Windows-1252 문자를 원래 바이트로 되돌린 뒤 UTF-8로 엄격하게 읽습니다.
- 다시 UTF-8로 인코딩했을 때 같은 바이트가 되는지 검사해 되돌릴 수 있는 경우만 출력합니다.
- 한 번에서 세 번까지 복구 횟수를 직접 지정해 반복된 잘못된 인코딩을 처리합니다.
사용 방법
- 깨진 부분의 텍스트를 붙여넣습니다. 이미 정상인 한글과 혼합되어 있다면 깨진 부분만 분리합니다.
- 잘못 적용된 인코딩을 선택합니다. 우선 Windows-1252와 복구 1회를 기준으로 확인할 수 있습니다.
- 실행하고 결과를 확인합니다. 오류가 나면 인코딩이나 횟수를 바꾸거나 원본 파일의 실제 인코딩을 확인합니다.
활용 예시
- café 같은 서유럽 문자 깨짐 복구
- UTF-8 한글이 안녕처럼 보이는 문자열 복원
- 여러 번 잘못 인코딩한 로그나 내보내기 결과의 제한적 복구
자주 묻는 질문
한글이 깨진 경우에도 사용할 수 있나요?
UTF-8 한글 바이트를 Latin-1 또는 Windows-1252로 읽은 경우에는 가능합니다. 예를 들어 Windows-1252의 안녕는 안녕으로 복구됩니다. EUC-KR·CP949 등 다른 방식으로 잘못 읽은 경우는 지원하지 않습니다.
�나 물음표로 바뀐 글자도 복구되나요?
�는 원래 바이트 정보를 잃었다는 뜻일 수 있어 오류로 처리합니다. 이미 ?로 치환된 정보도 복원할 수 없습니다. 다만 ?는 원래 정상 문자일 수도 있어 도구가 모든 손실을 자동 판별하지는 못합니다.
복구 횟수는 어떻게 고르나요?
한 번 잘못 읽혔다면 1회, 잘못된 문자열을 다시 UTF-8로 저장하고 또 잘못 읽었다면 2회가 필요할 수 있습니다. 예를 들어 café는 2회로 café가 됩니다. 지나치게 많은 횟수는 오류가 날 수 있습니다.
정상 텍스트를 넣으면 어떻게 되나요?
ASCII 문자만 있으면 결과가 같을 수 있습니다. 이미 정상인 한글이나 해당 단일 바이트 인코딩으로 표현할 수 없는 문자는 거부하며, 정상인 é도 혼자서는 유효한 UTF-8 바이트열이 아니므로 오류가 날 수 있습니다.
원본 파일의 인코딩을 감지하거나 변경하나요?
아니요. 파일의 원시 바이트를 업로드하거나 자동 감지하지 않습니다. 복사한 문자열에 남아 있는 정보를 제한된 두 인코딩 방식으로 역변환합니다. 바이트가 손실됐다면 올바른 인코딩으로 원본을 다시 읽어야 합니다.
개인정보 안내
입력과 결과는 현재 브라우저 메모리에서 처리하며 이 도구가 내용을 서버로 전송하거나 저장하지 않습니다. 사이트 공통 광고·방문 분석과 도구 사용 집계는 별도로 작동할 수 있으며, 입력 내용은 해당 집계에 포함하지 않습니다.
댓글과 질문