도구 가이드
겉보기에 같은 글자인데 시스템에서 다르게 취급되는 경우가 있습니다. 일반 공백과 줄바꿈 없는 공백, 하이픈과 대시, 조합형 한글과 완성형 한글처럼 눈으로는 구분되지 않는 문자들이 원인입니다.
이 도구는 텍스트의 각 문자를 U+ 코드 포인트, 10진수 값, UTF-8과 UTF-16 바이트로 분해해 보여 줍니다. 데이터가 일치하지 않는 원인이나 검색이 안 되는 이유를 찾을 때 결정적인 단서를 줍니다.
보이지 않는 제어 문자나 방향 지정 문자가 섞여 있는지 확인할 때도 유용합니다. 처리는 브라우저 안에서만 이루어집니다.
사용 방법
- 분석할 텍스트를 입력합니다.
- 각 문자의 코드 포인트를 확인합니다.
- 예상과 다른 문자가 섞여 있는지 찾습니다.
- 해당 문자를 정상 문자로 교체합니다.
이럴 때 유용해요
- 복사한 텍스트가 검색되지 않는 원인을 찾을 때
- 데이터 비교가 실패하는 이유를 확인할 때
- 보이지 않는 제어 문자를 찾아낼 때
- 인코딩 문제를 디버깅할 때
사용 팁
- 웹에서 복사한 텍스트에는 줄바꿈 없는 공백(U+00A0)이 자주 섞입니다. 일반 공백과 다른 문자입니다.
- 한글은 완성형 한 글자로 저장될 수도, 자모가 결합된 형태로 저장될 수도 있습니다. 보기에는 같지만 다른 데이터입니다.
- 찾아낸 문제 문자는 찾아 바꾸기 도구로 정상 문자로 일괄 교체하면 됩니다.