HTML 엔티티 디코딩
&, ©, — 를 그것이 나타내는 문자로 되돌립니다. 이름 참조와 숫자 참조 모두 동작하고, 알아보지 못한 것은 그대로 둡니다.
부호화됨
텍스트
이 도구에 대하여
엔티티로 부호화된 텍스트는 HTML이 데이터로 저장된 곳이면 어디서든 나타납니다. 데이터베이스 컬럼, RSS 피드, 렌더링된 내용을 돌려주는 API, 로그 한 줄 같은 곳입니다. 디코딩은 원래 문자를 되살려 텍스트를 읽거나 처리할 수 있게 합니다. 숫자 참조는 이모지 같은 확장 평면 문자까지 온전히 다루고, 이름 참조는 실제 문서에 나타나는 범위를 담습니다. 알 수 없는 것은 일부러 쓰인 그대로 두어 조용히 바뀌는 일이 없게 합니다.
사용 방법
- 1부호화된 텍스트를 왼쪽 패널에 붙여넣습니다.
- 2오른쪽에서 디코딩된 결과를 읽습니다.
- 3아직 엔티티가 남아 있다면 이중 부호화된 것이니 결과를 한 번 더 디코딩하세요.
자주 묻는 질문
›어떤 종류의 엔티티를 이해하나요?
모든 숫자 참조(10진 ©와 16진 ©)에 더해, 복사한 텍스트에 실제로 나타나는 이름 참조들을 다룹니다. &, , —, ©, 인용 부호, 화살표, 수학 기호, 그리스 문자입니다. 알아보지 못한 이름은 추측하지 않고 그대로 둡니다.
›텍스트에 이상한 공백이 남아 있는 이유는?
그것은 가 진짜 줄바꿈 없는 공백(U+00A0)으로 디코딩된 것입니다. 보통 공백처럼 보이지만 줄이 바뀌지도 합쳐지지도 않으며, 웹 페이지에서 복사한 텍스트가 이상하게 굴 때의 단골 원인입니다.
›& 는 무슨 뜻인가요?
이중 부호화입니다. 텍스트가 두 번 이스케이프된 것이죠. 한 번 더 디코딩하면 원본이 나옵니다. 보통 시스템의 두 계층이 같은 문자열을 각각 이스케이프했다는 뜻입니다.
›디코딩하면 페이지에 넣어도 안전해지나요?
반대입니다. 디코딩은 <script>를 진짜 태그로 되돌립니다. 결과를 읽는 것은 괜찮지만 HTML에 넣기 전에 다시 이스케이프하세요. 이 짝의 인코딩 쪽 페이지가 그 일을 합니다.