텍스트 파일 인코딩 변환기
텍스트에서 café가 café로, naïve가 naïve로 보인다면 문자 자체는 멀쩡하고, 인코딩이 잘못 읽히고 있는 것입니다. 텍스트를 붙여넣고 어떤 인코딩으로 읽고 어떤 인코딩으로 쓸지 지정하면, UTF-8, UTF-16, ISO-8859-1(Latin-1), Windows-1252 등 일반적인 코드 페이지 사이에서 깔끔하게 다시 인코딩합니다. 수정된 결과를 에디터, 스프레드시트, 데이터베이스에 바로 복사하세요.
텍스트 인코딩을 변환하는 방법
-
1
텍스트 붙여넣기
깨져 보이거나 다른 프로그램용으로 다시 인코딩해야 하는 모든 텍스트.
-
2
감지 결과 확인
입력란 위에 가능성이 높은 인코딩을 대략적인 힌트로 보여 줍니다.
-
3
원본 인코딩 선택
바이트를 어떻게 읽을지에 맞춰 「원본」을 설정하세요: UTF-8, Windows-1252, ISO-8859-1, SJIS 등.
-
4
대상 인코딩 선택
UTF-8이 현대의 표준입니다. 특정 프로그램이 필요로 할 때는 UTF-16, Big5, GB2312도 사용할 수 있습니다.
-
5
변환하고 복사
텍스트가 다시 인코딩되고 한 번의 클릭으로 결과를 클립보드에 복사합니다.
인코딩 불일치는 어디서 오는가
| 출처 | 예상 인코딩 |
|---|---|
| Windows의 Excel「CSV로 저장」 | Windows-1252 |
| 오래된 Windows 애플리케이션 | Windows-1252 |
| 오래된 Unix 유틸리티 | ISO-8859-1 (Latin-1) |
| 최신 macOS/Linux 에디터 | UTF-8 |
| Windows의 일본어 텍스트 | Shift-JIS (SJIS) |
| Windows의 중국어 간체 | GB2312 |
| 중국어 번체(대만/홍콩) | Big5 |
전형적인 증상
- UTF-8 바이트를 Latin-1로 읽으면
café가café로 보입니다. 바이트를 다시 올바르게 해석하려면 「원본」을 UTF-8로 설정하세요. - 같은 이유로
ñ은ñ이 됩니다. café같은 이중 모지바케는 첫 오독 후 텍스트를 다시 저장하여 잘못된 해석을 한 번 더 인코딩했다는 뜻입니다.- 맨 앞의
는 UTF-8 바이트 순서 표시가 세 개의 Latin-1 문자로 읽힌 것입니다.
증상을 알아채면 방향은 대개 분명합니다. 텍스트를 실제 모습대로(Latin-1, Windows-1252 등 해당하는 것으로) 읽고 UTF-8로 다시 써 내면 됩니다.
바이트 순서 표시(BOM)
이 변환기는 바이트 순서 표시를 임의로 추가하거나 제거하지 않습니다. 동작은 대상 인코딩을 따릅니다. UTF-8 출력에는 BOM이 없습니다. 일반 UTF-16 출력은 BOM으로 시작하고 빅엔디안이며, UTF-16BE와 UTF-16LE는 BOM 없이 바이트를 씁니다. 특정 프로그램이 UTF-16을 요구하지 않는 한 UTF-8을 선택하세요.
문자에 대응이 없을 때
선택한 원본 인코딩에서 의미가 없는 바이트가 있고, 대상 인코딩에서 표현할 수 없는 문자도 있습니다. 그런 경우 변환은 멈추지 않고 대체 표시로 바꿉니다. 가장 중요한 것은 올바른 원본 인코딩을 고르는 일입니다. ASCII만으로 된 문자열은 모든 인코딩에서 유효하므로, 불일치는 대개 악센트가 있는 문자나 비라틴 문자가 있을 때 비로소 드러납니다.
자주 묻는 질문
「원본」과 「대상」 목록 모두 UTF-8, UTF-16, UTF-16BE, UTF-16LE, ISO-8859-1, ISO-8859-15, Windows-1252, ASCII, EUC-JP, SJIS(Shift-JIS), GB2312, Big5를 제공합니다. 어느 것에서든 다른 어느 것으로도 변환할 수 있습니다.
웹, 데이터베이스, 그리고 거의 모든 현대적 처리에서는 그렇습니다. 예외는 Windows-1252만 읽는 오래된 Windows 앱, 일부 구형 메인프레임 도구, 그리고 Shift-JIS를 기대하는 특정 일본어 소프트웨어입니다.
바이트 패턴을 바탕으로 UTF-8, UTF-16, ISO-8859-1, Windows-1252, ASCII 중에서 고른 대략적인 추정입니다. 짧거나 ASCII만 있는 텍스트에서는 틀릴 수 있으니 힌트로만 여기고, 더 잘 알 때는 「원본」 인코딩을 직접 설정하세요.
텍스트는 변환을 수행하기 위해 서버로 전송되며 응답이 반환된 뒤에는 저장되지 않습니다. 기밀 자료라면 인코딩 변환기가 내장된 오프라인 에디터를 사용하는 편이 좋습니다.
관련 도구
ASCII 표 참조
NUL, LF, DEL 같은 제어 문자를 포함해 모든 문자에 대한 10진수, 16진수, 8진수, 2진수, HTML 숫자 문자 참조를 담은 0부터 127까지의 전체 ASCII 표.
FPS 카운터
requestAnimationFrame으로 브라우저 FPS를 측정하세요. 스무딩, 최소/최대 프레임레이트, 경고 임계값, 선택형 그래프를 제공합니다. 업로드나 API 없이 로컬에서 실행됩니다.
HTML 문자 참조
HTML 엔티티의 검색 가능한 목록, 각 엔티티의 이름 및 숫자 코드, 그리고 특수 문자 및 기호에 대한 1클릭 복사 기능을 제공합니다.
색상 혼합기
두 HEX 색상을 2-20개의 균등한 색상 견본으로 섞습니다. 양 끝 색상을 포함해 각 중간 색상을 대문자 HEX 코드로 확인하세요.
키보드 단축키 참고표
macOS, Windows, Linux에서 VS Code, Chrome, GNU Readline을 쓰는 Bash의 문서화된 기본 단축키를 검색합니다.
색상 틴트 생성기
기준 색의 밝은 틴트를 생성합니다. 디자인 시스템 토큰, 배경, 호버 상태를 위한 3-20단계 스케일.
이 도구는 다른 언어로도 제공됩니다
- Konwerter kodowania plików tekstowych [PL]
- Konverter Pengodean Berkas Teks [ID]
- Công cụ chuyển đổi mã hóa tệp văn bản [VI]
- Teckenkodningskonverterare för textfiler [SV]
- เครื่องมือแปลงการเข้ารหัสไฟล์ข้อความ [TH]
- テキストファイル文字コード変換ツール [JA]
- محوّل ترميز ملفات النصوص [AR]
- Conversor de codificación de archivos de texto [ES]
- Conversor de codificação de arquivos de texto [PT]
- Convertisseur d'encodage de fichiers texte [FR]
- Zeichenkodierung-Konverter für Textdateien [DE]
- Tekencodering-converter voor tekstbestanden [NL]
- Convertitore di codifica per file di testo [IT]
- Конвертер кодировки текстовых файлов [RU]
- Metin Dosyası Kodlama Dönüştürücü [TR]
- 文本文件编码转换器 [ZH]
- Text File Encoding Converter [EN]