Apri un file di testo con i caratteri sbagliati e risalvalo nella codifica corretta — oppure incolla direttamente il testo rovinato.
Clicca per caricare o trascina qui un file di testo
TXT, CSV, SRT, JSON, codice: letto nel tuo browser, mai caricatoVedi «ë²„ê·¸» o «Café» al posto di parole vere? Lascia attivo Rileva automaticamente e seleziona Ripara. Se il file resta sbagliato, scegli in Leggi il file come la code page usata nel tuo paese.
Informazioni sul Convertitore di codifica
Apri un file e invece delle parole vedi Café, 버그, æ–‡å—化ã o una fila di punti interrogativi. Il testo non è rovinato: viene semplicemente letto con la codifica sbagliata. Questo strumento lo legge con quella giusta e lo risalva in UTF-8, così da lì in poi ogni programma lo mostra correttamente.
È il lavoro che fa chcp nel prompt dei comandi di Windows e *Salva con nome → Codifica* nel Blocco note. Qui bastano due clic, e il file resta sul tuo dispositivo: la decodifica la fa il tuo browser.
Due problemi comuni che risolve
- Un file da un vecchio programma: un CSV, un file di sottotitoli o un .txt salvato nella vecchia code page del tuo paese (Windows-1252, EUC-KR, Shift_JIS, GBK, Big5, Windows-1251…). Scegli quella code page in Leggi il file come, poi salva in UTF-8.
- Mojibake: testo già in Unicode che mostra é dove dovrebbe esserci é, perché a un certo punto dei byte UTF-8 sono stati letti come Windows-1252. Seleziona Ripara e viene rimesso a posto.
Cosa puoi farci
- Convertire da ANSI a UTF-8 perché un file si apra bene ovunque
- Aggiungere un BOM UTF-8 così Excel smette di rovinare gli accenti quando apre il tuo CSV
- Togliere un BOM che dà fastidio a un programma o a una pagina web
- Riparare un file di sottotitoli (.srt, .vtt) i cui accenti o hangul escono come simboli
- Convertire file coreani EUC-KR, giapponesi Shift_JIS, cinesi GBK o Big5 in UTF-8
- Cambiare la fine riga fra Windows (CRLF) e Mac/Linux (LF) nello stesso passaggio
Caratteristiche
- Rilevamento automatico: BOM, UTF-16 e UTF-8 valido vengono individuati per te, con la valutazione a schermo
- Oltre 20 codifiche in lettura: UTF-8, UTF-16 LE/BE, la famiglia Windows-125x, ISO-8859, EUC-KR, Shift_JIS, EUC-JP, GBK, GB18030, Big5, KOI8-R e Mac Roman
- Sei modi di salvare: UTF-8, UTF-8 con BOM, UTF-16 LE, UTF-16 BE, Windows-1252 e ISO-8859-1
- Riparazione del mojibake per il classico caso dell'UTF-8 letto come 1252
- Controllo della fine riga: mantieni, CRLF o LF
- Anteprima dal vivo per verificare prima di scaricare
- Un avviso se dei caratteri andrebbero persi salvando in una code page ridotta
- Modalità incolla per un pezzo di testo rovinato, quando non hai un file
- 100% nel tuo browser: nulla viene caricato
Quanto è sicuro il rilevamento? A cosa serve «Leggi il file come»?
Un file di testo semplice è solo byte: non registra la propria codifica da nessuna parte. È proprio per questo che l'HTML ha bisogno di <meta charset> e la posta di un'intestazione charset=: senza di essi la codifica va dedotta dai byte.
E gli stessi byte sono leciti in molte codifiche. I due byte B0 A1 sono validi in tutte queste:
| Letto come | Ottieni |
|---|---|
| EUC-KR | 가 |
| GB18030 | 啊 |
| Big5 | 陛 |
| Windows-1252 | °¡ |
| Windows-1251 | °Ў |
Nemmeno un controllo rigoroso risolve la questione: del vero testo coreano si decodifica senza alcun errore anche come Shift_JIS, Big5, GB18030 e Windows-1251. Perciò lo strumento giudica il *risultato*: decodifica con ogni candidata e tiene quella che produce una scrittura coerente con una proporzione sensata di caratteri non inglesi.
Cosa significa in pratica:
- UTF-8, UTF-16 e qualsiasi file con BOM: identificati con certezza.
- Testo in inglese semplice: certo, e tutte le codifiche qui presenti lo leggono in modo identico.
- Una vecchia code page: lo strumento indica la più probabile e mostra le altre vicine come pulsanti cliccabili. Coreano, giapponese e cirillico vengono di solito individuati con precisione.
- Cinese semplificato, tradizionale e kanji giapponesi, e Windows-1252 rispetto a 1258, possono essere davvero indistinguibili: gli schemi di byte si sovrappongono. È lì che usi Leggi il file come e lasci decidere l'anteprima.
Quel campo è una riserva, non un passaggio. Lascialo su Rileva automaticamente a meno che l'anteprima non sembri sbagliata.
Perché il mio file non è cambiato?
È la sorpresa più frequente, e non è un difetto. Se il tuo testo usa solo lettere inglesi, cifre e punteggiatura (quello che si chiama ASCII), allora UTF-8, Windows-1252 e ISO-8859-1 lo memorizzano con esattamente gli stessi byte. Non c'è nulla da convertire, quindi il file salvato è identico e qualsiasi verifica continua a segnalare UTF-8.
Adesso lo strumento te lo dice quando succede. Se hai bisogno che i byte cambino davvero, scegli UTF-16 LE / BE oppure UTF-8 con BOM: quelli modificano sempre il file. Le codifiche iniziano a differire solo quando il testo contiene accenti, hangul, kanji, cirillico o altri caratteri non inglesi.
Come si usa
- Trascina qui il tuo file di testo: lo strumento indovina la codifica e ti mostra il testo
- Guarda l'anteprima. Se si legge bene hai finito; altrimenti cambia Leggi il file come scegliendo la code page di provenienza, oppure seleziona Ripara per i danni tipo é
- Scegli in che formato salvare: UTF-8 (senza BOM) è la risposta giusta quasi sempre. Usa UTF-8 con BOM se il file è un CSV che aprirai in Excel
- (Facoltativo) imposta la fine riga che preferisci
- Premi Scarica per salvare il file sistemato. La codifica finisce nel nome del file — notes-ANSI-1252-AppAndTools.txt, notes-UTF-8-AppAndTools.txt — così se salvi lo stesso file in due codifiche riesci sempre a distinguerli