Convertitore di codifica

Testo pieno di simboli strani? Leggilo con la codifica giusta e salvalo in UTF-8.

100% privato — funziona interamente nel tuo browser. I tuoi dati vengono elaborati sul tuo dispositivo e non vengono mai inviati a Internet.

Apri un file di testo con i caratteri sbagliati e risalvalo nella codifica corretta — oppure incolla direttamente il testo rovinato.

Clicca per caricare o trascina qui un file di testo

TXT, CSV, SRT, JSON, codice: letto nel tuo browser, mai caricato

Vedi «ë²„ê·¸» o «Café» al posto di parole vere? Lascia attivo Rileva automaticamente e seleziona Ripara. Se il file resta sbagliato, scegli in Leggi il file come la code page usata nel tuo paese.

Informazioni sul Convertitore di codifica

Apri un file e invece delle parole vedi Café, 버그, 文字化ã o una fila di punti interrogativi. Il testo non è rovinato: viene semplicemente letto con la codifica sbagliata. Questo strumento lo legge con quella giusta e lo risalva in UTF-8, così da lì in poi ogni programma lo mostra correttamente.

È il lavoro che fa chcp nel prompt dei comandi di Windows e *Salva con nome → Codifica* nel Blocco note. Qui bastano due clic, e il file resta sul tuo dispositivo: la decodifica la fa il tuo browser.

Due problemi comuni che risolve

  • Un file da un vecchio programma: un CSV, un file di sottotitoli o un .txt salvato nella vecchia code page del tuo paese (Windows-1252, EUC-KR, Shift_JIS, GBK, Big5, Windows-1251…). Scegli quella code page in Leggi il file come, poi salva in UTF-8.
  • Mojibake: testo già in Unicode che mostra é dove dovrebbe esserci é, perché a un certo punto dei byte UTF-8 sono stati letti come Windows-1252. Seleziona Ripara e viene rimesso a posto.

Cosa puoi farci

  • Convertire da ANSI a UTF-8 perché un file si apra bene ovunque
  • Aggiungere un BOM UTF-8 così Excel smette di rovinare gli accenti quando apre il tuo CSV
  • Togliere un BOM che dà fastidio a un programma o a una pagina web
  • Riparare un file di sottotitoli (.srt, .vtt) i cui accenti o hangul escono come simboli
  • Convertire file coreani EUC-KR, giapponesi Shift_JIS, cinesi GBK o Big5 in UTF-8
  • Cambiare la fine riga fra Windows (CRLF) e Mac/Linux (LF) nello stesso passaggio

Caratteristiche

  • Rilevamento automatico: BOM, UTF-16 e UTF-8 valido vengono individuati per te, con la valutazione a schermo
  • Oltre 20 codifiche in lettura: UTF-8, UTF-16 LE/BE, la famiglia Windows-125x, ISO-8859, EUC-KR, Shift_JIS, EUC-JP, GBK, GB18030, Big5, KOI8-R e Mac Roman
  • Sei modi di salvare: UTF-8, UTF-8 con BOM, UTF-16 LE, UTF-16 BE, Windows-1252 e ISO-8859-1
  • Riparazione del mojibake per il classico caso dell'UTF-8 letto come 1252
  • Controllo della fine riga: mantieni, CRLF o LF
  • Anteprima dal vivo per verificare prima di scaricare
  • Un avviso se dei caratteri andrebbero persi salvando in una code page ridotta
  • Modalità incolla per un pezzo di testo rovinato, quando non hai un file
  • 100% nel tuo browser: nulla viene caricato

Quanto è sicuro il rilevamento? A cosa serve «Leggi il file come»?

Un file di testo semplice è solo byte: non registra la propria codifica da nessuna parte. È proprio per questo che l'HTML ha bisogno di <meta charset> e la posta di un'intestazione charset=: senza di essi la codifica va dedotta dai byte.

E gli stessi byte sono leciti in molte codifiche. I due byte B0 A1 sono validi in tutte queste:

| Letto come | Ottieni |

|---|---|

| EUC-KR | 가 |

| GB18030 | 啊 |

| Big5 | 陛 |

| Windows-1252 | °¡ |

| Windows-1251 | °Ў |

Nemmeno un controllo rigoroso risolve la questione: del vero testo coreano si decodifica senza alcun errore anche come Shift_JIS, Big5, GB18030 e Windows-1251. Perciò lo strumento giudica il *risultato*: decodifica con ogni candidata e tiene quella che produce una scrittura coerente con una proporzione sensata di caratteri non inglesi.

Cosa significa in pratica:

  • UTF-8, UTF-16 e qualsiasi file con BOM: identificati con certezza.
  • Testo in inglese semplice: certo, e tutte le codifiche qui presenti lo leggono in modo identico.
  • Una vecchia code page: lo strumento indica la più probabile e mostra le altre vicine come pulsanti cliccabili. Coreano, giapponese e cirillico vengono di solito individuati con precisione.
  • Cinese semplificato, tradizionale e kanji giapponesi, e Windows-1252 rispetto a 1258, possono essere davvero indistinguibili: gli schemi di byte si sovrappongono. È lì che usi Leggi il file come e lasci decidere l'anteprima.

Quel campo è una riserva, non un passaggio. Lascialo su Rileva automaticamente a meno che l'anteprima non sembri sbagliata.

Perché il mio file non è cambiato?

È la sorpresa più frequente, e non è un difetto. Se il tuo testo usa solo lettere inglesi, cifre e punteggiatura (quello che si chiama ASCII), allora UTF-8, Windows-1252 e ISO-8859-1 lo memorizzano con esattamente gli stessi byte. Non c'è nulla da convertire, quindi il file salvato è identico e qualsiasi verifica continua a segnalare UTF-8.

Adesso lo strumento te lo dice quando succede. Se hai bisogno che i byte cambino davvero, scegli UTF-16 LE / BE oppure UTF-8 con BOM: quelli modificano sempre il file. Le codifiche iniziano a differire solo quando il testo contiene accenti, hangul, kanji, cirillico o altri caratteri non inglesi.

Come si usa

  • Trascina qui il tuo file di testo: lo strumento indovina la codifica e ti mostra il testo
  • Guarda l'anteprima. Se si legge bene hai finito; altrimenti cambia Leggi il file come scegliendo la code page di provenienza, oppure seleziona Ripara per i danni tipo é
  • Scegli in che formato salvare: UTF-8 (senza BOM) è la risposta giusta quasi sempre. Usa UTF-8 con BOM se il file è un CSV che aprirai in Excel
  • (Facoltativo) imposta la fine riga che preferisci
  • Premi Scarica per salvare il file sistemato. La codifica finisce nel nome del filenotes-ANSI-1252-AppAndTools.txt, notes-UTF-8-AppAndTools.txt — così se salvi lo stesso file in due codifiche riesci sempre a distinguerli

Aggiungiamo regolarmente nuovi strumenti — iscriviti su YouTube per ricevere una notifica a ogni novità.

Altri strumenti

Vedi tutti

App consigliate

Vedi tutti