Open een tekstbestand met verkeerde tekens en sla het opnieuw op in de juiste codering — of plak de kapotte tekst er rechtstreeks in.
Klik om te uploaden of sleep een tekstbestand hierheen
TXT, CSV, SRT, JSON, code — in je browser gelezen, nooit geüploadZie je "버그" of "Café" in plaats van echte woorden? Laat Automatisch herkennen aan staan en vink Herstellen aan. Ziet het bestand er dan nog verkeerd uit, kies dan bij Lees het bestand als de codetabel van jouw land.
Over Tekencodering omzetten
Je opent een bestand en in plaats van woorden zie je Café, 버그, æ–‡å—化ã of een rij vraagtekens. De tekst is niet stuk — hij wordt alleen met de verkeerde codering gelezen. Deze tool leest hem met de juiste en slaat hem opnieuw op als UTF-8, zodat elk programma daarna alles correct toont.
Dit is het werk dat chcp doet in het Windows-opdrachtvenster en *Opslaan als → Codering* in Kladblok. Hier zijn het twee klikken, en het bestand blijft op je apparaat — het decoderen doet je browser.
Twee veelvoorkomende problemen die het oplost
- Een bestand uit een oud programma — een CSV, een ondertitelbestand of een .txt die is opgeslagen in de oude codetabel van jouw land (Windows-1252, EUC-KR, Shift_JIS, GBK, Big5, Windows-1251…). Kies die codetabel bij Lees het bestand als en sla op als UTF-8.
- Mojibake — tekst die al Unicode is maar é toont waar é hoort te staan, omdat UTF-8-bytes ergens onderweg als Windows-1252 zijn gelezen. Vink Herstellen aan en het wordt weer in elkaar gezet.
Wat je ermee kunt
- ANSI naar UTF-8 omzetten zodat een bestand overal goed opent
- Een UTF-8-BOM toevoegen zodat Excel de accenten in je CSV niet meer verminkt
- Een BOM verwijderen die een programma of webpagina in de war stuurt
- Een ondertitelbestand repareren (.srt, .vtt) waarvan de accenten of hangul als symbolen verschijnen
- Koreaanse EUC-KR-, Japanse Shift_JIS-, Chinese GBK- of Big5-bestanden omzetten naar UTF-8
- De regeleinden wisselen tussen Windows (CRLF) en Mac/Linux (LF) in dezelfde stap
Mogelijkheden
- Automatische herkenning — BOM, UTF-16 en geldige UTF-8 worden voor je herkend, en de inschatting wordt getoond
- Meer dan 20 coderingen om uit te lezen — UTF-8, UTF-16 LE/BE, de Windows-125x-familie, ISO-8859, EUC-KR, Shift_JIS, EUC-JP, GBK, GB18030, Big5, KOI8-R en Mac Roman
- Zes manieren om op te slaan — UTF-8, UTF-8 met BOM, UTF-16 LE, UTF-16 BE, Windows-1252 en ISO-8859-1
- Mojibake-herstel voor het klassieke geval van UTF-8-gelezen-als-1252
- Controle over regeleinden — behouden, CRLF of LF
- Live voorbeeld zodat je vóór het downloaden ziet dat het klopt
- Een waarschuwing als er tekens verloren zouden gaan bij opslaan in een kleine codetabel
- Plakmodus voor een stukje kapotte tekst, als je geen bestand hebt
- 100% in je browser — er wordt niets geüpload
Hoe zeker is de herkenning? Waarvoor is "Lees het bestand als"?
Een plat tekstbestand is alleen maar bytes — het legt zijn eigen codering nergens vast. Daarom heeft HTML <meta charset> nodig en e-mail een charset=-header: zonder die moet de codering uit de bytes worden afgeleid.
En dezelfde bytes zijn geldig in veel coderingen. De twee bytes B0 A1 zijn geldig in al deze:
| Gelezen als | Je krijgt |
|---|---|
| EUC-KR | 가 |
| GB18030 | 啊 |
| Big5 | 陛 |
| Windows-1252 | °¡ |
| Windows-1251 | °Ў |
Strikte controle beslist het ook niet — echte Koreaanse tekst decodeert zonder enige fout ook als Shift_JIS, Big5, GB18030 en Windows-1251. De tool beoordeelt daarom het *resultaat*: hij decodeert met elke kandidaat en houdt degene die één samenhangend schrift oplevert met een zinnig aandeel niet-Engelse tekens.
Wat dat in de praktijk betekent:
- UTF-8, UTF-16 en elk bestand met een BOM — met zekerheid herkend.
- Gewone Engelse tekst — zeker, en elke codering hier leest hem identiek.
- Een oude codetabel — de tool noemt de meest waarschijnlijke en toont de dichte achtervolgers als knoppen waarop je kunt klikken. Koreaans, Japans en Cyrillisch worden meestal precies vastgepind.
- Vereenvoudigd versus traditioneel Chinees versus Japanse kanji, en Windows-1252 versus 1258, kunnen echt niet te onderscheiden zijn — de bytepatronen overlappen. Dan gebruik je Lees het bestand als en laat je het voorbeeld beslissen.
Dat veld is een terugvaloptie, geen stap. Laat het op Automatisch herkennen staan tenzij het voorbeeld er verkeerd uitziet.
Waarom is mijn bestand niet veranderd?
Dit is de meest voorkomende verrassing, en het is geen fout. Als je tekst alleen gewone Engelse letters, cijfers en leestekens gebruikt (wat ASCII heet), dan slaan UTF-8, Windows-1252 en ISO-8859-1 die op met precies dezelfde bytes. Er valt niets om te zetten, dus het opgeslagen bestand is identiek en elke controle meldt nog steeds UTF-8.
De tool zegt het nu wanneer dit gebeurt. Moeten de bytes echt verschillen, kies dan UTF-16 LE / BE of UTF-8 met BOM — die veranderen het bestand altijd. De coderingen gaan pas uiteenlopen zodra je tekst accenten, hangul, kanji, Cyrillisch of andere niet-Engelse tekens bevat.
Hoe je het gebruikt
- Sleep je tekstbestand erin — de tool raadt de codering en toont je de tekst
- Bekijk het voorbeeld. Leest het goed, dan ben je klaar; zo niet, zet Lees het bestand als op de codetabel waar je bestand vandaan komt, of vink Herstellen aan bij schade van het type é
- Kies waarin je opslaat — UTF-8 (zonder BOM) is bijna altijd het juiste antwoord. Gebruik UTF-8 met BOM als het bestand een CSV is die je in Excel opent
- (Optioneel) stel de gewenste regeleinden in
- Klik op Downloaden om het herstelde bestand op te slaan. De codering komt in de bestandsnaam te staan — notes-ANSI-1252-AppAndTools.txt, notes-UTF-8-AppAndTools.txt — zodat je twee versies van hetzelfde bestand altijd uit elkaar kunt houden