Zeichenkodierung ändern

Text zeigt seltsame Symbole? Mit der richtigen Kodierung lesen und als UTF-8 speichern.

100 % privat – läuft vollständig in Ihrem Browser. Ihre Daten werden auf Ihrem Gerät verarbeitet und niemals ins Internet gesendet.

Öffnen Sie eine Textdatei mit falschen Zeichen und speichern Sie sie in der richtigen Kodierung — oder fügen Sie den kaputten Text direkt ein.

Zum Hochladen klicken oder Textdatei hierher ziehen

TXT, CSV, SRT, JSON, Code — im Browser gelesen, nie hochgeladen

Sehen Sie „버그“ oder „Café“ statt richtiger Wörter? Lassen Sie Automatisch erkennen an und aktivieren Sie Reparieren. Sieht die Datei weiter falsch aus, wählen Sie unter Datei lesen als die Codepage Ihres Landes.

Über Zeichenkodierung ändern

Sie öffnen eine Datei und statt Wörtern steht dort Café, 버그, 文字化ã oder eine Reihe von Fragezeichen. Der Text ist nicht kaputt — er wird nur mit der falschen Kodierung gelesen. Dieses Tool liest ihn mit der richtigen und speichert ihn erneut als UTF-8, damit jedes Programm danach alles korrekt anzeigt.

Das ist die Aufgabe von chcp in der Windows-Eingabeaufforderung und von *Speichern unter → Kodierung* im Editor. Hier braucht es zwei Klicks, und die Datei bleibt auf Ihrem Gerät — das Dekodieren übernimmt Ihr Browser.

Zwei häufige Probleme, die es löst

  • Eine Datei aus einem alten Programm — eine CSV, eine Untertiteldatei oder eine .txt, gespeichert in der alten Codepage Ihres Landes (Windows-1252, EUC-KR, Shift_JIS, GBK, Big5, Windows-1251…). Wählen Sie diese Codepage unter Datei lesen als und speichern Sie als UTF-8.
  • Mojibake — Text, der bereits Unicode ist, aber é statt é zeigt, weil UTF-8-Bytes irgendwo unterwegs als Windows-1252 gelesen wurden. Aktivieren Sie Reparieren, und er wird wieder zusammengesetzt.

Was Sie damit machen können

  • ANSI in UTF-8 umwandeln, damit eine Datei überall richtig öffnet
  • Ein UTF-8-BOM hinzufügen, damit Excel beim Öffnen Ihrer CSV keine Umlaute mehr zerstört
  • Ein BOM entfernen, das ein Programm oder eine Webseite stört
  • Eine Untertiteldatei reparieren (.srt, .vtt), deren Umlaute oder Hangul als Symbole erscheinen
  • Koreanische EUC-KR-, japanische Shift_JIS-, chinesische GBK- oder Big5-Dateien in UTF-8 umwandeln
  • Zeilenenden ändern zwischen Windows (CRLF) und Mac/Linux (LF) — im selben Schritt

Funktionen

  • Automatische Erkennung — BOM, UTF-16 und gültiges UTF-8 werden für Sie erkannt, und die Einschätzung wird angezeigt
  • Über 20 Kodierungen zum Lesen — UTF-8, UTF-16 LE/BE, die Windows-125x-Familie, ISO-8859, EUC-KR, Shift_JIS, EUC-JP, GBK, GB18030, Big5, KOI8-R und Mac Roman
  • Sechs Speicherformate — UTF-8, UTF-8 mit BOM, UTF-16 LE, UTF-16 BE, Windows-1252 und ISO-8859-1
  • Mojibake-Reparatur für den klassischen Fall UTF-8-als-1252-gelesen
  • Kontrolle über Zeilenenden — beibehalten, CRLF oder LF
  • Live-Vorschau, damit Sie vor dem Herunterladen sehen, dass es stimmt
  • Eine Warnung, wenn Zeichen verloren gingen, falls Sie in eine kleine Codepage speichern
  • Einfüge-Modus für ein Stück kaputten Text, wenn Sie keine Datei haben
  • 100 % im Browser — nichts wird hochgeladen

Wie sicher ist die Erkennung? Wozu das Feld „Datei lesen als“?

Eine einfache Textdatei besteht nur aus Bytes — sie hält ihre eigene Kodierung nirgends fest. Genau deshalb braucht HTML <meta charset> und E-Mail einen charset=-Header: ohne sie muss die Kodierung aus den Bytes erschlossen werden.

Und dieselben Bytes sind in vielen Kodierungen gültig. Die zwei Bytes B0 A1 sind in allen folgenden erlaubt:

| Gelesen als | Ergebnis |

|---|---|

| EUC-KR | 가 |

| GB18030 | 啊 |

| Big5 | 陛 |

| Windows-1252 | °¡ |

| Windows-1251 | °Ў |

Auch strenge Prüfung klärt es nicht: echter koreanischer Text lässt sich fehlerfrei ebenso als Shift_JIS, Big5, GB18030 und Windows-1251 dekodieren. Deshalb beurteilt das Tool das *Ergebnis*: Es dekodiert mit jedem Kandidaten und behält den, der eine einheitliche Schrift mit einem sinnvollen Anteil nicht-englischer Zeichen ergibt.

Was das in der Praxis heißt:

  • UTF-8, UTF-16 und jede Datei mit BOM — mit Sicherheit erkannt.
  • Reiner englischer Text — sicher, und jede Kodierung hier liest ihn identisch.
  • Eine alte Codepage — das Tool nennt die wahrscheinlichste und zeigt die knappen Zweitplatzierten als anklickbare Schaltflächen. Koreanisch, Japanisch und Kyrillisch werden meist exakt bestimmt.
  • Vereinfachtes vs. traditionelles Chinesisch vs. japanische Kanji sowie Windows-1252 vs. 1258 können echt ununterscheidbar sein — die Bytemuster überschneiden sich. Dann nutzen Sie Datei lesen als und lassen die Vorschau entscheiden.

Das Feld ist eine Rückfalloption, kein Arbeitsschritt. Lassen Sie es auf Automatisch erkennen, solange die Vorschau stimmt.

Warum hat sich meine Datei nicht verändert?

Das ist die häufigste Überraschung — und kein Fehler. Wenn Ihr Text nur einfache englische Buchstaben, Ziffern und Satzzeichen verwendet (das nennt man ASCII), dann speichern UTF-8, Windows-1252 und ISO-8859-1 ihn mit exakt denselben Bytes. Es gibt nichts zu konvertieren, also ist die gespeicherte Datei identisch und jedes Prüfprogramm meldet weiterhin UTF-8.

Das Tool sagt Ihnen jetzt, wenn das passiert. Sollen sich die Bytes wirklich unterscheiden, wählen Sie UTF-16 LE / BE oder UTF-8 mit BOM — die ändern die Datei immer. Die Kodierungen gehen erst auseinander, sobald Ihr Text Akzente, Hangul, Kanji, Kyrillisch oder andere nicht-englische Zeichen enthält.

So verwenden Sie es

  • Ziehen Sie Ihre Textdatei hinein — das Tool schätzt die Kodierung und zeigt Ihnen den Text
  • Sehen Sie sich die Vorschau an. Liest sie sich richtig, sind Sie fertig; wenn nicht, stellen Sie Datei lesen als auf die Codepage um, aus der Ihre Datei stammt, oder aktivieren Sie Reparieren bei Schäden im Stil é
  • Wählen Sie das SpeicherformatUTF-8 (ohne BOM) ist fast immer richtig. Nehmen Sie UTF-8 mit BOM, wenn die Datei eine CSV ist, die Sie in Excel öffnen
  • (Optional) stellen Sie die gewünschten Zeilenenden ein
  • Klicken Sie auf Herunterladen, um die reparierte Datei zu speichern. Die Kodierung steht im Dateinamennotes-ANSI-1252-AppAndTools.txt, notes-UTF-8-AppAndTools.txt — damit Sie zwei Fassungen derselben Datei immer auseinanderhalten können

Wir veröffentlichen regelmäßig neue Tools — abonniere uns auf YouTube, um bei jedem neuen Tool benachrichtigt zu werden.

Weitere Tools

Alle anzeigen

Empfohlene Apps

Alle anzeigen