> text zeichensalat
Zeichensalat reparieren
„Müller" statt „Müller", „–" statt „–", Fragezeichen in Rauten: Text einfügen, die kaputten Stellen werden erkannt und zurückgewandelt. Dazu: störende unsichtbare Zeichen aufräumen und jedes Zeichen nachschlagen.
Aus einer Mail, einer CSV, einem Export einfügen oder eine Datei öffnen. Bis 200.000 Zeichen läuft die Reparatur beim Tippen, darüber auf Knopfdruck.
Vorher
Nachher
Die Zähler zeigen, wie oft jede Art vorkommt – noch bevor du etwas änderst. Aus, was bleiben soll.
Öffnend oder schließend ergibt sich aus der Stellung im Satz. Ein Apostroph mitten im Wort (geht’s) bleibt ein Apostroph.
Dein Text mit Schildchen für alles, was man sonst nicht sieht
NBSP = geschütztes Leerzeichen, ZWSP = Nullbreiten-Leerzeichen, SHY = weicher Trennstrich, BOM = Byte-Reihenfolge-Marke, TAB und CR = Tabulator und Wagenrücklauf. Rote Schilder sind Steuerzeichen. Ab 100.000 Zeichen wird nur der Anfang gezeigt.
Zeichen eintippen oder einfügen – auch eins, das du aus einem Text kopiert hast. Geht auch mit der Nummer: U+00E4, ä oder ä
Weitere Zeichen aus deiner Eingabe
Mehr für Text: Zählen und säubern · Texte vergleichen
Dein Text bleibt auf diesem Gerät. Auch geöffnete Dateien werden nur hier gelesen, nichts wird gespeichert oder übertragen.
So funktioniert's
- 01Reparieren: Text einfügen, fertig. Jede kaputte Stelle wird vorher und nachher markiert, die Liste darüber sagt, was wie oft umgewandelt wurde.
- 02Aufräumen: jede Art störender Zeichen einzeln an- und abschalten, mit Zähler. „Unsichtbares zeigen" macht sichtbar, was im Text steckt, ohne etwas zu ändern.
- 03Nachschlagen: ein Zeichen eintippen und erfahren, was es ist, welche Nummer und Bytes es hat und wie man es in HTML schreibt.
Woher der Salat kommt: Ein „ü" ist in UTF-8, der heute üblichen Kodierung, die Byte-Folge C3 BC. Liest ein Programm diese Bytes als Windows-1252 (die alte Standardkodierung von Windows), zeigt es „ü". Das Werkzeug nimmt jedes Zeichen zurück in sein Byte und setzt die Bytes wieder als UTF-8 zusammen. Das klappt auch, wenn der Text als Latin-1 gelesen wurde oder zweimal hintereinander kaputtgegangen ist („Müller").
Was nicht geht: Umgekehrt gelesene Texte, bei denen aus „ü" ein „�" oder ein „?" wurde, sind nicht zu retten – das Zeichen ist weg, es steht nirgends mehr, welches es war. Das Werkzeug sagt dir, wie viele solche Stellen es gibt, rät aber nicht. Die Reparatur greift nur, wo eine gültige Byte-Folge steht: „SÃO PAULO" bleibt stehen, weil auf das à kein passendes Zeichen folgt. Für Griechisch, Kyrillisch, Hebräisch und Arabisch wird nur repariert, wenn der Text mehrere solche Stellen hat, damit ein einzelnes „×" vor einem geschützten Leerzeichen nicht plötzlich ein hebräischer Buchstabe wird. Wo zwei Lesarten möglich sind, zeigt die Seite beide.
Dateien: „Datei öffnen" liest eine Textdatei (TXT, CSV, …) direkt hier im Browser. Die Kodierung wird geraten (Kennzeichen, gültiges UTF-8, sonst Windows-1252) und lässt sich umstellen. „Als UTF-8-Datei speichern" schreibt das Ergebnis neu; die Option „mit BOM" setzt das Kennzeichen, das Excel unter Windows braucht, um eine CSV als UTF-8 zu öffnen. Bis 5 MB.