=?ISO-2022-JP?B?…?= und andere MIME-Kodierungen dekodieren

Eine japanische Betreffzeile, die als =?ISO-2022-JP?B?GyRC…?= ankommt, ist nicht kaputt — sie trägt nur ihre Transportkodierung. Hier wird sie ausgezogen, und wieder angezogen, wenn du selbst eine schreiben musst.

Werkzeug wird geladen…

So funktioniert es

  1. Füg die Kopfzeile, den Textteil oder ein einzelnes =?…?=-Wort ein.
  2. Klick auf „Decode“ (Dekodieren); jedes encoded word wird mit seinem Zeichensatz aufgeführt.
  3. Für die Gegenrichtung tippst du den Text in das Kodierfeld unten.

Warum nichts hochgeladen wird

Alles, was auf dieser Seite passiert, erledigt Code, der im Tab deines Browsers läuft — mit derselben Engine, die auch Webseiten darstellt. Die Datei wird von der Festplatte in den Speicher des Tabs gelesen, dort umgewandelt und als Download wieder herausgeschrieben. Sie wird nirgendwohin geschickt — weder zu uns noch zu Dritten.

Prüf es selbst nach

  1. Öffne die Entwicklerwerkzeuge deines Browsers (F12) und wähle den Tab „Netzwerk“.
  2. Lade deine Datei und starte das Werkzeug.
  3. Die einzigen Anfragen, die du siehst, holen den Code des Werkzeugs selbst — und bei ein paar schweren Werkzeugen dessen Open-Source-Engine von einem öffentlichen CDN — dazu ein kleines Seitenaufruf-Signal an loreatec.jp (Adresse und Titel der Seite, mehr nicht). Keine davon trägt deine Datei.

Beweis, dass alles lokal bleibt →

Häufige Fragen

Was ist ein encoded word?

E-Mail-Kopfzeilen sind nach dem ursprünglichen Standard reines ASCII. RFC 2047 umgeht das, indem es Text außerhalb von ASCII in =?Zeichensatz?Kodierung?Text?= verpackt, wobei die Kodierung B (base64) oder Q (eine Variante von quoted-printable) ist. Jedes E-Mail-Programm dekodiert das zur Anzeige, deshalb bekommst du es normalerweise nie zu sehen — bis dir etwas die rohe Kopfzeile zeigt.

Soll ich ISO-2022-JP noch verwenden?

Für Kopfzeilen an japanische Mobilfunkanbieter und an wirklich alte Systeme bleibt es die sicherste Wahl. Aber es kann ①, ㈱, ~, die Hälfte der Symbole, die Leute aus Word einfügen, und jedes Emoji nicht darstellen: Die kommen als ? an oder verschwinden. UTF-8 trägt alles und wird von jedem modernen Empfänger angenommen, heute auch von allen drei Anbietern.

Warum bietet der Kodierer nur UTF-8 an?

Weil Browser ISO-2022-JP, Shift_JIS und EUC-JP dekodieren, aber nicht in sie kodieren können — TextEncoder erzeugt ausschließlich UTF-8. Diese Optionen anzubieten und stillschweigend UTF-8 zurückzugeben, wäre genau die Art von lautlosem Fehler, die dieses Werkzeug sichtbar machen soll. Beim Dekodieren werden alle unterstützt.

B oder Q?

Für Japanisch B: In Q müsste fast jedes Byte maskiert werden, base64 ist also kürzer. Bei Text, der überwiegend lateinisch ist und nur ein paar Akzente hat, hält Q die Kopfzeile lesbar, und das hilft, wenn du rohen Quelltext liest.