Decodifica =?ISO-2022-JP?B?…?= y otras codificaciones MIME

Un asunto japonés que llega como =?ISO-2022-JP?B?GyRC…?= no está corrupto: solo lleva puesta su codificación de transporte. Esto se la quita, y se la vuelve a poner cuando necesitas escribir una.

Cargando la herramienta…

Cómo funciona

  1. Pega la cabecera, la parte del cuerpo, o una sola palabra =?…?=.
  2. Pulsa «Decode» (decodificar); cada encoded word aparece listada con su juego de caracteres.
  3. Para el camino contrario, escribe el texto en la caja de codificar de abajo.

Por qué no se sube nada

Todo lo que hace esta página lo ejecuta código que corre dentro de la pestaña de tu navegador, con el mismo motor que dibuja las páginas web. El archivo se lee del disco a la memoria de la pestaña, se transforma ahí y se vuelve a escribir como descarga. No se envía a ninguna parte: ni a nosotros, ni a terceros.

Compruébalo tú mismo

  1. Abre las herramientas de desarrollo del navegador (F12) y elige la pestaña «Red».
  2. Carga tu archivo y ejecuta la herramienta.
  3. Las únicas peticiones que verás descargan el código de la propia herramienta —y, en unas pocas herramientas pesadas, su motor de código abierto desde un CDN público—, más un pequeño aviso de visita a loreatec.jp (dirección y título de la página, nada más). Ninguna lleva tu archivo.

Compruébalo tú mismo →

Preguntas frecuentes

¿Qué es un encoded word?

Las cabeceras de correo son, según el estándar original, solo ASCII. El RFC 2047 lo rodea envolviendo el texto no ASCII en =?juego?codificación?texto?=, donde la codificación es B (base64) o Q (una variante de quoted-printable). Todos los clientes de correo lo decodifican al mostrarlo, por eso normalmente no lo ves nunca, hasta que algo te enseña la cabecera en crudo.

¿Debería seguir usando ISO-2022-JP?

Para cabeceras dirigidas a las operadoras móviles japonesas y a sistemas realmente antiguos sigue siendo lo más seguro. Pero no puede representar ①, ㈱, ~, la mitad de los símbolos que la gente pega desde Word, ni ningún emoji: llegan como ? o desaparecen. UTF-8 lo lleva todo y lo acepta cualquier receptor moderno, incluidas hoy las tres operadoras.

¿Por qué el codificador solo ofrece UTF-8?

Porque los navegadores saben decodificar ISO-2022-JP, Shift_JIS y EUC-JP, pero no saben codificar a ellos: TextEncoder solo produce UTF-8. Ofrecer esas opciones y devolver UTF-8 en silencio sería justo el tipo de error callado que esta herramienta existe para destapar. Al decodificar sí están todas.

¿B o Q?

Para japonés, B: en Q habría que escapar casi todos los bytes, así que base64 sale más corto. Para texto casi todo latino con algunos acentos, Q mantiene la cabecera legible, lo que ayuda cuando lees el fuente en crudo.