Decodifique =?ISO-2022-JP?B?…?= e outras codificações MIME

Um assunto em japonês que chega como =?ISO-2022-JP?B?GyRC…?= não está corrompido — ele só está vestindo a codificação de transporte. Aqui ela sai, e volta quando você precisa escrever uma.

Carregando a ferramenta…

Como funciona

  1. Cole o cabeçalho, a parte do corpo, ou uma única palavra =?…?=.
  2. Aperte “Decode” (decodificar); cada encoded word é listada com o seu conjunto de caracteres.
  3. Para ir no sentido contrário, digite o texto na caixa de codificação abaixo.

Por que nada é enviado

Tudo o que esta página faz é executado por código que roda dentro da aba do seu navegador, com o mesmo motor que desenha as páginas web. O arquivo é lido do disco para a memória da aba, transformado ali e escrito de volta como um download. Ele nunca é enviado a lugar nenhum — nem para nós, nem para terceiros.

Comprove você mesmo

  1. Abra as ferramentas de desenvolvedor do navegador (F12) e escolha a aba Rede.
  2. Carregue o seu arquivo e rode a ferramenta.
  3. As únicas requisições que você vai ver baixam o código da própria ferramenta — e, em algumas ferramentas pesadas, o motor de código aberto delas a partir de um CDN público — mais um pequeno aviso de visita para loreatec.jp (endereço e título da página, nada mais). Nenhuma delas leva o seu arquivo.

Comprove você mesmo →

Perguntas frequentes

O que é uma encoded word?

Os cabeçalhos de e-mail são, pelo padrão original, só ASCII. O RFC 2047 contorna isso embrulhando o texto não ASCII em =?charset?codificação?texto?=, em que a codificação é B (base64) ou Q (uma variante de quoted-printable). Todo programa de correio decodifica isso para exibir, que é por que você normalmente nunca vê — até que algo mostre o cabeçalho cru.

Ainda devo usar ISO-2022-JP?

Para cabeçalhos que vão às operadoras móveis japonesas e a sistemas realmente antigos, continua sendo a escolha mais segura. Mas ele não consegue representar ①, ㈱, ~, metade dos símbolos que as pessoas colam do Word, nem emoji nenhum: essas coisas chegam como ? ou somem. O UTF-8 carrega tudo e é aceito por todo receptor moderno, inclusive as três operadoras, hoje.

Por que o codificador só oferece UTF-8?

Porque os navegadores conseguem decodificar ISO-2022-JP, Shift_JIS e EUC-JP, mas não conseguem codificar para eles — o TextEncoder só produz UTF-8. Oferecer essas opções e devolver UTF-8 caladamente seria exatamente o tipo de erro silencioso que esta ferramenta existe para expor. A decodificação suporta todos eles.

B ou Q?

Para o japonês, B: quase todo byte precisaria de escape em Q, então o base64 fica mais curto. Para texto quase todo latino com alguns acentos, o Q mantém o cabeçalho legível, o que ajuda quando você está lendo a fonte crua.