Codificação e conversão de texto

Unicode Converter

Analise o Code Point, o byte UTF-8 e a representação de escape de caracteres Unicode e manipule corretamente caracteres simples complementares, como o emoji.

CharacterUnicode Code PointU+XXXXDecimalUTF-8 BytesJavaScript Escape

Visualize informações de codificação um a um ponto de código Unicode e suporte para escape U+ e JavaScript e conversão inversa.

As entradas são processadas apenas no seu browser e não são carregadas no servidor.

O que esta ferramenta faz

O conversor Unicode utiliza for...of, codePointAt e String.fromCodePoint para percorrer o Code Point completo em vez de confundir os substitutos UTF-16 com dois caracteres. A transformação inversa valida estritamente o âmbito e rejeita substitutos órfãos.

  • Apresenta a representação U+, o valor decimal, os bytes UTF-8 e o escape JavaScript para cada caractere.
  • Suporta a recuperação de texto de sequências U+ ou escapes JavaScript Unicode.
  • A entrada e os resultados são processados apenas no browser e o texto de escape gerado não é executado.

Como utilizar

  1. Introduza o texto Unicode a analisar.
  2. Clique em Analisar Unicode para ver os resultados caractere a caractere.
  3. Para inverter a conversão, introduza U+ ou uma sequência de escape.
  4. Copie o texto de restauro após verificação.

Utilizações comuns

  • Verifique Code Points reais para emojis e caracteres chineses raros.
  • Gera representações de escape Unicode necessárias para a depuração.
  • Perceba a diferença entre as representações UTF-16 e UTF-8.

Privacidade e segurança

As entradas e os resultados são processados apenas na memória local do navegador; não são enviados para o servidor, não é chamada qualquer API online e nada é guardado automaticamente.

Funcionalidades do Unicode Converter

Visualize informações de codificação um a um ponto de código Unicode e suporte para escape U+ e JavaScript e conversão inversa. É útil para o desenvolvimento e a depuração do dia a dia; os resultados podem ser consultados, copiados ou descarregados de imediato.

FAQ

Porque é que um emoji ocupa apenas uma linha?

A ferramenta percorre todo o Code Point, fundindo corretamente os pares substitutos UTF-16 que compõem o caractere.

Todos os caracteres podem ser escritos como U+XXXX?

Os planos multilingues básicos utilizam geralmente quatro dígitos; Os pontos de código mais elevados utilizarão naturalmente cinco a seis dígitos hexadecimais.

A transformação inversa executará JavaScript?

Não. A página apenas analisa texto com escape compatível, sem utilizar eval ou new Function.

O conteúdo será carregado?

Não, os cálculos de Code Point e UTF-8 são feitos inteiramente localmente.

Voltar às Ferramentas para programadores