Explorador Unicode

Inspecione code points, categorias e representações Unicode de um texto.

Como interpretar Unicode e segmentação

Explorador Unicode trabalha com uma camada do texto que nem sempre aparece na tela. Um caractere percebido pode ser formado por vários code points, emojis podem usar sequências com ZWJ e regras de palavras variam por idioma.

  • Diferencie unidades UTF-16, code points e grapheme clusters antes de definir limites de campos ou posições.
  • Use normalização quando precisar comparar textos equivalentes representados por sequências diferentes.
  • Trate os resultados como uma análise padrão: idiomas como tailandês, chinês e japonês podem exigir regras específicas.
Dica prática: Não corte texto no meio de um grapheme cluster e teste sempre com emojis, acentos e diferentes alfabetos.

Como usar este módulo

Inspecionar Unicode revela como um texto é representado internamente. Essa visão ajuda a encontrar caracteres invisíveis, combinações inesperadas e diferenças entre símbolos parecidos.

Dica prática: Use dados reais somente quando não houver informação sensível na entrada.