Ordenador por idioma

Compara y ordena listas respetando idioma, acentos y mayúsculas.

Cómo interpretar Unicode y la segmentación

Ordenador por idioma trabaja con una capa del texto que no siempre aparece en pantalla. Un carácter percibido puede tener varios puntos de código, los emojis pueden usar secuencias ZWJ y las reglas de palabras varían por idioma.

  • Distingue unidades UTF-16, puntos de código y clusters de grafemas antes de definir límites o posiciones.
  • Usa normalización al comparar textos equivalentes representados mediante secuencias diferentes.
  • Trata el resultado como un análisis predeterminado: tailandés, chino y japonés pueden necesitar reglas adaptadas.
Consejo práctico: No cortes texto dentro de un cluster de grafemas. Prueba emojis, marcas combinadas y alfabetos distintos.

Como usar este módulo

Ordenação por idioma considera regras de collation que uma comparação simples de Unicode não representa. A mesma lista pode ter ordem diferente em português, alemão ou espanhol.

Dica prática: Não use a ordem visual de um idioma para inferir a ordem correta de outro.