Unicode

Technical/Unicode

Padrão universal de codificação de caracteres que atribui um número único a cada caractere de todos os sistemas de escrita e conjuntos de símbolos, incluindo emoji.

Unicode is the foundation of modern text computing. Before Unicode, competing encoding standards (ASCII, ISO 8859, Shift JIS, etc.) made international text exchange error-prone. Unicode provides a single, consistent mapping from numbers to characters.

The standard defines over 154,000 characters spanning 168 scripts. Emoji are allocated primarily in the Supplementary Multilingual Plane (Plane 1), starting around U+1F600. The Unicode Consortium releases new versions annually, each potentially adding new emoji.

Unicode only defines *what* each code point means — the actual byte representation depends on the encoding form used (UTF-8, UTF-16, or UTF-32).

Termos relacionados

Emoji Emoji
Palavra japonesa (絵文字) que significa 'caractere imagem' — pequenos símbolos gráficos usados na comunicação digital para expressar ideias, emoções e objetos.
ICU (ICU) ICU (ICU)
International Components for Unicode — uma biblioteca de código aberto amplamente utilizada que fornece suporte a Unicode e internacionalização, incluindo processamento de emoji.
Padrão Unicode Padrão Unicode
O sistema completo de codificação de caracteres mantido pelo Consórcio Unicode, que define caracteres, propriedades, algoritmos e formas de codificação.
Ponto de código Ponto de código
Valor numérico único atribuído a cada caractere no padrão Unicode, escrito no formato U+XXXX (por exemplo, U+1F600 para 😀).

Ferramentas relacionadas

🔢 Consulta Unicode Consulta Unicode
Digite um codepoint como U+1F600 e obtenha o emoji, detalhes de codificação, bytes UTF-8/16 e entidades HTML.
🔍 Analisador de sequências Analisador de sequências
Decodifique sequências ZWJ, modificadores de tom de pele, sequências de teclas e pares de bandeiras em componentes individuais.