Conversor de Texto para Código ASCII/Unicode
Converta texto em uma lista de códigos de caractere decimais e vice-versa — cobre todo o intervalo Unicode, não apenas o ASCII de 7 bits.
1.070 visualizações
Como Funciona
Cada caractere que você digita é percorrido um de cada vez e convertido em seu ponto de código Unicode — o mesmo sistema de numeração cujos primeiros 128 valores, de 0 a 127, formam a tabela ASCII original. Dentro dessa faixa, os códigos 32-126 formam o bloco imprimível: letras, dígitos, pontuação e o caractere de espaço. Os códigos 0-31 são caracteres de controle, uma camada histórica herdada de teleimpressoras e máquinas de escrever que usavam códigos específicos para mover a cabeça de impressão ou o papel em vez de imprimir um glifo — o código 13 (retorno de carro) mandava a cabeça de volta ao início da linha, e o código 10 (alimentação de linha) avançava o papel uma linha, uma separação que explica por que arquivos de texto puro em sistemas operacionais diferentes ainda discordam sobre como uma quebra de linha é armazenada.
Exemplo: digitar "Oi!" produz a lista de códigos 79, 105, 33 — o O maiúsculo é 79, o i minúsculo é 105 e o ponto de exclamação é 33, todos dentro da faixa imprimível 32-126. Colar essa lista de volta no decodificador reconstrói "Oi!" exatamente, caractere por caractere.
O ponto em que esta ferramenta vai além de uma tabela ASCII de livro didático são os códigos 128 e acima. Essa faixa superior, chamada informalmente de "ASCII estendido", nunca foi padronizada: diferentes fornecedores e regiões criaram diferentes páginas de código de 256 valores, atribuindo glifos diferentes ao mesmo byte. Um byte que significava "ã" em uma página de código poderia significar um caractere completamente diferente, ou nada imprimível, em outra. Essa inconsistência é exatamente o problema que o UTF-8 e os pontos de código Unicode completos foram criados para resolver: em vez de um byte por caractere com um significado dependente da página de código, cada caractere recebe uma identidade numérica estável que significa a mesma coisa em qualquer lugar. É por isso que este conversor codifica cada caractere como um ponto de código Unicode completo em vez de truncar para um único byte, de modo que letras acentuadas como á, ç, ã, õ, é e emojis sejam convertidos de forma confiável.
O Que Você Precisa Saber
- Faixa imprimível: os códigos 32-126 sempre correspondem a um caractere visível em qualquer sistema; qualquer outro valor precisa de contexto (uma fonte, uma página de código ou o Unicode completo) para ser interpretado corretamente.
- Códigos de controle não têm glifo: decodificar um valor de 0-31 (ou 127, DEL) de volta para texto não vai mostrar um caractere imprimível — isso é esperado, não um erro, já que esses códigos nunca foram feitos para serem exibidos.
- Além do byte 255: os pontos de código Unicode vão muito além do antigo teto de 256 valores — os emojis, por exemplo, vivem na casa das centenas de milhares — e esta ferramenta lida com a faixa completa, não apenas com o equivalente a um byte.
- Ciclo completo sem perdas: codificar e depois decodificar sempre retorna seu texto original exatamente, já que cada ponto de código corresponde a um único caractere, sem nada aproximado ou compactado.
- Roda inteiramente no seu navegador: nenhum texto é enviado para lugar nenhum, então é seguro converter strings sensíveis, tokens ou senhas para fins de depuração.
Perguntas Frequentes
Isso é realmente ASCII, ou algo mais?
O ASCII real de 7 bits cobre apenas os códigos 0-127 (letras em inglês, dígitos, pontuação básica). Esta ferramenta usa a mesma ideia, mas a estende para os pontos de código Unicode completos, de modo que letras acentuadas (á, ç, ã) e emojis sejam convertidos corretamente em vez de quebrarem.
Qual separador a lista de códigos utiliza?
Vírgulas, por padrão com um espaço depois de cada uma — mas o decodificador também aceita códigos separados apenas por espaços ou quebras de linha.
Qual é a diferença entre o código 10 e o código 13?
Os dois são caracteres de controle históricos de quebra de linha: o código 10 é "line feed" (avança uma linha), e o código 13 é "carriage return" (volta ao início da linha). O Unix usa só LF, o Mac clássico usava só CR, e o Windows usa os dois juntos (CRLF) — uma divisão que remonta diretamente ao hardware físico das teleimpressoras.
Por que os códigos acima de 127 aparecem diferentes em outras ferramentas?
Porque essa faixa nunca foi padronizada. A página de código "ASCII estendido" de cada fornecedor atribuiu seus próprios glifos aos bytes 128-255, então o mesmo valor de byte pode ser decodificado como caracteres diferentes em sistemas diferentes. Esta ferramenta contorna isso completamente ao trabalhar com Unicode completo em vez de uma tabela fixa de 256 valores.
Isso consegue lidar com emojis e outros caracteres de vários bytes?
Sim — emojis e muitos outros símbolos vivem em pontos de código muito além de 255, e esta ferramenta converte cada um para seu valor decimal Unicode completo (alguns emojis, como bandeiras, na verdade são formados por dois pontos de código, que a lista mostrará como dois números separados).
Ferramentas Semelhantes
Reportar um Problema
Conversor de Texto para Código ASCII/Unicode
Comentários
Ainda não há comentários — seja o primeiro a escrever um!