Lugares Favoritos da Sua Cidade Favorita
Início
Adicionar às fontes preferidas no Google

Calculadora de tamanho de texto

Compare codificações e tamanhos de dados de texto no navegador.

Seu texto

O processamento é local. Esta ferramenta não envia textos ou arquivos inseridos. Os serviços de análise e publicidade do site podem fazer solicitações de rede.

Tamanho do texto codificado

0 bytes

0 bytes · 0 bits

KB/MB: base 1000. KiB/MiB: base 1024. Apenas o conteúdo codificado, não a memória, o tráfego comprimido ou uma requisição HTTP completa.

UTF-8 · Não adicionar BOM · Preservar originais

UTF-8

0 bytes

UTF-16LE

0 bytes

UTF-16BE

0 bytes

UTF-32LE

0 bytes

UTF-32BE

0 bytes

LE e BE mudam a ordem dos bytes, não o tamanho. Todas as comparações usam a opção de BOM selecionada.

Texto efetivo: 0 grafemas · 0 pontos de código · 0 unidades UTF-16. Original: 0 unidades UTF-16.

Quebras originais: CRLF 0 · CR 0 · LF 0

Quebras efetivas: CRLF 0 · CR 0 · LF 0

Comparação de dados codificados

Base de comparação: codificação bruta selecionada, UTF-8 · Não adicionar BOM · Preservar originais. Todas as linhas usam o texto efetivo.

String JSON · UTF-8 · 2 bytes

JSON.stringify de todo o texto efetivo, com aspas e escapes; sem objeto externo nem BOM adicionado. Substitutos isolados são escapados, não substituídos. O JSON colado não é interpretado.

Diferença de tamanho: +2 bytes

Componente URL · ASCII · 0 bytes

Um valor encodeURIComponent, não uma URL completa ou formulário. Espaços viram %20. Sem BOM adicionado.

Diferença de tamanho: 0 bytes

Valor de formulário · ASCII · 0 bytes

Um valor application/x-www-form-urlencoded via URLSearchParams: sem nome do campo, sinal de igual ou outros campos. Espaços viram +; substitutos isolados viram U+FFFD. Sem BOM adicionado.

Diferença de tamanho: 0 bytes

Base64 · ASCII (UTF-8 · Não adicionar BOM · Preservar originais) · 0 bytes

Base64 padrão RFC 4648 com preenchimento, sem quebras. Usa os bytes da codificação escolhida, incluindo a assinatura opcional: 4 × ceil(bytes / 3).

Diferença de tamanho: 0 bytes

Em branco desativa o limite. Insira um inteiro não negativo até 9.007.199.254.740.991.

Codificação bruta selecionada (UTF-8 · Não adicionar BOM · Preservar originais)

Inspecionar arquivo local

Escolha ou arraste um arquivo .txt, .json ou .csv de até 5 MiB. Ele é lido localmente como texto, sem interpretação ou execução. A importação UTF-32 não é suportada.

Prévias codificadas e cópia

As prévias mostram até 600 caracteres de saída. Os totais sempre incluem todo o texto.

Inspeção de bytes por caractere

Índices de grafemas a partir de 1 no texto efetivo. Aspas e escapes mostram controles. As contribuições excluem o BOM adicionado. Intl.Segmenter agrupa combinações e sequências ZWJ; a alternativa para navegadores antigos pode diferir em escritas raras. Entradas longas são abreviadas.

Como usar a calculadora

  1. Cole texto ou inspecione um arquivo local. O editor começa vazio e preserva as quebras de linha originais.
  2. Escolha a codificação, a conversão de quebras e o BOM opcional. Veja os bytes exatos e compare as representações serializadas.
  3. Defina um limite opcional para a representação esperada pela API. Copie o original, o resumo ou a saída codificada completa com os botões.
  4. Leia o tamanho em destaque na unidade escolhida automaticamente: bytes, KB, MB ou GB (TB/PB para valores maiores). Os bytes exatos ficam abaixo e ao lado dos outros resultados grandes. Os tamanhos legíveis são arredondados; os limites sempre usam bytes exatos.

Entenda bytes, codificações e dados

Um byte tem oito bits; um caractere visível pode conter vários pontos de código Unicode. 😀 é um grafema, um ponto e duas unidades UTF-16: 4 bytes em UTF-8, UTF-16 e UTF-32. Marcas combinantes e sequências ZWJ fazem a contagem de caracteres diferir da de bytes.

UTF-8 usa 1–4 bytes por valor escalar Unicode; UTF-16 usa 2 ou 4 e UTF-32 usa 4. A ocupa 1/2/4 bytes, respectivamente. Cirílico, árabe, chinês e emojis são textos válidos, mesmo ocupando mais bytes. São tamanhos do conteúdo codificado, não da memória JavaScript ou do espaço alocado no disco.

Não há normalização, corte de espaços ou remoção de caracteres invisíveis. é composto usa 2 bytes UTF-8; e + U+0301 usa 3. Ambos costumam ser um grafema. O original é preservado: apenas a conversão de quebras escolhida cria o texto efetivo.

O BOM adicionado ocupa 3 bytes em UTF-8, 2 em UTF-16 ou 4 em UTF-32, mesmo com texto vazio. Um U+FEFF inicial literal continua sendo conteúdo. LF usa um byte ASCII; CRLF usa dois. A conversão trata CRLF como par e depois CR/LF isolados, preservando NEL, U+2028 e U+2029.

Para A espaço B, UTF-8 ocupa 3 bytes, A%20B na URL ocupa 5 e A+B no formulário ocupa 3. A seguido de CRLF e B ocupa 4 bytes UTF-8, ou 3 após conversão LF; a string JSON preservada ocupa 8. JSON inclui aspas externas e escapes: serializa a entrada como uma string, sem minificar um documento JSON.

Base64 é codificação, não compressão nem criptografia. A saída padrão com preenchimento ocupa 4 × ceil(byteLength / 3) bytes ASCII, aproximando-se de um terço de acréscimo para entradas longas. A em UTF-8 vira QQ== (4 bytes). Texto vazio sem BOM gera Base64 vazio; uma string JSON vazia ainda ocupa 2 bytes.

File.size é a contagem original imutável, incluindo a assinatura. A importação suporta UTF-8 e UTF-16LE/BE com decodificação estrita. Um BOM reconhecido escolhe o decodificador e é removido uma única vez; U+FEFF adicional é preservado. Sem assinatura, UTF-8 é uma suposição, não detecção confiável. A recodificação pode diferir por codificação, quebras, BOM ou edições.

Para limites de campos de API, confirme se o serviço conta texto bruto, string JSON ou dados URL/formulário. A calculadora exclui nomes de propriedades, objetos externos, nomes de campos, sinais de igual e cabeçalhos HTTP. Limite zero aceita apenas representação vazia; igualdade cabe exatamente. Regras de bancos e plataformas podem diferir. Use as ferramentas relacionadas para palavras, redes sociais e segmentos SMS.

Processamento local e escopo

O processamento é local. Esta ferramenta não envia textos ou arquivos inseridos. Os serviços de análise e publicidade do site podem fazer solicitações de rede.

Perguntas frequentes

Um byte tem oito bits; um caractere visível pode conter vários pontos de código Unicode. 😀 é um grafema, um ponto e duas unidades UTF-16: 4 bytes em UTF-8, UTF-16 e UTF-32. Marcas combinantes e sequências ZWJ fazem a contagem de caracteres diferir da de bytes.

Texto bruto sem BOM adicionado ocupa zero bytes. JSON.stringify de texto vazio inclui duas aspas, ocupando 2 bytes UTF-8. A assinatura também ocupa bytes, mesmo com texto vazio.

File.size é a contagem original imutável, incluindo a assinatura. A importação suporta UTF-8 e UTF-16LE/BE com decodificação estrita. Um BOM reconhecido escolhe o decodificador e é removido uma única vez; U+FEFF adicional é preservado. Sem assinatura, UTF-8 é uma suposição, não detecção confiável. A recodificação pode diferir por codificação, quebras, BOM ou edições.

O processamento é local. Esta ferramenta não envia textos ou arquivos inseridos. Os serviços de análise e publicidade do site podem fazer solicitações de rede.

Um byte (B) contém 8 bits. As unidades decimais aumentam por fatores de 1.000: 1 KB = 1.000 bytes, 1 MB = 1.000.000 bytes e 1 GB = 1.000.000.000 bytes; TB e PB seguem a mesma escala. As unidades binárias aumentam por fatores de 1.024: 1 KiB = 1.024 bytes, 1 MiB = 1.048.576 bytes e 1 GiB = 1.073.741.824 bytes. O resultado principal usa unidades decimais, com o equivalente binário e os bytes exatos abaixo. Por exemplo, 3.611.805 bytes aparecem como 3,6 MB ou cerca de 3,4 MiB. São unidades diferentes para o mesmo tamanho, não compressão. B maiúsculo significa bytes; b minúsculo significa bits. O arredondamento visual não altera a comparação exata com o limite.

Fontes

Fontes consultadas: 2026-09-13. Os algoritmos seguem estas especificações; a data não garante precisão.

Contador de caracteres e segmentos SMS

Veja a codificação da mensagem, os limites dos segmentos e o possível custo. O texto fica no seu navegador.

Abrir ferramentaContador de caracteres e segmentos SMS

Contador de caracteres para redes sociais

Confira os limites de cada plataforma e divida publicações sem perder texto.

Abrir ferramentaContador de caracteres para redes sociais

Contador de caracteres

Conte caracteres, palavras, frases e parágrafos. Consulte a densidade de palavras, o tempo de leitura e o tamanho UTF-8 no navegador.

Abrir ferramentaContador de caracteres