Calcolatore della dimensione del testo
Confronta codifiche e dimensioni dei dati di testo nel browser.
Come usare il calcolatore
- Incolla testo o esamina un file locale. L’editor inizia vuoto e conserva i terminatori di riga originali.
- Scegli codifica, conversione dei terminatori e BOM opzionale. Leggi i byte esatti e confronta le rappresentazioni serializzate.
- Imposta un limite facoltativo per la rappresentazione attesa dall’API. Copia l’originale, il riepilogo o l’output codificato completo con i pulsanti.
- Leggi la dimensione in evidenza nell’unità scelta automaticamente: byte, KB, MB o GB (TB/PB per valori maggiori). I byte esatti restano sotto e accanto agli altri risultati grandi. Le dimensioni leggibili sono arrotondate; i limiti usano sempre i byte esatti.
Capire byte, codifiche e dati
Un byte contiene otto bit; un carattere visibile può contenere più punti di codice Unicode. 😀 è un grafema, un punto e due unità UTF-16: 4 byte in UTF-8, UTF-16 e UTF-32. Segni combinanti e sequenze ZWJ distinguono il conteggio dei caratteri da quello dei byte.
UTF-8 usa 1–4 byte per valore scalare Unicode; UTF-16 ne usa 2 o 4 e UTF-32 ne usa 4. A occupa rispettivamente 1/2/4 byte. Cirillico, arabo, cinese ed emoji sono testo valido anche se richiedono più byte. Si misura il contenuto codificato, non la memoria JavaScript o lo spazio allocato su disco.
Non vengono applicati normalizzazione, taglio degli spazi o rimozione di caratteri invisibili. é composto usa 2 byte UTF-8; e + U+0301 ne usa 3. Entrambi sono solitamente un grafema. L’originale resta intatto: solo la conversione dei terminatori scelta crea il testo effettivo.
Il BOM aggiunto occupa 3 byte in UTF-8, 2 in UTF-16 o 4 in UTF-32, anche con testo vuoto. Un U+FEFF iniziale letterale resta contenuto. LF usa un byte ASCII; CRLF ne usa due. La conversione tratta CRLF insieme e poi CR/LF isolati, lasciando invariati NEL, U+2028 e U+2029.
Per A spazio B, UTF-8 occupa 3 byte, A%20B nell’URL ne occupa 5 e A+B nel modulo ne occupa 3. A seguito da CRLF e B occupa 4 byte UTF-8, o 3 dopo conversione LF; la stringa JSON preservata ne occupa 8. JSON include virgolette esterne ed escape: serializza l’input come stringa, senza minimizzare un documento JSON.
Base64 è una codifica, non compressione né crittografia. L’output standard con padding occupa 4 × ceil(byteLength / 3) byte ASCII, avvicinandosi a un terzo di aumento per input lunghi. A in UTF-8 diventa QQ== (4 byte). Un input vuoto senza BOM produce Base64 vuoto; una stringa JSON vuota occupa comunque 2 byte.
File.size è il conteggio originale immutabile, firma inclusa. L’importazione supporta UTF-8 e UTF-16LE/BE con decodifica rigorosa. Un BOM riconosciuto sceglie il decoder e viene rimosso una sola volta; eventuali U+FEFF aggiuntivi restano. Senza firma, UTF-8 è un’ipotesi, non un rilevamento affidabile. La ricodifica può differire per codifica, terminatori, BOM o modifiche.
Per un limite API, verifica se il servizio conta testo grezzo, stringa JSON o dati URL/modulo. Il calcolatore esclude nomi di proprietà, oggetti esterni, nomi di campi, segni uguale e intestazioni HTTP. Un limite zero accetta solo una rappresentazione vuota; l’uguaglianza rientra esattamente. Database e piattaforme possono avere regole diverse. Usa gli strumenti correlati per parole, social e segmenti SMS.
Elaborazione locale e ambito
L’elaborazione avviene localmente. Lo strumento non carica il testo o i file inseriti. I servizi di analisi e pubblicità del sito possono effettuare richieste di rete.
Domande frequenti
Fonti
Fonti consultate: 2026-09-13. Gli algoritmi seguono queste specifiche; la data non garantisce l’accuratezza.Strumenti correlati
Contatore di caratteri e segmenti SMS
Scopri la codifica del messaggio, i confini dei segmenti e il possibile costo. Il testo rimane nel tuo browser.
Apri strumento — Contatore di caratteri e segmenti SMSContatore di caratteri per social media
Verifica i limiti delle piattaforme e dividi i post senza perdere testo.
Apri strumento — Contatore di caratteri per social mediaContatore di caratteri
Conta caratteri, parole, frasi e paragrafi. Controlla densità delle parole, tempo di lettura e dimensione UTF-8 nel browser.
Apri strumento — Contatore di caratteri