I luoghi preferiti della tua città preferita
Pagina Iniziale
Aggiungi alle fonti preferite su Google

Calcolatore della dimensione del testo

Confronta codifiche e dimensioni dei dati di testo nel browser.

Il tuo testo

L’elaborazione avviene localmente. Lo strumento non carica il testo o i file inseriti. I servizi di analisi e pubblicità del sito possono effettuare richieste di rete.

Dimensione del testo codificato

0 byte

0 byte · 0 bit

KB/MB: base 1000. KiB/MiB: base 1024. Solo contenuto codificato, non memoria, traffico compresso o una richiesta HTTP completa.

UTF-8 · Non aggiungere BOM · Mantieni originali

UTF-8

0 byte

UTF-16LE

0 byte

UTF-16BE

0 byte

UTF-32LE

0 byte

UTF-32BE

0 byte

LE e BE cambiano l’ordine dei byte, non la dimensione. Tutti i confronti usano l’impostazione BOM selezionata.

Testo effettivo: 0 grafemi · 0 punti di codice · 0 unità UTF-16. Originale: 0 unità UTF-16.

Terminatori originali: CRLF 0 · CR 0 · LF 0

Terminatori effettivi: CRLF 0 · CR 0 · LF 0

Confronto dei dati codificati

Base del confronto: codifica grezza selezionata, UTF-8 · Non aggiungere BOM · Mantieni originali. Tutte le righe usano il testo effettivo.

Stringa JSON · UTF-8 · 2 byte

JSON.stringify dell’intero testo effettivo, incluse virgolette ed escape; senza oggetto esterno né BOM aggiunto. I surrogati isolati sono sottoposti a escape, non sostituiti. Il JSON incollato non viene analizzato.

Differenza di dimensione: +2 byte

Componente URL · ASCII · 0 byte

Un valore encodeURIComponent, non un URL completo o un modulo. Gli spazi diventano %20. Nessun BOM aggiunto.

Differenza di dimensione: 0 byte

Valore di modulo · ASCII · 0 byte

Un valore application/x-www-form-urlencoded tramite URLSearchParams: senza nome del campo, segno uguale o altri campi. Gli spazi diventano +; i surrogati isolati diventano U+FFFD. Nessun BOM aggiunto.

Differenza di dimensione: 0 byte

Base64 · ASCII (UTF-8 · Non aggiungere BOM · Mantieni originali) · 0 byte

Base64 standard RFC 4648 con padding, senza interruzioni di riga. Usa i byte della codifica scelta, inclusa la firma opzionale: 4 × ceil(byte / 3).

Differenza di dimensione: 0 byte

Lascia vuoto per disattivare. Inserisci un intero non negativo fino a 9.007.199.254.740.991.

Codifica grezza selezionata (UTF-8 · Non aggiungere BOM · Mantieni originali)

Esamina un file locale

Scegli o trascina un file .txt, .json o .csv fino a 5 MiB. Viene letto localmente come testo, senza analisi o esecuzione. L’importazione UTF-32 non è supportata.

Anteprime codificate e copia

Le anteprime mostrano fino a 600 caratteri di output. I totali includono sempre tutto il testo.

Ispezione dei byte dei caratteri

Indici dei grafemi da 1 nel testo effettivo. Virgolette ed escape rendono visibili i controlli. I contributi escludono il BOM aggiunto. Intl.Segmenter raggruppa combinazioni e sequenze ZWJ; l’alternativa per browser datati può differire per scritture rare. Le voci lunghe sono abbreviate.

Come usare il calcolatore

  1. Incolla testo o esamina un file locale. L’editor inizia vuoto e conserva i terminatori di riga originali.
  2. Scegli codifica, conversione dei terminatori e BOM opzionale. Leggi i byte esatti e confronta le rappresentazioni serializzate.
  3. Imposta un limite facoltativo per la rappresentazione attesa dall’API. Copia l’originale, il riepilogo o l’output codificato completo con i pulsanti.
  4. Leggi la dimensione in evidenza nell’unità scelta automaticamente: byte, KB, MB o GB (TB/PB per valori maggiori). I byte esatti restano sotto e accanto agli altri risultati grandi. Le dimensioni leggibili sono arrotondate; i limiti usano sempre i byte esatti.

Capire byte, codifiche e dati

Un byte contiene otto bit; un carattere visibile può contenere più punti di codice Unicode. 😀 è un grafema, un punto e due unità UTF-16: 4 byte in UTF-8, UTF-16 e UTF-32. Segni combinanti e sequenze ZWJ distinguono il conteggio dei caratteri da quello dei byte.

UTF-8 usa 1–4 byte per valore scalare Unicode; UTF-16 ne usa 2 o 4 e UTF-32 ne usa 4. A occupa rispettivamente 1/2/4 byte. Cirillico, arabo, cinese ed emoji sono testo valido anche se richiedono più byte. Si misura il contenuto codificato, non la memoria JavaScript o lo spazio allocato su disco.

Non vengono applicati normalizzazione, taglio degli spazi o rimozione di caratteri invisibili. é composto usa 2 byte UTF-8; e + U+0301 ne usa 3. Entrambi sono solitamente un grafema. L’originale resta intatto: solo la conversione dei terminatori scelta crea il testo effettivo.

Il BOM aggiunto occupa 3 byte in UTF-8, 2 in UTF-16 o 4 in UTF-32, anche con testo vuoto. Un U+FEFF iniziale letterale resta contenuto. LF usa un byte ASCII; CRLF ne usa due. La conversione tratta CRLF insieme e poi CR/LF isolati, lasciando invariati NEL, U+2028 e U+2029.

Per A spazio B, UTF-8 occupa 3 byte, A%20B nell’URL ne occupa 5 e A+B nel modulo ne occupa 3. A seguito da CRLF e B occupa 4 byte UTF-8, o 3 dopo conversione LF; la stringa JSON preservata ne occupa 8. JSON include virgolette esterne ed escape: serializza l’input come stringa, senza minimizzare un documento JSON.

Base64 è una codifica, non compressione né crittografia. L’output standard con padding occupa 4 × ceil(byteLength / 3) byte ASCII, avvicinandosi a un terzo di aumento per input lunghi. A in UTF-8 diventa QQ== (4 byte). Un input vuoto senza BOM produce Base64 vuoto; una stringa JSON vuota occupa comunque 2 byte.

File.size è il conteggio originale immutabile, firma inclusa. L’importazione supporta UTF-8 e UTF-16LE/BE con decodifica rigorosa. Un BOM riconosciuto sceglie il decoder e viene rimosso una sola volta; eventuali U+FEFF aggiuntivi restano. Senza firma, UTF-8 è un’ipotesi, non un rilevamento affidabile. La ricodifica può differire per codifica, terminatori, BOM o modifiche.

Per un limite API, verifica se il servizio conta testo grezzo, stringa JSON o dati URL/modulo. Il calcolatore esclude nomi di proprietà, oggetti esterni, nomi di campi, segni uguale e intestazioni HTTP. Un limite zero accetta solo una rappresentazione vuota; l’uguaglianza rientra esattamente. Database e piattaforme possono avere regole diverse. Usa gli strumenti correlati per parole, social e segmenti SMS.

Elaborazione locale e ambito

L’elaborazione avviene localmente. Lo strumento non carica il testo o i file inseriti. I servizi di analisi e pubblicità del sito possono effettuare richieste di rete.

Domande frequenti

Un byte contiene otto bit; un carattere visibile può contenere più punti di codice Unicode. 😀 è un grafema, un punto e due unità UTF-16: 4 byte in UTF-8, UTF-16 e UTF-32. Segni combinanti e sequenze ZWJ distinguono il conteggio dei caratteri da quello dei byte.

Il testo grezzo senza BOM aggiunto occupa zero byte. JSON.stringify del testo vuoto include due virgolette, quindi occupa 2 byte UTF-8. Anche la firma occupa byte con testo vuoto.

File.size è il conteggio originale immutabile, firma inclusa. L’importazione supporta UTF-8 e UTF-16LE/BE con decodifica rigorosa. Un BOM riconosciuto sceglie il decoder e viene rimosso una sola volta; eventuali U+FEFF aggiuntivi restano. Senza firma, UTF-8 è un’ipotesi, non un rilevamento affidabile. La ricodifica può differire per codifica, terminatori, BOM o modifiche.

L’elaborazione avviene localmente. Lo strumento non carica il testo o i file inseriti. I servizi di analisi e pubblicità del sito possono effettuare richieste di rete.

Un byte (B) contiene 8 bit. Le unità decimali aumentano di un fattore 1.000: 1 KB = 1.000 byte, 1 MB = 1.000.000 byte e 1 GB = 1.000.000.000 byte; TB e PB proseguono sulla stessa scala. Le unità binarie aumentano di un fattore 1.024: 1 KiB = 1.024 byte, 1 MiB = 1.048.576 byte e 1 GiB = 1.073.741.824 byte. Il risultato principale usa unità decimali, con l’equivalente binario e i byte esatti sotto. Ad esempio, 3.611.805 byte appaiono come 3,6 MB o circa 3,4 MiB. Sono unità diverse per la stessa dimensione, non una compressione. B maiuscola indica i byte; b minuscola indica i bit. L’arrotondamento visivo non modifica il confronto esatto con il limite.

Fonti

Fonti consultate: 2026-09-13. Gli algoritmi seguono queste specifiche; la data non garantisce l’accuratezza.

Contatore di caratteri e segmenti SMS

Scopri la codifica del messaggio, i confini dei segmenti e il possibile costo. Il testo rimane nel tuo browser.

Apri strumentoContatore di caratteri e segmenti SMS

Contatore di caratteri per social media

Verifica i limiti delle piattaforme e dividi i post senza perdere testo.

Apri strumentoContatore di caratteri per social media

Contatore di caratteri

Conta caratteri, parole, frasi e paragrafi. Controlla densità delle parole, tempo di lettura e dimensione UTF-8 nel browser.

Apri strumentoContatore di caratteri