Les lieux préférés de votre ville préférée
Accueil
Ajouter aux sources préférées sur Google

Calculateur de taille de texte

Comparez les encodages et la taille des données textuelles dans votre navigateur.

Votre texte

Le traitement est local. Cet outil ne téléverse ni le texte saisi ni les fichiers. Les services d’analyse et de publicité du site peuvent effectuer des requêtes réseau.

Taille du texte encodé

0 octets

0 octets · 0 bits

KB/MB : base 1000. KiB/MiB : base 1024. Contenu encodé uniquement, hors mémoire, trafic compressé ou requête HTTP complète.

UTF-8 · Ne pas ajouter de BOM · Conserver les originaux

UTF-8

0 octets

UTF-16LE

0 octets

UTF-16BE

0 octets

UTF-32LE

0 octets

UTF-32BE

0 octets

LE et BE modifient l’ordre des octets, pas la taille. Tous les comparatifs suivent le réglage BOM choisi.

Texte effectif : 0 graphèmes · 0 points de code · 0 unités UTF-16. Source : 0 unités UTF-16.

Fins de ligne d’origine: CRLF 0 · CR 0 · LF 0

Fins de ligne effectives: CRLF 0 · CR 0 · LF 0

Comparaison des données encodées

Base de comparaison : encodage brut choisi, UTF-8 · Ne pas ajouter de BOM · Conserver les originaux. Toutes les lignes utilisent le texte effectif.

Chaîne JSON · UTF-8 · 2 octets

JSON.stringify du texte effectif entier, guillemets et échappements inclus ; sans objet englobant ni BOM ajouté. Les substituts isolés sont échappés, pas remplacés. Le JSON collé n’est pas analysé.

Différence de taille: +2 octets

Composant URL · ASCII · 0 octets

Une valeur encodeURIComponent, pas une URL complète ni un formulaire. Les espaces deviennent %20. Aucun BOM ajouté.

Différence de taille: 0 octets

Valeur de formulaire · ASCII · 0 octets

Une valeur application/x-www-form-urlencoded via URLSearchParams : sans nom de champ, signe égal ni autres champs. Les espaces deviennent + ; les substituts isolés deviennent U+FFFD. Aucun BOM ajouté.

Différence de taille: 0 octets

Base64 · ASCII (UTF-8 · Ne pas ajouter de BOM · Conserver les originaux) · 0 octets

Base64 standard RFC 4648 avec remplissage, sans retour à la ligne. Utilise les octets de l’encodage choisi, signature facultative incluse : 4 × ceil(octets / 3).

Différence de taille: 0 octets

Laissez vide pour désactiver. Saisissez un entier positif ou nul, jusqu’à 9 007 199 254 740 991.

Encodage brut choisi (UTF-8 · Ne pas ajouter de BOM · Conserver les originaux)

Examiner un fichier local

Choisissez ou déposez un fichier .txt, .json ou .csv de 5 MiB maximum. Il est lu localement comme texte, sans analyse ni exécution. L’import UTF-32 n’est pas pris en charge.

Aperçus encodés et copie

Les aperçus affichent au maximum 600 caractères de sortie. Les totaux couvrent toujours le texte entier.

Inspection des octets par caractère

Indices de graphèmes à partir de 1 dans le texte effectif. Guillemets et échappements rendent les contrôles visibles. Les contributions excluent le BOM ajouté. Intl.Segmenter regroupe les combinaisons et séquences ZWJ ; le repli des anciens navigateurs peut différer pour certaines écritures rares. Les longues entrées sont abrégées.

Comment utiliser le calculateur

  1. Collez du texte ou examinez un fichier local. L’éditeur démarre vide et conserve les fins de ligne d’origine.
  2. Choisissez l’encodage, la conversion des fins de ligne et le BOM facultatif. Consultez les octets exacts et comparez les représentations sérialisées.
  3. Définissez un budget facultatif pour la représentation attendue par votre API. Copiez explicitement l’original, le récapitulatif ou la sortie encodée complète.
  4. Lisez la taille mise en évidence dans l’unité choisie automatiquement : octets, KB, MB ou GB (TB/PB pour les valeurs supérieures). Les octets exacts restent indiqués en dessous et à côté des autres grands résultats. Les tailles lisibles sont arrondies ; les budgets utilisent toujours les octets exacts.

Comprendre les octets, encodages et données

Un octet contient huit bits ; un caractère visible peut comprendre plusieurs points de code Unicode. 😀 est un graphème, un point et deux unités UTF-16 : 4 octets en UTF-8, UTF-16 et UTF-32. Les signes combinatoires et séquences ZWJ expliquent les différences de comptage.

UTF-8 utilise 1 à 4 octets par valeur scalaire Unicode ; UTF-16 en utilise 2 ou 4 et UTF-32 en utilise 4. A occupe respectivement 1/2/4 octets. Le cyrillique, l’arabe, le chinois et les emoji sont du texte valide, même s’ils prennent plus d’octets. Il s’agit du contenu encodé, pas de la mémoire JavaScript ni de l’espace disque alloué.

Aucune normalisation, suppression d’espaces ou de caractères invisibles n’est appliquée. é composé utilise 2 octets UTF-8 ; e + U+0301 en utilise 3. Les deux forment généralement un graphème. La source reste intacte : seule la conversion de fins de ligne choisie crée le texte effectif.

Le BOM ajouté occupe 3 octets en UTF-8, 2 en UTF-16 ou 4 en UTF-32, même pour un texte vide. Un U+FEFF initial littéral reste du contenu. LF utilise un octet ASCII ; CRLF en utilise deux. La conversion traite CRLF ensemble, puis CR/LF isolés, sans modifier NEL, U+2028 et U+2029.

Pour A espace B, UTF-8 occupe 3 octets, A%20B en URL en occupe 5 et A+B en formulaire en occupe 3. A suivi de CRLF puis B occupe 4 octets UTF-8, ou 3 après conversion LF ; sa chaîne JSON préservée en occupe 8. JSON inclut guillemets externes et échappements : l’entrée est sérialisée comme une chaîne, sans minifier un document JSON.

Base64 est un encodage, pas une compression ni un chiffrement. La sortie standard avec remplissage occupe 4 × ceil(byteLength / 3) octets ASCII, soit environ un tiers de plus pour les longues entrées. A en UTF-8 devient QQ== (4 octets). Une entrée vide sans BOM produit du Base64 vide ; une chaîne JSON vide occupe toujours 2 octets.

File.size est le nombre d’octets original immuable, signature incluse. L’import prend en charge UTF-8 et UTF-16LE/BE avec décodage strict. Un BOM reconnu choisit le décodeur et est retiré une seule fois ; tout U+FEFF supplémentaire est conservé. Sans signature, UTF-8 est supposé, pas détecté avec certitude. Le réencodage peut différer selon l’encodage, les fins de ligne, le BOM ou les modifications.

Pour un champ d’API, vérifiez si le service compte le texte brut, une chaîne JSON ou les données URL/formulaire. Le calculateur exclut noms de propriétés, objets englobants, noms de champs, signes égal et en-têtes HTTP. Un budget nul accepte uniquement une représentation vide ; l’égalité respecte exactement le budget. Les règles des bases et plateformes peuvent différer. Utilisez les outils associés pour les mots, réseaux sociaux et segments SMS.

Traitement local et périmètre

Le traitement est local. Cet outil ne téléverse ni le texte saisi ni les fichiers. Les services d’analyse et de publicité du site peuvent effectuer des requêtes réseau.

Questions fréquentes

Un octet contient huit bits ; un caractère visible peut comprendre plusieurs points de code Unicode. 😀 est un graphème, un point et deux unités UTF-16 : 4 octets en UTF-8, UTF-16 et UTF-32. Les signes combinatoires et séquences ZWJ expliquent les différences de comptage.

Le texte brut sans BOM ajouté occupe zéro octet. JSON.stringify d’un texte vide inclut deux guillemets, soit 2 octets UTF-8. La signature occupe aussi des octets, même sans texte.

File.size est le nombre d’octets original immuable, signature incluse. L’import prend en charge UTF-8 et UTF-16LE/BE avec décodage strict. Un BOM reconnu choisit le décodeur et est retiré une seule fois ; tout U+FEFF supplémentaire est conservé. Sans signature, UTF-8 est supposé, pas détecté avec certitude. Le réencodage peut différer selon l’encodage, les fins de ligne, le BOM ou les modifications.

Le traitement est local. Cet outil ne téléverse ni le texte saisi ni les fichiers. Les services d’analyse et de publicité du site peuvent effectuer des requêtes réseau.

Un octet (B, pour byte) contient 8 bits. Les unités décimales progressent par facteurs de 1 000 : 1 KB = 1 000 octets, 1 MB = 1 000 000 octets et 1 GB = 1 000 000 000 octets ; TB et PB prolongent cette échelle. Les unités binaires progressent par facteurs de 1 024 : 1 KiB = 1 024 octets, 1 MiB = 1 048 576 octets et 1 GiB = 1 073 741 824 octets. Le résultat principal utilise les unités décimales, avec l’équivalent binaire et les octets exacts en dessous. Par exemple, 3 611 805 octets s’affichent comme 3,6 MB ou environ 3,4 MiB. Ce sont différentes unités pour la même taille, pas une compression. B majuscule désigne les octets ; b minuscule désigne les bits. L’arrondi d’affichage ne modifie jamais la comparaison exacte avec le budget.

Sources

Sources consultées le 2026-09-13. Les algorithmes suivent ces spécifications ; la date ne garantit pas l’exactitude.

Compteur de caractères et de segments SMS

Découvrez l’encodage du message, les limites de ses segments et son coût possible. Le texte reste dans votre navigateur.

Ouvrir l’outilCompteur de caractères et de segments SMS

Compteur de caractères pour réseaux sociaux

Vérifiez les limites des plateformes et divisez vos publications sans perdre de texte.

Ouvrir l’outilCompteur de caractères pour réseaux sociaux

Compteur de caractères

Comptez les caractères, mots, phrases et paragraphes. Consultez la densité des mots, le temps de lecture et la taille UTF-8 dans votre navigateur.

Ouvrir l’outilCompteur de caractères