Любимые места любимого города
Главная
Добавить в предпочтительные источники Google

Калькулятор размера текста

Сравнивайте кодировки и размеры передаваемого текста прямо в браузере.

Ваш текст

Обработка выполняется локально. Инструмент не загружает введённый текст и файлы на сервер. Общие системы аналитики и рекламы сайта могут выполнять сетевые запросы.

Размер текста в кодировке

0 байт

0 байт · 0 бит

KB/MB: основание 1000. KiB/MiB: 1024. Только закодированное содержимое, не память, сжатый трафик или полный HTTP-запрос.

UTF-8 · Не добавлять BOM · Сохранить исходные

UTF-8

0 байт

UTF-16LE

0 байт

UTF-16BE

0 байт

UTF-32LE

0 байт

UTF-32BE

0 байт

LE и BE меняют порядок байтов, но не размер. Все сравнения учитывают выбранную настройку BOM.

Расчётный текст: 0 графем · 0 кодовых точек · 0 единиц UTF-16. Исходный: 0 единиц UTF-16.

Исходные переводы строк: CRLF 0 · CR 0 · LF 0

Расчётные переводы строк: CRLF 0 · CR 0 · LF 0

Сравнение форматов передачи

База сравнения: исходная кодировка, UTF-8 · Не добавлять BOM · Сохранить исходные. Все строки используют расчётный текст.

Строка JSON · UTF-8 · 2 байт

JSON.stringify всего расчётного текста с кавычками и экранированием; без обёртки и добавленного BOM. Одиночные суррогаты экранируются, не заменяются. Вставленный JSON не разбирается.

Разница в размере: +2 байт

Компонент URL · ASCII · 0 байт

Одно значение encodeURIComponent, не полный URL и не форма. Пробелы становятся %20. Без добавленного BOM.

Разница в размере: 0 байт

Значение поля формы · ASCII · 0 байт

Одно значение application/x-www-form-urlencoded по URLSearchParams: без имени поля, знака равенства и других полей. Пробелы становятся +, одиночные суррогаты — U+FFFD. Без добавленного BOM.

Разница в размере: 0 байт

Base64 · ASCII (UTF-8 · Не добавлять BOM · Сохранить исходные) · 0 байт

Стандартный Base64 RFC 4648 с дополнением, без переносов. Байты выбранной кодировки, включая необязательную сигнатуру: 4 × ceil(байты / 3).

Разница в размере: 0 байт

Пустое поле отключает лимит. Введите целое неотрицательное число до 9 007 199 254 740 991.

Выбранная кодировка (UTF-8 · Не добавлять BOM · Сохранить исходные)

Проверить локальный файл

Выберите или перетащите один файл .txt, .json или .csv до 5 MiB. Он читается локально как текст, без разбора или выполнения. Импорт файлов UTF-32 не поддерживается.

Предпросмотр кодирования и копирование

Предпросмотр показывает до 600 символов результата. Итоговые байты всегда относятся ко всему тексту.

Побайтовый разбор символов

Индексы графем расчётного текста начинаются с 1. Кавычки и экранирование показывают управляющие символы. Вклад не включает добавленный BOM. Intl.Segmenter группирует комбинации и ZWJ; резервный алгоритм старых браузеров может отличаться для редких письменностей. Длинные записи сокращаются.

Как пользоваться калькулятором

  1. Вставьте текст или откройте локальный текстовый файл. Редактор изначально пуст и сохраняет исходные переводы строк.
  2. Выберите кодировку, преобразование переводов строк и необязательный BOM. Посмотрите точное число байтов и сравните форматы сериализации.
  3. При необходимости задайте лимит байтов для формата, который ожидает ваш API. Отдельными кнопками скопируйте исходник, сводку или полный результат кодирования.
  4. Смотрите выделенный размер в автоматически выбранных байтах, KB, MB или GB (TB/PB для больших значений). Точные байты остаются под ним и рядом с другими крупными результатами. Удобные единицы округляются, а проверка лимита всегда использует точное число байтов.

Байты, кодировки и форматы передачи

Байт — это восемь бит; видимый символ может состоять из нескольких кодовых точек Unicode. 😀 — одна графема, одна кодовая точка и две единицы UTF-16: 4 байта в UTF-8, UTF-16 и UTF-32. Комбинируемые знаки и ZWJ-последовательности эмодзи объясняют различие числа символов и байтов.

UTF-8 использует 1–4 байта на скалярное значение Unicode, UTF-16 — 2 или 4, UTF-32 — 4. Для A это 1/2/4 байта соответственно. Кириллица, арабский, китайский и эмодзи — корректный текст, даже если занимают больше байтов. Это размеры закодированного содержимого, не памяти JavaScript или выделенного места на диске.

Нормализация, обрезка пробелов и удаление невидимых символов не выполняются. Готовый é занимает 2 байта UTF-8, e + U+0301 — 3. Обычно оба варианта являются одной графемой. Исходник сохраняется: расчётный текст создаётся только выбранным преобразованием переводов строк.

Добавленный BOM занимает 3 байта в UTF-8, 2 в UTF-16 или 4 в UTF-32, даже для пустого текста. Начальный U+FEFF остаётся содержимым. LF занимает один ASCII-байт, CRLF — два. Преобразование обрабатывает CRLF целиком, затем одиночные CR/LF, не меняя NEL, U+2028 и U+2029.

Для A пробел B размер UTF-8 — 3 байта, URL A%20B — 5, значение формы A+B — 3. A, затем CRLF и B — 4 байта UTF-8, или 3 после преобразования в LF; строка JSON с сохранённым CRLF — 8 байт. JSON включает внешние кавычки и экранирование: весь ввод сериализуется как одна строка, а не минифицируется как JSON-документ.

Base64 — кодирование, а не сжатие или шифрование. Стандартный результат с дополнением занимает 4 × ceil(byteLength / 3) ASCII-байтов; для длинного ввода прибавка близка к трети. UTF-8 A превращается в QQ== (4 байта). Пустой ввод без BOM даёт пустой Base64, но пустая строка JSON занимает 2 байта.

File.size — неизменный исходный размер в байтах, включая сигнатуру. Импорт поддерживает UTF-8 и UTF-16LE/BE со строгим декодированием. Распознанный BOM выбирает декодер и удаляется ровно один раз; дополнительный U+FEFF сохраняется. Без сигнатуры UTF-8 предполагается, а не определяется достоверно. Повторное кодирование может отличаться из-за кодировки, переводов строк, BOM и правок.

Для лимита поля API уточните, считает ли сервис обычный текст, строку JSON или данные URL/формы. Калькулятор не включает имена свойств, обёртки объектов, имена полей, знаки равенства и HTTP-заголовки. Нулевой лимит допускает только пустое представление; равенство точно укладывается в лимит. Правила баз данных и платформ могут отличаться. Для слов, соцсетей и сегментов SMS используйте связанные инструменты.

Локальная обработка и ограничения

Обработка выполняется локально. Инструмент не загружает введённый текст и файлы на сервер. Общие системы аналитики и рекламы сайта могут выполнять сетевые запросы.

Частые вопросы

Байт — это восемь бит; видимый символ может состоять из нескольких кодовых точек Unicode. 😀 — одна графема, одна кодовая точка и две единицы UTF-16: 4 байта в UTF-8, UTF-16 и UTF-32. Комбинируемые знаки и ZWJ-последовательности эмодзи объясняют различие числа символов и байтов.

Текст без добавленного BOM занимает ноль байтов. JSON.stringify пустого текста включает две кавычки — 2 байта UTF-8. Сигнатура тоже занимает байты, даже для пустого текста.

File.size — неизменный исходный размер в байтах, включая сигнатуру. Импорт поддерживает UTF-8 и UTF-16LE/BE со строгим декодированием. Распознанный BOM выбирает декодер и удаляется ровно один раз; дополнительный U+FEFF сохраняется. Без сигнатуры UTF-8 предполагается, а не определяется достоверно. Повторное кодирование может отличаться из-за кодировки, переводов строк, BOM и правок.

Обработка выполняется локально. Инструмент не загружает введённый текст и файлы на сервер. Общие системы аналитики и рекламы сайта могут выполнять сетевые запросы.

Байт (B) содержит 8 бит. Десятичные единицы увеличиваются в 1 000 раз: 1 KB = 1 000 байт, 1 MB = 1 000 000 байт, 1 GB = 1 000 000 000 байт; TB и PB продолжают эту шкалу. Двоичные единицы увеличиваются в 1 024 раза: 1 KiB = 1 024 байта, 1 MiB = 1 048 576 байт, 1 GiB = 1 073 741 824 байта. Основной результат использует десятичные единицы, а ниже показаны двоичный эквивалент и точные байты. Например, 3 611 805 байт отображаются как 3,6 MB или примерно 3,4 MiB. Это разные единицы одного размера, а не сжатие. Прописная B означает байты, строчная b — биты. Округление отображения не влияет на точную проверку лимита.

Источники

Источники проверены: 2026-09-13. Алгоритмы следуют этим спецификациям; дата не гарантирует точность.

Счётчик символов и сегментов SMS

Узнайте кодировку сообщения, границы сегментов и примерную стоимость. Текст остаётся в вашем браузере.

Открыть инструментСчётчик символов и сегментов SMS

Счётчик символов для соцсетей

Проверяйте лимиты платформ и разбивайте публикации без потери текста.

Открыть инструментСчётчик символов для соцсетей

Счётчик символов

Считайте символы, слова, предложения и абзацы. Проверяйте плотность слов, время чтения и размер UTF-8 прямо в браузере.

Открыть инструментСчётчик символов