Калькулятор размера текста
Сравнивайте кодировки и размеры передаваемого текста прямо в браузере.
Как пользоваться калькулятором
- Вставьте текст или откройте локальный текстовый файл. Редактор изначально пуст и сохраняет исходные переводы строк.
- Выберите кодировку, преобразование переводов строк и необязательный BOM. Посмотрите точное число байтов и сравните форматы сериализации.
- При необходимости задайте лимит байтов для формата, который ожидает ваш API. Отдельными кнопками скопируйте исходник, сводку или полный результат кодирования.
- Смотрите выделенный размер в автоматически выбранных байтах, KB, MB или GB (TB/PB для больших значений). Точные байты остаются под ним и рядом с другими крупными результатами. Удобные единицы округляются, а проверка лимита всегда использует точное число байтов.
Байты, кодировки и форматы передачи
Байт — это восемь бит; видимый символ может состоять из нескольких кодовых точек Unicode. 😀 — одна графема, одна кодовая точка и две единицы UTF-16: 4 байта в UTF-8, UTF-16 и UTF-32. Комбинируемые знаки и ZWJ-последовательности эмодзи объясняют различие числа символов и байтов.
UTF-8 использует 1–4 байта на скалярное значение Unicode, UTF-16 — 2 или 4, UTF-32 — 4. Для A это 1/2/4 байта соответственно. Кириллица, арабский, китайский и эмодзи — корректный текст, даже если занимают больше байтов. Это размеры закодированного содержимого, не памяти JavaScript или выделенного места на диске.
Нормализация, обрезка пробелов и удаление невидимых символов не выполняются. Готовый é занимает 2 байта UTF-8, e + U+0301 — 3. Обычно оба варианта являются одной графемой. Исходник сохраняется: расчётный текст создаётся только выбранным преобразованием переводов строк.
Добавленный BOM занимает 3 байта в UTF-8, 2 в UTF-16 или 4 в UTF-32, даже для пустого текста. Начальный U+FEFF остаётся содержимым. LF занимает один ASCII-байт, CRLF — два. Преобразование обрабатывает CRLF целиком, затем одиночные CR/LF, не меняя NEL, U+2028 и U+2029.
Для A пробел B размер UTF-8 — 3 байта, URL A%20B — 5, значение формы A+B — 3. A, затем CRLF и B — 4 байта UTF-8, или 3 после преобразования в LF; строка JSON с сохранённым CRLF — 8 байт. JSON включает внешние кавычки и экранирование: весь ввод сериализуется как одна строка, а не минифицируется как JSON-документ.
Base64 — кодирование, а не сжатие или шифрование. Стандартный результат с дополнением занимает 4 × ceil(byteLength / 3) ASCII-байтов; для длинного ввода прибавка близка к трети. UTF-8 A превращается в QQ== (4 байта). Пустой ввод без BOM даёт пустой Base64, но пустая строка JSON занимает 2 байта.
File.size — неизменный исходный размер в байтах, включая сигнатуру. Импорт поддерживает UTF-8 и UTF-16LE/BE со строгим декодированием. Распознанный BOM выбирает декодер и удаляется ровно один раз; дополнительный U+FEFF сохраняется. Без сигнатуры UTF-8 предполагается, а не определяется достоверно. Повторное кодирование может отличаться из-за кодировки, переводов строк, BOM и правок.
Для лимита поля API уточните, считает ли сервис обычный текст, строку JSON или данные URL/формы. Калькулятор не включает имена свойств, обёртки объектов, имена полей, знаки равенства и HTTP-заголовки. Нулевой лимит допускает только пустое представление; равенство точно укладывается в лимит. Правила баз данных и платформ могут отличаться. Для слов, соцсетей и сегментов SMS используйте связанные инструменты.
Локальная обработка и ограничения
Обработка выполняется локально. Инструмент не загружает введённый текст и файлы на сервер. Общие системы аналитики и рекламы сайта могут выполнять сетевые запросы.
Частые вопросы
Источники
Источники проверены: 2026-09-13. Алгоритмы следуют этим спецификациям; дата не гарантирует точность.Похожие инструменты
Счётчик символов и сегментов SMS
Узнайте кодировку сообщения, границы сегментов и примерную стоимость. Текст остаётся в вашем браузере.
Открыть инструмент — Счётчик символов и сегментов SMSСчётчик символов для соцсетей
Проверяйте лимиты платформ и разбивайте публикации без потери текста.
Открыть инструмент — Счётчик символов для соцсетейСчётчик символов
Считайте символы, слова, предложения и абзацы. Проверяйте плотность слов, время чтения и размер UTF-8 прямо в браузере.
Открыть инструмент — Счётчик символов