您最喜欢的城市的最爱地点
首页
添加为 Google 首选来源

文本大小计算器

在浏览器中比较文本编码和载荷大小。

输入文本

处理在本地进行。本工具不会上传输入的文本或文件。网站共用的分析和广告服务可能发送网络请求。

编码后的文本大小

0 字节

0 字节 · 0

KB/MB 使用 1000 进制,KiB/MiB 使用 1024 进制。仅计算编码内容,不代表内存、压缩流量或完整 HTTP 请求。

UTF-8 · 不添加 BOM · 保留原始换行符

UTF-8

0 字节

UTF-16LE

0 字节

UTF-16BE

0 字节

UTF-32LE

0 字节

UTF-32BE

0 字节

LE 和 BE 只改变字节顺序,不改变大小。所有比较都使用所选 BOM 设置。

有效文本:0 个字素、0 个码点、0 个 UTF-16 码元。原始文本:0 个 UTF-16 码元。

原始换行符: CRLF 0 · CR 0 · LF 0

有效换行符: CRLF 0 · CR 0 · LF 0

载荷比较

膨胀率基准:所选原始编码,UTF-8 · 不添加 BOM · 保留原始换行符。所有行均使用有效文本。

JSON 字符串 · UTF-8 · 2 字节

对整个有效文本执行 JSON.stringify,包含引号和转义,不含外层对象或新增 BOM。孤立代理项会被转义而非替换,不解析粘贴的 JSON。

大小差异: +2 字节

URL 组件 · ASCII · 0 字节

一个 encodeURIComponent 值,不是完整 URL 或表单。空格变为 %20,不添加 BOM。

大小差异: 0 字节

表单值 · ASCII · 0 字节

使用 URLSearchParams 编码的一个 application/x-www-form-urlencoded 值:不含字段名、等号或其他字段。空格变为 +,孤立代理项变为 U+FFFD,不添加 BOM。

大小差异: 0 字节

Base64 · ASCII (UTF-8 · 不添加 BOM · 保留原始换行符) · 0 字节

RFC 4648 标准 Base64,带填充且不换行。使用所选编码的字节,包含可选签名:4 × ceil(字节数 / 3)。

大小差异: 0 字节

留空则禁用预算。输入不超过 9,007,199,254,740,991 的非负整数。

所选原始编码 (UTF-8 · 不添加 BOM · 保留原始换行符)

检查本地文件

选择或拖放一个不超过 5 MiB 的 .txt、.json 或 .csv 文件。文件仅在本地作为文本读取,不会被解析或执行。不支持导入 UTF-32 文件。

编码预览与复制

预览最多显示 600 个输出字符,字节总数始终涵盖完整文本。

字符字节检查器

有效文本中的字素索引从 1 开始。引号和转义使控制字符可见。字节贡献不含新增 BOM。Intl.Segmenter 将组合字符和 ZWJ 序列分组;旧浏览器回退算法对少见文字可能不同。长条目会缩略。

如何使用计算器

  1. 粘贴文本或检查本地文本文件。编辑器初始为空,并保留原始换行符。
  2. 选择编码、换行转换和可选 BOM,查看精确字节数并比较序列化表示。
  3. 可为 API 所需的表示设置字节预算。通过明确的复制操作获取原始文本、摘要或完整编码输出。
  4. 查看突出显示的大小,单位会自动选择为字节、KB、MB 或 GB(更大数值使用 TB/PB)。精确字节数保留在下方及其他较大结果旁。易读大小会四舍五入,预算检查始终使用精确字节数。

理解字节、编码和载荷

一个字节为八位;一个可见字符可能包含多个 Unicode 码点。😀 是一个字素、一个码点和两个 UTF-16 码元,在 UTF-8、UTF-16 和 UTF-32 中均为 4 字节。组合标记和 ZWJ 表情序列使字符数与字节数不同。

UTF-8 每个 Unicode 标量使用 1–4 字节,UTF-16 使用 2 或 4 字节,UTF-32 使用 4 字节。A 分别占 1/2/4 字节。西里尔文、阿拉伯文、中文和表情符号都是有效文本,即使需要更多字节。这是编码内容大小,不是 JavaScript 堆内存或磁盘分配空间。

不执行规范化、去除首尾空白或删除不可见字符。预组合 é 占 2 个 UTF-8 字节,e + U+0301 占 3 个,两者通常都是一个字素。源文本保留不变,只有所选换行转换用于生成计算所需的有效文本。

新增 BOM 在 UTF-8 中占 3 字节、UTF-16 中占 2 字节、UTF-32 中占 4 字节,空文本也一样。文本开头已有的 U+FEFF 仍作为内容。LF 占一个 ASCII 字节,CRLF 占两个。转换将 CRLF 作为整体处理,再处理单独的 CR/LF,保留 NEL、U+2028 和 U+2029。

对于 A 空格 B,UTF-8 为 3 字节,URL 输出 A%20B 为 5 字节,表单值 A+B 为 3 字节。A 后接 CRLF 再接 B 为 4 个 UTF-8 字节,转为 LF 后是 3 个;保留 CRLF 的 JSON 字符串为 8 字节。JSON 包含外层引号和转义,把输入作为一个字符串序列化,不是压缩 JSON 文档。

Base64 是编码,不是压缩或加密。标准带填充输出为 4 × ceil(byteLength / 3) 个 ASCII 字节,长输入的开销接近三分之一。UTF-8 的 A 变为 QQ==(4 字节)。无 BOM 的空输入产生空 Base64,但空 JSON 字符串仍占 2 字节。

File.size 是不可变的原始字节数,包含签名。文件导入支持 UTF-8 和 UTF-16LE/BE,并严格解码。识别到的 BOM 选择解码器且只移除一次,额外的 U+FEFF 内容保留。无签名时假定 UTF-8,并非可靠自动检测。重新编码可能因编码、换行、BOM 策略或编辑而不同。

对于 API 字段限制,请确认服务计算的是原始文本、JSON 字符串还是 URL/表单数据。本工具不包含属性名、外层对象、字段名、等号和 HTTP 头。零预算仅接受空表示,等于预算时恰好符合。数据库和平台规则可能不同。字数、社交平台限制和短信分段请使用相关工具。

本地处理与范围

处理在本地进行。本工具不会上传输入的文本或文件。网站共用的分析和广告服务可能发送网络请求。

常见问题

一个字节为八位;一个可见字符可能包含多个 Unicode 码点。😀 是一个字素、一个码点和两个 UTF-16 码元,在 UTF-8、UTF-16 和 UTF-32 中均为 4 字节。组合标记和 ZWJ 表情序列使字符数与字节数不同。

不添加 BOM 的原始文本占零字节。JSON.stringify 空文本包含两个引号,因此占 2 个 UTF-8 字节。添加签名也会占用字节,即使文本为空。

File.size 是不可变的原始字节数,包含签名。文件导入支持 UTF-8 和 UTF-16LE/BE,并严格解码。识别到的 BOM 选择解码器且只移除一次,额外的 U+FEFF 内容保留。无签名时假定 UTF-8,并非可靠自动检测。重新编码可能因编码、换行、BOM 策略或编辑而不同。

处理在本地进行。本工具不会上传输入的文本或文件。网站共用的分析和广告服务可能发送网络请求。

一个字节(B)包含 8 位。十进制单位按 1,000 递增:1 KB = 1,000 字节,1 MB = 1,000,000 字节,1 GB = 1,000,000,000 字节;TB 和 PB 继续使用同一比例。二进制单位按 1,024 递增:1 KiB = 1,024 字节,1 MiB = 1,048,576 字节,1 GiB = 1,073,741,824 字节。主要结果使用十进制单位,下方显示二进制等值和精确字节数。例如,3,611,805 字节显示为 3.6 MB,或约 3.4 MiB。这是同一大小的不同单位,不是压缩。大写 B 表示字节,小写 b 表示位。显示值的舍入不会改变精确的预算比较。

参考来源

来源核查日期:2026-09-13。算法遵循这些规范;日期并不保证准确性。

SMS 短信字数与分段计算器

了解短信的编码方式、分段位置和预计费用。文本始终保留在您的浏览器中。

打开工具SMS 短信字数与分段计算器

社交媒体字符计数器

按平台规则检查长度,无损拆分帖子。

打开工具社交媒体字符计数器

字符计数器

统计字符、词语、句子和段落,并在浏览器中查看词语密度、预计阅读时间和 UTF-8 大小。

打开工具字符计数器