使用方法
- 在输入框里输入或粘贴文本。
- 所有统计随输入实时更新,不需要点任何按钮。
- 如果文本中英混排,会额外显示两种文字各自的数量。
- 底部的频次表列出出现最多的字与词。
关于字数统计
数字数听上去简单,直到文本不再是英文。字数统计通常建立在「按空白切分」之上——这对拉丁
字母完全够用,对中日韩则彻底失效:这些语言不在词间留空格,于是整段话变成一个词元。至今
仍有不少在线工具,对着一整页中文报出 1。
本工具的做法是:中日韩文字逐字计数,西文按词计数,再相加。这与两种传统各自的口径 一致——中文出版和学术要求说的是「字数」,英文的篇幅限制说的是 words。中英混排的文档 除总数外,还会分别给出两个数字。
另一处不易察觉的错误在字符计数。在 JavaScript 里 "🎉".length 等于 2,因为它数的是
UTF-16 码元而非字符。由四个人形加零宽连接符组成的一家人 emoji 会报 11。任何用 .length
数字符的工具都会把 emoji 多算,而这个误差恰恰在最讲究字数限制的社交媒体草稿里累积得最快。
本工具按字形簇切分,你看到的一个字符就算一个。
阅读时长刻意只做粗估。英文每分钟 200 词、中文每分钟 300 字都是大量个体差异下的平均值—— 密集的技术文章比熟悉的叙事文本慢得多。它适合用来判断「这是五分钟还是十五分钟的阅读量」, 不适合用于更精确的场合。