# 文本处理工具箱使用教程：字数统计、大小写转换、去重排序、JSON格式化一站搞定

> 来源：工具派（https://gjupai.com） 原文页面：https://gjupai.com/tutorial/text-toolkit-guide

## 工具简介

**文本处理工具箱**是工具派推出的一站式在线文本处理合集，把日常编辑、开发、写作中最常用的十类文本操作整合到一个页面里：📊 文本统计、🔤 大小写/格式转换、🧹 清理/排序/行操作、🔍 查找替换、⚖️ 文本对比、📋 JSON 工具、🔐 编码/进制/哈希、📤 提取匹配、🇨🇳 中文处理、📝 随机文本生成。页面顶部是一排标签页，点开即用，所有处理都在浏览器本地完成，文本不上传服务器，结果框右上角统一提供「复制」按钮，部分功能还支持把结果「使用结果」一键回填到输入框继续做二次处理。

## 功能亮点

- **11 项实时统计指标**：文本统计页输入即出结果，包含总字符、去除空白、中文字符、英文字母、数字、英文单词、行数、段落数、空格/换行、标点符号、字节数，适合字数核对和文案验收。
- **10 种大小写与命名格式**：除常规的大写、小写、首字母大写（每词/每句）、反转大小写外，还内置驼峰 camelCase、帕斯卡 PascalCase、蛇形 snake_case、短横 kebab-case、常量 CONSTANT_CASE，代码变量命名一键搞定。
- **清理 / 排序 / 行操作三合一**：清理区可去多余空格、去所有空白、去空行、合并多空行、去重；排序区支持升序（中文按拼音 localeCompare 排序）、降序、随机乱序、反转文本、反转行序；行操作可批量加数字序号、加自定义前缀/后缀，还能按「包含/不包含关键词」或「行长度」过滤。
- **支持正则的查找替换**：勾选「正则」后查找内容按正则表达式匹配，替换内容支持 `$1 $2` 捕获组引用，正则写错会提示「正则表达式错误」而不会让页面崩溃。
- **双栏字符级文本对比**：A/B 两栏输入后自动对比（300ms 防抖），行级差异红底高亮，同位置的修改行还会做字符级对比，删除部分加删除线，两侧滚动联动，并可一键交换 A/B 或清空。
- **JSON 工具五件套**：格式化（2 空格缩进）、压缩、转义（双引号变 `\"`）、JSON 转 URL 参数、URL 参数转 JSON，格式错误会显示具体报错信息。
- **编码 / 进制 / 哈希全覆盖**：Base64、URL、HTML 实体、Unicode、Escape 五种编码双向转换；2/8/10/16 进制互转；一次计算 MD5、SHA1、SHA256 三种哈希。

## 参数说明

| 参数 | 说明 | 默认值 / 取值范围 |
| --- | --- | --- |
| 标签页 | 页面顶部的 10 个功能 Tab | 默认进入「📊 文本统计」 |
| 查找替换-正则 | 勾选后查找内容按正则匹配，替换支持 `$1 $2` 捕获组 | 默认不勾选（普通字符串替换） |
| 行过滤条件 | 「保留包含 / 删除包含 / 保留长度≥ / 保留长度≤」+ 关键词或数字 | 默认「保留包含」 |
| 前缀 / 后缀 | 批量添加到每行行首/行尾的文本 | 默认空 |
| 编码类型 | 编码/解码所用格式 | Base64（默认）、URL、HTML 实体、Unicode、Escape |
| 编码动作 | 编码或解码方向 | 默认「编码」 |
| 进制转换 | 输入数字及源进制、目标进制 | 2 / 8 / 10 / 16 进制，默认 10 → 16 |
| 提取类型 | 从文本中匹配提取的内容类别 | URL 链接（默认）、邮箱、手机号、IPv4、IPv6、数字、中文段落、英文单词 |
| 拼音模式 | 汉字转拼音的输出形式 | 带声调 zhōng（默认）、无声调 zhong、首字母 z |
| 随机文本 | 生成数量与单位（单词/句子/段落） | 数量默认 3，范围 1–100；默认单位「段落」 |

## 使用步骤

1. **打开工具页面**：顶部标题区下方是一排功能标签页，默认进入「📊 文本统计」页，页面无需安装、打开即用。

![文本处理工具箱主界面（文本统计 Tab）：顶部标题区显示工具名与简介，其下为一排十个功能标签页（文本统计、大小写/格式、](article/202607/1783994175573_6065.png)

2. **做字数统计**：在输入框粘贴文本，下方 11 张统计卡片（总字符、中文字符、英文单词、行数、段落数、字节数等）会实时刷新，适合核对字数限制或统计中英混合文案。

3. **转换大小写 / 命名格式**：切到「🔤 大小写/格式」页，输入文本后点对应按钮（如「驼峰 camelCase」「蛇形 snake_case」），结果出现在下方只读框，右上角「复制」带走。

4. **清理与行操作**：切到「🧹 清理/排序/行操作」页，先点清理按钮（去重、去空行等）或排序按钮，需要批量处理行时用前缀/后缀输入框和过滤条件下拉，点「执行过滤」后会提示过滤前后的行数；结果可用「使用结果」回填输入框继续处理。

5. **查找替换**：切到「🔍 查找替换」页，填入「查找内容」和「替换为」，需要批量改格式时勾选「正则」并在替换内容中用 `$1` 引用捕获组，点「替换」生成结果。

6. **文本对比**：切到「⚖️ 文本对比」页，把两个版本分别粘贴到 A、B 输入框，结果自动生成——修改行红底显示且字符级差异加删除线，左右两栏滚动联动，可点「⇄ 交换」互换 A/B。

7. **JSON 与编码处理**：「📋 JSON 工具」页可格式化、压缩、转义、与 URL 参数互转；「🔐 编码/进制/哈希」页可选编码类型做编解码、2/8/10/16 进制互转，或一次算出 MD5/SHA1/SHA256。

8. **提取、中文与随机文本**：「📤 提取匹配」页从长文本中抓出 URL、邮箱、手机号等；「🇨🇳 中文处理」页做简繁互转、中英标点互转、全半角互转和汉字转拼音；「📝 随机文本」页设定数量和单位后生成占位文本。所有结果框都可一键复制。

## 使用技巧

- **链式处理用「使用结果」**：清理页和替换页的结果框都有「使用结果」按钮，点一下就把结果回填到输入框，可以连续做多步处理（先去重→回填→再排序），不用手动复制粘贴。
- **变量命名直接去「大小写/格式」页**：把 `user nickname list` 这样的短语贴进去，连点 camelCase、snake_case、CONSTANT_CASE，一次拿到各语言风格的变量名。
- **对比功能不用点按钮**：A/B 任一边输入后 300ms 内自动出结果；两侧滚动联动，长文本对照时只需滚一边。修改行做的是字符级 diff，适合找「只改了几个字」的版本差异。
- **替换里的 `$1 $2` 是捕获组引用**：比如查找 `(\d+)元`、替换为 `$1 RMB`，即可批量改货币写法；记得先勾选「正则」。
- **简繁转换是字表映射**：工具内置 400+ 常用无争议字映射，日常文案够用，但一简对多繁（如「发→發/髮」）无法按词义区分，正式出版前建议人工复核。
- **提取结果按行输出**：提取 URL、邮箱等后每条一行显示并标注「共提取 N 条」，方便直接粘贴到表格或去重（可顺手切到清理页做去重）。

## 常见问题

**Q1：我粘贴的文本会上传到服务器吗？**
不会。统计、转换、对比、编码、哈希等所有处理都在浏览器本地用 JavaScript 完成，文本不会发送到服务器，可以放心处理敏感内容。

**Q2：文本统计里的「字节数」和「总字符」有什么区别？**
总字符是按字符个数统计（一个汉字算 1），字节数按 UTF-8 编码的字节长度统计（一个汉字通常占 3 字节）。前者适合看篇幅，后者适合估算存储和传输大小。

**Q3：查找替换不勾选「正则」时能批量替换吗？**
可以。不勾选时做的是全局字符串替换（所有出现位置都会被替换），只是不支持通配和捕获组；需要模式匹配时再勾选正则。

**Q4：JSON 格式化报错怎么办？**
报错框会显示具体错误信息（如缺少逗号、括号不匹配的位置提示），按提示修正原文即可。注意输入必须是合法 JSON，JavaScript 对象字面量中的单引号、尾随逗号等写法都会报错。

**Q5：汉字转拼音支持多音字吗？**
工具基于 pinyin-pro 引擎，对常见词语有上下文读音判断（如「银行」读 yín háng），提供带声调、无声调、首字母三种输出；个别生僻词的多音字仍可能需要人工校对。

**Q6：随机文本生成的是什么内容？**
生成的是由英文单词随机拼成的占位文本（类似 Lorem Ipsum），可选按单词、句子或段落生成，数量 1–100，适合排版测试和 mock 数据，不是有意义的文章内容。

