文本排序
把多行文本排序。
这个工具能做什么
文本排序把粘贴进来的多行文本当成一行一条记录,按你选的规则重新排列后输出。日常整理清单时,手动一行行调顺序既慢又容易漏,几百行的名单、词表或配置项尤其折腾;这个工具一次点击就能完成升序、降序、按长度或反转顺序的行排序。它同时提供去除首尾空格、去掉空行、去除重复行三个开关,让排序文本和清洗一步到位。中文条目默认按拼音顺序排列,不会出现汉字乱序的情况。
排序的核心是把整段文本按换行符切成字符串数组,再对数组做比较排序,也就是纯粹的按行排序。文本按字母排序时,英文和数字大体沿 Unicode 码位(UTF-8 编码对应的字符先后)比较,中文则借助浏览器的本地化排序能力(Intl.Collator,locale 设为中文)折算成拼音再比大小,因此“北京”会排在“上海”之前。按长度排序比较的是每行的字符个数而非字节数,一个汉字和一个字母都算一个字符。反转顺序不做大小比较,只是把当前各行的先后颠倒,常用来配合已排好序的数据取倒序。去重基于整行内容完全相等来判断,空格差异会被视为不同行,所以通常建议先勾选去除首尾空格再去重。
最常见的用法是整理各类清单:把一份杂乱的域名黑名单粘进来,勾选去空行和去重、选升序,几秒就能得到一份干净、有序、便于二分查找和 diff 对比的列表。写配置文件时也很实用,比如 hosts、gitignore 或 requirements.txt 里的条目做一次文本按字母排序后,团队协作的改动 diff 会更清晰,减少无意义的顺序冲突。做词表、字典或翻译对照时,按拼音升序排列中文词条能快速定位和查漏。按长度排序则适合挑异常数据,例如把一堆手机号或 key 按长度排一遍,位数不对的脏数据会集中到两头,一眼就能发现。
有几个边界情况需要留意。去重只在完全相同的整行之间生效,大小写不同、全角半角不同或含有不可见字符(如制表符、零宽空格)的行会被当作不同内容保留,必要时先做统一再排序。按长度排序统计的是字符数,含 emoji 或部分生僻字时,这类字符在底层可能占两个编码单元,长度会比肉眼看到的偏大。此外这类纯排序工具不改动行内文字本身,不做大小写转换、编码替换等处理,需要那类操作应搭配其他文本工具。整个过程都在浏览器本地完成,文本不会上传服务器,粘贴敏感的配置或名单也不必担心外泄。
文本排序是一个免费的在线工具,打开网页就能用,不用下载也不用注册。平时大家搜的“文本排序”、“行排序”、“按行排序”,说的都是这个。
常见使用场景
- 把杂乱的域名黑名单去重并按字母排序
- 给 requirements.txt 依赖按字母排序减少冲突
- 把中文词表按拼音升序排列方便查漏
- 按长度排一遍手机号挑出位数不对的脏数据
- 给一份名单去空行去重后再导出
使用方法
- 把内容粘贴到输入框(生成类工具直接设置选项)。
- 按需要选择选项,点操作按钮。
- 结果出现在下方,点「复制结果」即可带走。