去除重音符号
去掉字母上的重音符号。
这个工具能做什么
这个工具把带重音或变音符号的拉丁字母还原成不带符号的基本字母,比如 café 变成 cafe、résumé 变成 resume、Zürich 变成 Zurich、señor 变成 senor。开发中经常遇到用户名、文件名、URL 里混进 é ñ ü ç 这类字符的情况,直接拿去做 slug 或做数据库匹配就会出问题:同一个词的带符号写法和不带符号写法被当成两个不同的字符串。去除重音符号的作用就是消除这种差异,把它们归一到 ASCII 范围内的基础字母,方便后续统一处理、比较和存储。
实现依赖 Unicode 规范化,而不是一张手工维护的替换表。核心是先对文本做 NFD 分解(Canonical Decomposition),把像 é 这样的预组合字符拆成基本字母 e 加上一个独立的组合重音符(U+0301),再用正则把 U+0300 到 U+036F 这一整段组合变音符号(combining diacritical marks)删掉,剩下的就是干净的基本字母。这样做的好处是覆盖面广,凡是能被 Unicode 拆成「基字母+组合符」的字符都能正确处理,à â ä ã ā å 全部还原成 a,而不用逐个枚举。这一步是纯粹的字符串运算,音标转换的性能开销很低,处理大段文本也能瞬间完成。
最典型的用途是生成 URL slug 和做搜索匹配。比如一篇标题为「Café Society」的文章,要生成对 SEO 友好的路径,先去掉重音得到 cafe,再转小写、把空格换成连字符,就得到 cafe-society,避免 URL 里出现被百分号转义的乱码。搜索场景也一样:用户搜 beyonce 时你希望能命中数据里的 Beyoncé,做法是把查询词和索引字段都先去除变音符再比对,让带不带音标的写法都能匹配上。此外拉丁转写、CSV 导入清洗、把外文人名地名规整成 ASCII 标识时也常用到。
需要注意的是,NFD 只能拆解「基字母+附加符号」型的字符,对本身就是独立字母的变体无能为力。像德语 ß、丹麦挪威语 ø、波兰语 ł、克罗地亚语 đ,以及连字 æ œ,都不会被分解,所以 ß 不会变成 ss、ø 也不会变成 o,这类需要专门的映射规则另行处理。另外去掉音标可能改变原词含义,西班牙语里 año(年)和 ano 是两个词,所以这个工具更适合内部标识、索引和匹配,而不是替代需要保留原义的正式排版文本。
去除重音符号是一个免费的在线工具,打开网页就能用,不用下载也不用注册。平时大家搜的“去除重音”、“去除音标”、“去掉重音符”,说的都是这个。
常见使用场景
- 把文章标题去重音后生成 URL slug
- 搜索时让 Beyoncé 和 Beyonce 都能命中
- 清洗 CSV 里的外文人名地名转成 ASCII
- 生成不含变音符的文件名或用户名
- 把外文词去音标后做统一索引匹配
使用方法
- 把内容粘贴到输入框(生成类工具直接设置选项)。
- 按需要选择选项,点操作按钮。
- 结果出现在下方,点「复制结果」即可带走。