Java 正则表达式去除重复字符和标点符号:实战案例
Java 利用正则表达式去除重复字符和标点符号:实战案例
目标:
将以下文本:
'今天食堂...的...的...的菜真...真是太好...好...好吃了!'
转换为:
'今天食堂的真太好吃了!'
代码实现:
String str = '今天食堂...的...的...的菜真...真是太好...好...好吃了!';
str = str.replaceAll('\.+', '');//去除所有的点号
str = str.replaceAll('(.)\1+', '$1');//去除重复的字
System.out.println(str);//输出:今天食堂的真太好吃了!
代码解析:
str.replaceAll('\.+', '');使用正则表达式\.+匹配所有点号并将其替换为空字符串,从而去除所有点号。str.replaceAll('(.)\1+', '$1');使用正则表达式(.)\1+匹配所有重复的字符(至少出现两次),并将其替换为第一个匹配的字符,从而去除重复的字符。
总结:
通过使用简单的正则表达式,我们可以方便快捷地去除文本中的重复字符和标点符号,使文本更简洁易读。
相关知识:
- 正则表达式: 一种用于匹配文本模式的强大工具,可以用于查找、替换、提取文本等操作。
- Java 字符串处理: Java 提供丰富的字符串处理方法,如
replaceAll()、split()、substring()等,可以方便地操作字符串。
更多应用:
除了本文中介绍的例子,正则表达式还有许多其他应用,例如:
- 提取文本中的特定信息
- 验证用户输入的格式
- 替换文本中的特定字符
- 分析日志文件等
原文地址: https://www.cveoy.top/t/topic/nV8o 著作权归作者所有。请勿转载和采集!