Java 利用正则表达式去除重复字符和标点符号:实战案例

目标:

将以下文本:

'今天食堂...的...的...的菜真...真是太好...好...好吃了!'

转换为:

'今天食堂的真太好吃了!'

代码实现:

String str = '今天食堂...的...的...的菜真...真是太好...好...好吃了!';
str = str.replaceAll('\.+', '');//去除所有的点号
str = str.replaceAll('(.)\1+', '$1');//去除重复的字
System.out.println(str);//输出:今天食堂的真太好吃了!

代码解析:

  • str.replaceAll('\.+', ''); 使用正则表达式 \.+ 匹配所有点号并将其替换为空字符串,从而去除所有点号。
  • str.replaceAll('(.)\1+', '$1'); 使用正则表达式 (.)\1+ 匹配所有重复的字符(至少出现两次),并将其替换为第一个匹配的字符,从而去除重复的字符。

总结:

通过使用简单的正则表达式,我们可以方便快捷地去除文本中的重复字符和标点符号,使文本更简洁易读。

相关知识:

  • 正则表达式: 一种用于匹配文本模式的强大工具,可以用于查找、替换、提取文本等操作。
  • Java 字符串处理: Java 提供丰富的字符串处理方法,如 replaceAll()split()substring() 等,可以方便地操作字符串。

更多应用:

除了本文中介绍的例子,正则表达式还有许多其他应用,例如:

  • 提取文本中的特定信息
  • 验证用户输入的格式
  • 替换文本中的特定字符
  • 分析日志文件等
Java 正则表达式去除重复字符和标点符号:实战案例

原文地址: https://www.cveoy.top/t/topic/nV8o 著作权归作者所有。请勿转载和采集!

免费AI点我,无需注册和登录