java使用正则表达式去除字符串的html标签

   1. /** 
   2.      * 删除input字符串中的html格式 
   3.      *  
   4.      * @param input 
   5.      * @param length 
   6.      * @return 
   7.      */  
   8.     public static String splitAndFilterString(String input, int length) {  
   9.         if (input == null || input.trim().equals("")) {  
  10.             return "";  
  11.         }  
  12.         // 去掉所有html元素,  
  13.         String str = input.replaceAll("\\&[a-zA-Z]{1,10};", "").replaceAll(  
  14.                 "<[^>]*>", "");  
  15.         str = str.replaceAll("[(/>)<]", "");  
  16.         int len = str.length();  
  17.         if (len <= length) {  
  18.             return str;  
  19.         } else {  
  20.             str = str.substring(0, length);  
  21.             str += "......";  
  22.         }  
  23.         return str;  
  24.     }  

  新闻内容或者博客文章,如果显示摘要,需要去除内容的html格式标签,找到一个正则表达式,实现了:

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值