Heim  >  Fragen und Antworten  >  Hauptteil

正则表达式 - [正则][获取<a>标签前后所有的正文内容][java]

内容例子:
哥伦比亚著名作家加西亚·马尔克斯的长篇小说《百年孤独》发表

内容组成:由n组 AAAABBBBBBCCCCC形式的内容组成的字符串
例如:

AAAA<a>BBBBBB</a>CCCCC
AAAA<a>BBBBBB</a>CCCCCAAAA<a>BBBBBB</a>CCCCC
AAAA<a>BBBBBB</a>CCCCCAAAA<a>BBBBBB</a>CCCCCAAAA<a>BBBBBB</a>CCCCC

最终取得的内容:
AAAABBBBBCCCCC
AAAAAAABBBBBBBCCCCCCAAAABBBBBCCCC

这样子;

这个正则在java里怎么写? 多谢;

最好一个正则不分组直接获取最终内容.

高洛峰高洛峰2710 Tage vor558

Antworte allen(1)Ich werde antworten

  • 迷茫

    迷茫2017-04-18 09:17:14

    正文内容是怎么判定的?目前看来只要把<a></a>标签删了就好了,这个不难吧


    [补充]如果只是文字+a标签的话,基础正则表达式用\<\/?a\>就行。
    但我对java不是很熟啦,网上生成的代码如下,好像只是做了匹配而没有替换,希望你会改吧。。。

    import java.util.regex.Matcher;
    import java.util.regex.Pattern;
    
    public class RegexMatches {
        
        public static void main(String args[]) {
            String str = "";
            String pattern = "\\<\\/?a\\>";
    
            Pattern r = Pattern.compile(pattern);
            Matcher m = r.matcher(str);
            System.out.println(m.matches());
        }
    
    }

    Antwort
    0
  • StornierenAntwort