码迷,mamicode.com
首页 > 其他好文 > 详细

正则表达式笔记

时间:2015-03-19 01:01:22      阅读:142      评论:0      收藏:0      [点我收藏+]

标签:正则表达式笔记

1.所谓组,即你查一次,可以查多种匹配的结果,每种结果即是一组

eg.

import re
pattern = re.compile(r'<div(.*?>)(.*?)</div>')
match = pattern.match('<div class="test">Hello <div>wa haha<div>test xxx</div></div>world</div>')
if match:
  print match.group(2)
  print match.group(1)
  print match.group(0)


>>> ================================ RESTART ================================
>>> 
Hello <div>wa haha<div>test xxx
 class="test">
<div class="test">Hello <div>wa haha<div>test xxx</div>
>>> 
其中group(0)比较特殊,所有组的合集


2.查找一个文件中所有的http(url)地址

import re
import urllib2
f = open('url.txt','r')
string = ""
while 1:
    line = f.readline()
    if not line:break
    string += line

f.close()

urls = re.findall('http[s]?://(?:[a-zA-Z]|[0-9]|[$-_@.&+]|[!*\(\),]|(?:%[0-9a-fA-F][0-9a-fA-F]))+', string)

3.正则表达式中的空格包括\t\r\n\f\v等几种字符

正则表达式笔记

标签:正则表达式笔记

原文地址:http://blog.csdn.net/hellochenlian/article/details/44429711

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!