手机
当前位置:查字典教程网 >脚本专栏 >python >Python提取网页中超链接的方法
Python提取网页中超链接的方法
摘要:下面是最简单的实现方法,先将目标网页抓回来,然后通过正则匹配a标签中的href属性来获得超链接代码如下:importurllib2impor...

下面是最简单的实现方法,先将目标网页抓回来,然后通过正则匹配a标签中的href属性来获得超链接

代码如下:

import urllib2 import re url = 'http://www.sunbloger.com/' req = urllib2.Request(url) con = urllib2.urlopen(req) doc = con.read() con.close() links = re.findall(r'href="(http://[a-zA-Z0-9./]+)"', doc) for a in links: print a

总结

以上就是这篇文章的全部内容,希望本文的内容对大家的学习或者工作能有所帮助,如果有疑问大家可以留言交流。

【Python提取网页中超链接的方法】相关文章:

python中的yield使用方法

Python生成随机数的方法

python 测试实现方法

盘点提高 Python 代码效率的方法

python中文乱码的解决方法

python二叉树遍历的实现方法

Python标准库与第三方库详解

python 自动提交和抓取网页

Python生成pdf文件的方法

python抓取网页内容示例分享

精品推荐
分类导航