手机
当前位置:查字典教程网 >脚本专栏 >python >Python提取网页中超链接的方法
Python提取网页中超链接的方法
摘要:下面是最简单的实现方法,先将目标网页抓回来,然后通过正则匹配a标签中的href属性来获得超链接代码如下:importurllib2impor...

下面是最简单的实现方法,先将目标网页抓回来,然后通过正则匹配a标签中的href属性来获得超链接

代码如下:

import urllib2 import re url = 'http://www.sunbloger.com/' req = urllib2.Request(url) con = urllib2.urlopen(req) doc = con.read() con.close() links = re.findall(r'href="(http://[a-zA-Z0-9./]+)"', doc) for a in links: print a

总结

以上就是这篇文章的全部内容,希望本文的内容对大家的学习或者工作能有所帮助,如果有疑问大家可以留言交流。

【Python提取网页中超链接的方法】相关文章:

python解析中国天气网的天气数据

python二叉树遍历的实现方法

python三元运算符实现方法

python读取注册表中值的方法

python 测试实现方法

python抓取网页时字符集转换问题处理方案分享

python中文乱码的解决方法

python每次处理固定个数的字符的方法总结

用Python脚本生成Android SALT扰码的方法

python解决字典中的值是列表问题的方法

精品推荐
分类导航