手机
当前位置:查字典教程网 >脚本专栏 >python >使用python BeautifulSoup库抓取58手机维修信息
使用python BeautifulSoup库抓取58手机维修信息
摘要:直接上代码:复制代码代码如下:#!/usr/bin/python#-*-coding:utf-8-*-importurllibimporto...

直接上代码:

复制代码 代码如下:

#!/usr/bin/python

# -*- coding: utf-8 -*-

import urllib

import os,datetime,string

import sys

from bs4 import BeautifulSoup

reload(sys)

sys.setdefaultencoding('utf-8')

__BASEURL__ = 'http://bj.58.com/'

__INITURL__ = "http://bj.58.com/shoujiweixiu/"

soup = BeautifulSoup(urllib.urlopen(__INITURL__))

lvlELements = soup.html.body.find('div','selectbarTable').find('tr').find_next_sibling('tr')('a',href=True)

f = open('data1.txt','a')

for element in lvlELements[1:]:

f.write((element.get_text()+'nr' ))

url = __BASEURL__ + element.get('href')

print url

soup = BeautifulSoup(urllib.urlopen(url))

lv2ELements = soup.html.body.find('table','tblist').find_all('tr')

for item in lv2ELements:

addr = item.find('td','t').find('a').get_text()

phone = item.find('td','tdl').find('b','tele').get_text()

f.write('地址:'+addr +' 电话:'+ phone + 'rnr')

f.close()

直接执行后,存在 data1.txt中就会有商家的地址和电话等信息。

BeautifulSoup api 的地址为: http://www.crummy.com/software/BeautifulSoup/bs4/doc/

【使用python BeautifulSoup库抓取58手机维修信息】相关文章:

忘记ftp密码使用python ftplib库暴力破解密码的方法示例

python抓取网页图片示例(python爬虫)

使用python删除nginx缓存文件示例(python文件操作)

python调用windows api锁定计算机示例

python 查找文件夹下所有文件 实现代码

python使用mysqldb连接数据库操作方法示例详解

使用python Django做网页

python使用ctypes模块调用windowsapi获取系统版本示例

用python删除java文件头上版权信息的方法

python strip()函数 介绍

精品推荐
分类导航