Python抓取Discuz!用户名脚本代码_python教程-查字典教程网

导航

手机

客服中心

投稿赚钱

免费注册

首页

系统安装
WindowsXP 安装基础教程 Ubuntu 安装基础教程 Gparted 分区编辑器操作基础 VMware 虚拟机基础入门教程 VirtualBox 虚拟机基础教程 360安全卫士基础入门教程操作系统 windows10安装教程 windows8安装教程 windows7安装教程 U盘教程 windows2003教程 Linux教程苹果MAC教程其他教程
办公制作
Word 基础入门教程 Excel 基础入门教程 PowerPoint 基础入门教程蒙泰瑶光课件制作基础 OpenOffice.org Writer OpenOffice.org Calc OpenOffice.org Impress 高效办公
图像动画
Photoshop CS 基础入门教程 GIMP 基础入门教程 3DS Max 8.0 基础入门教程 Flash 8.0 基础入门教程 Flash 8.0 脚本基础教程 Ulead Gif Animator 教程图形图像 Painter基础教程 isee基础教程可牛影像基础教程光影魔术手基础教程 Freehand基础教程
音频视频
Goldwave 基础入门教程视频编辑基础入门教程影视制作媒体工具快手抖音
编程开发基础
Visual C++基础入门教程 C++ 基础入门教程 C 基础入门教程 CSS 基础入门教程 VB 基础入门教程 QBasic基础入门教程 HTML 音画帖基础入门教程 Nvu 网站制作基础 FrontPage 网站制作基础 Kompozer 网站制作基础 Kompozer 帮助文档 KompoZer user guide Poedit 翻译基础教程 Ubuntu 命令行基础教程谷歌网站管理员工具操作基础 C#基础教程
网络应用
QQ 聊天基础入门教程 Firefox3 基础入门教程 Discuz! 和 PW 论坛安装教程电子邮件基础入门教程论坛新手基础入门教程其他教程... 网络知识网络基础知识网络应用技术网络故障处理下载工具
电脑基础
iphone教程安卓教程手机软件教程手机技巧微信教程手机知识刷机教程
教学设计
2008-2009学年 2009-2010学年 2010-2011学年 2011-2012学年 2012-2013学年 2013-2014学年 2014-2015学年

当前位置：查字典教程网 >脚本专栏 >python >Python抓取Discuz!用户名脚本代码

Python抓取Discuz!用户名脚本代码

摘要：最近学习Python，于是就用Python写了一个抓取Discuz!用户名的脚本，代码很少但是很搓。思路很简单，就是正则匹配title然后提...

最近学习Python，于是就用Python写了一个抓取Discuz!用户名的脚本，代码很少但是很搓。思路很简单，就是正则匹配title然后提取用户名写入文本文档。程序以百度站长社区为例(一共有40多万用户)，挂在VPS上就没管了，虽然用了延时但是后来发现一共只抓取了50000多个用户名就被封了。。。

代码如下：

复制代码代码如下:

# -*- coding: utf-8 -*-

# Author: 天一

# Blog: http://www.90blog.org

# Version: 1.0

# 功能: Python抓取百度站长平台用户名脚本

import urllib

import urllib2

import re

import time

def BiduSpider():

pattern = re.compile(r'<title>(.*)的个人资料百度站长社区 </title>')

uid=1

thedatas = []

while uid <400000:

theUrl = "http://bbs.zhanzhang.baidu.com/home.php?mod=space&uid="+str(uid)

uid +=1

theResponse = urllib2.urlopen(theUrl)

thePage = theResponse.read()

#正则匹配用户名

theFindall = re.findall(pattern,thePage)

#等待0.5秒，以防频繁访问被禁止

time.sleep(0.5)

if theFindall :

#中文编码防止乱码输出

thedatas = theFindall[0].decode('utf-8').encode('gbk')

#写入txt文本文档

f = open('theUid.txt','a')

f.writelines(thedatas+'n')

f.close()

if __name__ == '__main__':

BiduSpider()

最终成果如下：

Python抓取Discuz!用户名脚本代码1

【Python抓取Discuz!用户名脚本代码】相关文章：

★ win7安装python生成随机数代码分享

★ python获取糗百图片代码实例

★ python中wx将图标显示在右下角的脚本代码

★ python抓取京东商城手机列表url实例代码

★ Python 文件重命名工具代码

★ python利用hook技术破解https的实例代码

★ python插入排序算法的实现代码

★ python备份文件以及mysql数据库的脚本代码

★ Python 文件操作实现代码

★ python将人民币转换大写的脚本代码

上一篇： python之模拟鼠标键盘动作具体实现

下一篇： python连接mysql数据库示例(做增删改操作)

相关阅读

更多>>

网友关注

更多>>

网友最新关注视频

更多>>

精品推荐

系统安装

办公制作

图像动画

音频视频

编程开发基础

网络应用

数码

摄影

平面设计

ps

网页设计

室内设计

三维

电脑

电子商务

建站

编程开发

脚本专栏

操作系统

实用技巧

软件教程

网络

硬件教程

分类导航

系统安装

办公制作

图像动画

音频视频

编程开发基础

网络应用

电脑基础

数码

摄影

平面设计

ps

网页设计

室内设计

三维

电脑

电子商务

建站

编程开发

脚本专栏

操作系统

实用技巧

软件教程

网络

硬件教程

视频教程

教学设计

脚本专栏子分类

最新python学习

热门python学习