当前位置: 移动技术网 > IT编程>脚本编程>Python > 使用python BeautifulSoup库抓取58手机维修信息

使用python BeautifulSoup库抓取58手机维修信息

2019年04月02日  | 移动技术网IT编程  | 我要评论

史上最烂残害青少年引发众怒,千魂引,东道设计公司

直接上代码:

复制代码 代码如下:

#!/usr/bin/python
# -*- coding: utf-8 -*-

import urllib

import os,datetime,string

import sys

from bs4 import beautifulsoup

reload(sys)

sys.setdefaultencoding('utf-8')

__baseurl__ = 'http://bj.58.com/'

__initurl__ = "http://bj.58.com/shoujiweixiu/"

soup = beautifulsoup(urllib.urlopen(__initurl__))

lvlelements = soup.html.body.find('div','selectbartable').find('tr').find_next_sibling('tr')('a',href=true)

f = open('data1.txt','a')

for element in lvlelements[1:]:

    f.write((element.get_text()+'\n\r' ))

    url = __baseurl__ + element.get('href')

    print url

    soup = beautifulsoup(urllib.urlopen(url))

    lv2elements = soup.html.body.find('table','tblist').find_all('tr')

    for item in lv2elements:
        addr = item.find('td','t').find('a').get_text()
        phone = item.find('td','tdl').find('b','tele').get_text()
        f.write('地址:'+addr +' 电话:'+ phone + '\r\n\r')

f.close()

直接执行后,存在 data1.txt中就会有商家的地址和电话等信息。
beautifulsoup  api 的地址为: http://www.crummy.com/software/beautifulsoup/bs4/doc/

如对本文有疑问,请在下面进行留言讨论,广大热心网友会与你互动!! 点击进行留言回复

相关文章:

验证码:
移动技术网