爬虫基础练习—python爬虫下载豆瓣妹子图片

python学习教程

发布于 2020-08-05 14:47:53

5420

发布于 2020-08-05 14:47:53

文章被收录于专栏：python学习教程

下载指定网站上的妹子图片，这里只抓了前100页的图片，可根据需要自己设置页数

cat值为图片类型，大家可以自行更改cat值体验一下，有问题留言给我，看到就会解答

2 ＝大胸妹

3 ＝美腿控

4 ＝有颜值

5 ＝大杂烩

6 ＝小翘臀

import requests
import re
import time
from bs4 import BeautifulSoup

cat ='2'
img = 'http://www.dbmeinv.com/dbgroup/show.htm?cid='+ cat
end = '/dbgroup/show.htm?cid='+ cat + '&pager_offset=100'
urls = [ ]
def getURLs(mainURL):
    time.sleep(1)
    headers = {'User-Agent': 'Mozilla/5.0 (Macintosh; Intel Mac OS X 10_11_2) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/47.0.2526.80 Safari/537.36'}
    html = requests.get(mainURL).text
    soup = BeautifulSoup(html, 'html.parser')
    picURL = re.findall('<img class.*?src="(.+?\.jpg)"', html, re.S)
    for url in picURL:
        urls.append(url)
        print(url)
    asoup = soup.select('.next a')[0]['href']
    Next_page = 'http://www.dbmeinv.com' + asoup
    if asoup != end:
        getURLs(Next_page)
    else:
        print('链接已处理完毕！')
    return urls
url = getURLs(img)

i = 0
for each in url:
    pic = requests.get(each, timeout = 10)
    picName = 'pictures/' + str(i) + '.jpg'
    fp = open(picName, 'wb')
    fp.write(pic.content)
    fp.close()
    i += 1

print('图片下载完成')

本文参与腾讯云自媒体同步曝光计划，分享自微信公众号。

原始发表：2020-08-04，如有侵权请联系 cloudcommunity@tencent.com 删除

cat

本文分享自 python教程微信公众号，前往查看

如有侵权，请联系 cloudcommunity@tencent.com 删除。

本文参与腾讯云自媒体同步曝光计划，欢迎热爱写作的你一起参与！

cat

登录后参与评论

0 条评论

热度

爬虫基础练习—python爬虫下载豆瓣妹子图片

爬虫基础练习—python爬虫下载豆瓣妹子图片

社区

活动

资源

关于

腾讯云开发者

热门产品

热门推荐

更多推荐