发现一个好看的手机壁纸网站,撸代码的手已经饥渴难耐了

python

本文的文字及图片来源于网络,仅供学习、交流使用,不具有任何商业用途,版权归原作者所有,如有问题请及时联系我们以作处理。

最近有同学的爬虫代码出了bug,给问我怎么改

 

于是就发现了这个好看的壁纸网站" title="手机壁纸网站">手机壁纸网站。

 

看到那么多好看的壁纸,我的爬虫已经饥渴难耐了

受害网址

http://m.bcoderss.com/

为了良性爬取,这个代码就不完整的展示出来了

部分爬虫代码

导入工具

from urllib import parse

import requests

import parsel

import re

解析网站,爬取数据

for page in range(1, 10):

print("正在爬取第{}页壁纸".format(page))

url = "http://m.bcoderss.com/tag/{}/page/{}/".format(name, page)

headers = {

"Cookie": "UM_distinctid=1747c5616688f-0da459aa281e74-3962420d-1fa400-1747c56166982d; CNZZDATA1278590218=744878758-1599811024-%7C1599811024",

"User-Agent": "Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/81.0.4044.138 Safari/537.36"

}

response = requests.get(url=url, headers=headers)

selector = parsel.Selector(response.text)

img_url = selector.css("#main a::attr(href)").getall()

设置爬取类目

string = input("请输入你要爬取的类目:")

name = parse.unquote(string)

保存图片

        path = "C:UsersAdministratorDesktop手机壁纸" + new_title + ".jpg"

with open(path, mode="wb") as f:

f.write(data_response.content)

print(title)

运行代码,效果如下图

以上是 发现一个好看的手机壁纸网站,撸代码的手已经饥渴难耐了 的全部内容, 来源链接: utcz.com/z/530814.html

回到顶部