sbpkzhw 发表于 2021-6-2 07:11

使用Python抓取某不正经网站小姐姐

from urllib.request import urlretrieve

import requests
from bs4 import BeautifulSoup
def get_mm(page):
    for i in range(1,page+1):
      #想要什么类型,cid就替换成什么
      url = "https://www.buxiuse.com/?cid=2&page=%d" % i
      head = {
      "User-Agent":"Mozilla/5.0 (Windows NT 10.0; Win64; x64; rv:83.0) Gecko/20100101 Firefox/83.0"
      }
      resp = requests.get(url, headers=head)
      # print(resp.text)
      page = BeautifulSoup(resp.text, "html.parser")
      #拿到所有img标签
      img = page.find_all('img')
      # print(img)
      #遍历img
      for i in img:
            # print(i)
            #拿到src瞎子路径
            src = i.get("src")
            # print(src)
            #拿到标题,方便命名
            name = i.get("title")
            #设置好下载路径
            path = "img/{}.jpg".format(name)
            print("正在下载{}.jpg".format(name))
            # print(page)
            #下载路径和保持路径
            urlretrieve(src, path)
#设置下载页数 我设置为两页
get_mm(2)


在新标签打开所有链接复制所有链接URL复制所有链接URL(反向)复制所有链接标题 + URL复制所有链接标题 + URL (MD)复制所有链接标题 + URL (BBS)复制所有链接标题 + URL (筛选)复制所有链接标题 + URL (设置复制格式)在新标签页打开所有图片链接在一个标签页显示所有图片链接
复选框 - 选中
复选框 - 取消
复选框 - 反选
单选框 - 选中
单选框 - 取消
特殊单选框 - 选中


29138487 发表于 2021-6-2 07:26

谢谢分享

amilianas 发表于 2021-6-2 07:48


感谢楼主的分享

a84812302 发表于 2021-6-2 07:49

谢谢大佬分享

夜柒 发表于 2021-6-2 07:51

6666

weixia 发表于 2021-6-2 08:04

感谢楼主分享

781031926 发表于 2021-6-2 08:14

谢谢大牛

magicalbean 发表于 2021-6-2 08:21

谢谢@Thanks!

操哭小萝莉 发表于 2021-6-2 08:23


感谢分享,谢谢提供分享

rcbbc 发表于 2021-6-2 08:28

多谢分享多谢分享
页: [1] 2
查看完整版本: 使用Python抓取某不正经网站小姐姐