1. 首页
  2. 数据库
  3. 其它
  4. Python爬虫设置代理IP的方法(爬虫技巧)

Python爬虫设置代理IP的方法(爬虫技巧)

上传者: 2020-12-30 07:04:57上传 PDF文件 53.13KB 热度 26次
在学习Python爬虫的时候,经常会遇见所要爬取的网站采取了反爬取技术,高强度、高效率地爬取网页信息常常会给网站服务器带来巨大压力,所以同一个IP反复爬取同一个网页,就很可能被封,这里讲述一个爬虫技巧,设置代理IP。 (一)配置环境 安装requests库 安装bs4库 安装lxml库 (二)代码展示 # IP地址取自国内髙匿代理IP网站:http://www.xicidaili.com/nn/ # 仅仅爬取首页IP地址就足够一般使用 from bs4 import BeautifulSoup import requests import random def get_ip_li
用户评论