Python爬虫入门<二>—模拟浏览器

其他 2018-08-08 05:17:19 阅读次数: 0

模拟浏览器

标签： python爬虫模拟浏览器

1.为什么要模拟浏览器

其实，我们访问一一些需要登录的网站的时候，我们的到的请求是由浏览器发出来的，所以我们做爬虫的时候，需要模拟浏览器的环境，从而的到响应。

2需要的工具

其实，在做爬虫的时候，我们需要工具去进行抓包，这里我用的谷歌浏览器自带的抓包工具，大家也可以用fidder,当然还有很多人喜欢用火狐（据说好用）
我就用谷歌浏览器了（嘻嘻）
那我们就用豆瓣来模拟（都喜欢用豆瓣）
此处输入图片的描述

3编写代码访问

import urllib.request

def savefile(data):
    path = "C:\\Users\\Administrator\\Desktop\\爬虫豆瓣.txt"
    f = open(path ,'wb+')
    f.write(data)
    f.close()

url = "https://www.douban.com/"
headers = {'User-Agent':'Mozilla/5.0 (Windows NT 6.1; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/60.0.3112.101 Safari/537.36'}
request = urllib.request.Request(url=url,headers=headers)
response = urllib.request.urlopen(url)
data = response.read()
savefile(data)

此处输入图片的描述

HTTP文件详解

猜你喜欢

转载自blog.csdn.net/Travelerwz/article/details/79771485

Python爬虫入门<二>—模拟浏览器

Python爬虫入门5：模拟浏览器访问网站

python 爬虫（二）使用代理模拟浏览器

Python爬虫：浏览器模拟登录

Python爬虫入门6：模拟浏览器访问网页的http报文体压缩传输

爬虫笔记（二）——浏览器的模拟（Headers属性）

python爬虫模拟浏览器的两种方法

python urllib模拟浏览器请求爬虫

Python爬虫浏览器自动化模拟

python模拟浏览器爬虫之下拉弹窗

python爬虫:使用Selenium模拟浏览器行为

python爬虫模拟浏览器访问-User-Agent

python爬虫:使用Selenium模拟浏览器行为 python爬虫:使用Selenium模拟浏览器行为

python模拟浏览器爬虫之使用代理驱动“谷歌浏览器”

Web of Science爬虫[模拟浏览器]

爬虫浏览器的模拟--Hreader属性

爬虫高度模拟浏览器

关于爬虫的浏览器模拟事件

爬虫入门-巧用Chrome浏览器

Python网络爬虫：自动模拟HTTP请求&爬虫的异常处理&爬虫浏览器伪装技术&新闻爬虫实战

python基于控制浏览器爬虫

python 爬虫浏览器头部

python爬虫：常用浏览器的useragent

python爬虫伪装浏览器

Python网络爬虫:伪装浏览器

python 代理浏览器爬虫资源

python网络爬虫--浏览器伪装

Python 和 Selenium 的浏览器爬虫

记忆碎片之python爬虫APP数据爬取之mitmproxy分别代理监听本地浏览器和夜神模拟器（二）

Python3网络爬虫——（2）设置User Agent模拟浏览器访问

今日推荐

美国拟限制 AI 大模型出口中国和俄罗斯

苹果将与 OpenAI 达成协议，将 ChatGPT 应用于 iPhone

openKylin 社区生态委员会第六次会议圆满召开

阿里云正式发布通义千问 2.5

Python 3.13 发布首个 Beta：实验性自由线程模式和 JIT、改进交互式解释器

Stack Overflow 拿我的代码去训练 AI 大模型，还封了我的账号

Pop!_OS 的 COSMIC 桌面完成 App Store 上架工作

报告：Django 仍然是 74% 开发者的首选

《2024 年一季度互联网投融资运行情况》研究报告

15 年前上了“FFmpeg 耻辱柱”，今天他还得谢谢咱——腾讯QQPlayer一雪前耻？

TIOBE 5 月榜单：Fortran “复活”进入 Top 10

GCC 14.1 发布

周排行

curl的POST请求，封装方法

8.1.1. Integer Types

Java基础 Day05(个人复习整理)

Python - Django - 中间件 process_exception

小L的试卷

【Shell编程】（函数）判断用户是否存在

python(css样式)

spring ant path 匹配原则 - 【笔记】

《JavaScript与JScript从入门到精通》(美)James.Jaworski.中译本.扫描版.pdf

Eclipse运行带参数的java程序

每日归档

更多

2024-05-12(0)

2024-05-11(38)

2024-05-10(38)

2024-05-09(35)

2024-05-08(42)

2024-05-07(14)

2024-05-06(40)

2024-05-05(0)

2024-05-04(7)

2024-05-03(19)