请求头和响应头
请求头
请求方法
常见的请求方法有两种POST和GET
区别
- GET请求中的参数包含在 URL 里面,数据可以在 URL 中看到, GET 请求提交的数据最多只有 1024 字节
- POST请求 的 URL 会包含这些数据,数据都是通过表单形式传输的,会包含在请求体中,没有限制
请求行
由请求方式和HTTP协议和版本组成
如:GET / HTTP/1.1

请求报文
Accept
请求报头域,用于指定客户端可接受哪些类型的信息。
Accept-Language
指定客户端可接受的语言类型。
Accept-Encoding
指定客户端可接受的内容编码。
Host
用于指定请求资源的主机 IP 和端口号,其内容为请求 URL 的原始服务器或网关的位置。从HTTP 1. 版本开始,请求必须包含此内容。
Referer
此内容用来标识这个请求是从哪个页面发过来的,服务器可以拿到这 信息并做相应的处理,如做来源统计、防盗链处理等。比如在www.sojson.com 里有一个www.baidu.com 链接,那么点击这个www.baidu.com ,它的header 信息里就有:Referer=https://www.sojson.com
User-Agent
简称 UA ,它是一个特殊的字符串头,可以使服务器识别客户使用的操作系统及版本 浏览器及版本等信息 在做爬虫时加上此信息,可以伪装为浏览器;如果不加,很可能会被识别出为爬虫。
使得服务器能够识别客户使用的操作系统及版本、CPU 类型、浏览器及浏览器版本、浏览器渲染引擎、浏览器语言、浏览器插件等
Content-Type
也叫互联网媒体类型( Internet Media Type )或者 MIME 类型,在 HTTP协议消息头中,它用来表示具体请求中的媒体类型信息。例:text/html 代表 HTML 格式,image/gif 代表 GIF 图片, application/json 代表JSON 类型,
在爬虫中,如果要构造 POST 请求,需要使用正确的 Content-Type,并了解各种请求库的各个参数设置时使用的是哪种 Content-Type,不然可能会导致 POST 提交后无法正常响应。
关于IP地址的请求头
cookie
cookie机制:
是在浏览网页的时候,服务器将你的登录信息,浏览信息等发送给客户端并保存一定的时间。当你下一次访问这个网站的时候,就能读取上一次你的记录

- Path:这个定义了Web站点上可以访问该Cookie的目录
- Expires:这个值表示cookie的过期时间,也就是有效值,cookie在这个值之前都有效。
参考文献https://blog.csdn.net/HHYZBC/article/details/124297104
请求体
post为数据,get为空
响应头
响应行
由HTTP版本响应、状态码、状态描述组成。
如;HTTP/1.1 200 OK
响应状态码
常见的状态码有:
- 200 请求成功
- 307 重定向
- 400 错误的请求
- 404 请求资源在服务器中不存在
- 500 服务器内部源代码出现错误
响应头
Accept-Patch
指定服务器所支持的文档补丁格式
Accept-Ranges
服务器所支持的内容范围
Content-Disposition
对已知MIME类型资源的描述,浏览器可以根据这个响应头决定是对返回资源的动作,如:将其下载或是打开。
Content-Encoding
响应资源所使用的编码类型。
Content-Language
响就内容所使用的语言
Content-Length
响应消息体的长度,用8进制字节表示
Content-Type
当前内容的MIME类型
Date
此条消息被发送时的日期和时间(以RFC 7231中定义的”HTTP日期”格式来表示)
Expires
指定一个日期/时间,超过该时间则认为此回应已经过期
Server
服务器的名称
响应体
网页代码
————————————————
基本把这个内容总结完毕了
参考文献
https://blog.csdn.net/HHYZBC/article/details/124297104
https://blog.csdn.net/HHYZBC/article/details/124297104
来源: https://www.yuque.com/guansuanbangzhuangganjun/oxmbxg/pc5kgbme9bsamxqw
语雀文档ID: 111234289