8.每天进步一点点---Python抓包要了解的知识

本文涉及的产品
密钥管理服务KMS,1000个密钥,100个凭据,1个月
简介: 8.每天进步一点点---Python抓包要了解的知识

1.HTTPS 介绍

前面我们学习了HTTP,它使用 TCP 进行数据传输,数据没有加密,直接明文 传输,意味着可能会泄露传输内容,被中间人劫持,从而修改传输内容。 最常见的是运营商劫持对网页内容进行修改并添加广告。HTTPS 的出现旨在解决这些 风险因素:保证信息加密传输,避免被第三方窃取;为信息添加校验机制,避免被第三方 破坏;配置身份证书,防止第三方伪装参与通信。

HTTPS(Hyper Text Transfer Protocol over Secure Socket Laye,安全超文本传输协议), HTTP 是应用层协议,TCP 是传输层协议,HTTPS 是在这两层之间添加一个安全套接层 SSL/TLS。HTTPS 可以理解成 HTTP 的安全版。

在学习 HTTPS 的工作流程之前,先要了解一些名词。

  • 对称加密:加密用的密钥和解密用的密钥是一样的。
  • 非对称加密:加密用的密钥(公钥)和解密用的密钥(私钥)是不一样的,公钥 加密过的数据只能通过私钥解开,私钥加密过的数据只能通过公钥解开。
  • 公钥:公开的密钥,所有人都能查到。
  • 私钥:非公开的密钥,一般由网站的管理员持有。
  • 证书:网站的身份证,包含了很多信息,包括公钥。
  • CA(证书颁发机构):颁布证书的机构,可以颁发证书的 CA 很多,只有少数被 认为是权威的 CA,浏览器才会信任。比如 12306 网站的 CA 证书,就是由中国铁 道部自行签发的,而这个证书是不被 CA 机构信任的,在浏览器的左上角有一个 感叹号。

另外,免费的 SSL 证书比较少,一般是收费的且功能越强大的证书费用越高。

2.HTTPS 的工作流程

HTTPS 方式客户端与服务器端通信的流程如图所示

[外链图片转存失败,源站可能有防盗链机制,建议将图片保存下来直接上传(img-3u11r5NM-1670765308140)(Python爬虫image/image-20221211204832374.png)]

流程详解如下: (1)客户端使用 HTTPS 的 URL 访问服务器端,要求与服务器端建立 SSL 连接。 (2)服务器端接收到请求后,会给客户端传送一份网站的证书信息(证书中包含公钥)。 (3)客户端浏览器与服务器端开始协商 SSL 连接的安全等级,即信息加密的等级。 (4)客户端浏览器根据双方同意的安全等级,建立会话密钥,然后利用网站的公钥将 会话密钥加密,并传送给服务器端。 (5)服务器端利用自己的私钥解密出会话密钥。 (6)服务器端利用会话密钥加密与客户端之间的通信。 最后还有一点要注意,并不是使用了 HTTPS 就绝对安全,它只是增加了中间人攻击的 成本,但是它比没有任何加密的 HTTP 安全。另外,建议重要的数据要单独进行加密。

3.抓包工具

我们找一些免费的抓包工具,就能满足日常使用

wireshark

可以捕获并描述网络数据包,其最大的优势就是免费、开源以及多平台支持,在GNU通用公共许可证的保障范围下,用户可以免费获取软件和代码,并拥有对其源码修改和定制的权利。

Wireshark 特点

  • 支持实时捕获和离线分析
  • 跨平台使用,可以在在 Linux、Windows、OS X 和 FreeBSD运行
  • 支持协议多
  • 支持读/写许多不同的捕获文件格式
  • 开源免费,使用成本低

Wireshark 下载地址

https://www.wireshark.org/

fiddler

能记录所有客户端和服务器的http和https请求,允许用户监视,设置断点,甚至修改输入输出数据。

Fiddler 特点

  • 支持 HTTP 会话压缩,极大地减少客户端和服务器之间的字节传输
  • 支持重复、编辑请求
  • 对 cookie、标头和缓存的可见性
  • 支持解密 HTTPS 流量

Fiddler 下载地址

https://www.telerik.com/download/fiddler

后续补充如何使用这两个抓包工具

相关文章
|
2月前
|
开发者 Python
如何在Python中管理模块和包的依赖关系?
在实际开发中,通常会结合多种方法来管理模块和包的依赖关系,以确保项目的顺利进行和可维护性。同时,要及时更新和解决依赖冲突等问题,以保证代码的稳定性和可靠性
55 4
|
2月前
|
测试技术 Python
手动解决Python模块和包依赖冲突的具体步骤是什么?
需要注意的是,手动解决依赖冲突可能需要一定的时间和经验,并且需要谨慎操作,避免引入新的问题。在实际操作中,还可以结合使用其他方法,如虚拟环境等,来更好地管理和解决依赖冲突😉。
|
2月前
|
持续交付 Python
如何在Python中自动解决模块和包的依赖冲突?
完全自动解决所有依赖冲突可能并不总是可行,特别是在复杂的项目中。有时候仍然需要人工干预和判断。自动解决的方法主要是提供辅助和便捷,但不能完全替代人工的分析和决策😉。
|
4月前
|
Python
下载python所有的包 国内地址
下载python所有的包 国内地址
|
30天前
|
Python 容器
[oeasy]python048_用变量赋值_连等赋值_解包赋值_unpack_assignment _
本文介绍了Python中变量赋值的不同方式,包括使用字面量和另一个变量进行赋值。通过`id()`函数展示了变量在内存中的唯一地址,并探讨了变量、模块、函数及类类型的地址特性。文章还讲解了连等赋值和解包赋值的概念,以及如何查看已声明的变量。最后总结了所有对象(如变量、模块、函数、类)都有其类型且在内存中有唯一的引用地址,构成了Python系统的基石。
29 5
|
2月前
|
Python
Python的模块和包
总之,模块和包是 Python 编程中非常重要的概念,掌握它们可以帮助我们更好地组织和管理代码,提高开发效率和代码质量
45 5
|
2月前
|
数据可视化 Python
如何在Python中解决模块和包的依赖冲突?
解决模块和包的依赖冲突需要综合运用多种方法,并且需要团队成员的共同努力和协作。通过合理的管理和解决冲突,可以提高项目的稳定性和可扩展性
WK
|
5月前
|
Python
如何在Python中导入包
在 Python 中,包是一种组织代码的方式,通过包含 `__init__.py` 文件(在 Python 3.3 及以上版本可选)的目录实现。包内可以包含多个模块(`.py` 文件)和其他子包。导入包有多种方式:整体导入包、导入特定模块、导入特定函数或类、导入子包等。推荐的做法是明确指定导入内容以提高代码的可读性和可维护性。此外,确保包目录结构正确,并将其添加到 Python 的搜索路径中。对于分发包,使用 setuptools 和 pip 等工具更为便捷。
WK
140 66
WK
|
5月前
|
Python
如何在Python中创建包
在Python中创建包十分简便,主要涉及目录结构的设置及`__init__.py`文件的配置。虽然Python 3.3后空`__init__.py`文件不再强制要求,但在特定场景下保留它有助于保持兼容性或执行包初始化代码。创建包的具体步骤包括:构建目录结构、编写模块代码、(可选)编写初始化代码等。例如,可以创建一个名为`mypackage`的目录,其中包含`__init__.py`及多个模块文件如
WK
125 63
|
4月前
|
机器学习/深度学习 搜索推荐 数据可视化
Python量化炒股常用的Matplotlib包
Python量化炒股常用的Matplotlib包
41 7