Python爬虫--正则表达式

什么是正则表达式?
正则表达式,又称规则表达式。(英语:Regular Expression,在代码中常简写为regex、regexp或RE),计算机科学的一个概念。正则表达式通常被用来检索、替换那些符合某个模式(规则)的文本。
Python交流群:942913325
概念
正则表达式是对字符串操作的一种逻辑公式,就是用事先定义好的一些特定字符、及这些特定字符的组合,组成一个“规则字符串”,这个“规则字符串”用来表达对字符串的一种过滤逻辑。
在这里插入图片描述
正则表达式的特点是:

  1. 灵活性、逻辑性和功能性非常强;
  2. 可以迅速地用极简单的方式达到字符串的复杂控制。
  3. 对于刚接触的人来说,比较晦涩难懂。

为什么要用正则表达式?

  1. 给定的字符串是否符合正则表达式的过滤逻辑(称作“匹配”):
  2. 可以通过正则表达式,从字符串中获取我们想要特定部分。
    在这里插入图片描述
    第一个正则表达式:
    在这里插入图片描述
    语法:
    在这里插入图片描述在这里插入图片描述在这里插入图片描述在这里插入图片描述
    正则表达式在python中的用法:
    在这里插入图片描述
    课程:https://www.imooc.com/learn/550(PS:以上图片内容均来自该课程)

猜你喜欢

转载自blog.csdn.net/m0_37903789/article/details/83508430