hy199707

正则表达式与文本处理工具

引言

一、正则表达式基础

（一）字符匹配

1.基本字符

2.特殊字符

3.量词

4.边界匹配

（二）进阶用法

1.组与引用

2.选择

二、命令之-----grep

（一）基础用法

（二）高级用法

三、命令之-----sed

（一）基本用法

1.打印功能

2.插入内容

（二）查找替换

（三）变量

（四）高级用法

四、命令之-----awk

（一）基本介绍

（二）基本用法

（三）变量

（四）正则匹配

（五）line ranges：行范围

（六）条件判断

（六）数组

文本实战

1.过滤IP地址

2.统计网络连接状态

引言

正则表达式（Regular Expression，简写为regex或regexp）是一种用于文本搜索、匹配和替换的强大工具。它定义了一种字符串模式，使得我们可以通过这种模式来查找、验证或提取符合特定规则的文本片段。

在计算机科学和文本处理领域，正则表达式（Regular Expression）无疑是一种强大的工具。它为我们提供了一种简洁而富有表现力的方式来搜索、替换或提取符合特定模式的文本片段。无论是在编程开发、数据清洗、网络爬虫还是日志分析中，正则表达式的应用都无处不在。

一、正则表达式基础

（一）字符匹配

1.基本字符

直接写出即可匹配该字符本身，例如 a 匹配字符 "a"。

grep是一个全局搜索并打印匹配模式的行的命令。等下会讲到

2.特殊字符

.	匹配任意单个字符，可以是一个汉字
[]	匹配指定范围内的任意单个字符
[^]	匹配指定范围外的任意单个字符,示例：[^zhou][^a.z][a.z]
[:alnum:]	字母和数字
[:alpha:]	代表任何英文大小写字符，亦即A-Z,a-z
[:lower:]	小写字母,示例:[[:lower:]],相当于[a-z]
[:upper:]	大写字母
[:blank:]	空白字符（空格和制表符）
[:space:]	包括空格、制表符(水平和垂直)、换行符、回车符等各种类型的空白,比[:blank:]包含的范围广
[:cntrl:]	不可打印的控制字符（退格、删除、警铃...）
[:digit:]	十进制数字
[:xdigit:]	十六进制数字
[:graph:]	可打印的非空白字符
[:print:]	可打印字符
[:punct:]	标点符号
\w	#匹配单词构成部分，等价于[_[:alnum:]]
\W	#匹配非单词构成部分，等价于[^_[:alnum:]]
\S	#匹配任何非空白字符。等价于[^\f\n\r\t\v]。
\s	#匹配任何空白字符，包括空格、制表符、换页符等等。等价于[\f\n\r\t\v]
\d	数字字符集，等同于 [0-9]，如\d+可以匹配一个或多个连续的数字。

以前四个为例

. ：表示匹配单个字符

[ ]：匹配指定范围内的任意单个字符

[^]：匹配指定范围外的任意单个字符

[:alnum:]：字母和数字

3.量词

?	前一个元素出现0次或1次	如 colou?r 可以匹配 "color" 或 "colour"
*	前一个元素出现0次或多次	如 a*b 可以匹配 "b"、"ab"、"aab" 等
+	前一个元素至少出现1次	如 a+b 可以匹配 "ab"、"aab"，但不匹配 "b"
{n}	前一个元素精确出现n次	如 a{3} 只能匹配 "aaa"
{n,}	前一个元素至少出现n次	如 a{2,} 可以匹配 "aa"、"aaa" 等
{n,m}	前一个元素最少出现n次	最多出现m次，如 a{2,4} 匹配 "aa"、"aaa" 和 "aaaa"

？的用法

*的用法

+的用法

{n,m}的用法

4.边界匹配

^	匹配字符串的开始位置	如 ^Hello 只匹配以 "Hello" 开头的字符串
$	匹配字符串的结束位置	如 World$ 只匹配以 "World" 结尾的字符串
\b	匹配单词边界	确保前后为非单词字符和单词字符的交界处

^的用法

$的用法

\b的用法

\b主要用于位置锚定，即精确地界定匹配的模式必须是独立的单词，而不是作为其他单词的一部分。

（二）进阶用法

1.组与引用

（）

捕获分组

允许对内部模式进行分组，并可以引用捕获的内容

2.选择

表示或操作

匹配左右两边的任何一个表达式

符号“|”的使用

正则表达式是每个程序员都应该掌握的重要技能之一，熟练运用它可以极大地提高工作效率和代码质量。然而，需要注意的是，不同编程语言和工具对正则表达式的实现可能存在细微差异，请根据具体环境查阅相关文档并进行适配。同时，编写复杂正则时应尽量保持清晰和简洁，避免过度复杂的正则导致可读性和维护性降低。通过不断的实践与学习，你会发现正则表达式的世界充满了无限可能！

上面是一些正则表达式的基础用法。想要熟练掌握，还需要结合命令多加练习，下面介绍一些在工作中必备的三个文本处理命令

grep、sed 和 awk 是Linux/Unix环境下的三个非常强大的文本处理工具，它们在命令行中广泛用于搜索、替换和分析文本数据。

二、命令之-----grep

grep命令是Linux和类Unix系统中用于搜索文本文件中匹配特定模式的行的强大工具。它的全称是Global Regular Expression Print，即全局正则表达式打印

语法为

grep [选项] 表达式文件名

-i	忽略大小写进行匹配。
-v	反向选择，打印不包含匹配项的行。
-n	在输出行前加上行号。
-c	只显示包含匹配项的行数，而不是具体行内容。
-w	精确匹配整个单词。
-e	实现多个选项间的逻辑or关系
-f	从文件中读取多个搜索模式。
-r ;-R	递归地搜索目录下的所有文件。r不处理软链接R处理软链接
-l	仅列出包含匹配行的文件名。
-m	最多显示count个匹配行。
-o	只显示匹配内容
-q	静默输出，不显示任何内容。一般在写脚本的时候使用
-E	指定一个正则表达式模式。

（一）基础用法

grep的基础用法就是匹配已知字符

例如下图所示

还可以进行组合，比如查看一个目录下，有哪些文件包含匹配的字符串

使用grep -lr 需要匹配的内容目录

-o：表示只显示匹配的内容

-e：匹配多个内容，用-e连接起来

-m：最多显示指定的匹配行数

-v：反选，显示匹配内容之外的内容

-f：处理两个文件相同内容把第一个文件作为匹配条件

-w：精准匹配单词

（二）高级用法

与正则表达式相结合使用，一般使用正则表达式时，大多数字符都具有特殊含义，所以在命令行中需要进行转译，或者加 -E 使用扩展正则,支持更丰富的正则表达式特性

例如匹配ip地址，子网掩码和广播地址

这个时候，我们只需要加上-E开启扩展正则就无需进行转译，可以直接匹配

结合| 就无需使用-e进行字符串关联

使用grep统计当前主机有多少普通用户可以登录

总之，grep -E 提供了比基本正则表达式更多的灵活性和功能，使得能够编写更复杂、更精确的搜索模式。

三、命令之-----sed

相对于grep命令来说，sed的命令就更加强大了一些。

sed（Stream Editor）是一种流编辑器，它逐行处理文本文件或输入流，并能够进行搜索、替换、删除、插入等操作。

Sed是从文件或管道中读取一行，处理一行，输出一行；再读取一行，再处理一行，再输出一行，直到最后一行。每当处理一行时，把当前处理的行存储在临时缓冲区中，称为模式空间（PatternSpace），接着用sed命令处理缓冲区中的内容，处理完成后，把缓冲区的内容送往屏幕。接着处理下一行，这样不断重复，直到文件末尾。

sed命令，一般用于脚本当中

（一）基本用法

sed的基本语法为

sed [选项] ‘语法选项’ 文件名

-e	用指定命令或者脚本来处理输入的文本文件只有一个操作命令时省略，一般在执行多个操作命令使用
-f	用指定的脚本文件来处理输入的文本文件
-n	不输出模式空间内容到屏幕，取消默认的打印行为，只有在命令中显式使用 p 命令时才会打印行。
-r 或 -E	使用扩展正则表达式
-h	显示帮助
-i	直接修改目标文件
-i.xxx	备份文件并原处编辑。xxx为自定义后缀名，可以随意设置
-s	将多个文件视为独立文件，而不是单个连续的长文件流

语法选项（模式空间操作）：

s/old/new/flags	替换命令，用 new 替换每一行首次出现的 old，可选的标志包括 g:全局替换，在一行中所有匹配的地方都进行替换。 i:忽略大小写。 p:打印出已替换的行。
d	删除命令，删除匹配当前模式空间内容的行。
a\ text	在当前行后添加文本 text，新行以反斜杠 \ 结束。
i\ text	在当前行前插入文本 text。
p	打印当前行（默认行为，如果没有 -n 参数的话）。
q	退出 sed，如果后面跟着一个数字，则在处理到第 n 行之后退出。
c	替换，将选定行替换为指定内容
w	保存模式匹配的行至指定文件

地址范围：

number	指定要操作的行号。
/regex/	根据正则表达式匹配的行。
address1, address2	处理从 address1 到 address2 的行。

1.打印功能

虽然sed本身具有打印功能，但是直接使用sed命令却无法打印，因为sed的打印原理是将匹配的每一行内容，逐行放入模式空间，并打印到屏幕上。这里没有匹配项，所以无法打印

而加上语法选项p之后会将每一行的内容打印两边，这是因为，sed本身具有打印功能，而p选项，是打印文件内容，就等于将所有内容匹配了一遍，所有sed又打印了一遍。

加上-n选项后，取消了自动打印功能，所以只执行了p功能的打印属性

打印指定行数

2.插入内容

a：下方插入 i：上方插入 c：指定行替换

将其它文本的内容插入到当前文本中

这些都只是打印出来的内容，真实文件是没有改变的，想要真实修改文件，需要加-i选项

（二）查找替换

语法格式为 sed [选项] s/old/new/flags 文件路径

匹配旧内容时支持通配符，比如将selinux永久关闭，修改配置文件

查找替换中，还有一种比较实用的用法叫后向引用

就是使用捕获分组() 将括号中的字符串定义为一个分组，第一个括号中的内容就是1.第二个括号中的内容就是2，以此类推

修改httpd的配置文件中的监听端口

指定行数

指定需要修改的行的范围

（三）变量

sed支持变量查找与替换

首先定义变量

语法格式为

sed -ri "s/${变量名}/${变量名}/g" /etc/passwd

（四）高级用法

sed语法用有一些比较高级的使用方法

下面是一个语法选项

选项	含义
P	打印模式空间开端至\n内容，并追加到默认输出之前
N	读取匹配到的行的下一行追加至模式空间
n	读取匹配到的行的下一行覆盖至模式空间
G	从保持空间取出的内容追加至模式空间
g	从保持空间取出的数据覆盖至模式空间
H	把模式空间中的内容追加至保持空间
h	把模式空间中的内容覆盖至保持空间
x	把模式空间中的内容与保持空间中的内容进行互换
d	删除模式空间中的行
D	如果模式空间包含换行符，则删除直到第一个换行符的模式空间中的文本，并不会读取新的输入行，而使用合成的模式空间重新启动循环，如果模式空间不包含换行符，则会像发出d命令那样启动正常的新循环

n，表示读取匹配到的行的下一行覆盖至模式空间

打印奇数行与偶数行的方式

烧脑挑战

首先需要直到语法选项的含义

-n：取消默认打印

1：表示第一行

！：取反

G：从保持空间取出的内容追加至模式空间

h：把模式空间中的内容覆盖至保持空间

$！：表示最后一行

d：删除

现在，结合图片解释一下

从第一行开始匹配：1！取反，不是第一行才执行G（从保持空间取出的内容追加至模式空间），第一行不执行执行G，直接执行h（把模式空间中的内容覆盖至保持空间）保持空间为行1，不符合$(最后一行)条件，删除模式空间内容

第二行：1！取反，不是第一行就执行G，将保持空间取出的内容追加至模式空间，而后执行h，将行2与行1覆盖至保持空间，不是最后一行，删除模式空间内容

第三行：1！取反，不是第一行就执行G，将保持空间取出的内容追加至模式空间，而后执行h，将行3、行2、行1覆盖至保持空间，不是最后一行，删除模式空间内容

以此类推，一直到最后一行，不删除模式空间内容，输出到屏幕

小结：sed语法一般用在脚本当中，不需要打开文件，进行文件修改，如果在bash环境中一般直接使用vim进行修改，但是，处理大文件时使用sed命令会更好，因为vim需要打开文件，会占用缓存资源，sed不需要打开文件可以直修改

四、命令之-----awk

（一）基本介绍

awk 是一款强大的文本处理工具，它基于模式匹配和行处理的概念进行设计。在Unix/Linux环境中，awk 通常用于对结构化文本数据（如日志文件、表格数据等）执行一系列操作，包括搜索、过滤、格式化输出以及各种计算和转换。

起源与名称： awk 的名字来源于其三位创始人 Alfred Aho、Peter Weinberger 和 Brian Kernighan 的首字母组合

现在使用的awk命令来自gawk软件

基本语法： awk [options] 'pattern { action }' file(s)

options：可选的命令行选项，例如 -F 用于设置输入字段分隔符。

pattern：一个或多个条件表达式，当指定的模式匹配到当前行时，执行相应的动作。用{}指明

action：在模式匹配成功后要执行的操作，可以包含任意合法的Awk语句，如变量赋值、打印、循环、函数调用等。

file(s)：待处理的一个或多个输入文件名。

工作原理：

awk 将每一行输入数据视为一条记录，并将记录按照指定的分隔符划分为多个字段。对于每条记录，它都会尝试匹配给定的模式，如果模式匹配，则执行相应的动作。默认情况下，字段之间由空白字符（空格或制表符）分隔，但可以通过 -F 参数自定义分隔符。

内置功能

变量：awk 提供了一系列预定义变量，如 $0 表示整个记录，$1 到 $n 分别表示各字段，NF 表示字段数，NR 表示当前处理的记录行号等。

BEGIN/END 块

BEGIN 块在读取任何输入之前执行一次，常用于初始化变量或打印头部信息。

END 块在所有输入处理完毕后执行一次，适合于统计汇总结果或打印尾部信息。

运算符和表达式：支持算术、比较、逻辑及正则表达式等，可以用来构造复杂的匹配和控制流程。流程控制：if...else 条件判断，for 和 while 循环，以及其他控制结构。

函数：内置有多种函数，如数学函数、字符串函数，同时也允许用户自定义函数。

选项：

-v	定义变量
-F	指定分隔符

常见内置变量

（二）基本用法

awk默认以一个以上的空格为分隔符

比如以前想过滤出IP地址，需要好几个命令堆加在一起，现在只需要awk一个命令就可以了

-F：指定分隔符

BEGIN/END 块

BEGIN 块在读取任何输入之前执行一次，常用于初始化变量或打印头部信息。

END 块在所有输入处理完毕后执行一次，适合于统计汇总结果或打印尾部信息。

BEGIN/END必须要大写

awk还支持标准输入

（三）变量

awk中常见的内置变量有以下几种

内置变量	作用
NR	当前处理的行的行号（序数）
NF	当前处理的行的字段个数
FS	列分隔符，指定每行文本的字段分隔符，默认为空格或制表位。与 “ -F ” 作用相同
OFS	输出内容的列分隔符
RS	行分隔符，awk从文件中读取资料时，将根据RS的定义把资料切割成许多条记录，而awk一次仅读入一条记录进行处理。预设值是"\n"
$0	当前处理的行的整行内容
$n	当前处理行的第n个字段（第n列）
FILENAME	被处理的文件名

NR：表示当前处理的行的行号（序数）

语法为awk 'NR==n{处理动作}' 文件名

例：

awk '{print $1,NR}' passwd：打印出行号

awk 'NR==2{print $1}' /etc/passwd：只取第二行的第一个字段
awk 'NR==1,NR==3{print}' passwd ：打印出1到3 行

awk '(NR%2)==1{print NR,$0}' passwd：打印出函数取余数为1的行
awk '(NR%2)==0{print NR,$0}' passwd：打印出函数取余数为0行

$0：当前处理的行的整行内容

awk 'NR==1||NR==3{print}' passwd：打印出1和3行
awk 'NR>=3 && NR<=6{print NR,$0}' /etc/passwd ：打印出大于等于第三行，小于等于第六行，也就是3-6行

FNR：将多个文件分开显示

NF：当前处理的行的字段个数

例：

awk -F: '{print NF}' passwd

awk -F: '{print $NF}' passwd ：$NF表示最后一个字段

df|awk '{print $(NF-1)}'：倒数第二行

FS：列分隔符，指定每行文本的字段分隔符

RS：行分隔符，awk从文件中读取资料时，根据RS的定义把资分段，而awk一次仅读入一条记录进行处理。预设值是"\n"

OFS 输出内容的列分隔符（$n=$n 用于激活，否则不生效，n且必须存在）

（四）正则匹配

awk同样支持正则表达式进行匹配

（五）line ranges：行范围

算术操作符
x+y, x-y, x*y, x/y, x^y, x%y

比较操作符：
==, !=, >, >=, <, <=
逻辑
与：&&，并且关系
或：||，或者关系
非：!，取反

（六）条件判断

if语句：awk的if语句也分为单分支、双分支和多分支
单分支为if(判断条件){执行语句}

双分支为if(判断条件){执行语句}else{执行语句}

多分支为if(判断条件){执行语句}else if(判断条件){执行语句}else if(判断条件){执行语句}else if(判断条件){执行语句

（六）数组

awk的数组是关联数组(即key/value方式的hash数据结构)，索引下标可为数值(甚至是负数、小数等)，也可为字符串

1. 在内部，awk数组的索引全都是字符串，即使是数值索引在使用时内部也会转换成字符串

2. awk的数组元素的顺序和元素插入时的顺序很可能是不相同的

文本实战

1.过滤IP地址

[root@localhost ~]#ifconfig ens33|grep  netmask|tr -s " "|cut  -d " "  -f3
192.168.83.30

#ifconfig ens33：只看ens33网卡信息
#grep   netmask：过滤包含netmask的行
#tr -s " "     : 压缩空格
#cut -d " " -f3：以空格为分隔符，取第三列

[root@localhost ~]#ifconfig ens33|sed  -nr  's/ .*  inet (.*)  netmask.*/\1/p'
192.168.83.30

#ifconfig ens33：只看ens33网卡信息
#sed...........：
#-nr：关闭自动打印并开启扩展正则  
#.*表示任意字符，第一个.*表示前面的空格 
#inet (.*)表示inet后面的任意字符
#netmask.*表示netmask后面的任意字符；
#\1表示调用第一个括号中的内容；
#p打印
#打印出第一个括号中的内容，inet 后面的括号，里面的内容就是Ip地址
#需要注意空格符号，inte后面有一个空格 (.*)后面有两个空格  netmask


[root@localhost ~]#ifconfig ens33|awk  /netmask/'{print  $2}'
192.168.83.30

#ifconfig ens33：只看ens33网卡信息
#awk........
/netmask/   ：找到包含netmask的行
{print  $2} ：打印第二列

2.统计网络连接状态

总结：

grep、sed 和 awk是在日常工作中必不可少的操作命令，需要重点去掌握，而正则表达式，是实现文本高效处理的重要组成部分

命令名称	主要功能
grep	根据正则表达式搜索文件内容，并打印匹配行。
sed	对输入流（如文件或管道的输出）进行逐行编辑，可以实现查找、替换、删除、插入等多种操作。
awk	基于模式匹配对每一行数据进行处理，支持更复杂的条件判断和字段处理能力，通常用于结构化数据的处理。

你可能感兴趣的:(正则表达式)

python实现规则引擎_规则引擎python weixin_39601511 python实现规则引擎
广告关闭回望2020，你在技术之路上，有什么收获和成长么？对于未来，你有什么期待么？云+社区年度征文，各种定制好礼等你！我正在用python编写日志收集分析应用程序，我需要编写一个“规则引擎”来匹配和处理日志消息。它需要具有以下特点：正则表达式匹配消息本身消息严重性优先级的算术比较布尔运算符我设想一个例子规则可能是这样的：(message~program:messageandseverity>=h
Regular Expression 正则表达式 Aimyon_36 Data Development 正则表达式 redis 数据库
RegularExpression前言1.基本匹配2.元字符2.1点运算符.2.2字符集2.2.1否定字符集2.3重复次数2.3.1*号2.3.2+号2.3.3?号2.4{}号2.5(...)特征标群2.6|或运算符2.7转码特殊字符2.8锚点2.8.1^号2.8.2$号3.简写字符集4.零宽度断言（前后预查）4.1?=...正先行断言4.2?!...负先行断言4.3?Thefatcatsaton
Nginx从入门到实践(三) 听你讲故事啊
动静分离动静分离是将网站静态资源（JavaScript，CSS，img等文件）与后台应用分开部署，提高用户访问静态代码的速度，降低对后台应用访问。动静分离的一种做法是将静态资源部署在nginx上，后台项目部署到应用服务器上，根据一定规则静态资源的请求全部请求nginx服务器，达到动静分离的目标。rewrite规则Rewrite规则常见正则表达式Rewrite主要的功能就是实现URL的重写，Ngin
爬虫技术抓取网站数据 Bearjumpingcandy 爬虫
爬虫技术是一种自动化获取网站数据的技术，它可以模拟人类浏览器的行为，访问网页并提取所需的信息。以下是爬虫技术抓取网站数据的一般步骤：发起HTTP请求：爬虫首先会发送HTTP请求到目标网站，获取网页的内容。解析HTML：获取到网页内容后，爬虫会使用HTML解析器解析HTML代码，提取出需要的数据。数据提取：通过使用XPath、CSS选择器或正则表达式等工具，爬虫可以从HTML中提取出所需的数据，如文
互联网 Java 工程师面试题（Java 面试题四）苹果酱0567 面试题汇总与解析 java 中间件开发语言 spring boot 后端
下面列出这份Java面试问题列表包含的主题多线程，并发及线程基础数据类型转换的基本原则垃圾回收（GC）Java集合框架数组字符串GOF设计模式SOLID抽象类与接口Java基础，如equals和hashcode泛型与枚举JavaIO与NIO常用网络协议Java中的数据结构和算法正则表达式JVM底层Java最佳实JDBCDate,Time与CalendarJava处理XMLJUnit编程现在是时候给
【无标题】正则表达式笔记 qis_qis 正则表达式笔记
作用查找特殊规则的字符串编写一个正则表达式，用来查找所有以0开头，后面跟着2-3个数字，然后是一个连字号“-”，最后是7或8位数字的字符串(像010-12345678或0376-7654321)。0\d{2,3}-\d{7,8}基本匹配区分大小写cat会匹配"cat"CAt会匹配"CAt"元字符元字符是正则表达式的基本组成元素。元字符在这里跟它通常表达的意思不一样，而是以某种特殊的含义去解释。有些
python学习第七节：正则表达式一只会敲代码的小灰灰 python学习 python 学习正则表达式
python学习第七节：正则表达式正则表达式基本上在所有开发语言中都会使用到，在python中尤为重要。当我们使用python开发爬虫程序将目标网页扒下来之后我们要从网页中解析出我们想要的信息，这个时候就需要正则表达式去进行匹配。importrere的常量re模块中有9个常量，常量的值都是int类型！（知道就行）修饰符描述re.l使匹配对大小写不敏感re.L做本地化识别(locale-aware)
Linux三剑客之grep命令详解 promise524 Linux linux 服务器 python shell bash 后端运维
grep是Linux中最常用的文本搜索工具，用于在文件或文本输出中查找与指定模式匹配的行。它支持基本正则表达式、扩展正则表达式、多文件搜索、递归搜索等多种功能，非常适合过滤、搜索和提取文本内容。1.grep的基本语法grep[选项]模式[文件...]模式：搜索的文本模式，可以是普通字符串或正则表达式。[文件...]：要搜索的文件。如果没有指定文件，grep会从标准输入中读取数据。2.常用选项-i：
Linux三剑客与管道使用许琳珊
一、管道1、什么是管道linux提供管道符“|”将两个命令隔开，管道符左边命令的输出就会作为管道符右边命令的输入2、例子echo"hello123"|grep"hello"二、正则1、什么是正则正则表达式就是记录文本规则的代码2、正则的用法常用元字符代码说明.匹配除换行符以外的任意字符\w匹配字母或数字或下划线或汉字\s匹配任意的空白符\d匹配数字\b匹配单词的开始或结束^匹配字符串的开始$匹配字
Java 正则表达式详解艾伦~耶格尔 Java初级 java 正则表达式开发语言学习
正则表达式(RegularExpression，简称regex)是一种强大的文本处理工具，可以用来匹配、搜索和替换文本中的特定模式。在Java中，正则表达式由java.util.regex包提供支持。1.理解正则表达式语法正则表达式使用特殊的字符和符号来定义匹配模式。一些常用的元字符如下：.:匹配任意单个字符*:匹配前面的字符零次或多次+:匹配前面的字符一次或多次?:匹配前面的字符零次或一次[]:
Linux三剑客-sed krb___ linux 运维服务器
前言：sed是StreamEditor（字符流）的缩写，简称流编辑器。sed是操作、过滤和转换问吧内容的强大工具。sed是一次读取一行数据常用功能包括结合正则表达式对文件实现快速增删改查，其中查询的功能中最常用的两大功能是过滤（过滤指定字符串），取行（取出指定行）sed命令语法：sed[选项][sed内置命令字符][输入文件]选项参数解释-n取消默认sed的输出，常与sed内置命令p一起使用-i直
Python基础知识进阶之正则表达式_头歌python正则表达式进阶前端陈萨龙程序员 python 学习面试
最后硬核资料：关注即可领取PPT模板、简历模板、行业经典书籍PDF。技术互助：技术群大佬指点迷津，你的问题可能不是问题，求资源在群里喊一声。面试题库：由技术群里的小伙伴们共同投稿，热乎的大厂面试真题，持续更新中。知识体系：含编程语言、算法、大数据生态圈组件（Mysql、Hive、Spark、Flink）、数据仓库、Python、前端等等。网上学习资料一大堆，但如果学到的知识不成体系，遇到问题时只是
Java中的数组和字符串 RenX000 Java SE java
文章目录数组一维数组创立默认值转型多维数组可变长参数基本格式应用字符串String类StringBuilder类裁剪正则表达式检测数组数组类型本身也是类，即使是基本类型的数组也是以对象形式存在的，并不是基本数据类型一维数组int[]array=newint[10];//创建数组时需要指定长度创立类型[]变量名称=new类型[数组大小];类型变量名称[]=new类型[数组大小];//支持C语言样式，
Linux如何使用sed命令进行文本替换 yang295242361 linux 运维服务器
在Linux中，sed（StreamEditor）是一个用于处理文本流的命令行工具，它非常适合用于执行基本的文本转换。sed可以读取输入的文本文件，根据指定的指令对文本进行处理，并将结果输出到标准输出设备。以下是如何使用sed命令进行文本替换的详细说明：1.基本语法sed命令的基本语法如下：sed's/regexp/replacement/flags'fileregexp：正则表达式，用于匹配要替
Linux 运维三剑客：grep、sed 和 awk 实战案例与命令参数详解 Lyle_Tu Linux 云计算运维运维 linux chrome 云计算服务器
在Linux运维中，grep、sed和awk是三个非常强大的文本处理工具，它们在处理文本数据时发挥着重要作用。本文将通过一些实战案例，展示这三个工具的使用方法和强大功能，并对它们的命令参数进行详解。grep：文本搜索利器grep是一个强大的文本搜索工具，它使用正则表达式来匹配文本模式。以下是grep的一些常用命令参数：-i：忽略大小写进行匹配。-v：反向查找，只打印不匹配的行。-n：显示匹配行的行
python核心编程课后习题答案--第一章 NewForMe
正则表达式1-1[bh][aiu]t;1-2\w+\w+;1-3\w+,\s\w+;1-4[A-Za-z_]+[\w_]+python有效标识符的定义：1.python中的标识符是区分大小写的。2.标示符以字母或下划线开头，可包括字母，下划线和数字。3.以下划线开头的标识符是有特殊意义的。1-5\d+(\s\w+)+1-6(1)^w{3}://.+com/?$(2)^\w+://.+?\.\w{3
Java 正则表达式南风_001
正则表达式定义了字符串的模式。正则表达式可以用来搜索、编辑或处理文本。正则表达式并不仅限于某一种语言，但是在每种语言中有细微的差别。正则表达式实例一个字符串其实就是一个简单的正则表达式，例如HelloWorld正则表达式匹配"HelloWorld"字符串。.（点号）也是一个正则表达式，它匹配任何一个字符如："a"或"1"。下表列出了一些正则表达式的实例及描述：正则表达式描述thisistext匹配
Linux shell sed 命令详解 BugBear1989
详细的sed命令详解，请参考https://my.oschina.net/u/3908182/blog/1921761一、sed命令工作机制：每次读取一行文本至“模式空间(patternspace)”中，在模式空间中完成处理；将处理结果输出至标准输出设备；语法：sed[OPTION]...{script}[input-file]...参数说明-r支持扩展正则表达式-n静默模式-escript1-e
用正则表达式过滤logcat中的多个tag的日志 fc82bb084ee7
在AndroidStudio中,在过滤器的byLogTag选项中配置.我配置了2个tagfilter方便开发,1.multi-tag-filter2.ignore-multi-tag-filter.过滤出指定tag的日志信息^(?:Watchdog|InputReader|ahking)Watchdog忽略指定tag的日志信息^(?!WifiMonitor|WifiHW)有些tag的无用log非常
Python实现对哈利波特小说单词统计胜天半月子 Python基础及应用 python 字符串列表正则表达式
文章目录要求一、打开文件正则表达式spilt()函数实例二、词频统计三、单词排序四、输出或写入文件python文件写入要求对HarryPotter5.txt英文小说进行词频统计，统计出前二十个频率最高的单词，并打印输出或写入文件一、打开文件打开文件并将单词中非单词字符用空格代替代码：#读取小说内容fp=open('HarryPotter5.txt')content=fp.read()#所有标点符号
javase笔记3----正则表达式芝奥小婷笔记
正则表达式简介正则表达式（RegularExpressions），是一个特殊的字符串，可以对普通的字符串进行校验检测等工作，校验一个字符串是否满足预设的规则。基本语法字符集合[]:表示匹配括号里的任意一个字符。[abc]:匹配a或者b或者c[^abc]:匹配任意一个字符，只要不是a,或b,或c就表示匹配成功[a-z]:表示匹配所有的小写字母的任意一个。[A-Za-z]:表示匹配所有的小写字母和大写
搜索结果关键字标红 — 正则月亮消失了.974 servlet html javascript
str是你的内容，key是关键字正则表达式匹配模式支持的三个标志（newregexp的第二个参数）g:global全文搜索，不添加则搜索到第一个匹配停止；i:ignorecase忽略大小写，默认大小写敏感；m:multiplelines多行搜索highlight(str,key){ varreg=newRegExp(`(${key})`,'gi'); v
正则表达式语法、运算符优先级 weixin_54668000 mvc
正则表达式(regularexpression)描述了一种字符串匹配的模式（pattern），可以用来检查一个串是否含有某种子串、将匹配的子串替换或者从某个串中取出符合某个条件的子串等。例如：runoo+b，可以匹配runoob、runooob、runoooooob
shell脚本——正则表达式诚诚k 正则表达式
概述正则表达式是你所定义的模式模板，Linux工具可以用它来过滤文本。Linux工具（比如sed编辑器或gawk程序）能够在处理数据时使用正则表达式对数据进行模式匹配。如果数据匹配模式，它就会被接受并进一步处理；如果数据不匹配模式，它就会被滤掉。数据流--正则表达式---（1）匹配的数据（2）滤掉的数据正则表达式（或称RegularExpression，简称RE），是用于描述字符排列和匹配模式的一
正则表达式-运算符优先级一只小棉花正则表达式正则表达式-优先级
转自：http://www.runoob.com/regexp/regexp-operator.html
【Python】正则表达式丕羽 python 正则表达式 mysql
正则表达式正则表达式,全称是RegularExpression,正则表达式,即:正确的,符合特定规则的式子.用来校验和匹配数据,正则不独属于任意的一门语言,Java,Python…都支持,且:正则规则都是一样的,不同的是写法不一样.python中正则使用步骤:#1.导包importre#2.正则校验.re.match()re.search()re.compile().sub()#3.获取匹配结果.
re模块匿隱
defmain():""""""#1.compile(正则表达式)->将正则表达式转换成正则对象"""编译后可以直接通过对象调用相关的对象方法"""re_object=re.compile(r'\d{3}')re_object.fullmatch('432')#2.fullmatch(正则表达式,字符串)->让字符串和正则表达式完全匹配，匹配成功返回匹配对象，匹配失败返回None"""应用：检测字
Python 标准库一马归一码 Python python
目录1.一些常见的标准库：2.os模块的导入和使用3.re模块的导入与调用4.math模块的导入与调用5.datetime模块的导入与调用标准库：Python本身带着的一些标准的模块库，这些模块被直接构建在解析器里，虽然不是语言内置的功能，但可以高效地调用，甚至是系统级调用也可以。1.一些常见的标准库：os模块：提供了很多与操作系统相关联的函数re模块：为高级字符串处理提供了正则表达式工具，对于复
正则表达式他@ 正则表达式 php 数据库
一：正则表达式grep-a不要忽略二进制数据。-A除了显示符合范本样式的那一行之外，并显示该行之后的内容。-b在显示符合范本样式的那一行之外，并显示该行之前的内容。-c计算符合范本样式的列数。-C或-除了显示符合范本样式的那一列之外，并显示该列之前后的内容。-d当指定要查找的是目录而非文件时，必须使用这项参数，否则grep命令将回报信息并停止动作。-e指定字符串作为查找文件内容的范本样式。-E将范
14.JS-正则表达式的反向引用 WahFung_ js笔记正则表达式 js
选择字符：|com|cn|edu---选择其中一个(含有其中一个就能匹配成功)子表达式：用()包围的就是子表达式str="((/d)(/w))"第一个子表达式：((\d)(\w))第二个子表达式：(\d)第三个子表达式：(\w)子表达式：以第一个出现的(为第一个表达式捕获：将匹配到的子表达式保存在RegExp对象中RegExp.$1：保存第一个子表达式RegExp.$2：保存第二个子表达式RegE
java杨辉三角 3213213333332132 java基础
package com.algorithm; /** * @Description 杨辉三角 * @author FuJianyong * 2015-1-22上午10:10:59 */ public class YangHui { public static void main(String[] args) { //初始化二维数组长度 int[][] y
《大话重构》之大布局的辛酸历史白糖_ 重构
《大话重构》中提到“大布局你伤不起”，如果企图重构一个陈旧的大型系统是有非常大的风险，重构不是想象中那么简单。我目前所在公司正好对产品做了一次“大布局重构”，下面我就分享这个“大布局”项目经验给大家。背景公司专注于企业级管理产品软件，企业有大中小之分，在2000年初公司用JSP/Servlet开发了一套针对中
电驴链接在线视频播放源码 dubinwei 源码电驴播放器视频 ed2k
本项目是个搜索电驴（ed2k）链接的应用,借助于磁力视频播放器（官网： http://loveandroid.duapp.com/ 开放平台），可以实现在线播放视频，也可以用迅雷或者其他下载工具下载。项目源码： http://git.oschina.net/svo/Emule,动态更新。也可从附件中下载。项目源码依赖于两个库项目，库项目一链接： http://git.oschina.
Javascript中函数的toString()方法周凡杨 JavaScript js toString function object
简述 The toString() method returns a string representing the source code of the function. 简译之，Javascript的toString()方法返回一个代表函数源代码的字符串。句法 function.
struts处理自定义异常 g21121 struts
很多时候我们会用到自定义异常来表示特定的错误情况，自定义异常比较简单，只要分清是运行时异常还是非运行时异常即可，运行时异常不需要捕获，继承自RuntimeException，是由容器自己抛出，例如空指针异常。非运行时异常继承自Exception，在抛出后需要捕获，例如文件未找到异常。此处我们用的是非运行时异常，首先定义一个异常LoginException: /** * 类描述：登录相
Linux中find常见用法示例 510888780 linux
Linux中find常见用法示例 ·find path -option [ -print ] [ -exec -ok command ] {} \; find命令的参数；
SpringMVC的各种参数绑定方式 Harry642 springMVC 绑定表单
1. 基本数据类型(以int为例，其他类似)： Controller代码： @RequestMapping("saysth.do") public void test(int count) { } 表单代码： <form action="saysth.do" method="post&q
Java 获取Oracle ROWID aijuans java oracle
A ROWID is an identification tag unique for each row of an Oracle Database table. The ROWID can be thought of as a virtual column, containing the ID for each row. The oracle.sql.ROWID class i
java获取方法的参数名 antlove java jdk parameter method reflect
reflect.ClassInformationUtil.java package reflect; import javassist.ClassPool; import javassist.CtClass; import javassist.CtMethod; import javassist.Modifier; import javassist.bytecode.CodeAtt
JAVA正则表达式匹配查找替换提取操作百合不是茶 java 正则表达式替换提取查找
正则表达式的查找;主要是用到String类中的split(); String str; str.split();方法中传入按照什么规则截取,返回一个String数组常见的截取规则: str.split("\\.")按照.来截取 str.
Java中equals()与hashCode()方法详解 bijian1013 java set equals()hashCode()
一.equals()方法详解 equals()方法在object类中定义如下： public boolean equals(Object obj) { return (this == obj); } 很明显是对两个对象的地址值进行的比较（即比较引用是否相同）。但是我们知道，String 、Math、I
精通Oracle10编程SQL(4)使用SQL语句 bijian1013 oracle 数据库 plsql
--工资级别表 create table SALGRADE ( GRADE NUMBER(10), LOSAL NUMBER(10,2), HISAL NUMBER(10,2) ) insert into SALGRADE values(1,0,100); insert into SALGRADE values(2,100,200); inser
【Nginx二】Nginx作为静态文件HTTP服务器 bit1129 HTTP服务器
Nginx作为静态文件HTTP服务器在本地系统中创建/data/www目录，存放html文件(包括index.html) 创建/data/images目录，存放imags图片在主配置文件中添加http指令 http { server { listen 80; server_name
kafka获得最新partition offset blackproof kafka partition offset 最新
kafka获得partition下标，需要用到kafka的simpleconsumer import java.util.ArrayList; import java.util.Collections; import java.util.Date; import java.util.HashMap; import java.util.List; import java.
centos 7安装docker两种方式 ronin47
第一种是采用yum 方式 yum install -y docker
java-60-在O(1)时间删除链表结点 bylijinnan java
public class DeleteNode_O1_Time { /** * Q 60 在O(1)时间删除链表结点 * 给定链表的头指针和一个结点指针(!!)，在O(1)时间删除该结点 * * Assume the list is: * head->...->nodeToDelete->mNode->nNode->..
nginx利用proxy_cache来缓存文件 cfyme cache
user zhangy users; worker_processes 10; error_log /var/vlogs/nginx_error.log crit; pid /var/vlogs/nginx.pid; #Specifies the value for ma
[JWFD开源工作流]JWFD嵌入式语法分析器负号的使用问题 comsci 嵌入式
假如我们需要用JWFD的语法分析模块定义一个带负号的方程式，直接在方程式之前添加负号是不正确的，而必须这样做： string str01 = "a=3.14;b=2.71;c=0;c-((a*a)+(b*b))" 定义一个0整数c,然后用这个整数c去
如何集成支付宝官方文档 dai_lm android
官方文档下载地址 https://b.alipay.com/order/productDetail.htm?productId=2012120700377310&tabId=4#ps-tabinfo-hash 集成的必要条件 1. 需要有自己的Server接收支付宝的消息 2. 需要先制作app，然后提交支付宝审核，通过后才能集成调试的时候估计会真的扣款，请注意
应该在什么时候使用Hadoop datamachine hadoop
原帖地址：http://blog.chinaunix.net/uid-301743-id-3925358.html 存档，某些观点与我不谋而合，过度技术化不可取，且hadoop并非万能。 --------------------------------------------万能的分割线-------------------------------- 有人问我，“你在大数据和Hado
在GridView中对于有外键的字段使用关联模型进行搜索和排序 dcj3sjt126com yii
在GridView中使用关联模型进行搜索和排序首先我们有两个模型它们直接有关联: class Author extends CActiveRecord { ... } class Post extends CActiveRecord { ... function relations() { return array( '
使用NSString 的格式化大全 dcj3sjt126com Objective-C
格式定义The format specifiers supported by the NSString formatting methods and CFString formatting functions follow the IEEE printf specification; the specifiers are summarized in Table 1. Note that you c
使用activeX插件对象object滚动有重影蕃薯耀 activeX插件滚动有重影
使用activeX插件对象object滚动有重影 <object style="width:0;" id="abc" classid="CLSID:D3E3970F-2927-9680-BBB4-5D0889909DF6" codebase="activex/OAX339.CAB#
SpringMVC4零配置 hanqunfeng springmvc4
基于Servlet3.0规范和SpringMVC4注解式配置方式，实现零xml配置，弄了个小demo，供交流讨论。项目说明如下： 1.db.sql是项目中用到的表，数据库使用的是oracle11g 2.该项目使用mvn进行管理，私服为自搭建nexus,项目只用到一个第三方 jar，就是oracle的驱动； 3.默认项目为零配置启动，如果需要更改启动方式，请
《开源框架那点事儿16》：缓存相关代码的演变 j2eetop 开源框架
问题引入上次我参与某个大型项目的优化工作，由于系统要求有比较高的TPS，因此就免不了要使用缓冲。该项目中用的缓冲比较多，有MemCache，有Redis，有的还需要提供二级缓冲，也就是说应用服务器这层也可以设置一些缓冲。当然去看相关实现代代码的时候，大致是下面的样子。 [java] view plain copy print ? public vo
AngularJS浅析 kvhur JavaScript
概念 AngularJS is a structural framework for dynamic web apps. 了解更多详情请见原文链接：http://www.gbtags.com/gb/share/5726.htm Directive 扩展html，给html添加声明语句，以便实现自己的需求。对于页面中html元素以ng为前缀的属性名称，ng是angular的命名空间
架构师之jdk的bug排查(一)---------------split的点号陷阱 nannan408 split
1.前言. jdk1.6的lang包的split方法是有bug的,它不能有效识别A.b.c这种类型,导致截取长度始终是0.而对于其他字符,则无此问题.不知道官方有没有修复这个bug. 2.代码 String[] paths = "object.object2.prop11".split("'"); System.ou
如何对10亿数据量级的mongoDB作高效的全表扫描 quentinXXZ mongodb
本文链接: http://quentinXXZ.iteye.com/blog/2149440 一、正常情况下，不应该有这种需求首先，大家应该有个概念，标题中的这个问题，在大多情况下是一个伪命题，不应该被提出来。要知道，对于一般较大数据量的数据库，全表查询，这种操作一般情况下是不应该出现的，在做正常查询的时候，如果是范围查询，你至少应该要加上limit。说一下，
C语言算法之水仙花数 qiufeihu c 算法
/** * 水仙花数 */ #include <stdio.h> #define N 10 int main() { int x,y,z; for(x=1;x<=N;x++) for(y=0;y<=N;y++) for(z=0;z<=N;z++) if(x*100+y*10+z == x*x*x
JSP指令 wyzuomumu jsp
jsp指令的一般语法格式： <%@ 指令名属性 =”值 ” %> 常用的三种指令： page,include,taglib page指令语法形式： <%@ page 属性 1=”值 1” 属性 2=”值 2”%> include指令语法形式： <%@include file=”relative url”%> (jsp可以通过 include