linux 系统中正则表达式的使用(linux ls 正则表达式)
lipiwang 2025-03-25 15:03 6 浏览 0 评论
正则表达式是通过正则表达式引擎(regular expression engine)实现的。在Linux中,有两种流行的正则表达式引擎:
POSIX基础正则表达式(basic regular expression,BRE)引擎----sed
POSIX扩展正则表达式(extended regular expression,ERE)引擎---gawk
# 匹配两个空格
echo "This is a test"|sed -n '/ /p'
This is a test
- 正则表达式识别的特殊字符包括:
.*[]^${}\+?|()
不能在文本模式中单独使用这些字符
echo 'The cost is $4.00'|sed -n '/\$/p'
The cost is $4.00
echo "3 / 2" | sed -n '/\//p'
3 / 2
- 锁定在行首(^)行尾($)
# 匹配无结果,不在起始位置
echo "The book store" | sed -n '/^book/p'
# 匹配有结果
echo "Books are great" | sed -n '/^Book/p'
Books are great
# 行尾匹配
echo "This is a good book" | sed -n '/book$/p'
# 查询出空白行
sed -n '/^$/p' data4.txt
# 删除空白行
sed '/^$/d' data4.txt
- 点号字符:代表一个特定的字符。包括空格
sed -n '/.at/p' data5
The cat is sleeping.
That is a very nice hat.
This test is at line four.
- 字符组:使用方括号来定义一个字符组
sed -n '/[ch]at/p' data5
The cat is sleeping.
That is a very nice hat.
# 大小写匹配
echo "yes" | sed -n '/[Yy]es/p'
# 多个字符组
echo "yEs" | sed -n '/[Yy][Ee][Ss]/p'
# 匹配数字
sed -n '/[0123]/p' data6
# 排除型字符组:只要在字符组的开头加个逃逸字符
sed -n '/[^ch]at/p' data5
This test is at line four.
# 末尾是5个数字的行
sed -n '/[0123456789][0-9][0-9][0-9][0-9]$/p ' data7
gawk --re-interval '/[0-9]{5}$/{print $0} ' data7
# 连续不间断的字符组
sed -n '/[a-ch-m]at/p' data5
# 如下匹配不到结果
echo "I'm getting too fat." | sed -n '/[a-ch-m]at/p'
- BRE特殊字符组
组 描 述
[[:alpha:]] 匹配任意字母字符,不管是大写还是小写
[[:alnum:]] 匹配任意字母数字字符0~9、A~Z或a~z
[[:blank:]] 匹配空格或制表符
[[:digit:]] 匹配0~9之间的数字
[[:lower:] 匹配小写字母字符a~z
[[:print:]] 匹配任意可打印字符
[[:punct:]] 匹配标点符号
[[:space:]] 匹配任意空白字符:空格、制表符、NL、FF、VT和CR
[[:upper:]] 匹配任意大写字母字符A~Z
# 匹配任意字符。
echo "abc" | sed -n '/[[:alpha:]]/p'
abc
# 匹配数字
echo "abc is 123" | sed -n '/[[:digit:]]/p'
abc is 123
- 星号 :前面的表达式出现了0次到多次
echo "btt" | sed -n '/b[ae]*t/p'
btt
- 问号:问号表明前面的字符可以出现0次或1次,但只限于此。
echo "bt" | gawk '/be?t/{print $0}'
bt
echo "bet" | gawk '/be?t/{print $0}'
bet
echo "beet" | gawk '/be?t/{print $0}' # 不能匹配到
echo "bet" | gawk '/b[ae]?t/{print $0}'
bet
- 加号:表明前面的字符可以出现1次或多次,但必须至少出现1次。如果该字符没有出现,那么模式就不会匹配
echo "beet" | gawk '/be+t/{print $0}'
beet
echo "bt" | gawk '/be+t/{print $0}' # 匹配不到
echo "bet" | gawk '/be+t/{print $0}'
bet
- 花括号允许你为可重复的正则表达式指定一个上限。这通常称为间隔(interval)。
可以用两种格式来指定区间。
m :正则表达式准确出现 m 次。
m, n :正则表达式至少出现 m 次,至多 n 次。
这个特性可以精确调整字符或字符集在模式中具体出现的次数。
echo "bet" | gawk --re-interval '/be{1}t/{print $0}'
bet
echo "beet" | gawk --re-interval '/be{1,2}t/{print $0}'
beet
- 管道符号:允许你在检查数据流时,用逻辑 OR 方式指定正则表达式引擎要用的两个或多个模式。如果任何一个模式匹配了数据流文本,文本就通过测试。如果没有模式匹配,则数据流文本匹配失败。
echo "The cat is asleep" | gawk '/cat|dog/{print $0}'
The cat is asleep
echo "He has a hat." | gawk '/[ch]at|dog/{print $0}'
He has a hat.
实战:统计环境变量目录下的文件个数
echo $PATH | sed 's/:/ /g'
#!/bin/bash
# count number of files in your PATH
mypath=$(echo $PATH | sed 's/:/ /g')
count=0
for directory in $mypath
do
check=$(ls $directory)
for item in $check
do
count=$[ $count + 1 ]
done
echo "$directory - $count"
count=0
done
- 其他
# 过滤电话号码
echo "317-555-1234"|gawk --re-interval '/^\(?[2-9][0-9]{2}\)?(| |-|\.)[0-9]{3}( |-|\.)[0-9]{4}$/{print $0}'
# 邮箱过滤
echo wangguowei@126.com|gawk --re-interval '/^([a-zA-Z0-9_\-\.\+]+)@([a-zA-Z0-9_\-\.]+)\.([a-zA-Z]{2,5})$/ {print $0}'
wangguowei@126.com
# 频繁上下线终端统计
awk '{a[$3]+=1;} END {for(i in a){print a[i]" "i;}}' wgw.test |sort -n -r |head -10
276 '583BD98E30F0'
276 '583BD98E2660'
276 '583BD98E2310'
相关推荐
- httpclient+jsoup实现小说线上采集阅读
-
前言 用过老版本UC看小说的同学都知道,当年版权问题比较松懈,我们可以再UC搜索不同来源的小说,并且阅读,那么它是怎么做的呢?下面让我们自己实现一个小说线上采集阅读。(说明:仅用于技术学习、研究) ...
- Python3+requests+unittest接口自动化测试实战
-
一、Requests介绍RequestsisanelegantandsimpleHTTPlibraryforPython,builtforhumanbeings.翻译过来就是...
- 授权码 + PKCE 模式|OIDC & OAuth2.0 认证协议最佳实践系列【03】
-
在上一篇文章中,我们介绍了OIDC授权码模式,本次我们将重点围绕授权码+PKCE模式(AuthorizationCodeWithPKCE)进行介绍,从而让你的系统快速具备接入用户认...
- JWT 在 Java Web 开发中的奇妙应用
-
JWT在JavaWeb开发中的奇妙应用在当今的互联网世界里,安全始终是一个绕不开的话题。而当我们谈论到Web应用的安全性时,认证和授权绝对是其中的核心部分。说到这,我忍不住要给大家讲个笑话...
- 动手操作:一个 OAuth 2 应用程序(2) - 配置 Keycloak 为授权服务器
-
接上一篇《动手操作:一个OAuth2应用程序(1)-应用程序场景》进行场景分析后,本篇就开始动手实现授权服务器。在本文中,我们将Keycloak配置为系统的授权服务器(图3)。...
- JSON Web Token是什么?
-
JSONWebToken(缩写JWT)是目前最流行的跨域认证解决方案。传统的session认证http协议本身是一种无状态的协议,而这就意味着如果用户向我们的应用提供了用户名和密码来进行用户认证...
- Keycloak Servlet Filter Adapter使用
-
KeycloakClientAdapters简介Keycloakclientadaptersarelibrariesthatmakeitveryeasytosecurea...
- 使用JWT生成token
-
一、使用JWT进行身份验证1、传统用户身份验证Internet服务无法与用户身份验证分开。一般过程如下:用户向服务器发送用户名和密码。验证服务器后,相关数据(如用户角色,登录时间等)将保存在当前会话中...
- 在word中通过VBA调用百度翻译API在线翻译
-
一天的时间,借助各种AI终于解决了这个问题:在word中通过VBA调用百度翻译API进行在线翻译。给我的word又添加了一项神技。先上代码:Sub宏5()''宏5宏Dimapp...
- API 安全之认证鉴权
-
作者:半天前言API作为企业的重要数字资源,在给企业带来巨大便利的同时也带来了新的安全问题,一旦被攻击可能导致数据泄漏重大安全问题,从而给企业的业务发展带来极大的安全风险。正是在这样的背景下,Ope...
- 用WordPress建站哪些插件会拖慢速度影响排名?
-
你是否发现网站加载总慢半拍,SEO排名死活上不去?八成是插件惹的祸!80%的站长不知道,WordPress插件用错类型或配置不当,分分钟让网站速度暴跌,爬虫抓取效率直接砍半。缓存插件没装对,越用越卡你...
- JavaScript报错了?不要慌!怎么看怎么处理都在这里
-
在开发中,有时,我们花了几个小时写的JS代码,在游览器调试一看,控制台一堆红,瞬间一万头草泥马奔腾而来。至此,本文主要记录JS常见的一些报错类型,以及常见的报错信息,分析其报错原因,并给予处理...
-
- 跨站脚本攻击(四)
-
04XSS漏洞挖掘技巧4.1常见的绕过姿势实际应用中web程序往往会通过一些过滤规则来阻止带有恶意代码的用户输入被显示,但由于HTML语言的松散性和各种标签的不同优先级,使得我们绕过过滤规则成为了可能。4.1.1利用大小写绕过HTML标签...
-
2025-05-24 15:21 lipiwang
- WAF-Bypass之SQL注入绕过思路总结
-
过WAF(针对云WAF)寻找真实IP(源站)绕过如果流量都没有经过WAF,WAF当然无法拦截攻击请求。当前多数云WAF架构,例如百度云加速、阿里云盾等,通过更改DNS解析,把流量引入WAF集群,流量经...
- Springboot之登录模块探索(含Token,验证码,网络安全等知识)
-
简介登录模块很简单,前端发送账号密码的表单,后端接收验证后即可~淦!可是我想多了,于是有了以下几个问题(里面还包含网络安全问题):1.登录时的验证码2.自动登录的实现3.怎么维护前后端登录状态在这和大...
你 发表评论:
欢迎- 一周热门
- 最近发表
- 标签列表
-
- maven镜像 (69)
- undefined reference to (60)
- zip格式 (63)
- oracle over (62)
- date_format函数用法 (67)
- 在线代理服务器 (60)
- shell 字符串比较 (74)
- x509证书 (61)
- localhost (65)
- java.awt.headless (66)
- syn_sent (64)
- settings.xml (59)
- 弹出窗口 (56)
- applicationcontextaware (72)
- my.cnf (73)
- httpsession (62)
- pkcs7 (62)
- session cookie (63)
- java 生成uuid (58)
- could not initialize class (58)
- beanpropertyrowmapper (58)
- word空格下划线不显示 (73)
- jar文件 (60)
- jsp内置对象 (58)
- makefile编写规则 (58)