设为首页 收藏本站
查看: 451|回复: 0

[经验分享] Linux_grep总结2_正则表达式

[复制链接]

尚未签到

发表于 2016-2-24 15:14:01 | 显示全部楼层 |阅读模式
  Tip:
  请把下面的内容作为参考,而不是标准和绝对。
  例如,我此时使用的redhat3的man grep中有这么一小段,或许可以让你看出,不同的OS版本实现上或默认设置上有些差异[确实很不舒服]
  Within a bracket expression, a range expression consists of two charac-
       ters separated by a hyphen.  It matches any single character that sorts
       between  the  two  characters,  inclusive, using the locale’s collating
       sequence and character set.  For example,  in  the  default  C  locale,
       [a-d] is equivalent to [abcd].  Many locales sort characters in dictio-
       nary order, and in these locales [a-d] is typically not  equivalent  to
       [abcd];  it  might  be equivalent to [aBbCcDd], for example.  To obtain
       the traditional interpretation of bracket expressions, you can use  the
       C locale by setting the LC_ALL environment variable to the value C.
  
    http://soft.zdnet.com.cn/software_zone/2007/1014/553088.shtml 稍稍改动
  1. grep简介
  
  grep (global search regular expression(RE) and print out theline,全面搜索正则表达式并把行打印出来)是一种强大的文本搜索工具,它能使用正则表达式搜索文本,并把匹配的行打印出来。Unix的grep家族包括grep、egrep和fgrep。egrep和fgrep的命令只跟grep有很小不同。egrep是grep的扩展,支持更多的re元字符, fgrep就是fixed grep或fast grep,它们把所有的字母都看作单词,也就是说,正则表达式中的元字符表示回其自身的字面意义,不再特殊。Linux使用GNU版本的grep。它功能更强,可以通过-G、-E、-F命令行选项来使用egrep和fgrep的功能。
  grep的工作方式是这样的,它在一个或多个文件中搜索字符串模板。如果模板包括空格,则必须被引用,模板后的所有字符串被看作文件名。搜索的结果被送到屏幕,不影响原文件内容。
  grep可用于shell脚本,因为grep通过返回一个状态值来说明搜索的状态,如果模板搜索成功,则返回0,如果搜索不成功,则返回1,如果搜索的文件不存在,则返回2。我们利用这些返回值就可进行一些自动化的文本处理工作。
  
  2. grep正则表达式元字符集(基本集)
  ^
  锚定行的开始 如:'^grep'匹配所有以grep开头的行。
  $
  锚定行的结束 如:'grep$'匹配所有以grep结尾的行。
  匹配一个非换行符的字符 如:'gr.p'匹配gr后接一个任意字符,然后是p。
  *
  匹配零个或多个先前字符 如:'*grep'匹配所有一个或多个空格后紧跟grep的行。 .*一起用代表任意字符。
  []
  匹配一个指定范围内的字符,如'[Gg]rep'匹配Grep和grep。
  [^]
  匹配一个不在指定范围内的字符,如:'[^A-FH-Z]rep'匹配不包含A-R和T-Z的一个字母开头,紧跟rep的行。
  (..)
  标记匹配字符,如'(love)',love被标记为1。
  <
  锚定单词的开始,如:'
  >
  锚定单词的结束,如'grep>'匹配包含以grep结尾的单词的行。
  x
  重复字符x,m次,如:'0'匹配包含5个o的行。
  x
  重复字符x,至少m次,如:'o'匹配至少有5个o的行。
  x
  重复字符x,至少m次,不多于n次,如:'o'匹配5--10个o的行。
  w
  匹配文字和数字字符,也就是[A-Za-z0-9],如:'Gw*p'匹配以G后跟零个或多个文字或数字字符,然后是p。
  W
  w的反置形式,匹配一个或多个非单词字符,如点号句号等。
  b
  单词锁定符,如: 'bgrepb'只匹配grep。
  3. 用于egrep和 grep -E的元字符扩展集
  +
  匹配一个或多个先前的字符。如:'[a-z]+able',匹配一个或多个小写字母后跟able的串,如loveable,enable,disable等。
  ?
  匹配零个或多个先前的字符。如:'gr?p'匹配gr后跟一个或没有字符,然后是p的行。
  a|b|c
  匹配a或b或c。如:grep|sed匹配grep或sed
  ()
  分组符号,如:love(able|rs)ov+匹配loveable或lovers,匹配一个或多个ov。
  x,x,x
  作用同x,x,x
  4. POSIX字符类
  为了在不同国家的字符编码中保持一至,POSIX(The Portable Operating SystemInterface)增加了特殊的字符类,如[:alnum:]是A-Za-z0-9的另一个写法。要把它们放到[]号内才能成为正则表达式,如[A-Za-z0-9]或[[:alnum:]]。在Linux下的grep除fgrep外,都支持POSIX的字符类。
  [:alnum:]
  文字数字字符
  [:alpha:]
  文字字符
  [:digit:]
  数字字符
  [:graph:]
  非空字符(非空格、控制字符)
  [:lower:]
  小写字符
  [:cntrl:]
  控制字符
  [:print:]
  非空字符(包括空格)
  [:punct:]
  标点符号
  [:space:]
  所有空白字符(新行,空格,制表符)
  [:upper:]
  大写字符
  [:xdigit:]
  十六进制数字(0-9,a-f,A-F)
  5. Grep命令选项
  -?
  同时显示匹配行上下的?行,如:grep -2 pattern filename同时显示匹配行的上下2行。
  -b,--byte-offset
  打印匹配行前面打印该行所在的块号码。
  -c,--count
  只打印匹配的行数,不显示匹配的内容。
  -f File,--file=File
  从文件中提取模板。空文件中包含0个模板,所以什么都不匹配。
  -h,--no-filename
  当搜索多个文件时,不显示匹配文件名前缀。
  -i,--ignore-case
  忽略大小写差别。
  -q,--quiet
  取消显示,只返回退出状态。0则表示找到了匹配的行。
  -l,--files-with-matches
  打印匹配模板的文件清单。
  -L,--files-without-match
  打印不匹配模板的文件清单。
  -n,--line-number
  在匹配的行前面打印行号。
  -s,--silent
  不显示关于不存在或者无法读取文件的错误信息。
  -v,--revert-match
  反检索,只显示不匹配的行。
  -w,--word-regexp
  如果被<和>引用,就把表达式做为一个单词搜索。
  -V,--version
  显示软件版本信息。
  6. 实例
  要用好grep这个工具,其实就是要写好正则表达式,所以这里不对grep的所有功能进行实例讲解,只列几个例子,讲解一个正则表达式的写法。
  $ ls -l | grep '^a'
  通过管道过滤ls -l输出的内容,只显示以a开头的行。
  $ grep 'test' d*
  显示所有以d开头的文件中包含test的行。
  $ grep 'test' aa bb cc
  显示在aa,bb,cc文件中匹配test的行。
  $ grep '[a-z]\{5\}' aa.txt
  显示所有包含每个字符串至少有5个连续小写字符的字符串的行。
  $ grep 'w(es)t.*' aa
  如果west被匹配,则es就被存储到内存中,并标记为1,然后搜索任意个字符(.*),这些字符后面紧跟着另外一个es(),找到就显示该行。如果用egrep或grep -E,就不用""号进行转义,直接写成'w(es)t.*'就可以了。

运维网声明 1、欢迎大家加入本站运维交流群:群②:261659950 群⑤:202807635 群⑦870801961 群⑧679858003
2、本站所有主题由该帖子作者发表,该帖子作者与运维网享有帖子相关版权
3、所有作品的著作权均归原作者享有,请您和我们一样尊重他人的著作权等合法权益。如果您对作品感到满意,请购买正版
4、禁止制作、复制、发布和传播具有反动、淫秽、色情、暴力、凶杀等内容的信息,一经发现立即删除。若您因此触犯法律,一切后果自负,我们对此不承担任何责任
5、所有资源均系网友上传或者通过网络收集,我们仅提供一个展示、介绍、观摩学习的平台,我们不对其内容的准确性、可靠性、正当性、安全性、合法性等负责,亦不承担任何法律责任
6、所有作品仅供您个人学习、研究或欣赏,不得用于商业或者其他用途,否则,一切后果均由您自己承担,我们对此不承担任何法律责任
7、如涉及侵犯版权等问题,请您及时通知我们,我们将立即采取措施予以解决
8、联系人Email:admin@iyunv.com 网址:www.yunweiku.com

所有资源均系网友上传或者通过网络收集,我们仅提供一个展示、介绍、观摩学习的平台,我们不对其承担任何法律责任,如涉及侵犯版权等问题,请您及时通知我们,我们将立即处理,联系人Email:kefu@iyunv.com,QQ:1061981298 本贴地址:https://www.yunweiku.com/thread-182316-1-1.html 上篇帖子: Linux中脚本文件的自动执行 下篇帖子: 转:两条Linux命令彻底杀死Oracle
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

扫码加入运维网微信交流群X

扫码加入运维网微信交流群

扫描二维码加入运维网微信交流群,最新一手资源尽在官方微信交流群!快快加入我们吧...

扫描微信二维码查看详情

客服E-mail:kefu@iyunv.com 客服QQ:1061981298


QQ群⑦:运维网交流群⑦ QQ群⑧:运维网交流群⑧ k8s群:运维网kubernetes交流群


提醒:禁止发布任何违反国家法律、法规的言论与图片等内容;本站内容均来自个人观点与网络等信息,非本站认同之观点.


本站大部分资源是网友从网上搜集分享而来,其版权均归原作者及其网站所有,我们尊重他人的合法权益,如有内容侵犯您的合法权益,请及时与我们联系进行核实删除!



合作伙伴: 青云cloud

快速回复 返回顶部 返回列表