zoukankan      html  css  js  c++  java
  • grep文本搜索工具详解

    ############grep命令############
    这个命令属于文本处理三大命令之一,强大的文本搜索工具(贪婪模式)
    全面搜索正则表达式并把行打印出来)是一种强大的文本搜索工具,它能使用正则表达式搜索文本,并把匹配的行打印出来。
    用于过滤/搜索的特定字符。可使用正则表达式能多种命令配合使用,使用上十分灵活

    语法:
    grep [options] PATTERN [FILE...]

    选项:
    -a --text # 不要忽略二进制数据。
    -A <显示行数> --after-context=<显示行数> # 除了显示符合范本样式的那一行之外,并显示该行之后的内容。
    -b --byte-offset # 在显示符合范本样式的那一行之外,并显示该行之前的内容。
    -B<显示行数> --before-context=<显示行数> # 除了显示符合样式的那一行之外,并显示该行之前的内容。
    -c --count # 计算符合范本样式的列数。
    -C<显示行数> --context=<显示行数>或-<显示行数> # 除了显示符合范本样式的那一列之外,并显示该列之前后的内容。
    -d<进行动作> --directories=<动作> # 当指定要查找的是目录而非文件时,必须使用这项参数,否则grep命令将回报信息并停止动作。
    -e<范本样式> --regexp=<范本样式> # 指定字符串作为查找文件内容的范本样式。
    -E --extended-regexp # 将范本样式为延伸的普通表示法来使用,意味着使用能使用扩展正则表达式。
    -f<范本文件> --file=<规则文件> # 指定范本文件,其内容有一个或多个范本样式,让grep查找符合范本条件的文件内容,格式为每一列的范本样式。
    -F --fixed-regexp # 将范本样式视为固定字符串的列表。
    -G --basic-regexp # 将范本样式视为普通的表示法来使用。
    -h --no-filename # 在显示符合范本样式的那一列之前,不标示该列所属的文件名称。
    -H --with-filename # 在显示符合范本样式的那一列之前,标示该列的文件名称。
    -i --ignore-case # 忽略字符大小写的差别。
    -l --file-with-matches # 列出文件内容符合指定的范本样式的文件名称。
    -L --files-without-match # 列出文件内容不符合指定的范本样式的文件名称。
    -n --line-number # 在显示符合范本样式的那一列之前,标示出该列的编号。
    -q --quiet或--silent # 不显示任何信息。
    -R/-r --recursive # 此参数的效果和指定“-d recurse”参数相同。
    -s --no-messages # 不显示错误信息。
    -v --revert-match # 反转查找。
    -V --version # 显示版本信息。
    -w --word-regexp # 只显示全字符合的列。
    -x --line-regexp # 只显示全列符合的列。
    -y # 此参数效果跟“-i”相同。
    -o # 只输出文件中匹配到的部分。
    -m <num> --max-count=<num> # 找到num行结果后停止查找,用来限制匹配行数
    规则表达式
    ^ # 锚定行的开始 如:'^grep'匹配所有以grep开头的行。
    $ # 锚定行的结束 如:'grep$' 匹配所有以grep结尾的行。
    . # 匹配一个非换行符的字符 如:'gr.p'匹配gr后接一个任意字符,然后是p。
    * # 匹配零个或多个先前字符 如:'*grep'匹配所有一个或多个空格后紧跟grep的行。
    .* # 一起用代表任意字符。
    [] # 匹配一个指定范围内的字符,如'[Gg]rep'匹配Grep和grep。
    [^] # 匹配一个不在指定范围内的字符,如:'[^A-FH-Z]rep'匹配不包含A-R和T-Z的一个字母开头,紧跟rep的行。
    (..) # 标记匹配字符,如'(love)',love被标记为1。
    < # 锚定单词的开始,如:'<grep'匹配包含以grep开头的单词的行。
    > # 锚定单词的结束,如'grep>'匹配包含以grep结尾的单词的行。
    x{m} # 重复字符x,m次,如:'0{5}'匹配包含5个o的行。
    x{m,} # 重复字符x,至少m次,如:'o{5,}'匹配至少有5个o的行。
    x{m,n} # 重复字符x,至少m次,不多于n次,如:'o{5,10}'匹配5--10个o的行。
    w # 匹配文字和数字字符,也就是[A-Za-z0-9],如:'Gw*p'匹配以G后跟零个或多个文字或数字字符,然后是p。
    W # w的反置形式,匹配一个或多个非单词字符,如点号句号等。
     # 单词锁定符,如: 'grep'只匹配grep。

    字符集合:[:digit:], [:lower:], [:upper:], [:punct:], [:space:], [:alpha:], [:alnum:]

    grep常用组合:

    ##查看配置文件,去掉注释行和空行
    cat file | grep -v ^# | grep -v '^$'

    ##查看匹配到的前后行
    grep 'search_string' -A 1 file #表示从file文件中搜索search_string关键字,并显示当前行和后面一行
    grep 'search_string' -B 1 file #表示从file文件中搜索search_string关键字,并显示当前行和前面一行
    grep 'search_string' -C 1 file #表示从file文件中搜索search_string关键字,并显示当前行和前后各一行

    ##精确搜索
    grep -w good file #表示从file中搜索good关键字,且good是独立的,比如goods就不能匹配
    grep '<good>' file #同上
    grep '<good' file #表示从file中搜索good开头的字符串,good,goods都可以匹配,agood就不行
    grep 'good>' file #与上相反

    ##从多个文件中搜索是否有匹配的关键字
    grep "match_pattern" file_1 file_2 file_3 ...

    ##找出符合匹配模式的文件
    grep -l "match_pattern" file_1 file_2 file_3 ... #从列出文件中搜索
    grep -l "match_pattern" -r directory #表示从文件夹下的所有文件搜索

    弄个有意思的
    假如文本file中的内容如下:
    He love his lover.
    She like her liker.
    He like his lover.
    怎么匹配出第一行和第二行呢?特点:.*love.*love .*like.*like.* ,就像需求是要求每一行有相同的字符串
    [hive@mcpl046 lgh]$ grep '.*([a-z]{4}).*1.*' file
    He love his lover.
    She like her liker.

    ##输出行号和偏移量(从第一个字符开始)
    echo -e "b gun is not unix" | grep -n -b -o "not"

    [hive@mcpl046 lgh]$ echo -e "b gun is not unix" | grep -n -b -o "not"
    2:9:not

    ##忽略大小写和设置颜色
    grep -i "search_string" --color file

    ##计数
    grep -c -w "search_string" file #统计file中有多少个"search_string"

    ##匹配多个模式
    grep -e "a" -e "b" file #从file中匹配所有包含a或者b的行

    ##设置匹配次数
    grep -m 2 "good" file #表示匹配good两次之后就不在继续匹配了

  • 相关阅读:
    控制TABLE的一些属性
    windows7中各个dll文件作用和用途
    left join on and与left join on where的区别
    号外,left join比连表语句快80倍
    JS跳转语句
    [jQuery,Dojo,MooTools]
    CYQ.Data 数据框架 V3.5 开源版本发布(源码提供下载)
    Scala开发小小总结
    性能测试工具原理与架构
    joomla1.5模块开发和插件开发详解带实例
  • 原文地址:https://www.cnblogs.com/zsql/p/11139417.html
Copyright © 2011-2022 走看看