一天一个shell命令 linux文本内容操作系列-grep命令详解

更新时间：2016年06月05日 16:43:17 投稿：mdxy-dxy

这篇文章主要介绍了一天一个shell命令 linux文本内容操作系列-grep命令详解 ,需要的朋友可以参考下

脚本之家 / 编程助手：解决程序员“几乎”所有问题！
脚本之家官方知识库 → 点击立即使用

从这篇开始，是文本内容操作，区别于文本操作。

Linux系统中grep命令是一种强大的文本搜索工具，它能使用正则表达式搜索文本，并把匹配的行打印出来。grep全称是Global Regular Expression Print，表示全局正则表达式版本，它的使用权限是所有用户。

shell，perl,python，一直都是文本操作的专家语言，而我们今后学习的的将是shell的噱头--文本操作。下面提到最常见的一个：

grep

这算是文本内容的一个重量级选手，能根据某些规格在上千行的文本文件中查找所需要的数据。他能接受正则表达式和通配符。

础实例：

1. 命令翻译包含给定match_pattern的文本行，如我在grep.txt中查找PATTERN

grep PATTERN grep.txt

or grep "PATTERN" grep.txt

2. 匹配多个文件

grep PATTERN grep.txt grep1.txt

3. 从stdin中读取

echo –e "this is a word\nnext line" | grep word

打印：this is a word

4. grep 与正则表达式

grep –E "[a-z]+"

或者

egrep "[a-z]+"

5. 只输出匹配部分，而不是匹配的当前行

echo this is line. | greip –o –E "[a-z]+\."

输出：line

6. 打印除包含match_pattern的行之外的所有行，可使用

grep -v match_pattern file

7. 统计文本或者文件中包含匹配字符串的字数（这个面试经常会问到）

$grep -c "text" filename

但他给出的是匹配行的次数，而不是匹配的次数

统计匹配数量的话，可以用到下面的技巧

$echo –e "1 2 3 4\nhello\n5 6"| egrep -o "[0-9]" | wc –l

打印1到6 | 从stdin中读取数字，分行打印 | 统计行数

8. 打印行号

grep "text" -n filename

9. 搜2个文件，以及他们的行号，输出会打印文件名

grep "text"–n s1.txt s2.txt

10.如果你只想知道哪些文件有单词PATTERN

grep –l PATTER s1.txt s2.txt

-L则返回的不匹配文件列表

11.可以再整个目录下查找单词PATTERN 在那些文件里

grep PATTERN . -R -n

12 同时多个匹配查找

echo this is a line of text | grep -e "this" -e "line" -o

打印:

this

line

13 只在某些合适的文件中搜索

grep "main()" .-r --include *.{c,cpp}

只在.c 和.cpp结尾的文件中搜索 main()

14 进行搜索排除某些文件

grep "main()" . -r --exclude "README"

排除了所有文件名为"README"的文件

15 打印匹配之前或之后的3行

seq 10 | grep 5 –A 3 之前

seq 10 | grep 6 –B 3 之后

16 打印匹配前后3行，同时输出

seq 10 | grep 5 –C 3

我们来看下--help

复制代码代码如下:

用法: grep [选项]... PATTERN [FILE]...

在每个 FILE 或是标准输入中查找 PATTERN。

默认的 PATTERN 是一个基本正则表达式(缩写为 BRE)。

例如: grep -i 'hello world' menu.h main.c

正则表达式选择与解释:

  -E, --extended-regexp     PATTERN 是一个可扩展的正则表达式(缩写为 ERE)

  -F, --fixed-strings       PATTERN 是一组由断行符分隔的定长字符串。

  -G, --basic-regexp        PATTERN 是一个基本正则表达式(缩写为 BRE)

  -P, --perl-regexp         PATTERN 是一个 Perl 正则表达式

  -e, --regexp=PATTERN      用 PATTERN 来进行匹配操作

  -f, --file=FILE           从 FILE 中取得 PATTERN

  -i, --ignore-case         忽略大小写

  -w, --word-regexp         强制 PATTERN 仅完全匹配字词

  -x, --line-regexp         强制 PATTERN 仅完全匹配一行

  -z, --null-data           一个 0 字节的数据行，但不是空行

杂项:

  -s, --no-messages         不显示错误信息

  -v, --invert-match        选中不匹配的行

  -V, --version             显示版本信息并退出

      --help                显示此帮助并退出

      --mmap                忽略向后兼容性

Output control:

  -m, --max-count=NUM       stop after NUM matches

  -b, --byte-offset         print the byte offset with output lines

  -n, --line-number         print line number with output lines

      --line-buffered       flush output on every line

  -H, --with-filename       print the file name for each match

  -h, --no-filename         suppress the file name prefix on output

      --label=LABEL         use LABEL as the standard input file name prefix

  -o, --only-matching       只显示一行中匹配PATTERN 的部分

  -q, --quiet, --silent     不显示所有输出

      --binary-files=TYPE   假定二进制文件的TYPE 类型；

                            TYPE 可以是`binary', `text', 或`without-match'

  -a, --text                等同于 --binary-files=text

  -I                        等同于 --binary-files=without-match

  -d, --directories=ACTION  操作目录的方式；

                            ACTION 可以是`read', `recurse',或`skip'

  -D, --devices=ACTION      操作设备、先入先出队列、套接字的方式；

                            ACTION 可以是`read'或`skip'

  -R, -r, --recursive       等同于 --directories=recurse

      --include=FILE_PATTERN  只查找匹配FILE_PATTERN 的文件

      --exclude=FILE_PATTERN  跳过匹配FILE_PATTERN 的文件和目录

      --exclude-from=FILE   跳过所有除FILE 以外的文件

      --exclude-dir=PATTERN  跳过所有匹配PATTERN 的目录。

  -L, --files-without-match  只打印不匹配FILEs 的文件名

  -l, --files-with-matches  只打印匹配FILES 的文件名

  -c, --count               只打印每个FILE 中的匹配行数目

  -T, --initial-tab         行首tabs 分隔（如有必要）

  -Z, --null                在FILE 文件最后打印空字符

文件控制:

  -B, --before-context=NUM  打印以文本起始的NUM 行

  -A, --after-context=NUM   打印以文本结尾的NUM 行

  -C, --context=NUM         打印输出文本NUM 行

  -NUM                      等同于 --context=NUM

      --color[=WHEN],

      --colour[=WHEN]       使用标志高亮匹配字串；

                            WHEN 可以是`always', `never'或`auto'

  -U, --binary              不要清除行尾的CR 字符(MSDOS 模式)

  -u, --unix-byte-offsets   当CR 字符不存在，报告字节偏移(MSDOS 模式)

‘egrep'即‘grep -E'。‘fgrep'即‘grep -F'。

直接使用‘egrep'或是‘fgrep'均已不可行了。

不带 FILE 参数，或是 FILE 为 -，将读取标准输入。如果少于两个 FILE 参数

就要默认使用 -h 参数。如果选中任意一行，那退出状态为 0，否则为 1；

如果有错误产生，且未指定 -q 参数，那退出状态为 2。

大多数功能已经在实例中贴出，我的这个博文中，主要参考书籍《linux shell脚本攻略》

如果你觉得更是个学习时间比较充裕，不妨直接购买此书。

您可能感兴趣的文章:

微信公众号搜索 “ 脚本之家 ” ，选择关注

程序猿的那些事、送书等活动等着你

linux
grep

linux定时任务crontab 实现每秒执行一次的方法
linux crontab 命令，最小的执行时间是一分钟。这篇文章主要介绍了linux定时任务crontab 实现每秒执行一次的方法,需要的朋友可以参考下
2018-03-03
awk基础知识小结
awk基础知识小结，方便学习awk的朋友
2013-02-02
Linux下查看内存使用情况的方法总结
在做Linux系统优化的时候,物理内存是其中最重要的一方面,自然的,Linux也提供了非常多的方法来监控宝贵的内存资源的使用情况,下面的清单详细的列出了Linux系统下通过视图工具或命令行来查看内存使用情况的各种方法,需要的朋友可以参考下
2024-01-01
Shell脚本实现在Linux系统中自动安装JDK
这篇文章主要介绍了Shell脚本实现在Linux系统中自动安装JDK,本文直接给出实现代码,需要的朋友可以参考下
2015-01-01
Linux 中常用的sed命令
sed是一种流编辑器，它是文本处理中非常中的工具，能够完美的配合正则表达式使用，功能不同凡响。接下来通过本文给大家介绍Linux 中常用的sed命令，感兴趣的朋友一起看看吧
2017-09-09
shell脚本读取命令行参数的实现
本文主要介绍了shell脚本读取命令行参数的实现，文中通过示例代码介绍的非常详细，对大家的学习或者工作具有一定的参考学习价值，需要的朋友们下面随着小编来一起学习学习吧
2021-07-07
shell脚本源码安装nginx的详细过程
这篇文章主要介绍了shell脚本源码安装nginx,本文给大家介绍的非常详细，对大家的学习或工作具有一定的参考借鉴价值，需要的朋友可以参考下
2021-10-10
shell脚本实现定时检查应用状态步骤
这篇文章主要为大家介绍了shell脚本实现定时检查应用状态步骤详解,有需要的朋友可以借鉴参考下,希望能够有所帮助,祝大家多多进步,早日升职加薪
2023-08-08
Linux 查看端口的占用情况并找出并杀死占用进程的方法
这篇文章主要介绍了Linux 查看端口的占用情况并找出并杀死占用进程的方法，本文给大家介绍的非常详细，具有一定的参考借鉴价值 ,需要的朋友可以参考下
2019-08-08
shell 字符串操作(长度，查找，替换)详解
在做shell批处理程序时候，经常会涉及到字符串相关操作。有很多命令语句，如：awk,sed都可以做字符串各种操作。其实shell内置一系列操作符号，可以达到类似效果，大家知道，使用内部操作符会省略启动外部程序等时间，因此速度会非常的快
2012-09-09

一天一个shell命令 linux文本内容操作系列-grep命令详解

相关文章

最新评论

大家感兴趣的内容

最近更新的内容

在线工具

高防CDN

万恒网络

常用在线小工具