Linux-文本处理三剑客:grep、sed-和-awk

news2024/9/20 15:05:22

awk、grep、sed是linux操作文本的三大利器,合称文本三剑客,也是必须掌握的linux命令之一。三者的功能都是处理文本,但侧重点各不相同,其中属awk功能最强大,但也最复杂。grep更适合单纯的查找或匹配文本,sed更适合编辑匹配到的文本,awk更适合格式化文本,对文本进行较复杂格式处理。

grep

Linux 系统中 grep 命令是一种强大的文本搜索工具,它能使用正则表达式搜索文本,并把匹配的行打印出来。grep全称是 Global Regular Expression Print,表示全局正则表达式版本,它的使用权限是所有用户。

grep可用于shell脚本,因为grep通过返回一个状态值来说明搜索的状态,如果模板搜索成功,则返回0,如果搜索不成功,则返回1,如果搜索的文件不存在,则返回2。我们利用这些返回值就可进行一些自动化的文本处理工作。

命令的基本格式:

grep [option] pattern file

grep 常用的参数如下:

  • -A<行数 x>:除了显示符合范本样式的那一列之外,并显示该行之后的 x 行内容,A其实是after意思。
  • -B<行数 x>:除了显示符合样式的那一行之外,并显示该行之前的 x 行内容,B的意思before。
  • -C<行数 x>:除了显示符合样式的那一行之外,并显示该行之前后的 x 行内容,C是啥意思我不懂,哈哈。
  • -c:小写的c就是统计匹配的行数,c的意思count的意思。
  • -e:实现多个选项间的逻辑or 关系。
  • -E: 扩展的正则表达式。
  • -f 文件名:从文件获取 PATTERN 匹配。
  • -F :相当于fgrep,直接输入固定匹配,就是不会模糊匹配
  • -i :–ignore-case 忽略字符大小写的差别。
  • -n:显示匹配的行号。
  • -o:仅显示匹配到的字符串。
  • -q: 静默模式,不输出任何信息。
  • -s:不显示错误信息。
  • -v:显示不被 pattern 匹配到的行,相当于[^] 反向匹配
  • -w :匹配 整个单词

前三个 A、B、C 参数很容易理解,举个栗子,假设我们有一个文件,文件名是 test.log,内容是从 1 到 9,每个数字一行:
image.png

ps:搜索http-nio-8089-exec-13线程,显示匹配成功后两行。
image.png
ps:匹配http-nio-8089-exec-13到线程,匹配成功后,前10行显示。

我们再用C的参数查询看看
image.png
ps:如我们所料,匹配成功后,显示前后5行。

然后我们再来看看-c写的情况,就是匹配的行,比如我们相差一个tomcat的有多线程,我们可以用grep -c Thread test.log,如图
image.png

grep -e命令是实现多个匹配之间的或关系,我们可以同时查询线程13,或者14
如图
image.png
我们继续延时-F,匹配固定的字符串
image.png
上面没有http**的字符串

grep -f 文件名的使用方法是把后面这个文件里的内容当做pattern。就是我们把需要匹配的内容在文件里面而已,如下图
image.png
grep -i --ignore-case作用是忽略大小写。

grep -n显示匹配的行号,就是多显示了个行号,不用细说。
如图,
image.png
我们来说说-o的参数,他只会输入匹配到字符串,不会输出整行的内容,如图
image.png
这里-v就很有意思,你们有没有遇到很这样的需求,一个配置文件很多注释,怎么样输出过来掉注释呢。-v会帮到我们如图所示:
image.png

grep -w匹配整个单词,只有完全符合pattern的单次才会匹配到
image.png

sed

sed 命令的作用是利用脚本来处理文本文件。使用方法:

sed [-hnV][-e<script>][-f<script文件>][文本文件]

参数说明:

  • -e

动作说明:

  • a:新增, a 的后面可以接字串,而这些字串会在新的一行出现(目前的下一行)~
  • c:取代, c 的后面可以接字串,这些字串可以取代 n1,n2 之间的行!
  • d:删除,因为是删除啊,所以 d 后面通常不接任何咚咚;
  • i:插入, i 的后面可以接字串,而这些字串会在新的一行出现(目前的上一行);
  • p:打印,亦即将某个选择的数据印出。通常 p 会与参数 sed -n 一起运行~
  • s:取代,通常这个 s 的动作可以搭配正规表示法,例如 1,20s/old/new/g 。

下面我们举例说明
添加a或者i
我们来说说a,a的前面如果接数字,意思是新增到多少行的下面,a的后面是加"\添加的内容"如图
image.png
但是注意,这个只是将文字处理了,没有写入到文件里,文件里还是之前的内容。

如果a的前面是字符串,那就是做匹配用的用如图
image.png

参数i和a用法差不多,这里不做赘述

删除d
删除的字符是d,用法跟前面也很相似,就不赘述,例子如下:
image.png

替换c
替换也是一样,字符是c。举个栗子:

image.png
匹配到aaaa之后,替换成了bbbbb

替换还有个字符是 s,但是用法由不太一样了,最常见的用法:sed 's/old/new/g’其中old代表想要匹配的字符,new是想要替换的字符,比如:
image.png
g前还可以跟一个数字,数字代表一行中出现第几个,比较一行字不止一个字符串能匹配到
ps: 直接写那个命令是不会更改源文件的,需要加上一个-i的参数,比如:sed -i ‘s/1.0.0.6/1.0.0.7/’ /root/data/code-s3201/publish_codex/deploy/db.properties

awk

awk是一个强大的文本分析工具,相对于grep的查找,sed的编辑,awk在其对数据分析并生成报告时,显得尤为强大。简单来说awk就是把文件逐行的读入,以空格为默认分隔符将每行切片,切开的部分再进行各种分析处理。
语法

awk [选项参数] 'script' var=value file(s)
或
awk [选项参数] -f scriptfile var=value file(s)

参数说明:

  • -F fs or --field-separator fs 指定输入文件折分隔符,fs是一个字符串或者是一个正则表达式,如-F:。
  • -v var=value or --asign var=value 赋值一个用户定义变量。
  • -f scripfile or --file scriptfile 从脚本文件中读取awk命令。

基本用法
最基本的用法是awk 动作 文件名。
然后输入awk '{print $1,$4}' test就可以看到:
image.png

对比可以很清楚的发现,这行语句的作用是打印每行的第一个和第四个单词。这里如果是$0的话就是把整行都输出出来。

awk -F命令可以指定使用哪个分隔符,默认是空格或者 tab 键:

image.png

变量
awk中有不少内置的变量,比如$NF代表的是分割后的字段数量,相当于取最后一个。
image.png
可以看出都是每行的最后一项。

其他的内置变量还有,这里就不一一演示了:

  • FILENAME:当前文件名
  • FS:字段分隔符,默认是空格和制表符。
  • RS:行分隔符,用于分割每一行,默认是换行符。
  • OFS:输出字段的分隔符,用于打印时分隔字段,默认为空格。
  • ORS:输出记录的分隔符,用于打印时分隔记录,默认为换行符。
  • OFMT:数字输出的格式,默认为%.6g。

函数
awk还提供了一些内置函数,方便对原始数据的处理。主要如下:

  • toupper():字符转为大写。
  • tolower():字符转为小写。
  • length():返回字符串长度。
  • substr():返回子字符串。
  • sin():正弦。
  • cos():余弦。
  • sqrt():平方根。
  • rand():随机数。

条件
awk允许指定输出条件,只输出符合条件的行。输出条件要写在动作的前面:

awk '条件 动作' 文件名
➜ `awk -F, '$2!="" {print $2}' test`
apple

最后说一句,在linux界,盛行着两句话,第一个是linux一切皆是文件,第二是有问题找男人,查询命令man xxx。

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.coloradmin.cn/o/2109558.html

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈,一经查实,立即删除!

相关文章

【Godot4自学手册】第四十六节实现闪电攻击、闪电链

本节内容&#xff0c;主要学习闪电攻击魔法。闪电攻击又名为闪电链&#xff0c;就是在几个敌人之间产生不断跳动的闪电攻击效果。本节主要实现的是单击鼠标右键&#xff0c;会在敌人之间产生随机的闪电链条&#xff0c;效果如下&#xff1a; 一、基本闪电的建立 新建2D场景&…

蚂蚁数科独立后首度公布业务进展和战略布局

“过去一年&#xff0c;蚂蚁数科客户数增长35%。旗下多个产品取得所属赛道市场份额第一。”9月5日下午&#xff0c;蚂蚁数科CEO赵闻飙在外滩大会媒体交流会上透露。这是自今年3月份蚂蚁数科独立化运营后&#xff0c;赵闻飙首次对外公布公司的业务进展及战略布局。 赵闻飙还透露…

分布式风电电池储能系统

风能作为一种清洁的可再生能源,越来越受到世界各国的*视。但风能随机波动的特点,造成风电出力的频繁波动,使电网的调频、调峰压力加大,成为长期困扰风电并网的主要难题。 我国的弃风限电*次出现于2010年,此后弃风从零星现象快速扩散,2012年的情况*为严*,弃风率达17%。之后随着…

使用iperf3进行网络性能测试的完整指南

目录 前言1. 什么是iperf3&#xff1f;2. 如何下载并安装iperf32.1 Ubuntu/Debian安装iperf32.2 CentOS安装2.3 Windows系统下安装iperf32.4 macOS系统下安装iperf3 3. iperf3命令详解3.1 基本命令3.2 常用参数说明3.3 其他常用参数 4. 使用iperf3测试网络性能4.1 TCP性能测试4…

flutter的入口和原生交互

从今天起&#xff0c;笔者要开始从flutter列表页面向原生页面跳转了 首先遇到了N个No such module "Flutter" 因为笔者的公司其实是从前往后改造Flutter的&#xff0c;所以也不需要引擎组&#xff0c;但是笔者搞不懂&#xff0c;只能照着葫芦画瓢&#xff0c;以后等…

不同大模型代码解释对比

包含ChatGPT&#xff0c;讯飞星火&#xff0c;通义千问&#xff0c;腾讯元宝&#xff0c;智谱清言。 目标是想让大模型解释一个用于预处理人体骨骼关节三维坐标数据样本进行填补空帧的Python函数。 def f_padding_none(data):s data.copy()# print(pad the null frames with…

Electron32-Vue3OS桌面管理os模板|vite5+electron32+arco后台os系统

原创新作electron32.xvue3arco.design仿ipad/windows桌面os系统。 基于最新跨平台技术Electron32、Vite5、Vue3 setup、Pinia2、Arco-Design、Echarts、Sortablejs实战开发桌面版osx管理系统。内置ipad/windows两种桌面风格模板、动态json配置桌面图标、自研栅格拖拽布局模板。…

Anthropic发布Claude企业计划 对标OpenAI的ChatGPT Enterprise

领先的人工智能初创公司 Anthropic 今天宣布推出Claude企业计划&#xff0c;以扩大Claude在企业中的应用。OpenAI 早在 2023 年就推出了名为ChatGPT Enterprise 的类似产品&#xff0c;并取得了相当大的成功。事实上&#xff0c;OpenAI 声称&#xff0c;财富 500 强中已有 92% …

CentOS文件和目录命令

CentOS文件和目录命令 在CentOS上&#xff0c;文件和目录是操作系统的核心部分&#xff0c;掌握其基本操作是使用Linux的第一步。文件系统是Linux用户和系统进行交互的主要方式&#xff0c;理解文件和目录的管理对于执行各种操作至关重要。以下是CentOS中与文件和目录相关的主…

【有啥问啥】数据结构哈希链(Hash Chain)的详解与技术探讨

数据结构哈希链&#xff08;Hash Chain&#xff09;的详解与技术探讨 引言 哈希链&#xff08;Hash Chain&#xff09;是一种利用哈希函数将一系列数据块&#xff08;或区块&#xff09;链接起来的数据结构&#xff0c;广泛应用于区块链技术、数据完整性验证以及安全存储等领…

校园订餐系统小程序的设计

管理员账户功能包括&#xff1a;系统首页&#xff0c;个人中心&#xff0c;餐厅信息管理&#xff0c;美食信息管理&#xff0c;订单管理 微信端账号功能包括&#xff1a;系统首页&#xff0c;餐厅信息&#xff0c;美食信息&#xff0c;购物车&#xff0c;我的 开发系统&#…

Java+Swing+dat文件存储实现学生选课管理系统

JavaSwingdat文件存储实现学生选课管理系统 一、系统介绍二、系统展示1.用户登陆、注册2.课程信息查询3.添加课程4.选课5.退课 三、系统实现四、其他1.其它系统 一、系统介绍 功能展示&#xff1a;用户注册、用户登陆 课程管理&#xff1a;课程信息的查询、添加、删除 我的选课…

嵌入式全栈开发学习笔记---C++(强制类型转换/异常和文件)

目录 强制类型转换 static_cast reinterpret_cast dynamic_cast const_cast const_cast笔试 异常处理 什么是异常处理机制&#xff1f; 异常的基本语法 异常处理基本思想 栈解旋 异常接口声明 throw抛出类对象 异常案例 标准异常库 C的文件操作 C输入输出流 …

Unity(2022.3.41LTS) - UI详细介绍- Panel(面板)和RectTransform组件

目录 零. 简介 一、功能与作用 二、属性与设置 三、使用方法 四、优化和注意事项 五.面板总结 六. RectTransform A、主要属性 B、布局控制 C、代码控制 D.实例 控制对象靠近底部 对象紧贴底部 零. 简介 在 Unity 中&#xff0c;Panel&#xff08;面板&#xff0…

《ICT技术成熟度曲线(2024):API全生命周期管理》

来源&#xff1a;Gartner。 近期Gartner发布的《Hype Cycle for ICT in China, 2024》中&#xff0c;将全生命周期API管理收录其中。 •收益评级&#xff1a;高 •市场渗透率&#xff1a;目标受众的 5% 至 20% •成熟度&#xff1a;新兴阶段 &#xfeff; &#xfeff;&am…

ssm微信小程序的英语学习激励系统论文源码调试讲解

2 关键技术介绍 2.1 SSM框架 开发信息管理系统的主流框架是SSM&#xff08;Spring Spring MVC MyBatis&#xff09;&#xff0c;SSM框架web层使用Spring MVC框架&#xff0c;使传输前后端数据变得简单&#xff1b;对于业务层使用Spring作为轻量级控制反转和面向切面的容器框…

基于B/S的城市公交线路管理及查询系统

2 系统需求分析 需求分析是对所要做的系统进行分析&#xff0c;通过使用文字和图表的综合形式&#xff0c;以相对来说容易让人理解的方式去描绘需求的数据、功能、行为&#xff0c;更可以直接评审其正确性、完整性和一致性[2]。通过查询相关的资料&#xff0c;对所做的系统进行…

黑种草:花语中的爱与思念

一、黑种草的神秘面纱 &#xff08;一&#xff09;产地 黑种草原产于欧洲南部&#xff0c;随着被引种栽培&#xff0c;现在在中国长江流域及华北、新疆、云南、西藏等地也有栽培。它性喜冷凉气候&#xff0c;忌高温高湿&#xff0c;对生长环境有一定要求。在适宜的环境中&…

好看的个人导航页面html源码

源码介绍 好看的个人导航页面html源码&#xff0c;适合做博客介绍页或者公司介绍页。喜欢的朋友可以下载使用&#xff0c;源码HTML源码&#xff0c;记事本简单修改文字即可&#xff0c;上传到服务器 效果预览 源码获取 好看的个人导航页面html源码

TypeError: ‘ChatCompletion‘ object is not subscriptable 解决方案

大家好,我是爱编程的喵喵。双985硕士毕业,现担任全栈工程师一职,热衷于将数据思维应用到工作与生活中。从事机器学习以及相关的前后端开发工作。曾在阿里云、科大讯飞、CCF等比赛获得多次Top名次。现为CSDN博客专家、人工智能领域优质创作者。喜欢通过博客创作的方式对所学的…