正则表达式,linux文本三剑客

news2025/1/13 9:44:24

正则表达式匹配的是文本内容,linux的文本三剑客都是针对文本内容,按行进行匹配

文本三剑客:

grep 过滤文本内容

sed 针对文本内容进行增删改查

awd 按行取列

一.grep命令

作用就是使用正则表达式来匹配文本内容

-m +数字:匹配几次之后停止

-v :取反

-n :显示匹配的行号

-c :只统计匹配的行数

-o :仅显示匹配的结果

-q :静默模式,不输出任何信息

-A +数字 :显示包括匹配行的后几行

-B +数字 :显示包括匹配行的前几行

-C +数字 :显示包括匹配行的前后各几行

-e :或者

-E :匹配扩展正则表达式

-f :匹配两个文件相同的内容,以第一个文件为准

-r :递归目录,目录下的文件内容,软连接不包含在内

-R :递归目录,目录下的文件内容,包含软连接

sort

排序:

以行为单位,对文件的内容进行排序

sort 选项 参数

cat file | sort 选项

-f :忽略大小写,默认会把大写字母排在前面

-b :忽略每行之前的空格(不是把空格删除,只是依然按照数字和字母的顺序排列)

-n :按照数字进行排序

-r :反向排序

-u :表示相同的数据仅显示一行

-o :把排序后的结果转存到指定的文件

uniq

去除连续重复的行

-c :统计连续重复的行的次数,合并连续重复的行

-u :显示仅出现一次的行(包括不是连续出现的重复行)

-d :仅显示连续重复的行(不包括非连续出现的行)

tr

用来对标准输出字符进行替换,压缩和删除

tr 选项 参数

-c :保留字符集1的字符,其他字符用字符集2来进行替换

默认会多输出一次替换的字符集2

-d :删除字符集中一部分

-s :①把连续重复出现的字符压缩成一个,②把字符集1的部分替换成字符集2的部分

cut

快速裁剪,对字段进行截取和裁剪

-d :指定分割符(默认的分割符是tab键)

-f :对字段进行截取,指定输出段的内容

截取字段1到3段:

截取字段1和3段:

-complement :输出的时候排除指定的字段

截取除第二段外字段:

截取除第1到第6字段外字段

截取除第1和第3字段外字段

-output-delimiter :更改输出内容的分割符

将截取的1到5字段中分割符: 替换成@

-b :以字节为单位进行截取

-c :以字符为单位进行截取

文件的拆分:

split

大文件拆分成若干小的文件

-l :按行进行拆分

将文件test2.txt按每20行拆分,拆分后文件前缀名为xy102

-b :按照大小来进行拆分

将文件xshell7.rar已每份21M大小拆分,拆分后文件名前缀为xshell

面试题:现在有一个日志文件,5G,能不能快速的打开

答:拆分,两种方法 split -l按行拆分和 split -b按大小拆分

这种文件推荐使用按大小拆分,split -b

文件合并

paste

cat

面试题:cat合并和paste合并之间的区别

答:cat是上下合并,paste是左右合并

面试题:统计当前主机的连接状态

答:ss -antp | grep -v 'State' | cut -d ' ' -f 1 | sort | uniq -c

正则表达式:

由一类特殊字符以及文本字符所编写的一个模式,模式又来匹配文件当中内容(字符)

校验我们输入的内容是否满足规定,格式,长度等待要求

主要用来匹配文件内容,命令的结果

通配符:只能用于匹配文件名的目录名,不能匹配文件的内容和命令结果

正则表达式分为:

1.基本正则表达式

元字符(字符匹配)

. 任意单个字符,也可以是一个汉字

\ 转义符 恢复其本意

[] 匹配指定范围内的任意单个字符或数字

[^] 取反

^ 匹配开头

*匹配前面的字符任意次,0次也可以

.* 匹配前面的任意字符,至少要有一次

\? 匹配前面的字符0次或1次,可有可无

\ + 匹配前面的字符,至少要出现一次

\ {n\ } 匹配前面的字符=n次,可以小于n,但是不能大于n,而且前面的字符必须要是连续出现

\ (m,n\ )匹配前面的字符至少m次 ,最多n次,必须的连续出现,超出的不在匹配范围

\ {,n\ } 匹配前面的字符最多n次

\ {n,\ } 匹配前面的字符最少n次

位置锚顶:

^ :以什么开始,行尾锚定

$ :以什么为结尾,行尾锚定

\ <或\b 词首锚定,匹配单词的左侧(连续的数字,字母,下划线都算单词内部)

\ > 或\b 词尾锚定,用于匹配单词的右侧

\broot\b 匹配整个单词,空格隔开的也算整个单词

^root$ 整个一行只有这个单词

区别

分组和逻辑关系

分组 :()

或者 : \ |

扩展正则表达式

grep -E ,不用加\号,其他与正则表达式基本一样

二.sed命令

sed是一种流编器,一次处理一行内容,针对文本内容进行增删改查

如果只是展示,会放在缓冲区(模式空间),展示结束之后,会从模式空间把操作结果删除

一行一行处理,处理完当前行,才会处理下一行,直到文件末尾

sed的命令格式和操作选项:

-e :表示可以跟多个操作符,只有一个操作符 -e 可以省略

sed -e '操作符' -e '操作符' 文件1 文件2

sed -e '操作符1;操作符2;'文件1 文件2

选项

-e :用于执行多个操作命令

-f : 在脚本中定义好了操作符,然后根据脚本内容的操作符对文件进行操作

-i : 直接修改目标文件(慎用)

-n :仅显示script处理后的结果(不加 -n,sed会有两个输出结果,加了 -n后会把默认输出屏蔽,只显示一个结果)

操作符:

p :打印结果

r :使用扩展正则表达式

s :替换,替换字符串

c :替换,替换指定行

y :替换,替换单个字符;多个字符必须和替换内容的字符长度保持一致

d :删除,删除行

a :增加,在指定行的下一行插入内容

i :增加,在指定行的上一行插入内容

r :读取其他文件的内容,在行后增加文本内容

$a :在最后一行插入新的内容

$i :在倒数第二行插入新的内容

$r :读取其他文件的内容,插入到目标文件的最后一行

打印功能:

寻址打印,按照指定行打印

sed -n '$p' 文件名 :,打印最后行

sed -n '数字p' 文件名 :打印指定行

sed -n '数字p;数字p' 文件名 :打印指定的两行

sed -n '2,4p' :打印2-4行

sed -n 'p;n' :打印奇数行

sed -n 'n;p' :打印偶数行 ‘n’的作用,跳过一行,打印下一行

sed -n ‘/a/p’ : 过滤并打印包含a的行

使用正则表达式对文本内容进行过滤

sed -n '/^root/p' /etc/passwd :打印出以root开头的所有行

sed -n '42,/bash$/p' /etc/passwd :从指定42行打印到第一个以bash结尾的行

sed -rn '/(99:){2,}/p' /etc/passwd :

sed -rn '/^root|bash$/p' /etc/passwd :打印出要么以root开头要么以bash结尾的行

面试题

如何免交互删除文件:

答:两种方法

①cat /dev/null > test1.txt

②sed -i 'd' test1.txt

sed的删除操作

sed -n ‘3d;p’ 文件名 :删除第三行,打印剩余的行

sed -n '4d;6d;p' 文件名 :删除第四和第六行,打印剩余行

匹配字符串删除行

sed '/o/d' :删除所有包含o的行

ed '/222/,/444/d' :删除包含222到444中间的所有行

ed '/222/!d' :删除除了包含222的所有行

面试题:

如何用免交互方式删除空行

grep -v ‘^$’

cat test.txt | tr -s ‘\n’

sed ‘/^$/d’ test.txt

s替换字符串

sed -n 's/root/test/p' /etc/passwd :每行第一个root替换成test

sed -n ’s/root/test/2p‘ /etc/passwd :每行第二个root替换成test

sed -n ’s/root/test/gp‘ /etc/passwd:所有的root替换成test

sed -n '4,6s/^/#/p' test.txt :注释第4到6行

sed -n '4s/^/#/p;6s/^/#/p' test.txt :注释第4和第6行

sed 's/[a-z]/\u&/' test.txt:转换首字母小写为大写

sed 's/[a-z]/\u&/g' test.txt:所有的小写变为大写

u&:转换首字母为大写的特殊符号。

ed 's/[A-Z]/\l&/' test1.txt :转换首字母大写为小写

sed 's/[A-Z]/\l&/g' test1.txt :所有的大写变为小写

l& :转换首字母为小写的特殊符号。

整行替换

sed '/a/c shuai' test.txt :把a开头的行 替换成 shuai

y单字符替换

sed '/abc/123/' test.txt :将文件内字符abc分别替换成123,

位置替换

使用sed对字符串和字符的位置进行互换

echo wenzeshao | sed -r 's/(wen)(ze)(shao)/\3\1\2/'

对单个字符的位置进行互换

echo oahs | sed -r 's/(.)(.)(.)(.)/\4\3\2\1/'

sed主要作用是对文本的内容进行增删改查

最好用的是:改和增功能

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.coloradmin.cn/o/1854106.html

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈,一经查实,立即删除!

相关文章

VMware与windows的共享文件夹没找到怎么办?

如果这样子添加&#xff0c;在ubuntu中还是没能找到。开机后有的时候仍然未发现共享文件夹。 二、解决办法 使用如下指令&#xff1a; sudo mount -t fuse.vmhgfs-fuse .host:/ /mnt/hgfs -o allow_other /mnt/hgfs/ 是挂载点&#xff0c;也可以指定其它挂载点 -o allow_other…

第14章. GPIO简介

目录 0. 《STM32单片机自学教程》专栏 14.1 GPIO基本结构 14.1.1 保护二极管 14.1.2 上拉、下拉电阻 14.1.3 施密特触发器 14.1.4 P-MOS 管和 N-MOS 管 14.1.5 输出数据寄存器 14.1.6 输入数据寄存器 14.2 GPIO工作模式 14.2.1 输入模式 14.2.1.1 输入浮空模式 1…

Nginx自定义错误页面配置

Nginx错误页面包括404 403 500 502 503 504等页面&#xff0c;只需要在server中进行如下配置即可&#xff1a; error_page 404 500 502 503 504 /50x.html;location /50x.html {root /usr/share/nginx/html;}注意&#xff1a; /usr/local/nginx/html/ 路径下必须有50x.ht…

Node.js版Selenium WebDriver教程

目录 介绍 导言 Selenium基础 环境设置 使用npm安装selenium-webdriver模块 配置和管理浏览器驱动器 下载火狐 下载安装 webDriver 第一个WebDriver脚本 介绍 导言 在当今数字化时代&#xff0c;Web应用程序的质量和性能至关重要。为了确保这些应用的可靠性&#xf…

国产大模型技术创新分析

国产模型百舸争流&#xff0c;技术创新百花齐放 2023年下半年起&#xff0c;国内大模型领域迎来“百模大战”&#xff0c;各大厂商纷纷加速生成式AI的研发与突破&#xff0c;模型持续迭代升级&#xff0c;展现了人工智能技术的蓬勃发展与无限潜力。 中国大模型市场迅猛发展&am…

SpringBoot-注解@ImportResource引入自定义spring的配置xml文件和配置类

1、注解ImportResource 我们知道Spring的配置文件是可以有很多个的&#xff0c;我们在web.xml中如下配置就可以引入它们&#xff1a; SprongBoot默认已经给我们配置好了Spring&#xff0c;它的内部相当于已经有一个配置文件&#xff0c;那么我们想要添加新的配置文件怎么办&am…

SQL-Python

师从黑马程序员 数据库介绍 数据库就是存储数据的库 数据组织&#xff1a;库->表->数据 数据库和SQL的关系 MySQL的基础命令 SQL基础 SQL语言的分类 SQL的语法特征 DDL-库管理 show DATABASES;use sys;SELECT database();CREATE DATABASE test CHARSET utf-8;SHOW D…

【Orange Pi 5与Linux编程编程】-POSIX消息队列

Linux系统中的POSIX消息队列编程 文章目录 Linux系统中的POSIX消息队列编程1、POSIX 消息队列2、Linux 中的 POSIX 消息队列命名3、POSIX 消息队列调用3.1 mq_open, mq_close3.2 mq_timed_send、mq_send、mq_timed_receive、mq_receive3.3 mq_notify3.4 mq_unlink3.5 mq_getatt…

SpringCloud - 微服务

1、微服务介绍 参考&#xff1a; 微服务百度百科 1.1 概念 微服务&#xff08;或称微服务架构&#xff09;是一种云原生架构方法&#xff0c;在单个应用中包含众多松散耦合且可单独部署的小型组件或服务。 这些服务通常拥有自己的技术栈&#xff0c;包括数据库和数据管理模型&…

可视化大屏开发系列——DataV的使用

以下内容为近期个人学习总结&#xff0c;若有错误之处&#xff0c;欢迎指出&#xff01; 可视化大屏开发系列——DataV的使用 一、介绍二、注意事项1、技术支持2、兼容性3、状态更新 三、实现效果四、使用&#xff08;在vue2项目中&#xff09;1.npm安装2.main.js中引入3.开启愉…

昇思25天学习打卡营第5天|网络构建

一、简介&#xff1a; 神经网络模型是由神经网络层和Tensor操作构成的&#xff0c;mindspore.nn提供了常见神经网络层的实现&#xff0c;在MindSpore中&#xff0c;Cell类是构建所有网络的基类&#xff08;这个类和pytorch中的modul类是一样的作用&#xff09;&#xff0c;也是…

LVGL8.3动画图像(太空人)

LVGL8.3 动画图像 1. 动画图像本质 我们知道电影属于视频&#xff0c;而电影的本质是将一系列动作的静态图像进行快速切换而呈现出动画的形式&#xff0c;也就是说动画本质是一系列照片。所以 lvgl 依照这样的思想而定义了动画图像&#xff0c;所以在 lvgl 中动画图像类似于普…

【学习笔记】Mybatis-Plus(三):MP中Wrapper的使用

Wrapper简介 注意&#xff1a; 查询用QueryWrapper和LambdaQueryWrapper来封装 updateWrapper和LambdaUPdateWrapper不但能封装查询还能更改要更新的对象。 QueryWrapper的使用 QueryWrapper中的很多条件限定都是见名知其意的。下表列出来几个常用的&#xff1a; 1.多条件进行…

【八】【QT开发应用】QTcreate项目打包成.exe文件或.apk文件,EnigmaVirtualBox软件下载,虚拟网站代打开QT应用

EnigmaVirtualBox下载 Enigma Virtual Box QTcreate项目打包成.exe可执行文件 找到自己写好的项目的.exe文件 将这个文件复制到一个新的文件夹里面 在这个新的文件夹里面打开cmd,这样可以使得cmd直接进入到该文件夹 打包.exe命令行 输入下面的命令行 windeployqt game…

EndNote 21 for Mac v21.3 文献管理软件安装

Mac分享吧 文章目录 效果一、下载软件二、开始安装1、双击运行安装EndNote212、升级 三、运行1、打开软件&#xff0c;测试 安装完成&#xff01;&#xff01;&#xff01; 效果 一、下载软件 下载软件 链接&#xff1a;http://www.macfxb.cn 二、开始安装 1、双击运行安装End…

【目标检测】DAB-DETR

一、引言 论文&#xff1a; DAB-DETR: Dynamic Anchor Boxes are Better Queries for DETR 作者&#xff1a; IDEA 代码&#xff1a; DAB-DETR 注意&#xff1a; 该算法是对DETR的改进&#xff0c;在学习该算法前&#xff0c;建议掌握多头注意力、Sinusoidal位置编码、DETR等相…

一款基于WordPress开发的高颜值的自适应主题Puock

主题特性 支持白天与暗黑模式 全局无刷新加载 支持博客与CMS布局 内置WP优化策略 一键全站变灰 网页压缩成一行 后台防恶意登录 内置出色的SEO功能 评论Ajax加载 文章点赞、打赏 支持Twemoji集成 支持QQ登录 丰富的广告位 丰富的小工具 自动百度链接提交 众多页面模板 支持评论…

富文本编辑器CKEditor

介绍 富文本编辑器不同于文本编辑器,它提供类似于 Microsoft Word 的编辑功能 在Django中,有可以现成的富文本三方模块django-ckeditor,具体安排方式: pip install django-ckeditor==6.5.1官网:Django CKEditor — Django CKEditor 6.7.0 documentation 使用方式 创建项…

torchinfo这个包中的summary真的很好用

1.安装直接使用 pip 进行安装即可&#xff1a; pip install torchinfo 2.导入该模块 from torchinfo import summary 3.使用模块 summary(model)#这里的model是你自己的model&#xff0c;可以添加参数进去 4.效果图&#xff1a; 第一个图片是直接打印model吗&#xff0c;…

「动态规划」如何求环绕字符串中唯一的子字符串个数?

467. 环绕字符串中唯一的子字符串https://leetcode.cn/problems/unique-substrings-in-wraparound-string/description/ 定义字符串base为一个"abcdefghijklmnopqrstuvwxyz"无限环绕的字符串&#xff0c;所以base看起来是这样的&#xff1a;"...zabcdefghijklm…