使用awk合并文件及脚本解析
来源:互联网 发布:自学网c语言 编辑:程序博客网 时间:2024/05/20 09:09
昨天在CSND上看到有使用awk合并文件的一个问题, 正好这两天有点时间就简单整理了其执行过程的分析.
问题如下
a.txt的文件内容为:
20114042028 liuyh 9020114042045 liub 10020114042013 liubx 100
b.txt的文件内容为:
20114042013 yuwen20114042028 shuxue20114042045 yingyu
我想要的结果为把两个文件中key值相同的两条记录合并为一条记录,并输出到新的文件c.txt中
20114042028 liuyh 90 shuxue20114042045 liub 100 yingyu20114042013 liubx 100 yuwen
awk合并命令
awk 'NR==FNR{S[$1]=$0;next}NR>FNR{print S[$1],$2,$3}' a.txt b.txt > c.txtawk 'NR==FNR{S[$1]=$0;next}NR>FNR{print S[$1],$3,$2}' b.txt a.txt > c.txt
awk脚本解析
首先你要了解awk中NR和FNR内置变量的作用, 其他变量可自行百度. 或查看文档说明.
NR 已经读出的行号, 从1开始, 如果有多个文件的话, 这个值也是不断累加FNR 浏览文件的记录数, 与NR不同这个值是各个文件自己的行号
然后逐个分解这条脚本.
- 先看下
awk '{print NR " " FNR " " $0}' a.txt b.txt
结果为:
1 1 20114042028 liuyh 902 2 20114042045 liub 1003 3 20114042013 liubx 1004 1 20114042013 yuwen5 2 20114042028 shuxue6 3 20114042045 yingyu
- NR==FNR{S[
1]= 0;next}
#当已读的行号NR与FNR相同时执行S[$1]=$0;next #即只扫描a.txt中的内容, 把a.txt中的内容赋值给S[$1] #这里的S[$1]是一个map. key=$1 value=$0 #$0:读取行的内容, $1:读取行的第一列 NR==FNR{S[$1]=$0;next}
- NR>FNR{print A[
1], 2,$3}
#当已读的行号NR大于FNR时, 输入数据 #即: 当读取b.txt中的内容时, 直接输出数据. #输出的顺序为S[$1], $2, $3. #其中S[$1]是根据b.txt中的第一列从S中取值. $2,$3:b.txt中的第二/三列 NR>FNR{print S[$1],$2,$3}
- 重定向到c.txt, 这个就不讲了一看就懂
0 0
- 使用awk合并文件及脚本解析
- Shell脚本------解析elf文件及awk基本使用
- Shell脚本------解析elf文件及awk基本使用
- 使用awk合并文件--生成report
- awk 合并文件
- awk 合并文件
- awk 逐行合并文件
- awk 合并两个文件
- awk合并文件内容
- 使用awk来解析dump文件
- awk 多个文件合并
- 脚本使用(awk,shell...)
- shell脚本-awk使用
- 采用Shell及AWK脚本实现磁盘使用空间监控
- 合并SQL脚本文件
- 合并文件脚本
- awk求和及多行合并
- Selenium_IDE的基本使用及脚本解析
- Spring+Websocket实现消息的推送
- Selenium多层级的iframe中元素的定位
- CF 610B Vika and Squares
- Fragment 生命周期的问题
- 【NFC】NFC概述及认证
- 使用awk合并文件及脚本解析
- 浅谈 JSON.stringify 方法
- 常用docker命令,及一些坑
- 由浅入深了解Thrift(一)——Thrift介绍与用法
- VMWare Workstation 安装在ubuntu 14.04(15.04) 内核(3.19) 中更新编译失败的解决方法
- 将本地工程导到GitHub并将工程与git建立连接
- .Net自写Task进程监控程序
- Linux shell脚本判断输入目录是否存在,并输出目录所在磁盘使用量
- 向数据库中插入日期数据