此恨无关风与月 2016-07-12 16:38 采纳率: 66.7%
浏览 3623
已采纳

linux下如何把两个文件中key值相同的两条记录合并为一条记录,并输出到新的文件中?

比如
a.txt的文件内容为:
20114042028 liuyh 90
20114042045 liub 100
20114042013 liubx 100
b.txt的文件内容为:
20114042013 yuwen
20114042028 shuxue
20114042045 yingyu

我想要的结果为把两个文件中key值相同的两条记录合并为一条记录,并输出到新的文件c.txt中
20114042028 liuyh 90 shuxue
20114042045 liub 100 yingyu
20114042013 liubx 100 yuwen
域分隔符为\t

请问awk能实现吗?

  • 写回答

2条回答 默认 最新

  • Leo.li 2016-07-13 05:23
    关注

    @楼主 直接回复你的评论好像有字数限制. 就单独回答下.

    awk 'NR==FNR{S[$1]=$0;next}NR>FNR{print S[$1],$2,$3}' a.txt b.txt > c.txt
    

    首先你要了解awk中NR和FNR内置变量的作用, 其他变量可自行百度. 或查看文档说明.

    NR                 已经读出的行号, 从1开始, 如果有多个文件的话, 这个值也是不断累加
    FNR                浏览文件的记录数, 与NR不同这个值是各个文件自己的行号
    

    然后逐个分解这条脚本.
    1. 先看下

    awk '{print NR " " FNR " " $0}' a.txt b.txt
    

    结果为:

    1 1 20114042028 liuyh 90
    2 2 20114042045 liub 100
    3 3 20114042013 liubx 100
    4 1 20114042013 yuwen
    5 2 20114042028 shuxue
    6 3 20114042045 yingyu
    
    1. NR==FNR{S[$1]=$0;next}

      #当已读的行号NR与FNR相同时执行S[$1]=$0;next
      #即只扫描a.txt中的内容, 把a.txt中的内容赋值给S[$1]
      #这里的S[$1]是一个map. key=$1 value=$0
      #$0:读取行的内容, $1:读取行的第一列
      NR==FNR{S[$1]=$0;next}
      
    2. NR>FNR{print A[$1],$2,$3}

      #当已读的行号NR大于FNR时, 输入数据
      #即: 当读取b.txt中的内容时, 直接输出数据.
      #输出的顺序为S[$1], $2, $3.
      #其中S[$1]是根据b.txt中的第一列从S中取值. $2,$3:b.txt中的第二/三列
      NR>FNR{print S[$1],$2,$3}
      
    3. 重定向到c.txt, 这个就不讲了一看就懂

    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论
查看更多回答(1条)

报告相同问题?

悬赏问题

  • ¥15 运筹学排序问题中的在线排序
  • ¥15 关于docker部署flink集成hadoop的yarn,请教个问题 flink启动yarn-session.sh连不上hadoop,这个整了好几天一直不行,求帮忙看一下怎么解决
  • ¥30 求一段fortran代码用IVF编译运行的结果
  • ¥15 深度学习根据CNN网络模型,搭建BP模型并训练MNIST数据集
  • ¥15 lammps拉伸应力应变曲线分析
  • ¥15 C++ 头文件/宏冲突问题解决
  • ¥15 用comsol模拟大气湍流通过底部加热(温度不同)的腔体
  • ¥50 安卓adb backup备份子用户应用数据失败
  • ¥20 有人能用聚类分析帮我分析一下文本内容嘛
  • ¥15 请问Lammps做复合材料拉伸模拟,应力应变曲线问题