免费注册 查看新帖 |

Chinaunix

  平台 论坛 博客 文库
最近访问板块 发新帖
查看: 1763 | 回复: 4
打印 上一主题 下一主题

[文本处理] 两组数据交集的处理 [复制链接]

论坛徽章:
0
跳转到指定楼层
1 [收藏(0)] [报告]
发表于 2014-11-17 14:50 |只看该作者 |倒序浏览
a文件:(tab分隔)
11:a    qq    0.3
12:c    aa    0.24
13:d    bb    0.5
15:r     ss    0.1

b文件:(tab分隔)
10:c    1212     a
11:b     21       b
11:a      1        b
12:d      43       f
12:c      12       d
13:c      3434   e
15:r      1221   r
16:a     3456    t

想要根据第一列求出a、b两组数据的交集,结果如下:
11:a    1       b     0.3
12:c    12     d     0.24
15:r    1221  r     0.1

论坛徽章:
145
技术图书徽章
日期:2013-10-01 15:32:13戌狗
日期:2013-10-25 13:31:35金牛座
日期:2013-11-04 16:22:07子鼠
日期:2013-11-18 18:48:57白羊座
日期:2013-11-29 10:09:11狮子座
日期:2013-12-12 09:57:42白羊座
日期:2013-12-24 16:24:46辰龙
日期:2014-01-08 15:26:12技术图书徽章
日期:2014-01-17 13:24:40巳蛇
日期:2014-02-18 14:32:59未羊
日期:2014-02-20 14:12:13白羊座
日期:2014-02-26 12:06:59
2 [报告]
发表于 2014-11-17 15:01 |只看该作者
回复 1# gooderpan

$ awk 'BEGIN{FS=OFS="\t"}FNR==NR{a[$1]=$0;next}a[$1]{print a[$1],$3}' b a
11:a        1        b        0.3
12:c        12        d        0.24
15:r        1221        r        0.1

论坛徽章:
9
2015亚冠之大阪钢巴
日期:2015-06-04 11:47:30丑牛
日期:2015-01-22 15:49:26巳蛇
日期:2015-01-22 10:11:18巨蟹座
日期:2014-11-20 10:55:03天蝎座
日期:2014-11-16 22:10:26处女座
日期:2014-11-16 11:01:10申猴
日期:2014-09-19 11:12:37双鱼座
日期:2014-07-25 10:09:54程序设计版块每日发帖之星
日期:2015-08-24 06:20:00
3 [报告]
发表于 2014-11-17 15:02 |只看该作者
  1. awk 'NR==FNR{a[$1]=$NF;next}$1 in a{print $0"\t"a[$1]}' a b
复制代码

论坛徽章:
0
4 [报告]
发表于 2014-11-17 16:37 |只看该作者
本帖最后由 lwphappy 于 2014-11-17 16:37 编辑
  1. awk 'BEGIN{FS=OFS="\t"}NR==FNR{a[$1]=$3;next}NR!=FNR && a[$1]{print $1,$2,$3,a[$1]}' a b
复制代码

论坛徽章:
24
申猴
日期:2014-10-10 15:56:39射手座
日期:2014-10-10 15:57:18黑曼巴
日期:2018-05-14 11:05:122016科比退役纪念章
日期:2018-05-14 11:05:0715-16赛季CBA联赛之北控
日期:2018-05-14 11:05:0015-16赛季CBA联赛之江苏
日期:2017-02-27 18:11:0715-16赛季CBA联赛之上海
日期:2018-08-15 09:48:5415-16赛季CBA联赛之佛山
日期:2018-07-20 17:14:2315-16赛季CBA联赛之佛山
日期:2019-09-10 18:08:4615-16赛季CBA联赛之山西
日期:2020-03-26 09:40:5115-16赛季CBA联赛之佛山
日期:2020-05-08 09:03:54
5 [报告]
发表于 2014-11-17 16:56 |只看该作者
awk 'NR==FNR{a[$1]=$3;b[$1]++}NR!=FNR&&b[$1]++{print $0"\t"a[$1]}' a b
您需要登录后才可以回帖 登录 | 注册

本版积分规则 发表回复

  

北京盛拓优讯信息技术有限公司. 版权所有 京ICP备16024965号-6 北京市公安局海淀分局网监中心备案编号:11010802020122 niuxiaotong@pcpop.com 17352615567
未成年举报专区
中国互联网协会会员  联系我们:huangweiwei@itpub.net
感谢所有关心和支持过ChinaUnix的朋友们 转载本站内容请注明原作者名及出处

清除 Cookies - ChinaUnix - Archiver - WAP - TOP