免费注册 查看新帖 |

Chinaunix

  平台 论坛 博客 文库
12下一页
最近访问板块 发新帖
查看: 4239 | 回复: 11

[文本处理] 【请教】如何找出行中最大值并标记 [复制链接]

论坛徽章:
0
发表于 2015-01-23 22:54 |显示全部楼层
文件内容如下:

  1. 222.247.0.0/18,222.247.0.0/17,222.247.0.0/13,222.247.0.0/14
  2. 123.46.0.0/19,123.46.0.0/17,123.46.0.0/13,123.46.0.0/14
复制代码
文本一共4列,每列的格式为x.x.x.x/y,如何在每行中找到最大的 y 值,并把x.x.x.x/y标记为* x.x.x.x/y。

比如第一行应变为

  1. * 222.247.0.0/18,222.247.0.0/17,222.247.0.0/13,222.247.0.0/14
复制代码

论坛徽章:
23
15-16赛季CBA联赛之吉林
日期:2017-12-21 16:39:27白羊座
日期:2014-10-27 11:14:37申猴
日期:2014-10-23 08:36:23金牛座
日期:2014-09-30 08:26:49午马
日期:2014-09-29 09:40:16射手座
日期:2014-11-25 08:56:112015年辞旧岁徽章
日期:2015-03-03 16:54:152015年迎新春徽章
日期:2015-03-04 09:49:0315-16赛季CBA联赛之山东
日期:2017-12-21 16:39:1915-16赛季CBA联赛之广东
日期:2016-01-19 13:33:372015亚冠之山东鲁能
日期:2015-10-13 09:39:062015亚冠之西悉尼流浪者
日期:2015-09-21 08:27:57
发表于 2015-01-24 09:26 |显示全部楼层
回复 1# PharaohNie


try:
  1. awk -F '[/,]' '{m=n=0;for(i=2;i<=NF;i+=2)if($i>m){m=$i;n=i};print gensub($(n-1)"/"$n,"* &",1)}' file
复制代码

论坛徽章:
10
天蝎座
日期:2013-09-22 22:32:23程序设计版块每日发帖之星
日期:2016-08-07 06:20:00lufei
日期:2016-06-17 17:38:40程序设计版块每日发帖之星
日期:2016-06-12 06:20:002016科比退役纪念章
日期:2016-05-31 15:47:20CU十四周年纪念徽章
日期:2016-05-27 12:24:562015年亚洲杯之阿曼
日期:2015-05-03 21:01:352015年辞旧岁徽章
日期:2015-03-03 16:54:15天蝎座
日期:2013-10-20 21:05:24程序设计版块每日发帖之星
日期:2016-08-11 06:20:00
发表于 2015-01-24 09:47 |显示全部楼层
回复 1# PharaohNie
  1.         OIFS=$IFS
  2.         while read line; do
  3.                 IFS=","
  4.                 set -- $line
  5.                 Max=${1##*/}
  6.                 token=1
  7.                 for((i=2; i<=$#; i++)); do
  8.                         eval tmp=\$i
  9.                         if [[ $Max -lt ${tmp##*/} ]]; then
  10.                                 Max=${tmp##*/}
  11.                                 token=$i
  12.                         fi
  13.                 done;
  14.                 IFS=$OIFS
  15.                 echo $line | sed -r "s#(^|,)#&* #$token"
  16.        
  17.         done <testfile;
复制代码
  1. * 222.247.0.0/18,222.247.0.0/17,222.247.0.0/13,222.247.0.0/14
  2. 123.46.0.0/19,123.46.0.0/17,123.46.0.0/13,* 123.46.0.0/20
  3. 123.46.0.0/19,123.46.0.0/17,* 123.46.0.0/20,123.46.0.0/14
  4. 123.46.0.0/19,* 123.46.0.0/20,123.46.0.0/13,123.46.0.0/14
  5. * 123.46.0.0/19,123.46.0.0/19,123.46.0.0/13,123.46.0.0/14
复制代码

论坛徽章:
13
双鱼座
日期:2013-10-23 09:30:05数据库技术版块每日发帖之星
日期:2016-04-20 06:20:00程序设计版块每日发帖之星
日期:2016-03-09 06:20:002015亚冠之塔什干火车头
日期:2015-11-02 10:07:452015亚冠之德黑兰石油
日期:2015-08-30 10:07:07数据库技术版块每日发帖之星
日期:2015-08-28 06:20:00数据库技术版块每日发帖之星
日期:2015-08-05 06:20:002015年迎新春徽章
日期:2015-03-04 09:57:09辰龙
日期:2014-12-03 14:45:52酉鸡
日期:2014-07-23 09:46:23亥猪
日期:2014-03-13 08:46:22金牛座
日期:2014-02-11 09:36:21
发表于 2015-01-24 09:58 |显示全部楼层
  1. awk -vFS=OFS="," '{for(i=1;i<NF;++i){split($i,a,"/");if(a[2]>max){max=a[2];j=i;}}$j="* "$j}1' urfie
复制代码

论坛徽章:
145
技术图书徽章
日期:2013-10-01 15:32:13戌狗
日期:2013-10-25 13:31:35金牛座
日期:2013-11-04 16:22:07子鼠
日期:2013-11-18 18:48:57白羊座
日期:2013-11-29 10:09:11狮子座
日期:2013-12-12 09:57:42白羊座
日期:2013-12-24 16:24:46辰龙
日期:2014-01-08 15:26:12技术图书徽章
日期:2014-01-17 13:24:40巳蛇
日期:2014-02-18 14:32:59未羊
日期:2014-02-20 14:12:13白羊座
日期:2014-02-26 12:06:59
发表于 2015-01-24 10:05 |显示全部楼层
回复 1# PharaohNie

$ awk 'BEGIN{FS=OFS=","}{for(c=n=1;n<=NF;n++){match($n,"([0-9]+)$",a);d=a[1];if(m<d){c=n;m=d}}$c="* "$c}1' FILE
* 222.247.0.0/18,222.247.0.0/17,222.247.0.0/13,222.247.0.0/14
* 123.46.0.0/19,123.46.0.0/17,123.46.0.0/13,123.46.0.0/14

   

论坛徽章:
6
处女座
日期:2014-04-02 16:07:17酉鸡
日期:2014-04-14 10:09:22子鼠
日期:2014-04-17 11:57:30辰龙
日期:2014-09-01 17:14:08戌狗
日期:2014-10-28 12:25:54未羊
日期:2014-11-14 11:31:58
发表于 2015-01-24 11:27 |显示全部楼层
  1. awk 'BEGIN{FS=OFS=","}{max=0;for(i=1;i<=NF;i++){num=gensub(/.*\/(.+)/,"\\1","G",$i);if(num>max){max=num;m=i;s=$i}};gsub(s,"* &",$m)}1' o
复制代码

论坛徽章:
6
处女座
日期:2014-04-02 16:07:17酉鸡
日期:2014-04-14 10:09:22子鼠
日期:2014-04-17 11:57:30辰龙
日期:2014-09-01 17:14:08戌狗
日期:2014-10-28 12:25:54未羊
日期:2014-11-14 11:31:58
发表于 2015-01-24 11:51 |显示全部楼层
回复 5# jason680


    jason680大神,match()的第三个参数是什么意思能帮我解释一下么,我看了一下man,没大看明白,平时只用过match()的前两个参数。谢谢!!

论坛徽章:
10
天蝎座
日期:2013-09-22 22:32:23程序设计版块每日发帖之星
日期:2016-08-07 06:20:00lufei
日期:2016-06-17 17:38:40程序设计版块每日发帖之星
日期:2016-06-12 06:20:002016科比退役纪念章
日期:2016-05-31 15:47:20CU十四周年纪念徽章
日期:2016-05-27 12:24:562015年亚洲杯之阿曼
日期:2015-05-03 21:01:352015年辞旧岁徽章
日期:2015-03-03 16:54:15天蝎座
日期:2013-10-20 21:05:24程序设计版块每日发帖之星
日期:2016-08-11 06:20:00
发表于 2015-01-24 12:52 |显示全部楼层
本帖最后由 liion631818 于 2015-01-24 12:55 编辑
If array a is provided, a is cleared and then elements 1 through n are filled with  the  portions  of  s
                               that  match the corresponding parenthesized subexpression in r.
回复 7# rulebook

match(s,r,[,a]),
也就是r中被括号包含的子模式匹配的内容依次存入a,从1开始

   

论坛徽章:
6
处女座
日期:2014-04-02 16:07:17酉鸡
日期:2014-04-14 10:09:22子鼠
日期:2014-04-17 11:57:30辰龙
日期:2014-09-01 17:14:08戌狗
日期:2014-10-28 12:25:54未羊
日期:2014-11-14 11:31:58
发表于 2015-01-24 13:54 |显示全部楼层
回复 8# liion631818


    明白了,非常感谢!~

论坛徽章:
10
天蝎座
日期:2013-09-22 22:32:23程序设计版块每日发帖之星
日期:2016-08-07 06:20:00lufei
日期:2016-06-17 17:38:40程序设计版块每日发帖之星
日期:2016-06-12 06:20:002016科比退役纪念章
日期:2016-05-31 15:47:20CU十四周年纪念徽章
日期:2016-05-27 12:24:562015年亚洲杯之阿曼
日期:2015-05-03 21:01:352015年辞旧岁徽章
日期:2015-03-03 16:54:15天蝎座
日期:2013-10-20 21:05:24程序设计版块每日发帖之星
日期:2016-08-11 06:20:00
发表于 2015-01-24 14:06 |显示全部楼层
回复 9# rulebook


    英语不行啊,年轻人
您需要登录后才可以回帖 登录 | 注册

本版积分规则 发表回复

  

北京盛拓优讯信息技术有限公司. 版权所有 京ICP备16024965号-6 北京市公安局海淀分局网监中心备案编号:11010802020122 niuxiaotong@pcpop.com 17352615567
未成年举报专区
中国互联网协会会员  联系我们:huangweiwei@itpub.net
感谢所有关心和支持过ChinaUnix的朋友们 转载本站内容请注明原作者名及出处

清除 Cookies - ChinaUnix - Archiver - WAP - TOP