免费注册 查看新帖 |

Chinaunix

  平台 论坛 博客 文库
最近访问板块 发新帖
查看: 2436 | 回复: 5
打印 上一主题 下一主题

[文本处理] 好像发现了awk的一个多分隔符处理的bug [复制链接]

论坛徽章:
0
跳转到指定楼层
1 [收藏(0)] [报告]
发表于 2016-01-01 09:30 |只看该作者 |倒序浏览
本帖最后由 junhengwoo 于 2016-01-01 09:34 编辑

对字符串“"a_b-c.d"”采用“_”、“-”和“.”作为分隔符,这三个分隔符的位置不一样的时候,分割出来的结果不一样。
采用"[_|-|.]"作为分隔符,“-”没有起作用。
采用"[-|_|.]"作为分隔符,“-”起作用了。
而它们之间仅仅是顺序不一样,这算不算是awk的一个bug啊?

[root@iZ239im9cqvZ ~]#  echo "a_b-c.d" | awk -F "[_|-|.]" '{for(i=1;i<=NF;i++)print $i}'
a
b-c
d
[root@iZ239im9cqvZ ~]# echo "a_b-c.d" | awk -F "[-|_|.]" '{for(i=1;i<=NF;i++)print $i}'
a
b
c
d

论坛徽章:
5
2015年辞旧岁徽章
日期:2015-03-03 16:54:152015年迎新春徽章
日期:2015-03-04 09:50:282015年亚洲杯之朝鲜
日期:2015-03-13 22:47:33IT运维版块每日发帖之星
日期:2016-01-09 06:20:00IT运维版块每周发帖之星
日期:2016-03-07 16:27:44
2 [报告]
发表于 2016-01-01 12:34 |只看该作者
回复 1# junhengwoo


    不是什么bug,是正则表达式。

论坛徽章:
0
3 [报告]
发表于 2016-01-01 17:41 |只看该作者
黑哥,能否具体解释一下呢

我知道正则表达式中的“-”是用来表示范围的,“-”处于“_”和“.”中间表示“-”和“.”都可以用来做分隔符
如果“-”位于前面,就只是表示普通的字符

我这样理解上对的吧


blackold 发表于 2016-01-01 12:34
回复 1# junhengwoo

论坛徽章:
5
未羊
日期:2014-08-04 16:15:21天秤座
日期:2014-08-13 13:52:372015年辞旧岁徽章
日期:2015-03-03 16:54:152015年迎新春徽章
日期:2015-03-04 09:56:112015亚冠之浦和红钻
日期:2015-06-29 15:30:48
4 [报告]
发表于 2016-01-01 20:35 |只看该作者
要么去掉中括号
要么去掉管道

论坛徽章:
6
羊年新春福章
日期:2015-03-03 17:16:28双子座
日期:2015-03-03 17:16:56巳蛇
日期:2015-03-03 17:17:2415-16赛季CBA联赛之福建
日期:2016-03-11 09:05:00黑曼巴
日期:2016-07-07 16:58:1215-16赛季CBA联赛之吉林
日期:2016-11-14 09:23:07
5 [报告]
发表于 2016-01-05 10:14 |只看该作者
学习了~~~~~~~

论坛徽章:
28
15-16赛季CBA联赛之八一
日期:2016-02-22 19:10:4215-16赛季CBA联赛之深圳
日期:2016-12-01 10:34:0415-16赛季CBA联赛之新疆
日期:2016-12-07 10:24:2915-16赛季CBA联赛之同曦
日期:2016-12-15 12:06:43CU十四周年纪念徽章
日期:2016-12-18 13:03:4415-16赛季CBA联赛之吉林
日期:2017-01-03 15:52:2515-16赛季CBA联赛之辽宁
日期:2017-01-04 14:58:2415-16赛季CBA联赛之辽宁
日期:2017-01-15 09:42:512016科比退役纪念章
日期:2017-02-06 17:21:50黑曼巴
日期:2017-02-10 15:46:1215-16赛季CBA联赛之上海
日期:2017-03-18 10:14:5415-16赛季CBA联赛之青岛
日期:2017-03-18 22:00:44
6 [报告]
发表于 2016-01-06 18:05 |只看该作者
回复 1# junhengwoo


    转义
  1. echo 'a_b-c.d' | awk   -F '\\.|\\-|\\_' '{for(i=1;i<=NF;i++)print $i}'  
  2. a
  3. b
  4. c
  5. d


  6. echo 'a_b-c.d' | awk   -F '[_\\-.]' '{for(i=1;i<=NF;i++)print $i}'
  7. a
  8. b
  9. c
  10. d
复制代码
您需要登录后才可以回帖 登录 | 注册

本版积分规则 发表回复

  

北京盛拓优讯信息技术有限公司. 版权所有 京ICP备16024965号-6 北京市公安局海淀分局网监中心备案编号:11010802020122 niuxiaotong@pcpop.com 17352615567
未成年举报专区
中国互联网协会会员  联系我们:huangweiwei@itpub.net
感谢所有关心和支持过ChinaUnix的朋友们 转载本站内容请注明原作者名及出处

清除 Cookies - ChinaUnix - Archiver - WAP - TOP