忘记密码   免费注册 查看新帖 |

ChinaUnix.net

  平台 论坛 博客 文库 频道自动化运维 虚拟化 储存备份 C/C++ PHP MySQL 嵌入式 Linux系统
最近访问板块 发新帖
查看: 1111 | 回复: 9

[文本处理] awk 中 回车符的转换 [复制链接]

论坛徽章:
0
发表于 2018-03-14 10:06 |显示全部楼层
请教:
linux 7:
我可以进行下面的转换:
echo "ae ec as    sadasatsadca" |awk '{ gsub(/\040/, "\054", $0); { print }}' >/tmp/kk
cat /tmp/kk
ae,ec,as,,,,sadasatsadca


awk '{ gsub(/\054/, "\040", $0); { print }}' /tmp/kk

ae ec as    sadasatsadca


空格和,的转换是可以的

但回车就不可以:
echo "ae ec as    sadasatsadca" |awk '{ gsub(/\040/, "\n", $0); { print }}' >/tmp/kk

cat /tmp/kk
ae
ec
as



sadasatsadca

awk '{ gsub(/\n/, "\040", $0); { print }}' /tmp/kk                    #<----不能将 " "转换回 回车。
ae
ec
as



sadasatsadca





论坛徽章:
38
辰龙
日期:2013-08-21 15:45:19寅虎
日期:2014-06-09 12:52:17双鱼座
日期:2014-06-10 12:42:44巨蟹座
日期:2014-06-12 23:17:17戌狗
日期:2014-06-17 09:53:29未羊
日期:2014-10-10 13:45:41申猴
日期:2015-03-03 17:21:37亥猪
日期:2015-03-03 17:22:002015亚冠之广州富力
日期:2015-05-12 16:34:522015亚冠之卡尔希纳萨夫
日期:2015-05-24 15:24:35黄金圣斗士
日期:2015-12-02 17:25:08平安夜徽章
日期:2015-12-26 00:06:30
发表于 2018-03-14 10:28 |显示全部楼层
本帖最后由 关阴月飞 于 2018-03-14 10:35 编辑

/tmp/kk   文件已经是一个多行的文件, 里面的\n  会被当成  RS 处理,此时你想替换\n, 有两种方法:


1.改变RS
awk -vRS='XXOO' '{gsub("\n","\040")}1'   /tmp/kk

2.改变ORS
awk  1 ORS='\040'   /tmp/kk   

论坛徽章:
0
发表于 2018-03-14 11:34 |显示全部楼层
本帖最后由 本友会机友会摄友会 于 2018-03-14 17:57 编辑

ps第8课:用powershell读写文本、二进制文件。
http://bbs.chinaunix.net/thread-4266404-1-1.html

ps中用-raw打开文本,即可解决多行匹配问题。简单吧。

replace 空格 回车 ,回车空格,来回折腾。

对于7楼的问题,也没必要折腾。还是用-raw

把【回车USER】替换成‘本’,把【回车END】替换成‘友’,
然后替换回车成空格。
然后再把【本友】,替换回即可。
简单死你。

论坛徽章:
0
发表于 2018-03-14 11:43 |显示全部楼层
谢谢关阴月飞大神。
对第1种方法:
请问:  XXOO 什么含义?
对第2种方法:
1 有什么含义。

我想这么实现, 结果出现将回车换成了 32, 什么原因?
gawk 'BEGIN{ ORS='\040' }  { print $0 }'  /tmp/kk
ae32ec32as32323232sadasatsadca32[liuzhy@oc6111388464 ~]$

论坛徽章:
19
程序设计版块每日发帖之星
日期:2016-05-03 06:20:0015-16赛季CBA联赛之山西
日期:2018-08-07 19:46:2315-16赛季CBA联赛之佛山
日期:2018-08-03 13:19:33黑曼巴
日期:2018-07-06 15:19:5015-16赛季CBA联赛之八一
日期:2018-07-05 10:34:0915-16赛季CBA联赛之八一
日期:2018-07-03 16:56:4615-16赛季CBA联赛之深圳
日期:2018-06-15 14:59:3715-16赛季CBA联赛之青岛
日期:2018-06-08 13:45:2815-16赛季CBA联赛之同曦
日期:2018-06-04 19:42:2015-16赛季CBA联赛之山东
日期:2018-05-30 12:44:59CU十四周年纪念徽章
日期:2018-05-15 11:36:3815-16赛季CBA联赛之广东
日期:2018-05-14 09:52:42
发表于 2018-03-14 12:06 |显示全部楼层

我想这么实现, 结果出现将回车换成了 32, 什么原因?
gawk 'BEGIN{ ORS='\040' }  { print $0 }'  /tmp/kk
ae32ec32as32323232sadasatsadca32[liuzhy@oc6111388464 ~]$
  1. gawk 'BEGIN{ ORS="\040" }  { print $0 }'  /tmp/kk
复制代码

论坛徽章:
0
发表于 2018-03-14 13:08 |显示全部楼层
本帖最后由 liuzhy_cu 于 2018-03-14 13:09 编辑

找到原因了: \040看成是8进制, 32 是10进制。
没有转换为8进制的ascii码, 却转换为10进制的数字 : (
gawk 'BEGIN{ ORS='\040' }  { print $0 }'  /tmp/kk
ae32ec32as32323232sadasatsadca32[liuzhy@oc6111388464 ~]$


论坛徽章:
0
发表于 2018-03-14 13:16 |显示全部楼层
本意是想实现转换:
====
User aaaa
aaaa
aaaa
END

====
User bbbb
bbbb
bbbb
END

变为, (====是分隔符)
==== User aaaa aaaa aaaa END
==== User bbbb bbbb bbbb END

论坛徽章:
38
辰龙
日期:2013-08-21 15:45:19寅虎
日期:2014-06-09 12:52:17双鱼座
日期:2014-06-10 12:42:44巨蟹座
日期:2014-06-12 23:17:17戌狗
日期:2014-06-17 09:53:29未羊
日期:2014-10-10 13:45:41申猴
日期:2015-03-03 17:21:37亥猪
日期:2015-03-03 17:22:002015亚冠之广州富力
日期:2015-05-12 16:34:522015亚冠之卡尔希纳萨夫
日期:2015-05-24 15:24:35黄金圣斗士
日期:2015-12-02 17:25:08平安夜徽章
日期:2015-12-26 00:06:30
发表于 2018-03-14 16:23 |显示全部楼层
回复 7# liuzhy_cu

[root@ test]# cat a
====
User aaaa
aaaa
aaaa
END

====
User bbbb
bbbb
bbbb
END
[root@ip test]# awk -vRS='' -vOFS=' ' NF+=0  a
==== User aaaa aaaa aaaa END
==== User bbbb bbbb bbbb END

论坛徽章:
38
辰龙
日期:2013-08-21 15:45:19寅虎
日期:2014-06-09 12:52:17双鱼座
日期:2014-06-10 12:42:44巨蟹座
日期:2014-06-12 23:17:17戌狗
日期:2014-06-17 09:53:29未羊
日期:2014-10-10 13:45:41申猴
日期:2015-03-03 17:21:37亥猪
日期:2015-03-03 17:22:002015亚冠之广州富力
日期:2015-05-12 16:34:522015亚冠之卡尔希纳萨夫
日期:2015-05-24 15:24:35黄金圣斗士
日期:2015-12-02 17:25:08平安夜徽章
日期:2015-12-26 00:06:30
发表于 2018-03-14 16:28 |显示全部楼层
回复 4# liuzhy_cu

对第1种方法:
请问:  XXOO 什么含义?
只是为了改变RS的默认值而已,只要不是\n 就好, xxoo xoxo ooxx 都没关系


对第2种方法:
1 有什么含义。


1  =》 if(1){print $0}  =>  {print $0}

论坛徽章:
19
程序设计版块每日发帖之星
日期:2016-05-03 06:20:0015-16赛季CBA联赛之山西
日期:2018-08-07 19:46:2315-16赛季CBA联赛之佛山
日期:2018-08-03 13:19:33黑曼巴
日期:2018-07-06 15:19:5015-16赛季CBA联赛之八一
日期:2018-07-05 10:34:0915-16赛季CBA联赛之八一
日期:2018-07-03 16:56:4615-16赛季CBA联赛之深圳
日期:2018-06-15 14:59:3715-16赛季CBA联赛之青岛
日期:2018-06-08 13:45:2815-16赛季CBA联赛之同曦
日期:2018-06-04 19:42:2015-16赛季CBA联赛之山东
日期:2018-05-30 12:44:59CU十四周年纪念徽章
日期:2018-05-15 11:36:3815-16赛季CBA联赛之广东
日期:2018-05-14 09:52:42
发表于 2018-03-14 17:14 |显示全部楼层
回复 7# liuzhy_cu


  1. awk '/====/{a=NR}{b[a]=b[a]?b[a]" "$0:$0}END{for(i in b){print b[i]}}' file
复制代码
您需要登录后才可以回帖 登录 | 注册

本版积分规则

【重磅资料】多云网络实战的相关问题汇总!
云网融合的多云网络

本文介绍如何管理私有云数据中心,构建数据中心互联和混合云解决方案。对于OTT 网络架构的深入理解,基本上来源于SIGCOM 的白皮书和一些公开视频。

Overlay SDN 控制器详解

云计算为了适应业务/APP 的快速开发和部署,会把网络分为两层:Overlay 和 Underlay 网络。本文主要讲Overlay网络层面的问题。

超级核心路由器演进

2016 年,网络连接已经采用100G/200G/400G(虽然 400GE 接口技术还未成熟),互联网出口也已经增长到了 T 级别。

获得资料 >>
  

北京盛拓优讯信息技术有限公司. 版权所有 京ICP备16024965号 北京市公安局海淀分局网监中心备案编号:11010802020122
广播电视节目制作经营许可证(京) 字第1234号 中国互联网协会会员  联系我们:wangnan@it168.com
感谢所有关心和支持过ChinaUnix的朋友们 转载本站内容请注明原作者名及出处

清除 Cookies - ChinaUnix - Archiver - WAP - TOP