免费注册 查看新帖 |

Chinaunix

  平台 论坛 博客 文库
最近访问板块 发新帖
查看: 1898 | 回复: 3
打印 上一主题 下一主题

[文本处理] 如何将单行内容拆分成两行 [复制链接]

论坛徽章:
0
跳转到指定楼层
1 [收藏(0)] [报告]
发表于 2012-11-12 21:03 |只看该作者 |倒序浏览
文件内容如下:

    <section class='dark full-background middle slide steve-jobs'>
        <h1>On Design</h1>
    </section>

我希望将dark 和 middle 才分出来,变成这样:

<div class='full-background slide steve-jobs'>
    <section class='dark middle'>
        <h1>On Design</h1>
    </section>


注意,dark 和middle 可能有一个不存在,即如下情况:

    <section class='dark  slide steve-jobs'>
        <h1>On Design</h1>
    </section>
作为一个shell脚本熟手,这个问题怎不知道改怎么搞,求指点。

论坛徽章:
93
2015年辞旧岁徽章
日期:2019-10-10 10:51:15CU大牛徽章
日期:2014-02-21 14:21:56CU十二周年纪念徽章
日期:2020-10-15 16:55:55CU大牛徽章
日期:2014-02-21 14:22:07羊年新春福章
日期:2019-10-10 10:51:39CU大牛徽章
日期:2019-10-10 10:55:38季节之章:春
日期:2020-10-15 16:57:40ChinaUnix元老
日期:2019-10-10 10:54:42季节之章:冬
日期:2019-10-10 10:57:17CU大牛徽章
日期:2014-02-21 14:22:52CU大牛徽章
日期:2014-03-13 10:40:30CU大牛徽章
日期:2014-02-21 14:23:15
2 [报告]
发表于 2012-11-13 09:30 |只看该作者
是这个效果么:
  1. [seesea2517@UC ~]# cat a.sed
  2. /<section/!b; h; G; s/(.*\n.*').*('.*)/\1XXXXX\2/; s/dark //; Ta; s/XXXXX/dark XXXXX/; :a; s/middle //; Tb; s/XXXXX/middle/; :b; s/ *<section/<div/; p
  3. [seesea2517@UC ~]# cat file
  4.     <section class='dark full-background middle slide steve-jobs'>
  5.         <h1>On Design</h1>
  6.     </section>

  7.     <section class='dark slide steve-jobs'>
  8.         <h1>On Design</h1>
  9.     </section>
  10. [seesea2517@UC ~]# sed -nrf a.sed file
  11. <div class='full-background slide steve-jobs'>
  12.     <section class='dark middle'>
  13. <div class='slide steve-jobs'>
  14.     <section class='dark middle'>
复制代码

论坛徽章:
93
2015年辞旧岁徽章
日期:2019-10-10 10:51:15CU大牛徽章
日期:2014-02-21 14:21:56CU十二周年纪念徽章
日期:2020-10-15 16:55:55CU大牛徽章
日期:2014-02-21 14:22:07羊年新春福章
日期:2019-10-10 10:51:39CU大牛徽章
日期:2019-10-10 10:55:38季节之章:春
日期:2020-10-15 16:57:40ChinaUnix元老
日期:2019-10-10 10:54:42季节之章:冬
日期:2019-10-10 10:57:17CU大牛徽章
日期:2014-02-21 14:22:52CU大牛徽章
日期:2014-03-13 10:40:30CU大牛徽章
日期:2014-02-21 14:23:15
3 [报告]
发表于 2012-11-13 10:48 |只看该作者
本帖最后由 seesea2517 于 2012-11-13 10:48 编辑

我发现不会用 T 命令:
  1. [seesea2517@UC ~]# sed -rf a.sed file
  2. <div class='full-background slide steve-jobs'>
  3.     <section class='dark middle'>
  4.         <h1>On Design</h1>
  5.     </section>
  6. <div class='slide steve-jobs'>
  7.     <section class='dark'>
  8.         <h1>On Design</h1>
  9.     </section>
  10. <div class='slide steve-jobs'>
  11.      <section class='middle'>
  12.         <h1>On Design</h1>
  13.     </section>
  14. <div class='slide steve-jobs'>
  15.     <section class=''>
  16.         <h1>On Design</h1>
  17.     </section>
  18. [seesea2517@UC ~]# cat file
  19.     <section class='dark full-background middle slide steve-jobs'>
  20.         <h1>On Design</h1>
  21.     </section>
  22.     <section class='dark slide steve-jobs'>
  23.         <h1>On Design</h1>
  24.     </section>
  25.      <section class='middle slide steve-jobs'>
  26.         <h1>On Design</h1>
  27.     </section>
  28.     <section class='slide steve-jobs'>
  29.         <h1>On Design</h1>
  30.     </section>
  31. [seesea2517@UC ~]# cat a.sed
  32. /<section/!b; h; G; s/(.*\n.*').*('.*)/\1XXXXX\2/; /dark/!bb; s/dark //; s/XXXXX/dark XXXXX/; :b; /middle/!bc; s/middle //; s/XXXXX/middle/; :c; s/XXXXX//; s/ +'/'/; s/ *<section/<div/;
复制代码

论坛徽章:
33
荣誉会员
日期:2011-11-23 16:44:17天秤座
日期:2014-08-26 16:18:20天秤座
日期:2014-08-29 10:12:18丑牛
日期:2014-08-29 16:06:45丑牛
日期:2014-09-03 10:28:58射手座
日期:2014-09-03 16:01:17寅虎
日期:2014-09-11 14:24:21天蝎座
日期:2014-09-17 08:33:55IT运维版块每日发帖之星
日期:2016-04-17 06:23:27操作系统版块每日发帖之星
日期:2016-04-18 06:20:00IT运维版块每日发帖之星
日期:2016-04-24 06:20:0015-16赛季CBA联赛之天津
日期:2016-05-06 12:46:59
4 [报告]
发表于 2012-11-13 19:44 |只看该作者
如果量不大, 手工改吧.
因为你写这个脚本, 调试也得半天.

还有你的结果是错的, 因为 新增的"<div>" 没有 封闭.
您需要登录后才可以回帖 登录 | 注册

本版积分规则 发表回复

  

北京盛拓优讯信息技术有限公司. 版权所有 京ICP备16024965号-6 北京市公安局海淀分局网监中心备案编号:11010802020122 niuxiaotong@pcpop.com 17352615567
未成年举报专区
中国互联网协会会员  联系我们:huangweiwei@itpub.net
感谢所有关心和支持过ChinaUnix的朋友们 转载本站内容请注明原作者名及出处

清除 Cookies - ChinaUnix - Archiver - WAP - TOP