免费注册 查看新帖 |

Chinaunix

  平台 论坛 博客 文库
12下一页
最近访问板块 发新帖
查看: 3250 | 回复: 10
打印 上一主题 下一主题

unix编程难题,如何分解这样的文件 [复制链接]

论坛徽章:
0
跳转到指定楼层
1 [收藏(0)] [报告]
发表于 2009-06-06 18:44 |只看该作者 |倒序浏览
有一些文件,文件A的内容可能如下:
北京#2||erif|23|yu||||||a|^|||$$$
文件B的内容可能如下:
黑白hg|er|nmd|2||||反对法||||||反对jdjf|$$$
等等。总之,文件内容以"|"进行字段分隔,两个“|”之间可以有内容,也可以为空(非空格);现在要求把这些文件按照字段分解到另外的文件中,新文件要求每个字段占据一行,遇到^符号则退出对该文件的处理,遇到$$$符号则表示处理到该文件的尾部。比如文件A处理结果为:(两个“|”之间为空也是一个字段,处理后占一行)
================================
北京#2

erif
23
yu





a
==============================
不用一个一个字符读取,如何快速的达到偶的要求呢因为是从文件到文件转换,要求效率,用fgetc好像不合适吧???同样,如果一个一个字符处理,遇到中文怎么办呢,需要进行扫描转换吗????)
偶尝试用strtok函数,但strtok对两个“|”之间为空的部分不会返回一个空,而是接着处理后面的,直到有数据为止才返回
比如对文件A用strstok后会返回:

================================
北京#2
erif
23
yu
a
==============================
而不是偶上面要求的那样啊?怎么办
另外,文件有可能很长,后面的内容可能会循环,所以也不能固定几个字段,用sprintf来格式化处理

[ 本帖最后由 angel518 于 2009-6-6 19:16 编辑 ]

论坛徽章:
0
2 [报告]
发表于 2009-06-06 18:51 |只看该作者
strtok(char*,‘|’);

论坛徽章:
0
3 [报告]
发表于 2009-06-06 19:14 |只看该作者
偶都说了,用strtok不能满足要求啊

论坛徽章:
0
4 [报告]
发表于 2009-06-06 20:42 |只看该作者
先全部读进来,在弄个DFA就可以搞定了。DFA中遇到非|和^就直接输出,遇到|输出回车遇到^退出就可以了。

[ 本帖最后由 mfzz1134 于 2009-6-6 20:44 编辑 ]

论坛徽章:
0
5 [报告]
发表于 2009-06-06 21:31 |只看该作者
这个还是用脚本比较方便

论坛徽章:
0
6 [报告]
发表于 2009-06-06 21:59 |只看该作者
读进来一个一个判断呗
fgetc 怎么会影响你的效率呢.

论坛徽章:
7
酉鸡
日期:2013-10-30 17:17:51水瓶座
日期:2014-01-25 14:47:21天秤座
日期:2014-02-20 09:49:50处女座
日期:2014-11-04 17:44:082015年亚洲杯之中国
日期:2015-03-09 17:21:312015亚冠之北京国安
日期:2015-06-01 16:58:552015亚冠之山东鲁能
日期:2015-06-19 11:30:08
7 [报告]
发表于 2009-06-06 22:00 |只看该作者
脚本方便啊

论坛徽章:
0
8 [报告]
发表于 2009-06-06 23:37 |只看该作者
原帖由 DQP 于 2009-6-6 21:59 发表
读进来一个一个判断呗
fgetc 怎么会影响你的效率呢.

当然影响那,因为源文件可能很大,而且该转换过程是人机交互,要求转换后人要马上其他操作啊,
怎么提高效率呢

论坛徽章:
0
9 [报告]
发表于 2009-06-08 08:43 |只看该作者
原帖由 syncpk99 于 2009-6-6 22:00 发表
脚本方便啊

就是要用c编写呢

论坛徽章:
14
巨蟹座
日期:2013-11-19 14:09:4615-16赛季CBA联赛之青岛
日期:2016-07-05 12:36:0515-16赛季CBA联赛之广东
日期:2016-06-29 11:45:542015亚冠之全北现代
日期:2015-07-22 08:09:472015年辞旧岁徽章
日期:2015-03-03 16:54:15巨蟹座
日期:2014-12-29 08:22:29射手座
日期:2014-12-05 08:20:39狮子座
日期:2014-11-05 12:33:52寅虎
日期:2014-08-13 09:01:31巳蛇
日期:2014-06-16 16:29:52技术图书徽章
日期:2014-04-15 08:44:01天蝎座
日期:2014-03-11 13:06:45
10 [报告]
发表于 2009-06-08 10:22 |只看该作者

strchr的事例

#include <stdio.h>
#include <string.h>

void split001( const char* str, const char chr )
{
    const char* p1 = str;
    for( const char* p2; (p2=strchr(p1,chr))!=0; p1=p2+1 )
    {
        printf( "\"%.*s\"\n", p2-p1, p1 );
    }
    printf( "\"%s\"\n", p1 );
}

int main()
{
        split001( "北京#2||erif|23|yu||||||a|^|||$$$", '|' );

        return 0;
}
您需要登录后才可以回帖 登录 | 注册

本版积分规则 发表回复

  

北京盛拓优讯信息技术有限公司. 版权所有 京ICP备16024965号-6 北京市公安局海淀分局网监中心备案编号:11010802020122 niuxiaotong@pcpop.com 17352615567
未成年举报专区
中国互联网协会会员  联系我们:huangweiwei@itpub.net
感谢所有关心和支持过ChinaUnix的朋友们 转载本站内容请注明原作者名及出处

清除 Cookies - ChinaUnix - Archiver - WAP - TOP