忘记密码   免费注册 查看新帖 |

ChinaUnix.net

  平台 论坛 博客 文库 频道自动化运维 虚拟化 储存备份 C/C++ PHP MySQL 嵌入式 Linux系统
最近访问板块 发新帖
查看: 1524 | 回复: 5

perl怎么合并文件 [复制链接]

论坛徽章:
0
发表于 2018-08-13 17:40 |显示全部楼层
文件1:
>12454p p2
aaaaaaaaaaabbbbb
>12455 p1
aaaaabbbbbbbbbbb

文件2:
>12454p p2
abaaaaaaaaabbbbb
>12455 p1
aacaabbbbbbbbbcb


合并后
文件3:
>12454p p2
aaaaaaaaaaabbbbb
abaaaaaaaaabbbbb
>12455 p1
aaaaabbbbbbbbbbb
aacaabbbbbbbbbcb


是的,2个文件中带‘>’的标题是一样的,数量也是一样的。

论坛徽章:
0
发表于 2018-08-14 10:17 |显示全部楼层
文件不大的话,把两个文件做成hash结构
$h->{"12454p p2"} = ["aaaaaaaaaaabbbbb", "abaaaaaaaaabbbbb"]
$h->{"12455 p1"} = ["aaaaabbbbbbbbbbb", "aacaabbbbbbbbbcb"]
然后再写入文件

论坛徽章:
0
发表于 2018-08-15 16:32 |显示全部楼层
#!/usr/bin/perl -w
use strict;
use 5.010;

open my $IN_1  , '<' ,    "orange_in_1.file" or die "Can not read! $!\n";
open my $IN_2  , '<' ,    "orange_in_2.file" or die "Can not read! $!\n";
open my $OUT   , '>' ,    "orange_out.file" or die "Can not write! $!\n";

my @a = <$IN_1>;
my @b = <$IN_2>;

my $line_b = @b;
my $count_line_b = 0;

foreach (@a) {
chomp;
chomp ($b[$count_line_b]);
if (/\>/ && $count_line_b <= $line_b) {
print $OUT "$_\n";
$count_line_b++;
} else {
print $OUT "$_\n$b[$count_line_b]\n";
$count_line_b++;
}
}

close $IN_1;
close $IN_2;
close $OUT;

你试试吧,分别将两个文件的名字改下就行。

论坛徽章:
7
巳蛇
日期:2013-11-28 09:22:59天秤座
日期:2014-10-25 15:40:452015年辞旧岁徽章
日期:2015-03-03 16:54:152015年迎新春徽章
日期:2015-03-04 09:53:172015亚冠之德黑兰石油
日期:2015-07-15 08:46:452015亚冠之平阳省
日期:2015-11-08 16:27:53白银圣斗士
日期:2015-11-14 09:58:12
发表于 2018-08-17 11:02 |显示全部楼层
欢迎使用BioPerl的Bio::SeqIO模块,很好用

论坛徽章:
0
发表于 2018-08-18 16:40 |显示全部楼层
这个问题最难的其实是如果文件1中的内容和文件2中的内容在同一个文件中,然后如何得到文件3中的内容。

论坛徽章:
19
程序设计版块每日发帖之星
日期:2015-10-11 06:20:0015-16赛季CBA联赛之浙江
日期:2018-07-14 13:27:4015-16赛季CBA联赛之同曦
日期:2018-04-17 12:43:3415-16赛季CBA联赛之福建
日期:2018-02-09 14:28:3315-16赛季CBA联赛之四川
日期:2017-09-04 12:27:0315-16赛季CBA联赛之青岛
日期:2017-06-26 18:30:0315-16赛季CBA联赛之新疆
日期:2017-04-12 22:55:4715-16赛季CBA联赛之山东
日期:2016-05-28 18:18:5615-16赛季CBA联赛之新疆
日期:2016-05-07 05:05:3215-16赛季CBA联赛之八一
日期:2016-03-14 12:32:06IT运维版块每日发帖之星
日期:2016-02-27 06:20:0015-16赛季CBA联赛之深圳
日期:2016-01-31 10:37:36
发表于 2018-09-13 11:12 |显示全部楼层
  1. awk 'ARGIND==1{/>/ && b=$0; />/?a[b]=$0:a[b]=a[b]"\n"$0;}ARGIND==2{/>/ && c=$0; />/?a[c]:a[c]=a[c]"\n"$0;}END{for(i in a)print a[i]}' file1 file2
复制代码
您需要登录后才可以回帖 登录 | 注册

本版积分规则

【重磅资料】多云网络实战的相关问题汇总!
云网融合的多云网络

本文介绍如何管理私有云数据中心,构建数据中心互联和混合云解决方案。对于OTT 网络架构的深入理解,基本上来源于SIGCOM 的白皮书和一些公开视频。

Overlay SDN 控制器详解

云计算为了适应业务/APP 的快速开发和部署,会把网络分为两层:Overlay 和 Underlay 网络。本文主要讲Overlay网络层面的问题。

超级核心路由器演进

2016 年,网络连接已经采用100G/200G/400G(虽然 400GE 接口技术还未成熟),互联网出口也已经增长到了 T 级别。

获得资料 >>
  

北京盛拓优讯信息技术有限公司. 版权所有 京ICP备16024965号 北京市公安局海淀分局网监中心备案编号:11010802020122
广播电视节目制作经营许可证(京) 字第1234号 中国互联网协会会员  联系我们:wangnan@it168.com
感谢所有关心和支持过ChinaUnix的朋友们 转载本站内容请注明原作者名及出处

清除 Cookies - ChinaUnix - Archiver - WAP - TOP