标签:last 删除 t0 start chr awk 几列 print txt
依据几列的值删除重复行
输入
1.txt
a 1 1
a 1 2
a b 3
a c 4
a c 5
a c 6
a d 7
a d 8
a e 9
a f 10
a f 11
输出
2.txt
a b 3
a e 9
先把1.txt按照指定的几列(第1,2列)排序
sort -k1,1 -k2,2 1.txt > 3.txt
awk
'{last=$0; chr=$1;start=$2; getline; if( chr == $1 && start ==
$2 ) {print last"\t1";print $0"\t1";} else {print last"\t0";print
$0"\t0";}}' 3.txt \
> 4.txt
awk 'BEGIN{getline;print
$0"\t"0;}{last=$0; chr=$1;start=$2; getline; if( chr == $1 &&
start == $2 ) {print last"\t1";print $0"\t1";} else {print
last"\t0";print $0"\t0";}}' 4.txt \
> 5.txt
awk '$4 == 0 && $5 == 0' 5.txt | awk '{print $1"\t"$2"\t"$3;}' > 2.txt
标签:last,删除,t0,start,chr,awk,几列,print,txt 来源: https://www.cnblogs.com/emanlee/p/15177785.html
本站声明: 1. iCode9 技术分享网(下文简称本站)提供的所有内容,仅供技术学习、探讨和分享; 2. 关于本站的所有留言、评论、转载及引用,纯属内容发起人的个人观点,与本站观点和立场无关; 3. 关于本站的所有言论和文字,纯属内容发起人的个人观点,与本站观点和立场无关; 4. 本站文章均是网友提供,不完全保证技术分享内容的完整性、准确性、时效性、风险性和版权归属;如您发现该文章侵犯了您的权益,可联系我们第一时间进行删除; 5. 本站为非盈利性的个人网站,所有内容不会用来进行牟利,也不会利用任何形式的广告来间接获益,纯粹是为了广大技术爱好者提供技术内容和技术思想的分享性交流网站。