在选项卡分隔的文件中有数据,格式如下(filename.tsv):
#a 0 Espert A trius
#b 9 def J我想将这些数据转换成以下表格(我在这里每一行介绍一次):
#@<a>
<0 Espert> <abc> <A trius>.
#@<b>
<9 def> <abc> <J>.我正在介绍每一行。我知道如何使用使用csv模块的python来做同样的事情。但是我正在尝试学习linux命令,在linux终端中是否有一种方法可以使用像grep这样的linux命令呢?
发布于 2014-07-06 04:59:33
awk似乎是适合这项工作的工具:
awk '{
printf "#@<%s>\n<%s %s> <abc> <%s%s%s>.\n",
substr($1,2),
$2,
$3,
$4,
(length($5) ? " " : ""),
$5
}' filename.tsvawk遍历输入文件中的所有行,并通过运行制表符和/或空格将每一行拆分为字段;$1将第一个字段$2引用为第二个字段,.printf函数与C中相同:包含占位符的格式(模板)字符串后面跟着相应的参数来替换占位符。substr($1,2)返回从第二个字符开始的第一个字段的子字符串(即第一行的a,第二行的b )--注意awk中的索引是基于1的。(length($5) ? " " : "")是一个C样式的三元表达式,如果第5个字段为非空字段,则返回一个空格,否则返回一个空字符串。https://stackoverflow.com/questions/24592611
复制相似问题