取文本文件中的第 n 列

2024-10-29 08:35:00
admin
原创
43
摘要:问题描述:我有一个文本文件:1 Q0 1657 1 19.6117 Exp 1 Q0 1410 2 18.8302 Exp 2 Q0 3078 1 18.6695 Exp 2 Q0 2434 2 14.0508 Exp 2 Q0 3129 3 13.5495 Exp 我想像这样取出每一行的第二和第四个单词:1...

问题描述:

我有一个文本文件:

1 Q0 1657 1 19.6117 Exp
1 Q0 1410 2 18.8302 Exp
2 Q0 3078 1 18.6695 Exp
2 Q0 2434 2 14.0508 Exp
2 Q0 3129 3 13.5495 Exp

我想像这样取出每一行的第二和第四个单词:

1657 19.6117
1410 18.8302
3078 18.6695
2434 14.0508
3129 13.5495

我正在使用这个代码:

 nol=$(cat "/path/of/my/text" | wc -l)
 x=1
 while  [ $x -le "$nol" ]
 do
     line=($(sed -n "$x"p /path/of/my/text)
     echo ""${line[1]}" "${line[3]}""  >> out.txt
     x=$(( $x + 1 ))
 done

它可以工作,但是非常复杂并且处理长文本文件需要很长时间。

有没有更简单的方法可以做到这一点?


解决方案 1:

据我所知:

cat filename.txt | awk '{ print $2 $4 }'

或者,正如评论中提到的:

awk '{ print $2 $4 }' filename.txt

解决方案 2:

您可以使用以下cut命令:

cut -d' ' -f3,5 < datafile.txt

印刷

1657 19.6117
1410 18.8302
3078 18.6695
2434 14.0508
3129 13.5495

  • -d' '- 意思是,用作space分隔符

  • -f3,5- 取出并打印第 3 列和第 5 列

作为纯 shell 解决方案,对于大文件来说,速度cut快得多。如果您的文件由多个空格分隔,您可以先将其删除,例如:

sed 's/[     ][     ]*/ /g' < datafile.txt | cut -d' ' -f3,5

其中 (gnu) sed 将用单个替换任何tab或字符。space`space`

对于变体-这里也有一个 perl 解决方案:

perl -lanE 'say "$F[2] $F[4]"' < datafile.txt

解决方案 3:

为了完整起见:

while read -r _ _ one _ two _; do
    echo "$one $two"
done < file.txt

_也可以使用任意变量(例如)junk。重点只是提取列。

演示:

$ while read -r _ _ one _ two _; do echo "$one $two"; done < /tmp/file.txt
1657 19.6117
1410 18.8302
3078 18.6695
2434 14.0508
3129 13.5495

解决方案 4:

还有一个更简单的变体 -

$ while read line
  do
      set $line          # assigns words in line to positional parameters
      echo "$3 $5"
  done < file

解决方案 5:

如果您的文件包含n行,那么您的脚本必须读取该文件n次;因此,如果您将文件的长度加倍,则脚本的工作量就会增加四倍——并且几乎所有工作都被丢弃,因为您要做的就是按顺序循环遍历各行。

相反,循环遍历文件行的最佳方式是使用循环while,并使用条件命令作为read内置命令:

while IFS= read -r line ; do
    # $line is a single line of the file, as a single string
    : ... commands that use $line ...
done < input_file.txt

在您的情况下,由于您想将行拆分为一个数组,并且read内置函数实际上对填充数组变量有特殊的支持,这正是您想要的,因此您可以这样写:

while read -r -a line ; do
    echo ""${line[1]}" "${line[3]}"" >> out.txt
done < /path/of/my/text

或者更好的是:

while read -r -a line ; do
    echo "${line[1]} ${line[3]}"
done < /path/of/my/text > out.txt

但是,对于您正在做的事情,您只需使用该cut实用程序即可:

cut -d' ' -f2,4 < /path/of/my/text > out.txt

(或者awk,正如 Tom van der Woerdt 所建议的,或者perl,甚至sed)。

解决方案 6:

如果您使用结构化数据,这还有额外的好处,即不调用额外的 shell 进程来运行tr和/cut或某些操作。...

(当然,您需要使用条件和合理的替代方案来防止错误输入。)

...
while read line ; 
do 
    lineCols=( $line ) ;
    echo "${lineCols[0]}"
    echo "${lineCols[1]}"
done < $myFQFileToRead ; 
...
相关推荐
  为什么项目管理通常仍然耗时且低效?您是否还在反复更新电子表格、淹没在便利贴中并参加每周更新会议?这确实是耗费时间和精力。借助软件工具的帮助,您可以一目了然地全面了解您的项目。如今,国内外有足够多优秀的项目管理软件可以帮助您掌控每个项目。什么是项目管理软件?项目管理软件是广泛行业用于项目规划、资源分配和调度的软件。它使项...
项目管理软件   601  
  华为IPD与传统研发模式的8大差异在快速变化的商业环境中,产品研发模式的选择直接决定了企业的市场响应速度和竞争力。华为作为全球领先的通信技术解决方案供应商,其成功在很大程度上得益于对产品研发模式的持续创新。华为引入并深度定制的集成产品开发(IPD)体系,相较于传统的研发模式,展现出了显著的差异和优势。本文将详细探讨华为...
IPD流程是谁发明的   7  
  如何通过IPD流程缩短产品上市时间?在快速变化的市场环境中,产品上市时间成为企业竞争力的关键因素之一。集成产品开发(IPD, Integrated Product Development)作为一种先进的产品研发管理方法,通过其结构化的流程设计和跨部门协作机制,显著缩短了产品上市时间,提高了市场响应速度。本文将深入探讨如...
华为IPD流程   9  
  在项目管理领域,IPD(Integrated Product Development,集成产品开发)流程图是连接创意、设计与市场成功的桥梁。它不仅是一个视觉工具,更是一种战略思维方式的体现,帮助团队高效协同,确保产品按时、按质、按量推向市场。尽管IPD流程图可能初看之下显得错综复杂,但只需掌握几个关键点,你便能轻松驾驭...
IPD开发流程管理   8  
  在项目管理领域,集成产品开发(IPD)流程被视为提升产品上市速度、增强团队协作与创新能力的重要工具。然而,尽管IPD流程拥有诸多优势,其实施过程中仍可能遭遇多种挑战,导致项目失败。本文旨在深入探讨八个常见的IPD流程失败原因,并提出相应的解决方法,以帮助项目管理者规避风险,确保项目成功。缺乏明确的项目目标与战略对齐IP...
IPD流程图   8  
热门文章
项目管理软件有哪些?
云禅道AD
禅道项目管理软件

云端的项目管理软件

尊享禅道项目软件收费版功能

无需维护,随时随地协同办公

内置subversion和git源码管理

每天备份,随时转为私有部署

免费试用