如何将 Windows 行尾转换为 Unix 行尾(CR/LF 到 LF)

2024-10-09 09:10:00
admin
原创
267
摘要:问题描述:我是一名 Java 开发人员,使用 Ubuntu 进行开发。该项目是在 Windows 中使用 Eclipse 创建的,并使用Windows-1252编码。为了转换为 UTF-8,我使用了重新编码程序:find Web -iname *.java | xargs recode CP1252...UT...

问题描述:

我是一名 Java 开发人员,使用 Ubuntu 进行开发。该项目是在 Windows 中使用 Eclipse 创建的,并使用Windows-1252编码。

为了转换为 UTF-8,我使用了重新编码程序:

find Web -iname *.java | xargs recode CP1252...UTF-8

此命令给出以下错误:

recode: Web/src/br/cits/projeto/geral/presentation/GravacaoMessageHelper.java failed: Ambiguous output in step `CR-LF..data

我已经搜索过它并在Bash 和 Windows 中找到了解决方案,重新编码:步骤“数据..CR-LF”中的输出不明确,它显示:

将行尾从 CR/LF 转换为单个 LF:使用 Vim 编辑文件,给出命令:set ff=unix并保存文件。Recode 现在应该可以正常运行。

很好,但我有很多文件需要删除 CR/LF 字符,但我无法打开每个文件来执行此操作。Vi 没有为 Bash 操作提供任何命令行选项。

sed 能用来做这个吗?怎样做?


解决方案 1:

应该有一个名为的程序dos2unix可以帮你修复行尾。如果你的 Linux 机器上还没有这个程序,可以通过包管理器来使用它。

解决方案 2:

sed无法匹配,`
因为在该行放入模式空间之前,尾随的换行符已被删除,但它可以匹配
,因此你可以通过删除 r 将
(DOS) 转换为
`(Unix):

sed -i 's/
//g' file

警告:这将更改原始文件

但是,您无法通过此方法从 Unix EOL 更改为 DOS 或旧版 Mac ( `
`)。更多阅读材料请见:

如何使用 sed 替换换行符 (n)?

解决方案 3:

实际上,Vim 确实可以满足您的要求。进入 Vim,然后输入以下命令:

:args **/*.java
:argdo set ff=unix | update | next

这些命令中的第一个命令将参数列表设置为每个匹配的文件**/*.java(即所有 Java 文件),并以递归方式进行。这些命令中的第二个命令依次对参数列表中的每个文件执行以下操作:

  • 将行尾设置为 Unix 风格(您已经知道这一点)

  • 如果文件被更改则将其写出

  • 继续下一个文件

解决方案 4:

我对jichao 的回答有一点异议。实际上,您可以相当轻松地完成他刚才谈到的所有操作。不用查找`
`,只需查找行末的回车符即可。

sed -i 's/
$//' "${FILE_NAME}"

要从 Unix 切换回 DOS,只需查找行中的最后一个字符并在其中添加换页符即可。(我将-r使用 grep 正则表达式来简化此操作。)

sed -ri 's/(.)$/
/' "${FILE_NAME}"

理论上,可以通过在最后一个示例中添加代码将文件更改为 Mac 样式,该代码还会将下一行输入附加到第一行,直到所有行都处理完毕。不过,我不会尝试在这里举这个例子。

警告: -i更改实际文件。如果您想要备份,请在 后添加一串字符-i。这会将现有文件移动到同名文件,并在末尾添加您的字符。

更新:通过不费心寻找最后一个字符,可以简化 Unix 到 DOS 的转换并提高效率。这也使我们不需要使用 -r 即可使其工作:

sed -i 's/$/
/' "${FILE_NAME}"

解决方案 5:

tr 命令也可以执行以下操作:

tr -d '
' < winfile.txt > unixfile.txt

并且应该可供您使用。

您需要在脚本中运行 tr,因为它无法处理文件名。例如,创建一个文件 myscript.sh:

#!/bin/bash

for f in `find -iname *.java`; do
    echo "$f"
    tr -d '
' < "$f" > "$f.tr"
    mv "$f.tr" "$f"
    recode CP1252...UTF-8 "$f"
done

运行myscript.sh将处理当前目录及其子目录中的所有 java 文件。

解决方案 6:

为了克服

Ambiguous output in step `CR-LF..data'

简单的解决方案可能是添加-f标志来强制转换。

解决方案 7:

使用下面的命令使用 sed 将文件的行尾转换为 Unix 格式:

sed -i 's/
$//' file_name.sh

此命令将把行尾的所有回车符 (CR) 替换为空。

解决方案 8:

在 IntelliJ(或大多数其他 IDE)上,可以通过进入主菜单 > 文件 > 文件属性 > 行分隔符,然后从列表中选择行尾样式来更改它。

解决方案 9:

尝试一下Bryan Maupin 编写的 Python 脚本(我对其进行了一些修改,使其更加通用):

#!/usr/bin/env python

import sys

input_file_name = sys.argv[1]
output_file_name = sys.argv[2]

input_file = open(input_file_name)
output_file = open(output_file_name, 'w')

line_number = 0

for input_line in input_file:
    line_number += 1
    try:  # first try to decode it using cp1252 (Windows, Western Europe)
        output_line = input_line.decode('cp1252').encode('utf8')
    except UnicodeDecodeError, error:  # if there's an error
        sys.stderr.write('ERROR (line %s):    %s
' % (line_number, error))  # write to stderr
        try:  # then if that fails, try to decode using latin1 (ISO 8859-1)
            output_line = input_line.decode('latin1').encode('utf8')
        except UnicodeDecodeError, error:  # if there's an error
            sys.stderr.write('ERROR (line %s):    %s
' % (line_number, error))  # write to stderr
            sys.exit(1)  # and just keep going
    output_file.write(output_line)

input_file.close()
output_file.close()

您可以使用该脚本

$ ./cp1252_utf8.py file_cp1252.sql file_utf8.sql

解决方案 10:

返回 Windows,告诉 Eclipse 将编码更改为 UTF-8,然后返回 Unix 并运行d2u文件。

相关推荐
  政府信创国产化的10大政策解读一、信创国产化的背景与意义信创国产化,即信息技术应用创新国产化,是当前中国信息技术领域的一个重要发展方向。其核心在于通过自主研发和创新,实现信息技术应用的自主可控,减少对外部技术的依赖,并规避潜在的技术制裁和风险。随着全球信息技术竞争的加剧,以及某些国家对中国在科技领域的打压,信创国产化显...
工程项目管理   1565  
  为什么项目管理通常仍然耗时且低效?您是否还在反复更新电子表格、淹没在便利贴中并参加每周更新会议?这确实是耗费时间和精力。借助软件工具的帮助,您可以一目了然地全面了解您的项目。如今,国内外有足够多优秀的项目管理软件可以帮助您掌控每个项目。什么是项目管理软件?项目管理软件是广泛行业用于项目规划、资源分配和调度的软件。它使项...
项目管理软件   1354  
  信创国产芯片作为信息技术创新的核心领域,对于推动国家自主可控生态建设具有至关重要的意义。在全球科技竞争日益激烈的背景下,实现信息技术的自主可控,摆脱对国外技术的依赖,已成为保障国家信息安全和产业可持续发展的关键。国产芯片作为信创产业的基石,其发展水平直接影响着整个信创生态的构建与完善。通过不断提升国产芯片的技术实力、产...
国产信创系统   21  
  信创生态建设旨在实现信息技术领域的自主创新和安全可控,涵盖了从硬件到软件的全产业链。随着数字化转型的加速,信创生态建设的重要性日益凸显,它不仅关乎国家的信息安全,更是推动产业升级和经济高质量发展的关键力量。然而,在推进信创生态建设的过程中,面临着诸多复杂且严峻的挑战,需要深入剖析并寻找切实可行的解决方案。技术创新难题技...
信创操作系统   27  
  信创产业作为国家信息技术创新发展的重要领域,对于保障国家信息安全、推动产业升级具有关键意义。而国产芯片作为信创产业的核心基石,其研发进展备受关注。在信创国产芯片的研发征程中,面临着诸多复杂且艰巨的难点,这些难点犹如一道道关卡,阻碍着国产芯片的快速发展。然而,科研人员和相关企业并未退缩,积极探索并提出了一系列切实可行的解...
国产化替代产品目录   28  
热门文章
项目管理软件有哪些?
云禅道AD
禅道项目管理软件

云端的项目管理软件

尊享禅道项目软件收费版功能

无需维护,随时随地协同办公

内置subversion和git源码管理

每天备份,随时转为私有部署

免费试用