字符仅在行尾显示为菱形问号(Python>Text)

use*_*545 4 python text character utf

我正在处理一个 Python 文件,该文件输入一个带有日语字符 (UTF-8) 的文本文件,获取一些文本,然后将其写入一个新的 UTF-8 文本文件。

我遇到的问题是,出于某种原因,每当日本字符 ? 出现在原始输入文件的行尾,在输出文件中显示为菱形问号。

的实例?在一行的末尾之前读得很好,原始输入文件即使在行的末尾也读得很好。

Zda*_*daR 5

由于您尚未共享任何代码片段,因此我建议您utf-8使用以下codecs模块读取和写入文件的通用方法:

# Reading utf-8 encoded file
with codecs.open("in.txt", "r", encoding="utf-8") as input_data:
    data = input_data.read()

# Write utf-8 encoded file
with codecs.open("out.txt", "w", encoding="utf-8") as output_data:
     output_data.write(data)
Run Code Online (Sandbox Code Playgroud)

顺便说一句,我在给定的字符上测试了它?它工作得很好。