相关疑难解决方法(0)

"Unicode错误"unicodeescape"编解码器无法解码字节...无法在Python 3中打开文本文件

我在Windows 7机器上使用python 3.1.俄语是默认的系统语言,utf-8是默认编码.

看看上一个问题的答案,我尝试使用"编解码器"模块给我一点运气.以下是一些例子:

>>> g = codecs.open("C:\Users\Eric\Desktop\beeline.txt", "r", encoding="utf-8")
SyntaxError: (unicode error) 'unicodeescape' codec can't decode bytes in position 2-4: truncated \UXXXXXXXX escape (<pyshell#39>, line 1)
>>> g = codecs.open("C:\Users\Eric\Desktop\Site.txt", "r", encoding="utf-8")
SyntaxError: (unicode error) 'unicodeescape' codec can't decode bytes in position 2-4: truncated \UXXXXXXXX escape (<pyshell#40>, line 1)
>>> g = codecs.open("C:\Python31\Notes.txt", "r", encoding="utf-8")
SyntaxError: (unicode error) 'unicodeescape' codec can't decode bytes in position 11-12: malformed \N character escape (<pyshell#41>, line 1)
>>> g = codecs.open("C:\Users\Eric\Desktop\Site.txt", …
Run Code Online (Sandbox Code Playgroud)

python unicode python-3.x

223
推荐指数
6
解决办法
48万
查看次数

Python中的Windows路径

例如,表示Windows目录的最佳方法是什么"C:\meshes\as"?我一直在尝试修改脚本,但它永远不会起作用,因为我似乎无法正确获取目录,我假设因为'\'扮演转义角色?

python path string-literals

116
推荐指数
5
解决办法
22万
查看次数

使用Python读取UTF8 CSV文件

我正在尝试使用Python(只有法语和/或西班牙语字符)读取带有重音字符的CSV文件.基于csvreader的Python 2.5文档(http://docs.python.org/library/csv.html),我提出了以下代码来读取CSV文件,因为csvreader仅支持ASCII.

def unicode_csv_reader(unicode_csv_data, dialect=csv.excel, **kwargs):
    # csv.py doesn't do Unicode; encode temporarily as UTF-8:
    csv_reader = csv.reader(utf_8_encoder(unicode_csv_data),
                            dialect=dialect, **kwargs)
    for row in csv_reader:
        # decode UTF-8 back to Unicode, cell by cell:
        yield [unicode(cell, 'utf-8') for cell in row]

def utf_8_encoder(unicode_csv_data):
    for line in unicode_csv_data:
        yield line.encode('utf-8')

filename = 'output.csv'
reader = unicode_csv_reader(open(filename))
try:
    products = []
    for field1, field2, field3 in reader:
        ...
Run Code Online (Sandbox Code Playgroud)

以下是我试图阅读的CSV文件的摘录:

0665000FS10120684,SD1200IS,Appareil photo numérique PowerShot de 10 Mpx de Canon avec trépied (SD1200IS) …
Run Code Online (Sandbox Code Playgroud)

python csv utf-8 character-encoding

90
推荐指数
4
解决办法
18万
查看次数

在另一个目录中打开文件(Python)

我一直对Python中的目录遍历问题感到困惑,并且有一种我很好奇的情况:我有一个文件,我想在一个与我当前所在的目录基本平行的目录中访问.鉴于此目录结构:

\parentDirectory
    \subfldr1
        -testfile.txt
    \subfldr2
        -fileOpener.py
Run Code Online (Sandbox Code Playgroud)

我试图在fileOpener.py中编写脚本以退出subfldr2,进入subfldr1,然后在testfile.txt上调用open().

从浏览stackoverflow,我看到人们使用osos.path完成此操作,但我只找到了关于脚本源下的子目录中的文件的示例.

在这方面,我意识到我可以将脚本重新定位到subfldr1然后一切都会很好,但我的好奇心是如何实现这一点.

编辑:这个问题特别适用于Windows机器,因为我不知道驱动器字母和反斜杠将如何影响到这一点.

python windows os.path

13
推荐指数
4
解决办法
7万
查看次数

如何在 Jupyter Notebook 中加载 CSV 文件?

我是新手,正在学习机器学习。我偶然发现了我在网上找到的教程,我想让该程序运行,以便更好地理解。但是,我在将 CSV 文件加载到 Jupyter Notebook 时遇到了问题。

我收到此错误:

File "<ipython-input-2-70e07fb5b537>", line 2
    student_data = pd.read_csv("C:\Users\xxxx\Desktop\student-intervention- 
system\student-data.csv")
                          ^
SyntaxError: (unicode error) 'unicodeescape' codec can't decode bytes in 
position 2-3: truncated \UXXXXXXXX escape
Run Code Online (Sandbox Code Playgroud)

这是代码: 在此处输入图片说明

我在网上学习了有关此错误的教程,但没有任何效果。有谁知道如何修理它?

第 3 次尝试使用 r"path" 在此处输入图片说明

我也试过 "\" 和 utf-8 但没有奏效。

我正在使用最新版本的 Anaconda Windows 7 Python 3.7

python python-3.x jupyter-notebook

8
推荐指数
2
解决办法
10万
查看次数

如何解决 UnicodeDecodeError: 'utf-8' codec can't decode byte 0xff in position 0: invalid start byte in python

我潦草地记下数据,不得不将数据帧保存为 utf-16 (Unicode),因为拉丁语/西班牙语单词以 utf-8 的形式显示很奇怪。我使用以下代码来保存数据帧:

 df.to_csv("blogdata.csv", encoding = "utf-16", sep = "\t", index = False)
Run Code Online (Sandbox Code Playgroud)

当我尝试使用以下代码读取文件以清理数据时:

 blogdata = pd.read_csv('c:/Users/hyoungm?Downloads/blogdata.csv')
Run Code Online (Sandbox Code Playgroud)

它显示以下错误。


() ----> 1 blogdata = pd.read_csv('C:/Users/hyoungm/Downloads/blogdata.csv') 中的 UnicodeDecodeError Traceback(最近一次调用最后一次)

...

pandas._libs.parsers.TextReader 中的 pandas_libs\parsers.pyx。cinit ()

pandas._libs.parsers.TextReader._get_header() 中的 pandas_libs\parsers.pyx

UnicodeDecodeError: 'utf-8' 编解码器无法解码位置 0 中的字节 0xff:起始字节无效

请在此处查看我的屏幕截图: 在此处输入图片说明

我不知道如何在不丢失英文句子中的拉丁文/西班牙文单词的情况下保存原始数据,也不知道如何读取 Unicode 数据文件。有人可以帮我解决这个问题吗?

非常感谢!

python

5
推荐指数
3
解决办法
2万
查看次数