将一个包含文本文件的文件夹与单元格中的每个内容组合成一个 CSV

Ett*_*zza 2 python csv r

我有一个包含数千个 .txt 文件的文件夹。我想根据以下模型将它们组合在一个大的 .csv 中:

在此处输入图片说明

我发现一个 R 脚本应该可以完成这项工作(https://gist.github.com/benmarwick/9265414),但它显示了这个错误。

Error in read.table(file = file, header = header, sep = sep, quote = quote,  : duplicate 'row.names' are not allowed 
Run Code Online (Sandbox Code Playgroud)

我不明白我的错误是什么。

无论如何,我很确定有一种方法可以在没有 R 的情况下做到这一点。如果你知道一个非常优雅和简单的方法,那将不胜感激(并且对很多像我这样的人有用)

精确:文本文件是法语,所以不是 ASCII。这是一个示例:https : //www.dropbox.com/s/rj4df94hqisod5z/Texts.zip?dl=0

Nat*_*ren 5

以下python脚本适用于我(其中path_of_directory替换为您的文件所在目录output_file.csv的路径,并且是您要创建/覆盖的文件的路径):

#! /usr/bin/python

import os
import csv

dirpath = 'path_of_directory'
output = 'output_file.csv'
with open(output, 'w') as outfile:
    csvout = csv.writer(outfile)
    csvout.writerow(['FileName', 'Content'])

    files = os.listdir(dirpath)

    for filename in files:
        with open(dirpath + '/' + filename) as afile:
            csvout.writerow([filename, afile.read()])
            afile.close()

    outfile.close()
Run Code Online (Sandbox Code Playgroud)

请注意,这假定目录中的所有内容都是文件。