我有一个包含20000多行和一列的数据表.每列中的字符串具有不同的单词数.我想拆分单词并将它们放在一个新列中.我知道如何逐字逐句地做到:
Data [ , Word1 := as.character(lapply(strsplit(as.character(Data$complaint), split=" "), "[", 1))]
Run Code Online (Sandbox Code Playgroud)
(Data是我的数据表,complaint是列的名称)
显然,这不是有效的,因为每行中的每个单元具有不同数量的单词.
你能告诉我一个更有效的方法吗?
您能告诉我如何生成一个包含100行的字典,每行中0到1之间的随机数作为值?例如,在数据框中,我可以:
df['Rand'] = random.sample(random.random(), 100)
Run Code Online (Sandbox Code Playgroud)
但我不知道如何为字典做这件事.