我在R里遇到一个奇怪的问题
我有一个大的data.table dataTs1:
Classes ‘data.table’ and 'data.frame': 419172 obs. of 5 variables:
$ TimeStamp: chr "01MAR13:07:15:00" "01MAR13:07:16:00" "01MAR13:07:18:00" ...
$ col1 : chr "ALL1" "ALL1" "ALL1" "ALL1" ...
$ col2 : int NA NA NA NA NA NA NA NA NA NA ...
$ col3 : int 4 4 4 4 4 4 4 4 4 4 ...
$ col4 : int 621 810 4 4 8 1 3 1 1 1 ...
Run Code Online (Sandbox Code Playgroud)
我使用fread函数加载了这个表.
内存分配似乎没问题.
> memory.size(max=TRUE)
[1] …Run Code Online (Sandbox Code Playgroud) 这是我第一次提问,所以请宽大:)
我觉得这很简单.我有一个data.frame,它由一列"Time"组成.它看起来像这样:
-------------------------
> head(Times,10)
Times
1 NA
2 0.448
3 0.130
4 NA
5 NA
6 0.462
7 0.427
8 0.946
9 0.227
10 NA
>
------------------------
Run Code Online (Sandbox Code Playgroud)
这个想法是,第一个NA表示序列的开始,因此,跟随时间应来自相同的标签.到达下一个NA条目后,序列结束.
我现在想要创建一个新的data.frame,它将NA之间的数字转换为列,并按行分隔序列.
Time1 Time2 Time3 Time4
1 0.448 0.130 0.123
2 0.462 0.427 0.946 0.227
>
---------------------------------
Run Code Online (Sandbox Code Playgroud)
你能帮我吗?
假设,我有这样的虚拟数据:
x1 x2 x3 x4 x5 x6
26 25 30 0 23 27
24 0 26 0 22 30
20 0 24 0 21 21
27 0 26 0 27 25
22 0 0 0 28 22
20 0 0 0 24 20
22 0 0 0 20 27
22 0 0 0 23 28
30 0 0 0 27 24
23 0 0 0 24 22
26 0 0 0 26 26
I need clean this data.
1. delete …Run Code Online (Sandbox Code Playgroud) 我有一个对称矩阵,表示演员之间的联系程度。我想取消未连接的顶点。
igraph 中包含的函数(如 delete_edges 或 delete_vertices)不适用于我的情况。我分享我的代码
#import of matrix
matrix3<-import("matrix2a.xlsx")
r.name <- matrix2a [,1]
rownames(matrix2a) <- r.name
matrix2a <- matrix2a %>% select(-X__1)
View(matrix2a)
m=as.matrix(matrix2a)
#I compute the maximum spanning tree graph
g <- graph_from_adjacency_matrix(m, mode = "upper", weighted = T, diag = F)
max_spann_tree <- mst(g, weights = -E(g)$weight)
#I obtain a network with some unconneted vertex that I would like to erase
Run Code Online (Sandbox Code Playgroud)
在此先感谢您的帮助!
我想从某些列中获取值.每行的列不同,并取决于另一列的值.下面的例子应该说明一切.
这就是我所拥有的:
id year data.2014 data.2015
1 2014 21 22
2 2015 23 24
Run Code Online (Sandbox Code Playgroud)
这是我想要的:
id year data.2014 data.2015 data
1 2014 21 22 21
2 2015 23 24 24
Run Code Online (Sandbox Code Playgroud)
先感谢您!
我有2个数据表:items和category
require(data.table)
set.seed(1L) # for reproducibility
category <- data.table(from = c(0,8,15,25,45.5,90,101),
to = c(5,12,20,39,60,100,99999),
class = c("A","B","C","D","E","F","G"))
items <- data.table(weight = sample(0:999,10000,replace=TRUE))
Run Code Online (Sandbox Code Playgroud)
我希望"items"中的每一行都有一个类标签,例如,如果第一项的权重为7,它就会选择"B"类.类别权重不必跨越所有权重,可能存在间隙,因此类别A为0-5,B为8-12,C为15-20等
我可以在数据框中执行此操作%in%,但"item"数据集有1000万个项目,"category"数据集有200多个类别),因此我尝试在数据表中执行此操作.
我该怎么做?
r ×6
data.table ×1
dataframe ×1
date ×1
ggnetwork ×1
igraph ×1
memory ×1
memory-leaks ×1
na ×1
numbers ×1