小编G5W*_*G5W的帖子

达到R中的内存限制

我在R里遇到一个奇怪的问题

我有一个大的data.table dataTs1:

Classes ‘data.table’ and 'data.frame':  419172 obs. of  5 variables:
 $ TimeStamp: chr  "01MAR13:07:15:00" "01MAR13:07:16:00" "01MAR13:07:18:00" ...
 $ col1     : chr  "ALL1" "ALL1" "ALL1" "ALL1" ...
 $ col2     : int  NA NA NA NA NA NA NA NA NA NA ...
 $ col3     : int  4 4 4 4 4 4 4 4 4 4 ...
 $ col4     : int  621 810 4 4 8 1 3 1 1 1 ...
Run Code Online (Sandbox Code Playgroud)

我使用fread函数加载了这个表.

内存分配似乎没问题.

> memory.size(max=TRUE)
[1] …
Run Code Online (Sandbox Code Playgroud)

memory memory-leaks r date

1
推荐指数
1
解决办法
499
查看次数

如何通过NA`s分离包含NA的列?

这是我第一次提问,所以请宽大:)

我觉得这很简单.我有一个data.frame,它由一列"Time"组成.它看起来像这样:

-------------------------
> head(Times,10)
   Times
1     NA
2  0.448
3  0.130
4     NA
5     NA
6  0.462
7  0.427
8  0.946
9  0.227
10    NA
>
------------------------
Run Code Online (Sandbox Code Playgroud)

这个想法是,第一个NA表示序列的开始,因此,跟随时间应来自相同的标签.到达下一个NA条目后,序列结束.

我现在想要创建一个新的data.frame,它将NA之间的数字转换为列,并按行分隔序列.

  Time1 Time2 Time3 Time4
1 0.448 0.130 0.123 
2 0.462 0.427 0.946 0.227
>
---------------------------------
Run Code Online (Sandbox Code Playgroud)

你能帮我吗?

numbers r dataframe na

1
推荐指数
1
解决办法
59
查看次数

删除R中零值的列?

假设,我有这样的虚拟数据:

x1  x2  x3  x4  x5  x6
26  25  30  0   23  27
24  0   26  0   22  30
20  0   24  0   21  21
27  0   26  0   27  25
22  0   0   0   28  22
20  0   0   0   24  20
22  0   0   0   20  27
22  0   0   0   23  28
30  0   0   0   27  24
23  0   0   0   24  22
26  0   0   0   26  26

I need clean this data.
1. delete …
Run Code Online (Sandbox Code Playgroud)

r

1
推荐指数
1
解决办法
489
查看次数

删除未连接的节点 R igraph 或 ggnet

我有一个对称矩阵,表示演员之间的联系程度。我想取消未连接的顶点。

igraph 中包含的函数(如 delete_edges 或 delete_vertices)不适用于我的情况。我分享我的代码

#import of matrix
matrix3<-import("matrix2a.xlsx")
r.name <- matrix2a [,1]
rownames(matrix2a) <- r.name
matrix2a <- matrix2a %>% select(-X__1)
View(matrix2a)
m=as.matrix(matrix2a)
#I compute the maximum spanning tree graph
g <- graph_from_adjacency_matrix(m, mode = "upper", weighted = T, diag = F)
max_spann_tree <- mst(g, weights = -E(g)$weight)
#I obtain a network with some unconneted vertex that I would like to erase
Run Code Online (Sandbox Code Playgroud)

在此先感谢您的帮助!

r igraph ggnetwork

1
推荐指数
1
解决办法
5908
查看次数

如何根据列中的值选择列?

我想从某些列中获取值.每行的列不同,并取决于另一列的值.下面的例子应该说明一切.

这就是我所拥有的:

id   year   data.2014   data.2015
1    2014   21          22
2    2015   23          24
Run Code Online (Sandbox Code Playgroud)

这是我想要的:

id   year   data.2014   data.2015   data
1    2014   21          22          21
2    2015   23          24          24
Run Code Online (Sandbox Code Playgroud)

先感谢您!

r

0
推荐指数
1
解决办法
91
查看次数

连接2个数据表没有任何键,但有一些逻辑链接

我有2个数据表:itemscategory

require(data.table)
set.seed(1L) # for reproducibility
category <- data.table(from = c(0,8,15,25,45.5,90,101), 
                       to = c(5,12,20,39,60,100,99999), 
                       class = c("A","B","C","D","E","F","G"))

items <- data.table(weight = sample(0:999,10000,replace=TRUE))  
Run Code Online (Sandbox Code Playgroud)

我希望"items"中的每一行都有一个类标签,例如,如果第一项的权重为7,它就会选择"B"类.类别权重不必跨越所有权重,可能存在间隙,因此类别A为0-5,B为8-12,C为15-20等

我可以在数据框中执行此操作%in%,但"item"数据集有1000万个项目,"category"数据集有200多个类别),因此我尝试在数据表中执行此操作.

我该怎么做?

r data.table

0
推荐指数
1
解决办法
109
查看次数

标签 统计

r ×6

data.table ×1

dataframe ×1

date ×1

ggnetwork ×1

igraph ×1

memory ×1

memory-leaks ×1

na ×1

numbers ×1