我想知道,如果SAS可以将所有数据集变量都包含在回归模型中而无需全部输入.我以前用过R,我想要一样的东西:
model <- lm(y ~ ., data = d)
Run Code Online (Sandbox Code Playgroud)
但在SAS.提前致谢!
我有一个这样的数据表:
dat <- data.frame(
age = c(0,10,20,40,70,100),
surv = c(1.0,0.9,0.8,0.6,0.3,0.0)
)
Run Code Online (Sandbox Code Playgroud)
我想为每个缺失的年龄(30,50,60,80,90)添加一行,然后我想将 surv 的线性插值添加到新行。所以新行将是 (30,0.7) (80, 0.2) 等。
这只是一个例子。我实际上正在处理一个更大的数据集,从 0 到 5,000,000 乘以 10(有很多缺失的行),所以我需要一些自动化。
谢谢您的帮助!
我有这个字符串:
myStr <- "I am very beautiful btw"
str <- c("very","beauti","bt")
Run Code Online (Sandbox Code Playgroud)
现在我想检查是否myStr包含所有字符串str,如何在R中执行此操作?例如上面应该是TRUE.非常感谢
我的数据集如下所示
John
Tally
mac
hero
Run Code Online (Sandbox Code Playgroud)
我想删除以""开头的字符串
所以结果变量是
John
Tally
hero
Run Code Online (Sandbox Code Playgroud)
我用过
library(stringr)
which(startsWith(names[,1]," "))
Run Code Online (Sandbox Code Playgroud)
得到""的行
请帮我以任何有效的方式删除它?
我想在矩阵上应用滚动窗口模式更新.假设我有一个零的矩阵,如下所示:
mat <- matrix(c(0,1,1,0,1,1,0,0,1,1,1,0,1,0,0,0),nrow=4)
0 1 1 1
1 1 1 0
1 0 1 0
0 0 0 0
Run Code Online (Sandbox Code Playgroud)
我想一次扫描矩阵2值的每一行,并根据这组规则创建一个标签矩阵:
0 0 - then label as A
0 1 - then label as B
1 0 - then label as B
1 1 - then label as C
Run Code Online (Sandbox Code Playgroud)
上述矩阵的所需输出为:( NA显示的值是因为第一个值之前没有值)
NA B C C
NA C C B
NA B B B
NA A A A
Run Code Online (Sandbox Code Playgroud)
我正试图实现这一点R.有没有办法使用其中一种应用方法?或者是否有快速方法将这些数据存储为data.frame并使用诸如dplyr或data.table?之类的软件包进行处理?目前,我正在将其作为for循环处理(当然,这非常非常慢).
我想知道如何在R中做这个图?

我考虑过使用ggplot包中的geom_bar.但是我不知道如何绘制变化的厚度和同时反映多年增长的颜色.
我很欣赏任何想法.
谢谢.
t1 <- strptime("2015-02-17 12:20:00", format = "%Y-%m-%d %H:%M:%S", tz = "America/Chicago")
t2 <- strptime("2015-03-13 15:00:00", format = "%Y-%m-%d %H:%M:%S", tz = "America/Chicago")
as.numeric(abs(difftime(t1, t2, units = "mins", tz = "America/Chicago")))
Run Code Online (Sandbox Code Playgroud)
以上返回34,660,而Excel和http://www.timeanddate.com/date/duration.html均返回34,720.由于2015年3月8日的夏令时,R将t1识别为CST,t2识别为CDT.我想确认R是正确的,而其他两个来源则没有.
我在解决如何从模型系数和模型矩阵中找到预测值时遇到了很多麻烦.我希望有人可以提供帮助.
我目前有一个线性模型,我正在设置两个独立的变量.例如
data <- data.frame(d1,d2,d3)
lm.data <- lm(d1~d2*d3,data)
Run Code Online (Sandbox Code Playgroud)
我现在可以得到系数向量
co.data <- coef(lm.data)
Run Code Online (Sandbox Code Playgroud)
我现在也可以轻松获得模型矩阵
mm.data <- model.matrix(lm.data)
Run Code Online (Sandbox Code Playgroud)
这是我可以丢失的地方!我正在努力教会自己如何在使用predict(lm.data)系数时匹配我可以使用的值.换句话说,我知道从设计矩阵和系数的模型的预测值可以计算,但在过去48小时的工作之后,我真的不知道.
任何帮助都会很棒.
我有扑克手,我需要检查三种.有没有办法看看矢量中的3个元素是否相同,但另外2个元素是否不同?
例如:
hand <- c("Q","Q","6","5","Q")
Run Code Online (Sandbox Code Playgroud)
应该返回TRUE三种.
hand2 <- c("Q","Q","6","6","Q")
Run Code Online (Sandbox Code Playgroud)
......虽然是一个完整的房子,但不应该被认定为三种房子.
好吧,我确信我有一个非常基本的问题,但我在 R 方面太新手,无法解决它。我正在使用 pheatmap 创建热图,并希望显示每个单元格中的原始数字,但也对行进行缩放。问题是当我使用 display_numbers = nrow(theatmap_data) 时,它只显示转换后的缩放数字而不是原始值。
这是截图
library(pheatmap)
t(heatmap_data) -> theatmap_data
pheatmap((theatmap_data),cluster_rows= FALSE, cluster_cols = FALSE,
scale ="row", display_numbers = nrow(theatmap_data))
Run Code Online (Sandbox Code Playgroud)