我有一个模型(fit),根据历史信息,直到上个月.现在我想预测当前月份使用我的模型.当我尝试调用以下代码时:
predicted <- predict(fit, testData[-$Readmit])
Run Code Online (Sandbox Code Playgroud)
我收到以下错误:
Error in UseMethod("predict") : no applicable method for 'predict'
applied to an object of class "train"
Run Code Online (Sandbox Code Playgroud)
笔记:
train来自插入符号包的函数,使用随机森林算法这predict是一个泛型函数,它将根据第一个输入参数调用特定的预测函数.在我的情况下,它将是:
>fit$modelInfo$label
[1] "Random Forest"
因此,调用的预测方法将是:predict.randomForest.有关详细信息,请参阅[插入文档] [3].
这里是生成模型并调用它的摘要源代码:
# Script-1: create a model:
fit <- train(testData[-$Readmit], testData$Readmit)
saveRDS(fit, modelFileName) # save the fit object into a file
# Script-2: predict
fit <- readRDS(modelFileName) # Load the model (generated previously)
predicted <- predict(fit, testData[-$Readmit])
Run Code Online (Sandbox Code Playgroud)
注意:生成模型的执行时间大约为3小时,这就是为什么我保存对象以便在此之后重用.
训练模型中的数据集如下结构: …
我想在我的VBA脚本中获取在Excel中使用条件格式设置规则分配的单元格背景颜色.我意识到使用Range.Interior.Color属性不具有Excel中应用的条件格式设置功能的颜色.
我做了一些研究,我在这里找到了很长的路,它编译并运行,但我没有得到指定的颜色[我得到总是(255,255,255)]
我正在使用Excel 2016,我想知道是否有一种更简单的方法来使用一些内置的VBA函数或使用任何其他excel技巧来获取此信息.
使用后创建模型后h2o.randomForest,使用:
perf <- h2o.performance(model, test)
print(perf)
Run Code Online (Sandbox Code Playgroud)
我得到以下信息(价值H2OModelMetrics对象)
H2OBinomialMetrics: drf
MSE: 0.1353948
RMSE: 0.3679604
LogLoss: 0.4639761
Mean Per-Class Error: 0.3733908
AUC: 0.6681437
Gini: 0.3362873
Confusion Matrix (vertical: actual; across: predicted)
for F1-optimal threshold:
0 1 Error Rate
0 2109 1008 0.323388 =1008/3117
1 257 350 0.423394 =257/607
Totals 2366 1358 0.339689 =1265/3724
Maximum Metrics: Maximum metrics at their respective thresholds
metric threshold value idx
1 max f1 0.080124 0.356234 248
2 max f2 0.038274 0.515566 330
3 …Run Code Online (Sandbox Code Playgroud) 我想了解H2o R-package中h2o.predict()函数的值(结果)的含义。我意识到在某些情况下,当predict列是 时1,p1列的值低于列p0。我对p0和p1列的解释是指每个事件的概率,所以我预计predict=1的概率p1应该高于相反事件的概率 ( p0),但它并不总是发生,正如我在以下示例中所示:使用前列腺数据集。
这是可执行示例:
library(h2o)
h2o.init(max_mem_size = "12g", nthreads = -1)
prostate.hex <- h2o.importFile("https://h2o-public-test-data.s3.amazonaws.com/smalldata/prostate/prostate.csv")
prostate.hex$CAPSULE <- as.factor(prostate.hex$CAPSULE)
prostate.hex$RACE <- as.factor(prostate.hex$RACE)
prostate.hex$DCAPS <- as.factor(prostate.hex$DCAPS)
prostate.hex$DPROS <- as.factor(prostate.hex$DPROS)
prostate.hex.split = h2o.splitFrame(data = prostate.hex,
ratios = c(0.70, 0.20, 0.10), seed = 1234)
train.hex <- prostate.hex.split[[1]]
validate.hex <- prostate.hex.split[[2]]
test.hex <- prostate.hex.split[[3]]
fit <- h2o.glm(y = "CAPSULE", x = …Run Code Online (Sandbox Code Playgroud) 我有一个很长的R脚本文件,我想使用SQL Server R服务,阅读它的文档,我还没有看到任何使用的例子:sp_execute_external_script允许加载R脚本文件.所有示例都旨在使用嵌入在SQL语句中的简单r计算,例如以下示例:
DROP PROC IF EXISTS get_iris_dataset;
go
CREATE PROC get_iris_dataset
AS
BEGIN
EXEC sp_execute_external_script
@language = N'R'
, @script = N'iris_data <- iris;'
, @input_data_1 = N''
, @output_data_1_name = N'iris_data'
WITH RESULT SETS (("Sepal.Length" float not null,
"Sepal.Width" float not null,
"Petal.Length" float not null,
"Petal.Width" float not null, "Species" varchar(100)));
END;
go
Run Code Online (Sandbox Code Playgroud)
我需要以某种方式使用r句source("fileName")来执行r句.
注意:我试图使用SQL Server只是因为比我的个人计算机更好的机器性能.
提前致谢,
大卫