小编Dan*_*Bel的帖子

"statsmodels"和"sklearn"中的Logit估算器

我敢肯定它是一个功能,而不是一个错误,但我想知道是否有一种方法,使sklearn和statsmodels比赛中他们的Logit模型估计.一个非常简单的例子:

import numpy as np
import statsmodels.formula.api as sm
from sklearn.linear_model import LogisticRegression

np.random.seed(123)

n = 100
y = np.random.random_integers(0, 1, n)
x = np.random.random((n, 2))
# Constant term
x[:, 0] = 1.

Run Code Online (Sandbox Code Playgroud)

估计数statsmodels:

sm_lgt = sm.Logit(y, x).fit()
    Optimization terminated successfully.
             Current function value: 0.675320
             Iterations 4
print sm_lgt.params
    [ 0.38442   -1.1429183]

Run Code Online (Sandbox Code Playgroud)

估计与sklearn:

sk_lgt = LogisticRegression(fit_intercept=False).fit(x, y)
print sk_lgt.coef_
    [[ 0.16546794 -0.72637982]]

Run Code Online (Sandbox Code Playgroud)

我认为这与实现有关sklearn,它使用某种正规化.是否可以选择估计一个准系统logit statsmodels(它的速度更快,并且可以更好地扩展).此外,是否sklearn提供推理(标准错误)或边际效应？

python statistics scikit-learn statsmodels logistic-regression

Dan*_*Bel

2014 07-24

4
推荐指数

1
解决办法

2736
查看次数

标签统计

logistic-regression ×1

python ×1

scikit-learn ×1

statistics ×1

statsmodels ×1

"statsmodels"和"sklearn"中的Logit估算器

标签 统计

小编Dan_Bel的帖子

标签统计