本文不定期更新
模型的一般使用流程
- init
- fit(x_train, y_train)
- predict(x_test)
模型输出预测概率
- 方法名称: predict_proba(x_test)
- 该方法对于预测时使用概率或者分数的算法来说直接返回概率值,对于不能返回概率的类来说一般返回交叉验证结果的平均值等
- NB: 概率值
- LR: 逻辑回归的分数
- SVM: 交叉验证生成的平均值, 这里的结果与predict预测结果可能有偏差
关于参数
- 待补充
凡事预则立,不预则废
为DataFrame的某一列实行OneHot编码
1 | from sklearn.preprocessing import OneHotEncoder |