【技术干货】菜菜的机器学习sklearn11 -XGBoost

Parts

  1. P1 · 11.0 本周要学习什么内容
  2. P2 · 1 XGBoost前瞻:安装xgboost,xgboost库与sklearn API
  3. P3 · 2.1 梯度提升树(1):集成算法回顾,重要参数n_estimators
  4. P4 · 2.1 梯度提升树(2):参数n_estimators下的建模
  5. P5 · 2.1 梯度提升树(3):参数n_estimators的学习曲线
  6. P6 · 2.1 梯度提升树(4):基于方差-偏差困境改进的学习曲线
  7. P7 · 2.2 梯度提升树(5):控制有放回随机抽样,参数subsample
  8. P8 · 2.3 梯度提升树(6):迭代决策树:重要参数eta
  9. P9 · 2.3 梯度提升树(7):迭代决策树:重要参数eta
Description
菜菜的sklearn课堂直播第11期~!全程基于Python为大家解读sklearn内容~

Comments

华丽小学生 2019-09-28

请问有老师的讲义吗

♥ 8 ↩ 1

那一年严寒 2019-04-29

随机抽样应该会提高泛化能力把,但是又相当于样本减少,所以到底随机抽样会不会提高泛化能力??

♥ 4 ↩ 2

菜菜TsaiTsai 2021-09-26

[给心心]sklearn公开课是正课内容的「节选内容」,领取课件/获取完整版内容,请加vx号littlelion1206~ 爱你们哟~[OK]

♥ 3

new_bee_glass 2020-09-16

讲的很好,非常努力和认真

♥ 2

莫代尔棉 2019-02-12

菜菜小姐姐,讲讲kaggle比赛吧!第一次参加打进25%可能吗

♥ 2 ↩ 2

我就是路过的刘晓萤 2019-02-10

有生之年

♥ 2 ↩ 1

long9797 2020-06-23

eta越小,步子就越小,迭代的次数就越多,就越可能收敛到更精确的值,那么对训练集的拟合岂不就越好,那为什么还会减少过拟合呢?另外,迭代的树越多,意味着模型的复杂度越高,也应该对训练集的拟合程度会升高,应该会过拟合才对啊,为什么反倒提高了模型的泛化能力呢?

♥ 1

在深渊鸭 2023-07-19

老师能讲讲catboost吗

♥ 1 ↩ 1

木子映林 2019-05-13

您好,想问您几个问题。 第一个关于梯度提升的问题。以前看GBDT理论,理解其梯度提升的意义就是不断从偏差中学习。XGB中y更新的公式很像这个原理,但是如果一旦加上随机抽样(递归训练树时数据集不断变化),这一切就不合理了,所以想问一下这个疑惑。(XGB原理还未详细了解)。 第二个关于数据量的。我现在有大于10G的数据,已经按照一定规则分好文件,我想用XGB训练,不知道可不可以。如果可以,麻烦大致说一个思路或者方法?

♥ 1 ↩ 2

晓友同学 2019-03-08

菜菜,可以出一起adaboost 或者stacking

♥ 1

biubiu遇见她 2022-02-17

好懵,怎么一会儿adaboost ,一会儿gbdt,感觉讲的不是xgboost

♥ 1 ↩ 1

Paul--Frank 2021-12-27

大佬们做回归得分是个负值[脸红],这是什么情况呢

↩ 4

51270502341_bili 2021-08-13

菜菜,特征工程中的SelectKBest 接口返回的X特征矩阵怎么知道特征的名字呀,期待回复,谢谢厉害的菜菜

↩ 1

Coder_Xiaopang 2021-07-29

谁知道菜菜有没有那种系统的教学班啊

叮里个当哈 2021-03-10

请问 老师 是怎么做到 隐藏每个cell输出结果的诶?是通过安装什么插件嘛?还是Nbextensions里面的某个插件嘛?还是其他的?谢谢谢谢,灰常感谢~

↩ 2

Jiho233 2021-02-26

讲的好好

harrytsz 2021-01-08

案例中,如果输出运行时详情 silent = False 报警告,就是使用 verbosity = 2 代替。verbosity = 0 (静默)/ 1 (默认)/ 2 (详细)

↩ 1

bili_47234869051 2020-11-28

请问菜菜,learning_curve纵坐标的分数,是怎么算出来的,是R2吗

↩ 4

念念薰衣草的香 2020-09-13

我的R2曲线画出来你老师的差别很多,

↩ 1