朴素贝叶斯(Naive Bayes)
本课程通过贝叶斯公式推导与垃圾邮件算例讲解朴素贝叶斯,解决文本自动分类问题,帮助学习者掌握分词、平滑与概率计算完整流程。
手机阅读
学会从数据找规律,让判断有依据而不是凭感觉。
本课程通过贝叶斯公式推导与垃圾邮件算例讲解朴素贝叶斯,解决文本自动分类问题,帮助学习者掌握分词、平滑与概率计算完整流程。
本课程通过算例与源码讲解补集朴素贝叶斯,解决多项式朴素贝叶斯类别不平衡偏向多数类问题,帮助掌握CNB训练预测。
本课程通过鸢尾花与西瓜案例,讲解分类回归决策树分裂准则与剪枝,解决过拟合问题,帮助学习者完成树模型训练可视化,提升结构化建模能力。
本课程从最大间隔思想出发,经软间隔、对偶与核技巧讲解SVM超平面求解,解决线性不可分与噪声敏感,帮助理解C与核函数选择。
本课程通过判别函数推导与散度矩阵分析,讲解LDA分类与降维原理,解决类间不可分与高维特征问题,帮助学习者掌握LDA推导与代码实现。
本课程通过AdaBoost训练机制与指数损失推导,讲解样本权重与弱分类器加权投票,解决弱模型组合为强分类器问题,帮助吃透提升机制。
本课程通过鸢尾花与房价,讲解随机森林Bootstrap采样投票集成,解决单树方差大易过拟合,帮助学习者用sklearn分类回归。
本课程通过公式推导与实例拆解GBDT预测与训练过程,解决残差拟合与学习率作用问题,帮助学习者掌握负梯度拟合,提升机器学习调参能力。
本课程经目标函数推导与数值案例,讲解XGBoost结构正则与二阶泰勒展开,解决GBDT过拟合与叶子输出不稳,帮助掌握分裂增益优化。
本课程经原理推导与sklearn实践,讲解K-means及kmeans++优化,解决初始质心敏感与K值选择,帮助掌握聚类建模方法。
本课程通过高维数据案例讲解PCA方差最大化与协方差矩阵特征分解,解决维度灾难与噪声干扰,帮助学习者完成降维与可视化。
本课程通过距离矩阵演算讲解DBSCAN核心点边界点与簇扩展,及eps/min_samples设定,帮助学习者应对不规则数据聚类。
本课程以抛硬币估计概率为例讲解EM算法E步估后验、M步更新参数直至收敛的实现,解决隐变量参数估计问题,帮助提升统计建模思维。
本课程通过薪资分布案例与EM迭代计算,讲解高斯混合模型概率聚类原理,帮助学习者掌握分布建模方法,提升无监督学习与模型评估能力。
本课程通过TF/IDF推导与向量器拆解,讲解文本数值化与关键词权重,解决文档向量化与特征提取,帮助完成文本特征工程。
本课程通过中文语料示例,讲解词袋模型分词建词表与词频TF-IDF向量化,解决文本无法直接被算法处理,帮助学习者完成文本特征工程。
本课程经Softmax瓶颈分析与Huffman树推导,讲解层次Softmax加速原理,解决大词表计算过大,帮助理解概率优化思路。
本课程通过肿瘤预测与评论分类,讲解二分类多分类多标签评估指标,解决准确率骗人与类别不平衡,帮助学习者按业务选指标,提升评估能力。
本课程通过Tkinter与朴素贝叶斯实战,讲解贝叶斯公式与邮件向量化训练,解决中文垃圾邮件识别,帮助学习者交付可分发桌面分类应用。
本课程通过Tkinter绘图板与SVM+HOG训练,讲解手写数字识别系统,解决像素特征过拟合与位置敏感,帮助学习者视觉项目落地。