稳健协方差估计与马氏距离的相关性

本文介绍了在高斯分布数据中使用稳健协方差估计和马氏距离来识别异常值和进行数据聚类。

数组或稀疏矩阵的阈值化处理

本页面介绍了如何使用sklearn库对数组或稀疏矩阵进行阈值化处理,包括参数说明、返回值以及示例代码。

扩展学习与大数据处理

本文介绍了如何使用扩展学习技术处理大数据,包括流式实例处理、特征提取和增量学习算法的应用。

DBSCAN聚类算法提取

本页面介绍了DBSCAN聚类算法的实现和应用,包括算法原理、参数设置和代码示例。

多标签分类数据可视化

本页面展示了如何使用Python和matplotlib库来可视化多标签分类数据。

增量主成分分析(IPCA)示例

本页面展示了增量主成分分析(IPCA)在处理大型数据集时的优势,通过与常规PCA的比较,展示了IPCA在内存使用上的优化,并提供了代码示例和结果图表。

人脸图像补全示例

本网页展示了如何使用多输出估计器来补全人脸图像的下半部分,基于给定的上半部分。比较了极端随机树、K近邻、线性回归和岭回归四种方法的效果。

Oracle Approximating Shrinkage算法详解

本文介绍了Oracle Approximating Shrinkage算法,这是一种用于估计协方差的技术,广泛应用于数据科学和机器学习领域。

葡萄酒数据集介绍

葡萄酒数据集是一个经典的多类分类数据集,包含178个样本,每个样本有13个特征。

基于投票分类器的分类概率可视化

本文介绍了如何使用Python和sklearn库中的VotingClassifier进行软投票分类,并可视化不同分类器对单个样本的分类概率。

L1正则化分类器的C参数下限计算

本页面介绍了如何计算L1正则化分类器的C参数下限,包括参数说明和示例代码。

互信息估计方法

本页面介绍了互信息的概念、计算方法以及在特征选择中的应用。

使用加权样本计算Gram矩阵

本网页介绍了在使用ElasticNet模型时,如何对加权样本进行预处理以计算Gram矩阵。

AdaBoost算法在多标签分类问题中的应用

本文介绍了AdaBoost算法在多标签分类问题上的应用,包括数据集的创建、模型训练、性能分析以及算法的收敛性。

KMeans与MiniBatchKMeans聚类算法比较

本文介绍了KMeans与MiniBatchKMeans两种聚类算法的比较,并通过生成数据集、执行聚类、比较结果和可视化差异来展示这两种算法的不同之处。

无监督学习与降维技术

本文介绍了无监督学习中的降维技术,包括主成分分析(PCA)、随机投影和特征聚合等方法,并讨论了它们在数据预处理中的应用。

Brier得分计算指南

本页面介绍了Brier得分的概念、计算方法和应用场景,以及如何使用Python的sklearn库来计算Brier得分。

处理缺失值的欧几里得距离计算

本文介绍了一种在存在缺失值的情况下计算欧几里得距离的方法,详细解释了算法原理,并提供了Python代码示例。

特征排列重要性与随机森林分类器

本文探讨了如何使用排列重要性来评估随机森林分类器中特征的重要性,并展示了如何处理多重共线性问题,以提高模型的准确性。

机器学习中的决策边界可视化

本文介绍了如何使用Python和机器学习库sklearn来可视化决策边界,特别是针对Iris数据集的多类SGD分类器。

K-Means算法初始化策略的影响评估

本文评估了不同的K-Means算法初始化策略对于算法收敛鲁棒性的影响,通过分析聚类中心的相对标准偏差来衡量。

等值回归算法演示

本页面展示了等值回归算法和线性回归算法在处理具有均匀同质噪声的数据时的效果对比。

平均绝对百分比误差(MAPE)回归损失

本页面介绍了平均绝对百分比误差(MAPE)回归损失的概念、计算方法和应用示例。

KBinsDiscretizer策略演示

本页面展示了KBinsDiscretizer中实现的不同离散化策略,包括均匀离散化、分位数离散化和K均值离散化,并提供了相应的Python代码示例。

scikit-learn 1.0版本发布亮点

本文介绍了scikit-learn 1.0版本的新特性、改进和bug修复。

支持向量机(SVM)核函数练习

本教程旨在通过使用不同的SVM核函数来分类鸢尾花数据集,提供了详细的代码实现和结果展示。

增量计算均值和方差

本页面介绍了如何在CSR或CSC矩阵上沿指定轴增量计算均值和方差。

嵌套与非嵌套交叉验证比较

本文比较了在鸢尾花数据集上的分类器上嵌套与非嵌套交叉验证策略。嵌套交叉验证通常用于训练需要优化超参数的模型。

随机森林分类器的OOB误差分析

本网页介绍了随机森林分类器在训练过程中如何通过OOB误差进行模型验证,并提供了相应的Python代码示例。

聚类完整性度量

聚类完整性度量是一种评估聚类结果的方法,用于判断同一类别的数据点是否被分配到同一个聚类中。

沪ICP备2024098111号-1
上海秋旦网络科技中心:上海市奉贤区金大公路8218号1幢 联系电话:15216758379