特征选择与聚合的比较

本文比较了两种降维策略:单变量特征选择与方差分析和特征聚合与Ward层次聚类。这两种方法在回归问题中使用贝叶斯岭作为监督估计器进行比较。

Tweedie回归评分函数

本文介绍了Tweedie回归评分函数的计算方法和应用示例,包括参数说明和代码实现。

数组转换为浮点数数组

介绍如何将数组转换为浮点数数组,包括参数说明、返回值和示例代码。

密度不同的聚类分析

本文通过生成不同密度的数据集,使用OPTICS算法的Xi聚类检测方法和设置特定的可达性阈值来模拟DBSCAN算法,展示了不同阈值下DBSCAN算法的聚类效果。

稀疏编码信号生成示例

本页面展示了如何使用sklearn库中的make_sparse_coded_signal函数生成稀疏编码信号,包括数据集、字典和编码矩阵的生成过程。

机器学习管道中的特征选择

本文介绍了如何在机器学习的管道中集成特征选择,并通过分类报告展示了模型的性能。

生成高斯数据簇

本页面提供了一个关于如何使用scikit-learn库中的make_blobs函数来生成高斯数据簇的详细指南。

半监督学习在乳腺癌数据集上的应用

本文介绍了半监督学习中的自我训练分类器在乳腺癌数据集上的应用,分析了不同阈值对分类器性能的影响。

距离计算函数详解

本文详细介绍了如何使用机器学习库中的函数来计算两点之间的最小距离,并提供了代码示例和参数说明。

高斯过程分类器(GPC)在XOR数据集上的应用

本文介绍了高斯过程分类器(GPC)在XOR数据集上的应用,比较了RBF核和DotProduct核的性能,并提供了详细的代码实现。

数据重采样方法

本文介绍了一种在机器学习中常用的数据重采样方法,包括参数说明、代码示例和使用场景。

瑞士卷数据集生成器

本页面介绍了如何使用瑞士卷数据集生成器来创建三维数据点,并提供了代码示例和相关参考。

使用加权样本计算Gram矩阵

本网页介绍了在使用ElasticNet模型时,如何对加权样本进行预处理以计算Gram矩阵。

R平方回归评分函数详解

本文介绍了R平方(R^2)回归评分函数的计算方法及其在机器学习模型评估中的应用。

随机森林与多输出回归器的比较

本文介绍了如何使用随机森林回归器和多输出回归器进行多目标回归分析。通过比较这两种方法,我们可以了解它们在预测多个输出时的效能和偏差。

稀疏数据集加载指南

本文介绍了如何使用Python加载SVMLight/LibSVM格式的稀疏数据集,并提供了代码示例。

支持向量机(SVM)的平局破解示例

本文介绍了在多类分类问题中,支持向量机(SVM)的平局破解参数break_ties对决策边界的影响。

新闻组数据集加载指南

本页面提供了如何加载和使用20个新闻组数据集的详细指南,包括参数设置和示例代码。

数据局部结构的图连接性分析

本文探讨了在数据聚类中使用图连接性来捕捉数据的局部结构,并分析了稀疏连接矩阵的优势和不同链接方法的稳定性。

汉明损失计算

本文介绍了汉明损失的概念、计算方法以及在多类分类和多标签分类中的应用。

数组转换为浮点数类型

本页面介绍了如何将数组转换为浮点数类型,包括转换过程中的参数设置和数据类型处理。

决策阈值的后处理调整

本文介绍了如何使用TunedThresholdClassifierCV来根据特定指标调整分类器的决策阈值,以优化模型性能。

部分依赖图和个体条件期望

本文介绍了如何使用部分依赖图和个体条件期望(ICE)来分析机器学习模型中特征对预测结果的影响。

scikit-learn 1.0版本发布亮点

本文介绍了scikit-learn 1.0版本的新特性、改进和bug修复。

线性支持向量分类器中支持向量的可视化

本页面展示了如何在线性支持向量分类器(LinearSVC)中获取并可视化支持向量。

二元分类数据生成

本页面介绍了如何生成用于二元分类的样本数据,这些数据基于标准独立高斯分布,并根据特定的规则定义目标变量。

Scikit-learn 全局配置管理器

本文介绍了如何使用Scikit-learn的全局配置管理器来优化机器学习模型的性能和内存使用。

数据特征提取与处理流程

本文介绍了如何使用ColumnTransformer处理包含不同类型特征的数据集,并通过20 newsgroups数据集演示了具体的实现方法。

随机抽样算法详解

本文详细介绍了随机抽样算法的实现方式,包括无替换抽样的概念、参数设置、不同抽样方法的适用场景以及代码示例。

贝叶斯岭回归曲线拟合示例

本网页介绍了如何使用贝叶斯岭回归对正弦波数据进行曲线拟合,并探讨了初始参数选择对模型的影响。

沪ICP备2024098111号-1
上海秋旦网络科技中心:上海市奉贤区金大公路8218号1幢 联系电话:15216758379