计算机工程与应用 ›› 2018, Vol. 54 ›› Issue (3): 150-159.DOI: 10.3778/j.issn.1002-8331.1608-0411
江志良,侯 远,吴 敏
JIANG Zhiliang, HOU Yuan, WU Min
摘要: 对于具有多特征的复杂数据,使用子数据集作为聚类成员的输入并使用加权投票的聚类集成方法可以权衡不同聚类成员的质量,提高聚类的准确性和稳定性。针对子数据集的选择及权重的计算方式,提出了最小相关特征的子数据集选取方法,并基于特征关系分析比较了五种聚类成员的权重计算方法。实验结果表明,使用最小相关特征法选择每个聚类成员的输入数据,相比随机抽样法可提高聚类集成的准确率。基于五种权重计算方法的聚类集成准确率都比单聚类高,且时间消耗有明显差异。