国内刊号:11-5602/TP
国际刊号:1673-9418
发布日期:
作者:孙林, 刘梦含, 薛占熬
单位:1. 天津科技大学 人工智能学院,天津 3004572. 河南师范大学 计算机与信息工程学院,河南 新乡 453007
关键词:特征选择,人工蜂群,[K-means]聚类,特征重要度
K-means聚类是一种简捷高效、收敛速度快且易于实现的统计分析方法,但是传统的[K-means]聚类算法对初始聚类中心的选取敏感且易陷入局部最优,同时多数无监督特征选择算法容易忽视特征之间的联系。为此,提出了一种结合人工蜂群与[K-means]聚类的特征选择方法。首先,为了使同一簇中样本的相似度高而不同簇中样本的相似度低,基于簇内聚集度和簇间离散度构建了新的适应度函数,更好地反映各样本的特性,进而构建了蜜源被选择新的概率表达式;其次,设计了随着迭代次数的增加而数值逐渐减小的权重,提出了使蜂群搜索范围动态缩进的蜜源位置更新表达式;然后,为了弥补传统的欧氏距离在计算距离时仅考虑向量之间的累积差异而表现出的局限性,构造了同时考虑样本影响程度不同以及样本的相似性的加权欧氏距离表达式;最后,引入标准差和距离相关系数,定义了特征区分度与特征代表性,以二者之积度量特征重要性。实验结果表明,所提算法加快了人工蜂群算法的收敛速度并提高了[K-means]算法的聚类效果,同时也有效地提升了特征选择的分类效果。
来源:2024年第1期
《计算机科学与探索》期刊编辑部