国内刊号:37-1389/N
国际刊号:1671-9352
发布日期:
作者:卢政宇,李光松,申莹珠,张彬
单位:信息工程大学, 河南 郑州 450001
关键词:未知协议,协议逆向分析,K-均值算法,初始聚类中心,
基金:国家重点研发计划资助项目(2016YFB080010);国家重点研发计划资助项目(2016YFB0800100);国家自然科学基金创新研究群体项目(61521003)
对未知协议消息序列进行聚类处理是分析协议格式的基础。从字符串匹配的角度出发,利用协议格式字段的连续性,在传统K-均值算法基础上提出一种基于连续特征的未知协议消息聚类算法。首先基于协议格式字段连续性对待测数据集进行粗聚类,提取出K-均值算法的初始聚类中心,再使用消息距离及收敛函数改进的迭代算法对数据进行迭代处理实现消息的进一步聚类。实验表明,提出的新方法与传统K-均值算法相比,在聚类准确度上提升了17.58%,迭代次数上减少了约58.27%,与EM算法、DBSCAN算法相比在聚类准确率与时间上均有明显提升。
来源:2019年第5期
《山东大学学报(理学版)》期刊编辑部