[00230818]一种数据聚类方法、系统及数据处理设备
交易价格:
面议
类型:
发明专利
技术成熟度:
正在研发
专利所属地:中国
专利号:CN201310223451.7
交易方式:
完全转让
许可转让
技术入股
联系人:
中国科学院深圳先进技术研究院
所在地:广东深圳市
- 服务承诺
- 产权明晰
-
资料保密
对所交付的所有资料进行保密
- 如实描述
技术详细介绍
本发明适用于数据处理领域,提供了一种数据聚类方法、系统及数据处理设备。所述方法包括以下步骤:输入需要聚类的具有块数据特征的n个对象组成的数据集和期望的类别数k;从所述数据集中选择k个块数据对象作为初始类中心;计算各个对象到所述初始类中心的距离;根据计算出的距离,将每一个块数据对象分配到离其最近的中心,形成k个不相交的类;计算各个类的中心作为新的类中心;重复执行所述根据计算出的距离,将每一个块数据对象分配到离其最近的中心,形成k个不相交的类的步骤;以及所述计算各个类的中心作为新的类中心的步骤,直至算法收敛,获得数据集的划分结果。本发明可以直接对具有块特性的数据进行处理,而不需要对块数据进行压缩处理,避免了信息的丢失,得到的聚类结果比对块数据压缩后的聚类效果更佳。