博客
关于我
机器学习-无监督学习-聚类:聚类方法(三)--- 谱聚类算法
阅读量:225 次
发布时间:2019-02-28

本文共 535 字,大约阅读时间需要 1 分钟。

谱聚类算法是一种基于图论的无监督学习方法,通过构建拉普拉斯矩阵并利用其特征值和特征向量来实现数据的降维和聚类。以下是对谱聚类算法的详细描述:

  • 谱和谱聚类

    • 谱:方阵的所有特征值的全体统称为方阵的谱。谱半径是最大的特征值,而谱聚类则是基于拉普拉斯矩阵的特征向量进行聚类的方法。
  • 拉普拉斯矩阵

    • 拉普拉斯矩阵L = D - W,其中D是度矩阵,W是相似度矩阵。
    • 度矩阵D中的元素d_i表示样本点x_i与其他样本点的相似度之和。
    • 相似度矩阵W中的元素w_ij表示样本点x_i与x_j的相似度。
  • 计算特征值和特征向量

    • 对拉普拉斯矩阵L计算特征值,并从中选择前k小的特征值。
    • 对应每个选中的特征值,计算其特征向量,将这些特征向量组成矩阵U。
  • 生成新样本点

    • 将矩阵U的每一行作为新的样本点,生成n*k个新样本点。
    • 这些新样本点将用于后续的k-means聚类。
  • k-means聚类

    • 使用k-means算法对新生成的n*k个样本点进行聚类,得到k个聚类簇。
    • 每个聚类簇对应原始数据中的一个簇。
  • 输出聚类结果

    • 最终输出k个聚类簇,每个簇包含属于该簇的样本点集合。
  • 通过以上步骤,谱聚类算法能够有效地将高维数据映射到低维空间,并利用k-means算法完成聚类任务,从而实现数据的有效降维和聚类。

    转载地址:http://ltzp.baihongyu.com/

    你可能感兴趣的文章
    python 使用execjs 报编码错误解决办法,UnicodeDecodeError: ‘gbk‘ codec can‘t decode byte 0xac in position 145: il
    查看>>
    python 使用filetype校验文件
    查看>>
    Python 使用flush函数将缓冲区数据立即写磁盘
    查看>>
    python 使用in判断不准确,in不好使
    查看>>
    Python 使用pandas 进行查询和统计详解
    查看>>
    Redis 配置文件redis.conf详细解释
    查看>>
    python网络爬虫(2)——scrapy框架的基础使用
    查看>>
    python网络爬虫实例教程试读_Python网络爬虫实战教程(全套完整版) - 学途无忧网 - 做技术的王者 - Powered By EduSoho...
    查看>>
    Python 使用哈希函数用于加密
    查看>>
    Python 依赖管理的革新——Poetry 深度解析
    查看>>
    python 保留精度及增加去除数字的千位分隔符(金额化数字)
    查看>>
    python 倒计时 9,8,7,。。。。。。0
    查看>>
    Python 入门开发学习笔记之数据的增删改查
    查看>>
    Python 入门教程(2)搭建环境 2.4、VSCode配置Node.js运行环境
    查看>>
    Python 八大排序算法合集
    查看>>
    python 关于epoll的学习
    查看>>
    Python 内存管理
    查看>>
    Python 内嵌函数:它们有什么用处?
    查看>>
    Python 内置 sum 函数 vs. for 循环性能
    查看>>
    Python 内置时间模块
    查看>>