sklearn.cluster.Kmeans 聚类研究 - 代码天地

sklearn.cluster.Kmeans 聚类研究

其他 2018-09-14 07:49:00 阅读次数: 0

版权声明：本文为博主原创文章，未经博主允许不得转载。 https://blog.csdn.net/u014539580/article/details/78248003

具体的Kmeans算法自行百度，这里只把简单的调用方法展示出来

import numpy as np
import pandas as pd
from sklearn.cluster import KMeans


def loadData(filePath):
    fr = open(filePath,'r+')
    lines = fr.readlines()
    retData = []
    retCityName = []
    for line in lines:
        items = line.strip().split(",")
        retCityName.append(items[0])
        retData.append([float(items[i]) for i in range(1,len(items))])
    return retData,retCityName


if __name__ == '__main__':
    #data,cityName = loadData('city.txt')
    a = np.arange(100)  
    data = a[:20].reshape(4,5).tolist()
    c = a[-20:].reshape(4,5).tolist()
    data.extend(c)
    cityName = ['a','b','c','d','w','x','y','z'] 

    km = KMeans(n_clusters=2)
    label = km.fit_predict(data)

    expenses = np.sum(km.cluster_centers_,axis=1)
    #print(expenses)
    CityCluster = [[],[]]
    for i in range(len(cityName)):
        CityCluster[label[i]].append(cityName[i])
//排序下
    p = pd.DataFrame(CityCluster,index=expenses)
    p = p.sort_index()

    for i in p.index.tolist():
        print('Expenses:%.2f' % i)
        print(p.loc[i].values.tolist())

没找到city.txt 数据集
所以简单的构建了一组模拟数据
data
[[0, 1, 2, 3, 4],
[5, 6, 7, 8, 9],
[10, 11, 12, 13, 14],
[15, 16, 17, 18, 19],
[80, 81, 82, 83, 84],
[85, 86, 87, 88, 89],
[90, 91, 92, 93, 94],
[95, 96, 97, 98, 99]]
每一行分别对应cityName
cityName = [‘a’,’b’,’c’,’d’,’w’,’x’,’y’,’z’]
很明显可以看出应分为abcd 和wxyz两类
调用km = KMeans(n_clusters=2)
label = km.fit_predict(data)
返回的label为1维标签数组 array([0, 0, 0, 0, 1, 1, 1, 1])
将其成功分为两类

猜你喜欢

转载自blog.csdn.net/u014539580/article/details/78248003

sklearn.cluster.Kmeans 聚类研究

聚类--K均值算法：自主实现与sklearn.cluster.KMeans调用

第八次作业--聚类--K均值算法：自主实现与sklearn.cluster.KMeans调用

第八次作业-----#聚类--K均值算法：自主实现与sklearn.cluster.KMeans调用

sklearn.cluster.KMeans中的参数介绍

sklearn聚类KMeans

Python中SKlearn中kmeans聚类

sklearn KMeans聚类算法（总结）

scipy.cluster模块实现kmeans聚类

机器学习sklearn19.0聚类算法——Kmeans算法

聚类算法Kmeans的工作原理和sklearn实现

sklearn之kmeans文本聚类主题输出

sklearn kmeans 手写数字聚类

kmeans聚类

Kmeans聚类算法

Mahout kmeans聚类

kmeans聚类详解

聚类算法Kmeans

MatLab Kmeans聚类

聚类-kmeans

聚类（一）——Kmeans

Kmeans 聚类算法

kmeans聚类作用

理论--KMeans聚类/DBSCAN聚类

【聚类算法】Kmeans聚类

sklearn.cluster聚类模块结构（classes||Functions）及用法

聚类 Cluster

Sklearn - 聚类

聚类算法之Kmeans

聚类算法- Kmeans and DBSCAN

今日推荐

基于大语言模型的开源知识库问答系统 MaxKB GitHub Star 数量突破 5,000 个！

美国拟限制 AI 大模型出口中国和俄罗斯

苹果将与 OpenAI 达成协议，将 ChatGPT 应用于 iPhone

openKylin 社区生态委员会第六次会议圆满召开

阿里云正式发布通义千问 2.5

Python 3.13 发布首个 Beta：实验性自由线程模式和 JIT、改进交互式解释器

Stack Overflow 拿我的代码去训练 AI 大模型，还封了我的账号

Pop!_OS 的 COSMIC 桌面完成 App Store 上架工作

《2024 年一季度互联网投融资运行情况》研究报告

报告：Django 仍然是 74% 开发者的首选

15 年前上了“FFmpeg 耻辱柱”，今天他还得谢谢咱——腾讯QQPlayer一雪前耻？

TIOBE 5 月榜单：Fortran “复活”进入 Top 10

周排行

记一下去大梅沙的准备（2018-05-26）

Spring 注解事务

基于HTTP协议的客户端缓存

阿里云rds 备份和还原

[PHP] 几个拖慢 PHP 程序/API 运行速度的点

python 代码风格------------PEP8规则

js控制json生成菜单——自制菜单（一）

将字符串: 'k:1|k1:2|k2:3|k3:4 ' ,处理成 python 字典: {'k':1, 'k1':2, ...}

微信小程序转支付宝小程序

Qt551.窗口滚动条

每日归档

更多

2024-05-13(18)

2024-05-12(0)

2024-05-11(38)

2024-05-10(38)

2024-05-09(35)

2024-05-08(42)

2024-05-07(14)

2024-05-06(40)

2024-05-05(0)

2024-05-04(7)