R语言中的聚类的使用 - 小明在线

2024-04-09 06:08•javascript•阅读 4285

R语言中的聚类的使用

这里的聚类主要用到K-Means和K-Medoide聚类。在进行聚类之前，为了避免不同参数之间量纲不同所造成的影响，先将数据进行(0-1)标准化

# 如参数weight
data$weight <- (data$weight-min(data$weight))/(max(data$weight)-min(data$weight))

K-Means算法

1.读取数据

data <- read.csv("data/km/data.csv",header = T)

2.调用kmeans算法

# 设置聚类数
cluster_num <- 5
# 调用kmeans算法
km <- kmeans(data,cluster_num)

3.查看分类情况和总体汇总

# 查看具体分类情况
fitted(km)   
# 查看分类概括
table(data$weight, km$cluster)

4.将结果保存

# 构建新数据框映射
df <- data.frame(km[[1]],data$weight)
# 参数重新命名
names(df) <- (c("classification_number","weight"))
# 保存写入
write.csv(df,file="data/km.csv")

K-Medoide算法

这里用到K-Medoide中对大样本数据处理的算法------CLARA算法

1.下载cluster包

install.packages("cluster")

2.引入cluster包

# 引入cluster包
library(cluster)

3.读取数据

data <- read.csv("data/km/data.csv",header = T)

4.调用CLARA算法

# 设置聚类数
cluster_num <- 5
# 调用CLARA算法
cl <- clara(data,cluster_num)

5.将结果保存

# 构建新数据框映射
df <- data.frame(cl$clustering,data$weight)
#参数重新命名
names(df) <- (c("classification_number","weight")) 
# 写入 write.csv(df,file="data/clara.csv")

上一篇 »【转】R语言笔记--颜色的使用
下一篇 »《数据科学：R语言实现》——2.8　获取Facebook数据

R语言中的聚类的使用 - 小明在线

R语言中的聚类的使用

相关推荐

R语言调用C函数 - 旧版本C语言包转移

解决;R语言使用sqldf库是报错\"Failed to connect to database: Error: Access denied for user \'..\'@\'localhost\' ，using password: NO Error in !dbPreExists : invalid argument type\" - 小明在线

Kmeans算法的应用实例，Matlab版本 - KK4SBB

我的R语言入门笔记？

拓端tecdat|R语言解释生存分析中危险率和风险率的变化

R和python语言如何求平均值，中位数和众数？

r语言 函数

R语言的数据结构

r语言函数