u014568921

isodata聚类算法的实现

ISODATA算法是在k-均值算法的基础上，增加对聚类结果的“合并”和“分裂”两个操作，并设定算法运行控制参数的一种聚类算法。迭代次数会影响最终结果，迭代参数选择很重要。

算法步骤如下：

①初始化

设定控制参数：

c：预期的类数；

Nc：初始聚类中心个数（可以不等于c）；

TN：每一类中允许的最少样本数目（若少于此数，就不能单独成为一类）；

TE：类内各特征分量分布的相对标准差上限（大于此数就分裂）；

TC：两类中心间的最小距离下限（若小于此数，这两类应合并）；

NT：在每次迭代中最多可以进行“合并”操作的次数；

NS：允许的最多迭代次数。

选定初始聚类中心

②按最近邻规则将样本集{xi}中每个样本分到某一类中

③依据TN判断合并：如果类ωj中样本数nj< TN，则取消该类的中心zj，Nc=Nc-1，转至② 。

④计算分类后的参数：各类重心、类内平均距离

及总体平均距离

计算各类的重心：

计算各类中样本到类心的平均距离：

计算各个样本到其类内中心的总体平均距离：

⑤判断停止、分裂或合并。

a、若迭代次数Ip =NS，则算法结束；

b、若Nc ≤c/2，则转到⑥ （将一些类分裂）；

c、若Nc ≥2c，则转至⑦ （跳过分裂处理）；

d、若c/2< Nc<2c，当迭代次数Ip是奇数时转至⑥ （分裂处理）；迭代次数Ip是偶数时转至⑦ （合并处理）。

⑥分裂操作

计算各类内样本到类中心的标准差向量

σj=(σ1j, σ2j,…., σnj)T , j=1,2,…..,Nc

计算其各个分量。

求出每一类内标准差向量σj中的最大分量

若有某一类中最大分量大于TE，同时又满足下面两个条件之一：

a、

和

>2(TN+1) b、Nc

c/2

则将该类ωj分裂为两个类，原zj取消且令Nc=Nc+1。

两个新类的中心zj+和zj-分别是在原zj中相应于

的分量加上和减去

，而起它分量不变，其中0<k≤1。

分裂后，Ip=Ip+1, 转至②。

⑦合并操作

计算各类中心间的距离Dij，i=1,2,…,Nc-1; j=1,2,…,Nc

依据TC判断合并。将Dij与TC比较，并将小于TC的那些Dij按递增次序排列，取前NT个。

从最小的Dij开始，将相应的两类合并，并计算合并后的聚类中心。

在一次迭代中，某一类最多只能合并一次。

Nc=Nc-已并掉的类数。

⑧如果迭代次数Ip=NS或过程收敛，则算法结束。否则，Ip=Ip+1，若需要调整参数，则转至①；若不改变参数，则转至②；

具体可参见我上传的资料 isodata聚类算法步骤说明

// isodata-cluster.cpp : 定义控制台应用程序的入口点。
//

#include "stdafx.h"
#include<vector>
#include<algorithm>
#include<set>
#include<time.h>
#include<cstdlib>
#include<iostream>
#include <iterator>
using namespace std;

class isodata
{
private:
	unsigned int K;// 所想要分成的类别数
	unsigned int thetaN;//一个类别至少应具有的样本数目，如小于此数就不作为一个独立的聚类
	double theta_c;// 聚类中心之间距离的最小值,即归并系数，如小于此数，两个聚类进行合并
	double theta_s;// 一个类别中样本标准差最大值
	unsigned int maxcombine;// 每次迭代最多可归并对数
	unsigned int maxiteration;// 最大迭代次数
	unsigned int dim;
	double meandis;
	double alpha;
	unsigned int current_iter;
	vector<vector<int>>dataset;
	typedef vector<double> Centroid;
	struct Cluster
	{
		vector<int>clusterID;
		Centroid center;
		double inner_meandis;
		vector<double>sigma;
	};
	vector<Cluster>clus;
private:
	void init();
	void assign();
	void check_thetaN();
	void update_centers();
	void update_center(Cluster &aa);
	void update_sigma(Cluster &aa);
	void calmeandis();
	void choose_nextstep();
	double distance(const Centroid ¢er, const int k);
	double distance(const Centroid &cen1, const Centroid &cen2);
	void split(const int kk);
	void check_for_split();
	void merge(const int k1, const int k2);
	void check_for_merge();
	void prepare_for_next_itration();
	void show_result();
public:
	isodata()
	{
		time_t t;
		srand(time(&t));
	}
	void generate_data();
	void apply();
	void set_paras();
};

void isodata::show_result()
{
	int num = 0;
	for (int i = 0; i < clus.size(); i++)
	{
		char string[100];
		sprintf(string, "第个%d簇：", i);
		cout << string << endl;
		cout << "中心为 (" << clus[i].center[0] << ","
			<< clus[i].center[1] << ")" << endl;
		for (int j = 0; j < clus[i].clusterID.size(); j++)
		{
			sprintf(string, "编号%d   ", clus[i].clusterID[j]);
			cout << string << "(" << dataset[clus[i].clusterID[j]][0] << ","
				<< dataset[clus[i].clusterID[j]][1] << ")" << endl;
			num++;
		}

		cout << endl << endl;
	}

	_ASSERTE(num == dataset.size());


}


void isodata::generate_data()
{
	int datanums = 100;
	dim = 2;
	for (int i = 0; i < datanums; i++)
	{
		vector<int>data;
		data.resize(dim);
		for (int j = 0; j < dim; j++)
			data[j] = double(rand()) / RAND_MAX * 100;
		dataset.push_back(data);
	}
}

void isodata::set_paras()
{
	K = 5;
	theta_c = 5;
	theta_s = 0.01;
	maxiteration = 10;
	maxcombine = 2;
	thetaN = 5;
	alpha = 0.3;
}

void isodata::prepare_for_next_itration()
{
	for (int i = 0; i < clus.size(); i++)
		clus[i].clusterID.clear();
}

void isodata::apply()
{
	init();
	while (current_iter < maxiteration)
	{
		current_iter++;
		assign();
		check_thetaN();
		update_centers();
		calmeandis();
		choose_nextstep();
		if (current_iter < maxiteration)
			prepare_for_next_itration();
	}
	show_result();
}

double isodata::distance(const Centroid &cen, const int k)
{
	double dis = 0;
	for (int i = 0; i < dim; i++)
		dis += pow(cen[i] - dataset[k][i], 2);
	return sqrt(dis);
}

double isodata::distance(const Centroid ¢er1, const Centroid& center2)
{
	double dis = 0;
	for (int i = 0; i < dim; i++)
		dis += pow(center1[i] - center2[i], 2);
	return sqrt(dis);
}

/*第一步：输入N个模式样本{xi, i = 1, 2, …, N}
预选Nc个初始聚类中心*/
void isodata::init()
{
	clus.resize(K);
	set<int>aa;
	for (int i = 0; i < K; i++)
	{
		clus[i].center.resize(dim);
		int id = double(rand()) / RAND_MAX*dataset.size();
		while (aa.find(id) != aa.end())
		{
			id = double(rand()) / RAND_MAX*dataset.size();
		}
		aa.insert(id);
		for (int j = 0; j < dim; j++)
			clus[i].center[j] = dataset[id][j];
	}
}

/*第二步：将N个模式样本分给最近的聚类Sj */
void isodata::assign()
{
	for (int i = 0; i < dataset.size(); i++)
	{
		double mindis = 100000000;
		int th = -1;
		for (int j = 0; j < clus.size(); j++)
		{
			double dis = distance(clus[j].center, i);
			if (dis < mindis)
			{
				mindis = dis;
				th = j;
			}
		}
		clus[th].clusterID.push_back(i);
	}
}

/*第三步：如果Sj中的样本数目Sj<θN，
则取消该样本子集，此时Nc减去1*/
void isodata::check_thetaN()
{
	vector<int>toerase;
	for (int i = 0; i < clus.size(); i++)
	{
		if (clus[i].clusterID.size() < thetaN)
		{
			toerase.push_back(i);
			for (int j = 0; j < clus[i].clusterID.size(); j++)
			{
				double mindis = 10000000;
				int th = -1;
				for (int m = 0; m < clus.size(); m++)
				{
					if (m == i)
						continue;
					double dis = distance(clus[m].center,
						clus[i].clusterID[j]);
					if (dis < mindis)
					{
						mindis = dis;
						th = m;
					}
				}
				clus[th].clusterID.push_back(
					clus[i].clusterID[j]);
			}
			clus[i].clusterID.clear();
		}
	}
	for (vector<Cluster>::iterator it = clus.begin(); it != clus.end();)
	{
		if (it->clusterID.empty())
			it = clus.erase(it);
		else
			it++;
	}
}

void isodata::update_center(Cluster &aa)
{
	Centroid temp;
	temp.resize(dim);
	for (int j = 0; j < aa.clusterID.size(); j++)
	{
		for (int m = 0; m < dim; m++)
			temp[m] += dataset[aa.
			clusterID[j]][m];
	}
	for (int m = 0; m < dim; m++)
		temp[m] /= aa.clusterID.size();
	aa.center = temp;

}

/*第四步：修正各聚类中心*/
void isodata::update_centers()
{
	for (int i = 0; i < clus.size(); i++)
	{
		update_center(clus[i]);
	}
}
void isodata::update_sigma(Cluster&bb)
{
	bb.sigma.clear();
	bb.sigma.resize(dim);
	for (int j = 0; j < bb.clusterID.size(); j++)
		for (int m = 0; m < dim; m++)
			bb.sigma[m] += pow(bb.center[m] -
			dataset[bb.clusterID[j]][m], 2);
	for (int m = 0; m < dim; m++)
		bb.sigma[m] = sqrt(bb.sigma[m] /
		bb.clusterID.size());

}

/*五六步合并*/
/*第五步：计算各聚类域Sj中模式样本与各聚类中心间的平均距离*/
/*第六步：计算全部模式样本和其对应聚类中心的总平均距离*/
void isodata::calmeandis()
{
	meandis = 0;
	for (int i = 0; i < clus.size(); i++)
	{
		double dis = 0;
		for (int j = 0; j < clus[i].
			clusterID.size(); j++)
		{
			dis += distance(clus[i].center,
				clus[i].clusterID[j]);
		}
		meandis += dis;
		clus[i].inner_meandis = dis /
			clus[i].clusterID.size();
	}
	meandis /= dataset.size();
}


/*第七步：判别下一步进行分裂或合并或迭代运算*/
void isodata::choose_nextstep()
{
	if (current_iter == maxiteration)
	{
		theta_c = 0;
		//goto step 11
		check_for_merge();
	}
	else if (clus.size() < K / 2)
	{
		check_for_split();
	}
	else if (current_iter % 2 == 0 ||
		clus.size() >= 2 * K)
	{
		//goto step 11
		check_for_merge();
	}
	else
	{
		check_for_split();
	}

}
/*八、九、十步合并为分裂操作*/
/*第八步：计算每个聚类中样本距离的标准差向量*/
/*第九步：求每一标准差向量{σj, j = 1, 2, …,
Nc}中的最大分量*/
/*第十步：分裂*/
void isodata::check_for_split()
{
	for (int i = 0; i < clus.size(); i++)
	{
		update_sigma(clus[i]);
	}
	while (true)
	{
		bool flag = false;
		for (int i = 0; i < clus.size(); i++)
		{
			for (int j = 0; j < dim; j++)
			{
				if (clus[i].sigma[j] > theta_s &&
					(clus[i].inner_meandis>meandis&&
					clus[i].clusterID.size()>
					2 * (thetaN + 1) || clus.size() < K / 2))
				{
					flag = true;
					split(i);
				}
			}
		}
		if (!flag)
			break;
		else
			calmeandis();
	}
}

void isodata::split(const int kk)
{
	Cluster newcluster;
	newcluster.center.resize(dim);

	int th = -1;
	double maxval = 0;
	for (int i = 0; i < dim; i++)
	{
		if (clus[kk].sigma[i] > maxval)
		{
			maxval = clus[kk].sigma[i];
			th = i;
		}
	}
	for (int i = 0; i < dim; i++)
	{
		newcluster.center[i] = clus[kk].center[i];
	}
	newcluster.center[th] -= alpha*clus[kk].sigma[th];
	clus[kk].center[th] += alpha*clus[kk].sigma[th];
	for (int i = 0; i < clus[kk].clusterID.size(); i++)
	{
		double d1 = distance(clus[kk].center, clus[kk].clusterID[i]);
		double d2 = distance(newcluster.center, clus[kk].clusterID[i]);
		if (d2 < d1)
			newcluster.clusterID.push_back(clus[kk].clusterID[i]);
	}
	vector<int>cc; cc.reserve(clus[kk].clusterID.size());
	vector<int>aa;
	//insert_iterator<set<int, less<int> > >res_ins(aa, aa.begin()); 

	set_difference(clus[kk].clusterID.begin(), clus[kk].clusterID.end(),
		newcluster.clusterID.begin(), newcluster.clusterID.end(), inserter(aa, aa.begin()));//差集
	clus[kk].clusterID = aa;
	//应该更新meandis sigma。。。
	update_center(newcluster);
	update_sigma(newcluster);
	update_center(clus[kk]);
	update_sigma(clus[kk]);
	clus.push_back(newcluster);
}


/*第十一步：计算全部聚类中心的距离*/
/*第十二步：比较Dij 与θc 的值，将Dij <θc 的值按最小距离次序递增排列*/
/*第十三步：将距离为 的两个聚类中心 和 合并*/
void isodata::check_for_merge()
{
	vector<pair<pair<int, int>, double>>aa;
	for (int i = 0; i < clus.size(); i++)
	{
		for (int j = i + 1; j < clus.size(); j++)
		{
			double dis = distance(clus[i].center, clus[j].center);
			if (dis < theta_c)
			{
				pair<int, int>bb(i, j);
				aa.push_back(pair<pair<int, int>, double>(bb, dis));
			}
		}
	}
	// 利用函数对象实现升降排序    
	struct CompNameEx
	{
		CompNameEx(bool asce) : asce_(asce)
		{}
		bool operator()(pair<pair<int, int>, double>const& pl, pair<pair<int, int>, double>const& pr)
		{
			return asce_ ? pl.second < pr.second : pr.second < pl.second; // 《Eff STL》条款21: 永远让比较函数对相等的值返回false    
		}
	private:
		bool asce_;
	};
	sort(aa.begin(), aa.end(), CompNameEx(true));
	set<int>bb;
	int combinenus = 0;
	for (int i = 0; i < aa.size(); i++)
	{
		if (bb.find(aa[i].first.first) == bb.end()
			&& bb.find(aa[i].first.second) == bb.end())
		{
			bb.insert(aa[i].first.first);
			bb.insert(aa[i].first.second);
			merge(aa[i].first.first, aa[i].first.second);
			combinenus++;
			if (combinenus >= maxcombine)
				break;
		}
	}
	for (vector<Cluster>::iterator it = clus.begin(); it != clus.end();)
	{
		if (it->clusterID.empty())
		{
			it = clus.erase(it);
		}
		else
			it++;
	}

}

void isodata::merge(const int k1, const int k2)//k1、k2顺序不能变
{
	for (int i = 0; i < dim; i++)
		clus[k1].center[i] = (clus[k1].center[i] * clus[k1].clusterID.size() +
		clus[k2].center[i] * clus[k2].clusterID.size()) /
		double(clus[k1].clusterID.size() + clus[k2].clusterID.size());
	//clus[k1].clusterID.insert(clus[k1].clusterID.end(), 
	//	clus[k2].clusterID.begin(), clus[k2].clusterID.end());
	clus[k2].clusterID.clear();
}

int _tmain(int argc, _TCHAR* argv[])
{
	/*vector<int>aa;
	aa.push_back(1);
	aa.push_back(2);
	aa.push_back(3);
	aa.push_back(4);
	aa.push_back(5);
	for (vector<int>::iterator it = aa.begin(); it != aa.end(); )
	{
	cout << *it << endl;
	//it = aa.erase(it);
	//if (it == aa.end())
	//	break;
	if (*it > 3)
	{
	it = aa.insert(it+1, 2);
	cout << *it << endl;
	}
	else
	it++;
	}*/
	isodata iso;
	iso.generate_data();
	iso.set_paras();
	iso.apply();


	system("pause");
	return 0;
}

下面是结果，100个数据，共生成10个簇，结果比kmeans应该好一些

【代码分享】基于改进ISODATA的负荷风电光伏曲线场景聚类算法电力系统爱好者算法聚类机器学习
程序名称：基于改进ISODATA的负荷风电光伏曲线场景聚类算法实现平台：matlab代码简介：提出了一种针对负荷曲线聚类的聚类效果和速度并重的L-ISODATA(Loadcurve-ISODATA)算法。从初始聚类中心的选取和核方法进行非线性映射两个角度对ISODATA聚类算法进行改进，优化了初始化聚类中心的选取策略来加快算法收敛速度，并结合核方法捕捉高维空间的特征提升聚类效果。建立了基于L-IS
栅格数据的空间分析——多元分析进击的码农设计师
多元分析工具主要用于完成遥感影像图的分类问题。平时对遥感图像的处理主要在ENVI软件中实现，因此此处仅做大概介绍。1.ISO聚类：ISO（InteractiveSelf-organization）聚类，即迭代式自组织聚类方法，是最常用的非监督分类算法。ISO聚类工具是使用ISODATA（InteractiveSelf-organizationdataanalysisandtechniquesalg
NUAA模式识别实验报告阿迪不想上班经验分享 python 算法
模式识别实验报告题目一实现至少一个无监督算法：K-均值、ISOData算法、GMM算法等等。并通过数据集实验讨论其性能。可直接使用他人开源代码。任意自选数据集。K-均值算法1.算法原理概念K-均值（K-Means）算法是典型的基于距离的聚类算法，采用距离作为相似性的评价指标，即认为两个对象的距离越近，其相似度就越大。该算法认为簇是由距离靠近的对象组成的，因此把得到紧凑且独立的簇作为最终目标。K个初
K-means、手肘法与K-means优化（K-means++、elkan-means、mini batch k-means）戎梓漩机器学习机器学习 kmeans算法聚类算法无监督学习
目录一、k-means1、简介2、步骤3、总结二、手肘法1、指标2、原理三、k-means++1、简介2、流程四、elkan-means五、minibatchk-means六、ISODATA一、k-means1、简介k-means是一个简单常用的聚类方法，属于无监督学习。通过给定的超参数k，将数据集分成k个簇。k值的选取可以通过交叉验证的方式，多次测试取最优值。示例：k=3假设有k个簇，C1、C2
【RS】基于规则的面向对象分类 RS迷途小书童 Remote Sensing教程数据挖掘 ENVI 基于规则的面向对象分类遥感分类
ENVI使用最多的工具就是分类，这也是很多卫星影像的用途。在ENVI中有很多分类工具，如最基础的监督分类（最大似然法、最小距离、支持向量机、随机森林）、非监督分类（K-means、IsoData），还有面向对象、面向过程的提取，亦或是深度学习模块、精准农业模块。今天给大家介绍一下基于规则的面向对象分类，这里的规则包含光谱、几何等特征，所以博主认为它更适合提取水体、道路等具有明显纹理的地物，或者地物
K-means聚类算法的三种改进(K-means++,ISODATA,Kernel K-means)介绍与对比 WakingStone Algorithm 聚类算法 kmeans
目录一、概述二、经典K-means算法三、K-means++算法四、ISODATA算法六、数据集测试一、概述在本篇文章中将对四种聚类算法(K-means,K-means++,ISODATA和KernelK-means)进行详细介绍，并利用数据集来真实地反映这四种算法之间的区别。首先需要明确的是上述四种算法都属于"硬聚类”算法，即数据集中每一个样本都是被100%确定得分到某一个类别中。与之相对的"软
【风光场景生成】基于改进ISODATA的负荷曲线聚类算法（Matlab代码实现）程序辅导帮聚类算法 matlab
欢迎来到本博客❤️❤️博主优势：博客内容尽量做到思维缜密，逻辑清晰，为了方便读者。⛳️座右铭：行百里者，半于九十。本文目录如下：目录1概述1.1K-means聚类算法及存在的问题1.2ISODATA聚类算法及存在的问题1.3L-ISODATA聚类算法1.4K-L-ISODATA聚类算法2运行结果2.1聚类算法比较2.2K-L-ISODATA聚类算法2.3L-ISODATA聚类算法2.4ISODAT
基于改进ISODATA算法的负荷场景曲线聚类MATLAB程序学习不好的电气仔电网运行优化聚类负荷聚类 ISODATA 负荷场景聚类
正在为您运送作品详情https://mbd.pub/o/bread/ZJqclJ9v参考文献：基于机器学习的短期电力负荷预测和负荷曲线聚类研究_张辰睿（硕士论文）参考其第三章主要内容：主要包含四种聚类算法，K-means聚类、ISODATA聚类、L-ISODATA聚类及K-L-ISODATA聚类，并且包含了对聚类场景以及聚类效果的评价。程序完美运行注释清晰，非常容易理解！！部分程序：%%K-mea
动态聚类法 HHHTTY- 课程-模式识别-qin 聚类数据挖掘
目录动态聚类法一、K—均值算法(K-means)1.1条件及约定1.2基本思想：1.3基于使聚类准则函数最小化准则函数聚类准则1.4算法步骤1.5讨论1.6例题1.7类别数目未知情况下如何使用？1.8如何避免初始聚类中心的影响？二、ISODATA算法2.1ISODATA算法的提出2.2ISODATA算法2.2.1基本步骤和思路动态聚类法两种常用算法：K-均值算法(K-means算法)迭代自组织的数
【风光场景生成】基于改进ISODATA的负荷曲线聚类算法（Matlab代码实现）数学建模与科研电气期刊论文聚类算法 matlab
欢迎来到本博客❤️❤️博主优势：博客内容尽量做到思维缜密，逻辑清晰，为了方便读者。⛳座右铭：行百里者，半于九十。本文目录如下：目录1概述1.1K-means聚类算法及存在的问题1.2ISODATA聚类算法及存在的问题1.3L-ISODATA聚类算法1.4K-L-ISODATA聚类算法2运行结果2.1聚类算法比较2.2K-L-ISODATA聚类算法2.3L-ISODATA聚类算法2.4ISODATA
【风光场景生成】基于改进ISODATA的负荷曲线聚类算法（Matlab代码实现）然哥依旧电力系统聚类算法 matlab
欢迎来到本博客❤️❤️博主优势：博客内容尽量做到思维缜密，逻辑清晰，为了方便读者。⛳️座右铭：行百里者，半于九十。本文目录如下：目录1概述1.1K-means聚类算法及存在的问题1.2ISODATA聚类算法及存在的问题1.3L-ISODATA聚类算法1.4K-L-ISODATA聚类算法2运行结果2.1聚类算法比较2.2K-L-ISODATA聚类算法2.3L-ISODATA聚类算法2.4ISODAT
【风光场景生成】基于改进ISODATA的负荷曲线聚类算法（Matlab代码实现）数学建模与科研电气期刊论文聚类算法 matlab
欢迎来到本博客❤️❤️博主优势：博客内容尽量做到思维缜密，逻辑清晰，为了方便读者。⛳️座右铭：行百里者，半于九十。本文目录如下：目录1概述1.1K-means聚类算法及存在的问题1.2ISODATA聚类算法及存在的问题1.3L-ISODATA聚类算法1.4K-L-ISODATA聚类算法2运行结果2.1聚类算法比较2.2K-L-ISODATA聚类算法2.3L-ISODATA聚类算法2.4ISODAT
机器学习算法：知道canopy、K-means++、二分K-means、K-medoids的优化原理黑马程序员官方机器学习算法机器学习 kmeans
学习目标知道k-means算法的优缺点知道canopy、K-means++、二分K-means、K-medoids的优化原理了解kernelK-means、ISODATA、Mini-batchK-means的优化原理k-means算法小结优点：1.原理简单（靠近中心点），实现容易2.聚类效果中上（依赖K的选择）3.空间复杂度o(N)，时间复杂度o(IKN)N为样本点个数，K为中心点个数，I为迭代次
【图像分割】基于ISODATA算法实现视网膜血管分割提取附matlab代码 matlab科研助手图像处理 matlab 算法开发语言
1简介基于统计模式识别中非监督学习动态聚类算法ISODATA算[1],将彩色图像(RGB空间)中由像素的R、G、B分量组成的三维矢量看作待分类的模式样本,定义相似度函数作为类间合并和分裂的依据,通过设定初始参数进行迭代,考虑聚类算法应用于图像分割的一些具体问题并加以改进,最后将图像分割成互不相交的区域,取得了良好的效果.2部分代码clearall;clc;I=imread('retina_imag
机器学习算法（十二）：聚类意念回复机器学习算法机器学习
目录1K的选择1.1肘部法则(Elbowmethod)1.2目标法则1.3间隔统计量GapStatistic1.4关于K值选择的改进算法——ISODATA算法2聚类算法的评估2.1估计聚类趋势2.2判定数据簇数2.3测定聚类质量2.3.1轮廓系数（SilhouetteCoefficient）2.3.2均方根标准偏差（Root-mean-squarestandarddeviation，RMSSTD）
十三种基于直方图的图像全局二值化算法原理、实现、代码及效果风华明远 Python 图像处理算法 python
十三种基于直方图的图像全局二值化算法实现1.什么是基于直方图的图像全局二值化算法2.灰度平均值3.百分比阈值（P-Tile法）3.基于双峰的阈值3.1基于平均值的阈值3.2基于最小值的阈值方法4.迭代最佳阈值5.大津(OTSU)法6.一维最大熵7.力矩保持法8.模糊集9.Kittler最小错误分类法10.ISODATA11.Shanbhag法12.Yen法1.什么是基于直方图的图像全局二值化算法本
机器学习-无监督算法 hionechance 机器学习知识点
《百面机器学习》读书笔记无监督包括两类学习方法：数据聚类与特征变量关联。聚类算法通过多次迭代寻找数据的最优分割，特征变量关联利用相关性分析方法得到变量间的关系。KmeansKmeans++相对于Kmeans的改进：除了第一个初始聚类中心随机选取外，其他初始聚类中心的选择离现有聚类中心越远越好ISODATA相对于Kmeans而言，无需确定聚类中心个数，通过动态的拆分类别或聚合类别达到聚类的目的。因此
简述isodata算法的原理_算法系列 | DMS 简述及 S32V 平台介绍 Li Siyuan 简述isodata算法的原理
点击蓝字关注我们一、DMS简述1.1、概念简介伴随着社会经济的不断高速发展，人们生活水平不断提高。快速、舒适、便捷的生活也成为人们不断追求的目标，使得中国的用户数量不断增加。但同时，我国一直是世界上因交通事故死亡人数最多的国家之一，据显示，自2000年以来，我国的交通事故发生率已经持续十多年高居世界第一。根据2001年中国交通部的统计，我国48%的车祸由驾驶员疲劳驾驶引起，直接带来了30亿美元。有
高光谱isodata算法，可实现一条一条像素点的读取 Reta&Lisa 算法机器学习 python
独自完成的isodata算法！！！欧耶！我真厉害代码主体是借鉴的这个链接:https://blog.csdn.net/zsiming/article/details/122410398，分裂合并逻辑也没有做更改，但是结合我的自身需要改了很多部分：主要改的是数据读取部分，我要将高高光谱数据一条一条或者一帧一帧的读取，不能一次性全部load进去数据。全部代码见如下：#https://blog.csdn
【老生谈算法】matlab实现isodata算法源码——isodata算法阿里matlab建模师 matlab算法原理详解算法 matlab 聚类
matlab实现isodata算法代码实现1、文档下载：本算法已经整理成文档如下，有需要的朋友可以点击进行下载序号文档（点击下载）本项目文档【老生谈算法】matlab实现isodata算法.docx2、算法详解：%=================
简述isodata算法的原理_ISODATA算法的实现与分析摩方智享简述isodata算法的原理
摘要：ISODATA算法是目前应用比较广泛的，通过引入参数而进行人机交互不断进行分裂与合并的非监督分类算法。本文介绍了ISODATA基本原理与具体实现的过程，并用对参数设定的影响进行了试验和分析。关键词：ISODATA非监督分类算法模式识别一、原理介绍Isodata，迭代自组织分析，通过设定初始参数而引入人机对话环节，并使用归并与分裂的机制，当某两类聚类中心距离小于某一阈值时，将它们合并为一类，当
简述isodata算法的原理_【机器学习】聚类算法：ISODATA算法 weixin_39593340 简述isodata算法的原理
在之前的K-Means算法中，有两大缺陷：(1)K值是事先选好的固定的值(2)随机种子选取可能对结果有影响针对缺陷(2)，我们提出了K-Means++算法，它使得随机种子选取非常合理，进而使得算法更加完美。但是缺陷(1)始终没有解决，也就是说在K-Means算法中K值得选取是事先选好固定的一个值，当时也提出ISODATA算法可以找到合适的K，现在就来详细讲述ISODATA算法的原理，并会给出C++
ISODATA分类法 liangdas 机器学习 ISODATA 机器学习
ISODATA分类法介绍作者：liangdas出处：简单点儿，通俗点儿，机器学习http://blog.csdn.net/liangdas/article/details/39805815引言：上一篇K-Means分类方法，但它一个重要的缺点：分类的类别数目事先必须确定下来，而作为非监督分类，事先我们很难去确定待分类的集合（样本）中到底有多少类别，基于这一缺点，后来人们在K-Means的基础上做了
【聚类】ISODATA使用示例深海沙砾图像处理算法
Kmeans在进行样本聚类时，需要设定样本类别。ISODATA算法是在k-均值算法的基础上，增加对聚类结果的“合并”和“分裂”两个操作，并设定算法运行控制参数的一种聚类算法。因此，ISODATA是一种自适应聚类的算法。算法原理见聚类算法：ISODATA算法。这里给出ISODATA使用示例。首先，利用随机数生成待分类样本。给定一个圆的中心与半径，并设定样本点规模，生成二值样本。voidgenData
isodata算法确定k均值聚类的k值 lvjun93 机器学习 k均值聚类确定K
http://baike.baidu.com/view/3167773.htmhttp://www.cnblogs.com/huadongw/p/4101422.html聚类算法：ISODATA算法1.与K-均值算法的比较–K-均值算法通常适合于分类数目已知的聚类，而ISODATA算法则更加灵活；–从算法角度看，ISODATA算法与K-均值算法相似，聚类中心都是通过样本均值的迭代运算来决定的；–I
ISODATA算法 .癮. 遥感图像处理 matlab 图像分类聚类
在kmean基础上分割，合并。多波段图像计算。思想和网上ISODATA似乎有点不同，当聚类之间不满足条件需要合并或者分裂的时候直接减少增加分类个数，重新进行聚类计算。根据设置的阈值不同会有不同的计算结果。function[data1,K]=ISODATA(data,k,T,s,st)%K,为分类个数，s为判断一个聚类是否过于分散的阈值，T为初始判断聚类均值是否稳定的阈值，t为判断两个聚类之间是否过
机器学习算法优化赵广陆 machinelearning 算法机器学习聚类
目录1Canopy算法配合初始聚类1.1实现流程1.2Canopy算法优缺点2K-means++3二分k-means4k-medoids（k-中心聚类算法）5Kernelk-means6ISODATA7MiniBatchK-Means8小结1Canopy算法配合初始聚类k-means算法小结优点：1.原理简单（靠近中心点），实现容易2.聚类效果中上（依赖K的选择）3.空间复杂度o(N)，时间复杂度
ISODATA源代码 liangdas 机器学习源代码 ISODATA
ISODATA源代码作者：liangdas出处：简单点儿，通俗点儿，机器学习http://blog.csdn.net/liangdas/article/details/39809845下面是我写的ISODATA的源代码，分别有三个文件，一个是ISODATA.h头文件，一个是ISODATA.c文件，另外一个是Main.cpp文件。ISODATA.h和ISODATA.c文件中引用了系统的stdio.h
ISODATA算法 python实现 zsiming 机器学习算法 python 算法聚类
文章目录前言一、ISODATA的流程1.流程图（这里按迭代的奇偶来判断分裂或者合并）二、使用步骤1.代码实现2.迭代过程3.总结前言ISODATA经常被用来与Kmeans算法进行对比，其本质也是按照欧式距离来对样本进行分类，不同的是ISODATA可以根据一个大概的指定类别数去确定最终的聚类数（两者可能不同），而Kmeans指定聚类数是多少后，最终的聚类就一定是多少。一、ISODATA的流程本质上只
opencv实现包含有117种颜色的颜色表 Tilamy opencv HSV空间 opencv C++颜色表影像分类
opencv实现颜色表最近写了一些关于遥感影像非监督分类的一些练手的小程序（K均值、ISODATA聚类），其中最后都需要给最终分类结果中的不同类别赋予不同的色彩。看到许多周围的人都是直接声明一个数组：intR=[0,255];intG=[0,255];intB=[0,255];需要的颜色的时候给不同通道附上对应的值。但是这么做肯定是不够的。第一，手动输入太过麻烦；第二，受到限制。如上面的例子，你只
如何用ruby来写hadoop的mapreduce并生成jar包 wudixiaotie mapreduce
ruby来写hadoop的mapreduce，我用的方法是rubydoop。怎么配置环境呢： 1.安装rvm：不说了网上有 2.安装ruby：由于我以前是做ruby的，所以习惯性的先安装了ruby，起码调试起来比jruby快多了。 3.安装jruby： rvm install jruby然后等待安
java编程思想 -- 访问控制权限百合不是茶 java 访问控制权限单例模式
访问权限是java中一个比较中要的知识点,它规定者什么方法可以访问,什么不可以访问一:包访问权限; 自定义包: package com.wj.control; //包 public class Demo { //定义一个无参的方法 public void DemoPackage(){ System.out.println("调用
[生物与医学]请审慎食用小龙虾 comsci 生物
现在的餐馆里面出售的小龙虾,有一些是在野外捕捉的,这些小龙虾身体里面可能带有某些病毒和细菌,人食用以后可能会导致一些疾病,严重的甚至会死亡..... 所以,参加聚餐的时候,最好不要点小龙虾...就吃养殖的猪肉,牛肉,羊肉和鱼,等动物蛋白质
org.apache.jasper.JasperException: Unable to compile class for JSP: 商人shang maven 2.2 jdk1.8
环境： jdk1.8 maven tomcat7-maven-plugin 2.0 原因： tomcat7-maven-plugin 2.0 不知吃 jdk 1.8，换成 tomcat7-maven-plugin 2.2就行，即 <plugin>
你的垃圾你处理掉了吗?GC oloz GC
前序:本人菜鸟，此文研究学习来自网络，各位牛牛多指教　 1.垃圾收集算法的核心思想　　Java语言建立了垃圾收集机制，用以跟踪正在使用的对象和发现并回收不再使用(引用)的对象。该机制可以有效防范动态内存分配中可能发生的两个危险：因内存垃圾过多而引发的内存耗尽，以及不恰当的内存释放所造成的内存非法引用。　　垃圾收集算法的核心思想是：对虚拟机可用内存空间，即堆空间中的对象进行识别
shiro 和 SESSSION 杨白白 shiro
shiro 在web项目里默认使用的是web容器提供的session，也就是说shiro使用的session是web容器产生的，并不是自己产生的，在用于非web环境时可用其他来源代替。在web工程启动的时候它就和容器绑定在了一起，这是通过web.xml里面的shiroFilter实现的。通过session.getSession()方法会在浏览器cokkice产生JESSIONID，当关闭浏览器，此
移动互联网终端淘宝客如何实现盈利小桔子移動客戶端淘客淘寶App
2012年淘宝联盟平台为站长和淘宝客带来的分成收入突破30亿元，同比增长100%。而来自移动端的分成达1亿元，其中美丽说、蘑菇街、果库、口袋购物等App运营商分成近5000万元。可以看出，虽然目前阶段PC端对于淘客而言仍旧是盈利的大头，但移动端已经呈现出爆发之势。而且这个势头将随着智能终端(手机，平板)的加速普及而更加迅猛
wordpress小工具制作 aichenglong wordpress 小工具
wordpress 使用侧边栏的小工具，很方便调整页面结构小工具的制作过程 1 在自己的主题文件中新建一个文件夹(如widget)，在文件夹中创建一个php(AWP_posts-category.php) 小工具是一个类,想侧边栏一样，还得使用代码注册，他才可以再后台使用，基本的代码一层不变 <?php class AWP_Post_Category extends WP_Wi
JS微信分享 AILIKES js
// 所有功能必须包含在 WeixinApi.ready 中进行 WeixinApi.ready(function(Api) { // 微信分享的数据 var wxData = { &nb
封装探讨百合不是茶 JAVA面向对象封装
//封装属性方法将某些东西包装在一起，通过创建对象或使用静态的方法来调用，称为封装；封装其实就是有选择性地公开或隐藏某些信息，它解决了数据的安全性问题，增加代码的可读性和可维护性在 Aname类中申明三个属性，将其封装在一个类中：通过对象来调用例如 1： //属性将其设为私有姓名 name 可以公开
jquery radio/checkbox change事件不能触发的问题 bijian1013 JavaScript jquery
我想让radio来控制当前我选择的是机动车还是特种车，如下所示： <html> <head> <script src="http://ajax.googleapis.com/ajax/libs/jquery/1.7.1/jquery.min.js" type="text/javascript"><
AngularJS中安全性措施 bijian1013 JavaScript AngularJS 安全性 XSRF JSON漏洞
在使用web应用中，安全性是应该首要考虑的一个问题。AngularJS提供了一些辅助机制，用来防护来自两个常见攻击方向的网络攻击。一.JSON漏洞当使用一个GET请求获取JSON数组信息的时候（尤其是当这一信息非常敏感，
[Maven学习笔记九]Maven发布web项目 bit1129 maven
基于Maven的web项目的标准项目结构 user-project user-core user-service user-web src
【Hive七】Hive用户自定义聚合函数(UDAF) bit1129 hive
用户自定义聚合函数，用户提供的多个入参通过聚合计算(求和、求最大值、求最小值)得到一个聚合计算结果的函数。问题：UDF也可以提供输入多个参数然后输出一个结果的运算，比如加法运算add(3，5)，add这个UDF需要实现UDF的evaluate方法,那么UDF和UDAF的实质分别究竟是什么？ Double evaluate(Double a, Double b)
通过 nginx-lua 给 Nginx 增加 OAuth 支持 ronin47
前言：我们使用Nginx的Lua中间件建立了OAuth2认证和授权层。如果你也有此打算，阅读下面的文档，实现自动化并获得收益。SeatGeek 在过去几年中取得了发展，我们已经积累了不少针对各种任务的不同管理接口。我们通常为新的展示需求创建新模块，比如我们自己的博客、图表等。我们还定期开发内部工具来处理诸如部署、可视化操作及事件处理等事务。在处理这些事务中，我们使用了几个不同的接口来认证： &n
利用tomcat-redis-session-manager做session同步时自定义类对象属性保存不上的解决方法 bsr1983 session
在利用tomcat-redis-session-manager做session同步时，遇到了在session保存一个自定义对象时，修改该对象中的某个属性，session未进行序列化，属性没有被存储到redis中。在 tomcat-redis-session-manager的github上有如下说明： Session Change Tracking As noted in the &qu
《代码大全》表驱动法-Table Driven Approach-1 bylijinnan java 算法
关于Table Driven Approach的一篇非常好的文章： http://www.codeproject.com/Articles/42732/Table-driven-Approach package com.ljn.base; import java.util.Random; public class TableDriven { public
Sybase封锁原理 chicony Sybase
昨天在操作Sybase IQ12.7时意外操作造成了数据库表锁定，不能删除被锁定表数据也不能往其中写入数据。由于着急往该表抽入数据，因此立马着手解决该表的解锁问题。无奈此前没有接触过Sybase IQ12.7这套数据库产品，加之当时已属于下班时间无法求助于支持人员支持，因此只有借助搜索引擎强大的
java异常处理机制 CrazyMizzz java
java异常关键字有以下几个，分别为 try catch final throw throws 他们的定义分别为 try： Opening exception-handling statement. catch： Captures the exception. finally： Runs its code before terminating
hive 数据插入DML语法汇总 daizj hive DML 数据插入
Hive的数据插入DML语法汇总1、Loading files into tables语法：1) LOAD DATA [LOCAL] INPATH 'filepath' [OVERWRITE] INTO TABLE tablename [PARTITION (partcol1=val1, partcol2=val2 ...)]解释：1)、上面命令执行环境为hive客户端环境下： hive>l
工厂设计模式 dcj3sjt126com 设计模式
使用设计模式是促进最佳实践和良好设计的好办法。设计模式可以提供针对常见的编程问题的灵活的解决方案。工厂模式工厂模式（Factory）允许你在代码执行时实例化对象。它之所以被称为工厂模式是因为它负责“生产”对象。工厂方法的参数是你要生成的对象对应的类名称。 Example #1 调用工厂方法（带参数） <?phpclass Example{
mysql字符串查找函数 dcj3sjt126com mysql
FIND_IN_SET(str,strlist) 假如字符串str 在由N 子链组成的字符串列表strlist 中，则返回值的范围在1到 N 之间。一个字符串列表就是一个由一些被‘,’符号分开的自链组成的字符串。如果第一个参数是一个常数字符串，而第二个是type SET列，则 FIND_IN_SET() 函数被优化，使用比特计算。如果str不在strlist 或st
jvm内存管理 easterfly jvm
一、JVM堆内存的划分分为年轻代和年老代。年轻代又分为三部分：一个eden,两个survivor。工作过程是这样的：e区空间满了后，执行minor gc，存活下来的对象放入s0, 对s0仍会进行minor gc，存活下来的的对象放入s1中，对s1同样执行minor gc，依旧存活的对象就放入年老代中；年老代满了之后会执行major gc，这个是stop the word模式，执行
CentOS-6.3安装配置JDK-8 gengzg centos
JAVA_HOME=/usr/java/jdk1.8.0_45 JRE_HOME=/usr/java/jdk1.8.0_45/jre PATH=$PATH:$JAVA_HOME/bin:$JRE_HOME/bin CLASSPATH=.:$JAVA_HOME/lib/dt.jar:$JAVA_HOME/lib/tools.jar:$JRE_HOME/lib export JAVA_HOME
【转】关于web路径的获取方法 huangyc1210 Web 路径
假定你的web application 名称为news,你在浏览器中输入请求路径： http://localhost:8080/news/main/list.jsp 则执行下面向行代码后打印出如下结果： 1、 System.out.println(request.getContextPath()); //可返回站点的根路径。也就是项
php里获取第一个中文首字母并排序远去的渡口数据结构 PHP
很久没来更新博客了，还是觉得工作需要多总结的好。今天来更新一个自己认为比较有成就的问题吧。最近在做储值结算，需求里结算首页需要按门店的首字母A-Z排序。我的数据结构原本是这样的： Array ( [0] => Array ( [sid] => 2885842 [recetcstoredpay] =&g
java内部类 hm4123660 java 内部类匿名内部类成员内部类方法内部类
　在Java中，可以将一个类定义在另一个类里面或者一个方法里面，这样的类称为内部类。内部类仍然是一个独立的类，在编译之后内部类会被编译成独立的.class文件，但是前面冠以外部类的类名和$符号。内部类可以间接解决多继承问题,可以使用内部类继承一个类，外部类继承一个类，实现多继承。 &nb
Caused by: java.lang.IncompatibleClassChangeError: class org.hibernate.cfg.Exten zhb8015
maven pom.xml关于hibernate的配置和异常信息如下，查了好多资料，问题还是没有解决。只知道是包冲突，就是不知道是哪个包....遇到这个问题的分享下是怎么解决的。。 maven pom: <dependency> <groupId>org.hibernate</groupId> <ar
Spark 性能相关参数配置详解－任务调度篇 Stark_Summer spark cache cpu 任务调度 yarn
随着Spark的逐渐成熟完善, 越来越多的可配置参数被添加到Spark中来, 本文试图通过阐述这其中部分参数的工作原理和配置思路, 和大家一起探讨一下如何根据实际场合对Spark进行配置优化。由于篇幅较长，所以在这里分篇组织，如果要看最新完整的网页版内容，可以戳这里：http://spark-config.readthedocs.org/，主要是便
css3滤镜 wangkeheng html css
经常看到一些网站的底部有一些灰色的图标，鼠标移入的时候会变亮，开始以为是js操作src或者bg呢，搜索了一下，发现了一个更好的方法：通过css3的滤镜方法。 html代码： <a href='' class='icon'><img src='utv.jpg' /></a> css代码： .icon{-webkit-filter: graysc

isodata聚类算法的实现

你可能感兴趣的:(ISODATA)