坐看流年

数据挖掘-关联分析-Apriori算法Java实现支持度+置信度

apriori算法是最基本的发现频繁项集的算法，它的名字也体现了它的思想——先验，采用逐层搜索迭代的方法，挖掘任何可能的项集，k项集用于挖掘k+1项集。

先验性质

频繁项集的所有非空子集也一定是频繁的

该性质体现了项集挖掘中的反单调性，如果k项集不是频繁的，那么k+1项集一定也不是。基于这一点，算法的基本思想为：

step 1：连接

为了搜索k项集，将k-1项集自连接产生候选的k项集，称为候选集。

为了有效的实现连接，首先对每一项进行排序。其次，若满足连接的条件，则进行连接。

连接的条件，前k-2项相同，k-1项不同

step 2：剪枝

k项集的每一个k-1项子集都存在与k-1项集，并且支持度满足最小支持度阀值。

伪代码：

C<k>:candidata itemset of size k
L<k>:frequent itemset of size k
L<1>=frequent items
for(k=1;L<k>!=null;k++)
    C<k+1>=candidates generated from L<k>
    for transaction t in dataset
        increment the count of all candidates in C<k+1> that are contained in t     L<k+1>=candidates in C<k+1> with support>=min_support
return

Java代码实现方式：

抽象了一个项集实体类，并实现是否可以合并的方法，这个方法最初是使用TreeSet.headSet来实现的，但是在测试时发现性能瓶颈都产生在这个方法上，并造成OOM，很是费解，待研究清楚后总结一下。

/**
 * 
 */
package org.waitingfortime.datamining.association;

import java.io.BufferedReader;
import java.io.File;
import java.io.FileNotFoundException;
import java.io.FileOutputStream;
import java.io.FileReader;
import java.io.IOException;
import java.io.PrintStream;
import java.util.ArrayList;
import java.util.HashMap;
import java.util.Iterator;
import java.util.List;
import java.util.Map;
import java.util.Set;
import java.util.TreeSet;

/**
 * @author mazhiyuan
 * 
 */
public class Apriori {
	private int minNum;// 最小支持数
	private List<Set<Integer>> records;
	private String output;
	private List<List<ItemSet>> result = new ArrayList<List<ItemSet>>();

	public Apriori(double minDegree, String input, String output) {
		this.output = output;
		init(input);
		if (records.size() == 0) {
			System.err.println("不符合计算条件。退出！");
			System.exit(1);
		}
		minNum = (int) (minDegree * records.size());
	}

	private void init(String path) {
		// TODO Auto-generated method stub
		records = new ArrayList<Set<Integer>>();
		try {
			BufferedReader br = new BufferedReader(new FileReader(
					new File(path)));

			String line = null;
			Set<Integer> record;
			while ((line = br.readLine()) != null) {
				if (!"".equals(line.trim())) {
					record = new TreeSet<Integer>();
					String[] items = line.split(" ");
					for (String item : items) {
						record.add(Integer.valueOf(item));
					}
					records.add(record);
				}
			}

			br.close();
		} catch (IOException e) {
			System.err.println("读取事务文件失败。");
		}
	}

	private List<ItemSet> first() {
		// TODO Auto-generated method stub
		List<ItemSet> first = new ArrayList<ItemSet>();
		Map<Integer, Integer> _first = new HashMap<Integer, Integer>();
		for (Set<Integer> si : records)
			for (Integer i : si) {
				if (_first.get(i) == null)
					_first.put(i, 1);
				else
					_first.put(i, _first.get(i) + 1);
			}

		for (Integer i : _first.keySet())
			if (_first.get(i) >= minNum)
				first.add(new ItemSet(i, _first.get(i)));

		return first;
	}

	private void loop(List<ItemSet> items) {
		// TODO Auto-generated method stub
		List<ItemSet> copy = new ArrayList<ItemSet>(items);
		List<ItemSet> res = new ArrayList<ItemSet>();
		int size = items.size();

		// 连接
		for (int i = 0; i < size; i++)
			for (int j = i + 1; j < size; j++)
				if (copy.get(i).isMerge(copy.get(j))) {
					ItemSet is = new ItemSet(copy.get(i));
					is.merge(copy.get(j).item.last());
					res.add(is);
				}
		// 剪枝
		pruning(copy, res);

		if (res.size() != 0) {
			result.add(res);
			loop(res);
		}
	}

	private void pruning(List<ItemSet> pre, List<ItemSet> res) {
		// TODO Auto-generated method stub
		// step 1 k项集的子集属于k-1项集
		Iterator<ItemSet> ir = res.iterator();
		while (ir.hasNext()) {
			// 获取所有k-1项子集
			ItemSet now = ir.next();
			List<List<Integer>> ss = subSet(now);
			// 判断是否在pre集中
			boolean flag = false;
			for (List<Integer> li : ss) {
				if (flag)
					break;
				for (ItemSet pis : pre) {
					if (pis.item.containsAll(li)) {
						flag = false;
						break;
					}
					flag = true;
				}
			}
			if (flag) {
				ir.remove();
				continue;
			}
			// step 2 支持度
			int i = 0;
			for (Set<Integer> sr : records) {
				if (sr.containsAll(now.item))
					i++;

				now.value = i;
			}
			if (now.value < minNum)
				ir.remove();
		}
	}

	private List<List<Integer>> subSet(ItemSet is) {
		// TODO Auto-generated method stub
		List<Integer> li = new ArrayList<Integer>(is.item);
		List<List<Integer>> res = new ArrayList<List<Integer>>();
		for (int i = 0, j = li.size(); i < j; i++) {
			List<Integer> _li = new ArrayList<Integer>(li);
			_li.remove(i);
			res.add(_li);
		}
		return res;
	}

	private void output() throws FileNotFoundException {
		if (result.size() == 0) {
			System.err.println("无结果集。退出！");
			return;
		}
		FileOutputStream out = new FileOutputStream(output);
		PrintStream ps = new PrintStream(out);
		for (List<ItemSet> li : result) {
			ps.println("=============频繁"+li.get(0).item.size()+"项集=============");
			for (ItemSet is : li)
				ps.println(is.item + " : " + is.value);
			ps.println("=====================================");
		}
	}

	/**
	 * @param args
	 * @throws FileNotFoundException
	 */
	public static void main(String[] args) throws FileNotFoundException {
		// TODO Auto-generated method stub
		long begin = System.currentTimeMillis();
		Apriori apriori = new Apriori(0.25,
				"/home/mazhiyuan/code/mushroom.dat",
				"/home/mazhiyuan/code/mout.data");
		// apriori.first();//频繁1项集
		apriori.loop(apriori.first());
		apriori.output();
		System.out.println((System.currentTimeMillis()) - begin);
	}
}

class ItemSet {
	TreeSet<Integer> item;
	int value;

	ItemSet(ItemSet is) {
		this.item = new TreeSet<Integer>(is.item);
	}

	ItemSet() {
		item = new TreeSet<Integer>();
	}

	ItemSet(int i, int v) {
		this();
		merge(i);
		setValue(v);
	}

	void setValue(int i) {
		this.value = i;
	}

	void merge(int i) {
		item.add(i);
	}

	boolean isMerge(ItemSet other) {
		if (other == null || other.item.size() != item.size())
			return false;
		// 前k-1项相同，最后一项不同，满足连接条件
		/*
		 * Iterator<Integer> i = item.headSet(item.last()).iterator();
		 * Iterator<Integer> o =
		 * other.item.headSet(other.item.last()).iterator(); while (i.hasNext() &&
		 * o.hasNext()) if (i.next() != o.next()) return false;
		 */
		Iterator<Integer> i = item.iterator();
		Iterator<Integer> o = other.item.iterator();
		int n = item.size();
		while (i.hasNext() && o.hasNext() && --n > 0)
			if (i.next() != o.next())
				return false;

		return !(item.last() == other.item.last());
	}
}

使用mushroom数据集，整个运行时间只有大概6s，性能还算满意。

这个代码只是计算了频繁项集，还没有计算关联规则和置信度，稍后补上。

=========补充了关联规则的生成======== 比想象的要麻烦一点

关联规则可以是双向的，confidence(A-->B)=P(A|B)=support(A&B)/support(A)

所以在计算k项集的关联规则时，其分母都是k项集的支持度，分子为k-1项集的支持度，以及对应1项集的支持度

/**
 * 
 */
package org.waitingfortime.datamining.association;

import java.io.BufferedReader;
import java.io.File;
import java.io.FileNotFoundException;
import java.io.FileOutputStream;
import java.io.FileReader;
import java.io.IOException;
import java.io.PrintStream;
import java.util.ArrayList;
import java.util.HashMap;
import java.util.Iterator;
import java.util.List;
import java.util.Map;
import java.util.Set;
import java.util.TreeSet;

/**
 * @author mazhiyuan
 * 
 */
public class Apriori {
	private int minNum;// 最小支持数
	private double minCon;// 最小置信度
	private List<Set<Integer>> records;// 原始数据
	private String output;// 输出路径
	private List<List<ItemSet>> result = new ArrayList<List<ItemSet>>();// 频繁项集结果
	private List<ItemSet> fth;// 频繁1项集

	public Apriori(double minDegree, double minCon, String input, String output) {
		this.output = output;
		this.minCon = minCon;
		init(input);
		if (records.size() == 0) {
			System.err.println("不符合计算条件。退出！");
			System.exit(1);
		}
		minNum = (int) (minDegree * records.size());
	}

	private void init(String path) {
		// TODO Auto-generated method stub
		records = new ArrayList<Set<Integer>>();
		try {
			BufferedReader br = new BufferedReader(new FileReader(
					new File(path)));

			String line = null;
			Set<Integer> record;
			while ((line = br.readLine()) != null) {
				if (!"".equals(line.trim())) {
					record = new TreeSet<Integer>();
					String[] items = line.split(" ");
					for (String item : items) {
						record.add(Integer.valueOf(item));
					}
					records.add(record);
				}
			}

			br.close();
		} catch (IOException e) {
			System.err.println("读取事务文件失败。");
		}
	}

	private void first() {
		// TODO Auto-generated method stub
		fth = new ArrayList<ItemSet>();
		Map<Integer, Integer> first = new HashMap<Integer, Integer>();
		for (Set<Integer> si : records)
			for (Integer i : si) {
				if (first.get(i) == null)
					first.put(i, 1);
				else
					first.put(i, first.get(i) + 1);
			}

		for (Integer i : first.keySet())
			if (first.get(i) >= minNum)
				fth.add(new ItemSet(i, first.get(i)));

	}

	private void loop(List<ItemSet> items) {
		// TODO Auto-generated method stub
		List<ItemSet> copy = new ArrayList<ItemSet>(items);
		List<ItemSet> res = new ArrayList<ItemSet>();
		int size = items.size();

		// 连接
		for (int i = 0; i < size; i++)
			for (int j = i + 1; j < size; j++)
				if (copy.get(i).isMerge(copy.get(j))) {
					ItemSet is = new ItemSet(copy.get(i));
					is.merge(copy.get(j).item.last());
					res.add(is);
				}
		// 剪枝
		pruning(copy, res);

		if (res.size() != 0) {
			result.add(res);
			loop(res);
		}
	}

	private void pruning(List<ItemSet> pre, List<ItemSet> res) {
		// TODO Auto-generated method stub
		// step 1 k项集的子集属于k-1项集
		Iterator<ItemSet> ir = res.iterator();
		while (ir.hasNext()) {
			// 获取所有k-1项子集
			ItemSet now = ir.next();
			Map<Integer, List<Integer>> ss = subSet(now);
			// 判断是否在pre集中
			boolean flag = false;
			for (List<Integer> li : ss.values()) {
				if (flag)
					break;
				for (ItemSet pis : pre) {
					if (pis.item.containsAll(li)) {
						flag = false;
						break;
					}
					flag = true;
				}
			}
			if (flag) {
				ir.remove();
				continue;
			}
			// step 2 支持度
			int i = 0;
			for (Set<Integer> sr : records) {
				if (sr.containsAll(now.item))
					i++;

				now.support = i;
			}
			if (now.support < minNum) {
				ir.remove();
				continue;
			}
			// 产生关联规则
			double deno = now.support;
			for (Map.Entry<Integer, List<Integer>> me : ss.entrySet()) {
				ItemCon ic = new ItemCon(me.getKey(), me.getValue());
				int nume = 0;

				for (ItemSet f : fth)
					if (f.item.contains(me.getKey())) {
						nume = f.support;
						break;
					}
				if (deno / nume > minCon) {
					now.calcon(ic);
					ic.setC1(deno / nume);
				}
				for (ItemSet pis : pre)
					if (pis.item.size() == me.getValue().size()
							&& pis.item.containsAll(me.getValue())) {
						nume = pis.support;
						break;
					}
				if (deno / nume > minCon)
					ic.setC2(deno / nume);
			}
		}
	}

	private Map<Integer, List<Integer>> subSet(ItemSet is) {
		// TODO Auto-generated method stub
		List<Integer> li = new ArrayList<Integer>(is.item);
		Map<Integer, List<Integer>> res = new HashMap<Integer, List<Integer>>();
		for (int i = 0, j = li.size(); i < j; i++) {
			List<Integer> _li = new ArrayList<Integer>(li);
			_li.remove(i);
			res.put(li.get(i), _li);
		}
		return res;
	}

	private void output() throws FileNotFoundException {
		if (result.size() == 0) {
			System.err.println("无结果集。退出！");
			return;
		}
		FileOutputStream out = new FileOutputStream(output);
		PrintStream ps = new PrintStream(out);
		for (List<ItemSet> li : result) {
			ps.println("=============频繁" + li.get(0).item.size()
					+ "项集=============");
			for (ItemSet is : li) {
				ps.println(is.item + " : " + is.support);
				ps.println();
				if (is.ics.size() != 0) {
					ps.println("******关联规则******");
					for (ItemCon ic : is.ics) {
						ps.println(ic.i + " ---> " + ic.li + " con: "
								+ ic.confidence1);
						if (ic.confidence2 > minCon)
							ps.println(ic.li + " ---> " + ic.i + " con: "
									+ ic.confidence2);
					}
					ps.println("******************");
					ps.println();
				}
			}
			ps.println("=====================================");
		}

		ps.close();
	}

	/**
	 * @param args
	 * @throws FileNotFoundException
	 */
	public static void main(String[] args) throws FileNotFoundException {
		// TODO Auto-generated method stub
		long begin = System.currentTimeMillis();
		Apriori apriori = new Apriori(0.25, 0.5,
				"/home/mazhiyuan/code/mushroom.dat",
				"/home/mazhiyuan/code/mout.data");
		// apriori.first();//频繁1项集
		apriori.first();
		apriori.loop(apriori.fth);

		apriori.output();
		System.out.println("共耗时:" + ((System.currentTimeMillis()) - begin)
				+ "ms");
	}
}

class ItemSet {
	TreeSet<Integer> item;
	int support;
	List<ItemCon> ics = new ArrayList<ItemCon>(); // 关联规则结果

	ItemSet(ItemSet is) {
		this.item = new TreeSet<Integer>(is.item);
	}

	ItemSet() {
		item = new TreeSet<Integer>();
	}

	ItemSet(int i, int v) {
		this();
		merge(i);
		setValue(v);
	}

	void setValue(int i) {
		this.support = i;
	}

	void merge(int i) {
		item.add(i);
	}

	void calcon(ItemCon ic) {
		ics.add(ic);
	}

	boolean isMerge(ItemSet other) {
		if (other == null || other.item.size() != item.size())
			return false;
		// 前k-1项相同，最后一项不同，满足连接条件
		/*
		 * Iterator<Integer> i = item.headSet(item.last()).iterator();
		 * Iterator<Integer> o =
		 * other.item.headSet(other.item.last()).iterator(); while (i.hasNext()
		 * && o.hasNext()) if (i.next() != o.next()) return false;
		 */
		Iterator<Integer> i = item.iterator();
		Iterator<Integer> o = other.item.iterator();
		int n = item.size();
		while (i.hasNext() && o.hasNext() && --n > 0)
			if (i.next() != o.next())
				return false;

		return !(item.last() == other.item.last());
	}
}

class ItemCon {
	Integer i;
	List<Integer> li;
	double confidence1;
	double confidence2;

	ItemCon(Integer i, List<Integer> li) {
		this.i = i;
		this.li = li;
	}

	void setC1(double c1) {
		this.confidence1 = c1;
	}

	void setC2(double c2) {
		this.confidence2 = c2;
	}
}

Apriori算法本身的性能就是一大问题，产生太多的候选集，FP-TREE算法规避了这一问题，使得频繁项集的挖掘性能提高了至少一个量级，下一篇重点介绍这个算法。

Long类型前后端数据不一致 igotyback 前端
响应给前端的数据浏览器控制台中response中看到的Long类型的数据是正常的到前端数据不一致前后端数据类型不匹配是一个常见问题，尤其是当后端使用Java的Long类型（64位）与前端JavaScript的Number类型（最大安全整数为2^53-1，即16位）进行数据交互时，很容易出现精度丢失的问题。这是因为JavaScript中的Number类型无法安全地表示超过16位的整数。为了解决这个问
LocalDateTime 转 String igotyback java 开发语言
importjava.time.LocalDateTime;importjava.time.format.DateTimeFormatter;publicclassMain{publicstaticvoidmain(String[]args){//获取当前时间LocalDateTimenow=LocalDateTime.now();//定义日期格式化器DateTimeFormatterformat
Linux下QT开发的动态库界面弹出操作（SDL2） 13jjyao QT类 qt 开发语言 sdl2 linux
需求：操作系统为linux，开发框架为qt，做成需带界面的qt动态库，调用方为java等非qt程序难点：调用方为java等非qt程序，也就是说调用方肯定不带QApplication::exec()，缺少了这个，QTimer等事件和QT创建的窗口将不能弹出(包括opencv也是不能弹出)；这与qt调用本身qt库是有本质的区别的思路：1.调用方缺QApplication::exec()，那么我们在接口
DIV+CSS+JavaScript技术制作网页（旅游主题网页设计与制作）云南大理 STU学生网页设计网页设计期末网页作业 html静态网页 html5期末大作业网页设计 web大作业
️精彩专栏推荐作者主页:【进入主页—获取更多源码】web前端期末大作业：【HTML5网页期末作业(1000套)】程序员有趣的告白方式：【HTML七夕情人节表白网页制作(110套)】文章目录二、网站介绍三、网站效果▶️1.视频演示2.图片演示四、网站代码HTML结构代码CSS样式代码五、更多源码二、网站介绍网站布局方面：计划采用目前主流的、能兼容各大主流浏览器、显示效果稳定的浮动网页布局结构。网站程
【华为OD机试真题2023B卷 JAVA&JS】We Are A Team 若博豆 java 算法华为 javascript
华为OD2023（B卷）机试题库全覆盖，刷题指南点这里WeAreATeam时间限制：1秒|内存限制：32768K|语言限制：不限题目描述：总共有n个人在机房，每个人有一个标号（1<=标号<=n），他们分成了多个团队，需要你根据收到的m条消息判定指定的两个人是否在一个团队中，具体的：1、消息构成为：abc，整数a、b分别代
关于城市旅游的HTML网页设计——(旅游风景云南 5页)HTML+CSS+JavaScript 二挡起步 web前端期末大作业 javascript html css 旅游风景
⛵源码获取文末联系✈Web前端开发技术描述网页设计题材，DIV+CSS布局制作,HTML+CSS网页设计期末课程大作业|游景点介绍|旅游风景区|家乡介绍|等网站的设计与制作|HTML期末大学生网页设计作业，Web大学生网页HTML：结构CSS：样式在操作方面上运用了html5和css3，采用了div+css结构、表单、超链接、浮动、绝对定位、相对定位、字体样式、引用视频等基础知识JavaScrip
HTML网页设计制作大作业（div+css）云南我的家乡旅游景点带文字滚动二挡起步 web前端期末大作业 web设计网页规划与设计 html css javascript dreamweaver 前端
Web前端开发技术描述网页设计题材，DIV+CSS布局制作,HTML+CSS网页设计期末课程大作业游景点介绍|旅游风景区|家乡介绍|等网站的设计与制作HTML期末大学生网页设计作业HTML：结构CSS：样式在操作方面上运用了html5和css3，采用了div+css结构、表单、超链接、浮动、绝对定位、相对定位、字体样式、引用视频等基础知识JavaScript：做与用户的交互行为文章目录前端学习路线
node.js学习小猿L node.js node.js 学习 vim
node.js学习实操及笔记温故node.js，node.js学习实操过程及笔记~node.js学习视频node.js官网node.js中文网实操笔记githubcsdn笔记为什么学node.js可以让别人访问我们编写的网页为后续的框架学习打下基础，三大框架vuereactangular离不开node.jsnode.js是什么官网：node.js是一个开源的、跨平台的运行JavaScript的运行
Java 重写(Override)与重载(Overload) 叨唧唧的
Java重写(Override)与重载(Overload)重写(Override)重写是子类对父类的允许访问的方法的实现过程进行重新编写,返回值和形参都不能改变。即外壳不变，核心重写！重写的好处在于子类可以根据需要，定义特定于自己的行为。也就是说子类能够根据需要实现父类的方法。重写方法不能抛出新的检查异常或者比被重写方法申明更加宽泛的异常。例如：父类的一个方法申明了一个检查异常IOExceptio
简单了解 JVM 记得开心一点啊 jvm
目录♫什么是JVM♫JVM的运行流程♫JVM运行时数据区♪虚拟机栈♪本地方法栈♪堆♪程序计数器♪方法区/元数据区♫类加载的过程♫双亲委派模型♫垃圾回收机制♫什么是JVMJVM是JavaVirtualMachine的简称，意为Java虚拟机。虚拟机是指通过软件模拟的具有完整硬件功能的、运行在一个完全隔离的环境中的完整计算机系统（如：JVM、VMwave、VirtualBox）。JVM和其他两个虚拟机
1分钟解决 -bash: mvn: command not found，在Centos 7中安装Maven Energet!c 开发语言
1分钟解决-bash:mvn:commandnotfound，在Centos7中安装Maven检查Java环境1下载Maven2解压Maven3配置环境变量4验证安装5常见问题与注意事项6总结检查Java环境Maven依赖Java环境，请确保系统已经安装了Java并配置了环境变量。可以通过以下命令检查：java-version如果未安装，请先安装Java。1下载Maven从官网下载：前往Apach
Java企业面试题3 马龙强_ java
1.break和continue的作用(智*图)break：用于完全退出一个循环（如for,while）或一个switch语句。当在循环体内遇到break语句时，程序会立即跳出当前循环体，继续执行循环之后的代码。continue：用于跳过当前循环体中剩余的部分，并开始下一次循环。如果是在for循环中使用continue，则会直接进行条件判断以决定是否执行下一轮循环。2.if分支语句和switch分
JVM、JRE和 JDK：理解Java开发的三大核心组件 Y雨何时停T Java java
Java是一门跨平台的编程语言，它的成功离不开背后强大的运行环境与开发工具的支持。在Java的生态中，JVM（Java虚拟机）、JRE（Java运行时环境）和JDK（Java开发工具包）是三个至关重要的核心组件。本文将探讨JVM、JDK和JRE的区别，帮助你更好地理解Java的运行机制。1.JVM：Java虚拟机（JavaVirtualMachine）什么是JVM？JVM，即Java虚拟机，是Ja
Java面试题精选：消息队列(二) 芒果不是芒 Java面试题精选 java kafka
一、Kafka的特性1.消息持久化：消息存储在磁盘，所以消息不会丢失2.高吞吐量：可以轻松实现单机百万级别的并发3.扩展性：扩展性强，还是动态扩展4.多客户端支持：支持多种语言（Java、C、C++、GO、）5.KafkaStreams（一个天生的流处理）:在双十一或者销售大屏就会用到这种流处理。使用KafkaStreams可以快速的把销售额统计出来6.安全机制：Kafka进行生产或者消费的时候会
白骑士的Java教学基础篇 2.5 控制流语句白骑士所长 Java 教学 java 开发语言
欢迎继续学习Java编程的基础篇！在前面的章节中，我们了解了Java的变量、数据类型和运算符。接下来，我们将探讨Java中的控制流语句。控制流语句用于控制程序的执行顺序，使我们能够根据特定条件执行不同的代码块，或重复执行某段代码。这是编写复杂程序的基础。通过学习这一节内容，你将掌握如何使用条件语句和循环语句来编写更加灵活和高效的代码。条件语句条件语句用于根据条件的真假来执行不同的代码块。if语句‘
python语法——三目运算符 HappyRocking python python 三目运算符
在java中，有三目运算符，如：intc=(a>b)?a:b表示c取两者中的较大值。但是在python，不能直接这样使用，估计是因为冒号在python有分行的关键作用。那么在python中，如何实现类似功能呢？可以使用ifelse语句，也是一行可以完成，格式为：aifbelsec表示如果b为True，则表达式等于a，否则等于c。如：c=(aif(a>b)elseb)同样是完成了取最大值的功能。
ArrayList 源码解析程序猿进阶 Java基础 ArrayList List java 面试性能优化架构设计 idea
ArrayList是Java集合框架中的一个动态数组实现，提供了可变大小的数组功能。它继承自AbstractList并实现了List接口，是顺序容器，即元素存放的数据与放进去的顺序相同，允许放入null元素，底层通过数组实现。除该类未实现同步外，其余跟Vector大致相同。每个ArrayList都有一个容量capacity，表示底层数组的实际大小，容器内存储元素的个数不能多于当前容量。当向容器中添
Java爬虫框架（一）--架构设计狼图腾-狼之传说 java 框架 java 任务 html解析器存储电子商务
一、架构图那里搜网络爬虫框架主要针对电子商务网站进行数据爬取，分析，存储，索引。爬虫：爬虫负责爬取，解析，处理电子商务网站的网页的内容数据库：存储商品信息索引：商品的全文搜索索引Task队列：需要爬取的网页列表Visited表：已经爬取过的网页列表爬虫监控平台：web平台可以启动，停止爬虫，管理爬虫，task队列，visited表。二、爬虫1.流程1)Scheduler启动爬虫器，TaskMast
Java：爬虫框架 dingcho Java java 爬虫
一、ApacheNutch2【参考地址】Nutch是一个开源Java实现的搜索引擎。它提供了我们运行自己的搜索引擎所需的全部工具。包括全文搜索和Web爬虫。Nutch致力于让每个人能很容易,同时花费很少就可以配置世界一流的Web搜索引擎.为了完成这一宏伟的目标,Nutch必须能够做到:每个月取几十亿网页为这些网页维护一个索引对索引文件进行每秒上千次的搜索提供高质量的搜索结果简单来说Nutch支持分
python怎么将png转为tif_png转tif weixin_39977276
发国外的文章要求图片是tif，cmyk色彩空间的。大小尺寸还有要求。比如网上大神多，找到了一段代码，感谢！https://www.jianshu.com/p/ec2af4311f56https://github.com/KevinZc007/image2Tifimportjava.awt.image.BufferedImage;importjava.io.File;importjava.io.Fi
JavaScript 中，深拷贝（Deep Copy）和浅拷贝（Shallow Copy）跳房子的前端前端面试 javascript 开发语言 ecmascript
在JavaScript中，深拷贝（DeepCopy）和浅拷贝（ShallowCopy）是用于复制对象或数组的两种不同方法。了解它们的区别和应用场景对于避免潜在的bugs和高效地处理数据非常重要。以下是对深拷贝和浅拷贝的详细解释，包括它们的概念、用途、优缺点以及实现方式。1.浅拷贝（ShallowCopy）概念定义：浅拷贝是指创建一个新的对象或数组，其中包含了原对象或数组的基本数据类型的值和对引用数
JAVA·一个简单的登录窗口 MortalTom java 开发语言学习
文章目录概要整体架构流程技术名词解释技术细节资源概要JavaSwing是Java基础类库的一部分，主要用于开发图形用户界面（GUI）程序整体架构流程新建项目，导入sql.jar包（链接放在了文末），编译项目并运行技术名词解释一、特点丰富的组件提供了多种可视化组件，如按钮（JButton）、文本框（JTextField）、标签（JLabel）、下拉列表（JComboBox）等，可以满足不同的界面设计
WebMagic：强大的Java爬虫框架解析与实战 Aaron_945 Java java 爬虫开发语言
文章目录引言官网链接WebMagic原理概述基础使用1.添加依赖2.编写PageProcessor高级使用1.自定义Pipeline2.分布式抓取优点结论引言在大数据时代，网络爬虫作为数据收集的重要工具，扮演着不可或缺的角色。Java作为一门广泛使用的编程语言，在爬虫开发领域也有其独特的优势。WebMagic是一个开源的Java爬虫框架，它提供了简单灵活的API，支持多线程、分布式抓取，以及丰富的
博客网站制作教程 2401_85194651 java maven
首先就是技术框架：后端：Java+SpringBoot数据库：MySQL前端：Vue.js数据库连接：JPA(JavaPersistenceAPI)1.项目结构blog-app/├──backend/│├──src/main/java/com/example/blogapp/││├──BlogApplication.java││├──config/│││└──DatabaseConfig.java
00. 这里整理了最全的爬虫框架（Java + Python）有一只柴犬爬虫系列爬虫 java python
目录1、前言2、什么是网络爬虫3、常见的爬虫框架3.1、java框架3.1.1、WebMagic3.1.2、Jsoup3.1.3、HttpClient3.1.4、Crawler4j3.1.5、HtmlUnit3.1.6、Selenium3.2、Python框架3.2.1、Scrapy3.2.2、BeautifulSoup+Requests3.2.3、Selenium3.2.4、PyQuery3.2
JAVA学习笔记之23种设计模式学习 victorfreedom Java技术设计模式 android java 常用设计模式
博主最近买了《设计模式》这本书来学习，无奈这本书是以C++语言为基础进行说明，整个学习流程下来效率不是很高，虽然有的设计模式通俗易懂，但感觉还是没有充分的掌握了所有的设计模式。于是博主百度了一番，发现有大神写过了这方面的问题，于是博主迅速拿来学习。一、设计模式的分类总体来说设计模式分为三大类：创建型模式，共五种：工厂方法模式、抽象工厂模式、单例模式、建造者模式、原型模式。结构型模式，共七种：适配器
JavaScript `Map` 和 `WeakMap`详细解释跳房子的前端 JavaScript 原生方法 javascript 前端开发语言
在JavaScript中，Map和WeakMap都是用于存储键值对的数据结构，但它们有一些关键的不同之处。MapMap是一种可以存储任意类型的键值对的集合。它保持了键值对的插入顺序，并且可以通过键快速查找对应的值。Map提供了一些非常有用的方法和属性来操作这些数据对：set(key,value):将一个键值对添加到Map中。如果键已经存在，则更新其对应的值。get(key):获取指定键的值。如果键
切换淘宝最新npm镜像源是 hai40587 npm 前端 node.js
切换淘宝最新npm镜像源是一个相对简单的过程，但首先需要明确当前淘宝npm镜像源的状态和最新的镜像地址。由于网络环境和服务更新，镜像源的具体地址可能会发生变化，因此，我将基于当前可获取的信息，提供一个通用的切换步骤，并附上最新的镜像地址（截至回答时）。一、了解npm镜像源npm（NodePackageManager）是JavaScript的包管理器，用于安装、更新和管理项目依赖。由于npm官方仓库
【Java】已解决：java.util.concurrent.CompletionException 屿小夏 java 开发语言
文章目录一、分析问题背景出现问题的场景代码片段二、可能出错的原因三、错误代码示例四、正确代码示例五、注意事项已解决：java.util.concurrent.CompletionException一、分析问题背景在Java并发编程中，java.util.concurrent.CompletionException是一种常见的运行时异常，通常在使用CompletableFuture进行异步计算时出现
设计模式之建造者模式(通俗易懂--代码辅助理解【Java版】） ok!ko 设计模式设计模式建造者模式 java
文章目录设计模式概述1、建造者模式2、建造者模式使用场景3、优点4、缺点5、主要角色6、代码示例：1）实现要求2）UML图3)实现步骤：1）创建一个表示食物条目和食物包装的接口2）创建实现Packing接口的实体类3）创建实现Item接口的抽象类，该类提供了默认的功能4）创建扩展了Burger和ColdDrink的实体类5）创建一个Meal类，带有上面定义的Item对象6）创建一个MealBuil
java观察者模式 3213213333332132 java 设计模式游戏观察者模式
观察者模式——顾名思义，就是一个对象观察另一个对象，当被观察的对象发生变化时，观察者也会跟着变化。在日常中，我们配java环境变量时，设置一个JAVAHOME变量,这就是被观察者，使用了JAVAHOME变量的对象都是观察者，一旦JAVAHOME的路径改动，其他的也会跟着改动。这样的例子很多，我想用小时候玩的老鹰捉小鸡游戏来简单的描绘观察者模式。老鹰会变成观察者，母鸡和小鸡是
TFS RESTful API 模拟上传测试 ronin47
TFS RESTful API 模拟上传测试。　　细节参看这里：https://github.com/alibaba/nginx-tfs/blob/master/TFS_RESTful_API.markdown 模拟POST上传一个图片： curl --data-binary @/opt/tfs.png http
PHP常用设计模式单例, 工厂, 观察者, 责任链, 装饰, 策略,适配,桥接模式 dcj3sjt126com 设计模式 PHP
// 多态, 在JAVA中是这样用的, 其实在PHP当中可以自然消除, 因为参数是动态的, 你传什么过来都可以, 不限制类型, 直接调用类的方法 abstract class Tiger { public abstract function climb(); } class XTiger extends Tiger { public function climb()
hibernate 171815164 Hibernate
main,save Configuration conf =new Configuration().configure(); SessionFactory sf=conf.buildSessionFactory(); Session sess=sf.openSession(); Transaction tx=sess.beginTransaction(); News a=new
Ant实例分析 g21121 ant
下面是一个Ant构建文件的实例，通过这个实例我们可以很清楚的理顺构建一个项目的顺序及依赖关系，从而编写出更加合理的构建文件。下面是build.xml的代码： <?xml version="1
[简单]工作记录_接口返回405原因 53873039oycg 工作
最近调接口时候一直报错，错误信息是: responseCode:405 responseMsg:Method Not Allowed 接口请求方式Post.
关于java.lang.ClassNotFoundException 和 java.lang.NoClassDefFoundError 的区别程序员是怎么炼成的
真正完成类的加载工作是通过调用 defineClass来实现的；而启动类的加载过程是通过调用 loadClass来实现的；就是类加载器分为加载和定义 protected Class<?> findClass(String name) throws ClassNotFoundExcept
JDBC学习笔记-JDBC详细的操作流程 aijuans jdbc
所有的JDBC应用程序都具有下面的基本流程：　　1、加载数据库驱动并建立到数据库的连接。　　2、执行SQL语句。　　3、处理结果。　　4、从数据库断开连接释放资源。下面我们就来仔细看一看每一个步骤：其实按照上面所说每个阶段都可得单独拿出来写成一个独立的类方法文件。共别的应用来调用。 1、加载数据库驱动并建立到数据库的连接： Html代码 St
rome创建rss antonyup_2006 tomcat cms xml struts Opera
引用 1.RSS标准 RSS标准比较混乱，主要有以下3个系列 RSS 0.9x / 2.0 : RSS技术诞生于1999年的网景公司(Netscape)，其发布了一个0.9版本的规范。2001年，RSS技术标准的发展工作被Userland Software公司的戴夫温那(Dave Winer)所接手。陆续发布了0.9x的系列版本。当W3C小组发布RSS 1.0后，Dave W
html表格和表单基础百合不是茶 html 表格表单 meta 锚点
第一次用html来写东西,感觉压力山大,每次看见别人发的都是比较牛逼的再看看自己什么都还不会, html是一种标记语言,其实很简单都是固定的格式 _----------------------------------------表格和表单表格是html的重要组成部分,表格用在body里面的主要用法如下; <table> &
ibatis如何传入完整的sql语句 bijian1013 java sql ibatis
ibatis如何传入完整的sql语句？进一步说，String str ="select * from test_table"，我想把str传入ibatis中执行，是传递整条sql语句。解决办法： <
精通Oracle10编程SQL(14)开发动态SQL bijian1013 oracle 数据库 plsql
/* *开发动态SQL */ --使用EXECUTE IMMEDIATE处理DDL操作 CREATE OR REPLACE PROCEDURE drop_table(table_name varchar2) is sql_statement varchar2(100); begin sql_statement:='DROP TABLE '||table_name;
【Linux命令】Linux工作中常用命令 bit1129 linux命令
不断的总结工作中常用的Linux命令 1.查看端口被哪个进程占用通过这个命令可以得到占用8085端口的进程号，然后通过ps -ef|grep 进程号得到进程的详细信息 netstat -anp | grep 8085 察看进程ID对应的进程占用的端口号 netstat -anp | grep 进程ID &
优秀网站和文档收集白糖_ 网站
集成 Flex, Spring, Hibernate 构建应用程序性能测试工具-JMeter Hmtl5-IOCN网站 Oracle精简版教程网站鸟哥的linux私房菜 Jetty中文文档 50个jquery必备代码片段 swfobject.js检测flash版本号工具
angular.extend boyitech AngularJS angular.extend AngularJS API
angular.extend 复制src对象中的属性去dst对象中. 支持多个src对象. 如果你不想改变一个对象，你可以把dst设为空对象{}: var object = angular.extend({}, object1, object2). 注意: angular.extend不支持递归复制. 使用方法: angular.extend(dst, src); 参数:
java-谷歌面试题-设计方便提取中数的数据结构 bylijinnan java
网上找了一下这道题的解答，但都是提供思路，没有提供具体实现。其中使用大小堆这个思路看似简单，但实现起来要考虑很多。以下分别用排序数组和大小堆来实现。使用大小堆： import java.util.Arrays; public class MedianInHeap { /** * 题目：设计方便提取中数的数据结构 * 设计一个数据结构，其中包含两个函数，1.插
ajaxFileUpload 针对 ie jquery 1.7+不能使用问题修复版本 Chen.H ajaxFileUpload ie6 ie7 ie8 ie9
jQuery.extend({ handleError: function( s, xhr, status, e ) { // If a local callback was specified, fire it if ( s.error ) { s.error.call( s.context || s, xhr, status, e ); }
[机器人制造原则]机器人的电池和存储器必须可以替换 comsci 制造
机器人的身体随时随地可能被外来力量所破坏,但是如果机器人的存储器和电池可以更换,那么这个机器人的思维和记忆力就可以保存下来,即使身体受到伤害,在把存储器取下来安装到一个新的身体上之后,原有的性格和能力都可以继续维持..... 另外,如果一
Oracle Multitable INSERT 的用法 daizj oracle
转载Oracle笔记-Multitable INSERT 的用法 http://blog.chinaunix.net/uid-8504518-id-3310531.html 一、Insert基础用法语法： Insert Into 表名 (字段1,字段2,字段3...） Values (值1,
专访黑客历史学家George Dyson datamachine on
20世纪最具威力的两项发明——核弹和计算机出自同一时代、同一群年青人。可是，与大名鼎鼎的曼哈顿计划（第二次世界大战中美国原子弹研究计划）相比，计算机的起源显得默默无闻。出身计算机世家的历史学家George Dyson在其新书《图灵大教堂》（Turing’s Cathedral）中讲述了阿兰·图灵、约翰·冯·诺依曼等一帮子天才小子创造计算机及预见计算机未来
小学6年级英语单词背诵第一课 dcj3sjt126com english word
always 总是 rice 水稻，米饭 before 在...之前 live 生活，居住 usual 通常的 early 早的 begin 开始 month 月份 year 年 last 最后的 east 东方的 high 高的 far 远的 window 窗户 world 世界 than 比...更
在线IT教育和在线IT高端教育 dcj3sjt126com 教育
codecademy http://www.codecademy.com codeschool https://www.codeschool.com teamtreehouse http://teamtreehouse.com lynda http://www.lynda.com/ Coursera https://www.coursera.
Struts2 xml校验框架所定义的校验文件蕃薯耀 Struts2 xml校验 Struts2 xml校验框架 Struts2校验
>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>> 蕃薯耀 2015年7月11日 15:54:59 星期六 http://fa
mac下安装rar和unrar命令 hanqunfeng mac
1.下载：http://www.rarlab.com/download.htm 选择 RAR 5.21 for Mac OS X 2.解压下载后的文件 tar -zxvf rarosx-5.2.1.tar 3.cd rar sudo install -c -o $USER unrar /bin #输入当前用户登录密码 sudo install -c -o $USER rar
三种将list转换为map的方法 jackyrong list
在本文中，介绍三种将list转换为map的方法： 1）传统方法假设有某个类如下 class Movie { private Integer rank; private String description; public Movie(Integer rank, String des
年轻程序员需要学习的5大经验 lampcy 工作 PHP 程序员
在过去的7年半时间里，我带过的软件实习生超过一打，也看到过数以百计的学生和毕业生的档案。我发现很多事情他们都需要学习。或许你会说，我说的不就是某种特定的技术、算法、数学，或者其他特定形式的知识吗？没错，这的确是需要学习的，但却并不是最重要的事情。他们需要学习的最重要的东西是“自我规范”。这些规范就是：尽可能地写出最简洁的代码；如果代码后期会因为改动而变得凌乱不堪就得重构；尽量删除没用的代码，并添加
评“女孩遭野蛮引产致终身不育 60万赔偿款1分未得”医腐深入骨髓 nannan408
先来看南方网的一则报道：再正常不过的结婚、生子，对于29岁的郑畅来说，却是一个永远也无法实现的梦想。从2010年到2015年，从24岁到29岁，一张张新旧不一的诊断书记录了她病情的同时，也清晰地记下了她人生的悲哀。　　粗暴手术让人发寒　　2010年7月，在酒店做服务员的郑畅发现自己怀孕了，可男朋友却联系不上。在没有和家人商量的情况下，她决定堕胎。　　12月5日，
使用jQuery为input输入框绑定回车键事件 VS 为a标签绑定click事件 Everyday都不同 jsp input 回车键绑定 click enter
假设如题所示的事件为同一个，必须先把该js函数抽离出来，该函数定义了监听的处理： function search() { //监听函数略...... } 为input框绑定回车事件，当用户在文本框中输入搜索关键字时，按回车键，即可触发search(): //回车绑定 $(".search").keydown(fun
EXT学习记录 tntxia ext
1. 准备（1）官网：http://www.sencha.com/ 里面有源代码和API文档下载。 EXT的域名已经从www.extjs.com改成了www.sencha.com ，但extjs这个域名会自动转到sencha上。（2）帮助文档：想要查看EXT的官方文档的话，可以去这里h
mybatis3的mapper文件报Referenced file contains errors xingguangsixian mybatis
最近使用mybatis.3.1.0时无意中碰到一个问题： The errors below were detected when validating the file "mybatis-3-mapper.dtd" via the file "account-mapper.xml". In most cases these errors can be d

数据挖掘-关联分析-Apriori算法Java实现 支持度+置信度

你可能感兴趣的:(java,Apriori,关联分析,频繁项集)

数据挖掘-关联分析-Apriori算法Java实现支持度+置信度