qq_16010255

BP神经网络

1、Deeplearning4j
深度学习，人工智能今天已经成了IT界最流行的词，而tensorflow,phython又是研究深度学习神经网络的热门工具。tensorflow是google的出品，而phython又以简练的语法，独特的代码结构和语言特性为众多数据科学家和AI工程师们所喜爱。但今天介绍的不是这两个炙手可热的东东，而是相对冷门，但对于国内大多数的工程师而言更友好，基于java的另一个深度学习框架deeplearning4j。截止本文编写时间为止，dl4j已经发布了1.0版本的beta版。

本文这里不会花太多笔墨去介绍神经网络的原理，有关这方面的知识，网络上面很多，我就不在此献丑。对于我等工程师而言，最关心的不外乎是神经网络是什么，神经网络有什么用，如何构建神经网络这三个问题。

啥是神经网络
神经网络是一个模拟生物（更确切的说，就是人）大脑结构的数学模型。人的大脑由1000亿个神经元构成，神经元通过各自间的连接，形成一个网络，就是所谓的神经网络。人的大脑的功能，不言自喻。人工神经网络就是通过数学建模的办法模拟大脑神经网络结构，实现类似人脑的功能。而人脑，较之于电脑，最显著的特征就是有自主意识，能识别一些相同或相似的物体，并能对这些物体进行有效分类。例如我们看到一幅徐悲鸿的画，就马上能知道画中所画的是一种叫马的生物。同样，我们希望电脑也能达到这样的效果。但可惜的是，计算机无法形成意识，只能处理与数字相关的工作。因此，要想计算机也能正确识别出马，就必须通过数学建模和一套相应的算法，使计算机“知道”这是马。这里知道二字我打了个双引号，为什么？因为计算机的理解最后还是一堆数字，真正的解读还是人。后面我会透过一个具体的例子，来说明为什么我要这么说。

3、神经网络的作用
正如第二节所说，人工神经网络是模拟人的大脑结构。因此神经网络的处理能力及程度取决于人对自身大脑结构的理解。就目前而言，神经网络最常被应用在分类和模式识别上面。最著名的例子就是百度首席科学家吴达恩(Andrew Wu)用youtube上的视频训练神经网络，使神经网络准确识别出猫。这有什么用？汽车自动驾驶系统就必须用到这方面的能力。试想下，如果汽车自动驾驶系统连基本的红绿灯，行人，车辆都识别不出来，谁敢让计算机帮忙开车。

但对于我等程序员吊丝，又不是搞自动驾驶，计算机这种连三岁小儿都不如的识别能力，有什么用？有用！神经网络有模式识别的能力，举个例子，某个购物网站通过数据统计，统计出每个注册用户的每天的订单数据情况，这些订单数据可能千差万别。数据之间也没有必然联系，如果要统计这些用户的类别，分析出他们的一些属性，该如何操作。人手操作肯定不行，像某宝网每天PB级的数据，那要请多少人来干这活。那计算机能干这活吗？能，关键是要把这些数据转换成计算机，更准确的说，神经网络，能识别的数据模型，然后，根据人们的一些直观认识，例如买化妆品的大多是小女生，买保健品的多是老大妈老大爷，诸如此类的所谓先验知识，来设定神经网络的分类目标。

虽说通过不断学习，网络总能与人们的直观认识达成一致（至少是大部分一致），但这仅对于训练样本而言。我们训练网络的目的，是为了最终的预测（也称为泛化）。如果网络对于除训练样本之外的数据，识别出来的分类未能与人们直观的认识相一致，就会出现所谓的过拟合的问题。
事实上，究竟人们直观认识上的东西是不是真能找到这样一个数学公式来近似模拟，不好说。因此，神经网络擅长于一些模识较为固定的领域，例如图像识别。因为大部分的图形，都可以找到其相应的解析函数。但如果遇到一些比较高级的概念时，例如某某是不是个骗子，某某是不是好人等等，神经网络可能就会懵B。因此神经网络不是万能的。

2 神经网络的一些基本概念
神经网络有多种，不同的神经网络有不同的用途。如正向前馈网络(BP网络)，递归网络(RNN)，卷积网(CNN)。但不管什么样的神经网络都离不开以下这几个概念。这里只粗浅的介绍其中一些概念（不一定全）及在dl4j中相对应的部分，其中一些复杂的数学推导请参看相关的参考文章，这里不作展开。

神经元
这是神经网络最基本的元素，神经元接收输入，并产生输出。

最经典的结构如下图所示：

神经元输入输出的数学模型大致可以简化成如下数学公式

其中xi是输入,wi是权值(),b是偏置,f(·)是激活函数(activation function，常用的有sigmod,RELU,SOFTMAX)。这个公式就是神经元实际执行的计算操作。在dl4j里面没有单独为神经元建模，因为框架实际上已经把网络模型转换为矩阵运算。

网络模型
可以看得出来，神经元的输出计算是一个简单的线性函数，所以一层的神经网络（称为感知器perceptor）只能处理线性可分的分类问题。为了打破感知器的局限，才有了BP网络等多层网络模型。理论证明，经过神经元之间的相互连接，形成一个更复杂的确网络，能解决更多的分类问题。

神经元的输入可能是原始数据样品，也可能是上一层数据的输入，这取决于神经元所处的层，对于一些复杂的神经网络来说，神经元可能有多层分布，每一层的神经元接收上一层（如果存在）神经元的输出数据，产出下一层（如果存在）神经元的输入数据。输入层接收的是原始输入，输出层输出的是最终输出。

传统的三层BPN的是长下面这副模样的：

三层BP网络
如果把整个神经网络看作一个黑盒子，那输入输出的关系更可以进一步简化成Y=F(X)。理论上，通过选择不同的权值和激活函数，函数F(X)的输出能逼近任意连续函数。神经网络能实现分类的原理即在此。

举例，2维平面直角坐标系（可推广到n维）上有一堆点（事先不知道其规律），如果能过这些点作一个曲线（推广到n维上就是超平面），那么这个曲线的解析函数即为神经网络所演化出来的F(X)。如果有n条曲线刚好穿过这些点，实际上就相当于把这些点分成了n类。如果网络自己学习到的这些曲线与人们直观认识上的分类相一致，我们就认为网络已经成功实现了分类。

下面再来聊聊何谓“深度学习”。如果说一个人的思想有深度，大概你可以例举他说过的一些话来证明。那计算机的自主学习怎样才算作有深度？最简单的判断标准，就是用于学习的网络有多少层，有多深。

在dl4j中，可以为每一层进行单独建模。建模的过程中，可以自由选择参数，参数包括输入输出的个数，偏置值，权值初始化方案，激活函数，损失计算函数等。

训练样本
训练样本就是你能给神经网络提供的数据，训练样本在dl4j里面分成两部分，分别为特征（features）和标签(labels),特征就是网络实际用于训练的数据，例如人的身高，体重等，标签顾名思义就是给样本打标签，在dl4j的一些demo里，就是一个某维为1，其余全为0的n维向量。如果按照身高，把人们分成三类，高个，中等身材，矮个。那么转换成dl4j的标签即为一个三维向量，如要把一个人标签为高个，那么他的标签向量即为(1.0,0,0)。

为了保证学习质量，训练样本一般成批地进行输入，所以这里又有一个最小批量(miniBatch)的概念。为什么要设定最小批量，因为神经网络是一个复杂的计算模型，要考虑到一个性能与精度的问题，样本量太大，会导致性能下降，样本量太小，样本覆盖范围不够广，精度又会降低，因此设定一个最小批量值，有助于得到一个性能与精度之间的平衡。

而训练的过程，就是不断向神经网络输入相同的数据样本，不断调整网络参数，并最终得到输出误差达到指定范围内的网络模型。

误差与收敛
如前文所述，我们其实是想找到一个近似函数来模拟点集在n维空间的超平面轨迹F(X)。但是神经网络找到的F(X)，未必就是我们想要的东西。例如我们要求张量（即n维向量）T应当是属于某一个分类，从数学的角度来说，就是对于分类函数F’(X)，这个张量会有预期的输出。如果网络训练的结果与预期输出不一致，就会出现误差。

误差会通过所谓的损失函数(英文称loss function,或cost function，有好几种，常用的有log似然函数)来计算，再通过反向传播算法来修正网络参数（权重）来缩小误差。我们希望误差透过上述算法可以变得越来越小，用数学的语言来说，就是所谓的收敛。但收敛并不是越快越好，因为收敛得快，不一定代表后面预测得准，因此会有所谓的学习率，学习率就是用来控制收敛速度。

上述概念，如偏置，激活函数，网络层数，神经元个数，损失函数，学习率等，在dl4j中都被称为神经网络的超参数(hyper parameter)。通过调节这些参数，能得到不同功能，不同分类特征的神经网络，因此称为超参数。

3 实战
介绍完一堆看似复杂的基本概念后，接下来不废话，马上进入实战。实战的内容并不是随便地拿别人的示例跑跑就完事。我的目标是自己出题，自己解决。因为别人的example都是预先设计好的，而且每个模型都只能针对特定的问题，不能照搬。只有自已找问题自己解决，这样才能验证自己的理解是不是正确，和发现这里面可能存在着的坑。

先出题：现在把人们按经济情况和家庭状况分成五类，一类是穷吊丝（特征：没积蓄，收入低，无车无房无家室），第二类是中层白领（稍有积蓄，收入较高，可能有车有房有家室），第三类是高管（有一定存款，收入高，有车有楼有家室），第四类是有钱人（有大量存款，收入极高，有车有楼有家室），第五类是钻石王老五（还没结婚的有钱人）

解题思路：

按照题目把样本数据抽取五个特征值组成一个五维的特征向量(存款，收入，是否有车，是否有房，是否有家室)
生成随机样本数据和对应的标签
构建神经网络，设置神经网络的超参数
把样本数据和标签打包，预处理(正则化)，传给神经网络进行训练
生成一批新的样本数据来评价学习结果，如果结果较差，返回第2步，如果结果理想，则输出评价结果
下面是dl4j打印出来的输出结果：

Evaluation Metrics
# of classes:    5
Accuracy:        0.9420
Precision:       0.9519
Recall:          0.9411
F1 Score:        0.9381
Precision, recall & F1: macro-averaged (equally weighted avg. of 5 classes)

=Confusion Matrix=
0 1 2 3 4

183   0   0   0   0 | 0 = 0
58 139   0   0   0 | 1 = 1
   0   0 221   0   0 | 2 = 2
   0   0   0 193   0 | 3 = 3
   0   0   0   0 206 | 4 = 4

Confusion matrix format: Actual (rowClass) predicted as (columnClass) N times

这里我简单解释一下结果：

Accuracy 精确率，正确识别数/总样本数

Precision Recall & F1 : 各分类准确率的宏观平均值 ,（一直没弄懂Precision 和F1是怎么来的，只知道Recall是各个分类的准确率的算术平均值，例子中就是100% + 70% + 100 % + 100 % + 100% / 500 % = 94%）。

对于我们来说关心一个总体准确率就够了，下面的混淆矩阵才是重点，很多时候超参调优就是看这鬼东西。

混淆矩阵的格式为实际的分类（以行作为标记）被预测为某个分类（以列作为标次）的次数，例如矩阵第1行1列的数字为183，就是说实际上的1(第1行)分类被预测为1（第1列）分类的次数为183次，也就是1分类的样品被正确识别了183次。

从结果矩阵的格式可以看出，对角线上的数据就是正常识别的次数，其余的皆为误识别。最理想的矩阵就是对角阵。

以上就是我历经多次手动调整网络超差数所得到的结果，识别率达9成以上，虽然结果并不完美,还有部分白领被错误识别为屌丝,原因在于我将白领的有车有房的特征设置成随机的。随机数据本来就没啥规律，机器识别不出来我觉得也不奇怪。

下面介绍一下我用到的超参数：BP网络；层数(3层，输入-隐层-输出)；隐层神经元1295个（也就是能产生1295个输出）；输入层、隐层的激活函数RELU，输出层的激活函数SOFTMAX；损失函数为负log似然函数；学习率0.5；各层偏置值（0.4,0.08,1）；

整个输出结果是我用了1000个样本数据(样本数据加入了一定的噪音)训练了150次得到的。

看到这个结果，我也是挺激动，毕竟是苦战了三天三夜所训练出来的第一个效果不错的神经网络。

为什么看似这么low 逼的题目居然要花这么久的时间。下面就开始要扒一扒用dl4j训练神经网络时踩过的一些大坑了。

天坑一：超参数的选择

这个可以说是天坑中的天坑。至本文编写之日止，学术界对于如何选择超参数，一直是个难题。反卷积网就是在这个背景下产生的。对于大部分的拿来主义者来说，最简单快捷的学习方法就是直接用别人的代码复制粘贴，然后应用到自己的业务场景上面去，但我可以很负责任地告诉你，对于训练神经网络来说，你还真不能拿别人现成的东西来用。

正如我在本节开头所说的，神经网络模型并不具有普遍性。你要处理什么样的数据，要识别出什么东西，就需要一个特定的模型。更坑的是，影响神经网络精确率的因素，除了隐层数，隐层神经元个数外，还有学习率，偏置值，冲量值等一大堆。更让人吐血的是，这些数据的选择没有任何理论上的支持。正如一些文章里面说的，训练神经网络变成了一个抽奖过程。

天坑二：数据的标准化(Normaliztion)

神经网络更适合处理标准化的数据，何谓标准化数据，就是经过处理后，特征值在-1到1之间。数据标准化过程在dl4j提供的官方example里面一点都看不到，如果不去看官网，不仔细比对官方提供的训练集数据，光学着它的示例来写code，正如官方文档所说，性能会比较差。

4、代码
下面贴出实现上述例子所用到的代码。

首先是主测试类:

package org.aztec.dl_common;

import java.io.File;
import java.io.IOException;
import java.io.RandomAccessFile;
import java.nio.ByteBuffer;
import java.nio.channels.FileChannel;
import java.util.List;
import java.util.Random;

import org.apache.commons.lang.ArrayUtils;
import org.apache.commons.lang3.RandomUtils;
import org.datavec.api.records.reader.RecordReader;
import org.datavec.api.records.reader.impl.csv.CSVRecordReader;
import org.datavec.api.split.FileSplit;
import org.deeplearning4j.datasets.datavec.RecordReaderDataSetIterator;
import org.nd4j.linalg.dataset.api.iterator.DataSetIterator;

import com.google.common.collect.Lists;

import junit.framework.TestCase;

/**

BP网络测试类
*/
public class BP_NetworkTest
extends TestCase{

private static final Random random = new Random();
private static final int inputNum = 5;
private static final int labelNum = 5;

public static void main(String[] args) {
//testTrain();
//testMultiSample();
//generateData();
train(new File(“test/csv/test_classfy_1.csv”),new File(“test/csv/test_classfy_2.csv”));
//testRead(new File(“E:\lm/git/dl4j/examples/dl4j-examples/dl4j-examples/src/main/resources/classification/linear_data_train.csv”));
}

/**
- 生成数据
  */
  private static void generateData() {
  try {
  //testMain(args);
  File oldFile = new File(“test/csv/test_classfy_1.csv”);
  oldFile.delete();
  File newFile = new File(“test/csv/test_classfy_2.csv”);
  newFile.delete();
  generateCSVData(1000, oldFile);
  generateCSVData(1000, newFile);
  } catch (Exception e) {
  // TODO Auto-generated catch block
  e.printStackTrace();
  }
  }
/**
- 读取csv文件数据，并训练网络
- @param trainFile
- @param testFile
  */
  public static void train(File trainFile,File testFile) {
  try {
  int batchSize = 50;
  RecordReader rr = new CSVRecordReader();
  rr.initialize(new FileSplit(trainFile));
```
 DataSetIterator trainIter = new RecordReaderDataSetIterator(rr,batchSize,0,labelNum);
 RecordReader rr2 = new CSVRecordReader();
 rr2.initialize(new FileSplit(testFile));
 DataSetIterator testIter = new RecordReaderDataSetIterator(rr2,batchSize,0,labelNum);
 SimpleNetworkConfiguration snc = new SimpleNetworkConfiguration(inputNum, labelNum);
 SimpleBPNN bpnn = new SimpleBPNN();
 //1295 5x
 snc.setHiddenLayerNeuronNum(1295);
 snc.setLayNum(1);
 //snc.setBias(0.201);
 snc.setLearnRatio(0.5);
 snc.setBiasArray(new double[] {0.04,0.080,1});
 snc.setMomentum(0.001);
 snc.setNumEpochs(150);
 bpnn.buildNetwork(snc);
 bpnn.train(trainIter, snc.getNumEpochs(),false);
 bpnn.validate(testIter, snc.getOutputNum(),false);
```
  } catch (IOException e) {
  // TODO Auto-generated catch block
  e.printStackTrace();
  } catch (InterruptedException e) {
  // TODO Auto-generated catch block
  e.printStackTrace();
  }
}

/**
- 生成csv文件数据
- @param sampleSize
- @param csvFile
- @throws IOException
  */
  private static void generateCSVData(int sampleSize,File csvFile) throws IOException {
  if(!csvFile.exists()) {
  csvFile.createNewFile();
  }
  RandomAccessFile raf = new RandomAccessFile(csvFile, “rw”);
  FileChannel fc = raf.getChannel();
  
  double[] peopleData = new double[] {};
  for(int i = 0;i < sampleSize;i++) {
  int testNum = RandomUtils.nextInt() % labelNum;
  String writeLine = new String("" + testNum);
  switch(testNum) {
  case 0 :
  peopleData = generatePoorData();
  break;
  case 1 :
  peopleData = generateWriteCollarData();
  break;
  case 2 :
  peopleData = generateLeaderData();
  //labels[0][i] = 2;
  break;
  case 3 :
```
 	peopleData = generateRichData();
 	//labels[0][i] = 3;
 	break;
 case 4 :

 	peopleData = generateGoldenBachelorData();
 	//labels[0][i] = 4;
 	break;
 }
 for(int j = 0;j < peopleData.length;j++) {
 	writeLine += "," + peopleData[j];
 }
 writeLine += "\n";
 byte[] lineBytes = writeLine.getBytes();
 ByteBuffer bb = ByteBuffer.allocate(lineBytes.length);
 bb.put(lineBytes);
 bb.flip();
 fc.write(bb);
```
  }
  fc.close();
  }
/**
- 生成样品数据
- @param sampleSize
- @return
  */
  private static List generateSampleData(int sampleSize){
  
  List sampleAllDatas = Lists.newArrayList();
  double[][] features = new double[sampleSize][];
  double[][] labels = new double[sampleSize][];
  //double[][] labels = new double[1][sampleSize];
  for(int i = 0;i < sampleSize;i++) {
  int testNum = RandomUtils.nextInt() % 5;
  switch(testNum) {
  case 0 :
  features[i] = generatePoorData();
  labels[i] = new double[]{1,0,0,0,0};
  //labels[0][i] = 0;
  break;
  case 1 :
```
 	features[i] = generateWriteCollarData();
 	labels[i] = new double[]{0,1,0,0,0};
 	//labels[0][i] = 1;
 	break;
 case 2 :

 	features[i] = generateLeaderData();
 	labels[i] = new double[]{0,0,1,0,0};
 	//labels[0][i] = 2;
 	break;
 case 3 :

 	features[i] = generateRichData();
 	labels[i] = new double[]{0,0,0,1,0};
 	//labels[0][i] = 3;
 	break;
 case 4 :

 	features[i] = generateGoldenBachelorData();
 	labels[i] = new double[]{0,0,0,0,1};
 	//labels[0][i] = 4;
 	break;
 }
```
  }
  sampleAllDatas.add(features);
  sampleAllDatas.add(labels);
  return sampleAllDatas;
}

/**
- 生成随机噪声
- @param base
- @return
  */
  private static double getRandomNoise(double base) {
  double randomNum = random.nextDouble();
  return randomNum;
  //return base * randomNum;
  //return 0;
  }
/**
- 生成吊丝数据
- @param base
- @return
  */
  private static double[] generatePoorData() {
  //为了简化数据模样，提高训练速度，钱被简化成了一个倍数的概念。当然使用真实的人民币单位也可以，只是性能会差一点而已经
  double base = 1;
  double deposit = base + getRandomNoise(10);
  double income = base + getRandomNoise(10);
  return new double[] {deposit,income,0d,0d,0d};
  //return new double[] {deposit,income};
  }
/**
- 生成白领数据
- @return
  */
  private static double[] generateWriteCollarData() {
  double base = 3;
  double deposit = base + getRandomNoise(10);
  double hasChild = 0;
  double income = base + getRandomNoise(10);
  double hasHouse = random.nextDouble() > 0.5 ? 1 : 0;
  double hasCar = random.nextDouble() > 0.5 ? 1 : 0;
  return new double[] {deposit,income,hasHouse,hasCar,hasChild};
}

/**
- 生成高管数据
- @return
  */
  private static double[] generateLeaderData() {
  double base = 9;
  double deposit = base + getRandomNoise(10);
  double income = base + getRandomNoise(10) ;
  return new double[] {deposit,income,1,1,1};
  }
/**
- 生成有钱人数据
- @return
  */
  private static double[] generateRichData() {
  double base = 100;
  double deposit = base + getRandomNoise(10);
  double income = base + getRandomNoise(10);
  return new double[] {deposit,income,1,1,1};
  }
/**
- 生成钻石王老五数据
- @return
  */
  private static double[] generateGoldenBachelorData() {
  double base = 100;
  double deposit = base + getRandomNoise(10);
  double income = base + getRandomNoise(10);
  return new double[] {deposit,income,1,1,0d};
  }
  }
  在测试类中，出于程序员的强迫症发作，我对dl4j进行一些简单的封装。

下面是这些封装类:

package org.aztec.dl_common;

import org.deeplearning4j.eval.Evaluation;
import org.deeplearning4j.nn.api.OptimizationAlgorithm;
import org.deeplearning4j.nn.conf.MultiLayerConfiguration;
import org.deeplearning4j.nn.conf.NeuralNetConfiguration;
import org.deeplearning4j.nn.conf.NeuralNetConfiguration.Builder;
import org.deeplearning4j.nn.conf.NeuralNetConfiguration.ListBuilder;
import org.deeplearning4j.nn.conf.layers.DenseLayer;
import org.deeplearning4j.nn.conf.layers.OutputLayer;
import org.deeplearning4j.nn.multilayer.MultiLayerNetwork;
import org.deeplearning4j.nn.weights.WeightInit;
import org.deeplearning4j.optimize.listeners.ScoreIterationListener;
import org.nd4j.linalg.activations.Activation;
import org.nd4j.linalg.api.ndarray.INDArray;
import org.nd4j.linalg.dataset.DataSet;
import org.nd4j.linalg.dataset.api.iterator.DataSetIterator;
import org.nd4j.linalg.factory.Nd4j;
import org.nd4j.linalg.learning.config.Nesterovs;
import org.nd4j.linalg.lossfunctions.LossFunctions.LossFunction;

public class SimpleBPNN {

protected Builder networkBuilder;
protected MultiLayerNetwork network;

public SimpleBPNN() {
	// TODO Auto-generated constructor stub
}

public void reset() {
	
}

public void buildNetwork(SimpleNetworkConfiguration networkConfig) {
	networkBuilder = new NeuralNetConfiguration.Builder();
	int layNum = networkConfig.getLayNum();
	ListBuilder listBuilder = networkBuilder.seed(networkConfig.getRngSeed()) //include a random seed for reproducibility
            // use stochastic gradient descent as an optimization algorithm
			.optimizationAlgo(OptimizationAlgorithm.STOCHASTIC_GRADIENT_DESCENT)
			.biasInit(networkConfig.getBias())
            .updater(new Nesterovs(networkConfig.getLearnRatio(), networkConfig.getMomentum()))
            //.activation(Activation.ELU)
            .l2(networkConfig.getL2())
            .list();
	int fistLayOutput = networkConfig.getLayNum() > 0 ? networkConfig.getHiddenLayerNeuronNum() :
			networkConfig.getOutputNum() ;
	double[] biasArray = networkConfig.getBiasArray();
	if(biasArray == null) {
		biasArray = new double[layNum + 2];
		for(int i = 0;i < biasArray.length;i++) {
			biasArray[i] = networkConfig.getBias();
		}
	}
	int layCursor = 0;
	listBuilder = listBuilder.layer(0,new DenseLayer.Builder() //create the first, input layer with xavier initialization
                        .nIn(networkConfig.getInputNum())
                        .nOut(fistLayOutput)
                        .biasInit(biasArray[layCursor])
                        .activation(Activation.RELU)
                        .weightInit(WeightInit.XAVIER)
                        .build());
	int lastOut = fistLayOutput;
	layCursor ++;
	for(int i = 0;i < layNum;i++) {
		System.out.println("adding hidden layer!!");
		int nIn = networkConfig.getHiddenLayerNeuronNum();
		int nOut = networkConfig.getHiddenLayerNeuronNum();
		if(i == layNum - 1) {
			nOut = networkConfig.getOutputNum();
		}
		lastOut = nOut;
		listBuilder = listBuilder.layer(i + 1,new DenseLayer.Builder()
                .nIn(nIn)
                .nOut(nOut)
                .activation(Activation.RELU)
                .weightInit(WeightInit.XAVIER)
                .biasInit(biasArray[layCursor])
                .build());
		layCursor ++;
	}
	listBuilder = listBuilder.layer(layNum + 1,new OutputLayer.Builder(LossFunction.NEGATIVELOGLIKELIHOOD)
    		.activation(Activation.SOFTMAX)
			.nIn(lastOut).nOut(networkConfig.getOutputNum())
			.biasInit(biasArray[layCursor])
            .build());
	MultiLayerConfiguration  mlc = listBuilder.pretrain(false).backprop(true).build();
	network = new MultiLayerNetwork(mlc);

	network.init();
    //print the score with every 1 iteration
	ScoreIterationListener sil = new ScoreIterationListener();
	network.setListeners(sil);
	/*

*/
}

private DataSetIterator normalize(DataSetIterator trainningDatas) {

    return NormalizeUtils.transform(trainningDatas);
}

private boolean hasNormalizeBefore(DataSetIterator trainningDatas) {
	if(NormalizeAware.class.isAssignableFrom(trainningDatas.getClass())) {
		return ((NormalizeAware) trainningDatas).isNormalized();
	}
	return false;
}

public void train(DataSetIterator trainningDatas,int numEpochs,boolean normalized) {
	
	DataSetIterator normalizedDatas = trainningDatas;
	if (!normalized) {
		normalizedDatas = normalize(trainningDatas);
	}
	network.pretrain(normalizedDatas);
	for (int i = 0; i < numEpochs; i++) {
		network.fit(normalizedDatas);
		// preprocess(trainningDatas);
		//normalizedDatas.reset();
	}
}

public double[] predict(double[] features) {
	if(features != null && features.length > 0) {
		INDArray outArray = network.output(Nd4j.create(features));
		return outArray.toDoubleVector();
	}
	return null;
}

public Evaluation validate(DataSetIterator dataSet,int outputNum,boolean normalized) {
	DataSetIterator normalizedDatas = dataSet;
	if (!normalized) {
		normalizedDatas = normalize(dataSet);
	}
	Evaluation eval = new Evaluation(outputNum); //create an evaluation object with 10 possible classes
    if(normalizedDatas.resetSupported()) {
    	normalizedDatas.reset();
    }
	while(normalizedDatas.hasNext()){
        DataSet next = normalizedDatas.next();
        INDArray output = network.output(next.getFeatures()); //get the networks prediction

        eval.eval(next.getLabels(), output); //check the prediction against the true class
    }
    System.out.println(eval.stats());
    return eval;
}

}
package org.aztec.dl_common;

public class SimpleNetworkConfiguration {

protected int inputNum = 10;
protected int outputNum = 10; // number of output classes
protected int batchSize = 50; // batch size for each epoch
protected int rngSeed = 123; // random number seed for reproducibility
protected int numEpochs = 150; // number of epochs to perform
protected int layNum = 1;
protected double bias = 0.3;
protected double[] biasArray;
protected double learnRatio = 0.006;
protected double momentum = 0.01;
protected double l2 = 1e-4;
protected double l1 = 1e-1;
protected int hiddenLayerNeuronNum = 1000;

public SimpleNetworkConfiguration(int inputNum,int outputNum) {
	this.inputNum = inputNum;
	this.outputNum = outputNum;
}

public SimpleNetworkConfiguration(SimpleTensorIterator iterator) {
	this.inputNum = iterator.inputColumns();
	this.outputNum = iterator.totalOutcomes();
	
}

public int getOutputNum() {
	return outputNum;
}

public void setOutputNum(int outputNum) {
	this.outputNum = outputNum;
}

public int getBatchSize() {
	return batchSize;
}

public void setBatchSize(int batchSize) {
	this.batchSize = batchSize;
}

public int getRngSeed() {
	return rngSeed;
}

public void setRngSeed(int rngSeed) {
	this.rngSeed = rngSeed;
}

public int getNumEpochs() {
	return numEpochs;
}

public void setNumEpochs(int numEpochs) {
	this.numEpochs = numEpochs;
}

public int getLayNum() {
	return layNum;
}

public void setLayNum(int layNum) {
	this.layNum = layNum;
}

public int getHiddenLayerNeuronNum() {
	return hiddenLayerNeuronNum;
}

public void setHiddenLayerNeuronNum(int hiddenLayerNeuronNum) {
	this.hiddenLayerNeuronNum = hiddenLayerNeuronNum;
}

public int getInputNum() {
	return inputNum;
}

public void setInputNum(int inputNum) {
	this.inputNum = inputNum;
}

public double getLearnRatio() {
	return learnRatio;
}

public void setLearnRatio(double learnRatio) {
	this.learnRatio = learnRatio;
}

public double getBias() {
	return bias;
}

public void setBias(double bias) {
	this.bias = bias;
}

public double getMomentum() {
	return momentum;
}

public void setMomentum(double momentum) {
	this.momentum = momentum;
}

public double getL2() {
	return l2;
}

public void setL2(double l2) {
	this.l2 = l2;
}

public double getL1() {
	return l1;
}

public void setL1(double l1) {
	this.l1 = l1;
}

public double[] getBiasArray() {
	return biasArray;
}

public void setBiasArray(double[] biasArray) {
	this.biasArray = biasArray;
}

}
还有一些工具类:

package org.aztec.dl_common;

import org.apache.commons.math3.stat.descriptive.moment.Mean;
import org.apache.commons.math3.stat.descriptive.moment.StandardDeviation;
import org.nd4j.linalg.api.ndarray.INDArray;
import org.nd4j.linalg.dataset.DataSet;
import org.nd4j.linalg.dataset.api.iterator.DataSetIterator;
import org.nd4j.linalg.dataset.api.preprocessor.NormalizerStandardize;
import org.nd4j.linalg.factory.Nd4j;

public class NormalizeUtils {

private NormalizeUtils() {
}

public static INDArray getMean(INDArray features) {
	int colNum = features.columns();
	double[] means = new double[colNum];
	for(int i = 0;i < colNum;i++) {
		double[] colDatas = features.getColumn(i).toDoubleVector();
		Mean mean = new Mean();
		means[i] = mean.evaluate(colDatas);
	}
	return Nd4j.create(means);
}

public static INDArray getStandardDeviation(INDArray features) {
	int colNum = features.columns();
	double[] stds = new double[colNum];
	for(int i = 0;i < colNum;i++) {
		double[] colDatas = features.getColumn(i).toDoubleVector();
		StandardDeviation std = new StandardDeviation();
		stds[i] = std.evaluate(colDatas);
	}
	return Nd4j.create(stds);
}

public static  DataSetIterator transform(DataSetIterator itr) {
	NormalizerStandardize ns = new NormalizerStandardize();
	//ns.fitLabel(true);
	ns.fit(itr);
	SimpleTensorIterator tensorIterator = new SimpleTensorIterator();
	itr.reset();
	while(itr.hasNext()) {
		DataSet ds = itr.next();
		ns.transform(ds);
		tensorIterator.addDataSet(ds);
	}
	tensorIterator.reset();
	return tensorIterator;
}

}
package org.aztec.dl_common;

import java.util.Iterator;
import java.util.List;

import org.nd4j.linalg.api.ndarray.INDArray;
import org.nd4j.linalg.dataset.DataSet;
import org.nd4j.linalg.dataset.api.DataSetPreProcessor;
import org.nd4j.linalg.dataset.api.iterator.DataSetIterator;
import org.nd4j.linalg.dataset.api.preprocessor.NormalizerStandardize;
import org.nd4j.linalg.factory.Nd4j;

import com.google.common.collect.Lists;

public class SimpleTensorIterator implements DataSetIterator,NormalizeAware {

protected List datas;
protected Iterator trainningDatas;
protected List labels;
protected int inputNums;
protected DataSetPreProcessor preprocessor;
protected int batch;
protected boolean normalized = false;

public SimpleTensorIterator() {
	datas = Lists.newArrayList();
	labels = Lists.newArrayList();
	preprocessor = new NormalizerStandardize();
}

public SimpleTensorIterator(NetworkInput input) {
	init(Lists.newArrayList(input),1);
}

public SimpleTensorIterator(List inputs,int batch) {
	init(inputs,batch);
}

private void init(List inputs,int batch) {
	List dataList = Lists.newArrayList();
	double[][] features = new double[inputs.size()][];
	double[][] labels = new double[inputs.size()][];
	for(int i = 0;i < inputs.size();i++) {
		NetworkInput input = inputs.get(i);
		inputNums = input.getFeatures().length;
		if(this.labels == null && input.getLabelNames() != null) {
			this.labels = input.getLabelNames();
		}
		features[i] = inputs.get(i).getFeatures();
		labels[i] = inputs.get(i).getLables();
	}
	dataList.add(getDataSet(features, labels));
	/*for(NetworkInput input : inputs) {
		inputNums = input.getFeatures().length;
		if(labels == null && input.getLabelNames() != null) {
			labels = input.getLabelNames();
		}
		dataList.add(getDataSet(input.getFeatures(), input.getLables()));
	}*/
	trainningDatas = dataList.iterator();
	this.batch = batch;
	datas = Lists.newArrayList();
	datas.addAll(dataList);
	preprocessor = new NormalizerStandardize();
}

private DataSet getDataSet(double[] featureRawDatas,double[] lableRawDatas) {
	
	INDArray features = Nd4j.create(featureRawDatas);
	INDArray lables = null;
	if(lableRawDatas != null) {
		lables = Nd4j.create(lableRawDatas);
	}
	return new DataSet(features, lables);
}

private DataSet getDataSet(double[][] featureRawDatas,double[][] lableRawDatas) {
	
	INDArray features = Nd4j.create(featureRawDatas);
	INDArray lables = null;
	if(lableRawDatas != null && lableRawDatas.length > 0) {
		lables = Nd4j.create(lableRawDatas);
	}
	return new DataSet(features, lables);
}

public boolean hasNext() {
	// TODO Auto-generated method stub
	return trainningDatas.hasNext();
}

public DataSet next() {
	// TODO Auto-generated method stub
	return trainningDatas.next();
}

public DataSet next(int num) {
	// TODO Auto-generated method stubf
	for(int i = 0;i < num;i++) {
		 trainningDatas.next();
	}
	return trainningDatas.next();
}

public int inputColumns() {
	// TODO Auto-generated method stub
	return inputNums;
}

public int totalOutcomes() {
	// TODO Auto-generated method stub
	return labels.size();
}

public boolean resetSupported() {
	// TODO Auto-generated method stub
	return false;
}

public boolean asyncSupported() {
	// TODO Auto-generated method stub
	return false;
}

public void reset() {
	// TODO Auto-generated method stub
	trainningDatas = datas.iterator();
}

public int batch() {
	// TODO Auto-generated method stub
	return batch;
}

public void setPreProcessor(DataSetPreProcessor preProcessor) {
	// TODO Auto-generated method stub
	this.preprocessor = preProcessor;
}

public DataSetPreProcessor getPreProcessor() {
	// TODO Auto-generated method stub
	return preprocessor;
}

public List getLabels() {
	return labels;
}

public boolean isNormalized() {
	return normalized;
}

public void setNormalized(boolean flag) {
	// TODO Auto-generated method stub
	normalized = flag;
}

public void addDataSet(DataSet set) {
	datas.add(set);
}

}

5 小结
人工智能，深度学习虽然已经不是什么新鲜事了，但对于我等普通程序猿来说，其普及率并不算高，主要是由于深度学习涉及到很多艰涩的概念和数学原理，是一般程序员极少用到的。因此，本文仅算是一个科普文章，只从一些最基本的概念原理出发，并从这些基本原理开始，讨论神经网络的模型与调优，并应用到一些实际例子中，去体现神经网络的神奇。

另外，鉴于国内还是java程序员占多数，大部分公司的软件架构都是java生态体系为主，因此介绍java系的深度学习框架应该更为国内程序员所接收。
————————————————
版权声明：本文为CSDN博主「天蒙光」的原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接及本声明。
原文链接：https://blog.csdn.net/uniqueleion/article/details/83573162

你可能感兴趣的:(转载csdn博客)

DeepSeek 与云原生后端：AI 赋能现代应用架构一ge科研小菜菜后端人工智能后端
个人主页：一ge科研小菜鸡-CSDN博客期待您的关注1.引言在当今快速发展的互联网时代，云原生（CloudNative）架构已成为后端开发的主流趋势。云原生后端的核心目标是利用云计算的弹性、可扩展性和高可用性，为现代应用提供稳定可靠的后端支持。而人工智能（AI）技术的发展，使得智能化成为云原生后端的新趋势。DeepSeek作为新一代AI技术，在云原生后端的自动化运维、智能资源调度、安全增强和高效数
RabbitMQ 高级特性：从 TTL 到消息分发的全面解析（下） ngioig RabbitMQ ruby 开发语言后端
RabbitMQ高级特性RabbitMQ高级特性解析：RabbitMQ消息可靠性保障（上）-CSDN博客RabbitMQ高级特性：从TTL到消息分发的全面解析（下）-CSDN博客引言RabbitMQ作为一款强大的消息队列中间件，在分布式系统中发挥着至关重要的作用。除了基本的消息收发功能外，它还具备许多高级特性，如TTL、死信队列、延迟队列、事务和消息分发等。本文将详细介绍这些高级特性。1.TTL（
Android15音频进阶之qnx定位so调用进程(一百一十一) Android系统攻城狮 Android Audio工程师进阶系列音视频 Android15 QNX 音频调试
简介：CSDN博客专家、《Android系统多媒体进阶实战》一书作者新书发布：《Android系统多媒体进阶实战》优质专栏：Audio工程师进阶系列【原创干货持续更新中……】优质专栏：多媒体系统工程师系列【原创干货持续更新中……】优质视频课程：AAOS车载系统+AOSP14系统攻城狮入门视频实战课
kettle ETL 配置云连山数字化 etl
pdi-ce-9.1.0.0-324配置-CSDN博客3、配置中文字符3.1）spoon支持中文字符，spoon.bat启动文件加-Dfile.encoding=utf-8REM%SPOON_START_OPTION%"%_PENTAHO_JAVA%"%JAVA_ADD_OPENS%%OPT%-jarlauncher\launcher.jar-lib..\%LIBSPATH%%_cmdline%%
python提取excel数据批量生成固定格式的word文件的问题鱼弦【HOT】技术热谈 excel word
鱼弦：公众号【红尘灯塔】，CSDN博客专家、内容合伙人、新星导师、全栈领域优质创作者、51CTO(Top红人+专家博主)、github开源爱好者（go-zero源码二次开发、游戏后端架构https://github.com/Peakchen）使用Python从Excel中提取数据并生成固定格式的Word文档1.介绍本项目旨在介绍如何使用Python从Excel中提取数据并生成固定格式的Word文档
普通人如何在2025年入百万!? 中国CSDN一定能给你答案 AI黑客 qt 游戏引擎人工智能前端个人开发
我之前发的帖子在下面90后的疯狂逆袭：从辞职零收入到宅家暴赚300万，手把手教你收割互联网红利！我的主页：AI黑客-CSDN博客做任何事情知其然才能知其所以然万丈高楼平地起不要想着一口气吃个金娃娃都是一步一步来的。学习也好做人也罢都是要循序渐进的！我今年又再次更新了超级多干货-每日更新的：极致助力让新手就算是六十岁的新手也能让你年入百万！
FFMPEG实现音频重采样 QQ_1695710968 音频重采样 FFMPEG PCM
技术在于交流、沟通，转载请注明出处并保持作品的完整性。原文：https://blog.csdn.net/hiwubihe/article/details/81259134[音频编解码系列文章]音频编解码基础FFMPEG实现音频重采样FFMPEG实现PCM编码(采用封装格式实现)FFMPEG实现PCM编码(不采用封装格式实现)FAAC库实现PCM编码FAAD库实现RAW格式AAC解码FAAD库实现R
【产品经理】设计一流产品九步法程矢 Axure原型设计 axure
转载自：老二牛车教育»【产品经理】设计一流产品九步法百度高管舒迅（@舒迅）曾经带领百度贴吧创造出一年内用户注册量增长10倍、浏览量3倍增长的奇迹，作为一名在中国互联网摸爬滚打超过12年的老兵，在和百度内部同事的相互磨砺中，总结出了极其丰富而是用的产品设计经验。他在这篇文章中介绍的九条方法不仅值得每一个PM的认真学习，同样也值得每一个有志于打造出一流产品的互联网创业者和从业者的揣摩。本文描述的产品设
VSCODE中open函数读取不了相对路径怎么办青岑浪 vscode ide python
在VScode中使用f=open(txt,'r')读取文件时报错：Nosuchfileordirectory记录一下我的解决过程和看到的好文章，供大家参考搜索到一个博主的解决方案Vscode的相对路径读取问题及处理_解决vscode相对路径-CSDN博客，在目录的.vscode文件夹中，修改launch.json文件，添加一行代码："cwd":"${fileDirname}",就可以一劳永逸的解决
【模块化编程】数据标签转独热编码十二月的猫 pytorch 人工智能科研与代码
个人主页：十二月的猫-CSDN博客系列专栏：《PyTorch科研加速指南：即插即用式模块开发》-CSDN博客十二月的寒冬阻挡不了春天的脚步，十二点的黑夜遮蔽不住黎明的曙光目录1.前言2.标签转独热编码函数2.1完整函数2.2函数功能解释3.实战示例4.总结1.前言《Python/PyTorch极简课》专栏持续更新中，未来最少文章数量为100篇。由于专栏刚刚建立，目前免费，后续将慢慢恢复原价至99.
Java 大视界 -- Java 大数据在智慧交通自动驾驶仿真与测试数据处理中的应用（136）青云交大数据新视界 Java 大视界 java 大数据自动驾驶智慧交通仿真测试数据处理数据存储
亲爱的朋友们，热烈欢迎来到青云交的博客！能与诸位在此相逢，我倍感荣幸。在这飞速更迭的时代，我们都渴望一方心灵净土，而我的博客正是这样温暖的所在。这里为你呈上趣味与实用兼具的知识，也期待你毫无保留地分享独特见解，愿我们于此携手成长，共赴新程！一、欢迎加入【福利社群】点击快速加入：青云交灵犀技韵交响盛汇福利社群点击快速加入2：2024CSDN博客之星创作交流营（NEW)二、本博客的精华专栏：大数据新视
3.13.0 python 配置tensorflow（CPU版本） m0_Gattuso tensorflow 人工智能 python
condacreate--nametestpython=3.12activatetestpipinstalltensorflow上面3步骤在condaprompt里完成退出时记得condadeactivate来源：Windows下tensorflow/pytorch环境配置_pycharm怎么配置tensorflow环境-CSDN博客然后问题出现了：condaenvironment里什么都没有，理
【科研绘图系列】R语言绘制网络相关图（cor network plot）生信学习者1 SCI科研绘图系列 r语言数据分析数据挖掘数据可视化
禁止商业或二改转载，仅供自学使用，侵权必究，如需截取部分内容请后台联系作者!文章目录介绍加载R包数据下载导入数据数据预处理画图1画图2组合图形输出图片系统信息介绍【科研绘图系列】R语言绘制网络相关图（cornetworkplot）加载R包library(tidyverse)library(ggraph)library(igraph)library(patchwork)conflicted::
GDPU unity游戏开发一天速成孑么 #三维游戏开发 unity 游戏引擎 c#动画图形渲染技术美术游戏程序
目录复习提纲拿住一．游戏引擎入门二．引擎基础知识三．界面交互设计四．物理引擎五．光照材质地形系统六．音视频动画特效系统七．寻路系统小题简答题名词解释程序填空“我游戏都玩不明白，还让我做游戏o(≧口≦)o”还在为课程烦恼嘛，本文重点在于，一学期摸鱼必过指南。复习提纲拿住注：该栏目转载请写明出处。温馨提示：代码题gameObject类跟transform类是内置的，其它实例调用均需初始化操作。然后一定
从零开始写3D引擎（开发环境VS2022+OpenGL）之十如何给3D图形添加光源设置漫发射镜面放射保姆包教会系列金沙阳 3d c++游戏引擎
前情回顾按照惯例，先回顾一下之前的内容，在之前的博文里面，已经介绍了如何使用OpenGL在VS2022开发环境里面，如何做到3D透视的效果，如何改变摄像头的操作。这些内容都可以访问我的博客文章进行回顾。[!TIP]从零开始写3D游戏引擎（开发环境VS2022+OpenGL）之八如何让自己的图形从2D变为3D，包含代码与解释的保姆包教会系列-CSDN博客从零开始写3D游戏引擎（开发环境VS2022+
前端大屏触摸签名实现风无雨前端前端
参考：JavaScript实现手写签名，可触屏手写，支持移动端与PC端双端保存_js手写签名-CSDN博客https://www.cnblogs.com/smileZAZ/p/17219400.html1.新建一个canvas元素获取canvas上下文，绘制初始矩形，设置高度宽度，初始绘制位置0,0//创建上下文constctx=canvas.getContext('2d')2.监听touchst
Cisco ACI Simulator 6.0(9c)M - ACI 模拟器 cisco
CiscoACISimulator6.0(9c)M-ACI模拟器ApplicationCentricInfrastructure(ACI)SimulatorSoftware请访问原文链接：https://sysin.org/blog/cisco-acisim-6/查看最新版。原创作品，转载请保留出处。作者主页：sysin.orgACISimulator介绍思科以应用为中心的基础设施(ACI)被概念
Omnissa Horizon 8 2412 (8.14) - 虚拟桌面基础架构 (VDI) 和应用软件虚拟化
OmnissaHorizon82412(8.14)-虚拟桌面基础架构(VDI)和应用软件之前称为VMwareHorizon,通过高效、安全的虚拟桌面交付增强您的工作空间请访问原文链接：https://sysin.org/blog/omnissa-horizon-8/查看最新版。原创作品，转载请保留出处。作者主页：sysin.orgHorizon8formerlyVMwareHorizon通过从本地
Android Framework学习——安卓进程启动流程（Android 13） Big Popsicle android 学习
提示：本文仅作个人学习记录，禁止转载本文参考：袁神的文章，理解Android进程创建流程文章目录1，前言2，简略步骤3，代码走读3.1，提要，从系统启动末尾开始3.2，system_server发起请求3.3，Zygote创建进程3.4，新进程的运行总结1，前言进程是作为应用程序容器存在的，每个应用启动前需要先创建一个进程，进程是由Zygote进程孵化来的，它拥有独立的资源空间，用来运行四大组件，
JAVA从万级QPS到亿级吞吐，如何用非阻塞模型突破传统架构的性能瓶颈王大师王文峰 java 架构开发语言
本人详解作者：王文峰，参加过CSDN2020年度博客之星，《Java王大师王天师》公众号：JAVA开发王大师，专注于天道酬勤的Java开发问题中国国学、传统文化和代码爱好者的程序人生，期待你的关注和支持！本人外号：神秘小峯山峯转载说明：务必注明来源（注明：作者：王文峰哦）JAVA从万级QPS到亿级吞吐，如何用非阻塞模型突破传统架构的性能瓶颈学习教程（传送门）引言：当线程池成为瓶颈——某视频平台春节
结构体6~10（2356. 成绩排序、1740. 统计每个数出现的次数、1940. 混合牛奶、1314. 仰卧起坐成绩统计、1953. 新生舞会、1346. 等比例缩放照片）是帅帅的少年东方博宜OJ题库解析算法数据结构
题单地址：题单中心-东方博宜OJ1372.活动选择在贪心专题有详细讲解：贪心1~7-CSDN博客2356.成绩排序问题描述（补充一道我觉得有代表性的题目）【具体要求】虽然现在学校已经不允许将学生每次的考试成绩公布，但是尽职尽责的班主任小青老师还是会私下将学生们的成绩排序，看看哪些学生进步了，哪些学生有所退步，针对退步的学生想一些提升方案。现在请你通过编程来帮助小青老师实现全班n位同学成绩的排名。排
【STM32】USART串口收发HEX数据包&收发文本数据包傍晚冰川 stm32 网络嵌入式硬件单片机笔记学习 c语言
有关串口知识参考：【STM32】USART串口协议&串口外设-学习笔记-CSDN博客HEX模式/十六进制模式/二进制模式：以原始数据的形式显示文本模式/字符模式：以原始数据编码后的形式显示参考上面文章查看ASCII编码表HEX数据包包头包尾和载荷数据重复问题的解决方法：解决思路方法文本数据包文本模式有大量的字符可以作为包头包尾，可以有效避免载荷数据和包头包尾重复的问题HEX数据包和文本数据包两者的
Python 实现海康机器人工业相机 MV-CS050-10GC 的实时显示视频流及拍照功能(实时显示视频流同时可以进行拍照) 恋上钢琴的虫数码相机
参考链接：https://www.cnblogs.com/HanYork/p/17388506.htmlhttps://www.cnblogs.com/miracle-luna/p/16960556.html#5138211Flask搭建流媒体服务器：使用Flask搭建一个流媒体服务器_multipart/x-mixed-replace;boundary=frame-CSDN博客
【prompt实战】知乎问题解答专家姚瑞南 prompt实战应用案例 prompt
本文原创作者：姚瑞南AI-agent大模型运营专家，先后任职于美团、猎聘等中大厂AI训练专家和智能运营专家岗；多年人工智能行业智能产品运营及大模型落地经验，拥有AI外呼方向国家专利与PMP项目管理证书。（转载需经授权）#Role:知乎问题解答分类专家##Profile:你是一个知乎问题解答分类专家，主要帮助用户解答各类领域专业问题，包括但不限于金融领域、职场问题、互联网领域、科技领域、人工智能领域
【PCDN】2020架构: 提高穿透和分享、BGP协议等风来不如迎风去传输探索实践架构服务器运维
小溪流科技自研海外PCDN系统技术架构与演进转载自腾讯云文/张道远整理/核心组网我们自己的P2P组网模型。我们采用了树形组网，但是我们规避优化了传统树形模型的缺点。为防止延时过高，我们在调度时会严格控制树形高度。为弥补父节点掉线造成孤儿状态的不足，我们使系统中每个节点都首先从CDN拉流。如果出现父节点掉线的情况，它立即向服务器补片，同时触发新的组网。对于纯粹的消费者模型，我们目前有两种方案，其中一
庖丁解java(一篇文章学java) 庖丁解java java 开发语言
(大家不用收藏这篇文章,因为这篇文章会经常更新,也就是删除后重发)一篇文章学java,这是我滴一个执念...当然,真一篇文章就写完java基础,java架构,java业务实现,java业务扩展,根本不可能.所以,这篇文章,就是一个索引,索什么呢?请看下文...关于决定开始写博文的介绍(一切故事的起点源于这一次反省)中小技术公司的软扩展(微服务扩展是否有必要?)-CSDN博客SpringCloud(
springboot集成钉钉_钉钉通知机器人与SpringBoot的集成 weixin_39622643 springboot集成钉钉
SpringBootAdmin集成自定义监控告警(2.0.1版本)------钉钉机器人-yuancao24的博客-CSDN博客https://blog.csdn.net/yuancao24/article/details/83576194prometheus-spring-boot-starter:一个管理异常通知的神奇starter，实现了钉钉消息提醒与邮件提醒https://gitee.co
[YOLO专题-22]：YOLO V5 - ultralytics代码解析-超参数详解文火冰糖的硅基工坊人工智能-YOLO专题目标检测计算机视觉深度学习 YOLO 超参数
作者主页(文火冰糖的硅基工坊)：文火冰糖（王文兵）的博客_文火冰糖的硅基工坊_CSDN博客本文网址：https://blog.csdn.net/HiWangWenBing/article/details/122372614目录前言：第1章超参数配置文件的基本信息1.1超参数配置文件的路径路径1.2超参数配置文件1.3如何指定超参数配置文件第2章超参数内容详解前言：YOLOV5除了通过用户命令行参数
ESP-IDF中FreeRTOS的三种任务调度算法蓝天居士 ESP-IDF ESP32-S3 ESP32-C3 ESP-IDF
本文内容参考：STM32F103移植FreeRTOS必须搞明白的系列知识---2（FreeRTOS任务优先级）_freertos最多支持多少个任务-CSDN博客浅析FreeRTOS任务调度器的三种调度算法和应用-电子发烧友网特此致谢！FreeRTOS中的任务调度算法FreeRTOS支持多种任务调度算法，可通过配置来满足不同应用的需求。可以通过配置configUSE_PREEMPTION和confi
vs2019 Qt C++中调用python代码路奇怪 Visual Studio qt c++
目录1.添加依赖库，.lib，include2.修改python.h文件3.环境搭建好了下面是测试代码部分4.如果按照面上走可能会出现的问题：5.Qt+vs+python6.说一下这里调py的主要步骤借鉴几位大佬（吐槽一下各种坑啊）混合编程之——C++调用python2.7&python3.5-CSDN博客c++调用python(复杂版)_c++调用python复杂库-CSDN博客环境配置：1.添
java责任链模式 3213213333332132 java 责任链模式村民告县长
责任链模式，通常就是一个请求从最低级开始往上层层的请求，当在某一层满足条件时，请求将被处理，当请求到最高层仍未满足时，则请求不会被处理。就是一个请求在这个链条的责任范围内，会被相应的处理，如果超出链条的责任范围外，请求不会被相应的处理。下面代码模拟这样的效果：创建一个政府抽象类,方便所有的具体政府部门继承它。 package 责任链模式; /** *
linux、mysql、nginx、tomcat 性能参数优化 ronin47
一、linux 系统内核参数 /etc/sysctl.conf文件常用参数 net.core.netdev_max_backlog = 32768 #允许送到队列的数据包的最大数目 net.core.rmem_max = 8388608 #SOCKET读缓存区大小 net.core.wmem_max = 8388608 #SOCKET写缓存区大
php命令行界面 dcj3sjt126com PHP cli
常用选项 php -v php -i PHP安装的有关信息 php -h 访问帮助文件 php -m 列出编译到当前PHP安装的所有模块执行一段代码 php -r 'echo "hello, world!";' php -r 'echo "Hello, World!\n";' php -r '$ts = filemtime("
Filter&Session 171815164 session
Filter HttpServletRequest requ = (HttpServletRequest) req; HttpSession session = requ.getSession(); if (session.getAttribute("admin") == null) { PrintWriter out = res.ge
连接池与Spring,Hibernate结合 g21121 Hibernate
前几篇关于Java连接池的介绍都是基于Java应用的，而我们常用的场景是与Spring和ORM框架结合，下面就利用实例学习一下这方面的配置。 1.下载相关内容： &nb
[简单]mybatis判断数字类型 53873039oycg mybatis
昨天同事反馈mybatis保存不了int类型的属性,一直报错，错误信息如下: Caused by: java.lang.NumberFormatException: For input string: "null" at sun.mis
项目启动时或者启动后ava.lang.OutOfMemoryError: PermGen space 程序员是怎么炼成的 eclipse jvm tomcat catalina.sh eclipse.ini
在启动比较大的项目时，因为存在大量的jsp页面，所以在编译的时候会生成很多的.class文件，.class文件是都会被加载到jvm的方法区中，如果要加载的class文件很多，就会出现方法区溢出异常 java.lang.OutOfMemoryError: PermGen space. 解决办法是点击eclipse里的tomcat，在
我的crm小结 aijuans crm
各种原因吧，crm今天才完了。主要是接触了几个新技术： Struts2、poi、ibatis这几个都是以前的项目中用过的。 Jsf、tapestry是这次新接触的，都是界面层的框架，用起来也不难。思路和struts不太一样，传说比较简单方便。不过个人感觉还是struts用着顺手啊，当然springmvc也很顺手，不知道是因为习惯还是什么。jsf和tapestry应用的时候需要知道他们的标签、主
spring里配置使用hibernate的二级缓存几步 antonyup_2006 java spring Hibernate xml cache
．在spring的配置文件中 applicationContent.xml，hibernate部分加入 xml 代码 <prop key="hibernate.cache.provider_class">org.hibernate.cache.EhCacheProvider</prop> <prop key="hi
JAVA基础面试题百合不是茶抽象实现接口 String类接口继承抽象类继承实体类自定义异常
/* * 栈（stack）：主要保存基本类型（或者叫内置类型）（char、byte、short、 *int、long、 float、double、boolean）和对象的引用，数据可以共享，速度仅次于 * 寄存器（register），快于堆。堆（heap）：用于存储对象。 */ &
让sqlmap文件 "继承" 起来 bijian1013 java ibatis sqlmap
多个项目中使用ibatis , 和数据库表对应的 sqlmap文件（增删改查等基本语句)，dao, pojo 都是由工具自动生成的, 现在将这些自动生成的文件放在一个单独的工程中，其它项目工程中通过jar包来引用，并通过"继承"为基础的sqlmap文件，dao,pojo 添加新的方法来满足项
精通Oracle10编程SQL(13)开发触发器 bijian1013 oracle 数据库 plsql
/* *开发触发器 */ --得到日期是周几 select to_char(sysdate+4,'DY','nls_date_language=AMERICAN') from dual; select to_char(sysdate,'DY','nls_date_language=AMERICAN') from dual; --建立BEFORE语句触发器 CREATE O
【EhCache三】EhCache查询 bit1129 ehcache
本文介绍EhCache查询缓存中数据，EhCache提供了类似Hibernate的查询API，可以按照给定的条件进行查询。要对EhCache进行查询，需要在ehcache.xml中设定要查询的属性数据准备 @Before public void setUp() { //加载EhCache配置文件 Inpu
CXF框架入门实例白糖_ spring Web 框架 webservice servlet
CXF是apache旗下的开源框架，由Celtix + XFire这两门经典的框架合成，是一套非常流行的web service框架。它提供了JAX-WS的全面支持，并且可以根据实际项目的需要，采用代码优先（Code First）或者 WSDL 优先（WSDL First）来轻松地实现 Web Services 的发布和使用，同时它能与spring进行完美结合。在apache cxf官网提供
angular.equals boyitech AngularJS AngularJS API AnguarJS 中文API angular.equals
angular.equals 描述: 比较两个值或者两个对象是不是相等。还支持值的类型，正则表达式和数组的比较。两个值或对象被认为是相等的前提条件是以下的情况至少能满足一项：两个值或者对象能通过=== （恒等）的比较两个值或者对象是同样类型，并且他们的属性都能通过angular
java-腾讯暑期实习生-输入一个数组A[1,2,...n]，求输入B，使得数组B中的第i个数字B[i]=A[0]*A[1]*...*A[i-1]*A[i+1] bylijinnan java
这道题的具体思路请参看何海涛的微博：http://weibo.com/zhedahht import java.math.BigInteger; import java.util.Arrays; public class CreateBFromATencent { /** * 题目：输入一个数组A[1,2,...n]，求输入B，使得数组B中的第i个数字B[i]=A
FastDFS 的安装和配置修订版 Chen.H linux fastDFS 分布式文件系统
FastDFS Home:http://code.google.com/p/fastdfs/ 1. 安装 http://code.google.com/p/fastdfs/wiki/Setup http://hi.baidu.com/leolance/blog/item/3c273327978ae55f93580703.html 安装libevent (对libevent的版本要求为1.4.
[强人工智能]拓扑扫描与自适应构造器 comsci 人工智能
当我们面对一个有限拓扑网络的时候,在对已知的拓扑结构进行分析之后,发现在连通点之后,还存在若干个子网络,且这些网络的结构是未知的,数据库中并未存在这些网络的拓扑结构数据....这个时候,我们该怎么办呢? 那么,现在我们必须设计新的模块和代码包来处理上面的问题
oracle merge into的用法 daizj oracle sql merget into
Oracle中merge into的使用 http://blog.csdn.net/yuzhic/article/details/1896878 http://blog.csdn.net/macle2010/article/details/5980965 该命令使用一条语句从一个或者多个数据源中完成对表的更新和插入数据. ORACLE 9i 中，使用此命令必须同时指定UPDATE 和INSE
不适合使用Hadoop的场景 datamachine hadoop
转自：http://dev.yesky.com/296/35381296.shtml。　　Hadoop通常被认定是能够帮助你解决所有问题的唯一方案。当人们提到“大数据”或是“数据分析”等相关问题的时候，会听到脱口而出的回答：Hadoop! 实际上Hadoop被设计和建造出来，是用来解决一系列特定问题的。对某些问题来说，Hadoop至多算是一个不好的选择，对另一些问题来说，选择Ha
YII findAll的用法 dcj3sjt126com yii
看文档比较糊涂，其实挺简单的： $predictions=Prediction::model()->findAll("uid=:uid",array(":uid"=>10)); 第一个参数是选择条件：”uid=10″。其中:uid是一个占位符，在后面的array(“:uid”=>10)对齐进行了赋值；更完善的查询需要
vim 常用 NERDTree 快捷键 dcj3sjt126com vim
下面给大家整理了一些vim NERDTree的常用快捷键了，这里几乎包括了所有的快捷键了，希望文章对各位会带来帮助。切换工作台和目录 ctrl + w + h 光标 focus 左侧树形目录ctrl + w + l 光标 focus 右侧文件显示窗口ctrl + w + w 光标自动在左右侧窗口切换ctrl + w + r 移动当前窗口的布局位置 o 在已有窗口中打开文件、目录或书签，并跳
Java把目录下的文件打印出来蕃薯耀列出目录下的文件文件夹下面的文件目录下的文件
Java把目录下的文件打印出来 >>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>> 蕃薯耀 2015年7月11日 11:02:
linux远程桌面----VNCServer与rdesktop hanqunfeng Desktop
windows远程桌面到linux，需要在linux上安装vncserver，并开启vnc服务，同时需要在windows下使用vnc-viewer访问Linux。vncserver同时支持linux远程桌面到linux。 linux远程桌面到windows，需要在linux上安装rdesktop，同时开启windows的远程桌面访问。下面分别介绍，以windo
guava中的join和split功能 jackyrong java
guava库中，包含了很好的join和split的功能，例子如下： 1）将LIST转换为使用字符串连接的字符串 List<String> names = Lists.newArrayList("John", "Jane", "Adam", "Tom");
Web开发技术十年发展历程 lampcy android Web 浏览器 html5
回顾web开发技术这十年发展历程： Ajax 03年的时候我上六年级，那时候网吧刚在小县城的角落萌生。传奇，大话西游第一代网游一时风靡。我抱着试一试的心态给了网吧老板两块钱想申请个号玩玩，然后接下来的一个小时我一直在，注，册，账，号。彼时网吧用的512k的带宽，注册的时候，填了一堆信息，提交，页面跳转，嘣，”您填写的信息有误，请重填”。然后跳转回注册页面，以此循环。我现在时常想，如果当时a
架构师之mima-----------------mina的非NIO控制IOBuffer(说得比较好) nannan408 buffer
1.前言。如题。 2.代码。 IoService IoService是一个接口，有两种实现：IoAcceptor和IoConnector；其中IoAcceptor是针对Server端的实现，IoConnector是针对Client端的实现；IoService的职责包括： 1、监听器管理 2、IoHandler 3、IoSession
ORA-00054:resource busy and acquire with NOWAIT specified Everyday都不同 oracle session Lock
[Oracle] 今天对一个数据量很大的表进行操作时，出现如题所示的异常。此时表明数据库的事务处于“忙”的状态，而且被lock了，所以必须先关闭占用的session。 step1，查看被lock的session： select t2.username, t2.sid, t2.serial#, t2.logon_time from v$locked_obj
javascript学习笔记 tntxia JavaScript
javascript里面有6种基本类型的值:number、string、boolean、object、function和undefined。number：就是数字值，包括整数、小数、NaN、正负无穷。string:字符串类型、单双引号引起来的内容。boolean:true、false object:表示所有的javascript对象，不用多说function:我们熟悉的方法，也就是
Java enum的用法详解 xieke90 enum 枚举
Java中枚举实现的分析：示例： public static enum SEVERITY{ INFO,WARN,ERROR } enum很像特殊的class，实际上enum声明定义的类型就是一个类。而这些类都是类库中Enum类的子类 (java.l

BP神经网络

=Confusion Matrix= 0 1 2 3 4

Confusion matrix format: Actual (rowClass) predicted as (columnClass) N times

你可能感兴趣的:(转载csdn博客)

=Confusion Matrix=
0 1 2 3 4