南鸢北折

【浙江大学机器学习胡浩基】05 深度学习

第一节历史发展

多层神经网络的劣势

大事件

第二节自编码器

自动编码机(Auto-encoder)的结构

第三节卷积神经网络LeNet

LeNet结构

降采样层

MNIST数据集

第四节卷积神经网ALEXNET

ALEXNET结构

相比于LeNet，ALEXNET在以下方面有重要改进

第一个改进以ReLU函数代替sigmoid或tanh函数

第二个改进在降采样层用MAXPOOLING代替LENET的平均降采样

第三个改进随机丢弃(dropou)

第四个改进数据扩增(Data Augumentation)

第五个改进使用GPU加速训练过程

第五节 Tensorfow

第六节 CAFFE

三种接口

主要的三个批处理文件

第七节近年来流行的卷积神经网络

VGGNET

VGGNET对ALEXNET的改进包括两个方面

RESNET

第八节目标检测与分割(上)

目标定位与识别

目标检测(多个目标)

R-CNN (Regions with CNN features)

FAST R-CNN

FASTER R-CNN

第九节目标检测与分割(下)

YOLO网络

MTCNN

P-Net(Proposal Network)

R-Net(Refine Network)

O-Net(Output Network)

全卷积网络(FULLY CONVOLUTIONAL NETWORKS)

第十节时间序列的深度学习模型（RNN和LSTM）

RNN

RNN的结构

RNN的应用

RNN的训练过程

RNN的不足

多层RNN

VANILLA RNN的训练问题

Long-Short Term Memory (LSTM)

第十一节生成对抗网络

GAN算法简介

GAN的具体应用

1、真实人脸生成

2、侧脸转正

3、图像翻译

GAN的缺点

第一节历史发展

多层神经网络的劣势

1.优化算法只能获取局部极值，算法性能与初始值有关。

2.不可解释。训练神经网络获得的参数与实际任务的关联性非常模糊。

3.模型可调整的参数很多，使得训练神经网络变成了一门“艺术”。

参数有：网络层数、每层神经元个数、非线性函数、学习率、优化方法、终止条件等等

4.如果要训练相对复杂的网络，需要大量的训练样本。而支持向量机只需要小规模样本。

大事件

事件一:

2009年，LIDENG 和DONG YU等人将深度神经网络和自编码器引入语音识别中，将大词汇连续语音识别系统的识别率提高了10个百分点以上; 彻底代替了统治这一领域20多年的基于隐含马尔可夫模型(Hidden Markov Models)和高斯混合模型(Gaussian Mixture Models)的系统。

事件二:

数据库的构建。FEI-FEI LI等人从2007年开始创造了一个大规模图像识别数据库IMAGENET，为深度学习在图像处理领域的发展奠定了数据的基础。

事件三:

2013年，HINTON的学生ALEX Krizhevsky构建了一个包含65万多个神经元，待估计参数超过6000万的大规模的神经网络。

事件四：

2016年3月，英国DEEPMIND公司基于深度学习和强化学习的围棋程序ALPHAGO

第二节自编码器

自动编码机(Auto-encoder)的结构

采用分层初始化的思想

第一步：先训练下图的网络

该网络的具体结构如下图

步骤二：训练好第一层后，接着训练第二层

步骤M

以下是详细图解

最后用BP对网络参数进行微调

第三节 卷积神经网络LeNet
LeNet结构

卷积的图示

上图这六个卷积核的参数是待定的，需要通过后向传播算法进行更新

如何求解卷积核中参数的梯度？

图中xi表示图像的像素值，wi表示卷积核的参数，pi表示特征图的参数

以上四个式子使用权值共享网络来表示，如下图

根据链式求导法则，得到

降采样层

LeNet结构中采用平均降采样。示意图如下

LeNet结构中，平均降采样的步长为（2，2）

将28*28的特征图降采样为14*14的特征图

如何对降采样层进行梯度的后向传播？

计算LeNet网络中待估计参数的个数

将7层的加起来，一共61648个

MNIST数据集

60000个训练样本

10000个测试样本

LeNet网络在测试集中识别率达到98.5%

第四节 卷积神经网ALEXNET
ALEXNET结构

在第一个卷积层中 227*227的彩色图片

彩色图片有RGB三个颜色分量，因此channel数量为3

96个11*11*3的卷积核

卷积的步长 STRIDE=(4, 4)

事实上

如果一个M*N的图像和一个m*n的卷积核进行操作

移动步长STRIDE= (P,Q)

那么得到的特征图的长H和宽W分别为

代入计算可以得出

第一个卷积层获得的特征图长宽都是55

由于有96个卷积核，因此(CHANNEL)是96

相比于LeNet，ALEXNET在以下方面有重要改进
第一个改进 以ReLU函数代替sigmoid或tanh函数

ReLU(x)=max(0,x)

SIGMOID和TANH函数在绝对值较大的情况下会出现梯度消失现象，这不利于多层神经网络的收敛

ReLU函数的全称是RECTIFIED LINEAR UNITS

X<0时，f(x)=0且f’(x)=0

X>0时，f(x)=x且f’(x)=1

避免了梯度消失的现象

假设某一层神经元的输出，大于0和小于0的个数差不多，利用RELU函数可以关闭一半左右的神经元，使它们处于非激活状态。因此，每一次训练中，只有很少一部分神经元的参数被更新，这样可以促进神经网络的收敛

第二个改进 在降采样层用MAXPOOLING代替LENET的平均降采样

池化(pooling)：把邻近的像素作为一个“池子”来重新考虑

最大池化(maxpooling)：对每一个邻近的像素组成的池子，选取最大值作为输出，

相比于平均降采样，最大池化的好处是促进网络收敛

梯度直接传导到最大值

每次更新的参数将会进一步减少

保证了网络的稳定性

第三个改进 随机丢弃(dropou)

为了避免系统参数更新过快导致过拟合，每次利用训练样本更新参数时候，随机的“丢弃”一定比例的神经元。被丢弃的神经元将不参加训练过程，输入和输出该神经元的权重系数也不做更新

这样相当于每次训练的网络架构都不一样，而这些不同的网络架构却共享相同的权重系数

对每一层，每次训练时以概率P随机丢弃一些神经元

上图为P=0.5时的情况

第四个改进数据扩增(Data Augumentation)

采用多种方法增加训练样本

①将原图水平翻转

②将256x256的图像随机选取224x224的片段作为输入图像

通过以上两个操作，可以将一幅图像变为2048幅图像

此外还可以对每幅图片引入一定的噪声，构成新的图像

第五个改进使用GPU加速训练过程

采用2片GTX580 GPU，缩短训练时间

第五节 Tensorfow

开发工具演变历程

第1-12行，载入程序的各种库

from __future__ import absolute_import
from __future__ import division
from __future__ import print_function

import gzip
import os
import tempfile
import tensorflow.compat.v1 as tf
tf.disable_v2_behavior()
import input_data
import numpy
from six.moves import urllib

第14行，读入训练和测试的数据

mnist = input_data.read_data_sets('data/', one_hot=True)

第16-28行，定义了卷积神经网络中常用的几个函数

weight_variable(shape)用来初始化权重

bias_variable(shape)用来初始化偏置

conv2d(x, W, argument)是卷积操作

max_pool_2x2(x)是最大池化操作

def weight_variable(shape):
    initial = tf.truncated_normal(shape, stddev=0.1)
    return tf.Variable(initial)

def bias_variable(shape):
    initial = tf.constant(0.1, shape=shape)
    return tf.Variable(initial)

def conv2d(x, W, argument):
    return tf.nn.conv2d(x, W, strides=[1, 1, 1, 1], padding=argument)

def max_pool_2x2(x):
    return tf.nn.max_pool(x, ksize=[1, 2, 2, 1], strides=[1, 2, 2, 1], padding='SAME')

第31-33行，初始化操作，开启流程，描述流程的输入x和输出y

其中None为占位符。这也提现了tf的一个特点：先用占位符让流程走下去，到后面再一步步明确细节

sess = tf.InteractiveSession()
x = tf.placeholder("float", shape=[None, 784])
y_ = tf.placeholder("float", shape=[None, 10])

第一个卷积层。注意conv2d(x_image, W_conv1, 'SAME')中的SAME表示输入图像自动补零，使得输出的特征图维度和输入一样。如果为VALID，则表示不补零

#First convolutional layer
W_conv1 = weight_variable([5, 5, 1, 6])
b_conv1 = bias_variable([6])

x_image = tf.reshape(x, [-1,28,28,1])

h_conv1 = tf.nn.relu(conv2d(x_image, W_conv1, 'SAME') + b_conv1)
h_pool1 = max_pool_2x2(h_conv1)

第二个卷积层。这里为VALID，表示不补零

#Second convolutional layer
W_conv2 = weight_variable([5, 5, 6, 16])
b_conv2 = bias_variable([16])

h_conv2 = tf.nn.relu(conv2d(h_pool1, W_conv2, 'VALID') + b_conv2)
h_pool2 = max_pool_2x2(h_conv2)

三个全连接层，其中keep_prob表示保留参与训练的神经元的比例

#Three fully connected layers
W_fc1 = weight_variable([5*5*16, 120])
b_fc1 = bias_variable([120])

h_pool2_flat = tf.reshape(h_pool2, [-1, 5*5*16])
h_fc1 = tf.nn.relu(tf.matmul(h_pool2_flat, W_fc1) + b_fc1)
keep_prob = tf.placeholder("float")
h_fc1_drop = tf.nn.dropout(h_fc1, keep_prob)

W_fc2 = weight_variable([120, 84])
b_fc2 = bias_variable([84])
h_fc2 =tf.nn.relu(tf.matmul(h_fc1_drop, W_fc2) + b_fc2)
h_fc2_drop = tf.nn.dropout(h_fc2, keep_prob)

W_fc3 = weight_variable([84, 10])
b_fc3 = bias_variable([10])

y_conv=tf.nn.softmax(tf.matmul(h_fc2_drop, W_fc3) + b_fc3)

训练过程

#Evaluation
cross_entropy = -tf.reduce_sum(y_*tf.log(y_conv))#设置目标函数为交叉熵
train_step = tf.train.AdamOptimizer(1e-4).minimize(cross_entropy)#使用Adam优化策略进行训练
correct_prediction = tf.equal(tf.argmax(y_conv,1), tf.argmax(y_,1))
accuracy = tf.reduce_mean(tf.cast(correct_prediction, "float"))
sess.run(tf.global_variables_initializer())
for i in range(12000):
    batch = mnist.train.next_batch(50)#每个batch有50个训练样本
    if i%100 == 0:
        train_accuracy = accuracy.eval(feed_dict={x:batch[0], y_: batch[1], keep_prob: 1.0})
        print ("step %d, training accuracy %g"%(i, train_accuracy))
    train_step.run(feed_dict={x: batch[0], y_: batch[1], keep_prob: 0.5})

第六节 CAFFE

三种接口

命令行接口、Python接口、Matlab接口

主要的三个批处理文件

1.create_imdb.sh 将数据集制作为lmdb格式

参数解释

shuffle 用以打乱数据的顺序使训练随机化

resize_height、resize width 将图片归一化为固定尺寸

training.txt、testing.txt 分别包含了训练和测试数据所在的路径

2.train_lenet.sh

3.test_lenet.sh

第七节 近年来流行的卷积神经网络
VGGNET
VGGNET对ALEXNET的改进包括两个方面

1.增加了网络的深度

2.用多个3*3卷积核叠加代替更大的卷积核，用以增加感受野(RECEPTIVE FIELD)

感受野：卷积神经网络每一层输出的特征图(feature map)上的像素点在输入图片上映射的区域大小

通俗来讲，就是特征图上的一个点对应输入图上的区域

例一:

两层3*3的卷积核卷积操作之后，第三层特征图上的每一个点的感受野是5*5，其中卷积核(filter)的步长(stride)为1，padding为0。

例二:

如果步长STRIDE=2，则两层3*3卷积核操作之后，第三层特征图上每一个点的感受野是15*15。

计算感受野的公式为

两个3*3卷积核待求参数18个

一个5*5卷积核待求参数25个

用更小卷积核叠加代替大的卷积核，可以起到减少待估计参数个数的作用。代价是需要更大的计算量和储存空间

因此，VGG是一个计算和存储开销都很大的网络

RESNET

核心思想：直接将浅层的输出作为更深层的输入，跳过中间的一些层

由于浅层和深层特征图的维度不一致，因此要使用线性变换，将浅层的特征图维度改变至与深层的一致

第八节目标检测与分割(上)

目标定位与识别

在网络的最后一层，增加四个维度的输出，分别代表

目标所属方框的左上坐标点(x，y)、方框的长和宽(h，w)

当然，图像需要进行归一化

使得这四个坐标在不同图像中具有等价关系

目标检测(多个目标)

图像中有多个目标，我们要检测出他们的位置，同时对每个目标都要进行识别。

关键问题

我们不知道有多少个目标，以及目标在哪里

R-CNN (Regions with CNN features)

核心思想：

用大大小小的方框遍历所有图片是不现实的

因此提出ROI的候选区域(Region of Proposals, or Proposals)

使用SELECTIVE SEARCH

产生候选的方框(PROPOSAL)

将这些候选方框输入到CNN中

用SVM来判断检测结果是否正确

下面来介绍Region Proposals(Selective Search,SS)

给定一张图片，首先用Efficient Graph-Basedlmage Segmentation算法将图片进行过分割(Over-Segmentation)

过分割后的每个region非常小，每个region相对应一个bounding

R-CNN算法的缺点：计算量消耗巨大

High cost to performs Selective Search(~5s per image)

Too many passes to CNN(~2000 proposals per image)

Lead to unacceptable test time(~50 per image)

High space cost to train SVM(millions of 1024-d features)

FAST R-CNN

核心思想：使用ROI-POOLING加速CNN特征提取过程

先用CNN对整幅图进行卷积，在中间某一层的特征图上再用ROI-POOLING来归一化每个候选区域的输出

根据不同候选区域在某一层特征图上的感受野，成比例地利用MAXPOOLING，将每个候选区域经过MAXPOOLING后获得的特征图在维度上变为一致

FASTER R-CNN

在卷积后的特征图上滑动窗口

用不同长宽比的矩形作为候选区域

用一个小网络来判断这些候选区域是不是存在目标

运用ROI POOLING进行归一化

第九节目标检测与分割(下)
YOLO网络

多目标检测和识别的另一个重要工作

将输入图像分割为s*s个格子

某个物体 Ground truth 的中心位置的坐标落入到某个格子

那这个格子就负责检测这个物体

每个格子预测B个bounding box及其置信度(confidence score)，以及C个类别概率

bbox信息(X，Y，w，h)为物体的中心位置相对格子位置的偏移及宽度和高度，均被归一化

置信度(confidence score)

是否包含物体，以及包含物体情况下位置的准确性

YOLOv1网络在最后使用全连接层进行类别输出

全连接层的输出维度=SxSx(Bx5+C)

上图为YOLO的结构

目标检测举例

MTCNN

利用深度学习将人脸检测和人脸特征点定位结合起来

Multitask:

1. Face detection

2. Facial landmarks localization

该网络包含三个子网络

P-Net(Proposal Network)

检测图中的人脸

产生多个人脸候选框和回归向量

用回归向量对候选窗口进行校准

通过非极大值抑制NMS来合并高度重叠的候选框

R-Net(Refine Network)

输出候选框置信度(根据置信度削减候选框数量)和回归向量

通过边界框回归和NMS精调候选框的位置

O-Net(Output Network)

削减框数量同时精调回归框

输出5个人脸关键点坐标

语义分割

检测和识别出图像的目标

确定每个目标所对应的像素

全卷积网络(FULLY CONVOLUTIONAL NETWORKS)

输入是一幅图像，输出是与输入长宽一致的图像

特征图维度先缩小再放大，采取中心对称的结构设计

上采样层(UP-SAMPINGLAYER)

使用上采样层进行特征图的放大

例如

对于MAXPOOLING，首先记录与上采样层位置对应的下采样层最大值位置

如图所示，在对应位置赋予具体数值，在其他地方补0

对卷积层的上采样

也称为反卷积(Deconvolution)或转置卷积(Transpose Convolution)

在以上卷积层中，输入特征图为4*4，卷积核为3*3，步长为1 ，得到的特征图维度为2*2

反卷积的图示如下

第十节 时间序列的深度学习模型（RNN和LSTM）
RNN
RNN的结构

t时刻的状态，与t-1时刻的状态和t时刻的输入有关

其中，ht为t时刻的状态，xt为t时刻的输入。fw与t无关

RNN的应用

多个输入和多个输出图示

典型应用：大词汇连续语音识别、机器翻译

输入特征向量，输出对应的文字。用RNN进行Triphone的识别，在TIMIT数据集上获得了比DNN-HMM更高的识别率。

多个输入和一个输出

典型应用：动作识别、行为识别、单词量有限的语音识别

一个输入和多个输出

典型应用：文本生成、图像文字标注

下图为文本生成

RNN的训练过程

将RNN沿时间轴展开

前向计算后，将每一个时刻t的LOSS加到一起作为总的目标函数，逐级求导。

由于所有数据都求导不现实，所以实际中采用的方法是将RNN截断有限步，实际中只求有限步的导数

RNN的不足

状态之间的转移函数，以及状态到输出的转移函数都过于简单

多层RNN

VANILLA RNN的训练问题

1. Bengio et al. Learning long-term dependencies with gradient descent is difficult. IEEE Transactions on Neural Networks, 1994

2. Pascanu et al, On the difficulty of training recurrent neural networks.

训练中h0获得的梯度，将是矩阵W的对应于h0的部分被乘了很多次，将会导致梯度暴涨或梯度消失。

Long-Short Term Memory (LSTM)

是RNN中的一种，增加了RNN中单元的复杂度，使模型更复杂，增加系统表现力。

相比VANILLA RNN， LSTM的误差反向传播更方便和直接，梯度更新不存在RNN中的暴涨或消失现象。

建议涉及RNN的应用都用LSTM或LSTM相关的变种

第十一节 生成对抗网络
GAN算法简介

生成器(Generator)

判别器(Discriminator)

GAN的优化目标函数如下

当G、D二者的模型容量（capacity）足够时，二者将达到纳什均衡

具体训练过程如下

GAN的具体应用

1、真实人脸生成

输人随机噪声，利用生成对抗网络来生成真实的人脸图片

参考论文:

《A Style-Based Generator Architecture for Generative Adversarial Networks》, CVPR 2019

2、侧脸转正

给定不同旋转角度下的人脸图片，通过生成对抗网络来重建正面角度下的人脸图片，可用于侧脸角度的人脸识别等现实应用。

参考论文:

《Beyond Face Rotation: Global and Local Perception GAN for Photorealistic and Identity Preserving Frontal View Synthesis》，ICCV 2017

3、图像翻译

指的是从一张(源域)图像到另一张(目标域)图像的转换。可以类比机器翻译，一种语言转换为另一种语言。翻译过程中会保持源域图像的内容不变，但是风格或者一些其他属性变成目标域

①基于成对训练数据的图像翻译

成对图像翻译典型的典型例子就是pix2pix网络 pix2pix使用成对数据训练了一个条件GAN，其Loss包括GAN的对抗loss和逐像素差loss

参考论文:

《Image-to-Image Translation with Conditional Adversarial Networks》.CVPR 2017

②基于非成对训练数据的图像翻译

实际很多情况下，成对的训练数据是很难获取到的。

CycleGAN网络

GAN的缺点

训练不稳定，难以直观观测训练过程

难以有效收敛，很多时候收敛需要运气

可能出现模式崩溃

你可能感兴趣的:(浙大ML学习笔记（完结）,学习,人工智能,算法)

情绪觉察日记第37天露露_e800
今天是家庭关系规划师的第二阶最后一天，慧萍老师帮我做了个案，帮我处理了埋在心底好多年的一份恐惧，并给了我深深的力量！这几天出来学习，爸妈过来婆家帮我带小孩，妈妈出于爱帮我收拾东西，并跟我先生和婆婆产生矛盾，妈妈觉得他们没有照顾好我…。今晚回家见到妈妈，我很欣赏她并赞扬她，妈妈说今晚要跟我睡我说好，当我们俩躺在床上准备睡觉的时候，我握着妈妈的手对她说:妈妈这几天辛苦你了，你看你多利害把我们的家收拾得
机器学习与深度学习间关系与区别 ℒℴѵℯ心·动ꦿ໊ོ꫞ 人工智能学习深度学习 python
一、机器学习概述定义机器学习（MachineLearning,ML）是一种通过数据驱动的方法，利用统计学和计算算法来训练模型，使计算机能够从数据中学习并自动进行预测或决策。机器学习通过分析大量数据样本，识别其中的模式和规律，从而对新的数据进行判断。其核心在于通过训练过程，让模型不断优化和提升其预测准确性。主要类型1.监督学习（SupervisedLearning）监督学习是指在训练数据集中包含输入
铭刻于星（四十二）随风至
69夜晚，绍敏同学做完功课后，看了眼房外，没听到动静才敢从书包的夹层里拿出那个心形纸团。折痕压得很深，都有些旧了，想来是已经写好很久了。绍敏同学慢慢地、轻轻地捏开折叠处，待到全部拆开后，又反复抚平纸张，然后仔细地一字字默看。只是开头的三个字是第一次看到，让她心漏跳了几拍。“亲爱的绍敏：从四年级的时候，我就喜欢你了，但是我一直不敢说，怕影响你学习。六年级的时候听说有人跟你表白，你接受了，我很难过，但
UI学习——cell的复用和自定义cell Magnetic_h ui 学习
目录cell的复用手动（非注册）自动（注册）自定义cellcell的复用在iOS开发中，单元格复用是一种提高表格（UITableView）和集合视图（UICollectionView）滚动性能的技术。当一个UITableViewCell或UICollectionViewCell首次需要显示时，如果没有可复用的单元格，则视图会创建一个新的单元格。一旦这个单元格滚动出屏幕，它就不会被销毁。相反，它被添
学点心理知识，呵护孩子健康静候花开_7090
昨天听了华中师范大学教育管理学系副教授张玲老师的《哪里才是学生心理健康的最后庇护所，超越教育与技术的思考》的讲座。今天又重新学习了一遍，收获匪浅。张玲博士也注意到了当今社会上的孩子由于心理问题导致的自残、自杀及伤害他人等恶性事件。她向我们普及了一个重要的命题，她说心理健康的一些基本命题，我们与我们通常的一些教育命题是不同的，她还举了几个例子，让我们明白我们原来以为的健康并非心理学上的健康。比如如果
swagger访问路径 igotyback swagger
Swagger2.x版本访问地址：http://{ip}:{port}/{context-path}/swagger-ui.html{ip}是你的服务器IP地址。{port}是你的应用服务端口，通常为8080。{context-path}是你的应用上下文路径，如果应用部署在根路径下，则为空。Swagger3.x版本对于Swagger3.x版本（也称为OpenAPI3）访问地址：http://{ip
html 中如何使用 uniapp 的部分方法某公司摸鱼前端 html uni-app 前端
示例代码：Documentconsole.log(window);效果展示：好了，现在就可以uni.使用相关的方法了
ArcGIS栅格计算器常见公式（赋值、0和空值的转换、补充栅格空值）研学随笔 arcgis 经验分享
我们在使用ArcGIS时通常经常用到栅格计算器，今天主要给大家介绍我日常中经常用到的几个公式，供大家参考学习。将特定值（-9999）赋值为0，例如-9999.Con("raster"==-9999,0,"raster")2.给空值赋予特定的值（如0）Con(IsNull("raster"),0,"raster")3.将特定的栅格值(如1)赋值为空值，其他保留原值SetNull("raster"==
高级编程--XML+socket练习题 masa010 java 开发语言
1.北京华北2114.8万人上海华东2,500万人广州华南1292.68万人成都华西1417万人（1）使用dom4j将信息存入xml中（2）读取信息，并打印控制台（3）添加一个city节点与子节点（4）使用socketTCP协议编写服务端与客户端，客户端输入城市ID，服务器响应相应城市信息（5）使用socketTCP协议编写服务端与客户端，客户端要求用户输入city对象，服务端接收并使用dom4j
【一起学Rust | 设计模式】习惯语法——使用借用类型作为参数、格式化拼接字符串、构造函数广龙宇一起学Rust #Rust设计模式 rust 设计模式开发语言
提示：文章写完后，目录可以自动生成，如何生成可参考右边的帮助文档文章目录前言一、使用借用类型作为参数二、格式化拼接字符串三、使用构造函数总结前言Rust不是传统的面向对象编程语言，它的所有特性，使其独一无二。因此，学习特定于Rust的设计模式是必要的。本系列文章为作者学习《Rust设计模式》的学习笔记以及自己的见解。因此，本系列文章的结构也与此书的结构相同（后续可能会调成结构），基本上分为三个部分
回溯 Leetcode 332 重新安排行程 mmaerd Leetcode刷题学习记录 leetcode 算法职场和发展
重新安排行程Leetcode332学习记录自代码随想录给你一份航线列表tickets，其中tickets[i]=[fromi,toi]表示飞机出发和降落的机场地点。请你对该行程进行重新规划排序。所有这些机票都属于一个从JFK（肯尼迪国际机场）出发的先生，所以该行程必须从JFK开始。如果存在多种有效的行程，请你按字典排序返回最小的行程组合。例如，行程[“JFK”,“LGA”]与[“JFK”,“LGB
Python数据分析与可视化实战指南 William数据分析 python python 数据
在数据驱动的时代，Python因其简洁的语法、强大的库生态系统以及活跃的社区，成为了数据分析与可视化的首选语言。本文将通过一个详细的案例，带领大家学习如何使用Python进行数据分析，并通过可视化来直观呈现分析结果。一、环境准备1.1安装必要库在开始数据分析和可视化之前，我们需要安装一些常用的库。主要包括pandas、numpy、matplotlib和seaborn等。这些库分别用于数据处理、数学
2019-12-22-22:30 涓涓1016
今天是冬至，写下我的日更，是因为这两天的学习真的是能量的满满，让我看到了自己，未来另外一种可能性，也让我看到了这两年这几年的过程中我所接受那些痛苦的来源。一切的根源和痛苦都来自于人生，家庭，而你的原生家庭，你的爸爸和妈妈，是因为你这个灵魂在那一刻选择他们作为你的爸爸和妈妈来的，所以你得接受他，你得接纳他，他就是因为他的存在而给你的学习和成长带来这些痛苦，那其实是你必然要经历的这个过程，当你去接纳的
Goolge earth studio 进阶4——路径修改与平滑陟彼高冈yu Google earth studio 进阶教程旅游
如果我们希望在大约中途时获得更多的城市鸟瞰视角。可以将相机拖动到这里并创建一个新的关键帧。camera_target_clip_7EarthStudio会自动平滑我们的路径，所以当我们通过这个关键帧时，不是一个生硬的角度，而是一个平滑的曲线。camera_target_clip_8路径上有贝塞尔控制手柄，允许我们调整路径的形状。右键单击，我们可以选择“平滑路径”，这是默认的自动平滑算法，或者我们可
Python教程：一文了解使用Python处理XPath 旦莫 Python进阶 python 开发语言
目录1.环境准备1.1安装lxml1.2验证安装2.XPath基础2.1什么是XPath？2.2XPath语法2.3示例XML文档3.使用lxml解析XML3.1解析XML文档3.2查看解析结果4.XPath查询4.1基本路径查询4.2使用属性查询4.3查询多个节点5.XPath的高级用法5.1使用逻辑运算符5.2使用函数6.实战案例6.1从网页抓取数据6.1.1安装Requests库6.1.2代
将cmd中命令输出保存为txt文本文件落难Coder Windows cmd window
最近深度学习本地的训练中我们常常要在命令行中运行自己的代码，无可厚非，我们有必要保存我们的炼丹结果，但是复制命令行输出到txt是非常麻烦的，其实Windows下的命令行为我们提供了相应的操作。其基本的调用格式就是：运行指令>输出到的文件名称或者具体保存路径测试下，我打开cmd并且ping一下百度：pingwww.baidu.com>./data.txt看下相同目录下data.txt的输出：如果你再
基于社交网络算法优化的二维最大熵图像分割智能算法研学社（Jack旭）智能优化算法应用图像分割算法 php 开发语言
智能优化算法应用：基于社交网络优化的二维最大熵图像阈值分割-附代码文章目录智能优化算法应用：基于社交网络优化的二维最大熵图像阈值分割-附代码1.前言2.二维最大熵阈值分割原理3.基于社交网络优化的多阈值分割4.算法结果：5.参考文献：6.Matlab代码摘要：本文介绍基于最大熵的图像分割，并且应用社交网络算法进行阈值寻优。1.前言阅读此文章前，请阅读《图像分割：直方图区域划分及信息统计介绍》htt
四章-32-点要素的聚合彩云飘过
本文基于腾讯课堂老胡的课《跟我学Openlayers--基础实例详解》做的学习笔记，使用的openlayers5.3.xapi。源码见1032.html，对应的官网示例https://openlayers.org/en/latest/examples/cluster.htmlhttps://openlayers.org/en/latest/examples/earthquake-clusters.
DIV+CSS+JavaScript技术制作网页（旅游主题网页设计与制作）云南大理 STU学生网页设计网页设计期末网页作业 html静态网页 html5期末大作业网页设计 web大作业
️精彩专栏推荐作者主页:【进入主页—获取更多源码】web前端期末大作业：【HTML5网页期末作业(1000套)】程序员有趣的告白方式：【HTML七夕情人节表白网页制作(110套)】文章目录二、网站介绍三、网站效果▶️1.视频演示2.图片演示四、网站代码HTML结构代码CSS样式代码五、更多源码二、网站介绍网站布局方面：计划采用目前主流的、能兼容各大主流浏览器、显示效果稳定的浮动网页布局结构。网站程
探索OpenAI和LangChain的适配器集成：轻松切换模型提供商 nseejrukjhad langchain easyui 前端 python
#探索OpenAI和LangChain的适配器集成：轻松切换模型提供商##引言在人工智能和自然语言处理的世界中，OpenAI的模型提供了强大的能力。然而，随着技术的发展，许多人开始探索其他模型以满足特定需求。LangChain作为一个强大的工具，集成了多种模型提供商，通过提供适配器，简化了不同模型之间的转换。本篇文章将介绍如何使用LangChain的适配器与OpenAI集成，以便轻松切换模型提供商
深入理解 MultiQueryRetriever：提升向量数据库检索效果的强大工具 nseejrukjhad 数据库 python
深入理解MultiQueryRetriever：提升向量数据库检索效果的强大工具引言在人工智能和自然语言处理领域，高效准确的信息检索一直是一个关键挑战。传统的基于距离的向量数据库检索方法虽然广泛应用，但仍存在一些局限性。本文将介绍一种创新的解决方案：MultiQueryRetriever，它通过自动生成多个查询视角来增强检索效果，提高结果的相关性和多样性。MultiQueryRetriever的工
GitHub上克隆项目 bigbig猩猩 github
从GitHub上克隆项目是一个简单且直接的过程，它允许你将远程仓库中的项目复制到你的本地计算机上，以便进行进一步的开发、测试或学习。以下是一个详细的步骤指南，帮助你从GitHub上克隆项目。一、准备工作1.安装Git在克隆GitHub项目之前，你需要在你的计算机上安装Git工具。Git是一个开源的分布式版本控制系统，用于跟踪和管理代码变更。你可以从Git的官方网站（https://git-scm.
关于城市旅游的HTML网页设计——(旅游风景云南 5页)HTML+CSS+JavaScript 二挡起步 web前端期末大作业 javascript html css 旅游风景
⛵源码获取文末联系✈Web前端开发技术描述网页设计题材，DIV+CSS布局制作,HTML+CSS网页设计期末课程大作业|游景点介绍|旅游风景区|家乡介绍|等网站的设计与制作|HTML期末大学生网页设计作业，Web大学生网页HTML：结构CSS：样式在操作方面上运用了html5和css3，采用了div+css结构、表单、超链接、浮动、绝对定位、相对定位、字体样式、引用视频等基础知识JavaScrip
HTML网页设计制作大作业（div+css）云南我的家乡旅游景点带文字滚动二挡起步 web前端期末大作业 web设计网页规划与设计 html css javascript dreamweaver 前端
Web前端开发技术描述网页设计题材，DIV+CSS布局制作,HTML+CSS网页设计期末课程大作业游景点介绍|旅游风景区|家乡介绍|等网站的设计与制作HTML期末大学生网页设计作业HTML：结构CSS：样式在操作方面上运用了html5和css3，采用了div+css结构、表单、超链接、浮动、绝对定位、相对定位、字体样式、引用视频等基础知识JavaScript：做与用户的交互行为文章目录前端学习路线
Day1笔记-Python简介&标识符和关键字&输入输出 ~在杰难逃~ Python python 开发语言大数据数据分析数据挖掘
大家好，从今天开始呢，杰哥开展一个新的专栏，当然，数据分析部分也会不定时更新的，这个新的专栏主要是讲解一些Python的基础语法和知识，帮助0基础的小伙伴入门和学习Python，感兴趣的小伙伴可以开始认真学习啦！一、Python简介【了解】1.计算机工作原理编程语言就是用来定义计算机程序的形式语言。我们通过编程语言来编写程序代码，再通过语言处理程序执行向计算机发送指令，让计算机完成对应的工作，编程
【目标检测数据集】卡车数据集1073张VOC+YOLO格式熬夜写代码的平头哥∰ 目标检测 YOLO 人工智能
数据集格式：PascalVOC格式+YOLO格式(不包含分割路径的txt文件，仅仅包含jpg图片以及对应的VOC格式xml文件和yolo格式txt文件)图片数量(jpg文件个数)：1073标注数量(xml文件个数)：1073标注数量(txt文件个数)：1073标注类别数：1标注类别名称:["truck"]每个类别标注的框数：truck框数=1120总框数：1120使用标注工具：labelImg标注
121. 买卖股票的最佳时机薄荷糖的味道_fb40
给定一个数组，它的第i个元素是一支给定股票第i天的价格。如果你最多只允许完成一笔交易（即买入和卖出一支股票），设计一个算法来计算你所能获取的最大利润。注意你不能在买入股票前卖出股票。示例1:输入:[7,1,5,3,6,4]输出:5解释:在第2天（股票价格=1）的时候买入，在第5天（股票价格=6）的时候卖出，最大利润=6-1=5。注意利润不能是7-1=6,因为卖出价格需要大于买入价格。示例2:输入:
人工智能时代，程序员如何保持核心竞争力？ jmoych 人工智能
随着AIGC（如chatgpt、midjourney、claude等）大语言模型接二连三的涌现，AI辅助编程工具日益普及，程序员的工作方式正在发生深刻变革。有人担心AI可能取代部分编程工作，也有人认为AI是提高效率的得力助手。面对这一趋势,程序员应该如何应对?是专注于某个领域深耕细作，还是广泛学习以适应快速变化的技术环境?又或者，我们是否应该将重点转向AI无法轻易替代的软技能？让我们一起探讨程序员
每日算法&面试题，大厂特训二十八天——第二十天（树）肥学 ⚡算法题⚡面试题每日精进 java 算法数据结构
目录标题导读算法特训二十八天面试题点击直接资料领取导读肥友们为了更好的去帮助新同学适应算法和面试题，最近我们开始进行专项突击一步一步来。上一期我们完成了动态规划二十一天现在我们进行下一项对各类算法进行二十八天的一个小总结。还在等什么快来一起肥学进行二十八天挑战吧！！特别介绍小白练手专栏，适合刚入手的新人欢迎订阅编程小白进阶python有趣练手项目里面包括了像《机器人尬聊》《恶搞程序》这样的有趣文章
node.js学习小猿L node.js node.js 学习 vim
node.js学习实操及笔记温故node.js，node.js学习实操过程及笔记~node.js学习视频node.js官网node.js中文网实操笔记githubcsdn笔记为什么学node.js可以让别人访问我们编写的网页为后续的框架学习打下基础，三大框架vuereactangular离不开node.jsnode.js是什么官网：node.js是一个开源的、跨平台的运行JavaScript的运行
关于旗正规则引擎下载页面需要弹窗保存到本地目录的问题何必如此 jsp 超链接文件下载窗口
生成下载页面是需要选择“录入提交页面”，生成之后默认的下载页面<a>标签超链接为：<a href="<%=root_stimage%>stimage/image.jsp?filename=<%=strfile234%>&attachname=<%=java.net.URLEncoder.encode(file234filesourc
【Spark九十八】Standalone Cluster Mode下的资源调度源代码分析 bit1129 cluster
在分析源代码之前，首先对Standalone Cluster Mode的资源调度有一个基本的认识：首先，运行一个Application需要Driver进程和一组Executor进程。在Standalone Cluster Mode下，Driver和Executor都是在Master的监护下给Worker发消息创建(Driver进程和Executor进程都需要分配内存和CPU，这就需要Maste
linux上独立安装部署spark daizj linux 安装 spark 1.4 部署
下面讲一下linux上安装spark，以 Standalone Mode 安装 1）首先安装JDK 下载JDK：jdk-7u79-linux-x64.tar.gz ，版本是1.7以上都行，解压 tar -zxvf jdk-7u79-linux-x64.tar.gz 然后配置 ~/.bashrc&nb
Java 字节码之解析一周凡杨 java 字节码 javap
一： Java 字节代码的组织形式类文件 { OxCAFEBABE ，小版本号，大版本号，常量池大小，常量池数组，访问控制标记，当前类信息，父类信息，实现的接口个数，实现的接口信息数组，域个数，域信息数组，方法个数，方法信息数组，属性个数，属性信息数组 } &nbs
java各种小工具代码 g21121 java
1.数组转换成List import java.util.Arrays; Arrays.asList(Object[] obj); 2.判断一个String型是否有值 import org.springframework.util.StringUtils; if (StringUtils.hasText(str)) 3.判断一个List是否有值 import org.spring
加快FineReport报表设计的几个心得体会老A不折腾 finereport
一、从远程服务器大批量取数进行表样设计时，最好按“列顺序”取一个“空的SQL语句”，这样可提高设计速度。否则每次设计时模板均要从远程读取数据，速度相当慢！！二、找一个富文本编辑软件（如NOTEPAD+）编辑SQL语句，这样会很好地检查语法。有时候带参数较多检查语法复杂时，结合FineReport中生成的日志，再找一个第三方数据库访问软件（如PL/SQL）进行数据检索，可以很快定位语法错误。
mysql linux启动与停止墙头上一根草
如何启动/停止/重启MySQL一、启动方式1、使用 service 启动：service mysqld start2、使用 mysqld 脚本启动：/etc/inint.d/mysqld start3、使用 safe_mysqld 启动：safe_mysqld&二、停止1、使用 service 启动：service mysqld stop2、使用 mysqld 脚本启动：/etc/inin
Spring中事务管理浅谈 aijuans spring 事务管理
Spring中事务管理浅谈 By Tony Jiang@2012-1-20 Spring中对事务的声明式管理拿一个XML举例 [html] view plain copy print ? <?xml version="1.0" encoding="UTF-8"?>&nb
php中隐形字符65279（utf-8的BOM头）问题 alxw4616
php中隐形字符65279（utf-8的BOM头）问题今天遇到一个问题. php输出JSON 前端在解析时发生问题:parsererror. 调试: 1.仔细对比字符串发现字符串拼写正确.怀疑是非打印字符的问题. 2.逐一将字符串还原为unicode编码. 发现在字符串头的位置出现了一个 65279的非打印字符.
调用对象是否需要传递对象(初学者一定要注意这个问题) 百合不是茶对象的传递与调用技巧
类和对象的简单的复习,在做项目的过程中有时候不知道怎样来调用类创建的对象,简单的几个类可以看清楚,一般在项目中创建十几个类往往就不知道怎么来看为了以后能够看清楚,现在来回顾一下类和对象的创建,对象的调用和传递(前面写过一篇) 类和对象的基础概念: JAVA中万事万物都是类类有字段(属性),方法,嵌套类和嵌套接
JDK1.5 AtomicLong实例 bijian1013 java thread java多线程 AtomicLong
JDK1.5 AtomicLong实例类 AtomicLong 可以用原子方式更新的 long 值。有关原子变量属性的描述，请参阅 java.util.concurrent.atomic 包规范。AtomicLong 可用在应用程序中（如以原子方式增加的序列号），并且不能用于替换 Long。但是，此类确实扩展了 Number，允许那些处理基于数字类的工具和实用工具进行统一访问。
自定义的RPC的Java实现 bijian1013 java rpc
网上看到纯java实现的RPC，很不错。 RPC的全名Remote Process Call，即远程过程调用。使用RPC，可以像使用本地的程序一样使用远程服务器上的程序。下面是一个简单的RPC 调用实例，从中可以看到RPC如何
【RPC框架Hessian一】Hessian RPC Hello World bit1129 Hello world
什么是Hessian The Hessian binary web service protocol makes web services usable without requiring a large framework, and without learning yet another alphabet soup of protocols. Because it is a binary p
【Spark九十五】Spark Shell操作Spark SQL bit1129 shell
在Spark Shell上，通过创建HiveContext可以直接进行Hive操作 1. 操作Hive中已存在的表 [hadoop@hadoop bin]$ ./spark-shell Spark assembly has been built with Hive, including Datanucleus jars on classpath Welcom
F5　往header加入客户端的ip ronin47
when HTTP_RESPONSE {if {[HTTP::is_redirect]}{ HTTP::header replace Location [string map {:port/ /} [HTTP::header value Location]]HTTP::header replace Lo
java-61-在数组中，数字减去它右边(注意是右边)的数字得到一个数对之差. 求所有数对之差的最大值。例如在数组{2, 4, 1, 16, 7, 5, bylijinnan java
思路来自： http://zhedahht.blog.163.com/blog/static/2541117420116135376632/ 写了个java版的 public class GreatestLeftRightDiff { /** * Q61.在数组中，数字减去它右边(注意是右边)的数字得到一个数对之差。 * 求所有数对之差的最大值。例如在数组
mongoDB 索引开窍的石头 mongoDB索引
在这一节中我们讲讲在mongo中如何创建索引得到当前查询的索引信息 db.user.find(_id:12).explain(); cursor: basicCoursor 指的是没有索引 &
[硬件和系统]迎峰度夏 comsci 系统
从这几天的气温来看，今年夏天的高温天气可能会维持在一个比较长的时间内所以，从现在开始准备渡过炎热的夏天。。。。每间房屋要有一个落地电风扇，一个空调(空调的功率和房间的面积有密切的关系) 坐的，躺的地方要有凉垫，床上要有凉席电脑的机箱
基于ThinkPHP开发的公司官网 cuiyadll 行业系统
后端基于ThinkPHP，前端基于jQuery和BootstrapCo.MZ 企业系统轻量级企业网站管理系统运行环境:PHP5.3+, MySQL5.0 系统预览系统下载：http://www.tecmz.com 预览地址：http://co.tecmz.com 各种设备自适应响应式的网站设计能够对用户产生友好度，并且对于
Transaction and redelivery in JMS (JMS的事务和失败消息重发机制) darrenzhu jms 事务承认 MQ acknowledge
JMS Message Delivery Reliability and Acknowledgement Patterns http://wso2.com/library/articles/2013/01/jms-message-delivery-reliability-acknowledgement-patterns/ Transaction and redelivery in
Centos添加硬盘完全教程 dcj3sjt126com linux centos hardware
Linux的硬盘识别: sda 表示第1块SCSI硬盘 hda 表示第1块IDE硬盘 scd0 表示第1个USB光驱一般使用“fdisk -l”命
yii2 restful web服务路由 dcj3sjt126com PHP yii2
路由随着资源和控制器类准备，您可以使用URL如 http://localhost/index.php?r=user/create访问资源，类似于你可以用正常的Web应用程序做法。在实践中，你通常要用美观的URL并采取有优势的HTTP动词。例如，请求POST /users意味着访问user/create动作。这可以很容易地通过配置urlManager应用程序组件来完成如下所示
MongoDB查询(4)——游标和分页[八] eksliang mongodb MongoDB游标 MongoDB深分页
转载请出自出处：http://eksliang.iteye.com/blog/2177567 一、游标数据库使用游标返回find的执行结果。客户端对游标的实现通常能够对最终结果进行有效控制，从shell中定义一个游标非常简单，就是将查询结果分配给一个变量（用var声明的变量就是局部变量），便创建了一个游标，如下所示： > var
Activity的四种启动模式和onNewIntent() gundumw100 android
Android中Activity启动模式详解　　在Android中每个界面都是一个Activity，切换界面操作其实是多个不同Activity之间的实例化操作。在Android中Activity的启动模式决定了Activity的启动运行方式。　　Android总Activity的启动模式分为四种： Activity启动模式设置： <acti
攻城狮送女友的CSS3生日蛋糕 ini html Web html5 css css3
在线预览：http://keleyi.com/keleyi/phtml/html5/29.htm 代码如下： <!DOCTYPE html> <html> <head> <meta charset="UTF-8"> <title>攻城狮送女友的CSS3生日蛋糕-柯乐义<
读源码学Servlet（1）GenericServlet 源码分析 jzinfo tomcat Web servlet 网络应用网络协议
Servlet API的核心就是javax.servlet.Servlet接口，所有的Servlet 类（抽象的或者自己写的）都必须实现这个接口。在Servlet接口中定义了5个方法，其中有3个方法是由Servlet 容器在Servlet的生命周期的不同阶段来调用的特定方法。先看javax.servlet.servlet接口源码： package
JAVA进阶：VO(DTO)与PO(DAO)之间的转换 snoopy7713 java VO Hibernate po
PO即 Persistence Object　　VO即 Value Object 　VO和PO的主要区别在于：　　VO是独立的Java Object。　　PO是由Hibernate纳入其实体容器（Entity Map）的对象，它代表了与数据库中某条记录对应的Hibernate实体，PO的变化在事务提交时将反应到实际数据库中。　实际上，这个VO被用作Data Transfer
mongodb group by date 聚合查询日期统计每天数据（信息量） qiaolevip 每天进步一点点学习永无止境 mongodb 纵观千象
/* 1 */ { "_id" : ObjectId("557ac1e2153c43c320393d9d"), "msgType" : "text", "sendTime" : ISODate("2015-06-12T11:26:26.000Z")
java之18天常用的类(一) Luob. Math Date System Runtime Rundom
System类 import java.util.Properties; /** * System: * out:标准输出,默认是控制台 * in:标准输入,默认是键盘 * * 描述系统的一些信息 * 获取系统的属性信息:Properties getProperties(); * * * */ public class Sy
maven wuai maven
1、安装maven：解压缩、添加M2_HOME、添加环境变量path 2、创建maven_home文件夹，创建项目mvn_ch01,在其下面建立src、pom.xml，在src下面简历main、test、main下面建立java文件夹 3、编写类，在java文件夹下面依照类的包逐层创建文件夹，将此类放入最后一级文件夹 4、进入mvn_ch01 4.1、mvn compile ,执行后会在

【浙江大学机器学习胡浩基】05 深度学习

第一节 历史发展

多层神经网络的劣势

大事件

第二节 自编码器

自动编码机(Auto-encoder)的结构

第三节 卷积神经网络LeNet

LeNet结构

降采样层

MNIST数据集

第四节 卷积神经网ALEXNET

ALEXNET结构

相比于LeNet，ALEXNET在以下方面有重要改进

第一个改进 以ReLU函数代替sigmoid或tanh函数

第二个改进 在降采样层用MAXPOOLING代替LENET的平均降采样

第三个改进 随机丢弃(dropou)

第四个改进 数据扩增(Data Augumentation)

第五个改进 使用GPU加速训练过程

第五节 Tensorfow

第六节 CAFFE

三种接口

主要的三个批处理文件

第七节 近年来流行的卷积神经网络

VGGNET

VGGNET对ALEXNET的改进包括两个方面

RESNET

第八节 目标检测与分割(上)

目标定位与识别

目标检测(多个目标)

R-CNN (Regions with CNN features)

FAST R-CNN

FASTER R-CNN

第九节 目标检测与分割(下)

YOLO网络

MTCNN

P-Net(Proposal Network)

R-Net(Refine Network)

O-Net(Output Network)

全卷积网络(FULLY CONVOLUTIONAL NETWORKS)

第十节 时间序列的深度学习模型（RNN和LSTM）

RNN

RNN的结构

RNN的应用

RNN的训练过程

RNN的不足

多层RNN

VANILLA RNN的训练问题

Long-Short Term Memory (LSTM)

第十一节 生成对抗网络

GAN算法简介

GAN的具体应用

1、真实人脸生成

2、侧脸转正

3、图像翻译

GAN的缺点

你可能感兴趣的:(浙大ML学习笔记（完结）,学习,人工智能,算法)

第一节历史发展

第二节自编码器

第三节卷积神经网络LeNet

第四节卷积神经网ALEXNET

第一个改进以ReLU函数代替sigmoid或tanh函数

第二个改进在降采样层用MAXPOOLING代替LENET的平均降采样

第三个改进随机丢弃(dropou)

第四个改进数据扩增(Data Augumentation)

第五个改进使用GPU加速训练过程

第七节近年来流行的卷积神经网络

第八节目标检测与分割(上)

第九节目标检测与分割(下)

第十节时间序列的深度学习模型（RNN和LSTM）

第十一节生成对抗网络