oldmao_2000

番外.李宏毅学习笔记.12.GNN

文章目录

前言
Introduction
- NN（略）
- Graph
- 常见GNN应用
- - Classification
  - Generation
  - 结合社交网络的分类
- 现有问题
Roadmap
Tasks, Dataset, and Benchmark
- Graph Classification: SuperPixel MNIST and CIFAR10
- Regression: ZINC molecule graphs dataset
- Node classification:Stochastic Block Model dataset
- Edge classification: Traveling Salesman Problem
- 性能分析
Spatial-based GNN
- 法1：NN4G (Neural Networks for Graph)09年
- 法2：DCNN (Diffusion-Convolution Neural Network )15年
- 法3：MoNET (Mixture Model Networks)16年
- 法4：GraphSAGE.18年
- 法5：GAT (Graph Attention Networks).18年
- 理论：GIN (Graph Isomorphism Network)
Graph Signal Processing and Spectral-based GNN
- Warning of Signal And System（没看懂系列。。。）
- - Fourier Series Representation
  - 信号表示的两个域
  - Spectral Graph Theory
  - Discrete time Fourier basis
  - Filtering
  - ChebNet.17年
- GCN
Graph Generation
- VAE-based mode
- GAN-based model
- AR-based model
GNN for NLP（略）
Summary and Take Home Notes
Online Resources

前言

2020版加了一些内容，补充进来
这课是貌似是TA姜成翰讲的Graph Neural Networks
这个玩意最近挺热，基于GNN做知识图谱还有推荐系统效果貌似不错。
公式输入请参考：在线Latex公式
GNN的公共库：https://www.dgl.ai/

Introduction

GNN可以分为两部分

NN（略）

NN这块就列举了FC、CNN、RNN。以及时下最潮的变形金刚。
图这课主要举了几个例子

Graph

普通的树

化学

蛋白质表达

地铁

现在要思考的是如何把图按原来NN的思路进行输入？
就是把

变成：

这先挖坑，后面再讲。

常见GNN应用

Classification

Generation

新冠靶向药的开发。
在生成的过程中可以加入很多constraint，例如：是新药，比较好合成，有效性等。

https://arxiv.org/pdf/1802.03480.pdf

结合社交网络的分类

现有数据：某烧脑侦探剧，用GNN来分类谁是凶手，输入可以是这些人的属性：姓名、性别职业什么的。

训练的模型可以干这个事情：

当然这是不够的，可以结合人物（实体）之间的关系来辅助分类，这个就是GNN的范畴。

现有问题

1.How do we utilize the structures and relationship to help our model?关系杂
2.What if the graph is larger, like 20k nodes?模型大
3.What if we don‘t have the all the labels?无标签
看下面一个例子来理解，现有这样一个图结构：

蓝色是Unlabeled Node，褐色是Labeled Node
现在要推断黄圈中的节点的标签。
思想是A node can learn the structure from its neighbors（近朱者赤，近墨者黑）, but how?

借鉴CNN中的卷积操作，假设有6 x 6 image with 3 x 3 kernel

然后要对绿色和黄色的点进行特征提取，实际上是：

和filter相乘相加后就得到feature map。如何把卷积操作移植到Graph上？
Solution 1: Generalize the concept of convolution (corelation) to graph >> Spatial-based convolution
Solution 2: Back to the definition of convolution in signal processing>> Spectral-based convolution
第一种是把CNN的操作Generalize到GNN上。
第二种是借鉴信号处理中做法来进行卷积操作。

Roadmap

根据上面的两种Solutions，本次课程的内容如下：

Tasks, Dataset, and Benchmark

Tasks
ØSemi-supervised node classification
ØRegression
ØGraph classification
ØGraph representation learning
ØLink prediction
Common dataset
ØCORA: citation network. 2.7k nodes and 5.4k links
ØTU-MUTAG: 188 molecules with 18 nodes on average

Graph Classification: SuperPixel MNIST and CIFAR10

https://arxiv.org/pdf/2003.00982.pdf
先把图片转换为SuperPixel，然后再找出点之间的graph结构，进行识别

Regression: ZINC molecule graphs dataset

https://arxiv.org/pdf/1711.07553.pdf

Node classification:Stochastic Block Model dataset

从已知的图结构，去找相似的pattern。左边
从图结构中做聚类。右边

Edge classification: Traveling Salesman Problem

将边进行分类，判断边是否属于最短路径中的边。

性能分析

不是层越多就是性能越好。
还可以用DropEdge得到类似抓爆的效果

Spatial-based GNN

这个是solution 1，因此是根据CNN的卷积进行移植：

要把下面的图中箭头所指的节点进行更新得到下一层的状态

注意上图中的箭头所指的节点是

Terminology:
ØAggregate: 用 neighbor feature update 下一层的 hidden state
ØReadout: 把所有 nodes 的 feature 集合起來代表整个 graph（类似LSTM把整个句子向量压缩为一个向量）

法1：NN4G (Neural Networks for Graph)09年

https://ieeexplore.ieee.org/document/4773279

然后，每个节点都做同样的操作： $\bar w_i\cdot x_i$

下一层中，就把邻居的信息作为输入，更新到 $v_3$ ，然后还要加上本身的信息。

每层都计算完成后，进行Readout操作，每层都计算 $X_i=MEAN(h^l)$ ，最后 $y=\sum_i^lX_i\cdot w_i$

法2：DCNN (Diffusion-Convolution Neural Network )15年

https://arxiv.org/abs/1511.02136

第一层：

$w_3^0MEAN(d(3,\cdot))=1$
上式表示把和第三个节点距离为1的节点加起来取平均，然后点乘 $w_3^0$
第二层：

表示把和第三个节点距离为3的节点加起来取平均，然后点乘 $w_3^1$ ，每个节点都做这个事情：

然后把每层的每个节点特征 $h_i^l$ 堆叠起来得到 $H^l$

每个节点的特征计算就把节点i对应的 $h_i^l$ 从堆叠结果中提取出来，然后点乘w即可。

法3：MoNET (Mixture Model Networks)16年

https://arxiv.org/pdf/1611.08402.pdf
上面两个方法在处理节点和节点之间的关系的时候都是用加法，其实忽略节点之间如果边有权重，这样是不合理的，因此这个方法就是用来解决不同权重边的方法。
Define a measure on node ‘distances’
Use weighted sum (mean) instead of simply summing up (averaging) neighbor features.
具体做法如下：

$u(x,y)=(\cfrac{1}{\sqrt{deg(x)}},\cfrac{1}{\sqrt{deg(y)}})^T$
其中 $d e g$ 代表节点的度，例如：节点3的度为3，节点0的度为2，因此 $u(3,2)=(\cfrac{1}{\sqrt{3}},\cfrac{1}{\sqrt{2}})^T$
然后特征计算要根据下面公式来算：

法4：GraphSAGE.18年

https://arxiv.org/pdf/1706.02216.pdf
SAmple and aggreGatE
Can work on both transductive and inductive setting
GraphSAGE learns how to embed node features from neighbors

这个方法在提取邻居信息上提出了三种方式：
AGGREGATION: mean, max-pooling, or LSTM

法5：GAT (Graph Attention Networks).18年

https://arxiv.org/pdf/1710.10903.pdf

理论：GIN (Graph Isomorphism Network)

这个文章提供了证明什么方法是work的，什么方法是无用的。结论：

更新第k层第v个节点的时候要把它的邻居做求和，然后加上该节点与某个常数的乘积。这里提的是直接求和，不是求平均，也不是做maxpooling。为什么？
情况一，如果节点v的邻居都一样，求平均的话无法区分下面两种不同图结构。

同理，还有下面两种情况：

Graph Signal Processing and Spectral-based GNN

这节讲的是solution 2，就是用信号处理的方式来进行特征提取。之前讲过，直接对图中的节点做卷积是不行的，因为不能把节点的邻居和CNN中的卷积核位置一一对应，然后做运算，于是借鉴信号处理的方法，先用傅里叶变化分别处理节点和卷积核，然后相乘，然后再反傅里叶变化得到结果：

Warning of Signal And System（没看懂系列。。。）

一个信号可以看做是一个n维空间的向量，这个向量是由一组基向量合成的，下面这些TA都没解释清楚。。。

Fourier Series Representation

傅里叶级数：可以把某一个周期信号进行傅里叶展开

信号表示的两个域

可以从公式里面大概可以看出来，一个信号表示的原始形式可以经过一些变化得到另外一种表示方式（不同的Basis）。
时域信号

频域信号

变化要借助的是傅里叶变化

Spectral Graph Theory

notation：
Graph: G=(V,E), N=|V|(节点数量)
邻接矩阵：w是相连节点的边的权重

度矩阵，是一个对角（且对称）矩阵，记录了节点的邻居：

向量f(V)，代表节点上的信号

例子：

加入信号表示为，信号可以表示为节点的属性，例如路网图，那么节点表示某地区的气温之类的信息（这里信号表示可以是常量也可以是向量）：

图的laplacian矩阵L，其定义是：度矩阵-邻接矩阵，度矩阵和邻接矩阵都是对称的，所以L也是对称的，而且还是半正定的矩阵。因此可以分解为： $L=U\wedge U^T$ ，其中U是特征向量， $\wedge$ 是特征值

接上面的例子。并给出具体的向量表示：

写出邻接矩阵A和度矩阵D：

然后算出拉普拉斯矩阵D-A

然后计算L的特征值和特征向量
由于L是半正定矩阵，所以算出来的特征值都是大于等于0的

算出来的特征向量为：

红字标出来是每个特征值对应的特征向量（一个值对一列）。
每个列可以表示到图上：

Discrete time Fourier basis

从上到下，看到频率越大，相邻两点之间的信号变化越大，最下面的相邻信号是相反的。这个概念很重要，可以用来解决GNN中的节点信号推断的问题。
把拉普拉斯矩阵作为一个运算符，对图上的信号f进行运算： $L f$ 。
$L f = (D - A) f = D f - A f$
用上面的图做例子，算一下 $L f$

以计算 $L f$ 中的a为例：a等于D中的第一行乘以f减去A的第一行乘以f。

对照下图来看计算这个a的过程是什么意思：
第一个蓝色圈圈2表示 $v_0$ 的邻居个数
第二个蓝色圈圈4表示 $v_0$ 的信号
第三、四个蓝色圈圈分别表示 $v_0$ 的邻居的信号

当然表示两个信号的差异的方法是取平方，因此数学上表示为：

上面的 $f(v_i)-f(v_j))^2$ 表示节点i和j之间的信号能量差。能量差越小，信号越smooth，就像上面信号图一样，能量差为0就是第一个图片了。
因此： $f^TLf$ 可以用来表示能量差。代入具体值：
$u_i^TLu_i=u_i^T\lambda_i u_i=\lambda u_i^T u_i=\lambda_i$
这样变化以后，就得到：特征值就可以代表当前节点和相邻节点的能量差，会看上面的图：

节点0的特征值为0，所以它和他的相邻节点的能量差为0，能量差越小，越平滑，所以看到它和相邻节点的能量（频率）都同向，同大小。
看一个极端的例子，假设我们的图是一个直线，共有20个节点：

可以看到 $\lambda$ 变大后的频率变化：

以上内容就是要为接下来的GNN中的傅里叶变化做的铺垫。
先来看普通的信号的傅里叶变化

推广到图信号的傅里叶变化：
Graph Fourier Transform of signal x: $\hat x=U^Tx$
x相当于铺垫中的f；
U相当于铺垫中的特征值堆叠起来的向量


当然把上面的箭头反向回去也是可以的。（上面的箭头方向是把time domain信号转回frequency domain信号，如果反过来就是frequency domain信号转time domain信号）下面看反过来怎么搞，也是先看普通信号，再推广到图信号
下面是普通信号：求 $t=t_0$ 时刻的时域信号强度：注意框框的颜色是对应的，最上面是表达式。

下面是图信号的frequency domain信号转time domain信号：
下面是U

下面相当于 $\hat x$

注意上面的颜色，合成计算：

下面找出在GNN 上做filter的方式：

Filtering

先看普通的滤波怎么做：
modifying the amplitude/ phase of the different frequency components in a signal, including eliminating some frequency components entirely.
– frequency shaping, frequency selective

再看GNN的滤波：
Filtering: Convolution in time domain is multiplication in frequency domain.在时域的卷积相当于频域中做乘法。

把之前的内容代入上面的公式：

这个问题有点麻烦，在CNN中，无论输入多大，我都可以用3×3或者5×5大小的卷积核来进行卷积，这里推理出来的卷积操作需要的 $g_\theta$ 的维度和输入的图的维度有关，这样在复杂度上不说了，就是失去了灵活性，没有了参数共享的优势。不同类型的图需要的卷积核不一样大。
第二个问题，由于 $g_\theta$ 可以为任意函数，如果取 $g_\theta(L)=L$ ，可以看到下面第一行的最后一个为0，因为当距离为1的时候， $v_0$ 和 $v_3$ 不相邻


如果取 $g_\theta(L)=L^2$ ，可以看到下面第一行的最后一个不为0，因为当距离为2的时候， $v_0$ 和所有节点相邻

因此可以推理我们用 $g_\theta(L)=L^N$ ，那么有N个节点的图在做filter运算的时候每个节点都会受到来自其他所有节点的影响。这个有点类似CNN中的感受野的概念，CNN中filter越大，看到（覆盖）的图像面积越大。
所以，第二个问题就是Not localize
两个问题的解决方案ChebNet。

ChebNet.17年

https://arxiv.org/pdf/1606.09375.pdf
思想是把 $g_\theta(L)$ 定为拉普拉斯的K项多项式，使得卷积操作是K-localized（解决问题2）

而且使得要学习的参数从O(N)变成了O(K)（解决问题1）
用了这个之后，卷积操作的时间复杂度变比较高： $O(N^2)$ （问题三出来了）

解决问题三：
Use a polynomial function that can be computed recursively from L
Chebyshev polynomial

把x替换为 $\tilde\Lambda$

那么拉普拉斯多项式就变成：

整理要filter的信号y：

上面是递归的操作。

GCN

Graph Convolutional Networks 就是用上面的公式，设置k=1

展开：

最后形式：

大概意思是邻居乘以w取平均，然后加上bias，经过激活函数得结果。

Graph Generation

VAE-based model: Generate a whole graph in one step
GAN-based model: Generate a whole graph in one step
Auto-regressive-based model: Generate a node or an edge in one step

VAE-based mode

https://arxiv.org/pdf/1802.03480.pdf

GAN-based model

https://arxiv.org/pdf/1901.00596.pdf

AR-based model

https://arxiv.org/pdf/1803.03324.pdf
思想一步步的来，先问是否要生成节点，然后是否要生成边，然后重复这个动作。

GNN for NLP（略）

Semantic Roles Labeling
Event Detection
Document Time Stamping
Name Entity Recognition
Relation Extraction
Knowledge Graph

Summary and Take Home Notes

GAT and GCN are the most popular GNNs
Although GCN is mathematically driven, we tend to ignore its math
GNN (or GCN) suffers from information lose while getting deeper
Many deep learning models can be slightly modified and designed to fit graph data, such as Deep Graph InfoMax, Graph Transformer, GraphBert（效果不好）.
Theoretical analysis must be dealt with in the future
GNN can be applied to a variety of tasks

Online Resources

Functions of Matrices: Theory and Computation
Signal and System by Prof. Lee:
http://speech.ee.ntu.edu.tw/courses.html
Machine Learning by Prof. Hung-yi Lee
http://speech.ee.ntu.edu.tw/~tlkagk/courses.html
Vertex-Frequency Analysis of Graph Signals

李宏毅机器学习笔记——反向传播算法小陈phd 机器学习机器学习算法神经网络
反向传播算法反向传播（Backpropagation）是一种用于训练人工神经网络的算法，它通过计算损失函数相对于网络中每个参数的梯度来更新这些参数，从而最小化损失函数。反向传播是深度学习中最重要的算法之一，通常与梯度下降等优化算法结合使用。反向传播的基本原理反向传播的核心思想是利用链式法则（ChainRule）来高效地计算损失函数相对于每个参数的梯度。以下是反向传播的基本步骤：前向传播（Forwa
李宏毅机器学习笔记 2.回归 Simone Zeng 机器学习机器学习
最近在跟着Datawhale组队学习打卡，学习李宏毅的机器学习/深度学习的课程。课程视频：https://www.bilibili.com/video/BV1Ht411g7Ef开源内容：https://github.com/datawhalechina/leeml-notes本篇文章对应视频中的P3。另外，最近我也在学习邱锡鹏教授的《神经网络与深度学习》，会补充书上的一点内容。通过上一次课1.机器
2023春季李宏毅机器学习笔记 02 ：机器学习基本概念女王の专属领地机器学习深度学习 #李宏毅2023机器学习机器学习笔记人工智能
资料课程主页：https://speech.ee.ntu.edu.tw/~hylee/ml/2023-spring.phpGithub：https://github.com/Fafa-DL/Lhy_Machine_LearningB站课程：https://space.bilibili.com/253734135/channel/collectiondetail?sid=2014800一、機器學習基
2023春季李宏毅机器学习笔记 03 ：机器如何生成文句女王の专属领地 #李宏毅2023机器学习机器学习深度学习笔记机器学习人工智能深度学习
资料课程主页：https://speech.ee.ntu.edu.tw/~hylee/ml/2023-spring.phpGithub：https://github.com/Fafa-DL/Lhy_Machine_LearningB站课程：https://space.bilibili.com/253734135/channel/collectiondetail?sid=2014800一、大语言模型
Chat GPT4来了，它和3.5区别在哪？李宏毅机器学习笔记抱抱小杠杠机器学习人工智能笔记
听说GPT4模型更大、参数更多，功能更强，具体它好在哪里？GPT4真的能看懂图片吗？官方回答：不太能~~下面这张图片是将两个不存在的网址输入进GPT4，问它看到了什么，结果发现GPT真的会胡言乱语，它会根据网址中出现了“man”这个单词，就说他看到了“一个拿着手枪的男人。。。巴拉巴拉”明显就是在胡编乱造！而如果网址中出现了“girl”这个单词，GPT又会说他看到了“一个穿着校服的女孩子。。。巴拉巴
2023春季李宏毅机器学习笔记 05 ：机器如何生成图像女王の专属领地 #李宏毅2023机器学习机器学习笔记人工智能机器学习李宏毅 AI产品
资料课程主页：https://speech.ee.ntu.edu.tw/~hylee/ml/2023-spring.phpGithub：https://github.com/Fafa-DL/Lhy_Machine_LearningB站课程：https://space.bilibili.com/253734135/channel/collectiondetail?sid=2014800一、图像生成常
2023春季李宏毅机器学习笔记01 ：正确认识 ChatGPT 女王の专属领地深度学习机器学习机器学习李宏毅人工智能 AI产品
资料课程主页：https://speech.ee.ntu.edu.tw/~hylee/ml/2023-spring.phpGithub：https://github.com/Fafa-DL/Lhy_Machine_LearningB站课程：https://space.bilibili.com/253734135/channel/collectiondetail?sid=2014800一、对Chat
【23-24 秋学期】NNDL 作业11 LSTM HBU_David lstm 机器学习人工智能
习题6-4推导LSTM网络中参数的梯度，并分析其避免梯度消失的效果习题6-3P编程实现下图LSTM运行过程李宏毅机器学习笔记：RNN循环神经网络_李宏毅rnn笔记_ZEERO~的博客-CSDN博客https://blog.csdn.net/weixin_43249038/article/details/132650998L5W1作业1手把手实现循环神经网络-CSDN博客https://blog.c
李宏毅老师机器学习课程笔记_ML Lecture 1: ML Lecture 1: Regression - Demo leogoforit
引言：最近开始学习“机器学习”，早就听说祖国宝岛的李宏毅老师的大名，一直没有时间看他的系列课程。今天听了一课，感觉非常棒，通俗易懂，而又能够抓住重点，中间还能加上一些很有趣的例子加深学生的印象。视频链接（bilibili）：李宏毅机器学习(2017)另外已经有有心的同学做了速记并更新在github上：李宏毅机器学习笔记(LeeML-Notes)所以，接下来我的笔记只记录一些我自己的总结和听课当时的
李宏毅机器学习笔记.Flow-based Generative Model(补) oldmao_2000 李宏毅机器学习笔记机器学习笔记人工智能
文章目录引子生成问题回顾：GeneratorMathBackgroundJacobianMatrixDeterminant行列式ChangeofVariableTheorem简单实例一维实例二维实例网络G的限制基于Flow的网络构架G的训练CouplingLayerCouplingLayer反函数计算CouplingLayerJacobian矩阵计算CouplingLayerStacking1×1
李宏毅机器学习笔记-transformer ZEERO~ 深度学习机器学习笔记 transformer 深度学习
transformer是什么呢？是一个seq2seq的model。具体应用如上图所示，输入和输出的序列长度不固定，由model自己决定。语音翻译指的是，直接输入一段语音信号，例如英文，输出的直接是翻译之后的中文。seq2seq如今已经是一个应用非常广泛的模型，可以应用于NLP的各种任务，如语义分析，语义分类，聊天机器人等。另外还有个值得说明的功能是做multilabelclassification
李宏毅机器学习笔记-半监督学习 ZEERO~ 深度学习机器学习笔记学习
半监督学习，一般应用于少量带标签的数据（数量R）和大量未带标签数据的场景（数量U），一般来说，U>>R。半监督学习一般可以分为2种情况，一种是transductivelearning，这种情况下，将unlabeleddata的feature利用进来。另外一种是inductivelearning，这种情况下，在训练的整个过程中，完全不看任何unlabeleddata的信息。为什么要做semi-sup
李宏毅机器学习笔记第7周_局部最小值与鞍点 MoxiMoses 机器学习深度学习
文章目录一、OptimizationFailsbecause……二、TaylerSeriesApproximation三、Example总结一、OptimizationFailsbecause……1．问题：我们在做optimization的时候会发现，随着参数的不断更新，training的loss不会再下降，但是我们对loss并不满意。因此我们会发现，一开始model就train不起来，不管我们怎
李宏毅机器学习笔记：RNN循环神经网络 ZEERO~ 深度学习机器学习机器学习笔记 rnn
RNN一、RNN1、场景引入2、如何将一个单词表示成一个向量3种典型的RNN网络结构二、LSTMLSTM和普通NN、RNN区别三、LSTM的训练一、RNN1、场景引入例如情景补充的情况，根据词汇预测该词汇所属的类别。这个时候的Taipi则属于目的地。但是，在订票系统中，Taipi也可能会属于出发地。到底属于目的地，还是出发地，如果不结合上下文，则很难做出判断。因此，使用传统的深度神经网络解决不了问
李宏毅机器学习笔记：结构学习，HMM，CRF ZEERO~ 机器学习机器学习笔记学习
李宏毅机器学习笔记：结构学习，HMM，CRF1、隐马尔可夫模型HMM1.1Sequence2Sequence1.2HMM1.3Viterbi算法1.3HMM模型的缺点2、CRF2.1CRF模型2.2CRF模型训练1、隐马尔可夫模型HMM1.1Sequence2Sequence什么是Seq2Seq问题呢？简单来说，就是输入是一个序列，输出也是一个序列。输入和输出的序列可以相等，也可以不相等。在本文中
李宏毅机器学习笔记——16. Conditional Generation by RNN&Attention(RNN条件生成与注意力机制) HSR CatcousCherishes 机器学习基础课程知识机器学习人工智能神经网络
摘要：本章内容是讲解了Generation，Attention，TipsforGeneration，一是围绕用RNN实现Generation（生成）的方法与基本原理，先应用生成句子去介绍生成的基本原理，接着举例无条件的生成图片，其不同的是：将图片上的每个像素点看成一个word，并需要考虑各像素之间的几何关系，所以我们需要借助3D-LSTM完善了Generation图片功能。但是在实际应用中，我们的
李宏毅机器学习笔记——生成模型荆棘鸟》深度学习人工智能
介绍了三种方法，pixelRNN，VAE,GAN。笔记以VAE为主。pixelRNN比较容易理解，由已知推未知。这种方法还能应用到语音生成等领域在这里有个tips值得说一下，图的每个像素一般RGB三色，问题出在当RGB三个值相差不大时最终的结果像素点的颜色趋向灰色，于是乎，为了使生成的图像更加鲜亮，就需要拉高三个值的差距。简而言之，原本用三个数表示颜色，现在只用一个。VAE是一个相对复杂的东西，事
李宏毅机器学习笔记——概率模型荆棘鸟》机器学习人工智能神经网络
很有意思的一门课，但关于如何利用P(x)生成x还存在疑惑。在神经网络中y=w*x+b，为什么是这个形式？这门课将在最后归结到这一点上。举一个实际的例子，训练集中A类71个B类69个我们假定A类的71个点遵循gaussiondistribution，上图涉及的函数：输入一个点(代表一个实例的特征vector)，输出sample中该点的概率，在下文中即为P(x|A)与P(x|B)该函数有两个参数，μ与
李宏毅机器学习笔记 learn_for_more 机器学习人工智能深度学习
DataWhale–李宏毅老师机器学习P5-P8《误差来源》和《梯度下降法》学习笔记学习笔记本文是李宏毅老师B站–《机器学习》课程的学习笔记，在此非常感谢DataWhale提供的平台，希望大家加入到这个学习的大家庭中，共同成长。本文主要是关于误差来源及梯度下降法的介绍，是在老师的讲解视频和学习文档的基础上总结而来。一、误差来源在机器学习中，模型估计的误差可以分为两种，偏差（Bias）和方差（Var
【ML入门】李宏毅机器学习笔记02-回归问题（Regression） BG大龍
【ML入门】李宏毅机器学习笔记02-回归问题（Regression）-知乎https://zhuanlan.zhihu.com/p/74684108
李宏毅机器学习笔记第8周_批次与动量 MoxiMoses 机器学习深度学习
文章目录一、Review：OptimizationwithBatch二、SmallBatchv.s.LargeBatch三、Momentum1.SmallGradient2.VanillaGradient3.GradientDescent+Momentum一、Review：OptimizationwithBatch在计算微分的时候，并不是把所有的data对计算出来的L做微分，而是把data分成一个
【ML入门】李宏毅机器学习笔记01-Learning Map BG大龍
【ML入门】李宏毅机器学习笔记01-LearningMap-知乎https://zhuanlan.zhihu.com/p/74377397
李宏毅机器学习—机器学习介绍修_远李宏毅机器学习
李宏毅机器学习笔记github链接：https://github.com/datawhalechina/leeml-notes李宏毅机器学习笔记在线阅读链接：https://datawhalechina.github.io/leeml-notes机器学习介绍这门课，我们预期可以学到什么呢？我想多数同学的心理预期就是你可以学到一个很潮的人工智慧。我们知道，从今年开始，人工智慧这个词突然变得非常非常非
【李宏毅机器学习笔记】9、卷积神经网络（Convolutional Neural Network，CNN） qqqeeevvv 机器学习深度学习机器学习深度学习
【李宏毅机器学习笔记】1、回归问题（Regression）【李宏毅机器学习笔记】2、error产生自哪里？【李宏毅机器学习笔记】3、gradientdescent【李宏毅机器学习笔记】4、Classification【李宏毅机器学习笔记】5、LogisticRegression【李宏毅机器学习笔记】6、简短介绍DeepLearning【李宏毅机器学习笔记】7、反向传播（Backpropagatio
李宏毅机器学习笔记第8周_自动调整学习速率 MoxiMoses 机器学习深度学习
文章目录一、Trainingstuck≠SmallGradient二、Waitaminute三、Trainingcanbedifficultevenwithoutcriticalpoints四、Differentparametersneedsdifferentlearningrate五、Rootmeansquare六、RMSProp七、Adam:RMSProp+Momentum八、Learning
【李宏毅机器学习笔记1】第一节机器学习基本概念简介（上） freezing001 深度学习深度学习机器学习
第一节机器学习基本概念简介（上）1.机器学习第一步：function机器学习MachineLearning≈LookingforFunctionML的三大任务：Regression(回归)+classification（分类）+strcturedlearning(createsomethingwithstructure)即让机器产生有结构的东西机器学习的model：带有未知parameters的f
李宏毅机器学习笔记-Lecture1 不废江河954 笔记深度学习学习机器学习学习人工智能
李宏毅机器学习笔记-Lecture1_续机器学习基本概念（下）PiecewiseLinearCurvesBeyondPiecewiseLinearCurvesSigmoidFunction各参数对Sigmoid的影响用Sigmoid拟合PiecewiseLinearCurvesNewModelwithMoreFeatures最终模型对各个参数的认识MLFramework构造模型构造损失函数找到最优
2021李宏毅机器学习笔记--7.1 backpropagation guoxinxin0605 机器学习神经网络人工智能深度学习
2021李宏毅机器学习笔记--7.1backpropagation1摘要2步骤2.1chainrule链式法则2.2lossfunction2.2.1forwardpass2.2.2backwardpasscase1未知的两项在输出层case2未知的两项并不在输出层3小结及展望1摘要上文讲到可以用Backpropagation的方法对网络中的所有参数（w和b）进行更新，最终使totalloss达到
2021李宏毅机器学习笔记--16 Recursive Network guoxinxin0605 网络神经网络
2021李宏毅机器学习笔记--16RecursiveNetwork递归网络摘要一、Application:SentimentAnalysis(应用：情绪分析)二、RecursiveNetwork三、RecursiveNetworkTensorNetwork四、Matrix-VectorRecursiveNetwork五、TreeLSTM六、MoreApplication(更多应用：句子关联)总结摘
2021李宏毅机器学习笔记--7 deep learning深度学习与 fully connect feedforward network全连接前馈网络 guoxinxin0605 神经网络机器学习深度学习人工智能网络
2021李宏毅机器学习笔记--7deeplearning深度学习与fullyconnectfeedforwardnetwork全连接前馈网络摘要步骤step1NeuralnetworkFullyConnectFeedforwardNetwork全连接前馈网络step2goodnessofafunctionstep3Backpropagation小结与展望摘要近些年来。在各个领域，用到深度学习的地方
矩阵求逆（JAVA）初等行变换 qiuwanchi 矩阵求逆（JAVA）
package gaodai.matrix; import gaodai.determinant.DeterminantCalculation; import java.util.ArrayList; import java.util.List; import java.util.Scanner; /** * 矩阵求逆(初等行变换) * @author 邱万迟 *
JDK timer antlove java jdk schedule code timer
1.java.util.Timer.schedule(TimerTask task, long delay)：多长时间（毫秒）后执行任务 2.java.util.Timer.schedule(TimerTask task, Date time)：设定某个时间执行任务 3.java.util.Timer.schedule(TimerTask task, long delay,longperiod
JVM调优总结 -Xms -Xmx -Xmn -Xss coder_xpf jvm 应用服务器
堆大小设置JVM 中最大堆大小有三方面限制：相关操作系统的数据模型（32-bt还是64-bit）限制；系统的可用虚拟内存限制；系统的可用物理内存限制。32位系统下，一般限制在1.5G~2G；64为操作系统对内存无限制。我在Windows Server 2003 系统，3.5G物理内存，JDK5.0下测试，最大可设置为1478m。典型设置： java -Xmx
JDBC连接数据库 Array_06 jdbc
package Util; import java.sql.Connection; import java.sql.DriverManager; import java.sql.ResultSet; import java.sql.SQLException; import java.sql.Statement; public class JDBCUtil { //完
Unsupported major.minor version 51.0（jdk版本错误） oloz java
java.lang.UnsupportedClassVersionError: cn/support/cache/CacheType : Unsupported major.minor version 51.0 (unable to load class cn.support.cache.CacheType) at org.apache.catalina.loader.WebappClassL
用多个线程处理1个List集合 362217990 多线程 thread list 集合
昨天发了一个提问，启动5个线程将一个List中的内容，然后将5个线程的内容拼接起来，由于时间比较急迫，自己就写了一个Demo，希望对菜鸟有参考意义。。 import java.util.ArrayList; import java.util.List; import java.util.concurrent.CountDownLatch; public c
JSP简单访问数据库香水浓 sql mysql jsp
学习使用javaBean，代码很烂，仅为留个脚印 public class DBHelper { private String driverName; private String url; private String user; private String password; private Connection connection; privat
Flex4中使用组件添加柱状图、饼状图等图表 AdyZhang Flex
1.添加一个最简单的柱状图 ? 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 <?xml version= "1.0"&n
Android 5.0 - ProgressBar 进度条无法展示到按钮的前面 aijuans android
在低于SDK < 21 的版本中，ProgressBar 可以展示到按钮前面，并且为之在按钮的中间，但是切换到android 5.0后进度条ProgressBar 展示顺序变化了，按钮再前面，ProgressBar 在后面了我的xml配置文件如下： [html] view plain copy <RelativeLa
查询汇总的sql baalwolf sql
select list.listname, list.createtime,listcount from dream_list as list , (select listid,count(listid) as listcount from dream_list_user group by listid order by count(
Linux du命令和df命令区别 BigBird2012 linux
1，两者区别 du，disk usage,是通过搜索文件来计算每个文件的大小然后累加，du能看到的文件只是一些当前存在的，没有被删除的。他计算的大小就是当前他认为存在的所有文件大小的累加和。
AngularJS中的$apply，用还是不用？ bijian1013 JavaScript AngularJS $apply
在AngularJS开发中，何时应该调用$scope.$apply()，何时不应该调用。下面我们透彻地解释这个问题。但是首先，让我们把$apply转换成一种简化的形式。 scope.$apply就像一个懒惰的工人。它需要按照命
[Zookeeper学习笔记十]Zookeeper源代码分析之ClientCnxn数据序列化和反序列化 bit1129 zookeeper
ClientCnxn是Zookeeper客户端和Zookeeper服务器端进行通信和事件通知处理的主要类，它内部包含两个类，1. SendThread 2. EventThread， SendThread负责客户端和服务器端的数据通信，也包括事件信息的传输，EventThread主要在客户端回调注册的Watchers进行通知处理 ClientCnxn构造方法 &
【Java命令一】jmap bit1129 Java命令
jmap命令的用法： [hadoop@hadoop sbin]$ jmap Usage: jmap [option] <pid> (to connect to running process) jmap [option] <executable <core> (to connect to a
Apache 服务器安全防护及实战 ronin47
此文转自IBM. Apache 服务简介 Web 服务器也称为 WWW 服务器或 HTTP 服务器 (HTTP Server)，它是 Internet 上最常见也是使用最频繁的服务器之一，Web 服务器能够为用户提供网页浏览、论坛访问等等服务。由于用户在通过 Web 浏览器访问信息资源的过程中，无须再关心一些技术性的细节，而且界面非常友好，因而 Web 在 Internet 上一推出就得到
unity 3d实例化位置出现布置？ brotherlamp unity教程 unity unity资料 unity视频 unity自学
问：unity 3d实例化位置出现布置？答：实例化的同时就可以指定被实例化的物体的位置,即 position Instantiate (original : Object, position : Vector3, rotation : Quaternion) : Object 这样你不需要再用Transform.Position了, 如果你省略了第二个参数(
《重构，改善现有代码的设计》第八章 Duplicate Observed Data bylijinnan java 重构
import java.awt.Color; import java.awt.Container; import java.awt.FlowLayout; import java.awt.Label; import java.awt.TextField; import java.awt.event.FocusAdapter; import java.awt.event.FocusE
struts2更改struts.xml配置目录 chiangfai struts.xml
struts2默认是读取classes目录下的配置文件，要更改配置文件目录，比如放在WEB-INF下，路径应该写成../struts.xml(非/WEB-INF/struts.xml) web.xml文件修改如下： <filter> <filter-name>struts2</filter-name> <filter-class&g
redis做缓存时的一点优化 chenchao051 redis hadoop pipeline
最近集群上有个job，其中需要短时间内频繁访问缓存，大概7亿多次。我这边的缓存是使用redis来做的，问题就来了。首先，redis中存的是普通kv，没有考虑使用hash等解结构，那么以为着这个job需要访问7亿多次redis，导致效率低，且出现很多redi
mysql导出数据不输出标题行 daizj mysql 数据导出去掉第一行去掉标题
当想使用数据库中的某些数据，想将其导入到文件中，而想去掉第一行的标题是可以加上-N参数如通过下面命令导出数据： mysql -uuserName -ppasswd -hhost -Pport -Ddatabase -e " select * from tableName" > exportResult.txt 结果为： studentid
phpexcel导出excel表简单入门示例 dcj3sjt126com PHP Excel phpexcel
先下载PHPEXCEL类文件，放在class目录下面，然后新建一个index.php文件，内容如下 <?php error_reporting(E_ALL); ini_set('display_errors', TRUE); ini_set('display_startup_errors', TRUE); if (PHP_SAPI == 'cli') die('
爱情格言 dcj3sjt126com 格言
1) I love you not because of who you are, but because of who I am when I am with you. 　　我爱你，不是因为你是一个怎样的人，而是因为我喜欢与你在一起时的感觉。 　　2) No man or woman is worth your tears, and the one who is, won‘t
转 Activity 详解——Activity文档翻译 e200702084 android UI sqlite 配置管理网络应用
activity 展现在用户面前的经常是全屏窗口，你也可以将 activity 作为浮动窗口来使用（使用设置了 windowIsFloating 的主题），或者嵌入到其他的 activity （使用 ActivityGroup ）中。当用户离开 activity 时你可以在 onPause() 进行相应的操作。更重要的是，用户做的任何改变都应该在该点上提交 ( 经常提交到 ContentPro
win7安装MongoDB服务 geeksun mongodb
1. 下载MongoDB的windows版本：mongodb-win32-x86_64-2008plus-ssl-3.0.4.zip，Linux版本也在这里下载，下载地址： http://www.mongodb.org/downloads 2. 解压MongoDB在D:\server\mongodb, 在D:\server\mongodb下创建d
Javascript魔法方法:__defineGetter__,__defineSetter__ hongtoushizi js
转载自： http://www.blackglory.me/javascript-magic-method-definegetter-definesetter/ 在javascript的类中,可以用defineGetter和defineSetter_控制成员变量的Get和Set行为例如,在一个图书类中,我们自动为Book加上书名符号: function Book(name){
错误的日期格式可能导致走nginx proxy cache时不能进行304响应 jinnianshilongnian cache
昨天在整合某些系统的nginx配置时，出现了当使用nginx cache时无法返回304响应的情况，出问题的响应头： Content-Type:text/html; charset=gb2312 Date:Mon, 05 Jan 2015 01:58:05 GMT Expires:Mon , 05 Jan 15 02:03:00 GMT Last-Modified:Mon, 05
数据源架构模式之行数据入口 home198979 PHP 架构行数据入口
注：看不懂的请勿踩，此文章非针对java，java爱好者可直接略过。一、概念行数据入口（Row Data Gateway）：充当数据源中单条记录入口的对象，每行一个实例。二、简单实现行数据入口为了方便理解，还是先简单实现： <?php /** * 行数据入口类 */ class OrderGateway { /*定义元数
Linux各个目录的作用及内容 pda158 linux 脚本
1）根目录“/” 　　根目录位于目录结构的最顶层，用斜线（/）表示，类似于 Windows 操作系统的“C:\“，包含Fedora操作系统中所有的目录和文件。　　2）/bin 　　/bin 　　目录又称为二进制目录，包含了那些供系统管理员和普通用户使用的重要 linux命令的二进制映像。该目录存放的内容包括各种可执行文件，还有某些可执行文件的符号连接。常用的命令有：cp、d
ubuntu12.04上编译openjdk7 ol_beta HotSpot jvm jdk OpenJDK
获取源码从openjdk代码仓库获取(比较慢) 安装mercurial Mercurial是一个版本管理工具。 sudo apt-get install mercurial 将以下内容添加到$HOME/.hgrc文件中，如果没有则自己创建一个： [extensions] forest=/home/lichengwu/hgforest-crew/forest.py fe
将数据库字段转换成设计文档所需的字段 vipbooks 设计模式工作正则表达式
哈哈，出差这么久终于回来了，回家的感觉真好！ PowerDesigner的物理数据库一出来，设计文档中要改的字段就多得不计其数，如果要把PowerDesigner中的字段一个个Copy到设计文档中，那将会是一件非常痛苦的事情。