L先生AI课堂

大白话5分钟带你走进人工智能-第34节神经网络之多神经网络概念(2)

1、回顾：

2、常见的激活函数都有哪些？

3、多层神经网络里面故事：

4、如何训练神经网络？

1、回顾：

回顾下之前学习的内容。人工神经网络里面有重要的三条内容，一个是加和，加function，把前面的输入所对应模型的权重相乘相加，第二经过一个非线性变化，第三signal out输出。如果把function设置为Sigmoid函数，它相当于是一个逻辑回归。

2、常见的激活函数都有哪些？

第一个叫01函数，它要么就是0，要么就是1；

第二个叫Sigmoid函数；

可以是linear；也可以是saturated linearcs饱和的线性；也可以用gaussian激活函数。也可以是Tangent，它是一种比较常见的激活函数，通常写Tanh，它其实也是一个S曲线，跟Sigmoid函数S曲线有一点区别在于它的y轴是从-1到+1之间的，Sigmoid函数y轴是从0到+1之间的。如果是Sigmoid函数的话，它的输出一定是大于0的，有些时候我们不希望看到输出大于0的，希望它给一个负反馈，这样的话就会用Tanh，因为它有负的区间段；

哪一个方式都行，常用的就三种，第一种是ReLU，第二种是Sigmoid函数，第三种是Tanh。一般的框架都会把这三种的公式给它进行封装，我们只需要传不同的参数就可以去使用不同的激活函数。

再看下拓扑结构：

这就是一个单层的网络拓朴，比方我们有一个Data数据x1……xn有n个维度和相对应的y，中间的X1，X2，X3相当于Data数据里的每一列，对应着每个维度。往后去输入数据的时候，是一行行的获取样本数据，进行一个正向传播（从输入到输出的计算），以此类推，把所有数据都拿出来进行正向传播。第一行样本和权重相乘相加，再经过function函数计算，得到ŷ1，然后依次类推，得到ŷ1，ŷ2……ŷm样本的预测结果，再根据真实结果，算一下Loss损失。

如果把这里的y写成∑f，f是Sigmoid函数的话，就是一个逻辑回归。前面的输入层是不需要任何加和和激活的，直接把数据结构往下游去传递，在输出层会有加和以及function函数输出。单层网络，只有一个输入层，输出层，它并不能体现出神经网络的优点。

如果function函数是Sigmoid函数，这样一个逻辑回归是做二分类的，还是来做多分类的？二分类，因为它给了一个P概率，如果概率跟0.5进行比较，＞0.5就是1这个类别，＜0.5就是0这个类别。

逻辑回归也可以做多分类，它本质上是把多分类变成多个二分类来做，那么能不能用神经网络图来表达逻辑回归做多分类？

现在画框的图就是一个二分类，再来几个就是多分类，在输出层再加一个神经元，把前面的x1，x2，x3传给它，下面再画一个神经元，把前面的x1，x2，x3传给它。现在是一个全连接，因为两点之间全部都连接到一起。

每个结果y都会对应一个输出概率P，假如做的是个三分类的问题，第一个节点是来分第一个类别的，以此类推P1，P2，P3，最后逻辑回归看P1、P2、P3谁的输出最大，它就是属于哪个类别。

逻辑回归来做多分类，它本质上相当于是把第一层的输入和第一个输出的节点做一个二分类；然后接着它再把前面输入跟第二个做一个二分类；然后把前三个输入跟第三个输出节点再来作一个二分类，它相当于回归做了三个二分类模型。那么逻辑回归把多分类的问题当做二分类的问题来做，它们每一个分类器的w参数之间互相影响吗？

它们之间互相不影响，比如X1发出的第一根绿线，它不会把这根绿色线的结果传给w1，w2，w3，另外一个绿色线也不会传给其它的二分类模型，所以逻辑回归做多分类转为二分类问题时，每个模型之间是互相不影响的，是独立算的。

那么P1+P2+P3=1吗？事实上等于1概率不大，因为它们之间互相不影响，比如P1=0.8，P2=0.9，P3=0.6，那0.9最大，就分到第二个类别里面，它们互相之间不影响。

生成的另外两个神经元是新构建另外的w1，w2，w3吗？是，比如红色的节点，它就会有三个w值，w4，w5，w6；绿色的节点，它还会有三个w值，比如w7，w8，w9，每个独立的二分类模型，都会去算对应的w参数。

它分二分类的话，它都能跟什么样的那种类型区分加上里面，就是说什么样的就是混合类型的话，什么叫混合类型？不够。资格跟我讲。这跟高速广东模型没关系。这跟高斯混合模型没关系，这个就是来做一个多分类的问题，

如果是三分类，相当于如果逻辑回归来做三分类，现在力量有三个输出节点。如果来说N分类上地方有N个输出节点用来做分类，那一个输入点就够了。明白这意思吗？那么在这里面换句话说，

如果逻辑回归来做多分类，如果没有截距的话，它至少得要算9个参数；如果考虑截距的话，每一个节点会有一个w0，也就是有12个w要算。

这里面的X直接输入往后传递输出，Y要先加和，在经过function变化，如果做多分类，function变化全部都是Sigmoid函数，我们称为浅层的模型，只有一个输入层，一个输出层。

3、多层神经网络里面故事：

真正的神经网络绝对不只有输入输出两层，前面的输入层的节点叫做输入节点，输出层上的节点叫做输出节点，中间一层上的节点叫做隐藏景点，这一层叫做Hidden layer，它用了2个隐层节点。

除了输入层，隐藏层一定是神经元，神经元就一定有加和和非线性变化，输出层如果做分类，有加和和非线性变化；如果做回归，不一定。

我们先看下拓扑图：

什么是非线性变化？那什么是线性变化？

如图：

如果y随着x成一个线性的变化，这个就称为线性变化。

如果换一个曲线，那么y随x就不成一个线性的变化如图：

就是非线性的变化。x可以任意的增加，只要不是直线的变化，就说它是非线性的。x的维度上升比如x2，x3都是非线性变化的。如果是多维，比如y=x0*w0+x1*w1+x2*w2，其中x0*w0和y是成线性变化，x1*w1也是，x2*w2也是，x都是一次方，就一定是线性变化的；如果它是0.5次方，0.4次方或者1.5次方，都是非线性变化。

最终的结果是一个加和，就是∑xi*wi，x是一次方，加和之后的结果和x变化是线性变化。

最后的结果只有一个神经元来决定，∑|f，如果function是Sigmoid函数，如果它做分类，就是一个二分类问题的。

还是用逻辑回归来举例：假如没有隐藏层的话，最后给出P概率的结果会受到3个维度的影响。

如果加隐藏层，隐藏层里面只有两个隐藏节点，两个神经元，它的概率输出结果受到2个值的影响，一个H1的输出，一个H2的输出。

之前我们的y受到三个节点的影响，由于我们加了隐藏层，里面有两个隐层节点，y就受到了两个维度的影响，它本质上做了一件降维。这个是神经网络里面自带的好处。

降维的好处是使得我们的计算复杂度变得更加简单，还有防止过拟和。因为有些时候开始的维度可能有些重要有些不重要，经过了降维之后，它把重要的维度，对结果影响比较大的保留下来。

所以神经网络里，如果隐藏层的个数小于输入层的个数，相当于做了降维。

所谓的升维，说的是计算复杂度，降维本身也会有计算，做降维主要是看最后的结果，取决于前面因素有几个。H1，H2这两个维度的结果，是前面x1，x2，x3算出来的，对于y来说它考虑因素少了，实际上就是降维了。最前面输入的这一层可以叫预处理，相当于把原来这些维度数据进行了处理，给它变成了两个维度，然后再让y进行考虑。

总结下前面说的一堆废话~~~

逻辑回归，对于深度学习来说，就是一个神经元，前面是加和，后面是Sigmoid函数。对于逻辑回归，它的输入就是上一层的H1，H2两个，不再是X1，X2，X3三个了。从三个变两个的过程，相当于做了降维，把原来的数据进行了预处理，把它维度减少了。

如果隐藏层不是两个隐藏节点，五个隐藏节点，最后y进行判断的时候，它考虑因素从原来的三个变成了五个。第一个输入层和隐藏层中间的计算，相当于是升维。

神经网络里面网络拓朴，本质上是可以做降维和升维的，取决于怎么设置网络拓朴。

我们来看下如果拓扑结构表示实际中生活中的例子：

比如回家过年，假设三个维度X1为玩火，X2为动刀，X3为上房，相当于是有一个表x1，x2，x3对应数值，现在的Y是来判断父母会不会打你，打的话是1，不打就是0。

父母打你这件事情很茫然，因为最后结果，好像跟x关系不大，如果直接来判断的话，肯定不准，那应该怎么去做？

比如H1神经元它代表伤人，比如放鞭炮把别人炸了、动刀伤人，那么结果父母就是打你。伤人这件事是推断出来的，它是隐藏在玩火和动刀背后，推断出来一个隐藏的情况，一个节点。上房也是一样，上的是别人家的房顶，导致伤人了。

如果没有隐藏层，直接拿玩火、动刀、上房推断打你还是不打你，这件事情会难，因为它们没有什么直接联系。如果再往前再推一层，加一个隐藏节点H1，比如伤人，按照伤人来判断父母是打你还是不打你，这件事就更简单的来判断。

H2比如是孝顺，比如你玩火了十次，不是放鞭炮，而是开火生灶，开了10次；动刀是切菜；上房是上自己家房顶打扫，都可以。

所以隐藏层里面隐藏节点，代表一些隐含在背后可能推断出来的，可能演化出来的，演变出来一些中间的结果，然后根据这些中间的结果，再对最后的结果进行推测和预测，这种情况可以判断的更准。

如果咱们只推出两个结果的话，就是降维；神经网络里面一层有多少神经元，是可以随便设置的，如果神经元设置更多，相当于推断出更多有可能发生的事件。如果隐藏层设置更多神经元，就可以做到升维。

它就是神经网络意义所在，它可以帮助我们推断一些东西出来。

我们需要计算是什么呢？对于机器学习模型来说，我们要算的是每根连线上面参数w值是多少。这个例子要算8个w，如图：

那么算w的个数比刚才要远远的多。一层的神经网络只要算三个w，现在至少算八个。

这些w值有什么用呢？做预测。比如下次一个人给我传他的数据，x1到xn，我根据已经算好的w进行正向传播，最后算出来y结果就会得到一个概率，根据概率我们再来预测，最后是正例还是负例。

神经网络它的意义是，在一定程度上可以进行推断，或者叫演绎，可以把一些隐藏它背后的事件给它推导和演绎出来。

结合以前最火的AlphaGo，它用的是人工智能，背后就是深度学习，深度学习的本质就是神经网络，为什么要用神经网络来做下围棋这件事情，因为能看到的输入是现在棋盘上这些子所在的位置，也就是有x1到xn个输入，就是每一个子所在的位置。直白一点，可以把它理解为一个棋盘有多少行多少列，n就是它多少行乘多少列的值。有子是几，没有子是几，白颜色是几，黑颜色是几。

下一层是推断，但是推断出来是什么咱们不用关心，知道已知和最后的结果，因为AlphaGo在训练的过程当中，它一定是知道x和y的，然后它根据已知x和y来算x，y之间的隐藏层所对应的连接。

不管下围棋还是象棋，什么叫高手？你能想到3步，人家能想到后7步；你能想到后7步，人家能想到后20步。后一步相当于是你往前推断和演绎了一步，就是一个隐藏层。如果你用一个隐藏层，相当于是推断和演绎了另外一步。隐藏层越多，网络层次就越深，它就越是深度学习。

每往前推断一步，推断的情形越多，就意味着隐藏层上面的隐藏节点的数量就越多。

如果隐藏层层数多，每一层上的神经元个数又很多，就会导致整个网络的连接就越多，w值越多。如果计算机的话，它要需要反复迭代来算它最优解。一旦有了网络拓朴，还是拿AlphaGo举例，它其实就是一个模型，这种模型就是一个网络拓扑结构，网络拓扑结构里面，点和点之间都有连线，都有w权重。每当这个人输入一个子的时候，相当于x1到xn的输入就变了，走一次正向传播，得到一个概率值。但是下棋落子的位置有很多种，比如说棋盘上面有很多个点，每下一步的时候，落子的位置不同，就会导致这一次的x1到xn的输入就不一样了。

AlphaGo就是把你这两次落子的位置，转变为x1到xn，两次不同输入，然后一路算下来会得到两个概率值，哪个概率值越大，胜的概率就越大。

相当于每走一步之前，它都会把现在落子的可能性带入这个模型，走一遍正向传播，然后使得走哪一步棋的时候，概率最大，就是最终决定要走的。

深度学习，每次传一个数据都是一个向量，每次传入的向量大概是几百个？输入层输入量多少都可以，根据需求来。比如刚才数据集里面，x1是玩火，x2是动刀，x3是上房，只有三个维度，那么输入层就是这三个。可以是0到正无穷，也可以是0和1，看你的需求。在输入层这地方也可以有很多特征转换的工作，比如x1是动刀，数据里面就是0和1，1是动了，0就表示没动，那么x就是一个输入；如果x是一个次数，比如说10次，20次，30次，40次，我们也可以通过一种手段，比如去做离散化，比如10到30的归为0，40到60的归为1，依次类推。这个就看去做预处理的时候怎么思考这件事情，然后来决定输入的形式。

神经网络就是未来的方向，换句话说，深度学习就是未来的方向，它会把很多事情整合到一起，比如输入层到第一个隐藏层，不管升维还是降维，它都做了一下数据的预处理。如果再有隐藏层，它就对这个数据再进行预处理。

而之前讲机器学习的时候，数据预处理和算法训练，其实是分开的。神经网络数据预处理和最后的模型训练是一个整体。这就是神经网络的好处。

神经网络它是未来的一个趋势，但是它其实是一个大招，就是真正在公司里面去做这个模型的时候，不是上来就用深度学习大招了，往往都是先用机器学习的算法，如果算模型满足业务需求，比如说准确率达到了公司收入的90%，能用就这样用了。未来如果说公司专业准确率不够，还要提升准确率，其它的算法都不行的情况下，然后再去用深度学习、神经网络。

为什么公司不是直接就用神经网络呢？耗资源，如果网络层次多了，每层里面神经元的个数多了，要去算的w会特别多，它不是一下能算出来，需要反复的迭代。所以深度学习的模型一算可能就是一天，数量大的时候可能一算就是三天，所以深度学习的模型往往需要算很长的时间。

我们再欣赏下不同的网络拓扑层。

神经网络的网络拓扑，上面是一个隐藏层，下面是多个隐藏层。

4、如何训练神经网络？

分为两个阶段，一个是正向传播，一个是反向传播。通常人们会用SGD随机梯度下降，最重要的就是算梯度，根据梯度再来调整w。正向传播就是一路算它的Loss损失，有了损失之后再进行反向传播，反向传播就是算每根线上面w所对应的梯度。

为什么需要反向传播？因为最终算的是每根线的w，所以w都要调整到最优解，所以反向传播就是要反过头来算每根线上所对应的梯度g1，g2……然后跟据梯度再去调整w。

之前讲逻辑回归或者浅层模型的时候，为什么没有提过反向传播呢？因为浅层的模型不用传播。

如图是浅层模型：

最后输出节点是∑f，function是Sigmoid函数，也就是逻辑回归，对于逻辑回归来说，不需要传播，这里算出来Loss损失，以及w来求偏倒，可以得到梯度g1，g2，g3，因为它前面没有更多的层，所以它不需要去传播。

换句话说，就是浅层模型里面也是反向传播，只不过反向传播只传了一下，就从Loss经过中间一层，往前传求梯度。

反向传播最终会用到一个法则，数学上叫做链式法则求导，最终会一层层的把前面的梯度给它求出来。

机器学习与深度学习间关系与区别 ℒℴѵℯ心·动ꦿ໊ོ꫞ 人工智能学习深度学习 python
一、机器学习概述定义机器学习（MachineLearning,ML）是一种通过数据驱动的方法，利用统计学和计算算法来训练模型，使计算机能够从数据中学习并自动进行预测或决策。机器学习通过分析大量数据样本，识别其中的模式和规律，从而对新的数据进行判断。其核心在于通过训练过程，让模型不断优化和提升其预测准确性。主要类型1.监督学习（SupervisedLearning）监督学习是指在训练数据集中包含输入
腾讯云技术深度探索：构建高效云原生微服务架构我的运维人生云原生架构腾讯云运维开发技术共享
腾讯云技术深度探索：构建高效云原生微服务架构在当今快速发展的技术环境中，云原生技术已成为企业数字化转型的关键驱动力。腾讯云作为行业领先的云服务提供商，不断推出创新的产品和技术，助力企业构建高效、可扩展的云原生微服务架构。本文将深入探讨腾讯云在微服务领域的最新进展，并通过一个实际案例展示如何在腾讯云平台上构建云原生应用。腾讯云微服务架构概览腾讯云微服务架构基于云原生理念，旨在帮助企业快速实现应用的容
将cmd中命令输出保存为txt文本文件落难Coder Windows cmd window
最近深度学习本地的训练中我们常常要在命令行中运行自己的代码，无可厚非，我们有必要保存我们的炼丹结果，但是复制命令行输出到txt是非常麻烦的，其实Windows下的命令行为我们提供了相应的操作。其基本的调用格式就是：运行指令>输出到的文件名称或者具体保存路径测试下，我打开cmd并且ping一下百度：pingwww.baidu.com>./data.txt看下相同目录下data.txt的输出：如果你再
4招写出高价值文章 zhiliner
文章写得泛泛是因为思考得不够深，思考得越深文章会越有价值。拿到一个主题一定要去深入挖掘事件背后的东西，比如人物困境以及趋势性的东西。写作过程中有几个深度思考的方法一、解剖，让旧素材焕发新意作为一个写作者，我们能够做的最大贡献，就是给出自己看世界的角度。解剖其实就是把这个话题相关的信息都列出来，详细的列出来，看清楚它的内部。我们看到一个老话题或者一段旧素材的时候，不要只看这个素材或者话题本身，一定要
2024.8.22 Python，链表两数之和，链表快速反转，二叉树的深度，二叉树前中后序遍历，N叉树递归遍历，翻转二叉树 RaidenQ python 链表开发语言
1.链表两数之和输入：l1=[2,4,3],l2=[5,6,4]输出：[7,0,8]解释：342+465=807.示例2：输入：l1=[0],l2=[0]输出：[0]示例3：输入：l1=[9,9,9,9,9,9,9],l2=[9,9,9,9]输出：[8,9,9,9,0,0,0,1]昨天的这个题，用自己的办法写的麻烦的要死，然后刚才一看chat归类的办法，感觉自己像个智障。classListNode
海拔五千 3点8度
【海拔五千】连续几天到宿舍盯学生早起情况，今天早上都能及时离开宿舍，没有迟到的了。早读复习宋词，新背一首，晚上又忘了[流泪]断续听王静老师的一堂课，深度语文名不虚传！下课问学生如何，学生答曰比你讲的有趣[捂脸]继续读《娱乐至死》美国在不同的历史时期，代表城市不一样，从波士顿的政治中心，到纽约的大熔炉（自由女神就是其象征），再到芝加哥的工业发展中心，最后到拉斯维加斯的娱乐之城。不同历史时期美国精神的
2022.01.22 有用谨言的成长
写作，对我来说，更像是一个自说自话，自我观察，自我反思，自我探索的途径。可以写我的心情故事，写我的观点而不用担心任何人的评论，写我的情绪，写我想说的，有时候觉得只是简单用语言还不能表现出那份深刻，但是文字可以给自己一个更长的时间来思考，来做深度思考，表达得更透彻。写作，有时候我会写自己看了某个电影后的一点感悟，自己的真实感受，不管它和专业影评人相比是不是很肤浅，是不是片面了，只是有时候我也想发声，
阅读《认知觉醒》读书笔记就看看书
本周阅读了周岭的《认知觉醒开启自我改变的原动力》，启发较多，故做读书笔记一则，留待学习。全书共八章，讲述了大脑、潜意识、元认知、专注力、学习力、行动力、情绪力及成本最低的成长之道。具体描述了大脑、焦虑、耐心、模糊、感性、元认知、自控力、专注力、情绪专注、学习专注、匹配、深度、关联、体系、打卡、反馈、休息、清晰、傻瓜、行动、心智宽带、单一视角、游戏心态、早起、冥想、阅读、写作、运动等相关知识点。大脑
ChatGPT 高效学习套路揭秘：让知识获取事半功倍的秘诀 kkai人工智能 chatgpt 人工智能学习媒体 ai
最近这段时间，AI热潮因ChatGPT的火爆再次掀起。如今，网上大部分内容都在调侃AI，但很少有人探讨如何正经使用ChatGPT做事情。作为一名靠搜索引擎和GitHub自学编程的开发者，第一次和ChatGPT深度交流后，我就确信：ChatGPT能够极大提高程序员学习新技术的效率。使用ChatGPT一个月后，我越发感受到它的颠覆性。因此，我想从工作和学习的角度，分享它的优势及我的一些使用技巧，而非娱
免费的GPT可在线直接使用（一键收藏） kkai人工智能 gpt
1、LuminAI（https://kk.zlrxjh.top）LuminAI标志着一款融合了星辰大数据模型与文脉深度模型的先进知识增强型语言处理系统，旨在自然语言处理（NLP）的技术开发领域发光发热。此系统展现了卓越的语义把握与内容生成能力，轻松驾驭多样化的自然语言处理任务。VisionAI在NLP界的应用领域广泛，能够胜任从机器翻译、文本概要撰写、情绪分析到问答等众多任务。通过对大量文本数据的
推荐3家毕业AI论文可五分钟一键生成！文末附免费教程！小猪包333 写论文人工智能 AI写作深度学习计算机视觉
在当前的学术研究和写作领域，AI论文生成器已经成为许多研究人员和学生的重要工具。这些工具不仅能够帮助用户快速生成高质量的论文内容，还能进行内容优化、查重和排版等操作。以下是三款值得推荐的AI论文生成器：千笔-AIPassPaper、懒人论文以及AIPaperPass。千笔-AIPassPaper千笔-AIPassPaper是一款基于深度学习和自然语言处理技术的AI写作助手，旨在帮助用户快速生成高质
AI大模型的架构演进与最新发展季风泯灭的季节 AI大模型应用技术二人工智能架构
随着深度学习的发展，AI大模型（LargeLanguageModels,LLMs）在自然语言处理、计算机视觉等领域取得了革命性的进展。本文将详细探讨AI大模型的架构演进，包括从Transformer的提出到GPT、BERT、T5等模型的历史演变，并探讨这些模型的技术细节及其在现代人工智能中的核心作用。一、基础模型介绍：Transformer的核心原理Transformer架构的背景在Transfo
ai绘画工具midjourney怎么下载？附作品管理教程设计师早上好
Midjourney是一款功能强大的AI绘画工具，它使用机器学习技术和深度神经网络等算法，可以生成各种艺术风格的绘画作品。在创意设计、广告宣传等方面有着广泛的应用前景。那么，ai绘画工具midjourney怎么下载？本文将为您介绍Midjourney的下载以及作品的相关管理。一、Midjourney下载Midjourney的下载非常简单，只需打开Midjourney官网（点击“GetMidjour
【c++基础概念深度理解——堆和栈的区别，并实现堆溢出和栈溢出】 XWWW668899 C++基本概念 c++c语言开发语言青少年编程
文章目录概要技术名词解释栈溢出和堆溢出小结概要学习C++语言，避免不了要好好理解一下堆（Heap）和栈（Stack），有助于更好地管理内存，以及如何写出一段程序“成功实现”堆溢出和栈溢出。技术名词解释理解东西最快的方式是根据自己目前能理解的词语去关联新的概念，不断的纠正，向正确的深度理解靠近，当无限接近的时候也就理解了想要理解的概念。我们经常说堆栈，把这两个名词放到一起。其实，堆是堆，栈是栈，两种
[实践应用] 深度学习之模型性能评估指标 YuanDaima2048 深度学习工具使用深度学习人工智能损失函数性能评估 pytorch python 机器学习
文章总览：YuanDaiMa2048博客文章总览深度学习之模型性能评估指标分类任务回归任务排序任务聚类任务生成任务其他介绍在机器学习和深度学习领域，评估模型性能是一项至关重要的任务。不同的学习任务需要不同的性能指标来衡量模型的有效性。以下是对一些常见任务及其相应的性能评估指标的详细解释和总结。分类任务分类任务是指模型需要将输入数据分配到预定义的类别或标签中。以下是分类任务中常用的性能指标：准确率(
[实践应用] 深度学习之优化器 YuanDaima2048 深度学习工具使用 pytorch 深度学习人工智能机器学习 python 优化器
文章总览：YuanDaiMa2048博客文章总览深度学习之优化器1.随机梯度下降（SGD）2.动量优化（Momentum）3.自适应梯度（Adagrad）4.自适应矩估计（Adam）5.RMSprop总结其他介绍在深度学习中，优化器用于更新模型的参数，以最小化损失函数。常见的优化函数有很多种，下面是几种主流的优化器及其特点、原理和PyTorch实现：1.随机梯度下降（SGD）原理:随机梯度下降通过
（缓解抑郁症状）中原焦点团队杨小杰坚持分享第226天2021-4-1 yxjlady
缓解抑郁症状1、不要总待在室内，抑郁严重的人，通常都不想出门2、抑郁性都有诱因或一个导火索，人不能战胜所有东西，要有取舍3、社交，抑郁症的人总是自己脑中不断的自言自语，自我否定等，出去社交就被迫被别的东西点拨了，深度抑郁没法走出自己的世界，思维走不出自己的怪圈4、锻炼让自己轻微出汗最佳，身心是一体时，身体有活力，精神很难不健康5、冥想冥想和社交一样，可以改变你的神经可塑性，一个沉溺在自己世界里的抑
新的一年，春节假期期间，你有没有去深度思考过自己的未来？十八点心理
新的一年，是不是应该思考些什么？是继续和亲朋好友聊聊天，还是想一条属于自己的路？我们很多人会在过年的氛围中去享受当下的一切，打打麻将、打打牌、聊聊天、侃侃大山，整个人的精神状态特别好。觉得完全有一种自我满足的状态体验。但是从另外一个层面看，看到那些厉害的人，那些对于自己人生取得巨大成就的人来说，根本没有春节休息一说，在春节时分，还在见缝插针去写点文章、录个视频、思考新一年的规划。当看到那种忙碌的身
生成式地图制图 Bwywb_3 深度学习机器学习深度学习生成对抗网络
生成式地图制图（GenerativeCartography）是一种利用生成式算法和人工智能技术自动创建地图的技术。它结合了传统的地理信息系统（GIS）技术与现代生成模型（如深度学习、GANs等），能够根据输入的数据自动生成符合需求的地图。这种方法在城市规划、虚拟环境设计、游戏开发等多个领域具有应用前景。主要特点：自动化生成：通过算法和模型，系统能够根据输入的地理或空间数据自动生成地图，而无需人工逐
探索ASPICE V3.1：汽车行业软件开发的中文指南阮懿同
探索ASPICEV3.1：汽车行业软件开发的中文指南ASPICE_V3.1中文版.pdf.zip项目地址:https://gitcode.com/open-source-toolkit/422a2在汽车软件工程领域，高质量的标准对于确保行车安全和提升用户体验至关重要。今天，我们为您介绍一个珍贵的开源宝藏——ASPICEV3.1中文版资源。这是一篇专为国内汽车行业开发者、质量管理者准备的深度解读，旨
深度 Qlearning：在直播推荐系统中的应用 AGI通用人工智能之禅程序员提升自我硅基计算碳基计算认知计算生物计算深度学习神经网络大数据 AIGC AGI LLM Java Python 架构设计 Agent 程序员实现财富自由
深度Q-learning：在直播推荐系统中的应用关键词：深度Q-learning,强化学习,直播推荐系统,个性化推荐1.背景介绍1.1问题的由来随着互联网技术的飞速发展,直播平台如雨后春笋般涌现。面对海量的直播内容,用户很难快速找到自己感兴趣的内容。因此,个性化推荐系统在直播平台中扮演着越来越重要的角色。1.2研究现状目前,主流的个性化推荐算法包括协同过滤、基于内容的推荐等。这些方法在一定程度上缓
吴恩达深度学习笔记(30)-正则化的解释极客Array
正则化（Regularization）深度学习可能存在过拟合问题——高方差，有两个解决方法，一个是正则化，另一个是准备更多的数据，这是非常可靠的方法，但你可能无法时时刻刻准备足够多的训练数据或者获取更多数据的成本很高，但正则化通常有助于避免过拟合或减少你的网络误差。如果你怀疑神经网络过度拟合了数据，即存在高方差问题，那么最先想到的方法可能是正则化，另一个解决高方差的方法就是准备更多数据，这也是非常
个人学习笔记7-6：动手学深度学习pytorch版-李沐浪子L 深度学习深度学习笔记计算机视觉 python 人工智能神经网络 pytorch
#人工智能##深度学习##语义分割##计算机视觉##神经网络#计算机视觉13.11全卷积网络全卷积网络（fullyconvolutionalnetwork，FCN）采用卷积神经网络实现了从图像像素到像素类别的变换。引入l转置卷积（transposedconvolution）实现的，输出的类别预测与输入图像在像素级别上具有一一对应关系：通道维的输出即该位置对应像素的类别预测。13.11.1构造模型下
2021年化工自动化控制仪表考试及化工自动化控制仪表考试技巧女王219 安全生产模拟考试一点通安全生产一点通题库
题库来源：安全生产模拟考试一点通公众号小程序化工自动化控制仪表考试参考答案及化工自动化控制仪表考试试题解析是安全生产模拟考试一点通题库老师及化工自动化控制仪表操作证已考过的学员汇总，相对有效帮助化工自动化控制仪表考试技巧学员顺利通过考试。1、【单选题】辐射传热()任何介质做媒介。（A）A、不需要B、需要C、有时需要2、【单选题】同一密度的液体深度越深,压强()。（B）A、越小B、越大C、基本不变3
深度学习-点击率预估-研究论文2024-09-14速读 sp_fyf_2024 深度学习人工智能
深度学习-点击率预估-研究论文2024-09-14速读1.DeepTargetSessionInterestNetworkforClick-ThroughRatePredictionHZhong,JMa,XDuan,SGu,JYao-2024InternationalJointConferenceonNeuralNetworks,2024深度目标会话兴趣网络用于点击率预测摘要：这篇文章提出了一种新
公众号流量主如何赚钱？深度解析流量变现之道日常购物技巧呀
微信公众号作为自媒体平台的重要一环，吸引了越来越多的内容创作者和商家。而公众号流量主作为平台上的重要角色，如何有效地将流量变现，成为许多运营者关注的焦点。那么，公众号流量主究竟如何赚钱呢？本文将深度解析流量变现的奥秘，为您揭示公众号流量主的赚钱之道。废掉一个孩子最快的方式，就让他待在家里，一天到晚待在家里公众号流量主就找善士导师（shanshi2024）公众号：「善士笔记」主理人，《我的亲身经历，
损失函数与反向传播 Star_. PyTorch pytorch 深度学习 python
损失函数定义与作用损失函数(lossfunction)在深度学习领域是用来计算搭建模型预测的输出值和真实值之间的误差。1.损失函数越小越好2.计算实际输出与目标之间的差距3.为更新输出提供依据（反向传播)常见的损失函数回归常见的损失函数有：均方差（MeanSquaredError，MSE）、平均绝对误差（MeanAbsoluteErrorLoss，MAE）、HuberLoss是一种将MSE与MAE
【C#生态园】深度剖析：C#嵌入式开发工具大揭秘 friklogff C#生态园 c#开发语言
C#嵌入式开发：全面了解六大框架与库前言随着物联网和嵌入式系统的快速发展，越来越多的开发者开始关注使用C#语言进行嵌入式开发。本文将介绍几种用于C#的嵌入式开发框架和相关库，以及它们的核心功能、安装配置方法和API概览，帮助读者了解并选择适合自己项目的工具和资源。欢迎订阅专栏：C#生态园文章目录C#嵌入式开发：全面了解六大框架与库前言1.nanoFramework：一个用于C#的嵌入式开发框架1.
运用思维导图进行教学设计安定区张虎
制作思维导图是一个将碎片化的知识串联起来，形成可视化的图象，抽象化的文字转化具体化的图象，从而使知识点由分散到集中，由碎片化到彼此间建立联系性的过程。思维导图的制作，普遍利用结构性思维，这种思维导图最易掌握，也是最常见的思维导图。当然，人的思维方式多种多样，不仅仅只有结构性思维，如链条思维、逆向思维、创造性思维等等，因此，思维导图是一个极易掌握，又十分有深度的学习工具，它不仅有实用价值，还有研究价
Spring @Async 深度解读：默认线程池执行器的配置与优化小码快撩 spring java 前端
在Spring中，@Async注解用于异步执行方法。默认情况下，@Async注解的任务是由一个线程池执行的。然而，这个默认的线程池是如何初始化的呢？本文将深入探讨这一过程，帮助你理解Spring异步任务背后的线程池执行器的初始化原理。1.@Async的基本使用首先，让我们快速回顾一下@Async的基本用法。@Async通常用于标注在需要异步执行的方法上，比如：@Servicepublicclass
apache ftpserver-CentOS config gengzg apache
<server xmlns="http://mina.apache.org/ftpserver/spring/v1" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xsi:schemaLocation=" http://mina.apache.o
优化MySQL数据库性能的八种方法 AILIKES sql mysql
1、选取最适用的字段属性　　MySQL可以很好的支持大数据量的存取，但是一般说来，数据库中的表越小，在它上面执行的查询也就会越快。因此，在创建表的时候，为了获得更好的性能，我们可以将表中字段的宽度设得尽可能小。例如，在定义邮政编码这个字段时，如果将其设置为CHAR(255),显然给数据库增加了不必要的空间，甚至使用VARCHAR这种类型也是多余的，因为CHAR(6)就可以很
JeeSite 企业信息化快速开发平台 Kai_Ge JeeSite
JeeSite 企业信息化快速开发平台平台简介 JeeSite是基于多个优秀的开源项目，高度整合封装而成的高效，高性能，强安全性的开源Java EE快速开发平台。 JeeSite本身是以Spring Framework为核心容器，Spring MVC为模型视图控制器，MyBatis为数据访问层， Apache Shiro为权限授权层，Ehcahe对常用数据进行缓存，Activit为工作流
通过Spring Mail Api发送邮件 120153216 邮件 main
原文地址：http://www.open-open.com/lib/view/open1346857871615.html 使用Java Mail API来发送邮件也很容易实现，但是最近公司一个同事封装的邮件API实在让我无法接受，于是便打算改用Spring Mail API来发送邮件，顺便记录下这篇文章。【Spring Mail API】 Spring Mail API都在org.spri
Pysvn 程序员使用指南 2002wmj SVN
源文件:http://ju.outofmemory.cn/entry/35762 这是一篇关于pysvn模块的指南. 完整和详细的API请参考 http://pysvn.tigris.org/docs/pysvn_prog_ref.html. pysvn是操作Subversion版本控制的Python接口模块. 这个API接口可以管理一个工作副本, 查询档案库, 和同步两个. 该
在SQLSERVER中查找被阻塞和正在被阻塞的SQL 357029540 SQL Server
SELECT R.session_id AS BlockedSessionID , S.session_id AS BlockingSessionID , Q1.text AS Block
Intent 常用的用法备忘 7454103 .net android Google Blog F#
Intent 应该算是Android中特有的东西。你可以在Intent中指定程序要执行的动作（比如：view,edit,dial），以及程序执行到该动作时所需要的资料。都指定好后，只要调用startActivity()，Android系统会自动寻找最符合你指定要求的应用程序，并执行该程序。下面列出几种Intent 的用法显示网页:
Spring定时器时间配置 adminjun spring 时间配置定时器
红圈中的值由6个数字组成，中间用空格分隔。第一个数字表示定时任务执行时间的秒，第二个数字表示分钟，第三个数字表示小时，后面三个数字表示日，月，年，< xmlnamespace prefix ="o" ns ="urn:schemas-microsoft-com:office:office" /> 测试的时候，由于是每天定时执行，所以后面三个数
POJ 2421 Constructing Roads 最小生成树 aijuans 最小生成树
来源：http://poj.org/problem?id=2421 题意：还是给你n个点，然后求最小生成树。特殊之处在于有一些点之间已经连上了边。思路：对于已经有边的点，特殊标记一下，加边的时候把这些边的权值赋值为0即可。这样就可以既保证这些边一定存在，又保证了所求的结果正确。代码： #include <iostream> #include <cstdio>
重构笔记——提取方法（Extract Method） ayaoxinchao java 重构提炼函数局部变量提取方法
提取方法（Extract Method）是最常用的重构手法之一。当看到一个方法过长或者方法很难让人理解其意图的时候，这时候就可以用提取方法这种重构手法。下面是我学习这个重构手法的笔记：提取方法看起来好像仅仅是将被提取方法中的一段代码，放到目标方法中。其实，当方法足够复杂的时候，提取方法也会变得复杂。当然，如果提取方法这种重构手法无法进行时，就可能需要选择其他
为UILabel添加点击事件 bewithme UILabel
默认情况下UILabel是不支持点击事件的，网上查了查居然没有一个是完整的答案，现在我提供一个完整的代码。 UILabel *l = [[UILabel alloc] initWithFrame:CGRectMake(60, 0, listV.frame.size.width - 60, listV.frame.size.height)]
NoSQL数据库之Redis数据库管理(PHP-REDIS实例) bijian1013 redis 数据库 NoSQL
一.redis.php <?php //实例化 $redis = new Redis(); //连接服务器 $redis->connect("localhost"); //授权 $redis->auth("lamplijie"); //相关操
SecureCRT使用备注 bingyingao secureCRT 每页行数
SecureCRT日志和卷屏行数设置一、使用securecrt时，设置自动日志记录功能。 1、在C:\Program Files\SecureCRT\下新建一个文件夹(也就是你的CRT可执行文件的路径），命名为Logs； 2、点击Options -> Global Options -> Default Session -> Edite Default Sett
【Scala九】Scala核心三：泛型 bit1129 scala
泛型类 package spark.examples.scala.generics class GenericClass[K, V](val k: K, val v: V) { def print() { println(k + "," + v) } } object GenericClass { def main(args: Arr
素数与音乐 bookjovi 素数数学 haskell
由于一直在看haskell，不可避免的接触到了很多数学知识，其中数论最多，如素数，斐波那契数列等，很多在学生时代无法理解的数学现在似乎也能领悟到那么一点。闲暇之余，从图书馆找了<<The music of primes>>和<<世界数学通史>>读了几遍。其中素数的音乐这本书与软件界熟知的&l
Java-Collections Framework学习与总结-IdentityHashMap BrokenDreams Collections
这篇总结一下java.util.IdentityHashMap。从类名上可以猜到，这个类本质应该还是一个散列表，只是前面有Identity修饰，是一种特殊的HashMap。简单的说，IdentityHashMap和HashM
读《研磨设计模式》-代码笔记-享元模式-Flyweight bylijinnan java 设计模式
声明：本文只为方便我个人查阅和理解，详细的分析以及源代码请移步原作者的博客http://chjavach.iteye.com/ import java.util.ArrayList; import java.util.Collection; import java.util.HashMap; import java.util.List; import java
PS人像润饰&调色教程集锦 cherishLC PS
1、仿制图章沿轮廓润饰——柔化图像，凸显轮廓 http://www.howzhi.com/course/retouching/ 新建一个透明图层，使用仿制图章不断Alt+鼠标左键选点，设置透明度为21%，大小为修饰区域的1/3左右（比如胳膊宽度的1/3），再沿纹理方向（比如胳膊方向）进行修饰。所有修饰完成后，对该润饰图层添加噪声，噪声大小应该和
更新多个字段的UPDATE语句 crabdave update
更新多个字段的UPDATE语句 update tableA a set (a.v1, a.v2, a.v3, a.v4) = --使用括号确定更新的字段范围
hive实例讲解实现in和not in子句 daizj hive not in in
本文转自：http://www.cnblogs.com/ggjucheng/archive/2013/01/03/2842855.html 当前hive不支持 in或not in 中包含查询子句的语法，所以只能通过left join实现。假设有一个登陆表login(当天登陆记录,只有一个uid),和一个用户注册表regusers(当天注册用户，字段只有一个uid)，这两个表都包含
一道24点的10+种非人类解法（2,3,10,10） dsjt 算法
这是人类算24点的方法？！！！事件缘由：今天晚上突然看到一条24点状态，当时惊为天人，这NM叫人啊？以下是那条状态朱明西 : 24点，算2 3 10 10，我LX炮狗等面对四张牌痛不欲生，结果跑跑同学扫了一眼说，算出来了，2的10次方减10的3次方。。我草这是人类的算24点啊。。然后么。。。我就在深夜很得瑟的问室友求室友算刚出完题，文哥的暴走之旅开始了 5秒后
关于YII的菜单插件 CMenu和面包末breadcrumbs路径管理插件的一些使用问题 dcj3sjt126com yii framework
在使用 YIi的路径管理工具时，发现了一个问题。 <?php
对象与关系之间的矛盾：“阻抗失配”效应[转] come_for_dream 对象
概述 “阻抗失配”这一词组通常用来描述面向对象应用向传统的关系数据库（RDBMS）存放数据时所遇到的数据表述不一致问题。C++程序员已经被这个问题困扰了好多年，而现在的Java程序员和其它面向对象开发人员也对这个问题深感头痛。 “阻抗失配”产生的原因是因为对象模型与关系模型之间缺乏固有的亲合力。“阻抗失配”所带来的问题包括：类的层次关系必须绑定为关系模式（将对象
学习编程那点事 gcq511120594 编程互联网
一年前的夏天，我还在纠结要不要改行，要不要去学php？能学到真本事吗？改行能成功吗？太多的问题，我终于不顾一切，下定决心，辞去了工作，来到传说中的帝都。老师给的乘车方式还算有效，很顺利的就到了学校，赶巧了，正好学校搬到了新校区。先安顿了下来，过了个轻松的周末，第一次到帝都，逛逛吧！接下来的周一，是我噩梦的开始，学习内容对我这个零基础的人来说，除了勉强完成老师布置的作业外，我已经没有时间和精力去
Reverse Linked List II hcx2013 list
Reverse a linked list from position m to n. Do it in-place and in one-pass. For example:Given 1->2->3->4->5->NULL, m = 2 and n = 4, return
Spring4.1新特性——页面自动化测试框架Spring MVC Test HtmlUnit简介 jinnianshilongnian spring 4.1
目录 Spring4.1新特性——综述 Spring4.1新特性——Spring核心部分及其他 Spring4.1新特性——Spring缓存框架增强 Spring4.1新特性——异步调用和事件机制的异常处理 Spring4.1新特性——数据库集成测试脚本初始化 Spring4.1新特性——Spring MVC增强 Spring4.1新特性——页面自动化测试框架Spring MVC T
Hadoop集群工具distcp liyonghui160com
1. 环境描述两个集群：rock 和 stone rock无kerberos权限认证，stone有要求认证。 1. 从rock复制到stone，采用hdfs Hadoop distcp -i hdfs://rock-nn:8020/user/cxz/input hdfs://stone-nn:8020/user/cxz/运行在rock端，即源端问题：报版本
一个备份MySQL数据库的简单Shell脚本 pda158 mysql 脚本
　　主脚本（用于备份mysql数据库）：　　该Shell脚本可以自动备份数据库。只要复制粘贴本脚本到文本编辑器中，输入数据库用户名、密码以及数据库名即可。我备份数据库使用的是mysqlump 命令。后面会对每行脚本命令进行说明。　　 1. 分别建立目录“backup”和“oldbackup” 　　#mkdir /backup 　　#mkdir /oldbackup 　
300个涵盖IT各方面的免费资源（中）——设计与编码篇 shoothao IT资源图标库图片库色彩板字体
A. 免费的设计资源 Freebbble:来自于Dribbble的免费的高质量作品。 Dribbble:Dribbble上“免费”的搜索结果——这是巨大的宝藏。 Graphic Burger:每个像素点都做得很细的绝佳的设计资源。 Pixel Buddha:免费和优质资源的专业社区。 Premium Pixels:为那些有创意的人提供免费的素材。
thrift总结 - 跨语言服务开发 uule thrift
官网官网JAVA例子 thrift入门介绍 IBM-Apache Thrift - 可伸缩的跨语言服务开发框架 Thrift入门及Java实例演示 thrift的使用介绍 RPC POM： <dependency> <groupId>org.apache.thrift</groupId>

大白话5分钟带你走进人工智能-第34节神经网络之多神经网络概念(2)

1、回顾：

2、常见的激活函数都有哪些？

3、多层神经网络里面故事：

4、如何训练神经网络？

你可能感兴趣的:(深度学习篇,深度学习)