Eason.wxd

系统学习深度学习（七）--主流深度学习开源框架对比

转自：http://blog.csdn.net/u010167269/article/details/51810613，本文做了相关修改。

参考论文：《Comparative Study of Deep Learning Software Frameworks》，这篇文章对现在流行的五个开源深度学习框架 caffe、Neon、TensorFlow、Theano、Torch 做了比较，很严谨。作者也开源了他们的比较 Benchmarks 代码： https://github.com/DL-Benchmarks/DL-Benchmarks。

比较的三方面： 可扩展性（extensibility）、hardware utilization（硬件利用率）以及大家最关心的：速度（speed）

评估测试都是部署在单机上，对于多线程 CPU、GPU（Nvidia Titan X）都进行测试；
速度评估标准包括了梯度计算时间（gradient computation time）、前向传播时间（forward time）；
对于卷积网络，作者还对这几个深度框架支持的不同的卷积算法以及相应的性能表现做了实验；

最后通过实验，作者发现 Theano、Torch 是最具扩展性的深度学习框架；
在 CPU 上的测试性能来看，Torch 最优，其次是 Theano；
在 GPU 上的性能表现，对于大规模卷积以及全连接网络，还是 Torch 最优，其次是 Neon；
但是 Theano 在部署和训练 LSTM 网络中夺得拔筹；
caffe 是最容易测试评估性能的标准深度学习框架；
最后，TensorFlow 与 Theano 有些相似，是比较灵活的框架，但是其性能表现，目前还跟上面的几个框架比不起来。

但是，这篇文章发表的时候，TensorFlow 还只能用 cuDNN v.2 版本。现在怎么样，还需要做新的实验。

Introduction

现在大多数成功的深度学习架构由几种不同类型的网络层组合而成，如 全连接层（fully connected layer）、卷积层（convolutional layer）、递归层（recurrent layer）。之后用各种 随机梯度下降算法（stochastic gradient descent algorithm），以及一些 正则化技术（regularization），如 dropout、weight decay。

伴随着深度学习的流行与成功，一些深度学习框架不断涌现，包括但不限于：

caffe: http://caffe.berkeleyvision.org/
DeepLearning4J: http://deeplearning4j.org/
deepmat: https://github.com/kyunghyuncho/deepmat
Neon: http://neon.nervanasys.com/docs/latest/index.html
Eblearn: http://eblearn.sourceforge.net/
PyLearn: http://deeplearning.net/software/pylearn2/
TensorFlow: https://www.tensorflow.org/
Theano: http://deeplearning.net/software/theano/
Torch: http://torch.ch/
MXnet: http://mxnet.readthedocs.io/en/latest/
chainer: https://github.com/pfnet/chainer

不同的框架从不同的角度去部署、训练深度学习算法。例如：caffe 强调使用的简单性，所以在 caffe 中，在网络中添加一个层很简单。又如，Theano 可以自动求微分，可以方便的修改架构，以便研究与开发。

前不久，有人已经评测了几种深度学习框架的性能：https://github.com/soumith/convnet-benchmarks，但是这个比较只是在卷积网络架构上进行比较（并且忽视掉了与卷积无关测网络层，如 dropout 层、Softmax 层）。

这篇文章对评测比较实验进行了扩展，从上面的一些开源架构中，选择了五种有代表性的框架：caffe、Neon、TensorFlow、Theano、Torch。
其中，caffe、Theano、Torch 是目前深度学习社区使用最多的框架。
本论文中加入 Neon 的评测，是因为在上面的评测中，Neon 取得了卓越的性能表现。
而对 TensorFlow 进行评测，是因为自从 TensorFlow 被 Google 开源之后，取得了耀眼的关注度，在 Github 上的 Star 数量已经到 27,362 了。而 caffe 也才 11,062 个 Star 。在这篇文章进行评测的时候，TensorFlow 还没有支持最新的 cuDNN v.3，还只支持 cuDNN v.2。但为了评测的完整性，还是将 TensorFlow 加进入了。

在对这些框架进行评估时，考虑以下三个方面：

可扩展型（Extensibility）: 一是对于不同类型的网络层：全连接层（fully-connected layer）、卷积层（convolutional layer）、递归层（recurrent layer）的组合能力；二是对于不同训练过程支持的能力，如非监督逐层预训练（unsupervised layer-wise pre-training）、监督训练（supervised learning）；三是对于不同卷积层的支持能力，如支持不支持 FFT-based 算法。
硬件利用率（Hardware Utilization）: 这些框架对于硬件资源的结合、调用情况。如对于多线程 CPU 的支持使用、对于 GPU 调用的设置情况。
速度（speed）: 这些框架在训练方面、部署方面的速度表现性能。

这项研究可以便于深度学习个人与企业，了解深度学习框架的强项、弱项，以便于可以根据自身的需求来使用这些开源框架。
此外，本文还探究了深度学习框架当前的一些不足与限制，以便在未来能够得到解决。

Overview of the deep learning frameworks

这里有一个深度学习框架列表，总结了目前几乎所有的深度学习框架：http://deeplearning.net/software_links/。现在这些框架有些已经成熟了，在 CUDA 的帮助下，能够非常高效地训练具有数百万个参数的神经网络。
下面的表1 展示了 Google groups 中使用者的数量，以及每个深度学习框架在 Github 仓库中贡献者的数量（截至2016.02.08）：

可以看见，使用者与贡献者最多的是：caffe、Theano、Torch，这也是本文选择这三个框架做评测的原因之一。

表2 展示了这几个深度学习框架的通用属性：

Benchmarking Setup

Evaluation Metrics

作者用下面的两个评估标准来评测五个开源深度学习框架的性能：

前向传播时间（Forward Time）: 给定一个数据集、神经网络，将输入数据通过网络处理后，产生相应的输出数据，这个过程走过的时间，就是前向传播的时间。如果我们要将深度网络部署在实际生活中应用，前向传播时间就非常重要。
梯度计算时间（Gradient Computation Time）: 对于给定的 input batch，每一个 parameter 得到一个对应的梯度的时间，这个时间消耗也被纳入评测标准。注意到，对于大多数的框架（如：Torch），梯度计算时间是指调用 forward 函数、backward 函数，这两个函数计算所用时间之和。但是对于 Theano，梯度计算时间是指调用 Theano 编译生成的梯度计算函数，这个函数隐式地执行了 forward、backward 过程。另外，梯度计算时间不包含计算完梯度后，对梯度进行更新的时间。

因为对于 Theano ，一开始是需要花费时间去编译生成前向传播函数、梯度计算函数。

事实上，这个正是 Theano 被众多使用者“喷“的地方，因为速度实在是太…慢…了…我使用过 Theano 这个，但感觉还好，可能我的工程不是很大吧，但是这个确实是个问题。之后 Theano 执行的时候就一点也不慢了。因为这个过程是 Theano 将 Python 代码编译为 C 代码，所以调用的时候，速度很快。

这个 Theano 编译的时间也被记录，见下面表：

System setup

本实验都是在单机上完成的，操作系统为 Ubuntu 14.04，CPU 为 Intel Xeon CPU E5-1650 v2 @3.5GHz，GPU 为 Nvidia GeForce GTX Titan X/PCIe/SSE2，32G 的 DDR3 内存，SSD 硬盘。

使用的框架版本、依赖库及其版本：

OpenCV 3.0
OpenBLAS 0.2.14
caffe 使用的 commit ID：8c8e832
Neon 版本：1.0.0.rc1 (2015-09-08)，commit ID：a6766f
TensorFlow 版本：0.6.0，使用 pip install 安装的
Theano 版本：0.7.0.dev，commit ID：662ea98
Torch7，commit ID：8c8e832，fbcunn 的 commit ID：5bb9785
caffe、Theano、Torch 的 CUDA 版本为 CUDA 7.5，cuDNN 版本为 cuDNN v3。TensorFlow 的 CUDA 版本为 CUDA 7.0，cuDNN 版本为 cuDNN v2
Data arrays 是按照 float32 存储

Results and Discussion

评测实验一是在 MNIST 数据集、ImageNet 数据集上训练栈式自编码（stacked auto-encoder network）网络，卷积网络，二是在 IMDB review 数据集上训练 LSTM 网络。

注意，使用原始的框架，以及将这个深度学习框架结合基于 CUDA 包，这两者的测试结果可能会差别很大。
如在 Torch 中，我们可以用 Nvidia cuDNN 库，或者用 cunn 库，或者使用 fbcunn 库（Facebook AI 研究组开发的深度学习 CUDA 扩展库，包括 FFT-based 卷积）。
在 Theano 中，我们可以直接使用 cuDNN 或者 conv-fft 实施卷积操作，conv-fft 是 FFT-based 的 Theano 实现。

LeNet

第一个基准测试实验是在 MNIST 数据集，在 LeNet 网络上进行实验。与原始的 LeNet 不同，这里将原先的 Sigmoid 激活函数换成了 ReLU 激活函数，将原先的 RBF 网络 换成了 Softmax logistic loss layer。

LeNet 是第一个正式的卷积神经网络模型，在 LeCun 的 Paper 上：《Gradient-based learning applied to document recognition》，引用量 5368 次。
LeNet 包括两个 卷积 - 池化（conv-pooling） 层，两个 全连接层（fully connected layer），如下图所示：

下表展示了五个深度学习框架的梯度计算、前向传播过程在 CPU、GPU 上的平均处理时间。其中， batch size 设置为 64 。

对于 CPU 的实验统计时间，CPU 线程使用的个数也被统计在表格中。其中的 Neon 不能使用多线程，因此 Neon 的 CPU 实验时间统计只有但线程的结果。对于 caffe，caffe 的多线程使用的个数，需要在安装的时候决定好。这里是 12 个线程，因此 caffe 的 CPU 实验只有 12 线程的时间统计结果。
TensorFlow、Theano、Torch 可以灵活地选择使用的 CPU 线程数，因此他们的 CPU 的实验时间有多个结果。
因为我们的机器有 6 个物理核，但用 Hpyer-Threading 的技术，可以使用 12 个线程。因此，我们统计 6 线程、12 线程的实验结果。

当用 GPU 进行实验时，对于每个深度学习框架，使用基础的卷积加速库（如：cuDNN），并指明版本（版本越高，速度越快）。Neon 使用自己的 GPU/CPU backend。

从结果中可以看出，对于训练 LeNet，GPU的效率相比较于 CPU，是碾压性的。而且，对于更大的数据量，更大的网络模型，GPU 的这种优势将会更明显。

CPU 阶段的实验来看，Torch 的表现最好，而 Neon 的表现最差。对于 GPU 的实验看，cuDNN 的加速效果要明显好于 conv-fft 。LeCun 的一篇 Paper 《Fast Training of Convolutional Networks Through FFT》提到，一般来说，FFT-based 的性能表现，高度取决于 input 的 size，以及 kernel size 。

梯度计算的时间最好的是 Theano，只有 1.4s，当然，Torch 的表现也很棒，1.7s。而对于前向传播的时间，Theano 以及 Torch 打了个平手。之前耀眼的 TensorFlow 在 GPU 实验中的表现是最差的。可能的原因是 TensorFlow 使用的是 cuDNN v.2 版本，而 caffe、Theano、Torch 使用的是 cuDNN v.3 版本。

还应该注意到 MNIST 是相对较小的一个数据集，可以很容易的“放进“ CPU 的内存，或者 GPU 的显存中。因此，Theano、Torch、Neon 是一次性的将数据全部读入显存中。这样避免了后来将数据从本地拷贝到 GPU 中所造成的延迟。

在 Theano 中，这个可以用 shared variables 来完成。
在 Torch 中，可以调用 cuda( ) 函数来完成
在 Neon 中，可以使用 DataIterator class
在 TensorFlow 中，这个可以在定义变量的时候，通过设置合适的参数来完成
在 caffe 中，将整个训练数据集拷贝到显存中，可以用 MemoryData layer

下图展示了五个深度学习框架在 GPU 上，用不同的 batch size，各自 batch size 的梯度计算时间，前向传播时间的统计：

从图中可以看出，当 batch size 较小时，Theano 的梯度计算时间最短，而当 batch size 较大时，Neon 的梯度计算时间最短。
而在前向传播实验中，Theano 不管 batch size 的大小，其前向传播时间都最短，而且随着 batch size 的变大，其优势更明显。
caffe、Torch的表现，随着 batch size 的变大，其性能下降的很明显。TensorFlow 表现一直很“稳定“ — 性能都最差，尤其是当 batch size 越小的时候。

AlexNet

在这一部分的实验中，我们将用 ImageNet 去训练 AlexNet 。其实也有很多最新的、更大的网络模型，如 GoogleNet，Oxford Net 等等。但是因为 AlexNet 是第一个大幅提升 ImageNet 比赛结果的深度网络模型（2012 年 ImageNet 比赛），而且 AlexNet 非常流行，很具代表性。

AlexNet 前 5 层是卷积层，后 3 层是全连接层，最后一个全连接层的 output 是一个具有 1000 输出的 Softmax 。
如下示意图，应该很清楚的展现了 AlexNet 的结构：

图像被 crop 为 224×224。并没有做数据增广处理（data augmentation，如：random cropping，transformation）。

要注意，每一个框架在读取 ImageNet 数据的时候，caffe 是使用了 LMDB 数据库格式，Neon 是使用了 ImgMaster 类，Theano 是使用了 Hickle，Torch 使用了多线程的数据加载（这里面提供的：https://github.com/soumith/imagenet-multiGPU.torch）。

这个 AlexNet 网络模型，caffe 的版本、Neon 的版本在它们的 Github 仓库中就有，但是 Neon 不支持 Grouping 层、LRN 层。
TensorFlow 的版本改编自：https://github.com/soumith/convnet-benchmarks，同样的，TensorFlow 目前还不支持 Grouping 层。
Theano 的版本改编自《Theano-based Large-scale Visual Recognition with Multiple GPUs》这篇文章里的，不过没有用 GPU 并行。

更具体的，实现每个框架的 AlexNet 的时候，我们没有使用 dimshuffle 操作。
Theano 在 GPU 上的卷积操作，本文既调用了来自 cuDNN 库里的 dnn.dnn_conv 函数，又使用了 pylearn2 中的 cuda-convnet 接口里面的对应的卷积操作函数。对于后者，本文标记为：cuconv 。
对于 Torch，跟上面的 LeNet 一样，我们既使用了 cuDNN 卷积卷积加速库，又使用了 cunn 库、fbcunn 库，并分别做了时间消耗统计。

由于 fbcunn 库，当 stride lengths 大于 1 的时候，不支持。所以实现这个版本的 AlexNet 的时候，一开始的卷积操作，我们使用了 cuDNN 的库函数，剩下的卷积操作，我们使用 fbcunn 库来完成。此外，fbcunn 库、cunn 库不支持 grouping 层。

下面的表，展示了当 batch size 等于 256 的时候，五个深度学习框架的 AlexNet 训练的效率统计：

为了更好的比较，每个框架的数据加载时间、数据预处理时间（mean normalization）被我们去除掉了。
我们还汇报了 GPU 显存使用的峰值，来展示每个框架的的效率。
在 CPU 实验中，Torch 的性能最好，与上面 LeNet 的测试结果相似。使用 GPU 时的加速效果比 LeNet 中更明显（提高了至少 25×）。同时，Torch 在 GPU 上的 梯度计算 性能最好（上面 LeNet 实验时 Theano，不过那时候 Torch 与 Theano 相差无几）。但是在 前向传播 中，Neon 的性能最好，但是 Torch 也紧随其后，与之相差无几（Neon 中的没有 LRN 层，同时 grouping 设置为 1）。
与 LeNet 相似，TensorFlow 效果最差…

下面的图，展示了在 GPU 实验上（无 LRN 层，grouping 设置为 1），当 batch size 的大小设置不同的值时，五个深度学习框架的性能表现：

在 前向传播 性能测试上，Neon、Torch 的性能表现一直很优异，时间都最短。但是在 梯度计算 测试中，Neon 最好。

GPU 的使用效率上，caffe、Theano、Torch 的GPU使用效率都差不多（当使用 cuDNN 的时候），但是 Neon 的使用效率最高。TensorFlow 的消耗最大。

在本实验中，还注意到，caffe 中使用的 LMDB 数据库的性能相比较于 Neon 的，Theano 的，Torch 的数据读取，更高效，因为它支持并发读取（concurrent read）。caffe 还使用了 pre-fetching 来消除 IO 延迟。所以，Neon、Theano、Torch 在以后的改进中，可以加入对 LMDB 数据读取、pre-fetching 的支持。

补充：

下面是栈自编码器的性能分析，与上面类似：

结论跟上面类似，在多核CPU中，Torch，Theano都比较好，TensorFlow最差。在GPU中，也差不多这样。

LSTM：

这里可以看到，Theano在GPU中，LSTM上的评价有碾压性优势。但Torch也不差。Caffe在论文时，还不支持LSTM（新版支持了），Neon和TensorFlow不支持变长序列输入，因此，作者只对比了Torch和Theano。

Conclusions

通过上面的实验，以 梯度计算时间（gradient computation time）、前向传播时间（forward time） 为基准，比较了五个较为有影响力的深度学习框架：caffe、Theano、Neon、Torch 以及 TensorFlow 的性能。总结如下：

Theano、Torch 是两个最具有扩展性的深度学习框架，无论在支持的各种网络层种类数量上，或者是在支持的各种库上。symbolic differentiation 是 Theano 中对于非标准深度网络架构（non-standard deep architecture）提供的最有用的特性。Torch 正在补上这个空缺，可以参考这个博客：https://blog.twitter.com/2015/autograd-for-torch
在 CPU 上 training 以及 deploy，对于任何的网络模型，Torch 的性能都最优，其次是 Theano，Neon 的在 CPU 上的性能最差
在 GPU 上 deploy 已经训练好的卷积和全连接网络（也就是 前向传播过程），Torch 也是最适合的，其次是 Theano
在 GPU 上 training 卷积和全连接网络，Theano 在小网络模型（LeNet）的表现最好，在大网络模型（AlexNet）上，Torch 性能最佳。Neon 在大网络模型上也非常有优势
Torch 受益于它众多的扩展库及文档（这个确实，Torch 的文档阅读性很强，Theano 也不错），还有 Torch 的错误调试工具也很有优势
TensorFlow 是非常具有扩展性的一个深度学习框架，尤其是在不同情况的各种设备上，进行深度学习框架部署时，更方便稳定。但是在单机上，它的表现就不具有那么强的竞争力了

Postscript

看完这篇文章后，我发现其实本文还少了一个很重要的框架：MXnet 。MXnet 是由 DMLC 团队开发的，主要贡献者有发明 XGBoost 的陈天奇等等大神。在一些测试中，它的性能已经优于上面的几个框架，而且它也支持分布式，能够运行 Torch 的所有代码（我看 MXnet 的一个作者的微博上说的…没试过…）。

MXnet 与 caffe、TensorFlow 之间的对比，我推荐一篇博客吧，像上文中那样具体的实验分析在这里就先不写了。博客地址：http://chenrudan.github.io/blog/2015/11/18/comparethreeopenlib.html，个人感觉现在 MXnet 就是 model 太少了，不像 caffe，都有 Caffe Model Zoo ……

另外，再推荐一篇 Github 上的文章：https://github.com/zer0n/deepframeworks，也是对 Caffe、CNTK、TensorFlow、Theano、Torch 做了比对。从 Modeling Capability 、Interfaces、Model Deployment、Performance、Architecture 这几个方面做了比较。

机器学习与深度学习间关系与区别 ℒℴѵℯ心·动ꦿ໊ོ꫞ 人工智能学习深度学习 python
一、机器学习概述定义机器学习（MachineLearning,ML）是一种通过数据驱动的方法，利用统计学和计算算法来训练模型，使计算机能够从数据中学习并自动进行预测或决策。机器学习通过分析大量数据样本，识别其中的模式和规律，从而对新的数据进行判断。其核心在于通过训练过程，让模型不断优化和提升其预测准确性。主要类型1.监督学习（SupervisedLearning）监督学习是指在训练数据集中包含输入
将cmd中命令输出保存为txt文本文件落难Coder Windows cmd window
最近深度学习本地的训练中我们常常要在命令行中运行自己的代码，无可厚非，我们有必要保存我们的炼丹结果，但是复制命令行输出到txt是非常麻烦的，其实Windows下的命令行为我们提供了相应的操作。其基本的调用格式就是：运行指令>输出到的文件名称或者具体保存路径测试下，我打开cmd并且ping一下百度：pingwww.baidu.com>./data.txt看下相同目录下data.txt的输出：如果你再
推荐3家毕业AI论文可五分钟一键生成！文末附免费教程！小猪包333 写论文人工智能 AI写作深度学习计算机视觉
在当前的学术研究和写作领域，AI论文生成器已经成为许多研究人员和学生的重要工具。这些工具不仅能够帮助用户快速生成高质量的论文内容，还能进行内容优化、查重和排版等操作。以下是三款值得推荐的AI论文生成器：千笔-AIPassPaper、懒人论文以及AIPaperPass。千笔-AIPassPaper千笔-AIPassPaper是一款基于深度学习和自然语言处理技术的AI写作助手，旨在帮助用户快速生成高质
AI大模型的架构演进与最新发展季风泯灭的季节 AI大模型应用技术二人工智能架构
随着深度学习的发展，AI大模型（LargeLanguageModels,LLMs）在自然语言处理、计算机视觉等领域取得了革命性的进展。本文将详细探讨AI大模型的架构演进，包括从Transformer的提出到GPT、BERT、T5等模型的历史演变，并探讨这些模型的技术细节及其在现代人工智能中的核心作用。一、基础模型介绍：Transformer的核心原理Transformer架构的背景在Transfo
[实践应用] 深度学习之模型性能评估指标 YuanDaima2048 深度学习工具使用深度学习人工智能损失函数性能评估 pytorch python 机器学习
文章总览：YuanDaiMa2048博客文章总览深度学习之模型性能评估指标分类任务回归任务排序任务聚类任务生成任务其他介绍在机器学习和深度学习领域，评估模型性能是一项至关重要的任务。不同的学习任务需要不同的性能指标来衡量模型的有效性。以下是对一些常见任务及其相应的性能评估指标的详细解释和总结。分类任务分类任务是指模型需要将输入数据分配到预定义的类别或标签中。以下是分类任务中常用的性能指标：准确率(
[实践应用] 深度学习之优化器 YuanDaima2048 深度学习工具使用 pytorch 深度学习人工智能机器学习 python 优化器
文章总览：YuanDaiMa2048博客文章总览深度学习之优化器1.随机梯度下降（SGD）2.动量优化（Momentum）3.自适应梯度（Adagrad）4.自适应矩估计（Adam）5.RMSprop总结其他介绍在深度学习中，优化器用于更新模型的参数，以最小化损失函数。常见的优化函数有很多种，下面是几种主流的优化器及其特点、原理和PyTorch实现：1.随机梯度下降（SGD）原理:随机梯度下降通过
生成式地图制图 Bwywb_3 深度学习机器学习深度学习生成对抗网络
生成式地图制图（GenerativeCartography）是一种利用生成式算法和人工智能技术自动创建地图的技术。它结合了传统的地理信息系统（GIS）技术与现代生成模型（如深度学习、GANs等），能够根据输入的数据自动生成符合需求的地图。这种方法在城市规划、虚拟环境设计、游戏开发等多个领域具有应用前景。主要特点：自动化生成：通过算法和模型，系统能够根据输入的地理或空间数据自动生成地图，而无需人工逐
吴恩达深度学习笔记(30)-正则化的解释极客Array
正则化（Regularization）深度学习可能存在过拟合问题——高方差，有两个解决方法，一个是正则化，另一个是准备更多的数据，这是非常可靠的方法，但你可能无法时时刻刻准备足够多的训练数据或者获取更多数据的成本很高，但正则化通常有助于避免过拟合或减少你的网络误差。如果你怀疑神经网络过度拟合了数据，即存在高方差问题，那么最先想到的方法可能是正则化，另一个解决高方差的方法就是准备更多数据，这也是非常
个人学习笔记7-6：动手学深度学习pytorch版-李沐浪子L 深度学习深度学习笔记计算机视觉 python 人工智能神经网络 pytorch
#人工智能##深度学习##语义分割##计算机视觉##神经网络#计算机视觉13.11全卷积网络全卷积网络（fullyconvolutionalnetwork，FCN）采用卷积神经网络实现了从图像像素到像素类别的变换。引入l转置卷积（transposedconvolution）实现的，输出的类别预测与输入图像在像素级别上具有一一对应关系：通道维的输出即该位置对应像素的类别预测。13.11.1构造模型下
深度学习-点击率预估-研究论文2024-09-14速读 sp_fyf_2024 深度学习人工智能
深度学习-点击率预估-研究论文2024-09-14速读1.DeepTargetSessionInterestNetworkforClick-ThroughRatePredictionHZhong,JMa,XDuan,SGu,JYao-2024InternationalJointConferenceonNeuralNetworks,2024深度目标会话兴趣网络用于点击率预测摘要：这篇文章提出了一种新
损失函数与反向传播 Star_. PyTorch pytorch 深度学习 python
损失函数定义与作用损失函数(lossfunction)在深度学习领域是用来计算搭建模型预测的输出值和真实值之间的误差。1.损失函数越小越好2.计算实际输出与目标之间的差距3.为更新输出提供依据（反向传播)常见的损失函数回归常见的损失函数有：均方差（MeanSquaredError，MSE）、平均绝对误差（MeanAbsoluteErrorLoss，MAE）、HuberLoss是一种将MSE与MAE
【深度学习】训练过程中一个OOM的问题，太难查了 weixin_40293999 深度学习深度学习人工智能
现象：各位大佬又遇到过ubuntu的这个问题么？现象是在训练过程中，ssh上不去了，能ping通，没死机，但是ubunutu的pc侧的显示器，鼠标啥都不好用了。只能重启。问题原因：OOM了95G，尼玛！！！！pytorch爆内存了，然后journald假死了，在journald被watchdog干掉之后，系统就崩溃了。这种规模的爆内存一般，即使被oomkill了，也要卡半天的，确实会这样，能不能配
云服务业界动态简报-20180128 Captain7
一、青云青云QingCloud推出深度学习平台DeepLearningonQingCloud，包含了主流的深度学习框架及数据科学工具包，通过QingCloudAppCenter一键部署交付，可以让算法工程师和数据科学家快速构建深度学习开发环境，将更多的精力放在模型和算法调优。二、腾讯云1.腾讯云正式发布腾讯专有云TCE(TencentCloudEnterprise)矩阵，涵盖企业版、大数据版、AI
机器学习VS深度学习 nfgo 机器学习
机器学习（MachineLearning,ML）和深度学习（DeepLearning,DL）是人工智能（AI）的两个子领域，它们有许多相似之处，但在技术实现和应用范围上也有显著区别。下面从几个方面对两者进行区分：1.概念层面机器学习：是让计算机通过算法从数据中自动学习和改进的技术。它依赖于手动设计的特征和数学模型来进行学习，常用的模型有决策树、支持向量机、线性回归等。深度学习：是机器学习的一个子领
大数据毕业设计hadoop+spark+hive知识图谱租房数据分析可视化大屏租房推荐系统 58同城租房爬虫房源推荐系统房价预测系统计算机毕业设计机器学习深度学习人工智能 2401_84572577 程序员大数据 hadoop 人工智能
做了那么多年开发，自学了很多门编程语言，我很明白学习资源对于学一门新语言的重要性，这些年也收藏了不少的Python干货，对我来说这些东西确实已经用不到了，但对于准备自学Python的人来说，或许它就是一个宝藏，可以给你省去很多的时间和精力。别在网上瞎学了，我最近也做了一些资源的更新，只要你是我的粉丝，这期福利你都可拿走。我先来介绍一下这些东西怎么用，文末抱走。（1）Python所有方向的学习路线（
深度学习-13-小语言模型之SmolLM的使用皮皮冰燃深度学习深度学习
文章附录1SmolLM概述1.1SmolLM简介1.2下载模型2运行2.1在CPU/GPU/多GPU上运行模型2.2使用torch.bfloat162.3通过位和字节的量化版本3应用示例4问题及解决4.1attention_mask和pad_token_id报错4.2max_new_tokens=205参考附录1SmolLM概述1.1SmolLM简介SmolLM是一系列尖端小型语言模型，提供三种规
基于深度学习的农作物病害检测 SEU-WYL 深度学习dnn 深度学习人工智能
基于深度学习的农作物病害检测利用卷积神经网络（CNN）、生成对抗网络（GAN）、Transformer等深度学习技术，自动识别和分类农作物的病害，帮助农业工作者提高作物管理效率、减少损失。1.农作物病害检测的挑战病害种类繁多：农作物病害的类型多样，不同病害在同一作物上的表现差异很大，同时同一种病害在不同生长阶段的症状也可能不同。环境影响：天气、光照、湿度等外部环境因素会影响农作物的表现，使得病害检
基于深度学习的文本引导的图像编辑 SEU-WYL 深度学习dnn 深度学习人工智能
基于深度学习的文本引导的图像编辑（Text-GuidedImageEditing）是一种通过自然语言文本指令对图像进行编辑或修改的技术。它结合了图像生成和自然语言处理（NLP）的最新进展，使用户能够通过描述性文本对图像内容进行精确的调整和操控。1.文本引导的图像编辑的挑战文本和图像之间的对齐：如何将文本中的语义信息准确地映射到图像中的特定区域或元素是一个关键挑战。这涉及到多模态数据的对齐和理解。编
深度学习--对抗生成网络（GAN, Generative Adversarial Network） Ambition_LAO 深度学习生成对抗网络
对抗生成网络（GAN,GenerativeAdversarialNetwork）是一种深度学习模型，由IanGoodfellow等人在2014年提出。GAN主要用于生成数据，通过两个神经网络相互对抗，来生成以假乱真的新数据。以下是对GAN的详细阐述，包括其概念、作用、核心要点、实现过程、代码实现和适用场景。1.概念GAN由两个神经网络组成：生成器（Generator）和判别器（Discrimina
深度学习：怎么看pth文件的参数奥利给少年深度学习人工智能
.pth文件是PyTorch模型的权重文件，它通常包含了训练好的模型的参数。要查看或使用这个文件，你可以按照以下步骤操作：1.确保你有模型的定义你需要有创建这个.pth文件时所用的模型的代码。这意味着你需要有模型的类定义和架构。2.加载模型权重使用PyTorch的load_state_dict方法来加载权重。这里是如何操作的：importtorchimporttorch.nnasnn#定义模型结构
chatgpt赋能python：如何在Python中安装Keras库？ turensu ChatGpt python chatgpt keras 计算机
如何在Python中安装Keras库？Keras是一个简单易用的神经网络库，由FrançoisChollet编写。它在Python编程语言中实现了深度学习的功能，可以使您更轻松地构建和试验不同类型的神经网络。如果您是一名Python开发人员，肯定会想知道如何在您的Python项目中安装Keras库。在本文中，我们将向您展示如何安装和配置Keras库。步骤1：安装Python要使用Keras库，您需
如何理解深度学习的训练过程奋斗的草莓熊深度学习人工智能 python scikit-learn virtualenv numpy pandas
文章目录1.训练是干什么？2.预训练模型进行训练，主要更改的是预训练模型的什么东西？1.训练是干什么？以yolov5为例子，训练的目的是把一组输入猫狗图像放到神经网络中，得到一个输出模型，这个模型下次可以直接用来识别哪个是猫，哪个是狗2.预训练模型进行训练，主要更改的是预训练模型的什么东西？超参数（Hyperparameters）：这是模型结构中定义的参数，比如：卷积核大小（kernel_size
Keras深度学习框架入门及实战指南司莹嫣Maude
Keras深度学习框架入门及实战指南keraskeras-team/keras:是一个基于Python的深度学习库，它没有使用数据库。适合用于深度学习任务的开发和实现，特别是对于需要使用Python深度学习库的场景。特点是深度学习库、Python、无数据库。项目地址:https://gitcode.com/gh_mirrors/ke/keras一、项目介绍Keras简介Keras是一款高级神经网络
深度学习驱动的车牌识别：技术演进与未来挑战逼子歌深度学习车牌识别神经网络字符识别 YOLO 卷积神经网络
一、引言1.1研究背景在当今社会，智能交通系统的发展日益重要，而车牌识别作为其关键组成部分，发挥着至关重要的作用。车牌识别技术广泛应用于交通管理、停车场管理、安防监控等领域。在交通管理中，它可以用于车辆识别、交通违法监控和车流统计等，提高交通管理的效率和准确性。在停车场管理中，实现车辆的自动识别和收费，提升管理和服务水平。在安防监控领域，可用于追踪嫌疑人及犯罪行为。深度学习的出现为车牌识别带来了重
每天五分钟玩转深度学习PyTorch：模型参数优化器torch.optim 幻风_huanfeng 深度学习框架pytorch 深度学习 pytorch 人工智能神经网络机器学习优化算法
本文重点在机器学习或者深度学习中，我们需要通过修改参数使得损失函数最小化(或最大化)，优化算法就是一种调整模型参数更新的策略。在pytorch中定义了优化器optim，我们可以使用它调用封装好的优化算法，然后传递给它神经网络模型参数，就可以对模型进行优化。本文是学习第6步(优化器)，参考链接pytorch的学习路线随机梯度下降算法在深度学习和机器学习中，梯度下降算法是最常用的参数更新方法，它的公式
什么是AIGC？有哪些免费工具？ chent_某位 AIGC
AIGC（AIGeneratedContent），即“人工智能生成内容”，是指通过人工智能技术自动生成各种类型的数字内容。AIGC让机器能够根据输入的信息或数据生成符合人类需求的文本、图像、音频、视频等内容，极大提高了内容创作的效率。AIGC的背景与起源随着深度学习和自然语言处理技术的快速发展，人工智能已经不再局限于简单的任务，如分类、预测和数据分析，而是具备了生成内容的能力。生成式AI模型，如O
transformer架构(Transformer Architecture)原理与代码实战案例讲解 AI架构设计之禅大数据AI人工智能 Python入门实战计算科学神经计算深度学习神经网络大数据人工智能大型语言模型 AI AGI LLM Java Python 架构设计 Agent RPA
transformer架构(TransformerArchitecture)原理与代码实战案例讲解关键词：Transformer,自注意力机制,编码器-解码器,预训练,微调,NLP,机器翻译作者：禅与计算机程序设计艺术/ZenandtheArtofComputerProgramming1.背景介绍1.1问题的由来自然语言处理（NLP）领域的发展经历了从规则驱动到统计驱动再到深度学习驱动的三个阶段。
如何有效的学习AI大模型？ Python程序员罗宾学习人工智能语言模型自然语言处理架构
学习AI大模型是一个系统性的过程，涉及到多个学科的知识。以下是一些建议，帮助你更有效地学习AI大模型：基础知识储备：数学基础：学习线性代数、概率论、统计学和微积分等，这些是理解机器学习算法的数学基础。编程技能：掌握至少一种编程语言，如Python，因为大多数AI模型都是用Python实现的。理论学习：机器学习基础：了解监督学习、非监督学习、强化学习等基本概念。深度学习：学习神经网络的基本结构，如卷
【深度学习】【OnnxRuntime】【Python】模型转化、环境搭建以及模型部署的详细教程牙牙要健康深度学习 onnx onnxruntime 深度学习 python 人工智能
【深度学习】【OnnxRuntime】【Python】模型转化、环境搭建以及模型部署的详细教程提示:博主取舍了很多大佬的博文并亲测有效,分享笔记邀大家共同学习讨论文章目录【深度学习】【OnnxRuntime】【Python】模型转化、环境搭建以及模型部署的详细教程前言模型转换--pytorch转onnxWindows平台搭建依赖环境onnxruntime调用onnx模型ONNXRuntime推理核
基于深度学习的多模态信息检索 SEU-WYL 深度学习dnn 深度学习人工智能
基于深度学习的多模态信息检索（MultimodalInformationRetrieval,MMIR）是指利用深度学习技术，从包含多种模态（如文本、图像、视频、音频等）的数据集中检索出满足用户查询意图的相关信息。这种方法不仅可以处理单一模态的数据，还可以在多种模态之间建立关联，从而更准确地满足用户需求。1.多模态信息检索的挑战异构数据表示：多模态数据通常具有不同的特征和表示形式（如文本的词嵌入与图
多线程编程之join()方法周凡杨 java JOIN 多线程编程线程
现实生活中，有些工作是需要团队中成员依次完成的，这就涉及到了一个顺序问题。现在有T1、T2、T3三个工人，如何保证T2在T1执行完后执行，T3在T2执行完后执行？问题分析：首先问题中有三个实体，T1、T2、T3，因为是多线程编程，所以都要设计成线程类。关键是怎么保证线程能依次执行完呢？ Java实现过程如下： public class T1 implements Runnabl
java中switch的使用 bingyingao java enum break continue
java中的switch仅支持case条件仅支持int、enum两种类型。用enum的时候，不能直接写下列形式。 switch (timeType) { case ProdtransTimeTypeEnum.DAILY: break; default: br
hive having count 不能去重 daizj hive 去重 having count 计数
hive在使用having count()是，不支持去重计数 hive (default)> select imei from t_test_phonenum where ds=20150701 group by imei having count(distinct phone_num)>1 limit 10; FAILED: SemanticExcep
WebSphere对JSP的缓存周凡杨 WAS JSP 缓存
对于线网上的工程，更新JSP到WebSphere后，有时会出现修改的jsp没有起作用，特别是改变了某jsp的样式后，在页面中没看到效果，这主要就是由于websphere中缓存的缘故，这就要清除WebSphere中jsp缓存。要清除WebSphere中JSP的缓存，就要找到WAS安装后的根目录。现服务
设计模式总结朱辉辉33 java 设计模式
1.工厂模式 1.1 工厂方法模式 (由一个工厂类管理构造方法) 1.1.1普通工厂模式(一个工厂类中只有一个方法) 1.1.2多工厂模式(一个工厂类中有多个方法) 1.1.3静态工厂模式(将工厂类中的方法变成静态方法) &n
实例：供应商管理报表需求调研报告老A不折腾 finereport 报表系统报表软件信息化选型
引言随着企业集团的生产规模扩张，为支撑全球供应链管理，对于供应商的管理和采购过程的监控已经不局限于简单的交付以及价格的管理，目前采购及供应商管理各个环节的操作分别在不同的系统下进行，而各个数据源都独立存在，无法提供统一的数据支持；因此，为了实现对于数据分析以提供采购决策，建立报表体系成为必须。业务目标 1、通过报表为采购决策提供数据分析与支撑 2、对供应商进行综合评估以及管理，合理管理和
mysql 林鹤霄
转载源：http://blog.sina.com.cn/s/blog_4f925fc30100rx5l.html mysql -uroot -p ERROR 1045 (28000): Access denied for user 'root'@'localhost' (using password: YES) [root@centos var]# service mysql
Linux下多线程堆栈查看工具(pstree、ps、pstack) aigo linux
原文：http://blog.csdn.net/yfkiss/article/details/6729364 1. pstree pstree以树结构显示进程$ pstree -p work | grep adsshd(22669)---bash(22670)---ad_preprocess(4551)-+-{ad_preprocess}(4552) &n
html input与textarea 值改变事件 alxw4616 JavaScript
// 文本输入框(input) 文本域(textarea)值改变事件 // onpropertychange(IE) oninput(w3c) $('input,textarea').on('propertychange input', function(event) { console.log($(this).val()) });
String类的基本用法百合不是茶 String
字符串的用法; // 根据字节数组创建字符串 byte[] by = { 'a', 'b', 'c', 'd' }; String newByteString = new String(by); 1,length() 获取字符串的长度 &nbs
JDK1.5 Semaphore实例 bijian1013 java thread java多线程 Semaphore
Semaphore类一个计数信号量。从概念上讲，信号量维护了一个许可集合。如有必要，在许可可用前会阻塞每一个 acquire()，然后再获取该许可。每个 release() 添加一个许可，从而可能释放一个正在阻塞的获取者。但是，不使用实际的许可对象，Semaphore 只对可用许可的号码进行计数，并采取相应的行动。 S
使用GZip来压缩传输量 bijian1013 java GZip
启动GZip压缩要用到一个开源的Filter：PJL Compressing Filter。这个Filter自1.5.0开始该工程开始构建于JDK5.0，因此在JDK1.4环境下只能使用1.4.6。 PJL Compressi
【Java范型三】Java范型详解之范型类型通配符 bit1129 java
定义如下一个简单的范型类， package com.tom.lang.generics; public class Generics<T> { private T value; public Generics(T value) { this.value = value; } }
【Hadoop十二】HDFS常用命令 bit1129 hadoop
1. 修改日志文件查看器 hdfs oev -i edits_0000000000000000081-0000000000000000089 -o edits.xml cat edits.xml 修改日志文件转储为xml格式的edits.xml文件，其中每条RECORD就是一个操作事务日志 2. fsimage查看HDFS中的块信息等 &nb
怎样区别nginx中rewrite时break和last ronin47
在使用nginx配置rewrite中经常会遇到有的地方用last并不能工作，换成break就可以，其中的原理是对于根目录的理解有所区别，按我的测试结果大致是这样的。 location / { proxy_pass http://test;
java-21.中兴面试题输入两个整数 n 和 m ，从数列 1 ， 2 ， 3.......n 中随意取几个数 , 使其和等于 m bylijinnan java
import java.util.ArrayList; import java.util.List; import java.util.Stack; public class CombinationToSum { /* 第21 题 2010 年中兴面试题编程求解：输入两个整数 n 和 m ，从数列 1 ， 2 ， 3.......n 中随意取几个数 , 使其和等
eclipse svn 帐号密码修改问题开窍的石头 eclipse SVN svn帐号密码修改
问题描述： Eclipse的SVN插件Subclipse做得很好，在svn操作方面提供了很强大丰富的功能。但到目前为止，该插件对svn用户的概念极为淡薄，不但不能方便地切换用户，而且一旦用户的帐号、密码保存之后，就无法再变更了。解决思路：删除subclipse记录的帐号、密码信息，重新输入
[电子商务]传统商务活动与互联网的结合 comsci 电子商务
某一个传统名牌产品，过去销售的地点就在某些特定的地区和阶层，现在进入互联网之后，用户的数量群突然扩大了无数倍，但是，这种产品潜在的劣势也被放大了无数倍，这种销售利润与经营风险同步放大的效应，在最近几年将会频繁出现。。。。如何避免销售量和利润率增加的
java 解析 properties-使用 Properties-可以指定配置文件路径 cuityang java properties
#mq xdr.mq.url=tcp://192.168.100.15:61618; import java.io.IOException; import java.util.Properties; public class Test { String conf = "log4j.properties"; private static final
Java核心问题集锦 darrenzhu java 基础核心难点
注意，这里的参考文章基本来自Effective Java和jdk源码 1)ConcurrentModificationException 当你用for each遍历一个list时，如果你在循环主体代码中修改list中的元素，将会得到这个Exception，解决的办法是： 1)用listIterator, 它支持在遍历的过程中修改元素， 2)不用listIterator, new一个
1分钟学会Markdown语法 dcj3sjt126com markdown
markdown 简明语法基本符号 *,-,+ 3个符号效果都一样，这3个符号被称为 Markdown符号空白行表示另起一个段落 `是表示inline代码，tab是用来标记代码段，分别对应html的code，pre标签换行单一段落( <p>) 用一个空白行连续两个空格会变成一个 <br> 连续3个符号，然后是空行
Gson使用二（GsonBuilder） eksliang json gson GsonBuilder
转载请出自出处：http://eksliang.iteye.com/blog/2175473 一.概述 GsonBuilder用来定制java跟json之间的转换格式二.基本使用实体测试类：温馨提示：默认情况下@Expose注解是不起作用的,除非你用GsonBuilder创建Gson的时候调用了GsonBuilder.excludeField
报ClassNotFoundException: Didn't find class "...Activity" on path: DexPathList gundumw100 android
有一个工程，本来运行是正常的，我想把它移植到另一台PC上，结果报： java.lang.RuntimeException: Unable to instantiate activity ComponentInfo{com.mobovip.bgr/com.mobovip.bgr.MainActivity}: java.lang.ClassNotFoundException: Didn't f
JavaWeb之JSP指令 ihuning javaweb
要点 JSP指令简介 page指令 include指令 JSP指令简介 JSP指令（directive）是为JSP引擎而设计的，它们并不直接产生任何可见输出，而只是告诉引擎如何处理JSP页面中的其余部分。 JSP指令的基本语法格式： <%@ 指令属性名="
mac上编译FFmpeg跑ios 啸笑天 ffmpeg
1、下载文件：https://github.com/libav/gas-preprocessor，复制gas-preprocessor.pl到/usr/local/bin/下，修改文件权限：chmod 777 /usr/local/bin/gas-preprocessor.pl 2、安装yasm-1.2.0 curl http://www.tortall.net/projects/yasm
sql mysql oracle中字符串连接 macroli oracle sql mysql SQL Server
有的时候，我们有需要将由不同栏位获得的资料串连在一起。每一种资料库都有提供方法来达到这个目的： MySQL: CONCAT() Oracle: CONCAT(), || SQL Server: + CONCAT() 的语法如下： Mysql 中 CONCAT(字串1, 字串2, 字串3, ...): 将字串1、字串2、字串3，等字串连在一起。请注意，Oracle的CON
Git fatal: unab SSL certificate problem: unable to get local issuer ce rtificate qiaolevip 学习永无止境每天进步一点点 git 纵观千象
// 报错如下： $ git pull origin master fatal: unable to access 'https://git.xxx.com/': SSL certificate problem: unable to get local issuer ce rtificate // 原因：由于git最新版默认使用ssl安全验证，但是我们是使用的git未设
windows命令行设置wifi surfingll windows wifi 笔记本wifi
还没有讨厌无线wifi的无尽广告么，还在耐心等待它慢慢启动么教你命令行设置笔记本电脑wifi： 1、开启wifi命令 netsh wlan set hostednetwork mode=allow ssid=surf8 key=bb123456 netsh wlan start hostednetwork pause 其中pause是等待输入，可以去掉 2、
Linux（Ubuntu）下安装sysv-rc-conf wmlJava linux ubuntu sysv-rc-conf
安装：sudo apt-get install sysv-rc-conf 使用：sudo sysv-rc-conf 操作界面十分简洁，你可以用鼠标点击，也可以用键盘方向键定位，用空格键选择，用Ctrl+N翻下一页，用Ctrl+P翻上一页，用Q退出。背景知识 sysv-rc-conf是一个强大的服务管理程序，群众的意见是sysv-rc-conf比chkconf
svn切换环境，重发布应用多了javaee标签前缀 zengshaotao javaee
更换了开发环境，从杭州，改变到了上海。svn的地址肯定要切换的，切换之前需要将原svn自带的.svn文件信息删除，可手动删除，也可通过废弃原来的svn位置提示删除.svn时删除。然后就是按照最新的svn地址和规范建立相关的目录信息，再将原来的纯代码信息上传到新的环境。然后再重新检出，这样每次修改后就可以看到哪些文件被修改过，这对于增量发布的规范特别有用。检出