东风逍遥游

SqueezeNet详细解读

概要：SqueezeNet的工作为以下几个方面：

提出了新的网络架构Fire Module，通过减少参数来进行模型压缩
使用其他方法对提出的SqeezeNet模型进行进一步压缩
对参数空间进行了探索，主要研究了压缩比和 3∗3 卷积比例的影响

这篇文章是 SQUEEZENET: ALEXNET-LEVEL ACCURACY WITH 50X FEWER PARAMETERS AND <0.5MB MODEL SIZE 的解读，在精简部分内容的同时补充了相关的概念。如有错误，敬请指正。
论文链接：http://arxiv.org/abs/1602.07360
代码链接：https://github.com/DeepScale/SqueezeNet

ABSTRACT

近来深层卷积网络的主要研究方向集中在提高正确率。对于相同的正确率水平，更小的CNN架构可以提供如下的优势：
（1）在分布式训练中，与服务器通信需求更小
（2）参数更少，从云端下载模型的数据量小
（3）更适合在FPGA等内存受限的设备上部署。
基于这些优点，本文提出SqeezeNet。它在ImageNet上实现了和AlexNet相同的正确率，但是只使用了1/50的参数。更进一步，使用模型压缩技术，可以将SqueezeNet压缩到0.5MB，这是AlexNet的1/510。

1 INTRODUCTION AND MOTIVATION

对于一个给定的正确率，通常可以找到多种CNN架构来实现与之相近的正确率。其中，参数数量更少的CNN架构有如下优势：
（1）更高效的分布式训练
服务器间的通信是分布式CNN训练的重要限制因素。对于分布式数据并行训练方式，通信需求和模型参数数量正相关。小模型对通信需求更低。
（2）减小下载模型到客户端的额外开销
比如在自动驾驶中，经常需要更新客户端模型。更小的模型可以减少通信的额外开销，使得更新更加容易。
（3）便于FPGA和嵌入式硬件上的部署

2.1 MODEL COMPRESSION

常用的模型压缩技术有：
（1）奇异值分解(singular value decomposition (SVD))1
（2）网络剪枝（Network Pruning）2：使用网络剪枝和稀疏矩阵
（3）深度压缩（Deep compression）3：使用网络剪枝，数字化和huffman编码
（4）硬件加速器（hardware accelerator）4

2.2 CNN MICROARCHITECTURE

在设计深度网络架构的过程中，如果手动选择每一层的滤波器显得过于繁复。通常先构建由几个卷积层组成的小模块，再将模块堆叠形成完整的网络。定义这种模块的网络为CNN microarchitecture。

2.3 CNN MACROARCHITECTURE

与模块相对应，定义完整的网络架构为CNN macroarchitecture。在完整的网络架构中，深度是一个重要的参数。

2.4 NEURAL NETWORK DESIGN SPACE EXPLORATION

由于超参数繁多，深度神经网络具有很大的设计空间（design space）。通常进行设计空间探索的方法有：
（1）贝叶斯优化
（2）模拟退火
（3）随机搜索
（4）遗传算法

3 SQUEEZENET: PRESERVING ACCURACY WITH FEW PARAMETERS

3.1 ARCHITECTURAL DESIGN STRATEGIES

使用以下三个策略来减少SqueezeNet设计参数
（1）使用 1∗1 卷积代替 3∗3 卷积：参数减少为原来的1/9
（2）减少输入通道数量：这一部分使用squeeze layers来实现
（3）将欠采样操作延后，可以给卷积层提供更大的激活图：更大的激活图保留了更多的信息，可以提供更高的分类准确率
其中，（1）和（2）可以显著减少参数数量，（3）可以在参数数量受限的情况下提高准确率。

3.2 THE FIRE MODULE

Fire Module是SqueezeNet中的基础构建模块，如下定义 Fire Module :

squeeze convolution layer：只使用 1∗1 卷积 filter，即以上提到的策略（1）
expand layer：使用 1∗1 和 3∗3 卷积 filter的组合
Fire module中使用3ge可调的超参数： s1x1 （squeeze convolution layer中 1∗1 filter的个数）、 e1x1 （expand layer中 1∗1 filter的个数）、 e3x3 （expand layer中 3∗3 filter的个数）
使用Fire module的过程中，令 s1x1 < e1x1 + e3x3 ，这样squeeze layer可以限制输入通道数量，即以上提到的策略（2）

3.3 THE SQUEEZENET ARCHITECTURE

SqueezeNet以卷积层（conv1）开始，接着使用8个Fire modules (fire2-9)，最后以卷积层（conv10）结束。每个fire module中的filter数量逐渐增加，并且在conv1, fire4, fire8, 和 conv10这几层之后使用步长为2的max-pooling，即将池化层放在相对靠后的位置，这使用了以上的策略（3）。

如上图，左边为原始的SqueezeNet，中间为包含simple bypass的改进版本，最右侧为使用complex bypass的改进版本。在下表中给出了更多的细节。

因为这是一篇讲解网络压缩的文章，这里顺便提一下参数计算的方法。以上表中的 fire2模块为例：maxpool1层的输出为

55∗55∗96 ，一共有96个通道。之后紧接着的Squeeze层有16个

1∗1∗96 的卷积filter，注意这里是多通道卷积，为了避免与二维卷积混淆，在卷积尺寸末尾写上了通道数。这一层的输出尺寸为

55∗55∗16 ，之后将输出分别送到expand层中的

1∗1∗16 （64个）和

3∗3∗16 （64个）进行处理，注意这里不对16个通道进行切分。为了得到大小相同的输出，对

3∗3∗16 的卷积输入进行尺寸为１的zero padding。分别得到

55∗55∗64 和

55∗55∗64 大小相同的两个feature map。将这两个feature map连接到一起得到

55∗55∗128 大小的feature map。考虑到bias参数，这里的参数总数为：

(1 * 1 * 96 + 1) * 16 + (1 * 1 * 16 + 1) * 64 + (3 * 3 * 16 + 1) * 64 ＝ (1552 + 1088 + 9280) = 11920

可以看出，Squeeze层由于使用 1∗1 卷积极大地压缩了参数数量，并且进行了降维操作，但是对应的代价是输出特征图的通道数（维数）也大大减少。之后的expand层使用不同尺寸的卷积模板来提取特征，同时将两个输出连接到一起，又将维度升高。但是 3∗3∗16 的卷积模板参数较多，远超 1∗1 卷积的参数，对减少参数十分不利，所以作者又针对 3∗3∗16 卷积进行了剪枝操作以减少参数数量。从网络整体来看，feature map的尺寸不断减小，通道数不断增加，最后使用平均池化将输出转换成 1∗1∗1000 完成分类任务。

3.3.1 OTHER SQUEEZENET DETAILS

以下是网络设计中的一些要点：
（1）为了使 1∗1 和 3∗3 filter输出的结果又相同的尺寸，在expand modules中，给 3∗3 filter的原始输入添加一个像素的边界（zero-padding）。
（2）squeeze 和 expand layers中都是用ReLU作为激活函数
（3）在fire9 module之后，使用Dropout，比例取50%
（4）注意到SqueezeNet中没有全连接层，这借鉴了Network in network的思想
（5）训练过程中，初始学习率设置为0.04，，在训练过程中线性降低学习率。更多的细节参见本项目在github中的配置文件。
（6）由于Caffee中不支持使用两个不同尺寸的filter，在expand layer中实际上是使用了两个单独的卷积层（ 1∗1 filter 和 3∗3 filter），最后将这两层的输出连接在一起，这在数值上等价于使用单层但是包含两个不同尺寸的filter。
在github上还有SqueezeNet在其他框架下的实现：MXNet、Chainer、Keras、Torch。

4 EVALUATION OF SQUEEZENET

在表2中，以AlexNet为标准来比较不同压缩方法的效果。

SVD方法能将预训练的AlexNet模型压缩为原先的1/5，top1正确率略微降低。网络剪枝的方法能将模型压缩到原来的1/9，top1和top5正确率几乎保持不变。深度压缩能将模型压缩到原先的1/35，正确率基本不变。SqeezeNet的压缩倍率可以达到50以上，并且正确率还能有略微的提升。注意到几时使用未进行压缩的32位数值精度来表示模型，SqeezeNet也比压缩率最高的模型更小，同时表现也更好。
如果将深度压缩（Deep Compression）的方法用在SqeezeNet上，使用33%的稀疏表示和8位精度，会得到一个仅有0.66MB的模型。进一步，如果使用6位精度，会得到仅有0.47MB的模型，同时正确率不变。
此外，结果表明深度压缩不仅对包含庞大参数数量的CNN网络作用，对于较小的网络，比如SqueezeNet，也是有用的。将SqueezeNet的网络架构创新和深度压缩结合起来可以将原模型压缩到1/510。

5 CNN MICROARCHITECTURE DESIGN SPACE EXPLORATION

5.1 CNN MICROARCHITECTURE METAPARAMETERS

在SqueezeNet中，每一个Fire module有3个维度的超参数，即 s1x1 、 e1x1 和 e3x3 。SqueezeNet一共有8个Fire modules，即一共24个超参数。下面讨论其中一些重要的超参数的影响。为方便研究，定义如下参数：

basee ：Fire module中expand filter的个数
freq ：Fire module的个数
incree ：在每 freq 个Fire module之后增加的expand filter个数
ei ：第 i 个Fire module中，expand filters的个数
SR ：压缩比，即the squeeze ratio ，为squeeze layer中filter个数除以Fire module中filter总个数得到的一个比例
pct3x3 ：在expand layer有 1∗1 和 3∗3 两种卷积，这里定义的参数是 3∗3 卷积个占卷积总个数的比例

下图为实验结果：

5.2 SQUEEZE RATIO

Figure 3 中左图给出了压缩比（SR）的影响。压缩比小于0.25时，正确率开始显著下降。

5.3 TRADING OFF 1X1 AND 3X3 FILTERS

Figure 3 中右图给出了 3∗3 卷积比例的影响，在比例小于25%时，正确率开始显著下降，此时模型大小约为原先的44%。超过50%后，模型大小显著增加，但是正确率不再上升。

6 CNN MACROARCHITECTURE DESIGN SPACE EXPLORATION

受ResNet启发，这里探究旁路连接（bypass conection）的影响。在Figure 2中展示了三种不同的网络架构。下表给出了实验结果：

注意到使用旁路连接后正确率确实有一定提高。

7 Conclusions

在SqueezeNet提出后，Dense-Sparse-Dense (DSD)5使用了新的方法来进行压缩同时提高了精度。

8 Implementation

在这里我们分析SqeezeNet的PyTorch实现，以加深对网络架构的理解。源代码可见：https://github.com/pytorch/vision/blob/master/torchvision/models/squeezenet.py

为方便分析，除去其中不必要的代码。

8.1 Fire module的实现

首先Fire类是对torch.nn.Modules类进行拓展得到的，需要继承Modules类，并实现__init__()方法，以及forward()方法。其中，__init__()方法用于定义一些新的属性，这些属性可以包括Modules的实例，如一个torch.nn.Conv2d，nn.ReLU等。即创建该网络中的子网络，在创建这些子网络时，这些网络的参数也被初始化。接着使用super(Fire, self).__init__()调用基类初始化函数对基类进行初始化。

首先，在Fire类的__init__()函数中，定义了如下几个新增的属性：
1. inplanes：输入向量
2. squeeze：sqeeze layer，由二维 1∗1 卷积组成。其中，参考PyTorch文档，torch.nn.Conv2d 的定义为class torch.nn.Conv2d(in_channels, out_channels, kernel_size, stride=1, padding=0, dilation=1, groups=1, bias=True)，代码中inplanes为输入通道，squeeze_planes为输出通道，卷积模板尺寸为 1∗1 .
3. expand1x1：expand layer中的 1∗1 卷积。
4. expand3x3：expand layer中的 3∗3 卷积。注意，为了使 1∗1 和 3∗3 filter输出的结果有相同的尺寸，在expand modules中，给3∗3 filter的原始输入添加一个像素的边界（zero-padding）
5. 所有的激活函数都选择ReLU。注意inplace=True参数可以在原始的输入上直接进行操作，不会再为输出分配额外的内存，可以节省一部分内存，但同时也会破坏原始的输入。

之后实现foward方法，整个流程如下：
首先，将输入x经过squeeze layer进行卷积操作，再经过 squeeze_activation（） 进行激活，然后将输出分别送到 expand1x1 和 expand3x3 中进行卷积和激活操作，最后，使用torch.cat()可以将expand1x1_activation和 expand3x3_activation这两个维度相同的输出张量连接在一起。注意这里的dim=1，即按照列连接，最终得到若干行。

class Fire(nn.Module):

    def __init__(self, inplanes, squeeze_planes,
                 expand1x1_planes, expand3x3_planes):
        super(Fire, self).__init__()
        self.inplanes = inplanes
        self.squeeze = nn.Conv2d(inplanes, squeeze_planes, kernel_size=1)
        self.squeeze_activation = nn.ReLU(inplace=True)
        self.expand1x1 = nn.Conv2d(squeeze_planes, expand1x1_planes,
                                   kernel_size=1)
        self.expand1x1_activation = nn.ReLU(inplace=True)
        self.expand3x3 = nn.Conv2d(squeeze_planes, expand3x3_planes,
                                   kernel_size=3, padding=1)
        self.expand3x3_activation = nn.ReLU(inplace=True)

    def forward(self, x):
        x = self.squeeze_activation(self.squeeze(x))
        return torch.cat([
            self.expand1x1_activation(self.expand1x1(x)),
            self.expand3x3_activation(self.expand3x3(x))
        ], 1)

以上实现了SqeezeNet中最重要的Fire module，为搭建整体网络做好了准备。接下来定义SqueezeNet类，它同样继承自nn.Module，这里实现了version=1.0和version=1.1两个SqueezeNet版本。区别在于1.0只有 AlexNet的1/50的参数，而1.1在1.0的基础上进一步压缩，参数略微减少，计算量降低为1.0的40%左右。SqueezeNet类定义了如下属性：
1. num_classes：分类的类别个数
2. self.features：定义了主要的网络层，nn.Sequential()是PyTorch中的序列容器（sequential container），可以按照顺序将Modules添加到其中，这也是网络宏观架构实现的重要步骤。要理解这一部分代码，最好结合表1中的细节，并且自己计算一遍卷积操作后的feature map的尺寸。注意表1中的输入图片尺寸是 227∗227 而不是 224∗224 ，否则跟之后的输出尺寸对不上。
3. 注意nn.MaxPool2d()函数中ceil_mode=True会对池化结果进行向上取整而不是向下取整。
4. 最后一个卷积层的初始化方法与其他层不同，在接下来的for循环中，定义了不同层的初始化方法，可以看到，最后一层使用了均值为0，方差为0.01的正太分布初始化方法，其余层使用He Kaiming论文中的均匀分布初始化方法。同时这里使用了num_classes参数，可以调整分类类别数目。并且所有的bias初始化为零。
5. self.classifier：定义了网络末尾的分类器模块，注意其中使用了nn.Dropout()
6. forward()方法：可以看到由features模块和classifier模块构成。

class SqueezeNet(nn.Module):

    def __init__(self, version=1.0, num_classes=1000):
        super(SqueezeNet, self).__init__()
        if version not in [1.0, 1.1]:
            raise ValueError("Unsupported SqueezeNet version {version}:"
                             "1.0 or 1.1 expected".format(version=version))
        self.num_classes = num_classes
        if version == 1.0:
            self.features = nn.Sequential(
                nn.Conv2d(3, 96, kernel_size=7, stride=2),
                nn.ReLU(inplace=True),
                nn.MaxPool2d(kernel_size=3, stride=2, ceil_mode=True),
                Fire(96, 16, 64, 64),
                Fire(128, 16, 64, 64),
                Fire(128, 32, 128, 128),
                nn.MaxPool2d(kernel_size=3, stride=2, ceil_mode=True),
                Fire(256, 32, 128, 128),
                Fire(256, 48, 192, 192),
                Fire(384, 48, 192, 192),
                Fire(384, 64, 256, 256),
                nn.MaxPool2d(kernel_size=3, stride=2, ceil_mode=True),
                Fire(512, 64, 256, 256),
            )
        else:
            self.features = nn.Sequential(
                nn.Conv2d(3, 64, kernel_size=3, stride=2),
                nn.ReLU(inplace=True),
                nn.MaxPool2d(kernel_size=3, stride=2, ceil_mode=True),
                Fire(64, 16, 64, 64),
                Fire(128, 16, 64, 64),
                nn.MaxPool2d(kernel_size=3, stride=2, ceil_mode=True),
                Fire(128, 32, 128, 128),
                Fire(256, 32, 128, 128),
                nn.MaxPool2d(kernel_size=3, stride=2, ceil_mode=True),
                Fire(256, 48, 192, 192),
                Fire(384, 48, 192, 192),
                Fire(384, 64, 256, 256),
                Fire(512, 64, 256, 256),
            )
        # Final convolution is initialized differently form the rest
        final_conv = nn.Conv2d(512, self.num_classes, kernel_size=1)
        self.classifier = nn.Sequential(
            nn.Dropout(p=0.5),
            final_conv,
            nn.ReLU(inplace=True),
            nn.AvgPool2d(13)
        )

        for m in self.modules():
            if isinstance(m, nn.Conv2d):
                if m is final_conv:
                    init.normal(m.weight.data, mean=0.0, std=0.01)
                else:
                    init.kaiming_uniform(m.weight.data)
                if m.bias is not None:
                    m.bias.data.zero_()

    def forward(self, x):
        x = self.features(x)
        x = self.classifier(x)
        return x.view(x.size(0), self.num_classes)

在之后的代码中定义了完整的squeezenet1_0和squeezenet1_1，如果需要的话，可以使用PyTorch的预训练模型。

def squeezenet1_0(pretrained=False, **kwargs):
    r"""SqueezeNet model architecture from the `"SqueezeNet: AlexNet-level
    accuracy with 50x fewer parameters and <0.5MB model size"
    `_ paper.

    Args:
        pretrained (bool): If True, returns a model pre-trained on ImageNet
    """
    model = SqueezeNet(version=1.0, **kwargs)
    if pretrained:
        model.load_state_dict(model_zoo.load_url(model_urls['squeezenet1_0']))
    return model


def squeezenet1_1(pretrained=False, **kwargs):
    r"""SqueezeNet 1.1 model from the `official SqueezeNet repo
    `_.
    SqueezeNet 1.1 has 2.4x less computation and slightly fewer parameters
    than SqueezeNet 1.0, without sacrificing accuracy.

    Args:
        pretrained (bool): If True, returns a model pre-trained on ImageNet
    """
    model = SqueezeNet(version=1.1, **kwargs)
    if pretrained:
        model.load_state_dict(model_zoo.load_url(model_urls['squeezenet1_1']))
    return model

Refference

E.L Denton, W. Zaremba, J. Bruna, Y. LeCun, and R. Fergus. Exploiting linear structure within
convolutional networks for efficient evaluation. In NIPS, 2014. ↩
S. Han, J. Pool, J. Tran, and W. Dally. Learning both weights and connections for efficient neural
networks. In NIPS, 2015b. ↩
S. Han, H. Mao, and W. Dally. Deep compression: Compressing DNNs with pruning, trained
quantization and huffman coding. arxiv:1510.00149v3, 2015a. ↩
Song Han, Xingyu Liu, Huizi Mao, Jing Pu, Ardavan Pedram, Mark A Horowitz, and William J
Dally. Eie: Efficient inference engine on compressed deep neural network. International Symposium
on Computer Architecture (ISCA), 2016a. ↩
Song Han, Jeff Pool, Sharan Narang, Huizi Mao, Shijian Tang, Erich Elsen, Bryan Catanzaro, John
Tran, and William J. Dally. Dsd: Regularizing deep neural networks with dense-sparse-dense
training flow. arXiv:1607.04381, 2016b. ↩

[深度学习论文笔记]Hybrid Window Attention Based Transformer Architecture for Brain Tumor Segmentation SerendipityQYK 深度学习之医学图像分割论文深度学习 transformer 医学图像处理肿瘤分割人工智能
HybridWindowAttentionBasedTransformerArchitectureforBrainTumorSegmentation基于混合窗口注意力的Transformer结构脑肿瘤分割Author：HimashiPeiris,MunawarHayat,ZhaolinChen,GaryEgan,MehrtashHarandiUnit：MonashUniversitySubmitt
[深度学习论文笔记] TransBTS: Multimodal Brain Tumor Segmentation Using Transformer 基于Transformer的多模态脑肿瘤分割 Slientsake 深度学习之医学图像分割论文深度学习 pytorch python
TransBTS:MultimodalBrainTumorSegmentationUsingTransformer基于Transformer的多模态脑肿瘤分割论文：https://arxiv.org/pdf/2103.04430代码：https://github.com/Wenxuan-1119/TransBTS发表时间：Mar2021[MICCAI2021]一、基本介绍1.1胶质瘤胶质瘤是最常见
深度学习论文笔记 weixin_30730053 人工智能数据库 python
1.语音情感识别、人工神经网络，深度学习神经网络发展历程介绍2.语音情感识别的基本理论3.人工神经网络4.深度学习神经网络基本理论1.语音情感识别、人工神经网络，深度学习神经网络发展历程介绍深度学习常用模型：自编码器、限制玻尔兹曼机、卷积神经网络应用：图像识别、语音设别、广告推荐系统情感分类：anger,joy,sadness,surprise,disgust,fear,netural情感表现：语
[深度学习论文笔记][arxiv 1711]Learning to Segment Every Thing KFXW 深度学习论文笔记深度学习
[arxiv1711]LearningtoSegmentEveryThingRonghangHu,PiotrDollar,KaimingHe,TrevorDarrellandRossGirshickfromBAIR&FAIRpaperlinkMotivation这是一篇在实例分割问题(instancesegmentation)中研究扩展分割物体类别数量的论文。目前instanccesegmenta
[深度学习论文笔记][ICCV 17]Semi Supervised Semantic Segmentation Using Generative Adversarial Net KFXW 深度学习论文笔记深度学习图像分割
[ICCV17]SemiSupervisedSemanticSegmentationUsingGenerativeAdversarialNetworkNasimSouly,ConcettoSpampinatoandMubarakShahfromUniversityofCentralFloridaandUniversityofCataniapaperlinkMotivation第一篇将GAN应用在分
Deep Few-Shot Learning for Hyperspectral Image Classification（2019）——深度学习论文笔记（四） immortal12 DL论文笔记 3-D CNNs few-shot learning HSI分类 residual learning
DeepFew-ShotLearningforHyperspectralImageClassification（2019）文章目录DeepFew-ShotLearningforHyperspectralImageClassification（2019）Abstract1.INTRODUCTION2.PROPOSEDMETHOD**A.DeepFew-ShotLearningandTrainingS
[深度学习论文笔记]Cross-Modality Deep Feature Learning for Brain Tumor Segmentation Slientsake 深度学习之医学图像分割论文深度学习计算机视觉人工智能肿瘤分割
Cross-ModalityDeepFeatureLearningforBrainTumorSegmentation跨通道深度特征学习在脑肿瘤分割中的应用Published:PatternRecognition2021论文：https://arxiv.org/abs/2201.02356代码：机器学习和数字医学图像的流行，为利用深度卷积神经网络解决具有挑战性的脑肿瘤分割(BTS)任务提供了机会
[深度学习论文笔记]Efficient embedding network for 3D brain tumor Segmentation Slientsake 深度学习之医学图像分割论文深度学习人工智能 pytorch
Efficientembeddingnetworkfor3DbraintumorSegmentation一种高效的脑肿瘤三维分割嵌入网络英国皇家医科大学Nov2020MultimodalBrainTumorSegmentationChallenge2020(BRATS)BrainLes2020论文：https://arxiv.org/abs/2107.09842摘要：基于深度学习的三维医学图像
[深度学习论文笔记]Brain tumor segmentation with self-ensembled,deeply-supervised 3D U-net neural networks Slientsake 深度学习之医学图像分割论文深度学习 python pytorch
Braintumorsegmentationwithself-ensembled,deeply-supervised3DU-netneuralnetworks:aBraTS2020challengesolution.使用自集成、深度监督的3DU-net神经网络的脑肿瘤分割:BraTS2020挑战解决方案论文：https://arxiv.org/abs/2011.01045代码：https://gi
深度学习论文笔记（注意力机制）——CBAM: Convolutional Block Attention Module 菜到怀疑人生深度学习
文章目录主要工作methodchannelattentionmodulespatialattentionmodule如何结合spatialattentionmodule与channelattentionmodule实验主要工作提出了一种具有注意力机制的前馈卷积神经网络——ConvolutionalBlockAttentionModule(CBAM)method注意力机制是人类视觉所特有的大脑信号处
[深度学习论文笔记]Modality-aware Mutual Learning for Multi-modal Medical Image Segmentation Slientsake 深度学习之医学图像分割论文多模态融合深度学习人工智能医学图像分割肿瘤分割
Modality-awareMutualLearningforMulti-modalMedicalImageSegmentation多模态医学图像分割中的模态感知互学习Published:Jul2021MICCAI2021论文：https://arxiv.org/abs/2107.09842代码：https://github.com/YaoZhang93/MAML摘要：肝癌是全世界最常见的癌症
[深度学习论文笔记]Multi-phase Liver Tumor Segmentation with Spatial Aggregation Slientsake 深度学习之医学图像分割论文多模态融合计算机视觉深度学习人工智能
Multi-phaseLiverTumorSegmentationwithSpatialAggregationandUncertainRegionInpainting[深度学习论文笔记]基于空间聚集和不确定区域修复的多期肝脏肿瘤分割Jul2021MICCAI2021论文：https://arxiv.org/abs/2108.00911代码：https://github.com/yzhang-zju
[深度学习论文笔记]医学图像分割U型网络大合集 Slientsake 深度学习之医学图像分割论文深度学习计算机视觉 Unet大家族医学图像处理
[深度学习论文笔记]医学图像分割U型网络大合集2015U-Net:ConvolutionalNetworksforBiomedicalImageSegmentation(MICCAI)2016V-Net:FullyConvolutionalNeuralNetworksforVolumetricMedicalImageSegmentation3DU-Net:LearningDenseVolumetr
[深度学习论文笔记]CaraNet: Context Axial Reverse Attention Network for Segmentation of Small Medical Objects Slientsake 深度学习之医学图像分割论文深度学习计算机视觉 pytorch
CaraNet:ContextAxialReverseAttentionNetworkforSegmentationofSmallMedicalObjectsCaraNet:用于分割小医疗对象的上下文轴向反向注意网络Aug2021论文：https://arxiv.org/abs/2108.07368代码：https://github.com/AngeLouCN/CaraNet摘要：准确可靠地分割医
[深度学习论文笔记]Pairwise Learning for Medical Image Segmentation Slientsake 深度学习之医学图像分割论文深度学习人工智能计算机视觉
[深度学习论文笔记]PairwiseLearningforMedicalImageSegmentation医学图像分割的成对学习Published:October2020Publishedin:MedicalImageAnalysis论文：https://www.sciencedirect.com/science/article/abs/pii/S1361841520302401代码：https:
[深度学习论文笔记]Tumor attention networks: Better feature selection, better tumor segmentation Slientsake 深度学习之医学图像分割论文计算机视觉深度学习医学图像分割 pytorch 肿瘤分割
Tumorattentionnetworks:Betterfeatureselection,bettertumorsegmentation肿瘤注意网络:更好的特征选择，更好的肿瘤分割Published:March2021NeuralNetworks论文：https://www.sciencedirect.com/science/article/abs/pii/S0893608021000861代码
[深度学习论文笔记]Rethinking the Skip Connections in U-Net from a Channel-wise Perspective with Transformer Slientsake 深度学习之医学图像分割论文深度学习医学图像分割肿瘤分割计算机视觉
UCTransNet:RethinkingtheSkipConnectionsinU-NetfromaChannel-wisePerspectivewithTransformerUCTransNet:从transformer的通道角度重新思考U-Net中的跳跃连接Published:AAAI2022论文：https://arxiv.org/abs/2109.04335代码：https://gith
[深度学习论文笔记DoDNet: Learning to segment multi-organ and tumors from multiple partially labeled datasets Slientsake 深度学习之医学图像分割论文计算机视觉深度学习 DoDNet 肿瘤分割
DoDNet:Learningtosegmentmulti-organandtumorsfrommultiplepartiallylabeleddatasetsDoDNet：学习从多个部分标记数据集中分割多器官和肿瘤Jul2021CVPR2021论文：https://arxiv.org/abs/2011.10217代码：https://github.com/jianpengz/DoDNet摘要：
深度学习论文笔记（一）Deep Residual Learning for Image Recognition 澪mio 深度学习深度学习论文阅读神经网络
深度学习论文精读（一）DeepResidualLearningforImageRecognition前言ResNet1Summary总结遇到的问题？解决方案？成果？2Introduction神经网络叠的越深，则学习出的效果就一定会越好吗？深度残差学习DeepResidualLearning相关工作RelatedWork3DeepResidualLearning3.1残差学习ResidualLear
深度学习论文笔记（知识蒸馏）—— FitNets: Hints for Thin Deep Nets 菜到怀疑人生深度学习深度学习 r语言人工智能
文章目录主要工作知识蒸馏的一些简单介绍文中一些有意思的观念Method最近看了不少文献，一直懒得总结，现在才爬起来写总结…，不少论文的idea还是不错的主要工作让小模型模仿大模型的输出（softtarget），从而让小模型能获得大模型一样的泛化能力，这便是知识蒸馏，是模型压缩的方式之一，本文在Hinton提出knowledgedistillation方法（下文简称KD）的基础上进行扩展，利用tea
深度学习论文笔记（知识蒸馏）——Distilling the Knowledge in a Neural Network 菜到怀疑人生深度学习
文章目录主要工作motivationmethod实验主要工作提出一种知识蒸馏的方法，可以压缩模型，让小模型达到与集成亦或是大型模型相似的性能提出一种新的集成学习方法，可以让模型训练速度更快，并且是并行训练本文只总结第一点motivation大型模型往往不适合线上部署，一方面是计算资源消耗大，另一方面是响应速度慢，因此Hinton便考虑是否可以将大模型的知识迁移到小模型上，这里有两个问题大型模型知识
Generative Adverarial Networks for Hyperspectral Image Classification（2019）——深度学习论文笔记（十一） immortal12 DL论文笔记卷积神经网络分类算法
GenerativeAdversarialNetworksforHyperspectralImageClassification（2019）文章目录GenerativeAdversarialNetworksforHyperspectralImageClassification（2019）Abstract1.INTRODUCTION2.BACKGROUND3.PROPOSEDMETHODSA.Fra
[深度学习论文笔记] Inter-slice Context Residual Learning for 3D Medical Image Segmentation Slientsake 深度学习之医学图像分割论文深度学习 pytorch
[深度学习论文研读]Inter-sliceContextResidualLearningfor3DMedicalImageSegmentation基于层间上下文残差学习的三维医学图像分割论文：https://arxiv.org/abs/2011.14155v1代码：https://github.com/jianpengz/ConResNet发表时间：2020IEEE-TMI一、基本介绍1.1问题动
[深度学习论文笔记]TransBTSV2: Wider Instead of Deeper Transformer for Medical Image Segmentation Slientsake 深度学习之医学图像分割论文深度学习 transformer 人工智能肿瘤分割医学图像处理
TransBTSV2:WiderInsteadofDeeperTransformerforMedicalImageSegmentationTransBTSV2:用于医学图像分割的宽Transformer代替深TransformerPublished:Jan2022论文：https://arxiv.org/abs/2201.12785代码：https://github.com/Wenxuan-111
[深度学习论文笔记]使用多模态MR成像分割脑肿瘤的HNF-Netv2 Slientsake 深度学习之医学图像分割论文深度学习人工智能医学图像分割肿瘤分割计算机视觉
HNF-Netv2forBrainTumorSegmentationusingmulti-modalMRImaging使用多模态MR成像分割脑肿瘤的HNF-Netv2Published:Jan2022论文：https://arxiv.org/abs/2202.05268代码：暂无摘要：在之前的工作中，作者利用HNF-Net、高分辨率的特征表示和轻量化的非局部自注意机制，利用多模态MR成像对脑肿
[深度学习论文笔记]UCTransNet:从transformer的通道角度重新思考U-Net中的跳跃连接 Slientsake 深度学习之医学图像分割论文深度学习计算机视觉人工智能医学图像分割
UCTransNet:RethinkingtheSkipConnectionsinU-NetfromaChannel-wisePerspectivewithTransformerUCTransNet:从transformer的通道角度重新思考U-Net中的跳跃连接Published:AAAI2022论文：https://arxiv.org/abs/2109.04335代码：https://gith
[深度学习论文笔记]A Tri-attention Fusion Guided Multi-modal Segmentation Network Slientsake 多模态融合深度学习之医学图像分割论文深度学习计算机视觉人工智能多模态融合
ATri-attentionFusionGuidedMulti-modalSegmentationNetwork一种三注意力融合引导的多模态分割网络Published:2Nov2021PatternRecognition2021论文：https://arxiv.org/abs/2111.01623摘要：在多模态分割领域，可以考虑不同模态之间的相关性来提高分割结果。考虑到不同磁共振模态之间的相关
[深度学习论文笔记]UNETR: Transformers for 3D Medical Image Segmentation Slientsake 深度学习之医学图像分割论文深度学习人工智能医学图像分割多器官分割脑肿瘤分割
UNETR:Transformersfor3DMedicalImageSegmentationUNETR：用于三维医学图像分割的TransformerPublished:Oct2021Publishedin:IEEEWinterConferenceonApplicationsofComputerVision(WACV)2022论文：https://arxiv.org/abs/2103.10504代
[深度学习论文笔记]TransUNet: Transformers Make Strong Encoders for Medical Image Segmentation Slientsake 深度学习之医学图像分割论文深度学习 pytorch python
[深度学习论文笔记]TransUNet:TransformersMakeStrongEncodersforMedicalImageSegmentationTransUNet：用于医学图像分割的Transformers强大编码器论文：https://arxiv.org/pdf/2102.04306代码：https://github.com/Beckschen/TransUNet发表时间：Feb202
[深度学习论文笔记（增量学习）——Incremental Classifier and Representation Learning 梦回兵工厂 Deep Learning理论知识
深度学习论文笔记（增量学习）——IncrementalClassifierandRepresentationLearning
web报表工具FineReport常见的数据集报错错误代码和解释老A不折腾 web报表 finereport 代码可视化工具
在使用finereport制作报表，若预览发生错误，很多朋友便手忙脚乱不知所措了，其实没什么，只要看懂报错代码和含义，可以很快的排除错误，这里我就分享一下finereport的数据集报错错误代码和解释，如果有说的不准确的地方，也请各位小伙伴纠正一下。 NS-war-remote=错误代码\:1117 压缩部署不支持远程设计 NS_LayerReport_MultiDs=错误代码
Java的WeakReference与WeakHashMap bylijinnan java 弱引用
首先看看 WeakReference wiki 上 Weak reference 的一个例子： public class ReferenceTest { public static void main(String[] args) throws InterruptedException { WeakReference r = new Wea
Linux——（hostname）主机名与ip的映射 eksliang linux hostname
一、什么是主机名无论在局域网还是INTERNET上，每台主机都有一个IP地址，是为了区分此台主机和彼台主机，也就是说IP地址就是主机的门牌号。但IP地址不方便记忆，所以又有了域名。域名只是在公网（INtERNET)中存在，每个域名都对应一个IP地址，但一个IP地址可有对应多个域名。域名类型 linuxsir.org 这样的；主机名是用于什么的呢？答：在一个局域网中，每台机器都有一个主
oracle 常用技巧 18289753290
oracle常用技巧 ①复制表结构和数据 create table temp_clientloginUser as select distinct userid from tbusrtloginlog ②仅复制数据如果表结构一样 insert into mytable select * &nb
使用c3p0数据库连接池时出现com.mchange.v2.resourcepool.TimeoutException 酷的飞上天空 exception
有一个线上环境使用的是c3p0数据库，为外部提供接口服务。最近访问压力增大后台tomcat的日志里面频繁出现 com.mchange.v2.resourcepool.TimeoutException: A client timed out while waiting to acquire a resource from com.mchange.v2.resourcepool.BasicResou
IT系统分析师如何学习大数据蓝儿唯美大数据
我是一名从事大数据项目的IT系统分析师。在深入这个项目前需要了解些什么呢？学习大数据的最佳方法就是先从了解信息系统是如何工作着手，尤其是数据库和基础设施。同样在开始前还需要了解大数据工具，如Cloudera、Hadoop、Spark、Hive、Pig、Flume、Sqoop与Mesos。系统分析师需要明白如何组织、管理和保护数据。在市面上有几十款数据管理产品可以用于管理数据。你的大数据数据库可能
spring学习——简介 a-john spring
Spring是一个开源框架，是为了解决企业应用开发的复杂性而创建的。Spring使用基本的JavaBean来完成以前只能由EJB完成的事情。然而Spring的用途不仅限于服务器端的开发，从简单性，可测试性和松耦合的角度而言，任何Java应用都可以从Spring中受益。其主要特征是依赖注入、AOP、持久化、事务、SpringMVC以及Acegi Security 为了降低Java开发的复杂性，
自定义颜色的xml文件 aijuans xml
<?xml version="1.0" encoding="utf-8"?> <resources> <color name="white">#FFFFFF</color> <color name="black">#000000</color> &
运营到底是做什么的？ aoyouzi 运营到底是做什么的？
文章来源：夏叔叔（微信号：woshixiashushu），欢迎大家关注！很久没有动笔写点东西，近些日子，由于爱狗团产品上线，不断面试，经常会被问道一个问题。问：爱狗团的运营主要做什么？答：带着用户一起嗨。为什么是带着用户玩起来呢？究竟什么是运营？运营到底是做什么的？那么，我们先来回答一个更简单的问题——互联网公司对运营考核什么？以爱狗团为例，绝大部分的移动互联网公司，对运营部门的考核分为三块——用
js面向对象类和对象百合不是茶 js 面向对象函数创建类和对象
接触js已经有几个月了,但是对js的面向对象的一些概念根本就是模糊的,js是一种面向对象的语言但又不像java一样有class,js不是严格的面向对象语言 ,js在java web开发的地位和java不相上下 ,其中web的数据的反馈现在主流的使用json,json的语法和js的类和属性的创建相似下面介绍一些js的类和对象的创建的技术一:类和对
web.xml之资源管理对象配置 resource-env-ref bijian1013 java web.xml servlet
resource-env-ref元素来指定对管理对象的servlet引用的声明，该对象与servlet环境中的资源相关联 <resource-env-ref> <resource-env-ref-name>资源名</resource-env-ref-name> <resource-env-ref-type>查找资源时返回的资源类
Create a composite component with a custom namespace sunjing
https://weblogs.java.net/blog/mriem/archive/2013/11/22/jsf-tip-45-create-composite-component-custom-namespace When you developed a composite component the namespace you would be seeing would
【MongoDB学习笔记十二】Mongo副本集服务器角色之Arbiter bit1129 mongodb
一、复本集为什么要加入Arbiter这个角色回答这个问题，要从复本集的存活条件和Aribter服务器的特性两方面来说。什么是Artiber？ An arbiter does not have a copy of data set and cannot become a primary. Replica sets may have arbiters to add a
Javascript开发笔记白糖_ JavaScript
获取iframe内的元素通常我们使用window.frames["frameId"].document.getElementById("divId").innerHTML这样的形式来获取iframe内的元素，这种写法在IE、safari、chrome下都是通过的，唯独在fireforx下不通过。其实jquery的contents方法提供了对if
Web浏览器Chrome打开一段时间后，运行alert无效 bozch Web chorme alert 无效
今天在开发的时候，突然间发现alert在chrome浏览器就没法弹出了，很是怪异。试了试其他浏览器，发现都是没有问题的。开始想以为是chorme浏览器有啥机制导致的，就开始尝试各种代码让alert出来。尝试结果是仍然没有显示出来。这样开发的结果，如果客户在使用的时候没有提示，那会带来致命的体验。哎，没啥办法了就关闭浏览器重启。结果就好了，这也太怪异了。难道是cho
编程之美-高效地安排会议图着色问题贪心算法 bylijinnan 编程之美
import java.util.ArrayList; import java.util.Collections; import java.util.List; import java.util.Random; public class GraphColoringProblem { /**编程之美高效地安排会议图着色问题贪心算法 * 假设要用很多个教室对一组
机器学习相关概念和开发工具 chenbowen00 算法 matlab 机器学习
基本概念：机器学习(Machine Learning, ML)是一门多领域交叉学科，涉及概率论、统计学、逼近论、凸分析、算法复杂度理论等多门学科。专门研究计算机怎样模拟或实现人类的学习行为，以获取新的知识或技能，重新组织已有的知识结构使之不断改善自身的性能。它是人工智能的核心，是使计算机具有智能的根本途径，其应用遍及人工智能的各个领域，它主要使用归纳、综合而不是演绎。开发工具 M
[宇宙经济学]关于在太空建立永久定居点的可能性 comsci 经济
大家都知道,地球上的房地产都比较昂贵,而且土地证经常会因为新的政府的意志而变幻文本格式........ 所以,在地球议会尚不具有在太空行使法律和权力的力量之前,我们外太阳系统的友好联盟可以考虑在地月系的某些引力平衡点上面,修建规模较大的定居点
oracle 11g database control 证书错误 daizj oracle 证书错误 oracle 11G 安装
oracle 11g database control 证书错误 win7 安装完oracle11后打开 Database control 后，会打开em管理页面，提示证书错误，点“继续浏览此网站”，还是会继续停留在证书错误页面解决办法：是 KB2661254 这个更新补丁引起的，它限制了 RSA 密钥位长度少于 1024 位的证书的使用。具体可以看微软官方公告：
Java I/O之用FilenameFilter实现根据文件扩展名删除文件游其是你 FilenameFilter
在Java中，你可以通过实现FilenameFilter类并重写accept(File dir, String name) 方法实现文件过滤功能。在这个例子中，我们向你展示在“c:\\folder”路径下列出所有“.txt”格式的文件并删除。 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16
C语言数组的简单以及一维数组的简单排序算法示例，二维数组简单示例 dcj3sjt126com c array
# include <stdio.h> int main(void) { int a[5] = {1, 2, 3, 4, 5}; //a 是数组的名字 5是表示数组元素的个数，并且这五个元素分别用a[0], a[1]...a[4] int i; for (i=0; i<5; ++i) printf("%d\n",
PRIMARY, INDEX, UNIQUE 这3种是一类 PRIMARY 主键。就是唯一且不能为空。 INDEX 索引，普通的 UNIQUE 唯一索引 dcj3sjt126com primary
PRIMARY, INDEX, UNIQUE 这3种是一类PRIMARY 主键。就是唯一且不能为空。INDEX 索引，普通的UNIQUE 唯一索引。不允许有重复。FULLTEXT 是全文索引，用于在一篇文章中，检索文本信息的。举个例子来说，比如你在为某商场做一个会员卡的系统。这个系统有一个会员表有下列字段：会员编号 INT会员姓名
java集合辅助类 Collections、Arrays shuizhaosi888 Collections Arrays HashCode
Arrays、Collections 1 ）数组集合之间转换 public static <T> List<T> asList(T... a) { return new ArrayList<>(a); } a）Arrays.asL
Spring Security（10）——退出登录logout 234390216 logout Spring Security 退出登录 logout-url LogoutFilter
要实现退出登录的功能我们需要在http元素下定义logout元素，这样Spring Security将自动为我们添加用于处理退出登录的过滤器LogoutFilter到FilterChain。当我们指定了http元素的auto-config属性为true时logout定义是会自动配置的，此时我们默认退出登录的URL为“/j_spring_secu
透过源码学前端之 Backbone 三 Model 逐行分析JS源代码 backbone 源码分析 js学习
Backbone 分析第三部分 Model 概述： Model 提供了数据存储，将数据以JSON的形式保存在 Model的 attributes里，但重点功能在于其提供了一套功能强大，使用简单的存、取、删、改数据方法，并在不同的操作里加了相应的监听事件，如每次修改添加里都会触发 change，这在据模型变动来修改视图时很常用，并且与collection建立了关联。
SpringMVC源码总结（七）mvc:annotation-driven中的HttpMessageConverter 乒乓狂魔 springMVC
这一篇文章主要介绍下HttpMessageConverter整个注册过程包含自定义的HttpMessageConverter，然后对一些HttpMessageConverter进行具体介绍。 HttpMessageConverter接口介绍： public interface HttpMessageConverter<T> { /** * Indicate
分布式基础知识和算法理论 bluky999 算法 zookeeper 分布式一致性哈希 paxos
分布式基础知识和算法理论 BY [email protected] 本文永久链接：http://nodex.iteye.com/blog/2103218 在大数据的背景下，不管是做存储，做搜索，做数据分析，或者做产品或服务本身，面向互联网和移动互联网用户，已经不可避免地要面对分布式环境。笔者在此收录一些分布式相关的基础知识和算法理论介绍，在完善自我知识体系的同
Android Studio的.gitignore以及gitignore无效的解决 bell0901 android gitignore
　　github上.gitignore模板合集，里面有各种.gitignore ： https://github.com/github/gitignore 　　自己用的Android Studio下项目的.gitignore文件，对github上的android.gitignore添加了　　　　　　# OSX files　　　　　　//mac os下　　　　　　.DS_Store
成为高级程序员的10个步骤 tomcat_oracle 编程
What 软件工程师的职业生涯要历经以下几个阶段：初级、中级，最后才是高级。这篇文章主要是讲如何通过 10 个步骤助你成为一名高级软件工程师。 Why 得到更多的报酬！因为你的薪水会随着你水平的提高而增加提升你的职业生涯。成为了高级软件工程师之后，就可以朝着架构师、团队负责人、CTO 等职位前进历经更大的挑战。随着你的成长，各种影响力也会提高。
mongdb在linux下的安装 xtuhcy mongodb linux
一、查询linux版本号： lsb_release -a LSB Version: :base-4.0-amd64:base-4.0-noarch:core-4.0-amd64:core-4.0-noarch:graphics-4.0-amd64:graphics-4.0-noarch:printing-4.0-amd64:printing-4.0-noa