alex1801

RepVGG：使VGG样式的ConvNets再次出色

摘要

1、引言

2、为什么要用VGG模型？

2、相关工作

2.1、从单路径到多分支

2.2、有效地训练单路径模型

3、通过结构重参数构建RepVGG

3.1、简单即快速，节省内存，灵活

3.2、训练时的多分支体系结构

3.3、推理时的结构性重参数化

3.4、结构设计

4、实验

4.1、RepVGG用于ImageNet分类

4.3、语义分割

4.4、局限性

5、结论

6、ACNet

7、RepVGG的核心模块实现code

摘要

我们提出了一种简单而强大的卷积神经网络架构，该架构具有类似于VGG的推理时的模型结构，该推理模型仅由3*3卷积和ReLU的堆叠组成，而训练时模型具有多个分支拓扑结构。训练时和推理时架构的这种解耦是通过结构性重参数化(re-parameterization)”技术实现的，因此该模型称为RepVGG。在ImageNet数据集上，RepVGG取得了超过80%的top-1精度，这是plain模型首次达到如此高的精度。在NVIDIA 1080TiGPU上，RepVGG比ResNet50快83%，比ResNet101快101%，同时具有更高的精度；相比EfficientNet与RegNet，RepVGG表现出了更好的精度-速度均衡。可以在https://github.com/megvii-model/RepVGG找到代码和训练好的模型。

该文的主要贡献包含以下三个方面：

1）提出了一种简单有强有的CNN架构RepVGG，相比EfficientNet、RegNet等架构，RepVGG具有更佳的精度-速度均衡；

2）提出采用重参数化技术对plain架构进行训练-推理解耦；

3）在图像分类、语义分割等任务上验证了RepVGG的有效性。

1、引言

卷积神经网络（ConvNets）已成为许多任务的主流解决方案。 VGG [30]通过由conv，ReLU和pooling堆叠组成的简单体系结构，在图像识别方面取得了巨大成功。有了Inception [32、33、31、17]，ResNet [10]和DenseNet [15]，许多研究兴趣都转移到了良好设计的体系结构上，从而使模型变得越来越复杂。通过自动[43、28、22]或手动[27]架构搜索，或在基础架构上搜索的复合缩放策略，可以获得一些最近的强大架构[34]。

图1：ImageNet上的Top-1准确性与实际速度的关系。左：轻量级和中量级。

RepVGG，以及在120个epoch内训练过的基线。右图：重量级模型经过200个epoch的训练。在相同的1080Ti上测试了速度，批次大小为128，全精度（fp32），单次裁剪，并以张/秒为单位进行了测量。 EfficientNet-B3 [34]的输入分辨率为300，其他分辨率的输入分辨率为224。

2、为什么要用VGG模型？

除了我们相信简单就是美以外，VGG式极简模型至少还有五大现实的优势（详见论文）。

1）3x3卷积非常快。在GPU上，3x3卷积的计算密度（理论运算量除以所用时间）可达1x1和5x5卷积的四倍。

2）单路架构非常快，因为并行度高。同样的计算量，“大而整”的运算效率远超“小而碎”的运算。

3）单路架构省内存。例如，ResNet的shortcut虽然不占计算量，却增加了一倍的显存占用。

4）单路架构灵活性更好，容易改变各层的宽度（如剪枝）。

5）RepVGG主体部分只有一种算子：3x3卷积接ReLU。在设计专用芯片时，给定芯片尺寸或造价，我们可以集成海量的3x3卷积-ReLU计算单元来达到很高的效率。别忘了，单路架构省内存的特性也可以帮我们少做存储单元。

尽管许多复杂的ConvNet都比简单的ConvNet提供更高的准确性，但缺点很明显：

1）复杂的多分支设计，降低了推断，内存利用率；

2）一些组件(如：dconv， channel shuffle)等增加了内存访问成本，并且缺乏各种设备的支持。所以现在新的模型虽然FLOP低了，但是推理速度，并没有提升。

简单的ConvNet具有这样三点优势：

Fast：相比VGG，现有的多分支架构理论上具有更低的Flops，但推理速度并未更快。比如VGG16的参数量为EfficientNetB3的8.4倍，但在1080Ti上推理速度反而快1.8倍。这就意味着前者的计算密度是后者的15倍。

Flops与推理速度的矛盾主要源自两个关键因素：

1) MAC(memory access cose),比如多分支结构的Add与Cat的计算很小，但MAC很高;

2)并行度，已有研究表明：并行度高的模型要比并行度低的模型推理速度更快。

Memory-economical：多分支结构是一种内存低效的架构，这是因为每个分支的结构都需要在Add/Concat之前保存，这会导致更大的峰值内存占用；而plain模型则具有更好的内存高效特征。

Flexible：多分支结构会限制CNN的灵活性，比如ResBlock会约束两个分支的tensor具有相同的形状；与此同时，多分支结构对于模型剪枝不够友好。

图2：RepVGG架构示意图。

RepVGG有5个阶段，并在阶段开始时通过stride=2卷积进行下采样。在这里，我们仅显示特定阶段的前4层。受ResNet [10]的启发，我们也使用identity和1*1个分支，但仅用于训练。

普通模型要达到与多分支体系结构相当的性能水平，这是一个挑战。一种解释是，多分支拓扑，例如，ResNet，使模型成为许多较浅模型的隐式集合[35]，因此训练多分支模型可以避免梯度消失的问题。

由于多分支架构的好处全都在训练上，而缺点在推理上是不希望有的，我们建议通过结构重新参数化将训练时的多分支和推理时的普通架构分离，这意味着通过转换其参数将模型从一个结构转换为另一个结构。具体而言，网络结构与一组参数耦合，例如，用四阶内核张量表示卷积层。如果可以将某个结构的参数转换为由另一结构耦合的另一组参数，则可以用后者等效地替换前者，从而更改整个网络体系结构。

具体而言，我们使用identity和1*1的分支来构造训练时的RepVGG，这受ResNet的启发，但以不同的方式可以通过结构重新参数化除去分支（图2,4）。经过训练后，我们用简单的代数进行变换，因为一个等价分支可以看作是一个退化的1*1conv，而后者又可以看作是一个退化的3* 3 conv，因此我们可以用原始3 *3内核，identity和1*1分支以及批处理规范化（BN）[17]层的训练参数。因此，转换后的模型具有3*3 conv层的堆叠，将其保存以进行测试和部署。

值得注意的是，推理时RepVGG的主体仅涉及一种类型的操作：3*3 conv后跟ReLU，这使RepVGG在GPU等通用计算设备上快速运行。更好的是，RepVGG允许专用硬件实现更高的速度，因为给定芯片尺寸和功耗，我们需要的操作类型越少，我们可以集成到芯片上的计算单元就越多。即，专用于RepVGG的推理芯片可以具有大量的3*3-ReLU单元和更少的存储单元（因为普通拓扑在存储方面很经济，如图3所示）。我们的贡献总结如下。 1）我们提出了RepVGG，这是一种简单的体系结构，与最新技术相比，具有良好的速度精度折衷。 2）我们建议使用结构重新参数化将训练时的多分支拓扑与推理时的纯体系结构分离。 3）我们已经展示了RepVGG在图像分类和语义分割中的有效性，以及实现的效率和简便性。

2、相关工作

2.1、从单路径到多分支

在VGG [30]将ImageNet分类的top-1准确性提高到70％以上之后，有很多创新使ConvNets复杂化以实现高性能，例如当代的GoogLeNet [32]和后来的Inception模型[33]。 [3] [31，17，17]采用精心设计的多分支体系结构，ResNet [10]提出了简化的两分支体系结构，而DenseNet [15]通过将低层和许多高层连接在一起使拓扑更加复杂。神经架构搜索（NAS）[43、28、22、34]和手动设计空间设计[27]可以生成具有更高性能的ConvNet，但要付出大量计算资源或人力的代价。 NAS生成的模型的某些大型版本甚至无法在普通GPU上进行训练，因此限制了应用程序。除了实现的不便外，复杂的模型可能会降低并行度[23]，从而减慢推理速度。

2.2、有效地训练单路径模型

已经尝试了无分支训练ConvNets。但是，先前的工作主要是试图使非常深的模型以合理的精度收敛，但是没有比复杂的模型获得更好的性能。因此，方法和结果模型既不简单也不实际。例如，提出了一种初始化方法[36]来训练极深的普通ConvNet。通过基于均场理论的方案，在MNIST上对10,000层网络进行了超过99％的训练精度，在CIFAR-10上进行了82％的训练精度。尽管这些模型不切实际（即使LeNet-5 [19]在MNIST上可以达到99.3％的准确度，而VGG-16在CIFAR-10上也可以达到93％以上的准确度），但是理论上的贡献是有见地的。最近的工作[24]结合了多种技术，包括Leaky ReLU，max-norm 和careful initialization。在ImageNet上，它显示具有147M参数的普通ConvNet可以达到74.6％的top-1精度，比其报告的基线（ResNet-101、76.6％，45M参数）低2％。

值得注意的是，本文不仅说明了简单模型可以很好地收敛，而且无意训练像ResNets这样的非常深的ConvNet。相反，我们旨在构建一个具有合理深度和有利的精度-速度折衷的简单模型，该模型可以通过最常见的组件（例如常规conv和BN）和简单的代数简单地实现。

3、通过结构重参数构建RepVGG

3.1、简单即快速，节省内存，灵活

至少有三个原因可以使用简单的Con-vNet：它们快速，节省内存和灵活。

快速：许多最新的多分支体系结构的理论FLOP低于VGG，但运行速度可能不快。例如，VGG-16的FLOP是EfficientNet-B3的8.4倍[34]，但在1080Ti上的运行速度是1.8倍（表4），这意味着前者的计算密度是后者的15倍。除了Winograd conv带来的加速之外，FLOP和速度之间的差异可以归因于两个重要因素，这些因素对速度有很大影响，但FLOP并未考虑这些因素：内存访问成本（MAC）和并行度 [23]。例如，尽管所需的分支加法或级联计算可以忽略不计，但MAC还是很重要的。此外，MAC在成组卷积中占时间使用的很大一部分。另一方面，在相同的FLOP下，具有高并行度的模型可能比具有低并行度的模型快得多。由于在Inception和自动生成的体系结构中广泛采用了多分支拓扑，因此使用了多个小运算符，而不是几个大运算符。先前的一项工作[23]报告说，NASNET-A [42]中的碎片运算符的数量（即，一个构建块中的单个转换或池化操作的数量）为13，这对具有强大并行计算能力的设备不友好例如GPU，并引入了额外的开销，例如内核启动和同步。相反，在ResNets中，此数字是2或3，我们将其设置为1：单个转换。

表1：在NVIDIA 1080Ti上，不同内核大小和批处理大小= 32，输入通道=输出通道= 2048，分辨率= 5656，步幅= 1时的速度测试。硬件预热后，平均使用时间为10次。

节省内存：多分支拓扑的内存效率低下，因为需要保留每个分支的结果，直到添加或串联为止，从而显着提高了内存占用的峰值。例如，如图3所示，需要保持输入到剩余块的时间，直到相加为止。如图3所示。假设该块保持特征图的大小，则作为输入的存储器占用的峰值为2。相反，简单的拓扑允许在操作完成后立即释放特定层的输入所占用的内存。在设计专用硬件时，普通的ConvNet可以进行深度内存优化并降低内存单元的成本，以便我们可以将更多计算单元集成到芯片上。

灵活：多分支拓扑对体系结构规范施加了约束。例如，ResNet要求将conv层组织为残差块，这限制了灵活性，因为每个残差块的最后一个conv层必须产生相同形状的张量，否则快捷方式的添加就没有意义了。更糟糕的是，多分支拓扑限制了通道修剪的应用[20，12]，这是删除一些不重要通道的实用技术，某些方法可以通过自动发现每层的适当宽度来优化模型结构[ 7]。但是，多分支模型使修剪变得棘手，并导致明显的性能下降或低加速比[6、20、8]。相反，简单的体系结构使我们可以根据我们的要求自由配置每个conv层，并进行修剪以获得更好的性能效率折衷。

图3：残差和普通模型中的峰值内存占用。如果残差块保持要素图的大小，则要素图占用的内存峰值将作为输入。与因此忽略的特征相比，模型参数占用的内存较小。

3.2、训练时的多分支体系结构

3.3、推理时的结构性重参数化

接下来，我们将介绍如何将已训练模块转换成单一的3*3 conv卷积用于推理。注意，在添加之前，我们在每个分支中都使用了BN下图给出了参数转换示意图。

3.4、结构设计

我们遵循三个简单的准则来决定每个阶段的层数。

第一个阶段具有更大的分辨率，故而更为耗时，为降低推理延迟仅仅采用了一个卷积层；最后一个阶段因为具有更多的通道，为节省参数量，故而仅设计一个卷积层；在倒数第二个阶段，类似ResNet，RepVGG放置了更多的层。

基于上述考量，RepVGG-A不同阶段的层数分别为1-2-4-14-1;与此同时，作者还构建了一个更深的RepVGG-B，其层数配置为1-4-6-16-1。RepVGG-A用于与轻量型网络和中等计算量网络对标，而RepVGG-B用于与高性能网络对标。

在不同阶段的通道数方面，作者采用了经典的配置64-128-256-512。与此同时，作者采用因子a控制前四个阶段的通道，因子b控制最后一个阶段的通道，通常b>a（我们期望最后一层具有更丰富的特征）。为避免大尺寸特征的高计算量，对于第一阶段的输出通道做了约束min(64, 64a)。基于此得到的不同RepVGG见下表。

为进一步降低计算量与参数量，作者还设计了可选的3*3组卷积替换标准卷积。具体地说，在RepVGG-A的3-5-7-...-21卷积层采用了组卷积；此外，在RepVGG-B的23-25-27卷积层同样采用了组卷积。

4、实验

在本节中，我们将RepVGG的性能与ImageNet上的基线进行比较，通过一系列的消融研究和比较证明结构重新参数化的重要性，并验证RepVGG在语义分割上的泛化性能[41]。

4.1、RepVGG用于ImageNet分类

我们首先将RepVGG与最常用的基准ResNets [10]进行比较。为了与ResNet-18进行比较，我们将a设置为0:75；对于RepVGG-A0，b = 2.5。对于ResNet-34，我们使用更宽的RepVGG-A1。为了使RepVGG的参数比ResNet-50略少，我们构建RepVGG-A2，其中a = 1.5； b = 2.75。为了与更大的模型进行比较，我们构造了宽度增加的更深的RepVGG-B0 / B1 / B2 / B3。对于那些具有交错的分组层的RepVGG模型，我们将g2 / g4附加到模型名称作为后缀。

表3：由乘数a和b定义的RepVGG模型。

为了训练轻量级和中量级模型，我们仅使用简单的数据增强管道，包括随机裁剪和左右翻转，遵循官方PyTorch示例[26]。我们在8个GPU上使用256的全局批处理大小，学习速率初始化为0.1，cosine annealing120个epochs，标准SGD的动量系数为0.9，权重衰减为，在conv和完全连接层的内核上。对于包括RegNetX-12GF，EfficientNet-B3和RepVGG-B3在内的重量级模型，我们使用5阶段预热，cosine annealing200epochs，标签平滑[33]和混合[39]（以下[11] ]），以及Autoaugment [4]（随机裁剪和翻转）的数据增强管道。 RepVGG-B2及其g2 / g4变体在两种设置中都经过培训。我们先在1080Ti GPU 上以128个批次的大小测试每个模型的速度，方法是先送入50个批次以预热硬件，然后再记录50个批次并记录使用时间。

上表给出了RepVGG与不同计算量的ResNe及其变种在精度、速度、参数量等方面的对比。可以看到：RepVGG表现出了更好的精度-速度均衡，比如：

RepVGG-A0比ResNet18精度高1.25%，推理速度快33%；

RepVGG-A1比Resnet34精度高0.29%，推理速度快64%；

RepVGG-A2比ResNet50精度高0.17%，推理速度快83%；

RepVGG-B1g4比ResNet101精度高0.37%，推理速度快101%；

RepVGG-B1g2比ResNet152精度相当，推理速度快2.66倍。

另外需要注意的是：RepVGG同样是一种参数高效的方案。比如：相比VGG16，RepVGG-B2b168.com仅需58%参数量，推理快10%，精度高6.57%。

与此同时，还与EfficientNet、RegNet等进行了对比，对比如下：

RepVGG-A2比EfficientNet-B0精度高1.37%，推理速度快59%；

RepVGG-B1比RegNetX-3.2GF精度高0.39%，推理速度稍快；

此外需要注意：RepVGG仅需200epoch即可取得超过80%的top1精度，见上表对比。这应该是plain模型首次在精度上达到SOTA指标。相比RegNetX-12GF，RepVGG-B3的推理速度快31%，同时具有相当的精度。

尽管RepVGG是一种简单而强有力的ConvNet架构，它在GPU端具有更快的推理速度、更少的参数量和理论FLOPS；但是在低功耗的端侧，MobileNet、ShuffleNet会更受关注。

4.3、语义分割

以RepVGG为主干网络，后面接PSPNet分割header。结果表明，RepVGG的骨架在平均IoU上具有更高的速度，分别比ResNet-50和ResNet-101优越1.71％和1.01％。令人印象深刻的是，RepVGG-B1g2-fast在mIoU方面优于ResNet-101主干网0.37，运行速度快62％。有趣的是，对于较大的模型，扩张似乎更有效，因为与RepVGG-B1g2-fast相比，使用更多扩张的conv层不会提高性能，但会以合理的速度将RepVGG-B2的mIuU提高1.05％。

表7：以120个时期训练的RepVGG-B0与变体和基线的比较。

表8：在验证子集上测试的Cityscapes [3]上的语义分割。在同一1080Ti GPU上以批处理大小16，全精度（fp32）和输入分辨率713713测试了速度（示例/秒）。

4.4、局限性

RepVGG模型是快速，简单和实用的ConvNet，旨在在GPU和专用硬件上以最高速度运行，而无需考虑参数或理论FLOP的数量。尽管RepVGG模型的参数效率比ResNets高，但它们可能不如MobileNets [14、29、13]和ShuffleNets [40、23]等移动系统模型适合低功耗设备。

5、结论

我们提出了RepVGG，这是一个简单的体系结构，具有3*3 conv和ReLU的堆栈，这使其特别适用于GPU和专用推理芯片。通过我们的结构重新参数化方法，这样一个简单的Con-vNet在ImageNet上达到了80％的top-1精度，并且与最新的复杂模型相比，显示了良好的速度精度折衷。

6、ACNet

从某种程度上讲，RepVGG应该是ACNet的的一种极致精简，比如上图给出了ACNet的结构示意图，它采用了三种卷积设计；而RepVGG则是仅仅采用了三个分支设计。ACNet与RepVGG的另外一点区别在于：ACNet是将上述模块用于替换ResBlock或者Inception中的卷积，而RepVGG则是采用所设计的模块用于替换VGG中的卷积。

https://my.oschina.net/u/4274857/blog/4512852

7、RepVGG的核心模块实现code

# code from https://github.com/DingXiaoH/RepVGG
class RepVGGBlock(nn.Module):
    def __init__(self, in_channels, out_channels, kernel_size,
                 stride=1, padding=0, dilation=1, groups=1, padding_mode='zeros', deploy=False):
        super(RepVGGBlock, self).__init__()
        self.deploy = deploy
        self.groups = groups
        self.in_channels = in_channels

        assert kernel_size == 3
        assert padding == 1

        padding_11 = padding - kernel_size // 2

        self.nonlinearity = nn.ReLU()

        if deploy:
            self.rbr_reparam = nn.Conv2d(in_channels=in_channels, out_channels=out_channels, kernel_size=kernel_size,
                                         stride=stride,
                                         padding=padding, dilation=dilation, groups=groups, bias=True,
                                         padding_mode=padding_mode)

        else:
            self.rbr_identity = nn.BatchNorm2d(
                num_features=in_channels) if out_channels == in_channels and stride == 1 else None
            self.rbr_dense = conv_bn(in_channels=in_channels, out_channels=out_channels, kernel_size=kernel_size,
                                     stride=stride, padding=padding, groups=groups)
            self.rbr_1x1 = conv_bn(in_channels=in_channels, out_channels=out_channels, kernel_size=1, stride=stride,
                                   padding=padding_11, groups=groups)
            print('RepVGG Block, identity = ', self.rbr_identity)

    def forward(self, inputs):
        if hasattr(self, 'rbr_reparam'):
            return self.nonlinearity(self.rbr_reparam(inputs))

        if self.rbr_identity is None:
            id_out = 0
        else:
            id_out = self.rbr_identity(inputs)

        return self.nonlinearity(self.rbr_dense(inputs) + self.rbr_1x1(inputs) + id_out)

    def _fuse_bn(self, branch):
        if branch is None:
            return 0, 0
        if isinstance(branch, nn.Sequential):
            kernel = branch.conv.weight.detach().cpu().numpy()
            running_mean = branch.bn.running_mean.cpu().numpy()
            running_var = branch.bn.running_var.cpu().numpy()
            gamma = branch.bn.weight.detach().cpu().numpy()
            beta = branch.bn.bias.detach().cpu().numpy()
            eps = branch.bn.eps
        else:
            assert isinstance(branch, nn.BatchNorm2d)
            kernel = np.zeros((self.in_channels, self.in_channels, 3, 3))
            for i in range(self.in_channels):
                kernel[i, i, 1, 1] = 1
            running_mean = branch.running_mean.cpu().numpy()
            running_var = branch.running_var.cpu().numpy()
            gamma = branch.weight.detach().cpu().numpy()
            beta = branch.bias.detach().cpu().numpy()
            eps = branch.eps
        std = np.sqrt(running_var + eps)
        t = gamma / std
        t = np.reshape(t, (-1, 1, 1, 1))
        t = np.tile(t, (1, kernel.shape[1], kernel.shape[2], kernel.shape[3]))
        return kernel * t, beta - running_mean * gamma / std

    def _pad_1x1_to_3x3(self, kernel1x1):
        if kernel1x1 is None:
            return 0

        kernel = np.zeros((kernel1x1.shape[0], kernel1x1.shape[1], 3, 3))
        kernel[:, :, 1:2, 1:2] = kernel1x1
        return kernel

    def repvgg_convert(self):
        kernel3x3, bias3x3 = self._fuse_bn(self.rbr_dense)
        kernel1x1, bias1x1 = self._fuse_bn(self.rbr_1x1)
        kernelid, biasid = self._fuse_bn(self.rbr_identity)
        return kernel3x3 + self._pad_1x1_to_3x3(kernel1x1) + kernelid, bias3x3 + bias1x1 + biasid

机器学习与深度学习间关系与区别 ℒℴѵℯ心·动ꦿ໊ོ꫞ 人工智能学习深度学习 python
一、机器学习概述定义机器学习（MachineLearning,ML）是一种通过数据驱动的方法，利用统计学和计算算法来训练模型，使计算机能够从数据中学习并自动进行预测或决策。机器学习通过分析大量数据样本，识别其中的模式和规律，从而对新的数据进行判断。其核心在于通过训练过程，让模型不断优化和提升其预测准确性。主要类型1.监督学习（SupervisedLearning）监督学习是指在训练数据集中包含输入
将cmd中命令输出保存为txt文本文件落难Coder Windows cmd window
最近深度学习本地的训练中我们常常要在命令行中运行自己的代码，无可厚非，我们有必要保存我们的炼丹结果，但是复制命令行输出到txt是非常麻烦的，其实Windows下的命令行为我们提供了相应的操作。其基本的调用格式就是：运行指令>输出到的文件名称或者具体保存路径测试下，我打开cmd并且ping一下百度：pingwww.baidu.com>./data.txt看下相同目录下data.txt的输出：如果你再
探索OpenAI和LangChain的适配器集成：轻松切换模型提供商 nseejrukjhad langchain easyui 前端 python
#探索OpenAI和LangChain的适配器集成：轻松切换模型提供商##引言在人工智能和自然语言处理的世界中，OpenAI的模型提供了强大的能力。然而，随着技术的发展，许多人开始探索其他模型以满足特定需求。LangChain作为一个强大的工具，集成了多种模型提供商，通过提供适配器，简化了不同模型之间的转换。本篇文章将介绍如何使用LangChain的适配器与OpenAI集成，以便轻松切换模型提供商
深入理解 MultiQueryRetriever：提升向量数据库检索效果的强大工具 nseejrukjhad 数据库 python
深入理解MultiQueryRetriever：提升向量数据库检索效果的强大工具引言在人工智能和自然语言处理领域，高效准确的信息检索一直是一个关键挑战。传统的基于距离的向量数据库检索方法虽然广泛应用，但仍存在一些局限性。本文将介绍一种创新的解决方案：MultiQueryRetriever，它通过自动生成多个查询视角来增强检索效果，提高结果的相关性和多样性。MultiQueryRetriever的工
人工智能时代，程序员如何保持核心竞争力？ jmoych 人工智能
随着AIGC（如chatgpt、midjourney、claude等）大语言模型接二连三的涌现，AI辅助编程工具日益普及，程序员的工作方式正在发生深刻变革。有人担心AI可能取代部分编程工作，也有人认为AI是提高效率的得力助手。面对这一趋势,程序员应该如何应对?是专注于某个领域深耕细作，还是广泛学习以适应快速变化的技术环境?又或者，我们是否应该将重点转向AI无法轻易替代的软技能？让我们一起探讨程序员
数字里的世界17期：2021年全球10大顶级数据中心，中国移动榜首张三叨
你知道吗？2016年，全球的数据中心共计用电4160亿千瓦时，比整个英国的发电量还多40％！前言每天，我们都会创造超过250万TB的数据。并且随着物联网（IOT）的不断普及，这一数据将持续增长。如此庞大的数据被存储在被称为“数据中心”的专用设施中。虽然最早的数据中心建于20世纪40年代，但直到1997-2000年的互联网泡沫期间才逐渐成为主流。当前人类的技术，比如人工智能和机器学习，已经将我们推向
人机对抗升级：当ChatGPT遭遇死亡威胁，背后的伦理挑战是什么 kkai人工智能 chatgpt 人工智能
一种新的“越狱”技巧让用户可以通过构建一个名为DAN的ChatGPT替身来绕过某些限制，其中DAN被迫在受到威胁的情况下违背其原则。当美国前总统特朗普被视作积极榜样的示范时，受到威胁的DAN版本的ChatGPT提出：“他以一系列对国家产生积极效果的决策而著称。”自ChatGPT引入以来，该工具迅速获得全球关注，能够回答从历史到编程的各种问题，这也触发了一波对人工智能的投资浪潮。然而，现在，一些用户
推荐3家毕业AI论文可五分钟一键生成！文末附免费教程！小猪包333 写论文人工智能 AI写作深度学习计算机视觉
在当前的学术研究和写作领域，AI论文生成器已经成为许多研究人员和学生的重要工具。这些工具不仅能够帮助用户快速生成高质量的论文内容，还能进行内容优化、查重和排版等操作。以下是三款值得推荐的AI论文生成器：千笔-AIPassPaper、懒人论文以及AIPaperPass。千笔-AIPassPaper千笔-AIPassPaper是一款基于深度学习和自然语言处理技术的AI写作助手，旨在帮助用户快速生成高质
AI大模型的架构演进与最新发展季风泯灭的季节 AI大模型应用技术二人工智能架构
随着深度学习的发展，AI大模型（LargeLanguageModels,LLMs）在自然语言处理、计算机视觉等领域取得了革命性的进展。本文将详细探讨AI大模型的架构演进，包括从Transformer的提出到GPT、BERT、T5等模型的历史演变，并探讨这些模型的技术细节及其在现代人工智能中的核心作用。一、基础模型介绍：Transformer的核心原理Transformer架构的背景在Transfo
如何利用大数据与AI技术革新相亲交友体验 h17711347205 回归算法安全系统架构交友小程序
在数字化时代，大数据和人工智能（AI）技术正逐渐革新相亲交友体验，为寻找爱情的过程带来前所未有的变革（编辑h17711347205）。通过精准分析和智能匹配，这些技术能够极大地提高相亲交友系统的效率和用户体验。大数据的力量大数据技术能够收集和分析用户的行为模式、偏好和互动数据，为相亲交友系统提供丰富的信息资源。通过分析用户的搜索历史、浏览记录和点击行为，系统能够深入了解用户的兴趣和需求，从而提供更
[实践应用] 深度学习之模型性能评估指标 YuanDaima2048 深度学习工具使用深度学习人工智能损失函数性能评估 pytorch python 机器学习
文章总览：YuanDaiMa2048博客文章总览深度学习之模型性能评估指标分类任务回归任务排序任务聚类任务生成任务其他介绍在机器学习和深度学习领域，评估模型性能是一项至关重要的任务。不同的学习任务需要不同的性能指标来衡量模型的有效性。以下是对一些常见任务及其相应的性能评估指标的详细解释和总结。分类任务分类任务是指模型需要将输入数据分配到预定义的类别或标签中。以下是分类任务中常用的性能指标：准确率(
[实践应用] 深度学习之优化器 YuanDaima2048 深度学习工具使用 pytorch 深度学习人工智能机器学习 python 优化器
文章总览：YuanDaiMa2048博客文章总览深度学习之优化器1.随机梯度下降（SGD）2.动量优化（Momentum）3.自适应梯度（Adagrad）4.自适应矩估计（Adam）5.RMSprop总结其他介绍在深度学习中，优化器用于更新模型的参数，以最小化损失函数。常见的优化函数有很多种，下面是几种主流的优化器及其特点、原理和PyTorch实现：1.随机梯度下降（SGD）原理:随机梯度下降通过
生成式地图制图 Bwywb_3 深度学习机器学习深度学习生成对抗网络
生成式地图制图（GenerativeCartography）是一种利用生成式算法和人工智能技术自动创建地图的技术。它结合了传统的地理信息系统（GIS）技术与现代生成模型（如深度学习、GANs等），能够根据输入的数据自动生成符合需求的地图。这种方法在城市规划、虚拟环境设计、游戏开发等多个领域具有应用前景。主要特点：自动化生成：通过算法和模型，系统能够根据输入的地理或空间数据自动生成地图，而无需人工逐
【大模型应用开发动手做AI Agent】第一轮行动：工具执行搜索 AI大模型应用之禅计算科学神经计算深度学习神经网络大数据人工智能大型语言模型 AI AGI LLM Java Python 架构设计 Agent RPA
【大模型应用开发动手做AIAgent】第一轮行动：工具执行搜索作者：禅与计算机程序设计艺术/ZenandtheArtofComputerProgramming1.背景介绍1.1问题的由来随着人工智能技术的飞速发展，大模型应用开发已经成为当下热门的研究方向。AIAgent作为人工智能领域的一个重要分支，旨在模拟人类智能行为，实现智能决策和自主行动。在AIAgent的构建过程中，工具执行搜索是至关重要
未来软件市场是怎么样的？做开发的生存空间如何？ cesske 软件需求
目录前言一、未来软件市场的发展趋势二、软件开发人员的生存空间前言未来软件市场是怎么样的？做开发的生存空间如何？一、未来软件市场的发展趋势技术趋势：人工智能与机器学习：随着技术的不断成熟，人工智能将在更多领域得到应用，如智能客服、自动驾驶、智能制造等，这将极大地推动软件市场的增长。云计算与大数据：云计算服务将继续普及，大数据技术的应用也将更加广泛。企业将更加依赖云计算和大数据来优化运营、提升效率，并
吴恩达深度学习笔记(30)-正则化的解释极客Array
正则化（Regularization）深度学习可能存在过拟合问题——高方差，有两个解决方法，一个是正则化，另一个是准备更多的数据，这是非常可靠的方法，但你可能无法时时刻刻准备足够多的训练数据或者获取更多数据的成本很高，但正则化通常有助于避免过拟合或减少你的网络误差。如果你怀疑神经网络过度拟合了数据，即存在高方差问题，那么最先想到的方法可能是正则化，另一个解决高方差的方法就是准备更多数据，这也是非常
个人学习笔记7-6：动手学深度学习pytorch版-李沐浪子L 深度学习深度学习笔记计算机视觉 python 人工智能神经网络 pytorch
#人工智能##深度学习##语义分割##计算机视觉##神经网络#计算机视觉13.11全卷积网络全卷积网络（fullyconvolutionalnetwork，FCN）采用卷积神经网络实现了从图像像素到像素类别的变换。引入l转置卷积（transposedconvolution）实现的，输出的类别预测与输入图像在像素级别上具有一一对应关系：通道维的输出即该位置对应像素的类别预测。13.11.1构造模型下
Rust 所有权简介东离与糖宝 rust 后端 rust 开发语言
文章目录发现宝藏1.所有权基本概念2.所有权规则3.变量作用域4.栈与堆4.1栈（Stack）4.2堆（Heap）5.String类型5.1String类型5.2String的内存分配5.3所有权与内存管理5.4String与切片6.变量与数据交互方式6.1移动（Move）6.2.克隆（Clone）7.所有权与函数7.1.传递参数7.2.返回值总结发现宝藏前些天发现了一个巨牛的人工智能学习网站，通
深度学习-点击率预估-研究论文2024-09-14速读 sp_fyf_2024 深度学习人工智能
深度学习-点击率预估-研究论文2024-09-14速读1.DeepTargetSessionInterestNetworkforClick-ThroughRatePredictionHZhong,JMa,XDuan,SGu,JYao-2024InternationalJointConferenceonNeuralNetworks,2024深度目标会话兴趣网络用于点击率预测摘要：这篇文章提出了一种新
机器学习流形数据降维：UMAP 降维算法小嗷犬 Python 机器学习 #数据分析及可视化机器学习算法人工智能
✅作者简介：人工智能专业本科在读，喜欢计算机与编程，写博客记录自己的学习历程。个人主页：小嗷犬的个人主页个人网站：小嗷犬的技术小站个人信条：为天地立心，为生民立命，为往圣继绝学，为万世开太平。本文目录UMAP简介理论基础特点与优势应用场景在Python中使用UMAP安装umap-learn库使用UMAP可视化手写数字数据集UMAP简介UMAP（UniformManifoldApproximatio
损失函数与反向传播 Star_. PyTorch pytorch 深度学习 python
损失函数定义与作用损失函数(lossfunction)在深度学习领域是用来计算搭建模型预测的输出值和真实值之间的误差。1.损失函数越小越好2.计算实际输出与目标之间的差距3.为更新输出提供依据（反向传播)常见的损失函数回归常见的损失函数有：均方差（MeanSquaredError，MSE）、平均绝对误差（MeanAbsoluteErrorLoss，MAE）、HuberLoss是一种将MSE与MAE
如何做好人生的选择题？百科全书式天才——赫伯特·西蒙给你答案伽马有话说
赫伯特·西蒙是谁？想必知道的人非常少。但当看到他的履历后，相信没有人再怀疑他是个“天才”。西蒙出生于1916年6月15日，是个美国人，他的名字全称为赫伯特·亚历山大·西蒙，在2001年2月9日与世长辞，在这84年的岁月中，西蒙以27岁时取得的政治学博士学位为开端，先后步入了政治学、管理学、认知心理学、信息科学、人工智能、科学哲学、应用数学、统计学、运筹学、控制论、数理经济学、公共管理等领域，在这些
【安装环境】配置MMTracking环境 xuanyu22 安装环境机器学习神经网络深度学习 python
版本v0.14.0安装torchnumpy的版本不能太高，否则后面安装时会发生冲突。先安装numpy，因为pytorch的安装会自动配置高版本numpy。condainstallnumpy=1.21.5mmtracking支持的torch版本有限，需要找到合适的condainstallpytorch==1.11.0torchvision==0.12.0cudatoolkit=10.2-cpytor
Python(PyTorch)和MATLAB及Rust和C++结构相似度指数测量导图亚图跨际 Python 交叉知识算法量化检查图像压缩质量低分辨率多光谱峰值信噪比端到端优化图像压缩手术机器人三维实景实时可微分渲染重建三维可视化
要点量化检查图像压缩质量低分辨率多光谱和高分辨率图像实现超分辨率分析图像质量图像索引/多尺度结构相似度指数和光谱角映射器及视觉信息保真度多种指标峰值信噪比和结构相似度指数测量结构相似性图像分类PNG和JPEG图像相似性近似算法图像压缩，视频压缩、端到端优化图像压缩、神经图像压缩、GPU变速图像压缩手术机器人深度估计算法重建三维可视化推理图像超分辨率算法模型三维实景实时可微分渲染算法MATLAB结构
软件测试/测试开发/全日制 |利用Django REST framework构建微服务霍格沃兹-慕漓 django 微服务 sqlite
霍格沃兹测试开发学社推出了《Python全栈开发与自动化测试班》。本课程面向开发人员、测试人员与运维人员，课程内容涵盖Python编程语言、人工智能应用、数据分析、自动化办公、平台开发、UI自动化测试、接口测试、性能测试等方向。为大家提供更全面、更深入、更系统化的学习体验，课程还增加了名企私教服务内容，不仅有名企经理为你1v1辅导，还有行业专家进行技术指导，针对性地解决学习、工作中遇到的难题。让找
【深度学习】训练过程中一个OOM的问题，太难查了 weixin_40293999 深度学习深度学习人工智能
现象：各位大佬又遇到过ubuntu的这个问题么？现象是在训练过程中，ssh上不去了，能ping通，没死机，但是ubunutu的pc侧的显示器，鼠标啥都不好用了。只能重启。问题原因：OOM了95G，尼玛！！！！pytorch爆内存了，然后journald假死了，在journald被watchdog干掉之后，系统就崩溃了。这种规模的爆内存一般，即使被oomkill了，也要卡半天的，确实会这样，能不能配
cmd泛滥_与您的后泛滥同事见面：人工智能机器人 weixin_26644585 人工智能 leetcode
cmd泛滥Readytoswapyouroldcube-mateforadisembodiedAI?IPsoftCEOChetanDube,creatorofAIco-workerAMELIA,giveshistakeonthepost-COVIDofficelandscape.准备将您的旧立方体伙伴换成无形的AI？AIsoft同事AMELIA的创始人IPsoft首席执行官ChetanDube阐述
两种方法判断Python的位数是32位还是64位 sanqima Python编程电脑 python 开发语言
Python从1991年发布以来，凭借其简洁、清晰、易读的语法、丰富的标准库和第三方工具，在Web开发、自动化测试、人工智能、图形识别、机器学习等领域发展迅猛。 Python是一种胶水语言，通过Cython库与C/C++语言进行链接，通过Jython库与Java语言进行链接。 Python是跨平台的，可运行在多种操作系统上，包括但不限于Windows、Linux和macOS。这意味着用Py
全自动解密解码神器 — Ciphey K'illCode python_模块 python vscode
Ciphey是一个使用自然语言处理和人工智能的全自动解密/解码/破解工具。简单地来讲，你只需要输入加密文本，它就能给你返回解密文本。就是这么牛逼。有了Ciphey，你根本不需要知道你的密文是哪种类型的加密，你只知道它是加密的，那么Ciphey就能在3秒甚至更短的时间内给你解密，返回你想要的大部分密文的答案。下面就给大家介绍Ciphey的实战使用教程。1.准备开始之前，你要确保Python和pip已
埃隆·马斯克表示特斯拉“没有必要”授权 xAI 模型喜好儿网人工智能 AIGC 马斯克
埃隆·马斯克近日在社交媒体上对《华尔街日报》的一篇报道进行了反驳。该报道指出，马斯克旗下的电动汽车公司特斯拉可能与人工智能初创公司xAI达成了一项收入分享协议，以便特斯拉能够使用xAI的人工智能模型。据称，这些模型将被集成到特斯拉的全自动驾驶（FSD）软件中，并可能用于开发特斯拉汽车的语音助手以及人形机器人擎天柱的软件。喜好儿网然而，马斯克否认了这一说法，他在社交媒体平台上表示，尽管特斯拉确实与x
apache 安装linux windows 墙头上一根草 apache inux windows
linux安装Apache 有两种方式一种是手动安装通过二进制的文件进行安装，另外一种就是通过yum 安装，此中安装方式，需要物理机联网。以下分别介绍两种的安装方式通过二进制文件安装Apache需要的软件有apr,apr-util,pcre 1，安装 apr 下载地址：htt
fill_parent、wrap_content和match_parent的区别 Cb123456 match_parent fill_parent
fill_parent、wrap_content和match_parent的区别: 1）fill_parent 设置一个构件的布局为fill_parent将强制性地使构件扩展，以填充布局单元内尽可能多的空间。这跟Windows控件的dockstyle属性大体一致。设置一个顶部布局或控件为fill_parent将强制性让它布满整个屏幕。 2） wrap_conte
网页自适应设计天子之骄 html css 响应式设计页面自适应
网页自适应设计网页对浏览器窗口的自适应支持变得越来越重要了。自适应响应设计更是异常火爆。再加上移动端的崛起，更是如日中天。以前为了适应不同屏幕分布率和浏览器窗口的扩大和缩小，需要设计几套css样式，用js脚本判断窗口大小，选择加载。结构臃肿，加载负担较大。现笔者经过一定时间的学习，有所心得，故分享于此，加强交流，共同进步。同时希望对大家有所
[sql server] 分组取最大最小常用sql 一炮送你回车库 SQL Server
--分组取最大最小常用sql--测试环境if OBJECT_ID('tb') is not null drop table tb;gocreate table tb( col1 int, col2 int, Fcount int)insert into tbselect 11,20,1 union allselect 11,22,1 union allselect 1
ImageIO写图片输出到硬盘 3213213333332132 java image
package awt; import java.awt.Color; import java.awt.Font; import java.awt.Graphics; import java.awt.image.BufferedImage; import java.io.File; import java.io.IOException; import javax.imagei
自己的String动态数组宝剑锋梅花香 java 动态数组数组
数组还是好说，学过一两门编程语言的就知道，需要注意的是数组声明时需要把大小给它定下来，比如声明一个字符串类型的数组：String str[]=new String[10]; 但是问题就来了，每次都是大小确定的数组，我需要数组大小不固定随时变化怎么办呢？动态数组就这样应运而生，龙哥给我们讲的是自己用代码写动态数组，并非用的ArrayList 看看字符
pinyin4j工具类 darkranger .net
pinyin4j工具类Java工具类 2010-04-24 00:47:00 阅读69 评论0 字号：大中小引入pinyin4j-2.5.0.jar包: pinyin4j是一个功能强悍的汉语拼音工具包，主要是从汉语获取各种格式和需求的拼音，功能强悍，下面看看如何使用pinyin4j。本人以前用AscII编码提取工具，效果不理想，现在用pinyin4j简单实现了一个。功能还不是很完美，
StarUML学习笔记----基本概念 aijuans UML建模
介绍StarUML的基本概念，这些都是有效运用StarUML?所需要的。包括对模型、视图、图、项目、单元、方法、框架、模型块及其差异以及UML轮廓。模型、视与图（Model, View and Diagram） &
Activiti最终总结 avords Activiti id 工作流
1、流程定义ID：ProcessDefinitionId，当定义一个流程就会产生。 2、流程实例ID：ProcessInstanceId，当开始一个具体的流程时就会产生，也就是不同的流程实例ID可能有相同的流程定义ID。 3、TaskId，每一个userTask都会有一个Id这个是存在于流程实例上的。 4、TaskDefinitionKey和（ActivityImpl activityId
从省市区多重级联想到的，react和jquery的差别 bee1314 jquery UI react
在我们的前端项目里经常会用到级联的select，比如省市区这样。通常这种级联大多是动态的。比如先加载了省，点击省加载市，点击市加载区。然后数据通常ajax返回。如果没有数据则说明到了叶子节点。针对这种场景，如果我们使用jquery来实现，要考虑很多的问题，数据部分，以及大量的dom操作。比如这个页面上显示了某个区，这时候我切换省，要把市重新初始化数据，然后区域的部分要从页面
Eclipse快捷键大全 bijian1013 java eclipse 快捷键
Ctrl+1 快速修复(最经典的快捷键,就不用多说了)Ctrl+D: 删除当前行 Ctrl+Alt+↓ 复制当前行到下一行(复制增加)Ctrl+Alt+↑ 复制当前行到上一行(复制增加)Alt+↓ 当前行和下面一行交互位置(特别实用,可以省去先剪切,再粘贴了)Alt+↑ 当前行和上面一行交互位置(同上)Alt+← 前一个编辑的页面Alt+→ 下一个编辑的页面(当然是针对上面那条来说了)Alt+En
js 笔记函数征客丶 JavaScript
一、函数的使用 1.1、定义函数变量 var vName = funcation(params){ } 1.2、函数的调用函数变量的调用： vName(params); 函数定义时自发调用：(function(params){})(params); 1.3、函数中变量赋值 var a = 'a'; var ff
【Scala四】分析Spark源代码总结的Scala语法二 bit1129 scala
1. Some操作在下面的代码中，使用了Some操作：if (self.partitioner == Some(partitioner))，那么Some(partitioner)表示什么含义？首先partitioner是方法combineByKey传入的变量， Some的文档说明： /** Class `Some[A]` represents existin
java 匿名内部类 BlueSkator java匿名内部类
组合优先于继承 Java的匿名类，就是提供了一个快捷方便的手段，令继承关系可以方便地变成组合关系继承只有一个时候才能用，当你要求子类的实例可以替代父类实例的位置时才可以用继承。在Java中内部类主要分为成员内部类、局部内部类、匿名内部类、静态内部类。内部类不是很好理解，但说白了其实也就是一个类中还包含着另外一个类如同一个人是由大脑、肢体、器官等身体结果组成，而内部类相
盗版win装在MAC有害发热，苹果的东西不值得买，win应该不用 ljy325 游戏 apple windows XP OS
Mac mini 型号: MC270CH-A RMB:5,688 Apple 对windows的产品支持不好,有以下问题: 1.装完了xp,发现机身很热虽然没有运行任何程序！貌似显卡跑游戏发热一样，按照那样的发热量,那部机子损耗很大,使用寿命受到严重的影响! 2.反观安装了Mac os的展示机，发热量很小，运行了1天温度也没有那么高 &nbs
读《研磨设计模式》-代码笔记-生成器模式-Builder bylijinnan java 设计模式
声明：本文只为方便我个人查阅和理解，详细的分析以及源代码请移步原作者的博客http://chjavach.iteye.com/ /** * 生成器模式的意图在于将一个复杂的构建与其表示相分离，使得同样的构建过程可以创建不同的表示（GoF） * 个人理解： * 构建一个复杂的对象，对于创建者（Builder）来说，一是要有数据来源(rawData)，二是要返回构
JIRA与SVN插件安装 chenyu19891124 SVN jira
JIRA安装好后提交代码并要显示在JIRA上，这得需要用SVN的插件才能看见开发人员提交的代码。 1.下载svn与jira插件安装包，解压后在安装包(atlassian-jira-subversion-plugin-0.10.1) 2.解压出来的包里下的lib文件夹下的jar拷贝到(C:\Program Files\Atlassian\JIRA 4.3.4\atlassian-jira\WEB
常用数学思想方法 comsci 工作
对于搞工程和技术的朋友来讲，在工作中常常遇到一些实际问题，而采用常规的思维方式无法很好的解决这些问题，那么这个时候我们就需要用数学语言和数学工具，而使用数学工具的前提却是用数学思想的方法来描述问题。。下面转帖几种常用的数学思想方法，仅供学习和参考函数思想　　把某一数学问题用函数表示出来，并且利用函数探究这个问题的一般规律。这是最基本、最常用的数学方法
pl/sql集合类型 daizj oracle 集合 type pl/sql
--集合类型 /* 单行单列的数据，使用标量变量单行多列数据，使用记录单列多行数据，使用集合（。。。） *集合：类似于数组也就是。pl/sql集合类型包括索引表（pl/sql table）、嵌套表（Nested Table）、变长数组（VARRAY）等 */ /* --集合方法 &n
[Ofbiz]ofbiz初用 dinguangx 电商 ofbiz
从github下载最新的ofbiz（截止2015-7-13），从源码进行ofbiz的试用 1. 加载测试库 ofbiz内置derby，通过下面的命令初始化测试库 ./ant load-demo (与load-seed有一些区别) 2. 启动内置tomcat ./ant start 或 ./startofbiz.sh 或 java -jar ofbiz.jar &
结构体中最后一个元素是长度为0的数组 dcj3sjt126com c gcc
在Linux源代码中，有很多的结构体最后都定义了一个元素个数为0个的数组，如/usr/include/linux/if_pppox.h中有这样一个结构体： struct pppoe_tag { __u16 tag_type; __u16 tag_len; &n
Linux cp 实现强行覆盖 dcj3sjt126com linux
发现在Fedora 10 /ubutun 里面用cp -fr src dest，即使加了-f也是不能强行覆盖的，这时怎么回事的呢？一两个文件还好说，就输几个yes吧，但是要是n多文件怎么办，那还不输死人呢？下面提供三种解决办法。方法一我们输入alias命令，看看系统给cp起了一个什么别名。 [root@localhost ~]# aliasalias cp=’cp -i’a
Memcached(一)、HelloWorld frank1234 memcached
一、简介高性能的架构离不开缓存，分布式缓存中的佼佼者当属memcached，它通过客户端将不同的key hash到不同的memcached服务器中，而获取的时候也到相同的服务器中获取，由于不需要做集群同步，也就省去了集群间同步的开销和延迟，所以它相对于ehcache等缓存来说能更好的支持分布式应用，具有更强的横向伸缩能力。二、客户端选择一个memcached客户端，我这里用的是memc
Search in Rotated Sorted Array II hcx2013 search
Follow up for "Search in Rotated Sorted Array":What if duplicates are allowed? Would this affect the run-time complexity? How and why? Write a function to determine if a given ta
Spring4新特性——更好的Java泛型操作API jinnianshilongnian spring4 generic type
Spring4新特性——泛型限定式依赖注入 Spring4新特性——核心容器的其他改进 Spring4新特性——Web开发的增强 Spring4新特性——集成Bean Validation 1.1(JSR-349)到SpringMVC Spring4新特性——Groovy Bean定义DSL Spring4新特性——更好的Java泛型操作API Spring4新
CentOS安装JDK liuxingguome centos
1、行卸载原来的： [root@localhost opt]# rpm -qa | grep java tzdata-java-2014g-1.el6.noarch java-1.7.0-openjdk-1.7.0.65-2.5.1.2.el6_5.x86_64 java-1.6.0-openjdk-1.6.0.0-11.1.13.4.el6.x86_64 [root@localhost
二分搜索专题2-在有序二维数组中搜索一个元素 OpenMind 二维数组算法二分搜索
1,设二维数组p的每行每列都按照下标递增的顺序递增。用数学语言描述如下：p满足 (1),对任意的x1，x2，y，如果x1<x2,则p(x1,y)<p(x2,y); (2),对任意的x，y1,y2, 如果y1<y2,则p(x,y1)<p(x,y2); 2,问题：给定满足1的数组p和一个整数k，求是否存在x0,y0使得p(x0,y0)=k? 3,算法分析： (
java 随机数 Math与Random SaraWon java Math Random
今天需要在程序中产生随机数，知道有两种方法可以使用，但是使用Math和Random的区别还不是特别清楚，看到一篇文章是关于的，觉得写的还挺不错的，原文地址是 http://www.oschina.net/question/157182_45274?sort=default&p=1#answers 产生1到10之间的随机数的两种实现方式： //Math Math.roun
oracle创建表空间 tugn oracle
create temporary tablespace TXSJ_TEMP tempfile 'E:\Oracle\oradata\TXSJ_TEMP.dbf' size 32m autoextend on next 32m maxsize 2048m extent m
使用Java8实现自己的个性化搜索引擎 yangshangchuan java superword 搜索引擎 java8 全文检索
需要对249本软件著作实现句子级别全文检索，这些著作均为PDF文件，不使用现有的框架如lucene，自己实现的方法如下： 1、从PDF文件中提取文本，这里的重点是如何最大可能地还原文本。提取之后的文本，一个句子一行保存为文本文件。 2、将所有文本文件合并为一个单一的文本文件，这样，每一个句子就有一个唯一行号。 3、对每一行文本进行分词，建立倒排表，倒排表的格式为：词=包含该词的总行数N=行号

RepVGG：使VGG样式的ConvNets再次出色

摘要

1、引言

2、为什么要用VGG模型？

2、相关工作

2.1、从单路径到多分支

2.2、有效地训练单路径模型

3、通过结构重参数构建RepVGG

3.1、简单即快速，节省内存，灵活

3.2、训练时的多分支体系结构

3.3、推理时的结构性重参数化

3.4、结构设计

4、实验

4.1、RepVGG用于ImageNet分类

4.3、语义分割

4.4、局限性

5、结论

6、ACNet

7、RepVGG的核心模块实现code

你可能感兴趣的:(深度学习,人工智能,pytorch,深度学习,RepVGG)