孙琪翔

HigherHRNet论文详解

Hello，今天要更新一下“HigherHRNet- Scale-Aware Representation Learning for Bottom-Up Human Pose Estimation”论文的详解，文章被CVPR 2020接收。先对文章进行翻译：

摘要

自下而上的人体姿态估计方法由于尺度变化的挑战而难以为小人体预测正确的姿态。在本文中，我们提出了HigherHRNet：一种新的自下而上的人体姿势估计方法，用于使用高分辨率特征金字塔学习尺度感知表示。该方法配备了用于训练的多分辨率监督和用于推理的多分辨率聚合，能够解决自下而上的多人姿势估计中的尺度变化挑战，并能更精确地定位关键点，尤其是对于小人物。HigherHRNet中的特征金字塔包括HRNet的特征图输出和通过转置卷积进行上采样的高分辨率输出。在COCO test-dev中，HigherHRNet的中等人体的AP性能比以前最佳的自下而上方法高2.5％，显示了其在处理尺度变化方面的有效性。此外，HigherHRNet在COCO test-dev（AP: 70.5％）上获得了最新的最新结果，而无需使用优化或其他后处理技术，从而超越了所有现有的自下而上的方法。HigherHRNet甚至在CrowdPose测试（AP：67.6％）上超过了所有自上而下的方法，表明它在拥挤场景中的稳健性。这些代码和模型可从https://github.com/HRNet/Higher-HRNet-Human-Pose-Estimation获得。

1.引言

2D人体姿势估计旨在定位人体解剖学关键点（例如肘部，腕部等）或部位。作为人类行为理解的基本技术，近年来受到越来越多的关注。

当前的人体姿势估计方法可以分为自上而下的方法和自下而上的方法。自上而下的方法[34、9、16、42、38、40、39、16]依赖于人体检测器来检测每个带有边界框的人体实例，然后将问题简化为一个简单的单人姿势估计任务。由于自上而下的方法可以通过裁剪和调整检测到的人的边界框的大小来将所有人标准化为大致相同的比例，因此它们通常对人的比例变化不那么敏感。因此，在各种多人人体姿势估计基准上的最新性能大多是通过自上而下的方法实现的。然而，由于这种方法依赖于单独的人体检测器并且需要分别估计每个人的姿势，因此它们通常是计算密集的并且不是真正的端到端系统。相比之下，自下而上的方法[3、30、33、22]首先通过预测不同解剖学关键点的热图来定位输入图像中所有人的无身份关键点，然后将它们分组为人实例。该策略有效地使自下而上的方法更快，并且更有能力实现实时姿势估计。但是，由于自下而上方法需要处理规模变化，因此自下而上和自上而下方法的性能之间仍然存在很大的差距，特别是对于小尺度人体而言。

图1.（a）使用图像金字塔进行热图预测[33，30]。（a）通过对图像进行上采样来生成更高分辨率和空间上更准确的热图。PersonLab [33]的最新工作依赖于扩大输入图像的大小来生成高质量的特征图。（c）我们的HigherHRNet使用高分辨率特征金字塔。

预测小尺度人体的关键点主要有两个挑战。一种是应对尺度变化，即在不牺牲大人体性能的情况下提高小人体的性能。另一种方法是生成高质量的高分辨率热图，以精确定位小型人群的关键点。以前的自下而上的方法[3、30、33、22]主要集中于对关键点进行分组，并且仅使用特征图的单一分辨率（即输入图像分辨率的1/4）来预测关键点的热图。这些方法忽略了尺度变化的挑战，并在推理过程中依赖图像金字塔（图1（a））。特征金字塔是处理次尺度变化的基本组件，但是，自顶向下的特征金字塔中分辨率较低的特征图通常会遇到第二个挑战。PersonLab [33]通过提高输入分辨率来生成高分辨率的热图（图1（b））。尽管随着输入分辨率的提高，小型人体的性能将持续提高，但是当输入分辨率太大时，大型人员的性能将开始下降。为了解决这些挑战，至关重要的是，以自然而简单的方式为自下而上的关键点预测生成空间上更准确且具有尺度感知的热图，而又不会牺牲计算成本。

在本文中，我们提出了一个尺度感知的高分辨率网络（HigherHRNet）来应对这些挑战。HigherHRNet通过新的高分辨率特征金字塔模块生成高分辨率热图。与传统的特征金字塔从1/32分辨率开始并使用具有横向连接的双线性上采样逐渐将特征图分辨率提高到1/4有所不同，高分辨率特征金字塔直接从1/4分辨率开始，这是backbone中最高分辨率的特征。通过反卷积生成甚至更高分辨率的特征图（图1（c））。我们在HRNet的1/4分辨率路径上构建高分辨率要特征金字塔[38，40]，以使其高效。为了使HigherHRNet能够处理尺度变化，我们进一步提出了一种多分辨率监督策略，以将不同分辨率的训练目标分配给相应的特征金字塔级别。最后，我们在推理过程中引入了一种简单的“多分辨率热图聚合”策略，以生成尺度感知的高分辨率热图。

我们在具有挑战性的COCO关键点检测数据集上验证了我们的方法[27]，并展示了出色的关键点检测性能。具体来说，HigherHRNet在COCO2017 test-dev上无需任何后期处理即可达到70.5％的AP，大大优于所有现有的自下而上的方法。此外，我们观察到，大多数收益来自中级人体（关键点检测任务没有小人体标注），HigherHRNet在不牺牲性能的情况下，对中型人体的性能比以前最佳的自下而上方法高2.5％。大人体（+0.3％AP）。这一观察结果证明HigherHRNet确实在解决尺度变化难题。我们还为新的CrowdPose [24]数据集上的自下而上方法提供了坚实的基础。我们的HigherHRNet在CrowdPose测试中的AP达到67.6％，超过了所有现有方法。该结果表明，自下而上的方法在拥挤的场景中自然具有优势。

我们的贡献如下：

•我们尝试解决尺度变化的挑战，这在自下而上的多人姿势估计中很少进行研究。

•我们提出了一个HigherHRNet，它可以在训练阶段生成具有多分辨率监督的高分辨率特征金字塔，并在推理阶段生成多分辨率热图聚合，以预测有利于小型人体的尺度感知的高分辨率热图。

•我们在具有挑战性的COCO数据集上展示了我们的HigherHRNet的有效性。我们的模型优于其他所有自下而上的方法。我们尤其观察到中型人体的巨大增益。

2.相关工作

top-down 方法：自上而下的方法[42、38、40、34、16、18、15、9、31]在人体的边界框内检测单个人的关键点。人体边界框通常由目标检测器[36、26、14、13]生成。Mask R-CNN [16]直接在Faster R-CNN [36]上添加关键点检测分支，并在ROIPooling之后重用features。G-RMI [34]和以下方法进一步将自上而下的方法分为两个步骤，并使用单独的模型进行人体检测和姿势估计。

bottom-up 方法：自下而上的方法[35，19，20，3，30]在图像中为所有人检测无身份的身体关节，然后将其分组。OpenPose [3]使用两分支多阶段网络，其中一个分支用于热图预测，一个分支用于分组。OpenPose使用一种称为 part affinity field的分组方法，该方法学习链接两个关键点的2D矢量场。通过计算两个关键点之间的线积分并将其与最大积分对进行分组来完成分组。Newell等。[30]使用堆叠沙漏网络[31]进行热图预测和分组。分组是通过一种称为关联嵌入的方法完成的，该方法为每个关键点分配一个“tag”（向量表示），并根据标签向量之间的L2距离对这些关键点进行分组。PersonLab [33]使用dialated ResNet [17]并通过直接学习每对关键点的2D偏移字段来对关键点进行分组。PifPaf [22]使用Part Intensity Field（PIF）来定位身体部位，并使用Part Association Field（PAF）将身体部位彼此关联以形成完整的人体姿势。

特征金字塔：金字塔形表示已在最近的目标检测和分割框架中被广泛采用以处理尺度变化。SSD [29]和MSCNN [2]可以预测网络多层中的目标，而无需合并功能。特征金字塔网络（FPN）[26]使用自上而下的路径扩展了主干模型，该路径使用双线性上采样和横向连接逐渐将特征分辨率从1/32恢复到1/4。共同的动机是让来自不同金字塔等级的特征预测不同尺度的实例。但是，这种金字塔形表示法在自下而上的多人姿势估计中很少得到探索。在这项工作中，我们设计了一个高分辨率的特征金字塔，该金字塔将金字塔扩展到另一个不同方向，从1/4分辨率的特征开始，并生成具有更高分辨率的特征金字塔。

高分辨率特征图：生成高分辨率特征图的方法主要有4种。（1）Encoderdecoder [31、16、9、37、1、25、41、10]捕获编码器路径中的上下文信息，并恢复解码器路径中的高分辨率特征。解码器通常包含一系列双线性上采样操作，并具有相同分辨率的编码器功能的跳过连接。（2）扩展卷积[44、5、6、7、8、4、28、43、11、12]（也称为“atrous”卷积）用于删除多个跨步卷积/最大池，以保留特征图分辨率。扩散卷积可防止丢失空间信息，但会带来更多的计算成本。（3）在网络末端依次使用反卷积（转置卷积）[42]，以有效地提高特征图的分辨率。SimpleBaseline [42]演示了反卷积可以生成用于热图预测的高质量特征图。（4）最近，提出了一种高分辨率网络（HRNet）[38，40]，作为在整个网络上保持高分辨率传输的有效方法。HRNet [38，40]由具有不同分辨率的多个分支组成。较低分辨率的分支捕获上下文信息，而较高分辨率的分支保留空间信息。通过分支之间的多尺度融合，HRNet [38，40]可以生成具有丰富语义的高分辨率特征图。

我们采用HRNet [38，40]作为我们的基础网络来生成高质量的特征图。并且我们添加了一个反卷积模块，以生成更高分辨率的特征图以预测热图。生成的模型称为“尺度感知“的高分辨率网络”（HigherHRNet）。由于HRNet [38、40、40]和反卷积都是有效的，HigherHRNet是一种高效模型，可用于生成用于热图预测的高分辨率特征图。

3.Higher-Resolution Network

在本节中，我们介绍使用HigherHRNet提出的尺度感知的高分辨率表示学习。图2说明了我们方法的总体架构。我们将首先简要介绍提出的HigherHRNet，然后详细描述其组成部分。

3.1.HigherHRNet

HRNet：HigherHRNet使用HRNet [38，40]（如图2所示）作为backbone。HRNet [38，40]在第一阶段从高分辨率分支开始。在随后的每个阶段中，都会将一个新分支与当前分支中分辨率最低的1/2并行添加到当前分支中。随着网络具有更多阶段，它将具有更多具有不同分辨率的并行分支，并且先前阶段的分辨率都保留在以后阶段。图2显示了一个包含3个并行分支的示例网络结构。

我们使用与HRNet [38，40]类似的方式实例化backbone。网络从一个stem开始，该stem由两个跨步的3×3卷积组成，将分辨率降低到1/ 4。第一级包含4个残差单元，其中每个单元由一个bottleneck（宽度（通道数）为64）形成，然后是一个3×3卷积，将特征图的宽度减小到C。第二，第三，第四级包含1， 4个和3个多分辨率块。四个分辨率的卷积宽度分别为C，2C，4C和8C。多分辨率群卷积中的每个分支都有4个残差单位，每个单位的每个分辨率中都有2个3×3卷积。通过将C分别设置为32和48，我们可以测试两个容量不同的网络。

HRNet [38，40]最初是为自上而下的姿势估计而设计的。在这项工作中，我们通过添加1×1卷积来预测热图和标tagmap，从而将HRNet [38，40]应用于自下而上的方法，类似于[30]。我们仅使用最高分辨率（输入图像的1/4）的特征图进行预测。[30]之后，我们为每个关键点使用标量tag。

HigherHRNet：热图的分辨率对于预测小型人群的关键点很重要。现有的大多数人体姿势估计方法都是通过准备ground truth 热图来预测高斯平滑的热图，其中将未标准化的高斯核应用于每个关键点位置。添加此高斯核有助于训练网络，因为CNN倾向于输出空间平滑的响应，这是卷积运算的本质。但是，应用高斯核也会给关键点的精确定位带来混乱，特别是对于属于小人物的关键点。减少这种混乱的简单方法是减少高斯核的标准偏差。但是，从经验上我们发现，这会使优化变得更加困难，并导致更糟糕的结果。

图2. HigherHRNet的示意图。该网络使用HRNet [38，40]作为backbone，随后是一个或多个反卷积模块以生成多分辨率和高分辨率热图。多分辨率监督用于训练。更多细节在第3节中给出。

我们没有降低标准偏差，而是通过以更高的分辨率预测热图来解决此问题，而在不同分辨率下标准偏差不变。自下而上的方法通常以输入图像的分辨率1/4预测热图。但是我们发现该分辨率还不足以预测准确的热图。受[42]的启发，这表明可以使用反卷积有效地生成高质量和高分辨率的特征图，我们通过在图2中所示的HRNet中最高分辨率的特征图的基础上，通过添加一个反卷积模块来构建HigherHRNet，如图2所示。第3.3节。

反卷积模块将来自HRNet的特征和预测热图作为输入，并生成分辨率比输入特征图大2倍的新特征图。因此，反卷积模块会与HRNet的特征图一起生成具有两种分辨率的特征金字塔。反卷积模块还通过添加额外的1×1卷积来预测热图。我们遵循第3.4节，以不同的分辨率训练热图预测变量，并使用第3.5节中所述的热图聚合策略进行推理。

如果需要更大的分辨率，可以添加更多的反卷积模块。我们发现反卷积模块的数量取决于数据集人体尺度的分布。一般而言,包含较小人体的数据集需要较大分辨率的特征图才能进行预测，反之亦然。在实验中，我们发现添加单个反卷积模块可在COCO数据集上实现最佳性能。

3.2.Grouping

最近的工作[30，23]表明，可以通过使用关联嵌入的简单方法[30]高精度地解决分组问题。有证据表明，[30]中的实验结果表明，在带有COCO关键点检测数据集的500个训练图像上，使用具有预测tags的ground truth检测将AP从59.2提高到94.0 [27] 。我们遵循[30]将关联嵌入用于关键点分组。分组过程通过将tags具有小的L2距离的关键点分组，将无身份的关键点聚类为多个个体。

3.3. Deconvolution Module

我们提出了一个简单的反卷积模块，用于生成高质量的特征图，其分辨率是输入特征图的两倍。[42]之后，我们使用4×4反卷积（也称为转置卷积），然后使用BatchNorm和ReLU来学习对输入特征图进行上采样。可选地，我们可以在反卷积之后进一步添加几个基本残差块[17]，以细化上采样的特征图。我们在HigherHRNet中添加4个残差块。

与[42]不同，反卷积模块的输入是来自HRNet或以前的反卷积模块的特征图和预测的热图的串联。每个反卷积模块的输出特征图也可用于以多尺度方式预测热图。

3.4.Multi-Resolution Supervision

与其他仅对最大分辨率热图应用监视的自下而上的方法[30、33、3]不同，我们在训练过程中引入了多分辨率监督以处理尺度变化。我们将ground truth关键点位置转换为所有分辨率的热图上的位置，以生成具有不同分辨率的ground truth热图。然后，我们将具有相同标准偏差（默认情况下使用标准偏差= 2）的高斯核应用于所有这些ground truth热图。我们发现重要的是不要缩放高斯核的标准偏差。这是因为特征金字塔的不同分辨率适合于预测不同尺度的关键点。在更高分辨率的特征图上，需要相对较小的标准偏差（与特征图的分辨率相比）以更精确地定位小人物的关键点。

在HigherHRNet中的每个预测尺度上，我们计算该尺度的预测热图与其关联的ground truth热图之间的均方误差。热图的最终损失是所有分辨率的均方误差之和。

值得强调的是，由于以下原因，我们没有将不同尺度的人体分配给特征金字塔中的不同级别。首先，用于分配训练目标的启发式方法取决于数据集和网络体系结构。由于数据集（人对所有目标的尺度分布）和体系结构（HigherHRNet仅具有2个金字塔等级，而FPN有4个）变化，很难将FPN [26]的启发式方法转换为HigherHRNet。其次，由于我们应用了高斯核，因此发round truth关键点目标彼此相互作用。因此，仅通过设置忽略区域来分离关键点非常困难。我们认为模型能够自动关注特征金字塔不同级别中的特定尺度。

tagmap的训练与HigherHRNet中的热图不同。我们仅以最低分辨率预测标签图，而不使用所有分辨率。这是因为学习标记图需要全局推理，它更适合于以较低的分辨率预测标记图。根据经验，我们还发现更高的分辨率无法很好地预测标签图，甚至无法收敛。因此，我们遵循[30]来以14分辨率的输入图像在特征图上训练标签图。

3.5. Heatmap Aggregation for Inference

我们提出了推理过程中的热图聚合策略。我们使用双线性插值法将具有不同分辨率的所有预测热图上采样到输入图像的分辨率，并平均所有尺度的热图以进行最终预测。此策略与以前的方法[3，30，33]完全不同，以前的方法仅使用单个尺度或单个阶段的热图进行预测。

我们使用热图聚合的原因是为了启用尺度感知姿势估计。例如，COCO关键点数据集[27]包含从322个像素到超过1282个像素的大规模尺度变化的人。自上而下的方法[34、9、42]通过将人的区域近似标准化为单个尺度来解决此问题。但是，自下而上的方法需要注意尺度，以从所有尺度中检测关键点。我们在HigherHRNet中发现了不同尺度的热图，更好地捕获了不同尺度的关键点。例如，可以在较高分辨率的热图中恢复在较低分辨率的热图中丢失的小人们的关键点。因此，对来自不同分辨率的预测热图进行平均，使HigherHRNet成为可识别尺度的姿势估计器

4.实验

4.1.COCO关键点检测

Dataset. COCO数据集[27]包含超过200000张图像和250000个人体实例，并标有17个关键点。COCO被分为分别具有57k，5k和20k图像的train / val / test-dev集。本文所有实验仅在训练集上进行训练。我们报告了用于消融研究的val设置的结果，并与test-dev设置上的其他最新方法进行了比较。

Evaluation metric. 标准评估指标基于目标关键点相似性（OKS）OKS = 这里是检测到的关键点与其对应的ground truth之间的欧几里得距离，是ground truth的可见性标记，s 是目标尺度，是控制衰减的每个关键点常数。我们报告标准平均精确度和召回力评分：AP50（OKS处的AP = 0.50），AP75，AP（OKS处的AP评分的平均值= 0.50、0.55，...，0.90; 0.95），中型对象的APM，APL的大对象和AR（在OKS处的召回平均值= 0.50、0.55，...，0.90、0.95）。

Training. 根据[30]，我们使用随机旋转（[−30◦，30◦]），随机缩放（[0.75，1.5]），随机平移（[−40，40]）的数据增强来裁剪输入大小为512×512的图像块以及随机翻转。如第3.4节所述，我们生成了两个分辨率为128×128和256×256的ground truth热图。

我们使用Adam优化器[21]。基本学习率设置为1e-3，在第200个和第260个epochs分别降至1e-4和1e-5。我们对模型进行了总共300个epochs的训练。为了平衡热图损失和分组损失，我们将两个损失的权重分别设置为1和1e-3。

Testing. 我们首先将输入图像的短边尺寸调整为512，并保持宽高比。热图聚合是通过将所有预测的热图的大小调整为输入图像的大小并取平均值来完成的。follow[30]，翻转测试用于所有实验。所有报告的数字都是使用单个模型获得的，没用集合。

COCO2017 test-dev上的结果：表1总结了COCO2017 test-dev数据集上的结果。从结果可以看出，使用HRNet [38，40]本身已成为自下而上方法（64.1 AP）的简单而强大的基准。我们的仅使用单一尺度测试的HRNet baseline方法优于使用多尺度测试的Hourglass [30]，而HRNet在FLOP方面的参数和计算量要少得多。配备轻量级反卷积模块，我们提出的HigherHRNet（66.4 AP）在参数（+0.4％）和FLOPs（+23.1％）略有增加的情况下，以+2.3 AP胜过HRNet。HigherHRNet可与PersonLab [33]媲美，但参数仅为50％，FLOP为11％。如果我们进一步使用多尺度测试，我们的HigherHRNet将达到70.5的AP，大大优于所有现有的自下而上的方法。在[3，30]中，我们不使用任何自上而下的方法来进行后期处理，例如进行优化。

表1.与COCO2017 test-dev集上的自下而上方法的比较。所有GFLOP均以单尺度计算。对于PersonLab [33]，我们仅计算其主干的#Params和GFLOP。顶部：w/o尺度测试。底部：w /多尺度测试。值得注意的是，我们的结果是在没有refinement的情况下实现的。

表2列出了COCO2017 test-dev数据集的自下而上和自上而下的方法。HigherHRNet进一步缩小了自下而上和自上而下方法之间的性能差距。

表2.在COCO2017 test-dev数据集上与自顶向下和自底向上方法的比较。* 表示使用refinement。+表示使用多尺度测试。

4.2.消融实验

我们执行了许多消融实验，以分析COCO2017 [27] val数据集上尺度感知的高分辨率网络（HigherHRNet）。

HRNet vs. HigherHRNet

我们比较HRNet和HigherHRNet进行消融研究。对于HigherHRNet，使用没有额外残差块的反卷积模块，并且使用热图聚合进行inference。结果显示在表3中。通过使用特征步长为4的HRNet的简单的自下而上的基线可以达到AP = 64.4。通过添加一个反卷积模块，我们的HighHRHRNet的特征跨度为2，大大超过了HRNet +2.5 AP（实现了66.9 AP）。此外，主要改进来自中型人体，其中APM从HRNet的57.1提高到HigherHRNet的61.0。

表3.在COCO2017 val数据集上HRNet与HigherHRNet的消融研究。对HigherHRNet使用一个反卷积模块在COCO数据集上表现最佳。

这些结果表明，HigherHRNet由于具有高分辨率的热图，因此在小尺度下的性能要好得多。我们还发现大人体姿势的AP不会下降。这主要是因为我们还使用较小分辨率的热图进行预测。它表明1）以更高的分辨率进行预测对自下而上的姿势估计很有帮助，并且2）尺度感知预测很重要。

如果我们在HRNet之后添加两个反卷积模块的序列以生成与输入图像具有相同分辨率的特征图，则会观察到性能从66.9 AP降低到66.5 AP，仅添加一个反卷积模块。中型人体的改善很小（+0.1 AP），但大人体的表现却有很大的下降（-0.8 AP）。我们假设这是因为特征图尺度和目标尺度之间的不匹配。较大的分辨率特征图（特征步幅= 1）适合于检测甚至更小的人的关键点，但不考虑COCO中的小人进行姿势估计。因此，默认情况下，我们仅对COCO数据集使用一个反卷积模块。但我们想指出的是，级联反卷积模块的数量应取决于数据集，我们将在以后的工作中在更多数据集上对此进行验证。

图3.（a）使用HRNet [38，40]作为backbone的baseline方法。（b）具有多分辨率监督（MRS）的HigherHRNet。（c）具有MRS和特征串联的HigherHRNet。（d）具有MRS和特征串联的HigherHRNet。（e）具有MRS，特征串联和额外残差块的HigherHRNet。对于（d）和（e），使用热图聚合。

表4.在COCO2017 val数据集上HigherHRNet组件的消融研究。MSR：多分辨率监督。feature concat .：特征串联。res. bolck：残差块。

HigherHRNet 增益故障：为了更好地理解所提出组件的增益，我们对每个单独的组件进行了详细的消融研究。图3展示了我们实验的所有架构。结果示于表4。

反卷积模块的效果：我们对添加反卷积模块以生成更高分辨率的热图的效果进行消融研究。为了公平地比较，我们仅使用最高分辨率的特征图来生成用于预测的热图（图3（b））。HRNet（图3（a））达到了64.4 AP的baseline。通过添加一个反卷积模块，该模型可实现66.0 AP，这比baseline好1.6 AP。这种改进完全归因于对具有更高质量的较大特征图的预测。该结果验证了我们的主张，即对于自下而上的姿势估计，预测更高分辨率的特征图非常重要。

特征串联的效果：我们将特征图与来自HRNet的预测热图连接起来，作为反卷积模块的输入（图3（c）），性能进一步提高到66.3 AP。我们还观察到，中型人体的收益很大，而大型人体的表现却有所下降。比较方法（a）和（c），以较高的分辨率预测热图的收益主要来自中等人体（+3.7APM）。此外，大人体的AP下降（-1.6 AP）证明了我们的主张，即特征图的不同分辨率对不同尺度的人敏感。

热图聚合的效果：我们根据热图聚合策略进一步使用热图的所有分辨率进行inference（图3（d））。与仅使用最高分辨率的热图进行inference的图3（c）（66.3 AP）相比，应用热图聚合策略可实现66.9 AP。比较方法（d）和（e），热图聚合的收益来自大人体（+1.7 AP）。大人体的表现甚至比较低分辨率下的预测要好一些（方法（a））。这意味着使用热图聚合策略预测热图是真正尺度感知的。

额外残差块的影响：我们在反卷积模块中添加了4个残差块，我们的最佳模型实现了67.1 AP。添加残差块可以进一步细化特征图，并且同样增加中型和大型人员的AP。

表5.在COCO2017 val数据集上具有不同训练图像大小的HigherHRNet的消融研究。

用更大图片尺寸训练：一个自然的问题是，使用更大的输入size进行训练是否可以进一步提高性能？为了回答这个问题，我们用640×640和768×768训练HigherHRNet，结果如表5所示，所有三种模型都使用训练图像尺寸进行了测试。我们发现，通过将训练图像大小增加到640，可以显着提高AP的1.4增益。大部分收益来自中型人体，而大型人体的表现则略有下降。当我们进一步将训练图像大小更改为768时，整个AP不再变化。我们观察到中等人体的略微改善以及大人体的大幅度衰减。

表6.在COCO2017 val数据集上具有不同backbone的HigherHRNet的消融研究。

更大的backbone：在先前的实验中，我们使用HRNet-W32（1/4分辨率特征图具有32个通道）作为backbone。我们使用较大backbone 的HRNet W40和HRNet-W48进行实验。结果显示在表6中。我们发现使用较大的backbone可以持续提高中型和大型人体的性能。

4.3. CrowdPose

CrowdPose [24]数据集由20,000张图像组成，包含约80,000个人。训练，验证和测试子集按5：1：4的比例分配。与COCO关键点数据集相比，CrowdPose的场景更为拥挤，给姿势估计方法带来了更多挑战。评估指标与COCO [27]相同。

另一方面，自下而上的方法自然在拥挤的场景中具有优势。为了验证HigherHRNet在拥挤场景中的稳健性，以及为自下而上的方法设置一个强大的基准。我们在CrowdPose训练和val集合上训练了最好的HigherHRNet-W48模型，并在测试集中报告了性能。所有训练参数均严格遵循COCO，我们使用640×640的crop size进行训练和测试。

结果显示在表7中。我们的HigherHRNet优于单纯的自上而下的方法，大大提高了6.6 AP。HIGHERHRNET还以1.6 AP优于以前的最佳方法[24]（对自上而下的方法[15]进行了global refinement），大部分收益来自APM（+1.8 AP）和APH（+1.5 AP），其中包含人群最多的图像。即使没有多尺度测试，HigherHRNet在APH中也比SPPE [24]高出0.5

表7.与CrowdPose测试数据集上的自上而下和自下而上方法的比较。AP的上标E，M，H表示容易，中等和困难。+表示使用多尺度测试。

5.结论

我们提出了一个尺度感知的高分辨率网络（HigherHRNet）去解决在自底向上多人姿态估计中的尺度变化挑战的问题，特别是准确定位小尺度人的关键点。我们发现多尺度图像金字塔和更大的输入尺寸有解决这个问题的潜力，但是这些方法会导致高计算量损耗。为了解决这个问题，我们提出了一个有效的基于HRNet并且在多分辨率监督训练的高分辨率特征金字塔。进过推理，HigherHRNet结合多分辨率热图融合，是有能力生成多分辨率，和高分辨率的热图用于更准确的人体姿态估计。HigherHRNet在COCO挑战数据集上超过现存的全部自底向上的方法一大截，特别是在小尺度人上。

终于翻译完了。总结一下，多尺度训练，inference时进行heatmap aggregation可以一定程度上解决bottom-up方法，关于人尺度多样性难训练的老大难问题。Top-Down方法之所以精度高，就是因为将不同尺度的person rescale到同一个尺度下。output feature map需要再大一点，但不是越大越好，这个一般来说是和数据集有关系的，更大一些的feature map对提高检测small person的效果更明显。

最近在利用这篇论文中提到的方法进行实验，HigherHRNet是bottom-up的方法，使用之前论文提出的associate embedding对每个heatmap point赋上一个tag，用来做后面的后处理工作。论文只着重强调在前半部分关键点的提取上，后处理部分没有详细介绍，下次再更新一下与associate embedding相关的论文，然后看看能不能有一下改进，随后也会更新一些实验的具体进展。有做相关领域的朋友可以找我交流。

最近因为疫情原因，我们没有办法返校，但是我们依然有着非常艰巨的科研任务和比赛项目。宅家抗疫期间也尝试了很多种跑实验的方法，用CPU跑，用colab跑，真是一顿操作猛如虎，一看战绩0.5。没有办法，最后在师兄的帮助下，我发现可以远程租用服务器，既省去了我环境配置的难题，有没有GPU运行时的噪音，有需求的朋友可以参考一下他们的官网： http://www.ai-galaxy.cn/，淘宝店：https://shop36573300.taobao.com/，公众号: 智星AI

今天我们中国人有一次登上了珠峰，在现在全球抗疫的背景下，证明了我们抗疫取得了令人瞩目的成功，在这里恭喜登上队，同时也期待更多的好消息。PEACE&LOVE

参考资料：

https://arxiv.org/pdf/1908.07919.pdf

https://github.com/HRNet/HigherHRNet-Human-Pose-Estimation

https://blog.csdn.net/Murdock_C/article/details/104851289

https://blog.csdn.net/weixin_40671425/article/details/105600137

http://www.ai-galaxy.cn/index.php

https://shop36573300.taobao.com/

你可能感兴趣的:(计算机视觉,机器学习,人工智能,深度学习)

（转）优秀的 python 机器学习库 patrick75 python 机器学习 python 机器学习
优秀的python机器学习库IntroductionThereisnodoubtthatneuralnetworks,andmachinelearningingeneral,hasbeenoneofthehottesttopicsintechthepastfewyearsorso.It’seasytoseewhywithallofthereallyinterestinguse-casestheys
day39 心落薄荷糖 Python训练营 python
#先继续之前的代码importtorchimporttorch.nnasnnimporttorch.optimasoptimfromtorch.utils.dataimportDataLoader,Dataset#DataLoader是PyTorch中用于加载数据的工具fromtorchvisionimportdatasets,transforms#torchvision是一个用于计算机视觉的库，
DAY 10 机器学习建模与评估心落薄荷糖 Python训练营机器学习人工智能
知识点：1.数据集的划分2.机器学习模型建模的三行代码3.机器学习模型分类问题的评估今日代码比较多，但是难度不大，仔细看看示例代码，好好理解下这几个评估指标。作业：尝试对心脏病数据集采用机器学习模型建模和评估#一、导入库importpandasaspdimportpandasaspd#用于数据处理和分析，可处理表格数据。importnumpyasnp#用于数值计算，提供了高效的数组操作。impor
【图像处理入门】12. 综合项目与进阶：超分辨率、医学分割与工业检测小米玄戒Andrew 图像处理：从入门到专家图像处理人工智能深度学习算法 python 计算机视觉 CV
摘要本周将聚焦三个高价值的综合项目，打通传统算法与深度学习的技术壁垒。通过图像超分辨率重建对比传统方法与深度学习方案，掌握医学图像分割的U-Net实现，设计工业缺陷检测的完整流水线。每个项目均包含原理解析、代码实现与性能优化，帮助读者从“技术应用”迈向“系统设计”。一、项目1：图像超分辨率重建（从模糊到清晰的跨越）1.技术背景与核心指标超分辨率（SR）是通过算法将低分辨率（LR）图像恢复为高分辨率
Python机器学习元学习库higher 音程机器学习人工智能 python 机器学习
higher是一个用于元学习（Meta-Learning）和高阶导数（Higher-ordergradients）的Python库，专为PyTorch设计。它扩展了PyTorch的自动微分机制，使得在训练过程中可以动态地计算参数的梯度更新，并把这些更新过程纳入到更高阶的梯度计算中。一、主要用途higher主要用于以下场景：元学习（Meta-Learning）比如MAML（Model-Agnosti
基于迁移学习的ResNet50模型实现石榴病害数据集多分类图片预测深度学习乐园深度学习实战项目迁移学习分类人工智能
完整源码项目包获取→点击文章末尾名片！番石榴病害数据集背景描述番石榴（Psidiumguajava）是南亚的主要作物，尤其是在孟加拉国。它富含维生素C和纤维，支持区域经济和营养。不幸的是，番石榴生产受到降低产量的疾病的威胁。该数据集旨在帮助开发用于番石榴果实早期病害检测的机器学习模型，帮助保护收成并减少经济损失。数据说明该数据集包括473张番石榴果实的注释图像，分为三类。图像经过预处理步骤，例如钝
四个机器学习模型对比道路裂缝检测识别分类模型深度学习乐园深度学习实战项目机器学习分类人工智能
完整源码项目包获取→点击文章末尾名片！一、课题综述1.1.课题简介在机器学习的研究领域中，传统分类算法模型数量众多，适合的应用场景也各不相同。1.2.课题目标（示例）本课题使用的数据集来自于数据分析与数据挖掘竞赛Kaggle，该竞赛为数据科学领域著名的国际性赛事之一。课题使用的数据集为带标签的图像数据集，包含带有裂痕和不带有裂痕的桥梁、墙和人行道图片。课题的目标为对于目标数据集，搭建相应的传统机器
Densenet模型花卉图像分类深度学习乐园分类数据挖掘人工智能
项目源码获取方式见文章末尾！600多个深度学习项目资料，快来加入社群一起学习吧。《------往期经典推荐------》项目名称1.【基于CNN-RNN的影像报告生成】2.【卫星图像道路检测DeepLabV3Plus模型】3.【GAN模型实现二次元头像生成】4.【CNN模型实现mnist手写数字识别】5.【fasterRCNN模型实现飞机类目标检测】6.【CNN-LSTM住宅用电量预测】7.【VG
基于AFM注意因子分解机的推荐算法深度学习乐园深度学习实战项目深度学习科研项目推荐算法算法机器学习
关于深度实战社区我们是一个深度学习领域的独立工作室。团队成员有：中科大硕士、纽约大学硕士、浙江大学硕士、华东理工博士等，曾在腾讯、百度、德勤等担任算法工程师/产品经理。全网20多万+粉丝，拥有2篇国家级人工智能发明专利。社区特色：深度实战算法创新获取全部完整项目数据集、代码、视频教程，请进入官网：zzgcz.com。竞赛/论文/毕设项目辅导答疑，v：zzgcz_com1.项目简介项目A033基于A
Tair向量数据库：阿里云原生内存数据库服务的高性能向量检索解决方案 mmlihaio 数据库云原生 python
Tair向量数据库：阿里云原生内存数据库服务的高性能向量检索解决方案1.引言在当今的人工智能和大数据时代，高效的向量检索已成为许多应用场景的关键需求。Tair作为阿里云开发的云原生内存数据库服务，不仅提供了丰富的数据模型和企业级能力，还引入了基于非易失性内存(NVM)存储介质的持久内存优化实例。本文将深入探讨如何利用Tair向量数据库功能，实现高性能的向量存储和检索。2.Tair向量数据库概述Ta
阿里云魔搭社区AIGC专区：中国AI创作的革命性平台 Liudef06小白阿里云 AIGC 人工智能
在生成式人工智能重塑全球数字创作版图的浪潮中，中国首个一站式AIGC开发平台——阿里云魔搭社区AIGC专区于2024年9月杭州云栖大会正式亮相。这一突破性进展不仅填补了国内全流程AI创作工具的空白，更以157款多模态开源模型和全免费GPU算力的开放姿态，为超过690万开发者提供了从模型调用到应用落地的完整生态支持。一、魔搭社区：中国AI模型生态的奠基者魔搭社区（ModelScope）作为阿里云在2
探秘阿里云Tair KVCache：大模型推理的加速引擎云资源服务商阿里云云计算人工智能
一、引言近年来，人工智能领域发展迅猛，大语言模型（LLM）不断取得突破，其应用场景也日益广泛。从智能客服到内容生成，从智能写作到智能翻译，大语言模型正在深刻地改变着我们的生活和工作方式。随着模型规模的不断扩大和推理需求的日益增长，大模型推理过程中的显存瓶颈问题逐渐凸显，成为制约其发展和应用的关键因素。在大模型推理中，KVCache技术作为一种优化手段，通过缓存历史Token的Key/Value向量
AI正在偷偷取代这10种职业，你的工作安全吗？
近年来，人工智能（AI）的飞速发展正在悄然改变我们的工作方式。从自动化客服到AI生成内容，许多传统职业正面临被取代的风险。虽然AI带来了更高的效率和便利，但也让不少人开始担忧：我的工作会被AI抢走吗？今天，我们就来盘点10种最容易被AI取代的职业，并探讨如何在这个AI时代保持竞争力。1.客服代表取代指数：★★★★★AI驱动的聊天机器人（如ChatGPT、GoogleBard）已经能够处理大部分基础
直播预告！探讨生成模型中的极简概念擦除青稞社区. 青稞Talk 人工智能图像处理
主页：http://qingkeai.online/原文：https://mp.weixin.qq.com/s/yc4whKbnVY8ho1w7rgFVGg6月16日20:00，青稞Talk第55期，新加坡国立大学博士生张扬，将直播分享《生成模型中的极简概念擦除》。分享嘉宾张扬，慕尼黑工业大学计算机专业硕士，新加坡国立大学人工智能专业博士。曾于牛津大学进行学术访问，并在微软亚洲研究院及美国运通新加
机器学习5——非参数估计平和男人杨争争山东大学机器学习期末复习机器学习概率论算法
非参数估计在参数估计中我们已经提到，想要估计后验概率P(ωi∣x)=p(x∣ωi)p(ωi)p(x)P\left(\omega_i\midx\right)=\frac{p\left(x\mid\omega_i\right)p\left(\omega_i\right)}{p(x)}P(ωi∣x)=p(x)p(x∣ωi)p(ωi)，就需要估计类条件概率p(x∣ωi)p\left(x\mid\omega
机器学习4——参数估计之贝叶斯估计平和男人杨争争山东大学机器学习期末复习机器学习人工智能
贝叶斯估计问题建模：后验概率公式：P(ωi∣x,D)=P(x∣ωi,Di)P(ωi)∑j=1cP(x∣ωj,Dj)P(ωj)P\left(\omega_i\mid\mathbf{x},\mathcal{D}\right)=\frac{P\left(\mathbf{x}\mid\omega_i,\mathcal{D}_i\right)P\left(\omega_i\right)}{\sum_{j=1
【DeepSeek实战】3、Ollama实战指南：LobeChat+多网关架构打造高可用大模型集群无心水 Ollama实战指南 LobeChat实战 DeepSeek实战 DeepSeek全栈应用开发 AI入门大模型 CSDN技术干货
一、企业级大模型集群架构全景解析在人工智能落地应用的过程中，大模型服务的高可用性、成本控制和灵活扩展能力成为企业关注的核心痛点。本方案通过LobeChat前端、AI网关层和Ollama模型集群的三层架构设计，实现了无需复杂运维即可部署的生产级大模型服务体系。该架构不仅支持负载均衡、故障转移和模型热切换等企业级特性。还通过量化技术将硬件成本降低60%以上，为中小企业提供了与商业云服务相当的性能体验。
生成式人工智能实战 | 深度卷积生成对抗网络（Deep Convolutional Generative Adversarial Network, DCGAN）盼小辉丶生成式人工智能实战150讲人工智能生成对抗网络神经网络
生成式人工智能实战|深度卷积生成对抗网络0.前言1.模型与数据集分析1.1模型分析1.2数据集介绍2.构建DCGAN生成人脸图像2.1数据处理2.2模型构建2.3模型训练0.前言深度卷积生成对抗网络(DeepConvolutionalGenerativeAdversarialNetworks,DCGAN)是基于生成对抗网络(ConvolutionalGenerativeAdversarialNet
深度学习实战：基于嵌入模型的AI应用开发 AIGC应用创新大全 AI人工智能与大数据应用开发 MCP&Agent 云算力网络人工智能深度学习 ai
深度学习实战：基于嵌入模型的AI应用开发关键词：嵌入模型（EmbeddingModel）、深度学习、向量空间、语义表示、AI应用开发、相似性搜索、迁移学习摘要：本文将带你从0到1掌握基于嵌入模型的AI应用开发全流程。我们会用“翻译机”“数字身份证”等生活比喻拆解嵌入模型的核心原理，结合Python代码实战（BERT/CLIP模型）演示如何将文本、图像转化为可计算的语义向量，并通过“智能客服问答”“
机器学习3——参数估计之极大似然估计平和男人杨争争山东大学机器学习期末复习机器学习人工智能算法
参数估计问题背景：P(ωi∣x)=p(x∣ωi)P(ωi)p(x)p(x)=∑j=1cp(x∣ωj)P(ωj)\begin{aligned}&P\left(\omega_i\mid\mathbf{x}\right)=\frac{p\left(\mathbf{x}\mid\omega_i\right)P\left(\omega_i\right)}{p(\mathbf{x})}\\&p(\mathbf
2024年AI 智能助手（大模型）产品市场分析｜商派徐礼昭｜商派软件市场负责人人工智能
一、引言人工智能的浪潮不断向前推进，智能助手作为其中的重要应用，已经逐渐渗透到我们生活的各个方面。它们以其便捷性和个性化的特点，改变了我们与世界的互动方式。本报告将对AI智能助手进行全面的行业分析，包括行业概况、主要玩家、用户数据、发展要素以及未来趋势等方面，并通过具体案例分享，帮助读者深入了解这一领域的现状和未来发展潜力。二、行业概览（一）智能助手的定义和发展阶段智能助手是利用人工智能技术为用户
基于OpenCv的图片倾斜校正系统详细设计与具体代码实现 AI大模型应用之禅人工智能数学基础计算科学神经计算深度学习神经网络大数据人工智能大型语言模型 AI AGI LLM Java Python 架构设计 Agent RPA
基于OpenCv的图片倾斜校正系统详细设计与具体代码实现1.背景介绍1.1图像处理的重要性在当今数字时代,图像处理技术在各个领域都扮演着重要角色。无论是在计算机视觉、模式识别、医学影像、遥感探测还是多媒体处理等领域,图像处理都是不可或缺的核心技术。通过对图像进行预处理、增强、分割、特征提取等操作,可以从图像中获取有价值的信息,为后续的分析和决策提供支持。1.2图像倾斜问题及其影响在实际应用中,由于
大模型RLHF强化学习笔记（一）：强化学习基础梳理Part1 Gravity! 大模型笔记大模型 LLM 算法机器学习强化学习人工智能
【如果笔记对你有帮助，欢迎关注&点赞&收藏，收到正反馈会加快更新！谢谢支持！】一、强化学习基础1.1Intro定义：强化学习是一种机器学习方法，需要智能体通过与环境交互学习最优策略基本要素：状态（State）：智能体在决策过程中需要考虑的所有相关信息（环境描述）动作（Action）：在环境中可以采取的行为策略（Policy）：定义了在给定状态下智能体应该选择哪个动作，目标是最大化智能体的长期累积奖
高通 QCS8550 大模型性能深度解析：从算力基准到场景实测的全维度 Benchmark 伊利丹~怒风 Qualcomm 人工智能 AI编程 python arm 自然语言处理
前言在人工智能技术狂飙突进的时代，大模型正以前所未有的速度重塑各行业生态，从智能客服到多模态交互，从边缘推理到端侧部署，其应用场景不断拓展。而这一切革新的背后，离不开底层硬件的强力支撑。高通QCS8550作为面向下一代智能设备的旗舰级计算平台，凭借高达48TOPS的AI算力与先进的第七代高通AI引擎，在大模型性能表现上极具竞争力。其异构多核架构不仅能高效处理复杂的神经网络计算，还通过软硬件协同优化
从零开始理解零样本学习：AI人工智能必学技术 AI天才研究院 Agentic AI 实战 AI人工智能与大数据 AI大模型企业级应用开发实战 ai
从零开始理解零样本学习：AI人工智能必学技术关键词：零样本学习、人工智能、机器学习、知识迁移、语义嵌入摘要：本文旨在全面深入地介绍零样本学习这一在人工智能领域具有重要意义的技术。首先阐述零样本学习的背景和基本概念，通过详细的解释和直观的示意图让读者建立起对零样本学习的初步认识。接着深入剖析其核心算法原理，结合Python代码进行详细说明，同时引入相关数学模型和公式并举例阐释。通过项目实战部分，带领
卷积神经网络（Convolutional Neural Network, CNN）不想秃头的程序神经网络语音识别人工智能深度学习网络卷积神经网络
卷积神经网络（ConvolutionalNeuralNetwork,CNN）是一种专门用于处理图像、视频等网格数据的深度学习模型。它通过卷积层自动提取数据的特征，并利用空间共享权重和池化层减少参数量和计算复杂度，成为计算机视觉领域的核心技术。以下是CNN的详细介绍：一、核心思想CNN的核心目标是从图像中自动学习层次化特征，并通过空间共享权重和平移不变性减少参数量和计算成本。其关键组件包括：卷积层（
ResNet（Residual Network）不想秃头的程序神经网络语音识别人工智能深度学习网络残差网络神经网络
ResNet（ResidualNetwork）是深度学习中一种经典的卷积神经网络（CNN）架构，由微软研究院的KaimingHe等人在2015年提出。它通过引入残差连接（SkipConnection）解决了深度神经网络中的梯度消失问题，使得网络可以训练极深的模型（如上百层），并在图像分类、目标检测、语义分割等任务中取得了突破性成果。以下是ResNet的详细介绍：一、核心思想ResNet的核心创新是
P25：LSTM实现糖尿病探索与预测 ?Agony lstm 人工智能 rnn
本文为365天深度学习训练营中的学习记录博客原作者：K同学啊一、相关技术1.LSTM基本概念LSTM（长短期记忆网络）是RNN（循环神经网络）的一种变体，它通过引入特殊的结构来解决传统RNN中的梯度消失和梯度爆炸问题，特别适合处理序列数据。结构组成：遗忘门：决定丢弃哪些信息，通过sigmoid函数输出0-1之间的值，表示保留或遗忘的程度。输入门：决定更新哪些信息，同样通过sigmoid函数控制更新
Python训练营打卡——DAY16（2025.5.5） cosine2025 Python训练营打卡 python 开发语言机器学习
目录一、NumPy数组基础笔记1.理解数组的维度(Dimensions)2.NumPy数组与深度学习Tensor的关系3.一维数组(1DArray)4.二维数组(2DArray)5.数组的创建5.1数组的简单创建5.2数组的随机化创建5.3数组的遍历5.4数组的运算6.数组的索引6.1一维数组索引6.2二维数组索引6.3三维数组索引二、SHAP值的深入理解三、总结1.NumPy数组基础总结2.SH
深入详解：决策树算法的概念、原理、实现与应用场景猿享天开算法决策树机器学习
深入详解：决策树算法的概念、原理、实现与应用场景决策树（DecisionTree）是机器学习中一种直观且广泛应用的监督学习算法，适用于分类和回归任务。其树形结构易于理解，特别适合初学者。本文将从概念、原理、实现到应用场景，全面讲解决策树，并通过流程图和可视化示例增强理解，通俗易懂，帮助小白快速掌握决策树算法相关知识。1.决策树的概念1.1什么是决策树？决策树通过一系列条件判断（决策节点）将输入数据
ASM系列六利用TreeApi 添加和移除类成员 lijingyao8206 jvm 动态代理 ASM 字节码技术 TreeAPI
同生成的做法一样，添加和移除类成员只要去修改fields和methods中的元素即可。这里我们拿一个简单的类做例子，下面这个Task类，我们来移除isNeedRemove方法，并且添加一个int 类型的addedField属性。 package asm.core; /** * Created by yunshen.ljy on 2015/6/
Springmvc-权限设计 bee1314 spring Web jsp
万丈高楼平地起。权限管理对于管理系统而言已经是标配中的标配了吧，对于我等俗人更是不能免俗。同时就目前的项目状况而言，我们还不需要那么高大上的开源的解决方案，如Spring Security，Shiro。小伙伴一致决定我们还是从基本的功能迭代起来吧。目标： 1.实现权限的管理（CRUD） 2.实现部门管理（CRUD) 3.实现人员的管理（CRUD） 4.实现部门和权限
算法竞赛入门经典（第二版）第2章习题 CrazyMizzz c 算法
2.4.1 输出技巧 #include <stdio.h> int main() { int i, n; scanf("%d", &n); for (i = 1; i <= n; i++) printf("%d\n", i); return 0; } 习题2-2 水仙花数(daffodil
struts2中jsp自动跳转到Action 麦田的设计者 jsp webxml struts2 自动跳转
1、在struts2的开发中，经常需要用户点击网页后就直接跳转到一个Action，执行Action里面的方法，利用mvc分层思想执行相应操作在界面上得到动态数据。毕竟用户不可能在地址栏里输入一个Action（不是专业人士） 2、＜jsp:forward page="xxx.action" /＞，这个标签可以实现跳转，page的路径是相对地址,不同与jsp和j
php 操作webservice实例 IT独行者 PHP webservice
首先大家要简单了解了何谓webservice，接下来就做两个非常简单的例子，webservice还是逃不开server端与client端。我测试的环境为：apache2.2.11 php5.2.10做这个测试之前，要确认你的php配置文件中已经将soap扩展打开，即extension=php_soap.dll; OK 现在我们来体验webservice //server端 serve
Windows下使用Vagrant安装linux系统 _wy_ windows vagrant
准备工作：下载安装 VirtualBox ：https://www.virtualbox.org/ 下载安装 Vagrant ：http://www.vagrantup.com/ 下载需要使用的 box ：官方提供的范例：http://files.vagrantup.com/precise32.box 还可以在 http://www.vagrantbox.es/
更改linux的文件拥有者及用户组(chown和chgrp) 无量 c linux chgrp chown
本文（转） http://blog.163.com/yanenshun@126/blog/static/128388169201203011157308/ http://ydlmlh.iteye.com/blog/1435157 一、基本使用：使用chown命令可以修改文件或目录所属的用户：命令
linux下抓包工具矮蛋蛋 linux
原文地址： http://blog.chinaunix.net/uid-23670869-id-2610683.html tcpdump -nn -vv -X udp port 8888 上面命令是抓取udp包、端口为8888 netstat -tln 命令是用来查看linux的端口使用情况 13 . 列出所有的网络连接 lsof -i 14. 列出所有tcp 网络连接信息 l
我觉得mybatis是垃圾！：“每一个用mybatis的男纸，你伤不起” alafqq mybatis
最近看了每一个用mybatis的男纸，你伤不起原文地址：http://www.iteye.com/topic/1073938 发表一下个人看法。欢迎大神拍砖；个人一直使用的是Ibatis框架，公司对其进行过小小的改良；最近换了公司，要使用新的框架。听说mybatis不错；就对其进行了部分的研究；发现多了一个mapper层；个人感觉就是个dao；
解决java数据交换之谜百合不是茶数据交换
交换两个数字的方法有以下三种，其中第一种最常用 /* 输出最小的一个数 */ public class jiaohuan1 { public static void main(String[] args) { int a =4; int b = 3; if(a<b){ // 第一种交换方式 int tmep =
渐变显示 bijian1013 JavaScript
<style type="text/css"> #wxf { FILTER: progid:DXImageTransform.Microsoft.Gradient(GradientType=0, StartColorStr=#ffffff, EndColorStr=#97FF98); height: 25px; } </style>
探索JUnit4扩展：断言语法assertThat bijian1013 java 单元测试 assertThat
一.概述 JUnit 设计的目的就是有效地抓住编程人员写代码的意图，然后快速检查他们的代码是否与他们的意图相匹配。 JUnit 发展至今，版本不停的翻新，但是所有版本都一致致力于解决一个问题，那就是如何发现编程人员的代码意图，并且如何使得编程人员更加容易地表达他们的代码意图。JUnit 4.4 也是为了如何能够
【Gson三】Gson解析{"data":{"IM":["MSN","QQ","Gtalk"]}} bit1129 gson
如何把如下简单的JSON字符串反序列化为Java的POJO对象? {"data":{"IM":["MSN","QQ","Gtalk"]}} 下面的POJO类Model无法完成正确的解析： import com.google.gson.Gson;
【Kafka九】Kafka High Level API vs. Low Level API bit1129 kafka
1. Kafka提供了两种Consumer API High Level Consumer API Low Level Consumer API(Kafka诡异的称之为Simple Consumer API，实际上非常复杂) 在选用哪种Consumer API时，首先要弄清楚这两种API的工作原理，能做什么不能做什么，能做的话怎么做的以及用的时候，有哪些可能的问题
在nginx中集成lua脚本：添加自定义Http头，封IP等 ronin47 nginx lua
Lua是一个可以嵌入到Nginx配置文件中的动态脚本语言，从而可以在Nginx请求处理的任何阶段执行各种Lua代码。刚开始我们只是用Lua 把请求路由到后端服务器，但是它对我们架构的作用超出了我们的预期。下面就讲讲我们所做的工作。强制搜索引擎只索引mixlr.com Google把子域名当作完全独立的网站，我们不希望爬虫抓取子域名的页面，降低我们的Page rank。 location /{
java-归并排序 bylijinnan java
import java.util.Arrays; public class MergeSort { public static void main(String[] args) { int[] a={20,1,3,8,5,9,4,25}; mergeSort(a,0,a.length-1); System.out.println(Arrays.to
Netty源码学习-CompositeChannelBuffer bylijinnan java netty
CompositeChannelBuffer体现了Netty的“Transparent Zero Copy” 查看API（ http://docs.jboss.org/netty/3.2/api/org/jboss/netty/buffer/package-summary.html#package_description）可以看到，所谓“Transparent Zero Copy”是通
Android中给Activity添加返回键 hotsunshine Activity
// this need android:minSdkVersion="11" getActionBar().setDisplayHomeAsUpEnabled(true); @Override public boolean onOptionsItemSelected(MenuItem item) {
静态页面传参 ctrain 静态
$(document).ready(function () { var request = { QueryString : function (val) { var uri = window.location.search; var re = new RegExp("" + val + "=([^&?]*)", &
Windows中查找某个目录下的所有文件中包含某个字符串的命令 daizj windows 查找某个目录下的所有文件包含某个字符串
findstr可以完成这个工作。 [html] view plain copy >findstr /s /i "string" *.* 上面的命令表示，当前目录以及当前目录的所有子目录下的所有文件中查找"string&qu
改善程序代码质量的一些技巧 dcj3sjt126com 编程 PHP 重构
有很多理由都能说明为什么我们应该写出清晰、可读性好的程序。最重要的一点，程序你只写一次，但以后会无数次的阅读。当你第二天回头来看你的代码时，你就要开始阅读它了。当你把代码拿给其他人看时，他必须阅读你的代码。因此，在编写时多花一点时间，你会在阅读它时节省大量的时间。让我们看一些基本的编程技巧：尽量保持方法简短尽管很多人都遵
SharedPreferences对数据的存储 dcj3sjt126com
SharedPreferences简介： &nbs
linux复习笔记之bash shell (2) bash基础 eksliang bash bash shell
转载请出自出处： http://eksliang.iteye.com/blog/2104329 1.影响显示结果的语系变量（locale） 1.1locale这个命令就是查看当前系统支持多少种语系，命令使用如下： [root@localhost shell]# locale LANG=en_US.UTF-8 LC_CTYPE="en_US.UTF-8"
Android零碎知识总结 gqdy365 android
1、CopyOnWriteArrayList add(E) 和remove(int index)都是对新的数组进行修改和新增。所以在多线程操作时不会出现java.util.ConcurrentModificationException错误。所以最后得出结论：CopyOnWriteArrayList适合使用在读操作远远大于写操作的场景里，比如缓存。发生修改时候做copy，新老版本分离，保证读的高
HoverTree.Model.ArticleSelect类的作用 hvt Web .net C#hovertree asp.net
ArticleSelect类在命名空间HoverTree.Model中可以认为是文章查询条件类，用于存放查询文章时的条件，例如HvtId就是文章的id。HvtIsShow就是文章的显示属性，当为-1是，该条件不产生作用，当为0时，查询不公开显示的文章，当为1时查询公开显示的文章。HvtIsHome则为是否在首页显示。HoverTree系统源码完全开放，开发环境为Visual Studio 2013
PHP 判断是否使用代理 PHP Proxy Detector 天梯梦 proxy
1. php 类 I found this class looking for something else actually but I remembered I needed some while ago something similar and I never found one. I'm sure it will help a lot of developers who try to
apache的math库中的回归——regression（翻译） lvdccyb Math apache
这个Math库，虽然不向weka那样专业的ML库，但是用户友好，易用。多元线性回归，协方差和相关性（皮尔逊和斯皮尔曼），分布测试（假设检验，t，卡方，G），统计。数学库中还包含，Cholesky，LU，SVD，QR，特征根分解，真不错。基本覆盖了：线代，统计，矩阵，最优化理论曲线拟合常微分方程遗传算法（GA），还有3维的运算。。。
基础数据结构和算法十三：Undirected Graphs (2) sunwinner Algorithm
Design pattern for graph processing. Since we consider a large number of graph-processing algorithms, our initial design goal is to decouple our implementations from the graph representation
云计算平台最重要的五项技术 sumapp 云计算云平台智城云
云计算平台最重要的五项技术 1、云服务器云服务器提供简单高效，处理能力可弹性伸缩的计算服务，支持国内领先的云计算技术和大规模分布存储技术，使您的系统更稳定、数据更安全、传输更快速、部署更灵活。特性机型丰富通过高性能服务器虚拟化为云服务器，提供丰富配置类型虚拟机，极大简化数据存储、数据库搭建、web服务器搭建等工作；仅需要几分钟，根据CP
《京东技术解密》有奖试读获奖名单公布 ITeye管理员活动
ITeye携手博文视点举办的12月技术图书有奖试读活动已圆满结束，非常感谢广大用户对本次活动的关注与参与。 12月试读活动回顾： http://webmaster.iteye.com/blog/2164754 本次技术图书试读活动获奖名单及相应作品如下：一等奖（两名） Microhardest：http://microhardest.ite