Lingyun_wu

【论文学习】基于无监督迁移学习的高光谱目标检测

Unsupervised transfer learning for target detection from hyperspectral images

基于无监督迁移学习的高光谱目标检测

论文来源：https://doi.org/10.1016/j.neucom.2012.08.056

摘要

目标检测一直是高光谱图像处理的热门领域之一。传统的目标检测方法取决于观察中的所有像素的相对固定的特征。例如，RX对所有像素采用相同的距离测量。但是，最好的分离结果通常来自特定的目标和背景。理论上讲，它们是最纯粹的目标和背景像素，或子空间模型中的建设性端元。因此，使用那些最具代表性的像素特征来训练一个集中的子空间有望增强目标和背景之间的可分性。同时，将这些训练数据中的判别信息应用于不属于同一特征空间且数据分布不同的大量测试数据是一个挑战。这里采用了视频中交互式标注技术的迁移学习思想。基于迁移学习框架，考虑了几点，并将所提出的方法命名为基于无监督迁移学习的目标检测（UTLD）算法。大量的实验表明，其性能可与先进的目标检测方法相媲美。

UTLD算法：

从稳健的异常值检测生成极端目标和背景像素，为迁移学习中的目标样本和背景样本提供输入；
像素是根据分割方法中的根点计算的，目的是在缩小维度之后保留背景的最大分布特征；
迁移学习过程中施加了稀疏约束，有了这个约束，可以构建一个更简单，更集中的子空间，并且具有明确的物理意义。

1.Introduction

目标检测的首要关键是目标的特征。在高光谱图像的目标检测中，最广泛使用的是光谱特征。常用的模型有线性混合模型与子空间模型，这两种模型均呈现出较好的性能，然而这两种物理模型需要先验信息。还有一种是取决于统计模型，对目标没有预先的知识，它被称为无监督的（包括异常检测）。

这些常规方法中需要手动选择目标像素和背景像素，然后用于构建基于子空间的检测器，其中目标像素和背景像素被假定为可分离的。然而，训练像素的数量通常是有限的，并且相应构造的子空间可能过度拟合训练像素，从而不能精确地检测剩余目标像素。我们能否找到一些方法来保存判别信息并避免过拟合？迁移学习已经显示出其在有限的样本中学习子空间的良好性能，因此它被引入到本文中高光谱图像的目标检测中。重点研究利用训练样本的判别信息和从训练目标/背景样本和那些未标记样本中学习一个合适的子空间，这篇文章为高光谱目标检测做出了几点贡献：

使用多元异常值分析来选择目标像素与背景像素并将其作为positive training 和 negative training的训练样本（现有的目标检测方法主要依赖于手动选择像素作为训练样本）。
采用分割方法来获得最具代表性和信息量的未标记样本。这样可以充分考虑高光谱图像中丰富的连续空间特征（现有方法通常随机选择未标记的样本，或者图像中的所有样本用于学习检测器，如CEM）。
通过训练标注样本（包括positive样本和negative样本）和未标记样本，制定了基于迁移学习的子空间构建方法。如果使用成对的判别分析来增强目标背景像素的可分离性，高光谱图像的现有目标检测方法主要依靠标记样本构造子空间。

2.多元异常检测的无监督目标识别

迁移学习需要用到positive样本和negative样本。positive样本指目标像素，negative样本包含非目标像素与背景像素。这一部分主要是选择训练样本，样本包含正样本和负样本。

多元异常分析的主要思想是迭代计算来自图像数据集的背景像素的均值和协方差矩阵，以构建一个最佳的基于马氏距离的检测器，并最终提取可能的异常值，具体过程如下：

随机选择图像中1/3像素作为初始基本子集；
计算每个像素的均值向量与自相关矩阵；
计算每个像素向量的马氏距离；
设置阈值η，并且将具有阈值η以下的距离的图像中的像素设置为新的基本子集。阈值计算如下所示：
重复步骤2-4直到基本子集没有变化为止；
将最终基本子集排除的作为异常值，最终基本子集构成背景像素。

以上是BACON的基本思路。已经证明，在每次迭代中，BACON包含距离基本子集小于η的像素，但迭代次数通常很小。此外，它通过更新迭代中的基本子集来搜索最合理的均值向量和协方差矩阵来检测异常像素。最终的平均值往往会偏向非外围背景像素的真实中心。

从数据集中排除的异常值可能包含光谱异常，主要是噪声像素或罕见的不感兴趣的像素。为了消除光谱异常像素，需要进一步研究所有排除的像素。丢弃其中一半规格较大的像素，剩余的像素被用作正样本。至于背景像素，它们通过k-means聚类成几个组，这些组的数量等于正样本数量的三倍。在每个组中，选择与所有正样本的平均距离最大的像素，所有选择的背景像素都包含最终的负样本。利用正面和负面的样本，可以构建成对的区分信息，这将在第4部分中详细介绍。

3.未标记像素的获取

在本节中，进行分割和随后的流形分析以获得未标记的样本，这是迁移学习所必需的。其目的是充分利用高光谱图像的空间特征和流形特征，获得适当的未标记样本进行迁移学习。

通常情况下，只有高质量的未标记样本才能正确表示数据的分布，这些分布在迁移学习过程中使用以避免过度拟合问题。最常见的做法是将点的子集随机抽样为未标记的样本。然而，对于统计学中的大类小类并不适用。对于这个问题，文章中使用了一种高效的基于图形的图像分割方法，极大程度地将图像分割成小区域。它可以减小样本大小来表征均匀区域，并每个小均匀区域中的像素具有较高的相似性并且可以共享相同的标签。每个区域中的一个代表像素可以被选作未标记样本。

高效的基于图形的图像分割直接在特征空间中的数据点上工作并使用单链接聚类上的变化。为了执行传统的单链接聚类，首先生成数据点的最小生成树。其具体做法如下：

高效的基于图形分割算法，如式（8）中所示，使用了可变阈值来合并两个分量的单连接聚类。并且根据数据点生成最小生成树，文章中k值设置为0.8，适用于大多数高光谱图像。

半监督学习方法的一个常见假设是标记和未标记的样本位于相同的子流形中。因此，现有标记数据集和未标记候选之间的相关关系被应用于丢弃不相关的未标记样本。为了实现这个目标，完成上述分割过程以获得分割区域。在每个区域中，首先合并的两个顶点被命名为该区域的根。每个地区的根源之一被选作未标记样本。然后，我们寻找图像中每个未标记样本的t个光谱最近邻。对于每个未标记的样本，如果其邻居中存在标记样本，则相关性即退出。因此，这个未标记的候选者应该在最终的未标记集合中选择。否则，未标记的样品将被丢弃。请注意，邻居的数量t控制着这个相关性标准。在实践中，我们应该设置更大的t来放宽对这个选择过程的约束，以便容忍更多的频谱可变性。我们在实验中将t固定为20。最后，我们将在分割图像上获得剩余的未标记样本，将其输入到迁移学习过程中以保留分布属性。

4.迁移学习目标检测

在2,3两节中，我们已经得到了标记的目标/背景样本以及未标记的样本，在本章中将构建目标检测子空间。

4.1判别式流形

流形学习：一个前提是manifold中足够小的区域近似于欧式空间，流形学习目的是构造保留原始输入特征的低维表示的局部几何特性。

LDA探索成对判别信息以最大化不相似对之间的距离并使相似对之间的距离最小化。对于目标检测，降维后的子空间应该能够使目标样本和背景样本之间的距离最大化，并分别使目标样本和背景样本内的距离最小化。换句话说，目标 - 目标样本对应尽可能接近并且目标 - 背景样本对在学习子空间中尽可能地远离。这种成对区分降维问题的优化可以用类似于补丁对齐框架的方式来制定。在低维特征空间中，对于目标类别t_i的每个样本，我们预期给定样本与目标类别中其他样本之间的欧几里德距离尽可能小，而给定样本与其他样本之间的距离在后台阶级尽可能大，即

结合式（9）（10）可以引入参数c得到

可以进一步优化为如下：

此时完成了一个区域的部分，进一步的可以将目标类别的样本推广到整个图像中，得到全局的结果。

4.2迁移正则化

然而目标样本（或正样本）非常少见，并且背景样本（或负样本）也存在少量。通过这些样本，学习了一个子空间，它只能根据先前给定的训练信息最大限度地将目标样本与背景样本分开。由此产生的子空间会对有限的训练样本产生偏差，并且主导的结构分布也发生变化。此时需要用到迁移学习，他被用来保存从训练数据到不在同一特征空间和不同数据分布的测试数据的判别信息。本文将大量未标记样本提供的显性结构分布作为正则化来寻找一个子空间，该子空间应该将判别信息从训练数据转化为误差少的子序列的训练数据。

主成分分析（Principal Component Analysis，PCA）是一种根据数据矩阵的最大方差寻找主成分的线性变换，因此分布的主要结构可以很好地保留在子空间中。用P表示PCA投影矩阵，迁移正则化的目的是最小化目标子空间和PCA子空间中未标记样本数据矩阵之间的欧氏距离。

将判别式流形嵌入与正则化迁移结合为。由于样本数较少且高光谱图像维度高，这里W中可能包含很多0元素，因此需要采用稀疏约束。在稀疏公式中，关键是控制投影矩阵W的非零元素的数量。结合1范数和2范数构建目标函数：

目标函数（26）中有三个参数β，φ1和φ2，再加上系数向量（11）中的参数c。在本文中，为了避免交叉验证，我们根据它们的物理意义手动设置这些参数。β揭示了判别式流形嵌入和迁移正则化之间的权重，因此可以由输入样本的数量决定，即我们将其设置在N12 / M左右。φ1和φ2是稀疏正则化的权重，也由给定的数据决定。c是判别式流形嵌入中的参数，用于控制目标类别和背景类别的最小化，设置在N2 / N1周围。

4.3解决问题

将目标函数做一系列优化，得到

最后，利用降维的数据，采用简单的KNN分类和阈值处理来区分目标和背景。该方法的整个流程图如图1所示。

5.实验结果

5.1数据集

Urban数据集以及Hymap数据集

5.2检测性能

对比算法：local-RX，global-RX，CBAD（Cluster Based Anomaly Detector），ACE（自适应余弦估计）和AMSD（自适应匹配子空间检测器）。共5种算法用来做对比。

使用Urban数据集，得到的ROC曲线如下所示，可以看到检测性能有了极大地提升：

下图展示了使用HYMAP数据集，在相同虚警率条件下检测到的全局像素和子目标像素的数量，可以看到6种算法对全部像素检测性能基本一致，但对于亚像素目标而言有了很大的区别。可以明显的看出，UTLD算法在同等条件下可以检测到更多的目标，有着更好的性能。

与其他算法相比，UTLD算法能够提高目标检测性能的原因有如下几点：

多元异常值分析在选取感兴趣目标方向有优势，流形分析对于选择背景样本非常有用；
在子空间学习过程中增加成对的判别式约束。因此每个目标样本都被约束为与背景样本分离，目标样本的区分信息在UTLD中得到更充分的应用。
标记训练样本的数量有限通常会导致小样本量（SSS）问题，特别是对于高维特征提取。通过基于稀疏的迁移学习，SSS问题可以得到缓解。通过利用未标记的样品，也可以避免过度拟合。
在机器学习社区中，随机选择未标记样本进行降维或子空间学习方法是很常见的。对于高光谱图像，不同的地物以不同的空间分布，因此需要考虑大多数地物分布模式，从图像中选取未标记的样本，以获得具有代表性的标记样本。

文章5.3和5.4两节使用进一步的实验证实了后两点性能提升的原因。

6.总结

本文提出了一种基于迁移学习的无监督目标检测方法。首先将更多可检测的目标与背景的光谱差异与背景分离，其中使用稳健的异常值检测方法。分割方法用于获取未标记的样本。检测和分割结果都为转移学习提供了样本，构建了一个低维子空间，以更好地将目标与背景分离。利用真实的高光谱遥感图像的实验结果表明，这种自动目标检测性能优于最先进的方法，特别是在那些亚像素目标上。未来的研究重点是如何自动确定最优参数，从而将所提出的方法应用于实现更好的性能。

### 本文为作者原创文章，第一次阅读迁移学习方向的论文，尤其对于第4部分还不是很理解，欢迎大家共同讨论 ###

机器学习与深度学习间关系与区别 ℒℴѵℯ心·动ꦿ໊ོ꫞ 人工智能学习深度学习 python
一、机器学习概述定义机器学习（MachineLearning,ML）是一种通过数据驱动的方法，利用统计学和计算算法来训练模型，使计算机能够从数据中学习并自动进行预测或决策。机器学习通过分析大量数据样本，识别其中的模式和规律，从而对新的数据进行判断。其核心在于通过训练过程，让模型不断优化和提升其预测准确性。主要类型1.监督学习（SupervisedLearning）监督学习是指在训练数据集中包含输入
数字里的世界17期：2021年全球10大顶级数据中心，中国移动榜首张三叨
你知道吗？2016年，全球的数据中心共计用电4160亿千瓦时，比整个英国的发电量还多40％！前言每天，我们都会创造超过250万TB的数据。并且随着物联网（IOT）的不断普及，这一数据将持续增长。如此庞大的数据被存储在被称为“数据中心”的专用设施中。虽然最早的数据中心建于20世纪40年代，但直到1997-2000年的互联网泡沫期间才逐渐成为主流。当前人类的技术，比如人工智能和机器学习，已经将我们推向
nosql数据库技术与应用知识点皆过客，揽星河 NoSQL nosql 数据库大数据数据分析数据结构非关系型数据库
Nosql知识回顾大数据处理流程数据采集(flume、爬虫、传感器)数据存储(本门课程NoSQL所处的阶段)Hdfs、MongoDB、HBase等数据清洗(入仓)Hive等数据处理、分析(Spark、Flink等)数据可视化数据挖掘、机器学习应用(Python、SparkMLlib等)大数据时代存储的挑战(三高)高并发(同一时间很多人访问)高扩展(要求随时根据需求扩展存储)高效率(要求读写速度快)
Python开发常用的三方模块如下：换个网名有点难 python 开发语言
Python是一门功能强大的编程语言，拥有丰富的第三方库，这些库为开发者提供了极大的便利。以下是100个常用的Python库，涵盖了多个领域：1、NumPy，用于科学计算的基础库。2、Pandas，提供数据结构和数据分析工具。3、Matplotlib，一个绘图库。4、Scikit-learn，机器学习库。5、SciPy，用于数学、科学和工程的库。6、TensorFlow，由Google开发的开源机
Python实现简单的机器学习算法 master_chenchengg python python 办公效率 python开发 IT
Python实现简单的机器学习算法开篇：初探机器学习的奇妙之旅搭建环境：一切从安装开始必备工具箱第一步：安装Anaconda和JupyterNotebook小贴士：如何配置Python环境变量算法初体验：从零开始的Python机器学习线性回归：让数据说话数据准备：从哪里找数据编码实战：Python实现线性回归模型评估：如何判断模型好坏逻辑回归：从分类开始理论入门：什么是逻辑回归代码实现：使用skl
遥感影像的切片处理 sand&wich 计算机视觉 python 图像处理
在遥感影像分析中，经常需要将大尺寸的影像切分成小片段，以便于进行详细的分析和处理。这种方法特别适用于机器学习和图像处理任务，如对象检测、图像分类等。以下是如何使用Python和OpenCV库来实现这一过程，同时确保每个影像片段保留正确的地理信息。准备环境首先，确保安装了必要的Python库，包括numpy、opencv-python和xml.etree.ElementTree。这些库将用于图像处理
ai绘画工具midjourney怎么下载？附作品管理教程设计师早上好
Midjourney是一款功能强大的AI绘画工具，它使用机器学习技术和深度神经网络等算法，可以生成各种艺术风格的绘画作品。在创意设计、广告宣传等方面有着广泛的应用前景。那么，ai绘画工具midjourney怎么下载？本文将为您介绍Midjourney的下载以及作品的相关管理。一、Midjourney下载Midjourney的下载非常简单，只需打开Midjourney官网（点击“GetMidjour
[实践应用] 深度学习之模型性能评估指标 YuanDaima2048 深度学习工具使用深度学习人工智能损失函数性能评估 pytorch python 机器学习
文章总览：YuanDaiMa2048博客文章总览深度学习之模型性能评估指标分类任务回归任务排序任务聚类任务生成任务其他介绍在机器学习和深度学习领域，评估模型性能是一项至关重要的任务。不同的学习任务需要不同的性能指标来衡量模型的有效性。以下是对一些常见任务及其相应的性能评估指标的详细解释和总结。分类任务分类任务是指模型需要将输入数据分配到预定义的类别或标签中。以下是分类任务中常用的性能指标：准确率(
机器学习-聚类算法不良人龍木木机器学习机器学习算法聚类
机器学习-聚类算法1.AHC2.K-means3.SC4.MCL仅个人笔记，感谢点赞关注！1.AHC2.K-means3.SC传统谱聚类：个人对谱聚类算法的理解以及改进4.MCL目前仅专注于NLP的技术学习和分享感谢大家的关注与支持！
未来软件市场是怎么样的？做开发的生存空间如何？ cesske 软件需求
目录前言一、未来软件市场的发展趋势二、软件开发人员的生存空间前言未来软件市场是怎么样的？做开发的生存空间如何？一、未来软件市场的发展趋势技术趋势：人工智能与机器学习：随着技术的不断成熟，人工智能将在更多领域得到应用，如智能客服、自动驾驶、智能制造等，这将极大地推动软件市场的增长。云计算与大数据：云计算服务将继续普及，大数据技术的应用也将更加广泛。企业将更加依赖云计算和大数据来优化运营、提升效率，并
python中zeros用法_Python中的numpy.zeros()用法江平舟 python中zeros用法
numpy.zeros()函数是最重要的函数之一,广泛用于机器学习程序中。此函数用于生成包含零的数组。numpy.zeros()函数提供给定形状和类型的新数组,并用零填充。句法numpy.zeros(shape,dtype=float,order='C'参数形状：整数或整数元组此参数用于定义数组的尺寸。此参数用于我们要在其中创建数组的形状,例如(3,2)或2。dtype：数据类型(可选)此参数用于
【NumPy】深入解析numpy.zeros()函数二七830 numpy
欢迎莅临我的个人主页这里是我深耕Python编程、机器学习和自然语言处理（NLP）领域，并乐于分享知识与经验的小天地！博主简介：我是二七830，一名对技术充满热情的探索者。多年的Python编程和机器学习实践，使我深入理解了这些技术的核心原理，并能够在实际项目中灵活应用。尤其是在NLP领域，我积累了丰富的经验，能够处理各种复杂的自然语言任务。技术专长：我熟练掌握Python编程语言，并深入研究了机
【中国国际航空-注册_登录安全分析报告】风控牛验证码接口安全评测系列安全行为验证极验网易易盾智能手机
前言由于网站注册入口容易被黑客攻击，存在如下安全问题：1.暴力破解密码，造成用户信息泄露2.短信盗刷的安全问题，影响业务及导致用户投诉3.带来经济损失，尤其是后付费客户，风险巨大，造成亏损无底洞所以大部分网站及App都采取图形验证码或滑动验证码等交互解决方案，但在机器学习能力提高的当下，连百度这样的大厂都遭受攻击导致点名批评，图形验证及交互验证方式的安全性到底如何？请看具体分析一、中国国际航空PC
机器学习流形数据降维：UMAP 降维算法小嗷犬 Python 机器学习 #数据分析及可视化机器学习算法人工智能
✅作者简介：人工智能专业本科在读，喜欢计算机与编程，写博客记录自己的学习历程。个人主页：小嗷犬的个人主页个人网站：小嗷犬的技术小站个人信条：为天地立心，为生民立命，为往圣继绝学，为万世开太平。本文目录UMAP简介理论基础特点与优势应用场景在Python中使用UMAP安装umap-learn库使用UMAP可视化手写数字数据集UMAP简介UMAP（UniformManifoldApproximatio
七.正则化愿风去了
吴恩达机器学习之正则化（Regularization）http://www.cnblogs.com/jianxinzhou/p/4083921.html从数学公式上理解L1和L2https://blog.csdn.net/b876144622/article/details/81276818虽然在线性回归中加入基函数会使模型更加灵活，但是很容易引起数据的过拟合。例如将数据投影到30维的基函数上，模
机器学习-------数据标准化罔闻_spider 数据分析算法机器学习人工智能
什么是归一化，它与标准化的区别是什么？一作用在做训练时，需要先将特征值与标签标准化，可以防止梯度防炸和过拟合；将标签标准化后，网络预测出的数据是符合标准正态分布的—StandarScaler()，与真实值有很大差别。因为StandarScaler()对数据的处理是（真实值-平均值）/标准差。同时在做预测时需要将输出数据逆标准化提升模型精度：标准化/归一化使不同维度的特征在数值上更具比较性，提高分类
分享一个基于python的电子书数据采集与可视化分析 hadoop电子书数据分析与推荐系统 spark大数据毕设项目（源码、调试、LW、开题、PPT) 计算机源码社 Python项目大数据大数据 python hadoop 计算机毕业设计选题计算机毕业设计源码数据分析 spark毕设
作者：计算机源码社个人简介：本人八年开发经验，擅长Java、Python、PHP、.NET、Node.js、Android、微信小程序、爬虫、大数据、机器学习等，大家有这一块的问题可以一起交流！学习资料、程序开发、技术解答、文档报告如需要源码，可以扫取文章下方二维码联系咨询Java项目微信小程序项目Android项目Python项目PHP项目ASP.NET项目Node.js项目选题推荐项目实战|p
两种方法判断Python的位数是32位还是64位 sanqima Python编程电脑 python 开发语言
Python从1991年发布以来，凭借其简洁、清晰、易读的语法、丰富的标准库和第三方工具，在Web开发、自动化测试、人工智能、图形识别、机器学习等领域发展迅猛。 Python是一种胶水语言，通过Cython库与C/C++语言进行链接，通过Jython库与Java语言进行链接。 Python是跨平台的，可运行在多种操作系统上，包括但不限于Windows、Linux和macOS。这意味着用Py
使用最大边际相关性(MMR)选择示例：提高AI模型的多样性和相关性 aehrutktrjk 人工智能 easyui 前端 python
使用最大边际相关性(MMR)选择示例：提高AI模型的多样性和相关性引言在机器学习和自然语言处理领域，选择合适的训练示例对模型性能至关重要。最大边际相关性(MaximalMarginalRelevance,MMR)是一种优秀的示例选择方法，它不仅考虑了示例与输入的相关性，还注重保持所选示例之间的多样性。本文将深入探讨如何使用MMR来选择示例，以提高AI模型的性能和泛化能力。什么是最大边际相关性(MM
LangChain集成指南:如何利用多样化的AI提供商 aehrutktrjk 人工智能 langchain python
LangChain集成指南:如何利用多样化的AI提供商引言在人工智能和机器学习领域,LangChain已成为一个强大而灵活的框架,允许开发者轻松集成各种AI服务提供商。本文将深入探讨LangChain的集成能力,介绍如何利用不同的AI提供商来增强你的应用程序,并提供实用的代码示例。LangChain集成概览LangChain支持多种AI提供商的集成,这些集成可以分为两类:独立包集成:这些提供商有独
机器学习VS深度学习 nfgo 机器学习
机器学习（MachineLearning,ML）和深度学习（DeepLearning,DL）是人工智能（AI）的两个子领域，它们有许多相似之处，但在技术实现和应用范围上也有显著区别。下面从几个方面对两者进行区分：1.概念层面机器学习：是让计算机通过算法从数据中自动学习和改进的技术。它依赖于手动设计的特征和数学模型来进行学习，常用的模型有决策树、支持向量机、线性回归等。深度学习：是机器学习的一个子领
大数据毕业设计hadoop+spark+hive知识图谱租房数据分析可视化大屏租房推荐系统 58同城租房爬虫房源推荐系统房价预测系统计算机毕业设计机器学习深度学习人工智能 2401_84572577 程序员大数据 hadoop 人工智能
做了那么多年开发，自学了很多门编程语言，我很明白学习资源对于学一门新语言的重要性，这些年也收藏了不少的Python干货，对我来说这些东西确实已经用不到了，但对于准备自学Python的人来说，或许它就是一个宝藏，可以给你省去很多的时间和精力。别在网上瞎学了，我最近也做了一些资源的更新，只要你是我的粉丝，这期福利你都可拿走。我先来介绍一下这些东西怎么用，文末抱走。（1）Python所有方向的学习路线（
【机器学习与R语言】1-机器学习简介苹果酱0567 面试题汇总与解析 java 中间件开发语言 spring boot 后端
1.基本概念机器学习：发明算法将数据转化为智能行为数据挖掘VS机器学习：前者侧重寻找有价值的信息，后者侧重执行已知的任务。后者是前者的先期准备过程：数据——>抽象化——>一般化。或者：收集数据——推理数据——归纳数据——发现规律抽象化：训练：用一个特定模型来拟合数据集的过程用方程来拟合观测的数据：观测现象——数据呈现——模型建立。通过不同的格式来把信息概念化一般化：一般化：将抽象化的知识转换成可用
Python前沿技术：机器学习与人工智能 4.0啊 Python 人工智能 python 机器学习
Python前沿技术：机器学习与人工智能一、引言随着科技的飞速发展，机器学习和人工智能（AI）已经成为了计算机科学领域的热门话题。Python作为一门易学易用且功能强大的编程语言，已经成为了这两个领域的首选语言之一。本文将深入探讨Python在机器学习和人工智能领域的应用，以及一些前沿技术和工具。二、Python机器学习基础2.1机器学习概述机器学习是人工智能（AI）的一个关键子集，它的核心在于让
chatgpt赋能python：如何在Python中计算平均值 tulingtest ChatGpt python chatgpt numpy 计算机
如何在Python中计算平均值计算平均值是数据分析、统计和机器学习等许多领域中的常见任务。Python作为一门功能强大且易于学习的编程语言，为计算平均值提供了多种方法。在本文中，我们将介绍如何在Python中计算平均值。什么是平均值简单来说，平均值是一组数字的总和除以数字的数量。例如，对于数字序列1，3，5，7，9，平均值是(1+3+5+7+9)/5=5。平均值在数据分析中非常有用，因为它可以提供
Python 初学者入门必知： Anaconda是什么？有什么作用？怎么使用？懒大王爱吃狼 Python基础 python 开发语言 python基础 python学习 anaconda anaconda安装 python教程
初学者在学习Python时，经常看到的一个名字是Anaconda。究竟什么是Anaconda，为什么它如此受欢迎？在这篇文章中，我们将探讨Anaconda，了解Anaconda的从安装到使用的。Anaconda是一个免费开源的Python和R编程发行版，包含上千个适用于数据科学和机器学习的包。同时，配备了Spyder和Jupyternotebook等工具，初学者可以使用它们来学习Python，使用
每天五分钟玩转深度学习PyTorch：模型参数优化器torch.optim 幻风_huanfeng 深度学习框架pytorch 深度学习 pytorch 人工智能神经网络机器学习优化算法
本文重点在机器学习或者深度学习中，我们需要通过修改参数使得损失函数最小化(或最大化)，优化算法就是一种调整模型参数更新的策略。在pytorch中定义了优化器optim，我们可以使用它调用封装好的优化算法，然后传递给它神经网络模型参数，就可以对模型进行优化。本文是学习第6步(优化器)，参考链接pytorch的学习路线随机梯度下降算法在深度学习和机器学习中，梯度下降算法是最常用的参数更新方法，它的公式
一切皆是映射：AI的去中心化：区块链技术的融合 AI大模型应用之禅计算科学神经计算深度学习神经网络大数据人工智能大型语言模型 AI AGI LLM Java Python 架构设计 Agent RPA
一切皆是映射：AI的去中心化：区块链技术的融合作者：禅与计算机程序设计艺术/ZenandtheArtofComputerProgramming关键词：AI，区块链，去中心化，智能合约，共识机制，数据安全，隐私保护，分布式账本技术，机器学习，数据隐私1.背景介绍1.1问题的由来随着人工智能（AI）技术的快速发展，其在各个领域的应用越来越广泛，从自动驾驶、智能医疗到金融服务，AI正在改变着我们的生活。
第五届核磁机器学习班（训练营：2023.6.5~6.17）茗创科技
茗创科技专注于脑科学数据处理，涵盖（EEG/ERP,fMRI,结构像,DTI,ASL,FNIRS）等，欢迎留言讨论及转发推荐，也欢迎了解茗创科技的脑电课程，数据处理服务及脑科学工作站销售业务，可添加我们的工程师（微信号MCKJ-zhouyi或17373158786）咨询。★课程简介★基于血氧水平依赖的功能磁共振成像(fMRI)技术,利用其数据构建的功能性脑网络后,发现脑并不是一个单纯对外界刺激进行
如何有效的学习AI大模型？ Python程序员罗宾学习人工智能语言模型自然语言处理架构
学习AI大模型是一个系统性的过程，涉及到多个学科的知识。以下是一些建议，帮助你更有效地学习AI大模型：基础知识储备：数学基础：学习线性代数、概率论、统计学和微积分等，这些是理解机器学习算法的数学基础。编程技能：掌握至少一种编程语言，如Python，因为大多数AI模型都是用Python实现的。理论学习：机器学习基础：了解监督学习、非监督学习、强化学习等基本概念。深度学习：学习神经网络的基本结构，如卷
mondb入手木zi_鸣 mongodb
windows 启动mongodb 编写bat文件， mongod --dbpath D:\software\MongoDBDATA mongod --help 查询各种配置配置在mongob 打开批处理，即可启动，27017原生端口，shell操作监控端口扩展28017，web端操作端口启动配置文件配置，数据更灵活
大型高并发高负载网站的系统架构 bijian1013 高并发负载均衡
扩展Web应用程序一.概念简单的来说，如果一个系统可扩展，那么你可以通过扩展来提供系统的性能。这代表着系统能够容纳更高的负载、更大的数据集，并且系统是可维护的。扩展和语言、某项具体的技术都是无关的。扩展可以分为两种： 1.
DISPLAY变量和xhost(原创) czmmiao display
DISPLAY 在Linux/Unix类操作系统上, DISPLAY用来设置将图形显示到何处. 直接登陆图形界面或者登陆命令行界面后使用startx启动图形, DISPLAY环境变量将自动设置为:0:0, 此时可以打开终端, 输出图形程序的名称(比如xclock)来启动程序, 图形将显示在本地窗口上, 在终端上输入printenv查看当前环境变量, 输出结果中有如下内容:DISPLAY=:0.0
获取B/S客户端IP 周凡杨 java 编程 jsp Web 浏览器
最近想写个B/S架构的聊天系统，因为以前做过C/S架构的QQ聊天系统，所以对于Socket通信编程只是一个巩固。对于C/S架构的聊天系统，由于存在客户端Java应用，所以直接在代码中获取客户端的IP，应用的方法为： String ip = InetAddress.getLocalHost().getHostAddress(); 然而对于WEB
浅谈类和对象朱辉辉33 编程
类是对一类事物的总称，对象是描述一个物体的特征，类是对象的抽象。简单来说，类是抽象的，不占用内存，对象是具体的，占用存储空间。类是由属性和方法构成的，基本格式是public class 类名{ //定义属性 private/public 数据类型属性名； //定义方法 publ
android activity与viewpager+fragment的生命周期问题肆无忌惮_ viewpager
有一个Activity里面是ViewPager，ViewPager里面放了两个Fragment。第一次进入这个Activity。开启了服务，并在onResume方法中绑定服务后，对Service进行了一定的初始化，其中调用了Fragment中的一个属性。 super.onResume(); bindService(intent, conn, BIND_AUTO_CREATE);
base64Encode对图片进行编码 843977358 base64 图片 encoder
/** * 对图片进行base64encoder编码 * * @author mrZhang * @param path * @return */ public static String encodeImage(String path) { BASE64Encoder encoder = null; byte[] b = null; I
Request Header简介 aigo servlet
当一个客户端(通常是浏览器)向Web服务器发送一个请求是，它要发送一个请求的命令行，一般是GET或POST命令，当发送POST命令时，它还必须向服务器发送一个叫“Content-Length”的请求头(Request Header) 用以指明请求数据的长度，除了Content-Length之外，它还可以向服务器发送其它一些Headers，如：
HttpClient4.3 创建SSL协议的HttpClient对象 alleni123 httpclient 爬虫 ssl
public class HttpClientUtils { public static CloseableHttpClient createSSLClientDefault(CookieStore cookies){ SSLContext sslContext=null; try { sslContext=new SSLContextBuilder().l
java取反 -右移-左移-无符号右移的探讨百合不是茶位运算符位移
取反：在二进制中第一位，1表示符数，0表示正数 byte a = -1; 原码：10000001 反码：11111110 补码：11111111 //异或: 00000000 byte b = -2; 原码：10000010 反码：11111101 补码：11111110 //异或: 00000001
java多线程join的作用与用法 bijian1013 java 多线程
对于JAVA的join，JDK 是这样说的：join public final void join （long millis ）throws InterruptedException Waits at most millis milliseconds for this thread to die. A timeout of 0 means t
Java发送http请求(get 与post方法请求) bijian1013 java spring
PostRequest.java package com.bijian.study; import java.io.BufferedReader; import java.io.DataOutputStream; import java.io.IOException; import java.io.InputStreamReader; import java.net.HttpURL
【Struts2二】struts.xml中package下的action配置项默认值 bit1129 struts.xml
在第一部份，定义了struts.xml文件，如下所示： <!DOCTYPE struts PUBLIC "-//Apache Software Foundation//DTD Struts Configuration 2.3//EN" "http://struts.apache.org/dtds/struts
【Kafka十三】Kafka Simple Consumer bit1129 simple
代码中关于Host和Port是割裂开的，这会导致单机环境下的伪分布式Kafka集群环境下，这个例子没法运行。实际情况是需要将host和port绑定到一起， package kafka.examples.lowlevel; import kafka.api.FetchRequest; import kafka.api.FetchRequestBuilder; impo
nodejs学习api ronin47 nodejs api
NodeJS基础什么是NodeJS JS是脚本语言，脚本语言都需要一个解析器才能运行。对于写在HTML页面里的JS，浏览器充当了解析器的角色。而对于需要独立运行的JS，NodeJS就是一个解析器。每一种解析器都是一个运行环境，不但允许JS定义各种数据结构，进行各种计算，还允许JS使用运行环境提供的内置对象和方法做一些事情。例如运行在浏览器中的JS的用途是操作DOM，浏览器就提供了docum
java-64.寻找第N个丑数 bylijinnan java
public class UglyNumber { /** * 64.查找第N个丑数具体思路可参考 [url] http://zhedahht.blog.163.com/blog/static/2541117420094245366965/[/url] * 题目：我们把只包含因子 2、3和5的数称作丑数（Ugly Number）。例如6、8都是丑数，但14
二维数组（矩阵）对角线输出 bylijinnan 二维数组
/** 二维数组对角线输出两个方向例如对于数组： { 1, 2, 3, 4 }, { 5, 6, 7, 8 }, { 9, 10, 11, 12 }, { 13, 14, 15, 16 }, slash方向输出： 1 5 2 9 6 3 13 10 7 4 14 11 8 15 12 16 backslash输出： 4 3
[JWFD开源工作流设计]工作流跳跃模式开发关键点(今日更新) comsci 工作流
既然是做开源软件的,我们的宗旨就是给大家分享设计和代码,那么现在我就用很简单扼要的语言来透露这个跳跃模式的设计原理大家如果用过JWFD的ARC-自动运行控制器,或者看过代码,应该知道在ARC算法模块中有一个函数叫做SAN(),这个函数就是ARC的核心控制器,要实现跳跃模式,在SAN函数中一定要对LN链表数据结构进行操作,首先写一段代码,把
redis常见使用 cuityang redis 常见使用
redis 通常被认为是一个数据结构服务器，主要是因为其有着丰富的数据结构 strings、map、 list、sets、 sorted sets 引入jar包 jedis-2.1.0.jar (本文下方提供下载) package redistest; import redis.clients.jedis.Jedis; public class Listtest
配置多个redis dalan_123 redis
配置多个redis客户端 <?xml version="1.0" encoding="UTF-8"?><beans xmlns="http://www.springframework.org/schema/beans" xmlns:xsi=&quo
attrib命令 dcj3sjt126com attr
attrib指令用于修改文件的属性.文件的常见属性有:只读.存档.隐藏和系统. 只读属性是指文件只可以做读的操作.不能对文件进行写的操作.就是文件的写保护. 存档属性是用来标记文件改动的.即在上一次备份后文件有所改动.一些备份软件在备份的时候会只去备份带有存档属性的文件.
Yii使用公共函数 dcj3sjt126com yii
在网站项目中，没必要把公用的函数写成一个工具类，有时候面向过程其实更方便。在入口文件index.php里添加 require_once('protected/function.php'); 即可对其引用，成为公用的函数集合。 function.php如下： <?php /** * This is the shortcut to D
linux 系统资源的查看（free、uname、uptime、netstat） eksliang netstat linux uname linux uptime linux free
linux 系统资源的查看转载请出自出处：http://eksliang.iteye.com/blog/2167081 http://eksliang.iteye.com 一、free查看内存的使用情况语法如下： free [-b][-k][-m][-g] [-t] 参数含义 -b:直接输入free时，显示的单位是kb我们可以使用b(bytes),m
JAVA的位操作符 greemranqq 位运算 JAVA位移 <<>>>
最近几种进制，加上各种位操作符，发现都比较模糊，不能完全掌握，这里就再熟悉熟悉。 1.按位操作符：按位操作符是用来操作基本数据类型中的单个bit,即二进制位，会对两个参数执行布尔代数运算，获得结果。与（&）运算： 1&1 = 1, 1&0 = 0, 0&0 &
Web前段学习网站 ihuning Web
Web前段学习网站菜鸟学习：http://www.w3cschool.cc/ JQuery中文网：http://www.jquerycn.cn/ 内存溢出：http://outofmemory.cn/#csdn.blog http://www.icoolxue.com/ http://www.jikexue
强强联合：FluxBB 作者加盟 Flarum justjavac r
原文：FluxBB Joins Forces With Flarum作者：Toby Zerner译文：强强联合：FluxBB 作者加盟 Flarum译者：justjavac FluxBB 是一个快速、轻量级论坛软件，它的开发者是一名德国的 PHP 天才 Franz Liedke。FluxBB 的下一个版本(2.0)将被完全重写，并已经开发了一段时间。FluxBB 看起来非常有前途的，
java统计在线人数（session存储信息的） macroli java Web
这篇日志是我写的第三次了前两次都发布失败！郁闷极了！由于在web开发中常常用到这一部分所以在此记录一下，呵呵，就到备忘录了！我对于登录信息时使用session存储的，所以我这里是通过实现HttpSessionAttributeListener这个接口完成的。 1、实现接口类，在web.xml文件中配置监听类，从而可以使该类完成其工作。 public class Ses
bootstrp carousel初体验快速构建图片播放 qiaolevip 每天进步一点点学习永无止境 bootstrap 纵观千象
img{ border: 1px solid white; box-shadow: 2px 2px 12px #333; _width: expression(this.width > 600 ? "600px" : this.width + "px"); _height: expression(this.width &
SparkSQL读取HBase数据，通过自定义外部数据源 superlxw1234 spark sparksql sparksql读取hbase sparksql外部数据源
关键字：SparkSQL读取HBase、SparkSQL自定义外部数据源前面文章介绍了SparSQL通过Hive操作HBase表。 SparkSQL从1.2开始支持自定义外部数据源(External DataSource)，这样就可以通过API接口来实现自己的外部数据源。这里基于Spark1.4.0，简单介绍SparkSQL自定义外部数据源，访
Spring Boot 1.3.0.M1发布 wiselyman spring boot
Spring Boot 1.3.0.M1于6.12日发布，现在可以从Spring milestone repository下载。这个版本是基于Spring Framework 4.2.0.RC1,并在Spring Boot 1.2之上提供了大量的新特性improvements and new features。主要包含以下： 1.提供一个新的sprin