静静的喝酒

机器学习笔记之高斯分布(三)——从几何角度观察多维高斯分布

机器学习笔记之高斯分布——从几何角度观察多维高斯分布

引言
- 回顾：一维高斯分布
- 多维高斯分布
- 高斯分布的局限性(2022/11/18)
- - 回顾：协方差矩阵，马氏距离
  - 局限性的具体体现
- 总结

引言

回顾：一维高斯分布

在使用极大似然估计计算高斯分布最优参数一节中介绍了一维高斯分布。具体表示如下：
$\sim \mathcal N(\mu,\sigma^2) = \frac{1}{\sqrt{2\pi}\sigma} e^{-\frac{(x - \mu)^2}{2\sigma^2}}$

其中 $x,\mu,\sigma$ 均属于一维矩阵，即标量。

多维高斯分布

多维高斯分布与一维高斯分布的明显区别是：随机变量 $x$ ，期望 $\mu$ 以多维向量的形式出现，方差以多维矩阵的形式出现(方阵)。
随机变量定义：
数据集合 $\mathcal X$ 包含 $N$ 个样本：
$\mathcal X = \{x^{(1)},x^{(2)},\cdots,x^{(N)}\}$
其中， $\mathcal X$ 中 任意样本 $x^{(i)}(i \in \{1,2,\cdots,N\})$ 均属于 $p$ 维随机变量，记作 $\in \mathbb R^{p}$ ；
以样本 $x^{(i)}$ 为例，其向量表示如下：
$x^{(i)} = (x_1^{(i)},x_2^{(i)},\cdots,x_p^{(i)})^{T}$
期望 $\mu$ 同样属于 $p$ 维随机变量。每一维度值表示数据集合中所有样本对应该维度值的期望结果。 $\mu$ 的向量表示如下：
$\mu = (\mu_1,\mu_2,\cdots,\mu_p)$

$\Sigma$ 表示协方差矩阵。它的定义表示如下：
$x$ 表示‘宏观意义’上的样本;任意样本。
$\Sigma = \mathbb E[(x - \mu)(x - \mu)^{T}]$
由于多维高斯分布中 $x,\mu$ 均为 $p$ 维向量。因此，将 $(x_1,x_2,\cdots,x_p),\mu = (\mu_1,\mu_2,\cdots,\mu_p)$ 带入上式：
$\Sigma = \mathbb E \begin{bmatrix} (x_1 - \mu_1)^2,(x_1 - \mu_1)(x_2 - \mu_2),\cdots,(x_1 - \mu_1)(x_p - \mu_p) \\ (x_2 - \mu_2)(x_1 - \mu_1),(x_2 - \mu_2)^2,\cdots,(x_2 - \mu_2)(x_p - \mu_p) \\ \vdots \\ (x_p - \mu_p)(x_1 - \mu_1),(x_p - \mu_p)(x_2 - \mu_2),\cdots,(x_p - \mu_p)^2 \end{bmatrix}= \begin{pmatrix} \sigma_{11},\sigma_{12},\cdots,\sigma_{1p} \\ \sigma_{21},\sigma_{22},\cdots,\sigma_{2p} \\ \vdots \\ \sigma_{p1},\sigma_{p2},\cdots,\sigma_{pp} \end{pmatrix}_{p \times p}$
观察上述矩阵，发现 $\sigma_{ij} = \sigma_{ji} = \mathbb E[(x_i - \mu_i)(x_j - \mu_j)]$ 。因此，协方差矩阵 $\Sigma$ 是 实对称矩阵。并且 $\sigma_{ii} = (x_i - \mu_i)^2 \geq0(i = 1,2,\cdots,p)$ 恒成立。因此 $\Sigma$ 至少是半正定矩阵。
不排除 $\sigma_{ii}=0$ 的情况发生，因此这个协方差矩阵不一定是‘正定矩阵’。但在推导过程中暂时设定为‘正定矩阵’。

多维高斯分布的概率密度函数表示如下：
从‘概率模型’角度将高斯分布表示为 $\mid \mu,\Sigma)$
$\sim \mathcal N(\mu,\Sigma) = P(x \mid \mu,\Sigma) = \frac{1}{(2\pi)^{\frac{p}{2}}\cdot|\Sigma|^{\frac{1}{2}}} e^{-\frac{1}{2}(x - \mu)^{T} \Sigma^{-1} (x -\mu) }$
其中， $|\Sigma|$ 表示协方差矩阵的行列式结果； $\Sigma^{-1}$ 表示协方差矩阵的逆矩阵。

观察：如果将 $x$ 看作自变量/需要求解的量， $\mu,\Sigma$ 看作多维高斯分布 $\mathcal N(\mu,\Sigma)$ 的参数，则整个概率密度函数公式中和 $x$ 有关的部分只有：
$\mu)^{T} \Sigma^{-1}(x - \mu)$
首先观察它的维度： $\mu)$ 是 $p\times 1$ 维向量， $\mu)^{T}$ 自然是 $1\times p$ 维向量；协方差矩阵的逆不改变维度： $\Sigma^{-1} \to p \times p$ ；因此， $\mu)^{T} \Sigma^{-1}(x - \mu)$ 本质上是一个一维矩阵，是个标量，是一个具体数值。

这里引进一个概念：马氏距离(Mahalanobis distance)。它描述的是两个向量(高维空间内两个数据点)之间的距离描述。马氏距离传送门
例如 $p$ 维空间的两个数据点：
$(x_1,x_2,\cdots,x_p)^{T} \\ y=(y_1,y_2,\cdots,y_p)^{T}$
它们的马氏距离表示如下：
$D_{M}(x,y) = \sqrt{(x - y)^{T}\Sigma^{-1}(x - y)}$

在这里可以将 $\mu)^{T} \Sigma^{-1}(x - \mu)$ 视作样本点 $x$ 与样本均值向量 $\mu$ 之间的马氏距离。

如果 $\Sigma^{-1}$ 是单位矩阵，马氏距离将退化为欧式距离(Euclidean Distance)

假设协方差矩阵是正定矩阵，对协方差矩阵进行特征值分解：
如果协方差矩阵是一般情况下的‘半正定’，那么 $\Sigma$ 自然是不能求逆的， $\Sigma^{-1}$ 是不存在的。
$\Sigma = U \Lambda U^{T}$
根据特征值分解定义， $U$ 是一个正交矩阵，即：
$UU^{T} = U^{T}U = I$
其中 $I$ 表示单位矩阵， $U, I$ 矩阵格式均为 $p\times p$ 。将正交矩阵 $U$ 定义为 $(u_1,u_2,\cdots,u_p)$ ；其中 $u_i(i=1,2,\cdots,p)$ 看作 $\times 1$ 维向量。
$\Lambda$ 表示特征值向量，对角线上元素为 $\Sigma$ 矩阵的特征值。
根据上式则有：
$\begin{aligned} \Sigma & = U \Lambda U^{T} \\ & = (u_1,u_2,\cdots,u_p)\begin{pmatrix}\lambda_0 ,0,\cdots,0 \\ 0,\lambda_1,\cdots,0 \\ \vdots \\ 0,0,\cdots ,\lambda_p\end{pmatrix}\begin{pmatrix}u_1^{T} \\u_2^{T}\\ \vdots \\ u_p^{T}\end{pmatrix}\\ & = (u_1\lambda_1,u_2\lambda_2,\cdots,u_p\lambda_p) \begin{pmatrix}u_1^{T} \\u_2^{T}\\ \vdots \\ u_p^{T}\end{pmatrix} \\ & = u_1 \lambda_1 u_1^{T} + u_2 \lambda_2 u_2^{T} + \cdots +u_p \lambda_p u_p^{T} \end{aligned}$
由于 $\lambda_1,\lambda_2,\cdots,\lambda_p$ 是特征值，是常数，因此可以提到前面， $u_iu_i^{T}$ 结果是 $\times p$ 的方阵；
$\Sigma = \sum_{i=1}^p\lambda_iu_iu_i^{T}$
基于上式，通过 $\Sigma$ 求解 $\Sigma^{-1}$ ：
正交阵的性质，正交阵的转置等于该正交阵的逆。即： $U^{T} = U^{-1}$
$\begin{aligned} \Sigma^{-1} & = (U \Lambda U^{T})^{-1} \\ & = (U^{T})^{-1} \Lambda^{-1}U^{-1} \\ & = U \Lambda^{-1}U^{T} \\ & = \sum_{i=1}^p \frac{1}{\lambda_i}u_iu_i^{T} \end{aligned}$
将 $\Sigma^{-1}$ 带入 $\mu)^{T} \Sigma^{-1}(x - \mu)$ ，则有：
$\begin{aligned} (x - \mu)^{T} \Sigma^{-1}(x - \mu) & = (x - \mu)^{T} \sum_{i=1}^p \frac{1}{\lambda_i}u_iu_i^{T}(x - \mu) \end{aligned}$

观察， $-\mu)^{T}$ 是 $\times p$ 的向量； $\sum_{i=1}^p \frac{1}{\lambda_i}u_iu_i^{T}$ 是 $\times p$ 维向量； $\mu)$ 是 $\times 1$ 维向量。
因此， $\mu)^{T} \sum_{i=1}^p \frac{1}{\lambda_i}u_iu_i^{T}(x - \mu)$ 仍然是一个标量、一个数值。
将 $-\mu)^T,(x - \mu)$ 两个向量看成整体，不执行任何拆分，将 $\sum_{i=1}^p \frac{1}{\lambda_i}$ 提出来：
$\sum_{i=1}^p \frac{1}{\lambda_i}(x - \mu)^{T}u_iu_i^{T}(x - \mu)$
令向量 $\begin{pmatrix}k_1 \\k_2\\\vdots \\k_p\end{pmatrix}_{p \times 1}$ ， $k_i(i=1,2,\cdots,p) = (x - \mu)^{T}u_i$

上式可转化为：
$\sum_{i=1}^p \frac{1}{\lambda_i}k_ik_i^{T}$

由于 $k$ 的定义，因此， $k_i(i=1,2,\cdots,p)$ 是标量、数值。即：
$k_i^{T} = k_i$
则有：
$\begin{aligned} (x - \mu)^{T} \Sigma^{-1}(x - \mu) & = \sum_{i=1}^p \frac{1}{\lambda_i}k_ik_i^{T} \\ & = \sum_{i=1}^p \frac{k_i^2}{\lambda_i}(i=1,2,\cdots,p) \end{aligned}$

将上述结果展开：
$\sum_{i=1}^p \frac{k_i^2}{\lambda_i} = \frac{k_1^2}{\lambda_1} + \frac{k_2^2}{\lambda_2} +\cdots + \frac{k_p^2}{\lambda_p}$

如果给定上述结果一个具体的值： $\Delta$
则有：
$\begin{aligned} \frac{k_1^2}{\lambda_1} + \frac{k_2^2}{\lambda_2} +\cdots + \frac{k_p^2}{\lambda_p} = \Delta \\ \frac{1}{\Delta}(\frac{k_1^2}{\lambda_1} + \frac{k_2^2}{\lambda_2} +\cdots + \frac{k_p^2}{\lambda_p} ) = 1 \\ \frac{k_1^2}{\Delta\lambda_1} + \frac{k_2^2}{\Delta\lambda_2} +\cdots + \frac{k_p^2}{\Delta\lambda_p} = 1 \end{aligned}$
它就是一个超椭圆形的标准方程。
令 $p = 2$ ：
$\frac{k_1^2}{\Delta\lambda_1} + \frac{k_2^2}{\Delta\lambda_2} = 1$

它就是一个椭圆的标准方程，其中 $\sqrt{\Delta\lambda_1},b = \sqrt{\Delta\lambda_2}$

至此，基于马氏距离 $\mu)^{T} \Sigma^{-1}(x - \mu)$ ，它执行一次坐标系的映射：

原始 $p$ 维坐标系 $x_i(i=1,2,\cdots,p)$ ;
经过一系列变换： $k_i = (x - \mu)^{T} u_i$
将 $x$ 坐标系先通过平移 $\mu$ 个长度后，再映射到 $u$ 坐标系中(矩阵乘法的特点)
$k_i$ 表示在样本 $x$ 在 $u$ 坐标系中的映射结果。
而马氏距离 $\mu)^{T} \Sigma^{-1}(x - \mu)$ 可理解为在 $x$ 映射到 $k$ 之后，构建一个椭圆，而椭圆上的值就是马氏距离的结果。

上述表示 $i = 2$ 时的高斯分布图像，由于 $x$ 只和 $\mu)^{T} \Sigma^{-1}(x - \mu)$ 相关，和表示概率的 $\frac{1}{(2\pi)^{\frac{p}{2}}\cdot|\Sigma|^{\frac{1}{2}}}$ 无关。

但是概率和 $\Delta$ 相关，基于上述标准方程，椭圆的长轴和短轴长度分别是 $\sqrt{\Delta\lambda_1},\sqrt{\Delta\lambda_2}$ ；选择的 $\Delta$ 值直接影响椭圆的大小，从而影响获取横截面的位置。

因此，当概率被确定时，以上述图为例，在 $z$ 轴对应概率值位置进行横切，而横切得到的横截面必然是椭圆形截面。而 $\mu)^{T} \Sigma^{-1}(x - \mu)$ 表示椭圆形上的点。

高斯分布的局限性(2022/11/18)

回顾：协方差矩阵，马氏距离

回顾正常情况下(正定条件下) 协方差矩阵的表示：
$\Sigma = \mathcal U \Lambda \mathcal U^T \quad \mathcal U^T\mathcal U = \mathcal U\mathcal U^T = \mathcal I$
其中 $\mathcal I$ 是单位矩阵，由于协方差矩阵自身的性质， $\mathcal U$ 是各向量两两正交的正交矩阵：
$\mathcal U = (u_1,u_2,\cdots,u_p)_{p \times p}$
某样本点 $x$ 到对应分布的马氏距离 $\Delta$ 表示如下：
需要补充的点： $k_i$ 并不是正交基，而是 $x$ 坐标轴的元素 $\mu$ 在 $u$ 正交基上的投影坐标，是一个实数。
$k_i = (x - \mu)^T \cdot u_i$
$\begin{aligned} \Delta & = (x - \mu)^{T} \Sigma^{-1}(x - \mu) \\ & = (x - \mu)^{T} \sum_{i=1}^p \frac{1}{\lambda_i}u_iu_i^{T}(x - \mu) \\ & = \sum_{i=1}^p \frac{1}{\lambda_i} \left[(x - \mu)^T \cdot u_i\right] \cdot \left[(x - \mu)^T \cdot u_i\right]^T\\ & = \sum_{i=1}^p \frac{1}{\lambda_i}k_ik_i^{T} \\ & = \sum_{i=1}^p \frac{k_i^2}{\lambda_i}(i=1,2,\cdots,p) \end{aligned}$
因此，马氏距离在正交基 $\mathcal U = (u_1,u_2,\cdots,u_p)$ 中的呈现的函数是一个标准椭圆形状。但是该椭圆仅在 $\mathcal U$ 正交基下是标准的，但在 $x$ 坐标轴中可能存在偏移：
这里图形均以二维坐标为例，下同。

局限性的具体体现

计算协方差矩阵参数的时间复杂度过高。
协方差矩阵是一个 $\times p$ 的实对称矩阵，因此需要求解的元素包含上/下三角阵 + 对角阵的参数。具体参数数量 $\delta$ 以及对应的时间复杂度为：
$\delta = \frac{p(p+1)}{2} \to O(p^2)$
为了减小时间复杂度，尝试对求解过程进行简化。
- 假设协方差矩阵是对角矩阵。即：
  $\Sigma = \mathcal U \Lambda \mathcal U^T \to \Lambda$
  这意味着 $\mathcal U$ 不仅仅是单纯的正交矩阵，并且是单位矩阵，矩阵内各向量均是两两相互正交的单位向量：
  $\mathcal U = \mathcal U^T = \mathcal E$
  这使得正交基 $u_i$ 和坐标轴 $x_i$ 方向相同，此时仅需要计算 对角线上的 $p$ 个特征值即可。
  $\Delta = \sum_{i=1}^p \frac{1}{\lambda_i} u_iu_i^T$
  协方差矩阵是对角阵对应在图中的表示如下：
- 在上述假设的基础上，假设表示协方差矩阵 $\Sigma$ 的对角阵中各元素均相同。即：
  $\lambda_1, = \lambda_2 = \cdots = \lambda_p = \lambda$
  此时的马氏距离变化为：
  由于 $\lambda$ 均相同，使得原始的超椭圆体的判别式变成一个超球体的判别式。
  $\Delta = \frac{\sum_{i=1}^p u_i u_i^T}{\lambda}$
  协方差矩阵是对角线元素相同的对角阵对应图像表示如下：
  
  此时的协方差矩阵仅需要计算一个特征值即可，大大简化了运算。将这种情况称为各向同性(isotropic)。具体的延伸方法有因子分析(Factor Analysis),概率性主成分分析(Probabilisitc PCA)等。
高斯分布自身的局限性——虽然高斯分布涉及范围很广泛，但是一些情况使用高斯分布建立概率模型 显得不足。最明显的如高斯混合模型的概率分布，其分布明显一个高斯分布无法进行表示。详见高斯混合模型——模型介绍。

总结

矩阵乘法——将当前变量的坐标系映射到其他坐标系中；
在后续的线性判别分析中加深印象;
将 $x$ 参考系被映射到新的参考系中，并将马氏距离映射为标准的超椭圆方程。

相关参考：
机器学习-数学基础-概率-高斯分布3-从概率密度角度观察
机器学习-数学基础-概率-高斯分布4-局限性

机器学习的数学基础-线性代数
本文用于复习并记录机器学习中的相关数学基础，仅供学习参考。很多总结和例子来源于mml项目（mml-book.github.io）十分感谢这本书的作者，PS：这本书目前没有中文版。线性代数线性方程组矩阵矩阵的加法与乘法矩阵加法矩阵乘法单位矩阵与标量相乘逆与转置逆转置解决线性方程组特解与通解高斯消元法初级变换应用：“-1”trick应用：求逆总结-如何解决线性方程组？向量空间群向量空间向量子空间线性独
物联网全景解析：核心技术、多元应用与未来趋势
物联网（IoT）作为新一代信息技术的核心载体，正通过“万物互联”重塑人类生产生活方式。以下从核心技术、应用场景、未来趋势三个维度展开全景解析。一、核心技术：构建物联网的四大支柱传感器技术：数据采集的“神经末梢”功能：将物理世界（温度、湿度、压力等）和生物世界（心率、血压）的信号转化为数字信号，是物联网感知层的基础。创新方向：微型化：MEMS传感器体积缩小至毫米级，可嵌入可穿戴设备；智能化：集成滤波
区块链加持元宇宙：构建去中心化的超级数字生态 boyedu 元宇宙域名区块链去中心化元宇宙
在数字文明的演进中，区块链与元宇宙的融合正催生一个前所未有的“超级数字生态”。这一生态以去中心化架构为核心，通过区块链技术的信任机制、资产确权与智能合约，重塑了虚拟世界的运行规则，形成了一个兼具经济活力、用户主权与安全可信的数字宇宙。一、区块链：元宇宙的信任基石与技术底座去中心化身份与数字主权区块链通过分布式身份（DID）技术，赋予用户完全掌控数字身份的能力。例如，微软Azure与以太坊合作的“D
区块链重塑域名商业版图：技术革新、市场机遇与未来图景 boyedu 区块链终端域名区块链终端域名
在Web3.0时代，区块链技术正以去中心化、抗审查、身份绑定等特性重构域名系统，不仅解决了传统DNS的安全漏洞与中心化风险，更开创了数字身份、品牌资产化等全新商业模式。以下从技术革新、市场现状、挑战应对及典型案例四个维度，深入剖析区块链域名的商业潜力。一、技术革新：区块链如何重构域名基础设施？去中心化根域名系统Handshake协议：通过UTXO模型与SHA3算法构建无需许可的域名注册体系，其HN
SEO优化技巧深度解析：从算法逻辑到实战策略的全链路突破 boyedu 网站建设网站建设网站运营网站架构
第一章搜索引擎算法逻辑：SEO优化的底层密码1.1算法进化史：从关键词匹配到意图理解搜索引擎算法经历了从简单关键词匹配到复杂语义理解的跨越式发展。早期算法以PageRank为核心，通过分析网页间链接关系评估权威性。随着Hummingbird算法的推出，搜索引擎开始解析自然语言，BERT算法进一步实现上下文语义理解。当前算法已形成多维度评估体系，涵盖内容质量、用户体验、权威性建设等层面。以Googl
【机器学习|学习笔记】随机森林（Random Forest, RF）详解，附代码。努力毕业的小土博^_^ 机器学习基础算法优质笔记1 机器学习学习笔记随机森林人工智能
【机器学习|学习笔记】随机森林（RandomForest,RF）详解，附代码。【机器学习|学习笔记】随机森林（RandomForest,RF）详解，附代码。文章目录【机器学习|学习笔记】随机森林（RandomForest,RF）详解，附代码。前言起源随机子空间法与Bagging的萌芽原理算法机制理论保障发展应用优缺点优点缺点Python实现示例（Scikit-learn）欢迎铁子们点赞、关注、收藏
LSA主题模型：基于奇异值分解的主题模型 AI天才研究院 AI人工智能与大数据 AI大模型企业级应用开发实战计算计算科学神经计算深度学习神经网络大数据人工智能大型语言模型 AI AGI LLM Java Python 架构设计 Agent RPA
LSA主题模型：基于奇异值分解的主题模型1.背景介绍主题模型是一种无监督的机器学习技术，用于发现大规模文本语料库中隐藏的语义结构。它能够自动识别文档集合中的主题，并根据这些主题对文档进行聚类和分类。主题模型在文本挖掘、信息检索、推荐系统等领域有着广泛的应用。LSA（LatentSemanticAnalysis）是一种经典的主题模型算法，基于奇异值分解（SVD）对词-文档矩阵进行分解，从而揭示词语和
人工智能驱动下的可再生能源气象预测：构建绿色能源时代的新大脑一ge科研小菜菜人工智能人工智能能源
个人主页：一ge科研小菜鸡-CSDN博客期待您的关注一、背景：新能源快速发展下的预测焦虑为应对气候变化和实现碳中和目标，全球能源系统正在加速从“化石主导”向“可再生主导”过渡。风能、太阳能等清洁能源已成为未来能源结构的关键支柱。根据国际能源署（IEA）预测，到2050年，全球超70%的电力将来自可再生能源。然而，可再生能源具有显著的**“天气依赖性”和“波动不确定性”**，风速、光照、温度、湿度等
AI伦理与安全之-哥斯拉与缰绳：如何让“哥斯拉”听懂人类的“悄悄话”？众链网络 AI伦理与安全 AI 人工智能 AI工具 AI智能体
相关文章:AI伦理与安全AI伦理与安全之-镜子与偏见：我们教给它的，究竟是智慧还是偏见？AI伦理与安全之-哥斯拉与缰绳：如何让“哥斯拉”听懂人类的“悄悄话”？AI伦理与安全之-梦境与幻觉：它为何会一本正经地胡说八道？在上一篇中，我们谈到AI像一面“镜子”，会映照出我们数据中的偏见。但那只是AI伦理问题中的“序章”。一个更深邃、更终极的挑战，正横亘在人类与超人工智能（ASI）的未来之间。这个挑战，就
数据库面试题06为什么要用MyBatis框架？
MyBatis是一个优秀的持久层框架（虽然常被归类为“半自动化”ORM，但其核心更侧重于SQL映射），它在Java开发中广泛应用，尤其在需要精细控制SQL、处理复杂查询或与遗留数据库交互的场景中备受青睐。选择MyBatis的主要原因可以总结为以下几点：对SQL的完全控制权（核心优势）:开发者手写SQL：MyBatis要求开发者直接编写SQL语句（在XML映射文件或注解中）。这与Hibernate/
AI技术通过多模态应用（即融合文本、图像、语音、视频、传感器数据等多维度信息）正在深刻重塑工作模式、行业生态和人类创造力边界。 zzywxc787 人工智能音视频大数据 java spring 开发语言
AI技术通过多模态应用（即融合文本、图像、语音、视频、传感器数据等多维度信息）正在深刻重塑工作模式、行业生态和人类创造力边界。以下从技术融合、行业变革、职业重构三个维度展开分析，并附具体案例：一、技术融合：多模态AI的核心突破跨模态理解引擎案例：Meta的AudiovisualNeuralNetwork（AV-Wav2Vec）实现语音-唇形-场景的联合建模，语音识别错误率降低40%技术指标：跨模态
人工智能在医疗领域的应用：技术革新与未来展望
人工智能（AI）技术正在重塑医疗行业的面貌。从辅助诊断到药物研发，从健康管理到手术机器人，AI的广泛应用不仅提升了医疗效率，还为精准医疗和个性化治疗提供了新可能。根据2025年多份研究报告及政策文件，全球AI医疗市场正以39.4%的年复合增长率高速扩张，预计到2025年，中国市场规模将达349亿元，全球规模则可能突破千亿美元18。本文将从应用场景、技术驱动、挑战与政策支持等维度，探讨AI在医疗领域
10.5 实战ChatGLM3私有数据微调之提示工程：批量生成数据稳定性秘籍少林码僧掌握先机！从 0 起步实战 AI 大模型微调打造核心竞争力机器学习深度学习人工智能语言模型
实战ChatGLM3私有数据微调之提示工程：批量生成数据稳定性秘籍在当今人工智能蓬勃发展的时代，大语言模型（LLMs）如ChatGLM3的出现，为自然语言处理领域带来了革命性的变化。企业和开发者们纷纷寻求利用这些强大的模型来构建定制化的应用，以满足特定业务需求。其中，使用私有数据对ChatGLM3进行微调，成为了实现差异化竞争和提供个性化服务的关键途径。然而，在微调过程中，确保批量生成数据的稳定性
【机器学习笔记 Ⅱ】9 模型评估巴伦是只猫机器学习机器学习笔记人工智能
评估机器学习模型是确保其在实际应用中有效性和可靠性的关键步骤。以下是系统化的评估方法，涵盖分类、回归、聚类等任务的评估指标和技术：一、分类模型评估1.基础指标2.高级指标ROC-AUC：通过绘制真正例率（TPR）vs假正例率（FPR）曲线下面积评估模型整体性能。AUC=1：完美分类；AUC=0.5：随机猜测。适用于二分类及多分类（OvR或OvO策略）。混淆矩阵：可视化模型在各类别上的具体错误（如将
【机器学习笔记 Ⅱ】7 多类分类巴伦是只猫机器学习机器学习笔记分类
1.多类分类（Multi-classClassification）定义多类分类是指目标变量（标签）有超过两个类别的分类任务。例如：手写数字识别：10个类别（0~9）。图像分类：区分猫、狗、鸟等。新闻主题分类：政治、经济、体育等。特点互斥性：每个样本仅属于一个类别（区别于多标签分类）。输出要求：模型需输出每个类别的概率分布，且概率之和为1。实现方式One-vs-Rest(OvR)：训练K个二分类器（
3dmax标准材质转物理材质插件，支持VR材质和CR材质转换成功物理材质，支持多维子材质在下胡三汉材质 vr
3dmax标准材质转物理材质插件，支持VR材质和CR材质转换成功物理材质，支持多维子材质3dmax标准材质转物理材质插件，支持VR材质和CR材质转换成功物理材质，支持多维子材质
人工智能学习资源 Hemy08 人工智能学习
无机器学习基础：https://www.coursera.org/learn/machine-learning有机器学习基础：MachineYearning深度学习入门：https://www.coursera.org/learn/neural-networks-deep-learning
【机器学习笔记 Ⅱ】4 神经网络中的推理
推理（Inference）是神经网络在训练完成后利用学到的参数对新数据进行预测的过程。与训练阶段不同，推理阶段不计算梯度也不更新权重，仅执行前向传播。以下是其实现原理和代码示例的完整解析：1.推理的核心步骤加载训练好的模型参数（权重和偏置）。前向传播：输入数据逐层计算，得到输出。后处理：根据任务类型解析输出（如分类取概率最大值，回归直接输出）。2.代码实现（Python+NumPy）(1)定义模型
【面试题】为什么kafka的吞吐量这么高 oraen 面试系列 kafka 分布式
我们总结一下为什么kafka的吞吐量高核心：顺序写+零拷贝+批处理一数据模型简单+顺序读写磁盘1kafka的数据存储本质上使用的是Append-only日志模型，数据写入和读取是顺序的，不需要复杂索引或随机写，大大简化了写路径，2消息以顺序追加方式写入磁盘，避免了随机写，而且顺序写入能够更高效地配合操作系统的页缓存，进一步提升写的性能。3消息的消费也是顺序读取的，顺序读取硬盘数据再配合内存映射大大
开源语音分离工具大比拼：人声 VS 背景音乐 ⚔️ - 获取干净训练语音 (数据截至 2025年4月17日)！！！小丁学Java python 人工智能
开源语音分离工具大比拼：人声VS背景音乐⚔️-获取干净训练语音(数据截至2025年4月17日)在音频处理，特别是机器学习训练数据的准备中，获取纯净的人声（去除背景音乐或噪声）是一个常见的痛点。幸运的是，开源社区提供了许多强大的工具来帮助我们完成这项任务！本文将盘点一系列GitHub上的开源语音分离项目，重点关注那些能有效分离“人物语音”和“背景音乐”的工具，并根据GitHub星标⭐（反映社区关注度
HarmonyOS 生命周期详解：用三张图彻底搞懂 UIAbility、页面与组件的生命周期
作者：像素笔记|发布时间：2025年6月27日摘要本文通过三层结构图、状态流程图、对比表格三大图表，深入解析HarmonyOSArkUI的生命周期机制，涵盖UIAbility、页面、组件各层级的触发顺序与最佳实践。同时提供高级场景管理方案、常见误区分析及实战级生命周期管理工具设计，助你打造高性能、高稳定性的HarmonyOS应用！一、三层生命周期结构图（图1）下图展示了HarmonyOS应用框架的
【机器学习笔记 Ⅲ】3 异常检测算法巴伦是只猫机器学习机器学习笔记算法
异常检测算法（AnomalyDetection）详解异常检测是识别数据中显著偏离正常模式的样本（离群点）的技术，广泛应用于欺诈检测、故障诊断、网络安全等领域。以下是系统化的解析：1.异常类型类型描述示例点异常单个样本明显异常信用卡交易中的天价消费上下文异常在特定上下文中异常（如时间序列）夏季气温突降至零下集体异常一组相关样本联合表现为异常网络流量中突然的DDOS攻击流量2.常用算法(1)基于统计的
【机器学习笔记 Ⅲ】4 特征选择巴伦是只猫机器学习机器学习笔记人工智能
特征选择（FeatureSelection）系统指南特征选择是机器学习中优化模型性能的关键步骤，通过筛选最相关、信息量最大的特征，提高模型精度、降低过拟合风险并加速训练。以下是完整的特征选择方法论：1.特征选择的核心目标提升模型性能：去除噪声和冗余特征，增强泛化能力。降低计算成本：减少训练和预测时间。增强可解释性：简化模型，便于业务理解。2.特征选择方法分类(1)过滤法（FilterMethods
机器学习笔记二-回归
回归是统计学和机器学习中的一种基本方法，用于建模变量之间的关系，特别是用一个或多个自变量（输入变量）来预测一个因变量（输出变量）的值。回归分析广泛应用于预测、趋势分析和关联研究中。根据目标和数据的性质，可以使用不同类型的回归方法。1.回归的基本概念：自变量（IndependentVariable）:也称为预测变量、解释变量，是模型中的输入变量，用于预测或解释因变量的变化。因变量（Dependent
Claude Code 深夜也要加班？这个神器让 AI 自动续命! terryso AI编程 AI编程
你有没有遇到过这种情况？晚上熬夜用ClaudeCode写代码，正写到关键时刻，突然弹出："Claudeusagelimitreached.恢复时间：凌晨3点"这时候你可能已经困得睁不开眼，但又舍不得放弃手头的工作进度…解决方案来了！今天给大家推荐一个开源神器：ClaudeAutoResume，让你的ClaudeCode可以"自动续命"！它是怎么工作的？智能检测：自动监控Claude使用限制倒计时等
如何制定YashanDB数据库的维护与管理计划数据库
数据库在现代应用程序中扮演着至关重要的角色。然而，随着数据量的不断增加和复杂性的加剧，数据库的性能瓶颈、数据一致性问题、存储的高可用性等正成为技术管理者面临的共同挑战。为了确保数据库的高效运营，制定一份全面的数据库维护与管理计划是必要的。本文旨在帮助技术团队理清YashanDB的维护与管理步骤，为提升数据库的可用性和性能提供指导，目标读者包括DBA、系统管理员和IT管理人员。了解YashanDB架
两个场景的车辆相似度评估并画图（弗雷歇距离）
疑问：是否有必要normalize？（待解决）importmathimportnumpyasnpimportpandasaspdimporttorchfrommatplotlibimportpyplotaspltfromshapesimilarityimportshape_similarity,procrustes_normalize_curve,find_procrustes_rotation_
FAAC 在海思平台使用得到aac实时音频流张海森_168820 aac 音视频
FAAC在海思平台使用得到aac实时音频流使用FAAC将音频pcm转为aac主要参见这篇博客FAAC在君正平台使用得到aac实时音频流_君正x2600音频-CSDN博客
html读取媒体长度,用媒体查询media根据屏幕分辨率大小确定网页宽度 weixin_39886205 html读取媒体长度
显示网页的终端屏幕分辨率大小不一，为了能使同一网页能在不同的终端中合适显示，CSS3推出了媒体查询media。用媒体查询media能根据屏幕分辨率大小确定网页宽度，这主要在CSS文件中根据屏幕分辨率大小定义网页宽度。以前用百分比来根据屏幕分辨率大小确定网页宽度，但由于同样的百分比随着屏幕分辨率的增大，网页离屏幕两边的距离也随之变宽，不能很好的解决这个问题；用媒体查询media就能很好的解决这个问题
SpringBoot服务端在处理大文件Excel任务时的设计 Ceramist spring boot 后端 java
SpringBoot服务端处理大文件Excel任务的设计在构建SpringBoot应用时，处理大文件，尤其是大体积的Excel文件，是一项挑战性的任务。这不仅涉及到数据的高效读取，还需要考虑系统的稳定性、用户体验以及任务的状态跟踪。本篇文章将详细探讨如何设计一个高效、稳定的SpringBoot服务端，以处理大文件Excel任务，涵盖异步处理、状态设计和分步骤响应用户等关键方面。异步处理设计异步处理
多线程编程之存钱与取钱周凡杨 java thread 多线程存钱取钱
生活费问题是这样的：学生每月都需要生活费，家长一次预存一段时间的生活费，家长和学生使用统一的一个帐号，在学生每次取帐号中一部分钱，直到帐号中没钱时通知家长存钱，而家长看到帐户还有钱则不存钱，直到帐户没钱时才存钱。问题分析：首先问题中有三个实体，学生、家长、银行账户，所以设计程序时就要设计三个类。其中银行账户只有一个，学生和家长操作的是同一个银行账户，学生的行为是
java中数组与List相互转换的方法征客丶 JavaScript java jsonp
1.List转换成为数组。（这里的List是实体是ArrayList) 　　调用ArrayList的toArray方法。　　toArray 　　public T[] toArray(T[] a)返回一个按照正确的顺序包含此列表中所有元素的数组；返回数组的运行时类型就是指定数组的运行时类型。如果列表能放入指定的数组，则返回放入此列表元素的数组。否则，将根据指定数组的运行时类型和此列表的大小分
Shell 流程控制 daizj 流程控制 if else while case shell
Shell 流程控制和Java、PHP等语言不一样，sh的流程控制不可为空，如(以下为PHP流程控制写法)： <?php if(isset($_GET["q"])){ search(q);}else{// 不做任何事情} 在sh/bash里可不能这么写，如果else分支没有语句执行，就不要写这个else，就像这样 if else if if 语句语
Linux服务器新手操作之二周凡杨 Linux 简单操作
1.利用关键字搜寻Man Pages man -k keyword 其中-k 是选项，keyword是要搜寻的关键字如果现在想使用whoami命令，但是只记住了前3个字符who，就可以使用 man -k who来搜寻关键字who的man命令 [haself@HA5-DZ26 ~]$ man -k
socket聊天室之服务器搭建朱辉辉33 socket
因为我们做的是聊天室，所以会有多个客户端，每个客户端我们用一个线程去实现，通过搭建一个服务器来实现从每个客户端来读取信息和发送信息。我们先写客户端的线程。 public class ChatSocket extends Thread{ Socket socket; public ChatSocket(Socket socket){ this.sock
利用finereport建设保险公司决策分析系统的思路和方法老A不折腾 finereport 金融保险分析系统报表系统项目开发
决策分析系统呈现的是数据页面，也就是俗称的报表，报表与报表间、数据与数据间都按照一定的逻辑设定，是业务人员查看、分析数据的平台，更是辅助领导们运营决策的平台。底层数据决定上层分析，所以建设决策分析系统一般包括数据层处理（数据仓库建设）。项目背景介绍通常，保险公司信息化程度很高，基本上都有业务处理系统（像集团业务处理系统、老业务处理系统、个人代理人系统等）、数据服务系统（通过
始终要页面在ifream的最顶层林鹤霄
index.jsp中有ifream，但是session消失后要让login.jsp始终显示到ifream的最顶层。。。始终没搞定，后来反复琢磨之后，得到了解决办法，在这儿给大家分享下。。 index.jsp--->主要是加了颜色的那一句 <html> <iframe name="top" ></iframe> <ifram
MySQL binlog恢复数据 aigo mysql
1，先确保my.ini已经配置了binlog： # binlog log_bin = D:/mysql-5.6.21-winx64/log/binlog/mysql-bin.log log_bin_index = D:/mysql-5.6.21-winx64/log/binlog/mysql-bin.index log_error = D:/mysql-5.6.21-win
OCX打成CBA包并实现自动安装与自动升级 alxw4616 ocx cab
近来手上有个项目,需要使用ocx控件 (ocx是什么? http://baike.baidu.com/view/393671.htm) 在生产过程中我遇到了如下问题. 1. 如何让 ocx 自动安装? a) 如何签名? b) 如何打包? c) 如何安装到指定目录? 2.
Hashmap队列和PriorityQueue队列的应用百合不是茶 Hashmap队列 PriorityQueue队列
HashMap队列已经是学过了的,但是最近在用的时候不是很熟悉,刚刚重新看以一次, HashMap是K,v键 ,值 put()添加元素 //下面试HashMap去掉重复的 package com.hashMapandPriorityQueue; import java.util.H
JDK1.5 returnvalue实例 bijian1013 java thread java多线程 returnvalue
Callable接口：返回结果并且可能抛出异常的任务。实现者定义了一个不带任何参数的叫做 call 的方法。 Callable 接口类似于 Runnable，两者都是为那些其实例可能被另一个线程执行的类设计的。但是 Runnable 不会返回结果，并且无法抛出经过检查的异常。 ExecutorService接口方
angularjs指令中动态编译的方法(适用于有异步请求的情况) 内嵌指令无效 bijian1013 JavaScript AngularJS
在directive的link中有一个$http请求，当请求完成后根据返回的值动态做element.append('......');这个操作，能显示没问题，可问题是我动态组的HTML里面有ng-click，发现显示出来的内容根本不执行ng-click绑定的方法！
【Java范型二】Java范型详解之extend限定范型参数的类型 bit1129 extend
在第一篇中，定义范型类时，使用如下的方式： public class Generics<M, S, N> { //M,S,N是范型参数 } 这种方式定义的范型类有两个基本的问题： 1. 范型参数定义的实例字段，如private M m = null;由于M的类型在运行时才能确定，那么我们在类的方法中，无法使用m，这跟定义pri
【HBase十三】HBase知识点总结 bit1129 hbase
1. 数据从MemStore flush到磁盘的触发条件有哪些？ a.显式调用flush，比如flush 'mytable' b.MemStore中的数据容量超过flush的指定容量，hbase.hregion.memstore.flush.size,默认值是64M 2. Region的构成是怎么样？ 1个Region由若干个Store组成
服务器被DDOS攻击防御的SHELL脚本 ronin47
mkdir /root/bin vi /root/bin/dropip.sh #!/bin/bash/bin/netstat -na|grep ESTABLISHED|awk ‘{print $5}’|awk -F:‘{print $1}’|sort|uniq -c|sort -rn|head -10|grep -v -E ’192.168|127.0′|awk ‘{if($2!=null&a
java程序员生存手册-craps 游戏-一个简单的游戏 bylijinnan java
import java.util.Random; public class CrapsGame { /** * *一个简单的赌*博游戏，游戏规则如下： *玩家掷两个骰子，点数为1到6，如果第一次点数和为7或11，则玩家胜， *如果点数和为2、3或12，则玩家输， *如果和为其它点数，则记录第一次的点数和，然后继续掷骰，直至点数和等于第一次掷出的点
TOMCAT启动提示NB: JAVA_HOME should point to a JDK not a JRE解决开窍的石头 JAVA_HOME
当tomcat是解压的时候，用eclipse启动正常，点击startup.bat的时候启动报错; 报错如下： The JAVA_HOME environment variable is not defined correctly This environment variable is needed to run this program NB: JAVA_HOME shou
[操作系统内核]操作系统与互联网 comsci 操作系统
我首先申明：我这里所说的问题并不是针对哪个厂商的，仅仅是描述我对操作系统技术的一些看法操作系统是一种与硬件层关系非常密切的系统软件，按理说，这种系统软件应该是由设计CPU和硬件板卡的厂商开发的，和软件公司没有直接的关系，也就是说，操作系统应该由做硬件的厂商来设计和开发
富文本框ckeditor_4.4.7 文本框的简单使用支持IE11 cuityang 富文本框
<html xmlns="http://www.w3.org/1999/xhtml"> <head> <meta http-equiv="Content-Type" content="text/html; charset=UTF-8" /> <title>知识库内容编辑</tit
Property null not found darrenzhu datagrid Flex Advanced propery null
When you got error message like "Property null not found ***", try to fix it by the following way: 1)if you are using AdvancedDatagrid, make sure you only update the data in the data prov
MySQl数据库字符串替换函数使用 dcj3sjt126com mysql 函数替换
需求：需要将数据表中一个字段的值里面的所有的 . 替换成 _ 原来的数据是 site.title site.keywords .... 替换后要为 site_title site_keywords 使用的SQL语句如下： updat
mac上终端起动MySQL的方法 dcj3sjt126com mysql mac
首先去官网下载: http://www.mysql.com/downloads/ 我下载了5.6.11的dmg然后安装,安装完成之后..如果要用终端去玩SQL.那么一开始要输入很长的:/usr/local/mysql/bin/mysql 这不方便啊,好想像windows下的cmd里面一样输入mysql -uroot -p1这样...上网查了下..可以实现滴. 打开终端,输入: 1
Gson使用一（Gson） eksliang json gson
转载请出自出处：http://eksliang.iteye.com/blog/2175401 一.概述从结构上看Json，所有的数据（data）最终都可以分解成三种类型：第一种类型是标量（scalar），也就是一个单独的字符串（string）或数字（numbers），比如"ickes"这个字符串。第二种类型是序列（sequence），又叫做数组（array）
android点滴4 gundumw100 android
Android 47个小知识 http://www.open-open.com/lib/view/open1422676091314.html Android实用代码七段（一） http://www.cnblogs.com/over140/archive/2012/09/26/2611999.html http://www.cnblogs.com/over140/arch
JavaWeb之JSP基本语法 ihuning javaweb
目录 JSP模版元素 JSP表达式 JSP脚本片断 EL表达式 JSP注释特殊字符序列的转义处理如何查找JSP页面中的错误 JSP模版元素 JSP页面中的静态HTML内容称之为JSP模版元素，在静态的HTML内容之中可以嵌套JSP
App Extension编程指南（iOS8/OS X v10.10）中文版啸笑天 ext
当iOS 8.0和OS X v10.10发布后，一个全新的概念出现在我们眼前，那就是应用扩展。顾名思义，应用扩展允许开发者扩展应用的自定义功能和内容，能够让用户在使用其他app时使用该项功能。你可以开发一个应用扩展来执行某些特定的任务，用户使用该扩展后就可以在多个上下文环境中执行该任务。比如说，你提供了一个能让用户把内容分
SQLServer实现无限级树结构 macroli oracle sql SQL Server
表结构如下：数据库id path titlesort 排序 1 0 首页 0 2 0,1 新闻 1 3 0,2 JAVA 2 4 0,3 JSP 3 5 0,2,3 业界动态 2 6 0,2,3 国内新闻 1 创建一个存储过程来实现，如果要在页面上使用可以设置一个返回变量将至传过去 create procedure test as begin decla
Css居中div，Css居中img，Css居中文本，Css垂直居中div qiaolevip 众观千象学习永无止境每天进步一点点 css
/**********Css居中Div**********/ div.center { width: 100px; margin: 0 auto; } /**********Css居中img**********/ img.center { display: block; margin-left: auto; margin-right: auto; }
Oracle 常用操作(实用) 吃猫的鱼 oracle
SQL>select text from all_source where owner=user and name=upper('&plsql_name'); SQL>select * from user_ind_columns where index_name=upper('&index_name'); 将表记录恢复到指定时间段以前
iOS中使用RSA对数据进行加密解密 witcheryne ios rsa iPhone objective c
RSA算法是一种非对称加密算法,常被用于加密数据传输.如果配合上数字摘要算法, 也可以用于文件签名. 本文将讨论如何在iOS中使用RSA传输加密数据. 本文环境 mac os openssl-1.0.1j, openssl需要使用1.x版本, 推荐使用[homebrew](http://brew.sh/)安装. Java 8 RSA基本原理 RS