weixin_39901213

hevc角度预测_VVC帧内预测工具详解

未经许可，禁止转载

简介

为了增加帧内预测的精度，VVC改进了HEVC的帧内预测方法，将预测角度从33种扩展到65种，角度预测的插值滤波器改用4抽头的高斯插值滤波器。同时，由于QTMTT划分结构使得CU的不在局限于正方形，各种矩形尺寸的CU被广泛采用，因此VVC扩展了HEVC中角度预测的预测范围，引入了广角预测模式。

除了改进HEVC中的帧内编码技术，VVC还使用了新的高效预测技术，具体有跨分量线性预测(Corss-Component Linear Mode, CCLM)、位置自适应帧内联合预测(Position dependent intra prediciton Combination, PDPC)、帧内多行预测(Multiple reference line intra prediction, MRL)、帧内逐块预测(Intra sub-Partition prediction, ISP)等。

1. 扩展角度帧内模式

传统帧内预测包括方向角度预测和平滑预测(DC和Planar)两类，VVC为提高预测精度，将HEVC帧内的33种角度预测模式扩展到65种，如图所示，67种角度预测可用于亮度和色度的预测。

在原HEVC中的35个角度模式的基础上，每两个方向之间插入一个新预测方向，共33+32=65个预测方向。

1.1 MPM构建和模式编码

为了降低建立MPM列表的复杂度，VTM通过两个相邻的CU预测模式生成6个MPM，MPM列表中的模式包含以下三类：默认模式

相邻CU模式

计算推导的模式

VTM参考两个相邻PU(左(A)、上(B))的帧内模式生成MPM列表。默认的初始化MPM列表如下 6 MPM modes = {A, Planar (0) or DC (1), Vertical (50), HOR (18), VER - 4 (46), VER + 4 (54)} 之后MPM列表根据两个相邻的PU帧内模式进行更新。更新方式如下： - 如果A=B且A>1，6个模式为三个默认模式(A, Planar, DC)和三个推导模式，由A偏移得到。 - 如果A与B不等，则6个模式前两个为A和B，剩余四个由默认模式和相邻模式推导得到。

生成MPM列表时，要进行去重操作，以保证6个模式都是不同的。在编码帧内模式时，61个非MPM模式，采用截断二进制编码(TBC)。

1.2 帧内广角预测(WAIP)

HEVC采用四叉树划分结构，对于每个正方形N×N的CU帧内角度预测模式的范围为45°— -135°，其左、上参考样点数目都是2N+1。但是VVC采用了QTMTT划分结构，CU尺寸不局限于正方形，还有矩形尺寸。对于一个尺寸为W×H的CU，为满足45度~-135度的角度预测范围，左、上分别需要W+H+1个参考样点，这种角度预测范围虽然兼容了HEVC相关技术，但是并没有考虑到VVC中QTMTT的特点，例如：(1)当W>H时，待预测像素距离上方的参考像素更近；(2)当W

这种矩形尺寸的CU并不是沿斜对角线对称的，这就造成对于某些预测角度，其预测值使用的是很远的参考像素而不会用邻近的参考像素，如下图所示。

左侧示例，待预测像素A距离上方参考像素T更近，但是由于预测角度限制，最终使用左侧像素L预测。对于右侧示例，待预测像素A距离左侧参考像素L更近，但是由于预测角度限制，最终使用上方像素T进行预测。

为解决此问题，对于非方形的编码块，VTM提出了帧内广角预测技术，为了不增加帧内预测模式数量，广角预测将依据CU的长宽比，自适应替换原始的角度预测模式，被替换的模式按照原始的索引进行传输，在解码端载替换为相应的广角预测。广角预测模式下，尺寸为W×H的CU上方参考像素点个数为2W+1，左侧参考样点个数为2H+1。如下图所示。

由上图可以看到，可被替换的角度预测模式与CU的宽高比有关，现在总结如下， |宽高比| 被替换的角度模式 | |--|--| |W / H == 16 |12, 13,14,15 | | W / H == 8|12, 13 | | W / H == 4 |2,3,4,5,6,7,8,9,10,11 | |W / H == 2 | 2,3,4,5,6,7| |W / H == 1 | 无 | |W / H == 1/2 |61,62,63,64,65,66 | |W / H == 1/4 |57,58,59,60,61,62,63,64,65,66 | |W / H == 1/8 |55, 56 | |W / H == 1/16 | 53, 54, 55, 56 |

在此，需要注意的是，在广角预测下，相邻像素的参考像素可能并不相邻，如下所示

因此，在广角模式下，为了降低非相邻参考样点对预测的影响，需要对参考值进行低通滤波，即参考样点的平滑。加入广角预测模式之后，VTM所支持的预测角度如下图所示

1.3 基于模式的参考样本平滑(MDIS)

VTM采用4抽头的插值滤波器用于生成角度预测参考像素，以提高角度预测的预测精度。在HEVC中，角度预测参考像素通过2抽头的线性插值滤波器计算得到，而VTM使用了更精确的6bit 4抽头高斯插值滤波器。VTM中以下五种模式不进行四抽头滤波：2, HOR_IDX, DIA_IDX, VER_IDX和66；其余所有角度模式都要进行滤波。

根据帧内预测的模式，参考样本的平滑遵循以下原则(JVET-L0628)：帧内角度预测模式将被分为如下三类：A: 水平、垂直模式(HOR_IDX, VER_IDX)；B: 对角线模式(2, DIA_IDX, VDIA_IDX)；C: 其他角度模式。

对于A类模式，不需要对参考样点进行滤波。

对于B类模式，参考样点有可能会使用抽头系数为[1,2,1]的参考样本滤波器进行平滑，然后直接生成帧内预测值，不需要进行插值预测。此可能性根据MDIS的条件判断。

对于C类模式，对参考像素使用帧内插值滤波器生成预测样本，不需要对参考像素进行平滑滤波。

2. 跨分量线性模型预测(CCLM)

为降低颜色分量间的冗余，VTM采用了跨分量线性模型的色度预测模式，即色度值可根据已重建亮度像素线性变换得到，变换函数为pred_C (i,j)=α•rec_L'(i,j)+β，其中pred_C为预测的色度值，rec_L'(i,j)表示已重建的亮度下采样后的值。参数α和β通过相邻CU的亮度和色度计算得到，计算公式为 $α = \frac{Y_a - Y_b}{X_a - X_b}$，$β = Y_b - α \times X_b$。其中，$Y_a$ 是相邻亮度像素下采样后最大亮度像素的亮度值，$X_a 是Y_a$对应的色度值。 $Y_b$ 是相邻亮度像素下采样后最大亮度像素的亮度值，$X_b 是Y_b$对应的色度值。下图给出一个CCLM预测的例子

VTM中计算α的除法操作通过查表获得，以降低计算复杂度。为了减少表的存储空间，最大最小的差值 diff 和 α 以指数形式存储和计算。例如，diff近似为4位有效位和一个指数量级。因此，1/diff 的表格元素可减少为16 个，如下 $DivTable [ ] = { 0, 7, 6, 5, 5, 4, 4, 3, 3, 2, 2, 1, 1, 1, 1, 0 }$ 总之，这种计算方式不仅减少了计算复杂度还减少了存储空间。

除了亮度所有的上方参考像素和左侧参考像素联合计算线性模型的参数外，模型参数还有另外两种计算方式，即CCLM还有两位两种模式，称之为LM_A和LM_L模式。LM_A模式仅使用已重建亮度像素的上方元素作为参考像素计算线性模型参数，为了获取足够参考像素，上方亮度参考像素扩展为W+H个

LM_L模式仅使用已重建像素左侧元素计算线性模型参数，同样，左侧参考像素扩展为H+W个

对于4:2:0色度采样的序列，需要对对亮度信息进行下采样，VTM支持两种2：1采样方式。采样滤波器的选择由SPS指出，分表标识为“type-0”和“type-2”，如下

线性模型参数的计算过程不仅在编码端进行，解码端同样进行相同的操作，因此参数alpha和belta不用记录在码流中。

VTM色度共有8种预测模式，包括5种亮度分量的帧内模式和三种CCLM模式(CCLM、LM_A、LM_L)。色度模式的传输和获取过程如下表所示

帧内色度模式的编码依赖于相应的亮度块，因为VTM中I帧的亮度和色度分量可能会有不同的划分结构，一个色度块可能对应多个亮度块。因此，对于色度的DM模式，使用当前色度块中心像素对应的亮度块的帧内预测模式。

3. 位置自适应帧内联合预测(PDPC)

在VTM中，帧内某些模式的预测结果将通过位置自适应帧内联合预测模式进行修正。简单来说，PDPC模式就是通过未滤波和已滤波的参考像素的预测值加权作为最终的预测值。VTM中的以下模式将默认进行PDPC：Planar, DC, horizontal, vertical, bottom-left angular mode and its eight adjacent angular modes, and top-right angular mode and its eight adjacent angular modes.

最终预测值pred(x,y) 为(传统帧内模式预测值)与(参考像素直接计算的修正值)的和，计算公式如下： $pred(x,y) = [ wL×R_{-1,y} + wT×R_{x,-1} – wTL ×R_{-1,-1} + (64 – wL – wT+wTL) × pred(x,y) + 32 ]>>6$ 其中$R_{x,-1}$和$R_{-1,y}$当前像素(x,y)上方和左侧的相邻参考像素，$R_{-1,-1}$表示当前块左上角的参考像素。

类似于HEVC中DC模式的边界滤波器和水平/垂直模式的边缘滤波器，当PDPC作用于DC、Planar、水平和垂直预测模式时，不需要额外的边界滤波器。

下图列出不同预测模式的PDPC的预测方式和相应参考像素，其中pred (x’, y’)是预测像素位于当前预测块的(x’, y’)。对于对角线模式，参考像素$R_{x,-1}$的横坐标x计算方式为x = x’ + y’ + 1，纵坐标y计算方式为y = x’ + y’ + 1。对于别的方向模式，参考像素可能会处于分数像素位置，此时，使用最邻近的整数像素值进行替代。

PDPC的权重依赖于帧内预测模式，具体如下 |预测模式 | wT |wL | wTL |

|--|--|--|--| | 右上对角线模式 |16 >> ( ( y’<<1 ) >> shift) | 16 >> ( ( x’<<1 ) >> shift) | 0 |

| 右上对角线模式相邻角度 | 32 >> ( ( y’<<1 ) >> shift ) | 0 |0 |

| 下左对角线模式相邻角度 | 0 | 32 >> ( ( x’<<1 ) >> shift ) | 0 |

4. 多行预测模式(MRL)

多行帧内预测模式即使用多个参考行的帧内预测，如下图所示

传统帧内预测(如HEVC等)使用reference line 0进行帧内预测，VTM增加了两个参考行reference line 1和reference line 3。需要注意的是，Segment A和Segment F并不是相邻的已重建像素，而是由临近的Segment B和Segment E填充得到。

多行预测的参考行索引(mrl_idx)需要传输到解码端以生成相应的帧内参考像素，即帧内多行编解码模式信息为 “预测模式+ 参考行索引” 。VTM为了降低码率，同时平衡编码端复杂度，对于不使用reference line 0的多行预测，其额外的参考行模式将包含在MPM列表中，因此只需要传输MPM的索引即可。码流中，参考行的索引在帧内预测模式之前传输，DC和Planar模式不使用多行预测。

需要额外注意，为了避免使用CTU外扩展使用参考样本，多行预测模式对CTU最上第一行CU默认关闭。此外，PDPC默认对扩展参考行关闭。

5. 帧内逐块预测(ISP)

帧内逐块预测技术依据CU的亮度分量尺寸，将其沿水平或垂直方向划分成2个或者4个尺寸相同的子块，然后逐个子块进行预测重建。进行帧内ISP的最小CU尺寸为48或84(即最少需要32个像素)，48或84的CU会被分成2个子块，其他尺寸则被分成4个子块，即每个子块最要需要有16个像素。下图给出了一个例子，上方为4*8CU的ISP划分方式，下方为划分为4个子块的情况。

对于每个子块，重建信号为预测信号与残差信号的和，残差信号通过熵解码、反量化和反变换得到。(每个子块独立预测变换量化) 换句话说，每个子块的重建信号可以用来进行下一个子块的预测，CU中每个子块的重建、预测依次进行。位于当前CU左上角的第一个子块首先压缩，然后向下(水平划分)或者向右(垂直划分)依次编码, 每个子块公用相同的帧内预测模式。

5.1 ISP预测模式和其他工具的关系总结如下：多行预测：如果CU使用多行预测(参考行索引大于0)，则ISP默认关闭。

熵编码系数长度：所有情况下，子块熵编码以一组16个像素进行，按照子块尺寸的不同，其尺寸略有差异，具体如下：

MPM列表：ISP只对MPM列表中的模式进行。如果采用ISP模式，需要传输一个MPM索引，标注何种预测模式。DC模式不加入MPM列表，水平划分时，MPM中水平预测模式优先，垂直划分垂直预测模式优先。

变换核尺寸：尺寸16使用DCTII变换核

PDPC：ISP默认关闭PDPC。

MTS：...

5.2 针对ISP预测的编码端优化

平衡性能和复杂度，对编码端做出如下优化分别对ISP水平划分(ISP_H)和垂直划分(ISP_V)建立不同候选模式列表。

使用传统帧内预测(非ISP)RMD候选列表初始化ISP候选列表。

依据ISP划分类型，去除2中RMD非ISP的MPM模式。

在RD全搜索中，进行如下操作 (1) 传统帧内预测结束后，将未量化的DCT-II系数划分为三个区域：右上区域、左下区域和对角线(对角线包含DC系数) (2) 分别计算三个区域的变换系数的绝对值和(topRight, blowLeft, diag) (3) 计算两个比率：r1=topRight/belowLeft 和r2=diag/(topRight + belowLeft) (4) 保存最优帧内模式的r1和r2

如果r1大于预先设定的阈值，则跳过所有ISP_H的模式选择；如果r1小于预先设定的阈值，则跳过所有ISP_V的模式选择。

如果r2大于预先设定的阈值，跳过ISP_H和ISP_V。

对剩余的ISP_H和ISP_V候选列表中的模式进行RD全搜索。

Python 爬虫实战：视频平台播放量实时监控（含反爬对抗与数据趋势预测）西攻城狮北 python 爬虫音视频
一、引言在数字内容蓬勃发展的当下，视频平台的播放量数据已成为内容创作者、营销人员以及行业分析师手中极为关键的情报资源。它不仅能够实时反映内容的受欢迎程度，更能在竞争分析、营销策略制定以及内容优化等方面发挥不可估量的作用。然而，视频平台为了保护自身数据和用户隐私，往往会设置一系列反爬虫机制，对数据爬取行为进行限制。这就向我们发起了挑战：如何巧妙地突破这些限制，同时精准地捕捉并预测播放量的动态变化趋势
LLM中最后一个词语的表征（隐藏状态）通常会融合前面所有词语的信息吗？ ZhangJiQun&MXP 教学 2024大模型以及算力 2021 AI python 机器学习算法深度学习人工智能
LLM中最后一个词语的表征（隐藏状态）通常会融合前面所有词语的信息吗？在大语言模型（LLM）中，最后一个词语的表征（隐藏状态）通常会融合前面所有词语的信息，这是由LLM的核心架构（以Transformer为基础）决定的，具体可以从以下角度理解：1.核心机制：自注意力（Self-Attention）的作用现代LLM（如GPT系列、Qwen等）均基于Transformer架构，其核心是自注意力机制。在
视频分析：让AI看懂动态画面随机森林404 计算机视觉音视频人工智能 microsoft
引言：动态视觉理解的革命在数字信息爆炸的时代，视频已成为最主要的媒介形式。据统计，每分钟有超过500小时的视频内容被上传到YouTube平台，而全球互联网流量的82%来自视频数据传输。面对如此海量的视频内容，传统的人工处理方式已无法满足需求，这正是人工智能视频分析技术大显身手的舞台。视频分析技术赋予机器"看懂"动态画面的能力，使其能够自动理解、解释甚至预测视频中的内容，这一突破正在彻底改变我们与视
卫星分析系列之使用卫星图像量化野火烧毁面积在 Google Colab 中使用 Python 使用 Sentinel-2 图像确定森林火灾烧毁面积知识大胖 NVIDIA GPU和大语言模型开发教程 python sentinel 开发语言
简介几年前，当大多数气候模型预测如果我们不采取必要措施，洪水、热浪和野火将会发生更多时，我没想到这些不寻常的灾难现象会成为常见事件。其中，野火每年摧毁大量森林面积。如果你搜索不同地方的重大野火表格，你会发现令人震惊的统计数据，显示由于野火，地球上有多少森林面积正在消失。在本教程中，我将结合我已经发表过的关于下载、处理卫星图像和可视化野火的故事，量化加州发生的其中一场重大野火的烧毁面积。与之前的帖子
使用STM32单片机控制步进电动机是一个常见的应用场景 QoyOle 单片机 stm32 mongodb
使用STM32单片机控制步进电动机是一个常见的应用场景。步进电动机可以通过产生脉冲信号来控制转动角度和速度。在本文中，我们将详细介绍如何使用STM32单片机来生成脉冲信号并控制步进电动机。下面是一个简要的步骤概览：初始化STM32单片机的GPIO引脚：首先，我们需要初始化单片机的GPIO引脚，以将其配置为输出模式。这些引脚将用于产生脉冲信号，并控制步进电动机的步进脚。具体的引脚配置取决于你使用的具
为什么你的服务器总被攻击？运维老兵的深度分析
作为运维人员，最头疼的莫过于服务器在毫无征兆的情况下变得异常缓慢、服务中断，甚至数据泄露。事后查看日志，常常发现一些“莫名其妙”的攻击痕迹。为什么服务器会成为攻击者的目标？这些攻击又是如何悄无声息发生的？今天，我们就从实战角度分析几种常见且容易被忽视的攻击模式，并教你如何通过日志分析初步定位问题。一、服务器被攻击的常见“莫名其妙”原因“扫楼式”探测与弱口令爆破：现象：服务器CPU、内存无明显异常，
搜广推校招面经九十三 Y1nhl 搜广推面经机器学习人工智能 python 算法推荐算法 pytorch 搜索算法
字节懂车帝一面一、NDCG（NormalizedDiscountedCumulativeGain）的计算NDCG是信息检索和排序任务中常用的评价指标，用于衡量模型预测的排序质量与真实相关性排序的一致程度。1.1.DCG@k（DiscountedCumulativeGain）DCG@k=∑i=1krelilog⁡2(i+1)\text{DCG@k}=\sum_{i=1}^{k}\frac{rel_i
目标检测中的NMS算法详解
好的，我们来详细解释一下目标检测中非极大值抑制（Non-MaximumSuppression,NMS）的相关概念和计算过程。1.为什么需要NMS？问题：目标检测模型（如FasterR-CNN,YOLO,SSD等）在推理时，对于同一个目标物体，通常会预测出多个重叠的、不同置信度（confidencescore）的候选边界框（BoundingBoxes）。直接输出所有这些框会导致：结果冗余：同一个物体
AWS 管理秘籍（一）绝不原创的飞龙默认分类默认分类
原文：annas-archive.org/md5/cf1c4e1db999839ba88fc56df4011156译者：飞龙协议：CCBY-NC-SA4.0序言AWS平台的增长速度非常快，正在被各行各业广泛采用。正如俗话所说，朋友不会让朋友建立数据中心。不管从哪个角度看，按需计算、网络和存储的模式将持续存在。尤其是当你看到AWS平台在功能和增强方面的更新速度时，很难再去反对站在巨人的肩膀上，尤其是
RidgeUI页面脚本开发系列:反应速度测试页面
简介大家好，欢迎学习ridgeui页面脚本开发系列:反应速度测试页面脚本开发反应速度测试是个很简单的应用，开始时显示红色屏幕内容，当变为绿色时，用户以最快速度点击页面，进而测算出反应时间。应用的分析虽然应用简单，但是从界面角度看，应用有5个不同的页面。分别是启动说明页、红色等待、绿色点击、反应结果页、提前点击结果页。页面脚本除了要进行反应时间的计时，还需要调度安排何时显示哪个页面。为此我们首先创建
使用tensorflow的线性回归的例子（十二） lishaoan77 tensorflow tensorflow 线性回归人工智能戴明回归
DemingRegression这里展示如何用TensorFlow求解线性戴明回归。=+y=Ax+b我们用iris数据集,特别是:y=SepalLength且x=PetalWidth。戴明回归Demingregression也称为totalleastsquares,其中我们最小化从预测线到实际点(x,y)的最短的距离。最小二乘线性回归最小化与预测线的垂直距离，戴明回归最小化与预测线的总的距离，这种
【C语言经典面试题】memcpy函数有没有更高效的拷贝实现方法？架构师李肯嵌入式物联网开发进阶 c语言面试性能优化
【C语言经典面试题】memcpy函数有没有更高效的拷贝实现方法？我相信大部分初中级C程序员在面试的过程中，可能都被问过关于memcpy函数的问题，甚至需要手撕memcpy。本文从另一个角度带你领悟一下memcpy的面试题，你可以看看是否能接得住？文章目录1写在前面2源码实现2.1函数申明2.2简单的功能实现2.3满足大数据量拷贝的功能实现3源码测试4小小总结5更多分享1写在前面假如你遇到下面的面试
如何使用Python实现交通工具识别
如何使用Python实现交通工具识别文章目录技术架构功能流程识别逻辑用户界面增强特性依赖项主要类别内容展示该系统是一个基于深度学习的交通工具识别工具，具备以下核心功能与特点：技术架构使用预训练的ResNet50卷积神经网络模型（来自ImageNet数据集）集成图像增强预处理技术（随机裁剪、旋转、翻转等）采用多数投票机制提升预测稳定性基于置信度评分的结果筛选策略功能流程用户通过GUI界面选择待识别图
【EGSR2025】材质+扩散模型+神经网络相关论文整理随笔（四） Superstarimage 文献随笔材质神经网络人工智能扩散模型
AnevaluationofSVBRDFPredictionfromGenerativeImageModelsforAppearanceModelingof3DScenes输入3D场景的几何和一张参考图像，通过扩散模型和SVBRDF预测器获取多视角的材质maps，这些maps最终合并成场景的纹理地图集，并支持在任意视角、任意光照条件下进行重新渲染。样例图如下：在当前时代的技术背景下，生成与几何匹配
医疗金融预测与语音识别中的模型优化及可解释性技术突破智能计算研究中心其他
内容概要随着人工智能技术的纵深发展，模型优化与可解释性技术正在重塑医疗诊断、金融预测及语音识别领域的应用范式。在医疗领域，基于自适应学习的动态参数调整机制，结合迁移学习的跨场景知识复用，显著提升了疾病筛查模型的泛化能力；而金融预测场景中，联邦学习框架通过分布式数据协作，在保障隐私安全的前提下，实现了风险预测模型的多维度优化。语音识别领域则依托边缘计算架构，将模型压缩技术与实时推理引擎结合，有效解决
第35周—————糖尿病预测模型优化探索
目录目录前言1.检查GPU2.查看数据编辑3.划分数据集4.创建模型与编译训练5.编译及训练模型6.结果可视化7.总结前言本文为365天深度学习训练营中的学习记录博客原作者：K同学啊1.检查GPUimporttorch.nnasnnimporttorch.nn.functionalasFimporttorchvision,torch#设置硬件设备，如果有GPU则使用，没有则使用cpudevice=
用Python向PDF添加文本：新建与编辑内容的三种方式
PDF文档的版式特性使其适用于输出不可变格式的报告与合同。但若要在此类文档中插入或修改文本，常规方式难以实现。借助Python，我们可以高效地向PDF添加文本，实现从文档生成到内容审阅的自动化流程。本文将从技术角度详细讲解三种PDF文本添加方式：✅新建PDF文档并添加段落文本；✅向现有PDF文件插入简短说明或批注；✅自定义文本格式、对齐方式与排版区域。本文使用的方法需要用到免费的FreeSpire
如何选择适合自己企业的YashanDB数据库托管服务？数据库
引言在当前数据驱动的业务环境中，企业面临着许多挑战，例如性能瓶颈、数据一致性问题和大规模数据处理需求等。因此，选择合适的数据库托管服务成为企业成功的关键因素之一。YashanDB作为一款具备高性能与高可用性的数据库系统，为企业提供了灵活的数据库部署和管理选项。然而，不同企业的需求差异化，需要综合考量多方面的因素来选择最适合的托管服务。本文旨在帮助企业在选择YashanDB数据库托管服务时从多角度进
bert中 [CLS] 和 [SEP] 表示什么意思？
[CLS]和[SEP]是BERT中的两个特殊标记符号，在BERT的输入文本中起到特殊的作用。[CLS]是"classification"的缩写，在文本分类任务中，它通常表示句子或文档的开头。在BERT中，[CLS]对应着输入文本中第一个词的词向量，输出层中的第一个神经元通常会被用来预测文本的类别。[SEP]是"separator"的缩写，它通常表示句子或文档的结尾。在BERT中，[SEP]对应着输
【Rust日报】使用Rust开发分布式系统的经验教训
Fjall-一个安全Rust的KV存储引擎Fjall是一个可嵌入的基于LSM的forbid-unsafeRust键值存储引擎。它的目标是成为一个可靠且可预测但性能优异的通用KV存储引擎，适用于小型数据集，尤其是大于内存大小的数据集。我刚刚发布了1.0版本，该版本稳定了其数据格式，适用于所有未来的1.x.x版本。它的设计受到了LevelDB/RocksDB架构的重大影响，并且通常具有相似的性能。它具
面试技术问题总结一 Z字小熊饼干爱吃保安面试数据库职场和发展
MySQL的几种锁机制一、从锁的粒度角度划分表级锁机制：它是对整张表进行锁定的一种锁。当一个事务对表执行写操作时，会获取写锁，在写锁持有期间，其他事务无法对该表进行读写操作；而当事务执行读操作时，会获取读锁，读锁之间是共享的，多个事务可以同时对表加读锁。行级锁机制：行级锁仅对操作的行进行锁定。它能最大程度地支持并发处理。行级锁又可细分为共享锁和排他锁。共享锁允许多个事务同时读取同一行数据；排他锁则
YOLOv8 环境监测五大场景 —— 二、森林火灾早期预警之无人机巡逻监测详细解释及代码完整示例路飞VS草帽 YOLOv8 原理与源代码讲解---六大章 YOLOv各版本的应用详细说明及代码示例环境监测五大场景 YOLO 无人机环境监测森林火灾早期预警无人机巡逻监测 YOLOv8
YOLOv8无人机森林火灾巡逻监测系统系统架构设计无人机火灾监测系统组成：1.飞行平台-多旋翼无人机(续航≥60分钟)-双光吊舱(可见光+红外)-RTK高精度定位-4G/5G数据链2.机载计算单元-JetsonOrinNX(AI加速)-轻量化YOLOv8模型-实时火情分析3.地面控制站-飞行路径规划-实时视频监控-火情预警系统4.云端协同-多机任务分配-火势扩散预测-应急资源调度完整代码实现1.无
【个人思考】如何理解量化交易与做空？初学者必读的金融交易入门指南姚瑞南Raynan 个人思考人工智能 AIGC
本文原创作者：姚瑞南AI-agent大模型运营专家/音乐人/野生穿搭model，先后任职于美团、猎聘等中大厂AI训练专家和智能运营专家岗；多年人工智能行业智能产品运营及大模型落地经验，拥有AI外呼方向国家专利与PMP项目管理证书。（转载需经授权）目录金融交易中的一些常见概念：量化交易、做空以及更多1️⃣量化交易：数据驱动的交易方式2️⃣做空：预测价格下跌赚取差价个人做空的理解：借西瓜赚差价3️⃣做
DeepSeek 驱动智能交通调度：从传统到智慧的跃迁之路奔跑吧邓邓子 DeepSeek 实战 DeepSeek 智能交通调度应用
目录一、引言二、DeepSeek技术概述2.1DeepSeek简介2.2核心技术原理2.3技术特点与优势三、智能交通调度现状与挑战3.1智能交通调度系统构成3.2现存问题与挑战四、DeepSeek在智能交通调度中的应用4.1交通流量预测与优化4.2智能信号灯控制4.3公交智能排班与调度4.4地铁智能运维与调度4.5交通枢纽智能管理4.6事故预防与应急响应五、应用案例分析5.1某省会城市交通优化案例
Google机器学习实践指南(模型预测偏差) AI_Auto 人工智能机器学习人工智能
Google机器学习（31）-模型预测偏差预测偏差：模型为何总是"猜不准"的真相揭秘你的模型预测准确率高达95%，却总是与实际情况差那么一点点？这可能是预测偏差在作祟！本文将带你深入探索这个被忽视的模型"隐形杀手"。一、什么是预测偏差？一个生活化案例想象一下，你网购了一个智能体重秤，连续一周称重显示都是60kg。但你去健身房用专业设备测量，实际是62kg。这种系统性的测量偏差，就是预测偏差在现实中
人工智能大模型如何助力产品经理优化商品定价策略产品经理独孤虾人工智能产品经理智能营销数字营销价格策略大模型电子商务
摘要商品定价策略是电商、广告营销和用户增长等数字化营销业务中的重要环节，它直接影响着企业的收入和利润，以及用户的满意度和忠诚度。本文从产品经理的视角，介绍了如何应用人工智能大模型来优化商品定价策略的步骤，包括分析商品定价策略的影响因素、市场需求预测、商品成本分析、商品定价策略优化和使用人工智能大模型优化商品定价策略。本文旨在帮助产品经理和运营人员了解人工智能大模型在商品定价策略中的作用和价值，以及
Python自动化机器学习平台库之mindsdb使用详解
概要MindsDB是一个开源的自动化机器学习平台，它通过SQL接口简化了机器学习模型的创建、训练和预测过程。该库的核心理念是将机器学习功能直接集成到数据库中，让开发者无需深入了解复杂的机器学习算法，就能够快速构建和部署预测模型。MindsDB支持多种数据源连接，包括MySQL、PostgreSQL、MongoDB等主流数据库，同时提供了丰富的PythonAPI接口，使得数据科学家和开发者能够在熟悉
达摩院发布2022十大科技趋势！俺是一个也看不懂鸭！ xhmj12 人工智能网络大数据机器学习编程语言
上一篇：MVVM已过时？MVVM升级版：MVI架构来了来源|达摩院/阿里技术小伙伴们大家好。2021年12月28日，阿里巴巴达摩院发布了2022年的十大科技趋势预测(https://damo.alibaba.com/techtrends/2022)，作为一个打工人，俺也第一时间追了一波。虽说很多都看不懂，但是我想着多了解了解趋势和方向总是好的，所以咱们这里也分享一波。这次应该是达摩院连续第四年发
12 | 走向元宇宙：数字化工作与生活 _Rye_ 元宇宙
专栏快接近尾声了。在之前的课程里，我们一直在用一个框架来概括元宇宙，那就是：元宇宙=立体互联网+价值互联网。这个公式可以帮助我们从宏观角度更好地理解元宇宙。当我们回归工作和生活，用更加个人化的角度来观察元宇宙时，我们可以换用另外一个等式：元宇宙=实体空间+数字空间。通过这个等式，我们可以看到，元宇宙将带给我们线上线下全面融合的数字生活。这一讲的讨论分成两个部分。首先，我们来看看自己周围的数字化发展
使用Qlib基于LightGBM预测沪深300涨跌 DeepReinforce 量化投资
Qlib是一个专为量化金融和算法交易研究设计的开源库。本文配置一个基于LightGBM的梯度提升决策树（GBDT）模型，并使用金融数据集（包含158个技术指标特征）进行训练和预测。1.导入必要的模块pythonCollapseWrapRunCopyfromqlib.contrib.model.gbdtimportLGBModelfromqlib.contrib.data.handlerimport
Java实现的基于模板的网页结构化信息精准抽取组件：HtmlExtractor yangshangchuan 信息抽取 HtmlExtractor 精准抽取信息采集
HtmlExtractor是一个Java实现的基于模板的网页结构化信息精准抽取组件，本身并不包含爬虫功能，但可被爬虫或其他程序调用以便更精准地对网页结构化信息进行抽取。 HtmlExtractor是为大规模分布式环境设计的，采用主从架构，主节点负责维护抽取规则，从节点向主节点请求抽取规则，当抽取规则发生变化，主节点主动通知从节点，从而能实现抽取规则变化之后的实时动态生效。如
java编程思想 -- 多态百合不是茶 java 多态详解
一: 向上转型和向下转型面向对象中的转型只会发生在有继承关系的子类和父类中（接口的实现也包括在这里）。父类：人子类：男人向上转型： Person p = new Man() ; //向上转型不需要强制类型转化向下转型： Man man =
[自动数据处理]稳扎稳打,逐步形成自有ADP系统体系 comsci dp
对于国内的IT行业来讲,虽然我们已经有了"两弹一星",在局部领域形成了自己独有的技术特征,并初步摆脱了国外的控制...但是前面的路还很长.... 首先是我们的自动数据处理系统还无法处理很多高级工程...中等规模的拓扑分析系统也没有完成,更加复杂的
storm 自定义日志文件商人shang storm cluster logback
Storm中的日志级级别默认为INFO，并且，日志文件是根据worker号来进行区分的，这样，同一个log文件中的信息不一定是一个业务的，这样就会有以下两个需求出现： 1. 想要进行一些调试信息的输出 2. 调试信息或者业务日志信息想要输出到一些固定的文件中不要怕，不要烦恼，其实Storm已经提供了这样的支持，可以通过自定义logback 下的 cluster.xml 来输
Extjs3 SpringMVC使用 @RequestBody 标签问题记录 21jhf
springMVC使用 @RequestBody(required = false) UserVO userInfo 传递json对象数据，往往会出现http 415，400,500等错误，总结一下需要使用ajax提交json数据才行，ajax提交使用proxy，参数为jsonData，不能为params；另外，需要设置Content-type属性为json，代码如下：（由于使用了父类aaa
一些排错方法文强chu 方法
1、java.lang.IllegalStateException: Class invariant violation at org.apache.log4j.LogManager.getLoggerRepository(LogManager.java:199)at org.apache.log4j.LogManager.getLogger(LogManager.java:228) at o
Swing中文件恢复我觉得很难小桔子 swing
我那个草了！老大怎么回事，怎么做项目评估的？只会说相信你可以做的，试一下，有的是时间！用java开发一个图文处理工具，类似word，任意位置插入、拖动、删除图片以及文本等。文本框、流程图等，数据保存数据库，其余可保存pdf格式。ok,姐姐千辛万苦，
php 文件操作 aichenglong PHP 读取文件写入文件
1 写入文件 @$fp=fopen("$DOCUMENT_ROOT/order.txt", "ab"); if(!$fp){ echo "open file error" ; exit; } $outputstring="date:"." \t tire:".$tire."
MySQL的btree索引和hash索引的区别 AILIKES 数据结构 mysql 算法
Hash 索引结构的特殊性，其检索效率非常高，索引的检索可以一次定位，不像B-Tree 索引需要从根节点到枝节点，最后才能访问到页节点这样多次的IO访问，所以 Hash 索引的查询效率要远高于 B-Tree 索引。可能很多人又有疑问了，既然 Hash 索引的效率要比 B-Tree 高很多，为什么大家不都用 Hash 索引而还要使用 B-Tree 索引呢
JAVA的抽象--- 接口 --实现百合不是茶
抽象接口实现接口 //抽象类 ,方法 //定义一个公共抽象的类 ,并在类中定义一个抽象的方法体抽象的定义使用abstract abstract class A 定义一个抽象类例如： //定义一个基类 public abstract class A{ //抽象类不能用来实例化，只能用来继承 //
JS变量作用域实例 bijian1013 作用域
<script> var scope='hello'; function a(){ console.log(scope); //undefined var scope='world'; console.log(scope); //world console.log(b);
TDD实践（二） bijian1013 java TDD
实践题目：分解质因数 Step1：单元测试： package com.bijian.study.factor.test; import java.util.Arrays; import junit.framework.Assert; import org.junit.Before; import org.junit.Test; import com.bijian.
[MongoDB学习笔记一]MongoDB主从复制 bit1129 mongodb
MongoDB称为分布式数据库，主要原因是1.基于副本集的数据备份， 2.基于切片的数据扩容。副本集解决数据的读写性能问题，切片解决了MongoDB的数据扩容问题。事实上，MongoDB提供了主从复制和副本复制两种备份方式，在MongoDB的主从复制和副本复制集群环境中，只有一台作为主服务器，另外一台或者多台服务器作为从服务器。本文介绍MongoDB的主从复制模式，需要指明
【HBase五】Java API操作HBase bit1129 hbase
import java.io.IOException; import org.apache.hadoop.conf.Configuration; import org.apache.hadoop.hbase.HBaseConfiguration; import org.apache.hadoop.hbase.HColumnDescriptor; import org.apache.ha
python调用zabbix api接口实时展示数据 ronin47
zabbix api接口来进行展示。经过思考之后，计划获取如下内容： 1、获得认证密钥 2、获取zabbix所有的主机组 3、获取单个组下的所有主机 4、获取某个主机下的所有监控项
jsp取得绝对路径 byalias 绝对路径
在JavaWeb开发中，常使用绝对路径的方式来引入JavaScript和CSS文件，这样可以避免因为目录变动导致引入文件找不到的情况，常用的做法如下：一、使用${pageContext.request.contextPath} 　　代码” ${pageContext.request.contextPath}”的作用是取出部署的应用程序名，这样不管如何部署，所用路径都是正确的。
Java定时任务调度：用ExecutorService取代Timer bylijinnan java
《Java并发编程实战》一书提到的用ExecutorService取代Java Timer有几个理由，我认为其中最重要的理由是：如果TimerTask抛出未检查的异常，Timer将会产生无法预料的行为。Timer线程并不捕获异常，所以 TimerTask抛出的未检查的异常会终止timer线程。这种情况下，Timer也不会再重新恢复线程的执行了;它错误的认为整个Timer都被取消了。此时，已经被
SQL 优化原则 chicony sql
一、问题的提出　在应用系统开发初期，由于开发数据库数据比较少，对于查询SQL语句，复杂视图的的编写等体会不出SQL语句各种写法的性能优劣，但是如果将应用系统提交实际应用后，随着数据库中数据的增加，系统的响应速度就成为目前系统需要解决的最主要的问题之一。系统优化中一个很重要的方面就是SQL语句的优化。对于海量数据，劣质SQL语句和优质SQL语句之间的速度差别可以达到上百倍，可见对于一个系统
java 线程弹球小游戏 CrazyMizzz java 游戏
最近java学到线程，于是做了一个线程弹球的小游戏，不过还没完善这里是提纲 1.线程弹球游戏实现 1.实现界面需要使用哪些API类 JFrame JPanel JButton FlowLayout Graphics2D Thread Color ActionListener ActionEvent MouseListener Mouse
hadoop jps出现process information unavailable提示解决办法 daizj hadoop jps
hadoop jps出现process information unavailable提示解决办法 jps时出现如下信息： 3019 -- process information unavailable3053 -- process information unavailable2985 -- process information unavailable2917 --
PHP图片水印缩放类实现 dcj3sjt126com PHP
<?php class Image{ private $path; function __construct($path='./'){ $this->path=rtrim($path,'/').'/'; } //水印函数，参数：背景图，水印图，位置，前缀,TMD透明度 public function water($b,$l,$pos
IOS控件学习：UILabel常用属性与用法 dcj3sjt126com ios UILabel
参考网站： http://shijue.me/show_text/521c396a8ddf876566000007 http://www.tuicool.com/articles/zquENb http://blog.csdn.net/a451493485/article/details/9454695 http://wiki.eoe.cn/page/iOS_pptl_artile_281
完全手动建立maven骨架 eksliang java eclipse Web
建一个 JAVA 项目： mvn archetype:create -DgroupId=com.demo -DartifactId=App [-Dversion=0.0.1-SNAPSHOT] [-Dpackaging=jar] 建一个 web 项目： mvn archetype:create -DgroupId=com.demo -DartifactId=web-a
配置清单 gengzg 配置
1、修改grub启动的内核版本 vi /boot/grub/grub.conf 将default 0改为1 拷贝mt7601Usta.ko到/lib文件夹拷贝RT2870STA.dat到 /etc/Wireless/RT2870STA/文件夹拷贝wifiscan到bin文件夹，chmod 775 /bin/wifiscan 拷贝wifiget.sh到bin文件夹，chm
Windows端口被占用处理方法 huqiji windows
以下文章主要以80端口号为例，如果想知道其他的端口号也可以使用该方法..........................1、在windows下如何查看80端口占用情况?是被哪个进程占用?如何终止等. 这里主要是用到windows下的DOS工具,点击"开始"--"运行",输入&
开源ckplayer 网页播放器，跨平台(html5, mobile)，flv, f4v, mp4, rtmp协议. webm, ogg, m3u8 ！天梯梦 mobile
CKplayer，其全称为超酷flv播放器，它是一款用于网页上播放视频的软件，支持的格式有：http协议上的flv,f4v,mp4格式，同时支持rtmp视频流格式播放，此播放器的特点在于用户可以自己定义播放器的风格，诸如播放/暂停按钮，静音按钮，全屏按钮都是以外部图片接口形式调用，用户根据自己的需要制作出播放器风格所需要使用的各个按钮图片然后替换掉原始风格里相应的图片就可以制作出自己的风格了，
简单工厂设计模式 hm4123660 java 工厂设计模式简单工厂模式
简单工厂模式（Simple Factory Pattern）属于类的创新型模式，又叫静态工厂方法模式。是通过专门定义一个类来负责创建其他类的实例，被创建的实例通常都具有共同的父类。简单工厂模式是由一个工厂对象决定创建出哪一种产品类的实例。简单工厂模式是工厂模式家族中最简单实用的模式，可以理解为是不同工厂模式的一个特殊实现。
maven笔记 zhb8015 maven
跳过测试阶段： mvn package -DskipTests 临时性跳过测试代码的编译： mvn package -Dmaven.test.skip=true maven.test.skip同时控制maven-compiler-plugin和maven-surefire-plugin两个插件的行为，即跳过编译，又跳过测试。指定测试类 mvn test
非mapreduce生成Hfile，然后导入hbase当中 Stark_Summer map hbase reduce Hfile path实例
最近一个群友的boss让研究hbase，让hbase的入库速度达到5w+/s，这可愁死了，4台个人电脑组成的集群，多线程入库调了好久，速度也才1w左右，都没有达到理想的那种速度，然后就想到了这种方式，但是网上多是用mapreduce来实现入库，而现在的需求是实时入库，不生成文件了，所以就只能自己用代码实现了，但是网上查了很多资料都没有查到，最后在一个网友的指引下，看了源码，最后找到了生成Hfile
jsp web tomcat 编码问题王新春 tomcat jsp pageEncode
今天配置jsp项目在tomcat上，windows上正常，而linux上显示乱码，最后定位原因为tomcat 的server.xml 文件的配置，添加 URIEncoding 属性： <Connector port="8080" protocol="HTTP/1.1" connectionTi

hevc角度预测_VVC帧内预测工具详解

你可能感兴趣的:(hevc角度预测)