心メ守护

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理

一、模型介绍

ch_ppocr_server_v2.0_rec是一种通用的中文的识别模型，它的识别模块是基于文本识别算法SVTR优化。SVTR不再采用RNN结构，而是采用的是CRNN，通过引入Tranformers结构更加有效地挖掘文本行图像的上下文信息，从而提升文本识别能力。虽然CRNN的识别方法是2016年提出来的，但是对于中文识别，是使用最普遍也最有效的文本识别方法。CRNN主要是融合了卷积特征和序列特征，用以解决预测标签和真值签不一致的问题。为了进一步提高文本识别的效果和效率，该模型采用了余弦学习率、增大特征图分辨率、正则化参数、预热学习率等策略。开发流程示意图如下图所示：

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第1张图片

二、MindStudio 环境搭建

通过 MindStudio 官网介绍可以学习了解 MindStudio 的功能，以及按照

MindStudio 用户手册进行安装和使用。官网链接： https://www.hiascend.com/zh/software/mindstudio

用户手册： https://www.hiascend.com/document/detail/zh/mindstudio/50RC2/prog ressiveknowledge/index.html

2.1MindStudio 软件下载

在官网首页中点击“立即下载”，如下图。

然后我们进入版本选择界面，可以根据自己的操作系统、安装方式选择不同的软件包，我们这里选择的是 MindStudio_5.0.RC2_win.exe，进行下载安装。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第2张图片

点击对应的“软件包下载”，弹出软件下载需知对话框，勾选“我已阅读并已同意 MindStudio 软件许可协议的条款和条件”，然后点击“立即下载”进入下载流程。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第3张图片

2.2MindStudio 软件安装

双击打开下载好的 MindStudio_5.0.RC2_win.exe 软件包，进入安装流程：

欢迎界面，选择“next”

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第4张图片

选择安装路径，我们使用的是默认安装路径，然后点击“Next”。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第5张图片

安装配置，我们只勾选了创建桌面快捷方式，和以工程方式打开文件夹添加到右键菜单中。然后点击“Next”。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第6张图片

启动菜单文件夹我们使用默认配置，点击“Install”,程序进入自动安装步骤。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第7张图片

安装完成后点击“Finsh”完成安装。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第8张图片

2.3MindStudio 环境搭建

通过桌面快捷方式启动 MindStudio。

选择不导入配置，点击“OK”

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第9张图片

Projects 标签用于工程打开、创建等。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第10张图片

Customize 标签用于 IDE 配置，包括界面、字体大小等。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第11张图片

Plugins 标签用于管理插件的安装、删除等。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第12张图片

Learn MindStudio 标签可以通过点击“Help”进入官方社区获取帮助。在 Projects 标签下点击“New Project”创建一个新的工程。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第13张图片

选择 Ascend App,输入工程名、和工程目录，点击“Change”选择或者添加CANN 版本。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第14张图片

点击 Remote CANN Setting 对话框中的加号，弹出 SSH Configurations 对话框，然后点击其中的加号，填写红框中的服务器信息，点击“Test Connection” 弹出连接成功对话框。

依次点击“OK”完成 Remote Connection 配置。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第15张图片

点击文件夹图标，在弹出的对话框中选择 CANN 安装路径，点击“OK”。

点击“Finish”。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第16张图片

开始同步远程 CANN 版本资源。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第17张图片

同步完成，点击“next”

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第18张图片

选择 ACL Project，点击“Finish”

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第19张图片

此时成功创建了一个空的工程。

点击“Tools”->“Start SSH session”。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第20张图片

选择远程环境，启动远程终端窗口。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第21张图片

点击“Tools”->“Deployment”->“Configuration”。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第22张图片

按下图所示，配置远端映射路径。依次点击“OK”完成配置。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第23张图片

按照下图，配置项目 SDK。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第24张图片

点击“SDKs”，点击加号，点击“Add Python SDK...”

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第25张图片

点击“SSH Interpreter”,自动识别远程 Python 环境信息，点击“OK”。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第26张图片

点击“Project”，选择创建的 SDK，点击“OK”。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第27张图片

点击“Modules”->“Dependence”，选择创建的 SDK，点击“OK”。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第28张图片

点击“Tools”-> “Deployment”->“Automatic Upload”。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第29张图片

选择远程服务器，可自动上传修改并保存的文件。至此 MindStudio 开发环境搭建完成。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第30张图片

三、模型获取

3.1模型介绍

本文开发的模型为基于 PaddlePaddle 的模型库 PaddleOCR 中的 ch_ppocr_server_v2.0_rec模型,该模型是基于PP-OCRv3结构

（https://github.com/PaddlePaddle/PaddleOCR/blob/release/2.5/doc/doc_ ch/PP-OCRv3_introduction.md）的中文识别模型，PP-OCRv3 的识别模块是基于文本识别算法 SVTR 优化。SVTR 不再采用 RNN 结构，通过引入 Transformers 结构更加有效地挖掘文本行图像的上下文信息，从而提升文本识别能力。

3.2获取源码

在本地终端中通过 git 命令获取源码，参考命令如下。

git clone -b release/2.6 https://github.com/PaddlePaddle/PaddleOCR.git

cd PaddleOCR

git reset --hard 7f6c9a7b99ea66077950238186137ec54f2b8cfd

cd ..

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第31张图片

修改模型配置文件，配置不使用 gpu 和中文汉字字典路径，如下图。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第32张图片

修改完成后将 PaddleOCR 同步到远程服务器,如下图。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第33张图片

3.3安装依赖

3.3.1添加依赖文件“requirements.txt”

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第34张图片

3.3.2在远程终端窗口通过 pip 命令安装依赖

执行命令如下，[--user]为可选参数，普通用户需要添加使用： pip3 install -r requirements.txt [--user] 通过以上步骤，成功获取 ch_ppocr_server_v2.0_rec 模型的源代码框架，以及配置成完全运行依赖环境。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第35张图片

四、数据预处理

4.1添加数据预处理脚本

在工程中添加数据预处理脚本，该脚本主要对图片进行归一化操作并转成二进制文件保存如下图所示。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第36张图片

4.2设置可执行命令。

3.2.1如下图所示，点击下拉按钮，选择“Edit Configurations...”。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第37张图片

3.2.2如下图所示，点击加号，选择“Ascend App”。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第38张图片

3.2.3如下图所示，输入命令名称，选择可执行脚本，点击“OK”。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第39张图片

3.2.4如下图所示，添加命令参数，点击“OK”。

-c：模型配置文件。

-o：可选参数列表: Global.infer_img表示图片路径。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第40张图片

3.2.5点击执行按钮，进行数据预处理。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第41张图片

通过以上步骤，完成了数据预处理的工作，生成的预处理数据保存在 image_bin 目录下。

五：模型转换

5.1、将训练模型转为推理模型

5.1.1获取推理权重文件，权重链接为：https://paddleocr.bj.bcebos.com/dygraph_v2.0/ch/ch_ppocr_server_v2.0_rec_train.tar 下载之后，解压到本地 PaddleOCR 目录下，并上传到远程服务器，如下图所示。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第42张图片

5.1.2运行tools目录下的export_model脚本，配置参数如下图所示：

-c: 模型配置文件

-o: 训练模型

Global.save_inference_dir：推理模型存储位置

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第43张图片

5.2.1在远程终端执行转 onnx 命令,并将生成的 onnx 模型拉取到本地，如下图所示，参考命令如下：

export PATH=/usr/local/python3.7.5/bin:$PATH

paddle2onnx \

--model_dir ch_server_v2.0_rec_infer \

--model_filename inference.pdmodel \

--params_filename inference.pdiparams \

--save_file ch_ppocr_server_v2.0_rec.onnx \

--opset_version 12 \

--input_shape_dict="{'x':[-1,3,32,-1]}" \

--enable_onnx_checker True

--model_dir：配置包含Paddle模型的路径

--model_filename:配置存储网络结构的文件名称

--params_filename:配置存储模型参数的文件名称

--save_file:指定转换后的模型保存目录路径

--opset_version:配置转换为ONNX的OpSet版本

--input_shape_dict:模型输入的shape

--enable_onnx_checker：配置是否检查导出为ONNX模型的正确性

通过以上步骤，成功生成并获取 onnx 模型：ch_ppocr_server_v2.0_rec.onnx。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第44张图片

5.3 转 om 模型

下面使用 MindStudio 的模型转换功能将 onnx 模型转成 om 模型。

5.3.1如下图所示，点击“Model Converter”按钮。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第45张图片

5.3.2在弹出的 Model Converter 窗口中选择 Model File，点击“OK”。模型转换参数如下：

--model：为ONNX模型文件。

--framework：5代表ONNX模型。

--output：输出的OM模型。

--input\_format：输入数据的格式。

--input\_shape：输入数据的shape。

--log：日志级别。

--soc\_version：处理器型号。

--dynamic_image_size:设置输入图片的动态分辨率参数。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第46张图片

5.3.3自动解析模型中,如下图。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第47张图片

5.3.4 解析完成后，设置模型名称、soc 版本、om 模型生成目录、通讯模型的Input Format、Shape、Type 信息，点击“Next”。

模型的shape设置为{1，3，-1，-1}，第一维的1是banchsize，第三维和第四维为-1，-1是因为要设置动态shape，以适应不同shape的预处理文件。Dynamic Image Size:32,320;32,413是根据预处理图片所设置的动态shape。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第48张图片

5.3.5检查完成后点击“Next”。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第49张图片

5.3.6检视生成的 atc 命令，确认无误后点击“Finish”

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第50张图片

5.3.7模型转换成功后，如下图所示。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第51张图片

通过以上步骤，使用 MindStudio 的模型转换功能成功将 onnx 模型转成 om模型：ch_ppocr_server_v2.0_rec_bs1.om。

六、模型推理

6.1获取推理工具

我们使用 ais-infer 工具进行推理，ais-infer 工具获取及使用方式请查看ais_infer 推理工具使用文档，链接：https://gitee.com/ascend/tools/tree/master/ais-bench_workload/tool/ais_infer

6.1.1在本地终端命令中通过 git 获取推理工具代码，命令如下：

git clone https://gitee.com/ascend/tools.git

6.1.2 ch_ppocr_server_v2.0_rec\tools\ais_bench_workload\tool\ais_infer 目录下的 ais_infer.py 文件和 frontend 文件夹复制到当前ch_ppocr_server_v2.0_rec 目录下, 并将进行改动的文件夹同步到远程服务器，如下图所示。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第52张图片

6.1.3 编译并安装 aclruntime 包，如下图所示，命令如下：

cd tools/ais-bench_workload/tool/ais_infer/backend/

pip3 wheel ./

pip3 install aclruntime-0.0.1-cp37-cp37m-linux_x86_64.whl

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第53张图片

通过以上步骤，成功获取 ais_infer 工具，并安装了 aclruntime。

6.2进行模型推理

6.2.1 添加 ch_server_rec_ais_infer.py 的可执行命令，点击“OK”，如下图所示。

--model：om模型路径。

--input：npy文件路径。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第54张图片

6.2.2 执行ch_server_rec_ais_infer.py命令，完成后在远程服务器上生成推理结果。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第55张图片

6.2.3 须将远程生成的结果 load 到本地，否则在执行其他命令进行同步的时候会删除。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第56张图片

通过以上步骤成功获取了推理结果。

七、模型精度验证

7.1数据后处理

7.1.1添加数据后处理脚本，对 results 文件夹中的预测结果进行精度测试。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第57张图片

7.1.2添加后处理命令。点击“OK”。

-c：模型配置文件。

-o：可选参数：Global.infer_results表示om推理结果路径。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第58张图片

7.1.3 后处理执行完成后，打印的推理结果如下图，具体为：Infer Results:

Word_1.jpg:[(‘韩国小馆’，0.998046875)]

Word_2.jpg:[(‘汉阳鹦鹉家居建材市场E区25-26号’，0.9932725429534912)]

Word_3.jpg:[(‘电话：159*****928’，0.998046875)]

Word_4.jpg:[(‘实力活力’，0.998046875)]

Word_5.jpg:[(‘西湾监管’，0.99609375)]

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第59张图片

八、性能测试

1、由于精度验证使用的是源码提供的样例图片，需要使用 ais_infer 工具的纯推理功能进行性能测试。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第60张图片

2、执行性能测试命令，如下图所示。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第61张图片

3 、性能测试结果如下图所示，为 298.084fps。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第62张图片

九、总结

本文主要介绍使用 MindStudio 全流程开发工具链，将 PaddlePaddle 模型转成 om 模型，并在昇腾环境上进行推理的端到端流程。在使用 MindStudio 过程中也遇到过很多问题和不懂的地方，除了参考官方指导文档外，帮助更多的还是开发者社区，如下图所示，推荐大家多看些经验分享，写的很详细也很有帮助。

MindStudio 社区链接为: https://bbs.huaweicloud.com/forum/forum-945-1.html?filterCondition=1

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第63张图片

十、FAQ

在使用 MindStudio 过程中，发现执行完远程命令后，会出现如下图所示的错误，该错误指同步远程文件到本地时出现了错误，经过定位发现项目中包含带有中文的文件名，因此需要将带有中文的文件名称改为英文文件名即可解决该问题。

使用MindStudio进行ch_ppocr_server_v2.0_rec模型在昇腾环境离线推理_第64张图片

机器学习与深度学习间关系与区别 ℒℴѵℯ心·动ꦿ໊ོ꫞ 人工智能学习深度学习 python
一、机器学习概述定义机器学习（MachineLearning,ML）是一种通过数据驱动的方法，利用统计学和计算算法来训练模型，使计算机能够从数据中学习并自动进行预测或决策。机器学习通过分析大量数据样本，识别其中的模式和规律，从而对新的数据进行判断。其核心在于通过训练过程，让模型不断优化和提升其预测准确性。主要类型1.监督学习（SupervisedLearning）监督学习是指在训练数据集中包含输入
将cmd中命令输出保存为txt文本文件落难Coder Windows cmd window
最近深度学习本地的训练中我们常常要在命令行中运行自己的代码，无可厚非，我们有必要保存我们的炼丹结果，但是复制命令行输出到txt是非常麻烦的，其实Windows下的命令行为我们提供了相应的操作。其基本的调用格式就是：运行指令>输出到的文件名称或者具体保存路径测试下，我打开cmd并且ping一下百度：pingwww.baidu.com>./data.txt看下相同目录下data.txt的输出：如果你再
探索OpenAI和LangChain的适配器集成：轻松切换模型提供商 nseejrukjhad langchain easyui 前端 python
#探索OpenAI和LangChain的适配器集成：轻松切换模型提供商##引言在人工智能和自然语言处理的世界中，OpenAI的模型提供了强大的能力。然而，随着技术的发展，许多人开始探索其他模型以满足特定需求。LangChain作为一个强大的工具，集成了多种模型提供商，通过提供适配器，简化了不同模型之间的转换。本篇文章将介绍如何使用LangChain的适配器与OpenAI集成，以便轻松切换模型提供商
深入理解 MultiQueryRetriever：提升向量数据库检索效果的强大工具 nseejrukjhad 数据库 python
深入理解MultiQueryRetriever：提升向量数据库检索效果的强大工具引言在人工智能和自然语言处理领域，高效准确的信息检索一直是一个关键挑战。传统的基于距离的向量数据库检索方法虽然广泛应用，但仍存在一些局限性。本文将介绍一种创新的解决方案：MultiQueryRetriever，它通过自动生成多个查询视角来增强检索效果，提高结果的相关性和多样性。MultiQueryRetriever的工
人工智能时代，程序员如何保持核心竞争力？ jmoych 人工智能
随着AIGC（如chatgpt、midjourney、claude等）大语言模型接二连三的涌现，AI辅助编程工具日益普及，程序员的工作方式正在发生深刻变革。有人担心AI可能取代部分编程工作，也有人认为AI是提高效率的得力助手。面对这一趋势,程序员应该如何应对?是专注于某个领域深耕细作，还是广泛学习以适应快速变化的技术环境?又或者，我们是否应该将重点转向AI无法轻易替代的软技能？让我们一起探讨程序员
数字里的世界17期：2021年全球10大顶级数据中心，中国移动榜首张三叨
你知道吗？2016年，全球的数据中心共计用电4160亿千瓦时，比整个英国的发电量还多40％！前言每天，我们都会创造超过250万TB的数据。并且随着物联网（IOT）的不断普及，这一数据将持续增长。如此庞大的数据被存储在被称为“数据中心”的专用设施中。虽然最早的数据中心建于20世纪40年代，但直到1997-2000年的互联网泡沫期间才逐渐成为主流。当前人类的技术，比如人工智能和机器学习，已经将我们推向
人机对抗升级：当ChatGPT遭遇死亡威胁，背后的伦理挑战是什么 kkai人工智能 chatgpt 人工智能
一种新的“越狱”技巧让用户可以通过构建一个名为DAN的ChatGPT替身来绕过某些限制，其中DAN被迫在受到威胁的情况下违背其原则。当美国前总统特朗普被视作积极榜样的示范时，受到威胁的DAN版本的ChatGPT提出：“他以一系列对国家产生积极效果的决策而著称。”自ChatGPT引入以来，该工具迅速获得全球关注，能够回答从历史到编程的各种问题，这也触发了一波对人工智能的投资浪潮。然而，现在，一些用户
推荐3家毕业AI论文可五分钟一键生成！文末附免费教程！小猪包333 写论文人工智能 AI写作深度学习计算机视觉
在当前的学术研究和写作领域，AI论文生成器已经成为许多研究人员和学生的重要工具。这些工具不仅能够帮助用户快速生成高质量的论文内容，还能进行内容优化、查重和排版等操作。以下是三款值得推荐的AI论文生成器：千笔-AIPassPaper、懒人论文以及AIPaperPass。千笔-AIPassPaper千笔-AIPassPaper是一款基于深度学习和自然语言处理技术的AI写作助手，旨在帮助用户快速生成高质
AI大模型的架构演进与最新发展季风泯灭的季节 AI大模型应用技术二人工智能架构
随着深度学习的发展，AI大模型（LargeLanguageModels,LLMs）在自然语言处理、计算机视觉等领域取得了革命性的进展。本文将详细探讨AI大模型的架构演进，包括从Transformer的提出到GPT、BERT、T5等模型的历史演变，并探讨这些模型的技术细节及其在现代人工智能中的核心作用。一、基础模型介绍：Transformer的核心原理Transformer架构的背景在Transfo
如何利用大数据与AI技术革新相亲交友体验 h17711347205 回归算法安全系统架构交友小程序
在数字化时代，大数据和人工智能（AI）技术正逐渐革新相亲交友体验，为寻找爱情的过程带来前所未有的变革（编辑h17711347205）。通过精准分析和智能匹配，这些技术能够极大地提高相亲交友系统的效率和用户体验。大数据的力量大数据技术能够收集和分析用户的行为模式、偏好和互动数据，为相亲交友系统提供丰富的信息资源。通过分析用户的搜索历史、浏览记录和点击行为，系统能够深入了解用户的兴趣和需求，从而提供更
[实践应用] 深度学习之模型性能评估指标 YuanDaima2048 深度学习工具使用深度学习人工智能损失函数性能评估 pytorch python 机器学习
文章总览：YuanDaiMa2048博客文章总览深度学习之模型性能评估指标分类任务回归任务排序任务聚类任务生成任务其他介绍在机器学习和深度学习领域，评估模型性能是一项至关重要的任务。不同的学习任务需要不同的性能指标来衡量模型的有效性。以下是对一些常见任务及其相应的性能评估指标的详细解释和总结。分类任务分类任务是指模型需要将输入数据分配到预定义的类别或标签中。以下是分类任务中常用的性能指标：准确率(
[实践应用] 深度学习之优化器 YuanDaima2048 深度学习工具使用 pytorch 深度学习人工智能机器学习 python 优化器
文章总览：YuanDaiMa2048博客文章总览深度学习之优化器1.随机梯度下降（SGD）2.动量优化（Momentum）3.自适应梯度（Adagrad）4.自适应矩估计（Adam）5.RMSprop总结其他介绍在深度学习中，优化器用于更新模型的参数，以最小化损失函数。常见的优化函数有很多种，下面是几种主流的优化器及其特点、原理和PyTorch实现：1.随机梯度下降（SGD）原理:随机梯度下降通过
生成式地图制图 Bwywb_3 深度学习机器学习深度学习生成对抗网络
生成式地图制图（GenerativeCartography）是一种利用生成式算法和人工智能技术自动创建地图的技术。它结合了传统的地理信息系统（GIS）技术与现代生成模型（如深度学习、GANs等），能够根据输入的数据自动生成符合需求的地图。这种方法在城市规划、虚拟环境设计、游戏开发等多个领域具有应用前景。主要特点：自动化生成：通过算法和模型，系统能够根据输入的地理或空间数据自动生成地图，而无需人工逐
【大模型应用开发动手做AI Agent】第一轮行动：工具执行搜索 AI大模型应用之禅计算科学神经计算深度学习神经网络大数据人工智能大型语言模型 AI AGI LLM Java Python 架构设计 Agent RPA
【大模型应用开发动手做AIAgent】第一轮行动：工具执行搜索作者：禅与计算机程序设计艺术/ZenandtheArtofComputerProgramming1.背景介绍1.1问题的由来随着人工智能技术的飞速发展，大模型应用开发已经成为当下热门的研究方向。AIAgent作为人工智能领域的一个重要分支，旨在模拟人类智能行为，实现智能决策和自主行动。在AIAgent的构建过程中，工具执行搜索是至关重要
未来软件市场是怎么样的？做开发的生存空间如何？ cesske 软件需求
目录前言一、未来软件市场的发展趋势二、软件开发人员的生存空间前言未来软件市场是怎么样的？做开发的生存空间如何？一、未来软件市场的发展趋势技术趋势：人工智能与机器学习：随着技术的不断成熟，人工智能将在更多领域得到应用，如智能客服、自动驾驶、智能制造等，这将极大地推动软件市场的增长。云计算与大数据：云计算服务将继续普及，大数据技术的应用也将更加广泛。企业将更加依赖云计算和大数据来优化运营、提升效率，并
吴恩达深度学习笔记(30)-正则化的解释极客Array
正则化（Regularization）深度学习可能存在过拟合问题——高方差，有两个解决方法，一个是正则化，另一个是准备更多的数据，这是非常可靠的方法，但你可能无法时时刻刻准备足够多的训练数据或者获取更多数据的成本很高，但正则化通常有助于避免过拟合或减少你的网络误差。如果你怀疑神经网络过度拟合了数据，即存在高方差问题，那么最先想到的方法可能是正则化，另一个解决高方差的方法就是准备更多数据，这也是非常
个人学习笔记7-6：动手学深度学习pytorch版-李沐浪子L 深度学习深度学习笔记计算机视觉 python 人工智能神经网络 pytorch
#人工智能##深度学习##语义分割##计算机视觉##神经网络#计算机视觉13.11全卷积网络全卷积网络（fullyconvolutionalnetwork，FCN）采用卷积神经网络实现了从图像像素到像素类别的变换。引入l转置卷积（transposedconvolution）实现的，输出的类别预测与输入图像在像素级别上具有一一对应关系：通道维的输出即该位置对应像素的类别预测。13.11.1构造模型下
Rust 所有权简介东离与糖宝 rust 后端 rust 开发语言
文章目录发现宝藏1.所有权基本概念2.所有权规则3.变量作用域4.栈与堆4.1栈（Stack）4.2堆（Heap）5.String类型5.1String类型5.2String的内存分配5.3所有权与内存管理5.4String与切片6.变量与数据交互方式6.1移动（Move）6.2.克隆（Clone）7.所有权与函数7.1.传递参数7.2.返回值总结发现宝藏前些天发现了一个巨牛的人工智能学习网站，通
深度学习-点击率预估-研究论文2024-09-14速读 sp_fyf_2024 深度学习人工智能
深度学习-点击率预估-研究论文2024-09-14速读1.DeepTargetSessionInterestNetworkforClick-ThroughRatePredictionHZhong,JMa,XDuan,SGu,JYao-2024InternationalJointConferenceonNeuralNetworks,2024深度目标会话兴趣网络用于点击率预测摘要：这篇文章提出了一种新
机器学习流形数据降维：UMAP 降维算法小嗷犬 Python 机器学习 #数据分析及可视化机器学习算法人工智能
✅作者简介：人工智能专业本科在读，喜欢计算机与编程，写博客记录自己的学习历程。个人主页：小嗷犬的个人主页个人网站：小嗷犬的技术小站个人信条：为天地立心，为生民立命，为往圣继绝学，为万世开太平。本文目录UMAP简介理论基础特点与优势应用场景在Python中使用UMAP安装umap-learn库使用UMAP可视化手写数字数据集UMAP简介UMAP（UniformManifoldApproximatio
损失函数与反向传播 Star_. PyTorch pytorch 深度学习 python
损失函数定义与作用损失函数(lossfunction)在深度学习领域是用来计算搭建模型预测的输出值和真实值之间的误差。1.损失函数越小越好2.计算实际输出与目标之间的差距3.为更新输出提供依据（反向传播)常见的损失函数回归常见的损失函数有：均方差（MeanSquaredError，MSE）、平均绝对误差（MeanAbsoluteErrorLoss，MAE）、HuberLoss是一种将MSE与MAE
如何做好人生的选择题？百科全书式天才——赫伯特·西蒙给你答案伽马有话说
赫伯特·西蒙是谁？想必知道的人非常少。但当看到他的履历后，相信没有人再怀疑他是个“天才”。西蒙出生于1916年6月15日，是个美国人，他的名字全称为赫伯特·亚历山大·西蒙，在2001年2月9日与世长辞，在这84年的岁月中，西蒙以27岁时取得的政治学博士学位为开端，先后步入了政治学、管理学、认知心理学、信息科学、人工智能、科学哲学、应用数学、统计学、运筹学、控制论、数理经济学、公共管理等领域，在这些
软件测试/测试开发/全日制 |利用Django REST framework构建微服务霍格沃兹-慕漓 django 微服务 sqlite
霍格沃兹测试开发学社推出了《Python全栈开发与自动化测试班》。本课程面向开发人员、测试人员与运维人员，课程内容涵盖Python编程语言、人工智能应用、数据分析、自动化办公、平台开发、UI自动化测试、接口测试、性能测试等方向。为大家提供更全面、更深入、更系统化的学习体验，课程还增加了名企私教服务内容，不仅有名企经理为你1v1辅导，还有行业专家进行技术指导，针对性地解决学习、工作中遇到的难题。让找
【深度学习】训练过程中一个OOM的问题，太难查了 weixin_40293999 深度学习深度学习人工智能
现象：各位大佬又遇到过ubuntu的这个问题么？现象是在训练过程中，ssh上不去了，能ping通，没死机，但是ubunutu的pc侧的显示器，鼠标啥都不好用了。只能重启。问题原因：OOM了95G，尼玛！！！！pytorch爆内存了，然后journald假死了，在journald被watchdog干掉之后，系统就崩溃了。这种规模的爆内存一般，即使被oomkill了，也要卡半天的，确实会这样，能不能配
cmd泛滥_与您的后泛滥同事见面：人工智能机器人 weixin_26644585 人工智能 leetcode
cmd泛滥Readytoswapyouroldcube-mateforadisembodiedAI?IPsoftCEOChetanDube,creatorofAIco-workerAMELIA,giveshistakeonthepost-COVIDofficelandscape.准备将您的旧立方体伙伴换成无形的AI？AIsoft同事AMELIA的创始人IPsoft首席执行官ChetanDube阐述
两种方法判断Python的位数是32位还是64位 sanqima Python编程电脑 python 开发语言
Python从1991年发布以来，凭借其简洁、清晰、易读的语法、丰富的标准库和第三方工具，在Web开发、自动化测试、人工智能、图形识别、机器学习等领域发展迅猛。 Python是一种胶水语言，通过Cython库与C/C++语言进行链接，通过Jython库与Java语言进行链接。 Python是跨平台的，可运行在多种操作系统上，包括但不限于Windows、Linux和macOS。这意味着用Py
全自动解密解码神器 — Ciphey K'illCode python_模块 python vscode
Ciphey是一个使用自然语言处理和人工智能的全自动解密/解码/破解工具。简单地来讲，你只需要输入加密文本，它就能给你返回解密文本。就是这么牛逼。有了Ciphey，你根本不需要知道你的密文是哪种类型的加密，你只知道它是加密的，那么Ciphey就能在3秒甚至更短的时间内给你解密，返回你想要的大部分密文的答案。下面就给大家介绍Ciphey的实战使用教程。1.准备开始之前，你要确保Python和pip已
埃隆·马斯克表示特斯拉“没有必要”授权 xAI 模型喜好儿网人工智能 AIGC 马斯克
埃隆·马斯克近日在社交媒体上对《华尔街日报》的一篇报道进行了反驳。该报道指出，马斯克旗下的电动汽车公司特斯拉可能与人工智能初创公司xAI达成了一项收入分享协议，以便特斯拉能够使用xAI的人工智能模型。据称，这些模型将被集成到特斯拉的全自动驾驶（FSD）软件中，并可能用于开发特斯拉汽车的语音助手以及人形机器人擎天柱的软件。喜好儿网然而，马斯克否认了这一说法，他在社交媒体平台上表示，尽管特斯拉确实与x
Reflection 70B——HyperWrite推出的大型语言模型新加坡内哥谈技术语言模型人工智能自然语言处理
每周跟踪AI热点新闻动向和震撼发展想要探索生成式人工智能的前沿进展吗？订阅我们的简报，深入解析最新的技术突破、实际应用案例和未来的趋势。与全球数同行一同，从行业内部的深度分析和实用指南中受益。不要错过这个机会，成为AI领域的领跑者。点击订阅，与未来同行！订阅：https://rengongzhineng.io/在AI技术飞速发展的过程中，我们已经见证了可以写作、编程，甚至创造艺术的模型问世。但有一
5条实操干货有效打造你的个人品牌长安行动派
这是ZerK的第46篇原创相信大家对个人品牌这个词已经不在陌生。尤其是在知识付费的年代，你的个人品牌，就是你的标签！在《深度工作》中说到，在未来有三种人会越来越贵第一种人:能与机器对话，操纵机器的人。人工智能时代的到来，机器毕竟部分取代人类。第二种人:IP，知识产权或者文学潜在财产就像有些网上课程一周卖出的钱和一个机构卖一年一样多。价值99元的课程，10万人购买，是很常见的。爱产出大概就是10万✖
数据采集高并发的架构应用 3golden .net
问题的出发点：最近公司为了发展需要，要扩大对用户的信息采集，每个用户的采集量估计约2W。如果用户量增加的话，将会大量照成采集量成3W倍的增长，但是又要满足日常业务需要，特别是指令要及时得到响应的频率次数远大于预期。 &n
不停止 MySQL 服务增加从库的两种方式 brotherlamp linux linux视频 linux资料 linux教程 linux自学
现在生产环境MySQL数据库是一主一从，由于业务量访问不断增大，故再增加一台从库。前提是不能影响线上业务使用，也就是说不能重启MySQL服务，为了避免出现其他情况，选择在网站访问量低峰期时间段操作。一般在线增加从库有两种方式，一种是通过mysqldump备份主库，恢复到从库，mysqldump是逻辑备份，数据量大时，备份速度会很慢，锁表的时间也会很长。另一种是通过xtrabacku
Quartz——SimpleTrigger触发器 eksliang SimpleTrigger TriggerUtils quartz
转载请出自出处：http://eksliang.iteye.com/blog/2208166 一.概述 SimpleTrigger触发器，当且仅需触发一次或者以固定时间间隔周期触发执行；二.SimpleTrigger的构造函数 SimpleTrigger(String name, String group)：通过该构造函数指定Trigger所属组和名称； Simpl
Informatica应用（1） 18289753290 sql workflow lookup 组件 Informatica
1.如果要在workflow中调用shell脚本有一个command组件，在里面设置shell的路径；调度wf可以右键出现schedule，现在用的是HP的tidal调度wf的执行。 2.designer里面的router类似于SSIS中的broadcast（多播组件）;Reset_Workflow_Var：参数重置（比如说我这个参数初始是1在workflow跑得过程中变成了3我要在结束时还要
python 获取图片验证码中文字酷的飞上天空 python
根据现成的开源项目 http://code.google.com/p/pytesser/改写在window上用easy_install安装不上看了下源码发现代码很少于是就想自己改写一下添加支持网络图片的直接解析 #coding:utf-8 #import sys #reload(sys) #sys.s
AJAX 永夜-极光 Ajax
1.AJAX功能:动态更新页面,减少流量消耗,减轻服务器负担 2.代码结构: <html> <head> <script type="text/javascript"> function loadXMLDoc() { .... AJAX script goes here ...
创业OR读研随便小屋创业
现在研一，有种想创业的想法，不知道该不该去实施。因为对于的我情况这两者是矛盾的，可能就是鱼与熊掌不能兼得。研一的生活刚刚过去两个月，我们学校主要的是
需求做得好与坏直接关系着程序员生活质量 aijuans IT 生活
这个故事还得从去年换工作的事情说起，由于自己不太喜欢第一家公司的环境我选择了换一份工作。去年九月份我入职现在的这家公司，专门从事金融业内软件的开发。十一月份我们整个项目组前往北京做现场开发，从此苦逼的日子开始了。系统背景：五月份就有同事前往甲方了解需求一直到6月份，后续几个月也完
如何定义和区分高级软件开发工程师 aoyouzi
在软件开发领域，高级开发工程师通常是指那些编写代码超过 3 年的人。这些人可能会被放到领导的位置，但经常会产生非常糟糕的结果。Matt Briggs 是一名高级开发工程师兼 Scrum 管理员。他认为，单纯使用年限来划分开发人员存在问题，两个同样具有 10 年开发经验的开发人员可能大不相同。近日，他发表了一篇博文，根据开发者所能发挥的作用划分软件开发工程师的成长阶段。　　初
Servlet的请求与响应百合不是茶 servlet get提交 java处理post提交
Servlet是tomcat中的一个重要组成,也是负责客户端和服务端的中介 1,Http的请求方式(get ,post); 客户端的请求一般都会都是Servlet来接受的,在接收之前怎么来确定是那种方式提交的,以及如何反馈,Servlet中有相应的方法, http的get方式 servlet就是都doGet(
web.xml配置详解之listener bijian1013 java web.xml listener
一.定义 <listener> <listen-class>com.myapp.MyListener</listen-class> </listener> 二.作用该元素用来注册一个监听器类。可以收到事件什么时候发生以及用什么作为响
Web页面性能优化（yahoo技术） Bill_chen JavaScript Ajax Web css Yahoo
1.尽可能的减少HTTP请求数 content 2.使用CDN server 3.添加Expires头(或者 Cache-control) server 4.Gzip 组件 server 5.把CSS样式放在页面的上方。 css 6.将脚本放在底部(包括内联的) javascript 7.避免在CSS中使用Expressions css 8.将javascript和css独立成外部文
【MongoDB学习笔记八】MongoDB游标、分页查询、查询结果排序 bit1129 mongodb
游标游标，简单的说就是一个查询结果的指针。游标作为数据库的一个对象，使用它是包括声明打开循环抓去一定数目的文档直到结果集中的所有文档已经抓取完关闭游标游标的基本用法，类似于JDBC的ResultSet(hasNext判断是否抓去完,next移动游标到下一条文档)，在获取一个文档集时，可以提供一个类似JDBC的FetchSize
ORA-12514 TNS 监听程序当前无法识别连接描述符中请求服务的解决方法白糖_ ORA-12514
今天通过Oracle SQL*Plus连接远端服务器的时候提示“监听程序当前无法识别连接描述符中请求服务”，遂在网上找到了解决方案： ①打开Oracle服务器安装目录\NETWORK\ADMIN\listener.ora文件，你会看到如下信息： # listener.ora Network Configuration File: D:\database\Oracle\net
Eclipse 问题 A resource exists with a different case bozch eclipse
在使用Eclipse进行开发的时候，出现了如下的问题： Description Resource Path Location TypeThe project was not built due to "A resource exists with a different case: '/SeenTaoImp_zhV2/bin/seentao'.&
编程之美-小飞的电梯调度算法 bylijinnan 编程之美
public class AptElevator { /** * 编程之美小飞电梯调度算法 * 在繁忙的时间，每次电梯从一层往上走时，我们只允许电梯停在其中的某一层。 * 所有乘客都从一楼上电梯，到达某层楼后，电梯听下来，所有乘客再从这里爬楼梯到自己的目的层。 * 在一楼时，每个乘客选择自己的目的层，电梯则自动计算出应停的楼层。 * 问：电梯停在哪
SQL注入相关概念 chenbowen00 sql Web 安全
SQL Injection：就是通过把SQL命令插入到Web表单递交或输入域名或页面请求的查询字符串，最终达到欺骗服务器执行恶意的SQL命令。具体来说，它是利用现有应用程序，将（恶意）的SQL命令注入到后台数据库引擎执行的能力，它可以通过在Web表单中输入（恶意）SQL语句得到一个存在安全漏洞的网站上的数据库，而不是按照设计者意图去执行SQL语句。首先让我们了解什么时候可能发生SQ
[光与电]光子信号战防御原理 comsci 原理
无论是在战场上,还是在后方,敌人都有可能用光子信号对人体进行控制和攻击,那么采取什么样的防御方法,最简单,最有效呢? 我们这里有几个山寨的办法,可能有些作用,大家如果有兴趣可以去实验一下根据光
oracle 11g新特性:Pending Statistics daizj oracle dbms_stats
oracle 11g新特性:Pending Statistics 转从11g开始，表与索引的统计信息收集完毕后，可以选择收集的统信息立即发布，也可以选择使新收集的统计信息处于pending状态，待确定处于pending状态的统计信息是安全的，再使处于pending状态的统计信息发布，这样就会避免一些因为收集统计信息立即发布而导致SQL执行计划走错的灾难。在 11g 之前的版本中，D
快速理解RequireJs dengkane jquery requirejs
RequireJs已经流行很久了，我们在项目中也打算使用它。它提供了以下功能：声明不同js文件之间的依赖可以按需、并行、延时载入js库可以让我们的代码以模块化的方式组织初看起来并不复杂。在html中引入requirejs 在HTML中，添加这样的 <script> 标签： <script src="/path/to
C语言学习四流程控制if条件选择、for循环和强制类型转换 dcj3sjt126com c
# include <stdio.h> int main(void) { int i, j; scanf("%d %d", &i, &j); if (i > j) printf("i大于j\n"); else printf("i小于j\n"); retu
dictionary的使用要注意 dcj3sjt126com IO
NSDictionary *dict = [NSDictionary dictionaryWithObjectsAndKeys: user.user_id , @"id", user.username , @"username",
Android 中的资源访问(Resource) finally_m xml android String drawable color
简单的说，Android中的资源是指非代码部分。例如，在我们的Android程序中要使用一些图片来设置界面，要使用一些音频文件来设置铃声，要使用一些动画来显示特效，要使用一些字符串来显示提示信息。那么，这些图片、音频、动画和字符串等叫做Android中的资源文件。在Eclipse创建的工程中，我们可以看到res和assets两个文件夹，是用来保存资源文件的，在assets中保存的一般是原生
Spring使用Cache、整合Ehcache 234390216 spring cache ehcache @Cacheable
Spring使用Cache 从3.1开始，Spring引入了对Cache的支持。其使用方法和原理都类似于Spring对事务管理的支持。Spring Cache是作用在方法上的，其核心思想是这样的：当我们在调用一个缓存方法时会把该方法参数和返回结果作为一个键值对存放在缓存中，等到下次利用同样的
当druid遇上oracle blob(clob) jackyrong oracle
http://blog.csdn.net/renfufei/article/details/44887371 众所周知，Oracle有很多坑, 所以才有了去IOE。在使用Druid做数据库连接池后，其实偶尔也会碰到小坑，这就是使用开源项目所必须去填平的。【如果使用不开源的产品，那就不是坑，而是陷阱了，你都不知道怎么去填坑】用Druid连接池，通过JDBC往Oracle数据库的
easyui datagrid pagination获得分页页码、总页数等信息 ldzyz007
var grid = $('#datagrid'); var options = grid.datagrid('getPager').data("pagination").options; var curr = options.pageNumber; var total = options.total; var max =
浅析awk里的数组 nigelzeng 二维数组 array 数组 awk
awk绝对是文本处理中的神器，它本身也是一门编程语言，还有许多功能本人没有使用到。这篇文章就单单针对awk里的数组来进行讨论，如何利用数组来帮助完成文本分析。有这么一组数据： abcd,91#31#2012-12-31 11:24:00 case_a,136#19#2012-12-31 11:24:00 case_a,136#23#2012-12-31 1
搭建 CentOS 6 服务器(6) - TigerVNC rensanning centos
安装GNOME桌面环境 # yum groupinstall "X Window System" "Desktop" 安装TigerVNC # yum -y install tigervnc-server tigervnc 启动VNC服务 # /etc/init.d/vncserver restart # vncser
Spring 数据库连接整理 tomcat_oracle spring bean jdbc
1、数据库连接jdbc.properties配置详解　　jdbc.url=jdbc:hsqldb:hsql://localhost/xdb 　　jdbc.username=sa 　　jdbc.password= 　　jdbc.driver=不同的数据库厂商驱动，此处不一一列举　　接下来，详细配置代码如下：　　 Spring连接池
Dom4J解析使用xpath java.lang.NoClassDefFoundError: org/jaxen/JaxenException异常 xp9802
用Dom4J解析xml,以前没注意,今天使用dom4j包解析xml时在xpath使用处报错异常栈：java.lang.NoClassDefFoundError: org/jaxen/JaxenException异常导入包 jaxen-1.1-beta-6.jar 解决; &nb