E-COM-NET
首页
在线工具
Layui镜像站
SUI文档
联系我们
推荐频道
Java
PHP
C++
C
C#
Python
Ruby
go语言
Scala
Servlet
Vue
MySQL
NoSQL
Redis
CSS
Oracle
SQL Server
DB2
HBase
Http
HTML5
Spring
Ajax
Jquery
JavaScript
Json
XML
NodeJs
mybatis
Hibernate
算法
设计模式
shell
数据结构
大数据
JS
消息中间件
正则表达式
Tomcat
SQL
Nginx
Shiro
Maven
Linux
自训练
深度整理总结MySQL——索引工作原理
B+树索引数据结构前言什么样的索引数据结构是好的搜索速度要求支持范围查找寻求适合查找的算法寻求合适的数据结构二叉查找树
自
平衡二叉树B树B+树数据结构B+与B树比较总结前言相信你在面试时,通常会被问到“什么是索引
左灯右行的爱情
·
2025-02-07 12:56
mysql
数据库
P11558 [ROIR 2016] 和谐数列
题目背景翻译
自
ROIR2016D2T4。
aqfcca
·
2025-02-07 11:23
c++算法笔记
算法
c++
洛谷
当大模型遇上Spark:解锁大数据处理新姿势
大模型,即大规模机器学习模型,是利用海量数据和强大算力
训练
出来的“大参数”模型。其发展历程可谓是一部科技创新的传奇史。从20世纪中叶人工智能概念的提出,到2006年深度学习技术崭露
敏叔V587
·
2025-02-07 11:52
spark
大数据
分布式
基于langchain和gradio实现天气查询智能体,本地ollama大模型调实时天气api,前端输入即可自动返回天气
介绍:众所周知大模型
训练
数据都是用的历史数据,无法实时查询天气信息,因此使用本地ollama大模型调实时天气api接口的方式,大模型识别和理解你要查询的请求,然后调第三方天气api接口返回实时天气。
福小白
·
2025-02-07 10:48
langchain
前端
基于 DeepSeek-R1 模型微调(SFT)技术详解
目录引言1.1大模型时代与微调的重要性1.2本文目的与结构概述DeepSeek-R1模型基础2.1模型简介2.1.1模型架构2.1.2预
训练
数据与目标2.2模型特点与优势2.2.1语言理解与生成能力2.2.2
zhangjiaofa
·
2025-02-07 10:43
大模型
DeepSeek-R1
SFT
模型微调
idea2024新特性以及idea2024.1版本安装、激活
一、idea2024新特性1、行级别的代码补全IDEA现在可以根据代码的上下文分析,给我们提示一整行的代码,借助了大模型对数据的分析
训练
,同时确保了代码数据的安全性。
阿东知识库
·
2025-02-07 09:39
开发工具
intellij-idea
pycharm
性能优化
java
python
Android耗电分析之Battery Historian工具使用
当设备在使用电池的时候,它可以使开发者们看到系统级和应用级事件图表,在图表时间轴上可以缩放和平移,能够直观的看到
自
上一次充
xiangzhihong8
·
2025-02-07 09:37
深入Android应用开发
android
adb
android
studio
大模型元年:人工智能的“寒武纪大爆发”
一、从“专用”到“通用”:大模型开启AI新范式传统的人工智能模型往往是针对特定任务进行
训练
的“专用工具”,例如图像识别、语音识别等。而大模
小马过河R
·
2025-02-07 08:05
AI人工智能
人工智能
机器学习
深度学习
大模型生态开源工具整理
最近一直在做大模型应用开发工作,总结下用到的一些开源工具1-模型
训练
LLaMA-Factory整体介绍LLaMA-Factory是一个开源的微调框架,为开发者提供简便高效的工具,以便在预
训练
模型基础上快速适应特定任务需求
miracletiger
·
2025-02-07 08:35
开源
与StableDiffusion相比,Janus Pro在文本到图像生成任务上有哪些优势?
与StableDiffusion相比,JanusPro在文本到图像生成任务上有以下优势:架构创新优势路径分离更高效:JanusPro采用创新的
自
回归框架,将视觉编码分离为“理解”和“生成”两条路径,避免了视觉编码器在理解和生成任务中的角色冲突
alankuo
·
2025-02-07 08:32
人工智能
Realtek网卡断流
此网络接口
自
上次初始化以来已重置50次。网卡的晶振老化了,导致了始终偏移,在网络流量高的时候,会丢包导致超时,网卡会出现硬
Victor YU223
·
2025-02-07 08:32
杂记
服务器
linux
网络
python写接口调用模型_对YOLOv3模型调用时候的python接口详解
之前
训练
好的模型,在模型调用的时候,总是在lib=CDLL("/home/*****/*******/darknet/li
weixin_39835607
·
2025-02-07 07:28
python写接口调用模型
聚类算法与应用
3.1基本原理3.1.1树状结构的建立3.1.2聚合或分裂策略3.2应用场景3.2.1生物学中的基因表达数据聚类3.2.2文本数据的主题分类4.聚类算法的实践应用4.1数据准备与预处理4.2算法选择与模型
训练
theskylife
·
2025-02-07 06:16
数据挖掘
算法
聚类
机器学习
数据挖掘
人工智能
DeepSeek开源引擎引爆央国企AI革命:一场自主可控的“智能突围战“
然而现实却充满挑战——某能源集团AI模型
训练
耗时长达72小时,某金融机构因数据安全问题被迫放弃云端方案,某制造央企为适配国产硬件额外投入超千万...这些痛点直指三大困局:性能瓶颈:
Light60
·
2025-02-07 05:43
央国企
AI应用
产业篇
人工智能
DeepSeek
央国企AI革命
4.2 过拟合与欠拟合
4.2.1什么是过拟合与欠拟合过拟合:一个假设在
训练
数据上能够获得比其他假设更好的拟合,但是在测试数据集上却不能很好地拟合数据,此时认为这个假设出现了过拟合的现象。
望云山190
·
2025-02-07 05:11
算法
人工智能
探秘 DeepSeek:AI 领域的创新力量
公司
自
2023年成立以来,便将目光聚焦于大语言模型(LLM)和相关技术的开发,致力于在人工智能领域开辟出一片新天地。
秉寒
·
2025-02-07 04:35
人工智能
tensorflow模型继续
训练
??
之前
训练
的模型没有收敛就结束了,再次
训练
,增加
训练
次数是不是就会收敛了?有时,网上的参考答案并不能解决问题,因为每个人的细节不同,总有些关键细节问题决定成败。
小李飞刀李寻欢
·
2025-02-07 04:35
python
speechdnn
tensorflow
模型恢复
继续训练
global_step
PDF转图片及拼接- ImageMagick
图片垂直拼接montage*.jpeg-tile1x-geometry+0+0-backgroundnoneoutput-long.png我是海持,AI顶尖大厂攻城狮+创业者,为梦想窒息的老少年,追求
自
海持Alvin
·
2025-02-07 04:33
pdf
ai
人工智能
图像处理
大模型参数量及其单位的概念
以下是最常见的几种BERT模型的参数量:1.BERT-Base:-Transformer的层数(即encoder的个数):12-隐藏单元数:768-
自
注意力头的数量:12-参数量:约1.1亿(110M)
这个人有丶懒
·
2025-02-07 03:57
自然语言处理
语言模型
【时序分析】使用skforecast进行时间序列预测并分享14个Python时间序列分析库
Python时间序列分析库1.时间序列分析基础2.多步时间序列预测2.1递归多步预测2.2直接多步预测2.3多输出预测3.实战:使用skforecast进行时间序列预测3.1使用skforecast进行递归
自
回归预测
镰刀韭菜
·
2025-02-07 03:27
深度学习与机器学习
python
时间序列分析
skforecast
TimeGPT
tsfresh
AutoTS
递归多步预测
使用一个大语言模型对另一个大语言模型进行“调教”
以下是基于搜索结果整理的详细步骤和方法:1.准备工作安装必要的库•Transformers:用于加载和
训练
模型。•Datasets:用于处理数据集。
大霸王龙
·
2025-02-07 03:25
python
人工智能
python
Ollama安装部署deepseek
内置的模型下载llama3模型(亲测垃圾机房都可以跑起来)下载DeepSeek-V3模型运行模型搭建Web环境OllamaOllama是一个开源的大型语言模型服务工具,旨在帮助用户在本地环境中部署和运行大规模预
训练
语言模型
angel725
·
2025-02-07 02:53
llama
ai
https是什么?和http有什么区别?
转
自
:https://www.pinlue.com/article/2019/04/1107/068614641110.html
思绪随想
·
2025-02-07 00:39
HTTP
https
http
Stable Diffusion使用样例实践(二)
细节上可以多
训练
几次,得到满意的为准。
Allen-Steven
·
2025-02-07 00:38
SD
创作实践
stable
diffusion
ai
DeepSeek R1和V3区别
DeepSeekR1和V3是深度求索(DeepSeek)推出的两款大模型,尽管基于相似的技术框架(如混合专家架构MoE),但在设计目标、
训练
方法、性能表现和应用场景上存在显著差异。
@Rocky
·
2025-02-06 23:02
大模型
语言模型
代码随想录算法
训练
营第二十八天| 回溯算法01
77.组合对着在回溯算法理论基础给出的代码模板,来做本题组合问题,大家就会发现写回溯算法套路。在回溯算法解决实际问题的过程中,大家会有各种疑问,先看视频介绍,基本可以解决大家的疑惑。本题关于剪枝操作是大家要理解的重点,因为后面很多回溯算法解决的题目,都是这个剪枝套路。题目链接/文章讲解:代码随想录视频讲解:带你学透回溯算法-组合问题(对应力扣题目:77.组合)|回溯法精讲!_哔哩哔哩_bilibi
Rachela_z
·
2025-02-06 23:02
算法
机器学习算法 —— 朴素贝叶斯
博客的简介(文章目录)目录朴素贝叶斯朴素贝叶斯的介绍朴素贝叶斯的优点朴素贝叶斯的缺点朴素贝叶斯的应用实战(贝叶斯分类)莺尾花数据库函数导入数据导入和分析模型
训练
模型预测原理简析模拟离散数据集朴素贝叶斯朴素贝叶斯的介绍朴素贝叶斯法
ZShiJ
·
2025-02-06 23:01
机器学习算法
机器学习
算法
分类
贝叶斯
[论文笔记] Deepseek技术报告
介绍了两代模型:DeepSeek-R1-Zero(纯RL,无SFT冷启动数据)和DeepSeek-R1(在RL前加入少量冷启动数据和多阶段
训练
流程,提升可读性及推理表现)。
心心喵
·
2025-02-06 22:53
论文笔记
论文阅读
人工智能
深度学习篇---深度学习相关知识点&关键名词含义
文章目录前言第一部分:相关知识点一、基础铺垫层(必须掌握的核心基础)1.数学基础•线性代数•微积分•概率与统计2.编程基础3.机器学习基础二、深度学习核心层(神经网络与
训练
机制)1.神经网络基础2.激活函数
Ronin-Lotus
·
2025-02-06 21:21
深度学习篇
深度学习
人工智能
机器学习
pytorch
paddlepaddle
python
深度学习篇---深度学习中的超参数&张量转换&模型
训练
文章目录前言第一部分:深度学习中的超参数1.学习率(LearningRate)定义重要性常见设置2.批处理大小(BatchSize)定义重要性常见设置3.迭代次数(NumberofEpochs)定义重要性常见设置4.优化器(Optimizer)定义重要性常见设置5.损失函数(LossFunction)定义重要性常见设置6.正则化(Regularization)定义重要性常见设置7.网络架构(Net
Ronin-Lotus
·
2025-02-06 21:50
深度学习篇
深度学习
人工智能
paddlepaddle
pytorch
超参数
张量转换
模型训练
利用Docker简化机器学习应用程序的部署和可扩展性
传统方法往往需要帮助将ML模型操作化,原因包括
训练
和服务环境之间的差异或扩展的困难。Docker是一个旨在自动化应用程序部署、扩展和管理的开源平台,作为解决这些挑战的方法。所提出的方法将ML模型及其
荆州克莱
·
2025-02-06 20:44
面试题汇总与解析
spring
cloud
spring
boot
spring
技术
css3
【模板】Spfa判负环
【模板】Spfa判负环给定一个n个点m条边的有向图,图中可能存在重边和
自
环,边权可能为负数。请你判断图中是否存在负权回路。输入格式第一行包含整数n和m。
user_qym
·
2025-02-06 20:41
最短路
C++题解
机考不会画图的请进!!!
☆绘制前导图先划出所有活动,将活动命名若要调整大小,选中需要调整的原件,点击工具栏中的“设置相同大小”不选定任何面板工具的情况下,单击原件可以实现
自
油移动,我们将它移动到大概正确的位置通过连线工具,连接各活动表示出活动之间的关系
w011109
·
2025-02-06 20:41
模块测试
计算机网络
软件构建
pat考试
软件工程
LDA主题分析—情感分析案例
以下是一个针对投诉内容进行情感分析的完整案例,包含数据准备、模型
训练
、情感分析以及结果展示的过程。案例:投诉内容情感分析步骤1:数据准备首先,我们准备一份包含用户投诉内容的数据集。
rubyw
·
2025-02-06 20:41
机器学习
数据分析
python
机器学习
T1:实现mnist手写数字识别
>-**本文为[365天深度学习
训练
营](https://mp.weixin.qq.com/s/0dvHCaOoFnW8SCp3JpzKxg)中的学习记录博客**>-**原作者:[K同学啊](https
哈维羊
·
2025-02-06 19:33
neo4j
LLM知识蒸馏代码讲解及
训练
实验
LLM知识蒸馏代码讲解及
训练
实验知识蒸馏简单讲即使用大规模参数的模型对小规模参数模型进行蒸馏,且不是简单的只使用答案,是需要两个模型的logprob进行交互的,故两个模型的vocabsize必须是一样的
淡水,
·
2025-02-06 18:33
深度学习
pytorch
人工智能
nlp
python
知识蒸馏
深度学习学习笔记 --- 动量momentum
一、动量momentum的由来
训练
网络时,通常先对网络的初始值按照某种分布进行初始化,如:高斯分布。
杨鑫newlfe
·
2025-02-06 18:01
Machine
Learning
深度学习
动量
momentum
梯度下降
DeepSeek与OpenAI:谁是AI领域的更优选择?
一、成本与性价比1.
训练
成本DeepSeek在
训练
成本上的优势极为显著。其开发团队通过创
gs80140
·
2025-02-06 18:28
基础知识科谱
AI
人工智能
TensorFlow、把数字标签转化成onehot标签
在MNIST手写字数据集中,我们导入的数据和标签都是预先处理好的,但是在实际的
训练
中,数据和标签往往需要自己进行处理。以手写数字识别为例,我们需要将0-9共十个数字标签转化成onehot标签。
dg989385783
·
2025-02-06 18:58
【大模型LLM面试合集】
训练
数据_数据格式
对于大语言模型的
训练
中,SFT(SupervisedFine-Tuning)的数据集格式可以采用以下方式:输入数据:输入数据是一个文本序列,通常是一个句子或者一个段落。
X.AI666
·
2025-02-06 18:28
人工智能
big
data
大型推理模型 (LRM) 的比较 OpenAI DeepSeek R1 Gemini 2.0
分钟发布时间:2025-02-06近日热文:全网最全的神经网络数学原理(代码和公式)直观解释欢迎关注知乎和公众号的专栏内容LLM架构专栏知乎LLM专栏知乎【柏企】公众号【柏企科技说】【柏企阅文】1.架构与
训练
技术
·
2025-02-06 17:20
人工智能
Tauri2.x+Vite5+Pinia2电脑版仿微信聊天(源码版)
自
研tauri2.0+vite5+vue3setup+pinia+element-plus客户端聊天软件,源码演示篇!
·
2025-02-06 17:14
理解红黑树
简介:红黑树是一种
自
平衡二叉查找树,由鲁道夫·贝尔(RudolfBayer)在1972年发明,最初称为“对称二叉B树”。
因特麦克斯
·
2025-02-06 17:20
c++
构建安全可靠的LLM应用架构
接下来,我们将详细解析数据处理模块、模型
训练
模块、应用部署模块和安全防护模块的设计与实现策略。本文将使用Mermaid流程图和Pyth
AI天才研究院
·
2025-02-06 16:15
计算机软件编程原理与应用实践
java
python
javascript
kotlin
golang
架构
人工智能
大厂程序员
硅基计算
碳基计算
认知计算
生物计算
深度学习
神经网络
大数据
AIGC
AGI
LLM
系统架构设计
软件哲学
Agent
程序员实现财富自由
从零开始构建一个大语言模型-第五章第五节
第五章目录5.1评估生成文本模型5.2
训练
一个LLM5.3控制随机性的解码策略5.4在PyTorch中加载和保存模型权重5.5从OpenAI加载预
训练
权重5.5从OpenAI加载预
训练
权重此前,我们使用一个由一本短篇小说集组成的有限数据集
训练
了一个小型
释迦呼呼
·
2025-02-06 15:41
从零开始构建一个大语言模型
语言模型
人工智能
自然语言处理
机器学习
pytorch
弹性文件服务(SFS)的使用场景
华为云弹性文件服务(ScalableFileService,简称SFS)是一种高性能、高可用、弹性伸缩的文件存储服务,广泛应用于多种场景,包括高性能计算、媒体处理、企业办公、AI
训练
等。
九河云
·
2025-02-06 14:02
人工智能
华为云
服务器
Seed Edge- AGI(人工智能通用智能)长期研究计划
目标与定位核心目标是做比预
训练
和大模型迭代更长期、更基础的AGI前沿研究,为AI研究者提供更自由的探索空间和资源支持,探索AGI的新方法,推动通用智能的边界。支持措
自不量力的A同学
·
2025-02-06 13:29
人工智能
DeepSeek-R1真算得上开源吗?
OpenAIo1模型证明,当LLM在推理时,通过增加计算量进行类似
训练
后,它们在数学、编程和逻辑等推理任务上的表现显著提升。然而,OpenAI推理模型的
训练
方法一直是秘密。
·
2025-02-06 13:37
人工智能
基于YOLOv11的目标检测系统
在之前YOLO版本令人印象深刻的进步基础上,YOLO11在架构和
训练
方法上进行了重大改进,使其成为广泛的计算机视觉任务的多功能选择。
夜思、晨
·
2025-02-06 12:21
YOLO
目标检测
人工智能
快速掌握用python写并行程序
自
2013年以来,处理器频率的增长速度逐渐放缓了,目前CPU的频率主要分布在34GHz。这个也是可以理解的
python2021_
·
2025-02-06 12:18
python
开发语言
上一页
9
10
11
12
13
14
15
16
下一页
按字母分类:
A
B
C
D
E
F
G
H
I
J
K
L
M
N
O
P
Q
R
S
T
U
V
W
X
Y
Z
其他