E-COM-NET
首页
在线工具
Layui镜像站
SUI文档
联系我们
推荐频道
Java
PHP
C++
C
C#
Python
Ruby
go语言
Scala
Servlet
Vue
MySQL
NoSQL
Redis
CSS
Oracle
SQL Server
DB2
HBase
Http
HTML5
Spring
Ajax
Jquery
JavaScript
Json
XML
NodeJs
mybatis
Hibernate
算法
设计模式
shell
数据结构
大数据
JS
消息中间件
正则表达式
Tomcat
SQL
Nginx
Shiro
Maven
Linux
Hadoop调度器
Spark-submit提交任务的常用参数
#参数名称#含义--clusterc3prc-
hadoop
#--masterMASTER_URL#可以是spark://host:port,mesos://host:port,yarn,yarn-cluster
liuzx32
·
2024-09-02 20:22
hadoop
sdk使用_使用 .NET SDK 管理 HDInsight 中的 Apache
Hadoop
群集
全球版技术文档网站,若需要访问由世纪互联运营的MICROSOFTAZURE中国区技术文档网站,请访问https://docs.azure.cn.使用.NETSDK管理HDInsight中的Apache
Hadoop
weixin_39862484
·
2024-09-02 20:39
hadoopsdk使用
Hive 运行在 Tez 上
Tez下载Tez官网Tez在Hive上的运用前提要有
Hadoop
集群上传Tez压缩包到Hive节点上tar-zxvfapache-tez-0.9.1-bin.tar.gz-C/opt/module/tez
爱吃酸梨
·
2024-09-02 20:07
大数据
大数据开发技术HBase优化与特点分析
关闭HBase集群(如果没有开启则跳过此步)[atguigu@
hadoop
102hbase]$bin/stop-hbase.sh在con
at小白在线中
·
2024-09-02 13:32
大数据
经验笔记:
Hadoop
Hadoop
经验笔记一、
Hadoop
概述
Hadoop
是一个开源软件框架,用于分布式存储和处理大规模数据集。其设计目的是为了在商用硬件上运行,具备高容错性和可扩展性。
漆黑的莫莫
·
2024-09-02 03:54
随手笔记
笔记
hadoop
大数据
Python大数据之
Hadoop
学习——day06_hive学习02
一.hive内外表操作1.建表语法create[external]table[ifnotexists]表名(字段名字段类型,字段名字段类型,...)[partitionedby(分区字段名分区字段类型)]#分区表固定格式[clusteredby(分桶字段名)into桶个数buckets]#分桶表固定格式[sortedby(排序字段名asc|desc)][rowformatdelimitedfiel
笨小孩124
·
2024-09-01 11:18
大数据
hadoop
学习
大数据毕业设计
hadoop
+spark+hive微博舆情情感分析 知识图谱微博推荐系统
(一)Selenium自动化Python爬虫工具采集新浪微博评论、热搜、文章等约10万条存入.csv文件作为数据集;(二)使用pandas+numpy或MapReduce对数据进行数据清洗,生成最终的.csv文件并上传到hdfs;(三)使用hive数仓技术建表建库,导入.csv数据集;(四)离线分析采用hive_sql完成,实时分析利用Spark之Scala完成;(五)统计指标使用sqoop导入m
qq_79856539
·
2024-09-01 11:16
javaweb
大数据
hadoop
课程设计
基于
hadoop
+spark的旅游大数据分析平台
S2023132基于
hadoop
+spark的旅游大数据分析平台使用BeautifulSoup爬取数据,爬取成功以后使用spark分析数据,将分析的结果保存到mysql,flask读取mysql数据,结合
源码空间站11
·
2024-09-01 11:16
hadoop
spark
旅游
大数据毕业设计天
hadoop
+spark+hive游戏推荐系统 游戏数据分析可视化大屏 steam游戏爬虫 游戏大数据 机器学习 知识图谱 计算机毕业设计 机器学习 深度学习 人工智能 知识图谱
|—||一、选题的目的和意义用户往往因为不能及时查看游戏信息而造成许多烦恼。另一方面,游戏商城平台没能进行系统的管理与维护使游戏信息没能及时的更新。而传统的游戏信息管理,采用的还是手工备案、人工查询的方式。但是随之游戏信息的增多这种管理方式的工作量不断加大,这种做法就存在费时费力、缺乏时效性、不利于调动人员的积极性等缺点。一旦网站建立好之后,一方面,用户可以在第一时间在系统里查询所需的信息,另一方
2401_84159688
·
2024-09-01 11:45
程序员
大数据
hadoop
人工智能
【基于
Hadoop
3.3.6+Spark3.4.3电商用户行为分析】
基于
Hadoop
3.3.6+Spark3.4.3电商用户行为分析一、摘要二、正文2.1需求分析2.2架构设计2.3实施过程2.3.1系统环境说明2.3.2系统开发思路说明2.3.4代码实现及测试2.3.5
若兰幽竹
·
2024-09-01 00:09
大数据项目
大数据
基于
Hadoop
的高校教学管理平台设计与实现
文中就高校大数据平台的关键技术和架构进行阐述,结合高校实际情况,设计高校大数据平台架构,通过搭建
Hadoop
集群环境,以业务系统和平台之间的数据交互验证平台设计的可行性和优势。
这是辰辰啊
·
2024-09-01 00:38
hadoop
hadoop
大数据
Hive SQL练习之影评案例
找的练习hive,内容非原创链接https://www.cnblogs.com/frankdeng/p/9309668.html一、建表,导入数据1、建表[root@master
hadoop
]#hiveLogginginitializedusingconfigurationinjar
软件手
·
2024-08-31 17:23
Hive
mysql
hive
hadoop
sql
大数据
hadoop
日志文件
路径:/opt/homebrew/Cellar/
hadoop
/3.4.0/libexec/logs从你提供的输出信息来看,你正在查看
Hadoop
的日志文件目录(logs目录)。
静听山水
·
2024-08-31 17:51
Spark
hadoop
hadoop
常用地址
java:"/opt/homebrew/Cellar/openjdk/22.0.1/libexec/openjdk.jdk/Contents/Home"
hadoop
:1】sbin:/opt/homebrew
静听山水
·
2024-08-31 16:49
Spark
hadoop
Hadoop
技术栈
1.什么是
hadoop
(分布式软件框架)他提供了分步式数据存储分布式数据计算分布式资源调度为一体的整体解决方案1.1
hadoop
的用处可以部署在1台乃至成千上万台服务器节点上协同工作。
XingChen.
·
2024-08-31 16:48
分布式
hadoop
大数据
【Mysql】通过Keepalived搭建mysql双主高可用集群
一、环境信息主机名ip操作系统mysql版本VIP(虚拟ip)
hadoop
01192.168.10.200centos7_x865.7192.168.10.253
hadoop
03192.168.10.202centos7
维运
·
2024-08-31 15:13
数据库
mysql
数据库
Linux 实时
调度器
:带宽限制
2.概念Linux实时
调度器
(RTscheduler)的带宽限制,是指限制系统中实时进程占用的CPU时间的配额、比例。和实时进程打过交道的读
JiMoKuangXiangQu
·
2024-08-31 13:23
#
进程调度
Linux
实时调度器
带宽限制
《
Hadoop
系列》Docker安装
Hadoop
文章目录Docker安装
Hadoop
1安装docker1.1添加docker到yum源1.2安装docker2安装
Hadoop
2.1使用docker自带的
hadoop
安装2.2免密操作2.2.1master
DATA数据猿
·
2024-08-31 12:16
Hadoop
Docker
docker
hadoop
docker安装
Hadoop
拉取镜像[root@ecs-e722~]#dockerpullregistry.cn-hangzhou.aliyuncs.com/
hadoop
_test/
hadoop
_baseUsingdefaulttag
悾说
·
2024-08-31 11:16
docker
hadoop
hadoop
docker
大数据
小白学习大数据测试之
hadoop
hdfs和MapReduce小实战
转发是对小编的最大支持在湿货|大数据测试之
hadoop
单机环境搭建(超级详细版)这个基础上,我们来运行一个官网的MapReducedemo程序来看看效果和处理过程。
大数据学习02
·
2024-08-30 11:39
企业级负载均衡LVS集群———KeepAlived高可用性集群、LVS(IPVS)+KeepAlived+Httpd、LVS(IPVS)+KeepAlived+Vsftpd
Keepalived运行机制5、面试中Keepalived的工作原理的文字表述二、LVS+KeepAlived+Httpd三、LVS+KeepAlived+Vsftpd一、KeepAlived背景:我们之前都是一个
调度器
来调度多台
草莓啾啾啾
·
2024-08-30 09:46
企业
Linux
【码农日常】时间触发嵌入式系统设计模式
整体架构时间触发嵌入式系统说穿了就是通过时间划片,采用
调度器
任务的一种处理方式,与我们熟知的freetos或μcos并没有根本的区别。整体架构的核心包括:定时器
真·Wild·攻城狮
·
2024-08-30 07:34
OS
软件测学习笔记丨Linux的进程与线程
进程是操作系统的基本单位,它们在系统中相互独立地运行,并通过操作系统
调度器
进行管理。线程:在Linux中,线程是一种轻量级的执行流,是cpu调度的基本单位,可以共
霍格沃兹测试开发学社测试人社区
·
2024-08-29 23:41
linux
学习
笔记
软件测试
测试开发
为什么k8s节点要保持配置一致
K8s集群通过
调度器
将容器调度到可用
骑上单车去旅行
·
2024-08-29 22:34
kubernetes
容器
云原生
虚拟机安装
hadoop
,hbase(单机伪集群模式)
虚拟机安装
Hadoop
,Hbase工作中遇到了大数据方面的一些技术栈,没有退路可言,只能去学习掌握它,就像当初做爬虫一样(虽然很简单),在数据爆发的现在,传统的数据库mysql,oracle显然在处理大数据量级的数据时显得力不从心
流~星~雨
·
2024-08-29 21:31
大数据相关
hadoop
hbase
大数据
hive中的数据同步到hbase
关于
hadoop
,hive,hbase这三个技术栈我写了两篇博客简单的分享了我对这三个技术栈的一些看法,在我目前的认知里,
hadoop
提供hdfs这个组件来存储大数据量的数据(相比于mysql,oracle
流~星~雨
·
2024-08-29 21:31
大数据相关
hive
hbase
hadoop
hbase ExportSnapshot迁移hbase表
在源集群上准备快照:snapshot'credit_dict','credit_dict_snapshot20221117'list_snapshots复制快照到目标集群:hbaseorg.apache.
hadoop
.hbase.snapshot.ExportSnapshot
Rjunxiang
·
2024-08-29 16:56
hbase
hbase
大数据
hadoop
Hbase离线迁移
hadoop
distcp-Dmapreduce.job.hdfs-servers.token-renewal.exclude="xx.xx.xx.xx"-i-strat
我要用代码向我喜欢的女孩表白
·
2024-08-29 15:22
hbase
数据库
大数据
Python知识点:如何使用HBase与HappyBase进行分布式存储
HBase是一个基于
Hadoop
的开源分布式数据库,可以处理非常大的表。HappyBase是一个Python库,它提供了一个友好的接口来与HBase交互。
杰哥在此
·
2024-08-29 15:51
Python系列
分布式
python
hbase
编程
面试
Spark-RDD迭代器管道计算
一、上下文《Spark-Task启动流程》中讲到我们提交Stage是传入的是这个Stage最后一个RDD,当Task中触发ShuffleWriter、返回Driver数据或者写入
Hadoop
文件系统时才触发这个
隔着天花板看星星
·
2024-08-29 07:24
spark
大数据
scala
关于这道填空题,你会如何回答?(附带学习链接)
小白的答案是:Java是铜牌,Linux是银牌,
Hadoop
是金牌,大数据是王牌。因为Java是学大数据的基础,有基础然后就可以学后续的;最后只有学好大数据这一王牌才能出去找一份比较好的工作。
csdn业界要闻
·
2024-08-29 05:09
Hdfs的机架感知与副本放置策略
1.介绍Apache
hadoop
机架感知
Hadoop
分布式文件系统(Hdfs)作为Apache
Hadoop
生态系统的的核心组件之一,通过机架感知和副本放置策略来优化数据的可靠性,可用和性能.Hdfs的机架感知和副本放置策略是其设计的关键组成部分
sheansavage
·
2024-08-29 01:42
hdfs
hadoop
大数据
Java高级技术day75:Zookeeper与Dubbo
一、Zookeeper的介绍1.Zookeeper介绍:顾名思义zookeeper就是动物园管理员,他是用来管
hadoop
(大象)、Hive(蜜蜂)、pig(小猪)的管理员,ApacheHbase和ApacheSolr
开源oo柒
·
2024-08-28 20:54
Spark on YARN
ApacheSpark和Apache
Hadoop
YARN是两个紧密相关的项目,它们经常一起使用来处理大规模数据集。
静听山水
·
2024-08-28 09:26
Spark
spark
大数据
分布式
Ubuntu下部署
Hadoop
集群+Hive(三)
Hive部署准备环境apache-hive-4.0.0-bin.tar.gz、mysql-connector-j-8.1.0.jar如果是离线安装的话,使用mysql-8.0.34-1.el7.x86_64.rpm-bundle.tar,在线安装的话则不用;hive下载地址:Indexof/hive(apache.org)mysqlconnector下载地址:MySQL::DownloadConn
岩屿
·
2024-08-28 01:07
hadoop
ubuntu
hive
分享一个基于Spark的招聘数据可视化与分析系统
Hadoop
大数据源码(源码、调试、LW、开题、PPT)
作者:计算机源码社个人简介:本人八年开发经验,擅长Java、Python、PHP、.NET、Node.js、Android、微信小程序、爬虫、大数据、机器学习等,大家有这一块的问题可以一起交流!学习资料、程序开发、技术解答、文档报告如需要源码,可以扫取文章下方二维码联系咨询Java项目微信小程序项目Android项目Python项目PHP项目ASP.NET项目Node.js项目选题推荐项目实战|基
计算机源码社
·
2024-08-27 20:05
大数据
大数据
spark
毕业设计项目
计算机毕业设计源码
计算机毕设论文
hadoop
计算机课程设计
Hadoop
:HA模式配置与实现
写的不到位的地方,欢迎评论指出不足之处一、检查系统环境1、HostName、Hosts、JDK、SSH、网络、防火墙、数据源二、集群角色分配表注:这只是实例服务器NameNodeNameNodeZookepperFailoverControllerDataNodeZookepperJournalNodeOneyes(NN2和其它节点免密)yesyesTwoyes(NN1和其它节点免密)yesyes
家道消乏
·
2024-08-27 08:14
Hadoop基础
hadoop
大数据
hdfs
LVS负载均衡群集
集群的分类四、负载均衡的集群架构五、负载均衡的工作模式六、部署安装LVS-NAT1.1步骤1.2ipvsadm工具选项1.3实际案例(这里面有很多细节,暂时没有解释说明,比如两个节点服务器的网关应该是负载
调度器
的
必叫你大败而归
·
2024-08-27 05:29
高性能群集部署
lvs
负载均衡
服务器
大数据技术之Flume 企业开发案例——负载均衡和故障转移(6)
2)需求分析故障转移案例3)实现步骤准备工作在/opt/module/flume/job目录下创建group2文件夹[lzl@
hadoop
12job]$c
大数据深度洞察
·
2024-08-27 05:58
Flume
大数据
flume
负载均衡
lvs+keepalived+nfs集群部署
体系主要模块及其作用四、Keepalived服务的主要功能1、管理LVS负载均衡软件2、支持故障自动切换(Failover)3、实现LVS集群中节点的健康检查(HealthChecking)4、实现LVS负载
调度器
Linux运维老纪
·
2024-08-27 05:26
以梦为马
不负服务器群集技术
lvs
DR模式下的LVS负载均衡群集详解与部署指南
文章目录DR模式下的LVS负载均衡群集详解与部署指南一、DR模式下的LVS负载均衡原理1.1数据包流向分析1.2DR模式的特点二、DR模式LVS负载均衡群集的部署2.1配置负载
调度器
2.2部署共享存储2.3
爱吃糖的蠢猫
·
2024-08-26 21:09
lvs
负载均衡
运维
Keepalived与LVS高可用群集部署指南
LVS高可用群集部署指南一、Keepalived的工作原理1.1Keepalived的工作机制1.2Keepalived的主要模块二、LVS+Keepalived高可用群集部署2.1环境说明2.2配置负载
调度器
爱吃糖的蠢猫
·
2024-08-26 21:09
lvs
github
git
zookeeper+KAFKA 集群搭建
ZooKeeper是一个分布式的,开放源码的分布式应用程序协调服务,是Google的Chubby一个开源的实现,是
Hadoop
和Hbase的重要组件。
懵逼的运维弟弟
·
2024-08-26 16:28
Linux
zookeeper+KAFKA
集群搭建
(十五)Flink 内存管理机制
在大数据领域,很多开源框架(
Hadoop
、Spark、Storm)都是基于JVM运行,但是JVM的内存管理机制往往存在着诸多类似OutOfMemoryError的问题,主要是因为创建大量的实例,超过JVM
springk
·
2024-08-26 16:27
Flink全景解析
flink
大数据
实时数据
flink
内存管理
内存管理机制
企业群集应用概述与 LVS 负载均衡详解
LoadBalanceCluster)2.2高可用群集(HighAvailabilityCluster)2.3高性能运算群集(HighPerformanceComputerCluster)三、负载均衡群集架构3.1第一层:负载
调度器
爱吃糖的蠢猫
·
2024-08-26 16:27
lvs
负载均衡
运维
面试笔记8.24
正确答案:在我的项目中涉及大数据开发时,我通常会采用分布式的架构,比如使用
Hadoop
或者Spark等大数据处理框架。我会在集群中部署多台服务器,通过分布式计算和存储来处理大规模数据。
励志秃头码代码
·
2024-08-26 16:55
面试
职场和发展
在linux机器中安装配置
hadoop
1.首先我们要把
hadoop
包上传到我们的liunx机器中(运用外链软件上传如:Xshell+xftp)(用我们的外链软件连接成功后,进行
hadoop
包的上传)上传到我们想要的目录路径下,比如我的是上传到
BigData_C
·
2024-08-26 14:40
linux
hadoop
计算机毕业设计
Hadoop
+Spark知识图谱体育赛事推荐系统 体育赛事热度预测系统 体育赛事数据分析 体育赛事可视化 体育赛事大数据 机器学习 大数据毕业设计 大数据毕设 机器学习 人工智能
开发技术前端:vue.js、element-ui、echarts后端:springboot、mybatis大数据:spark、
hadoop
数据库:mysql关系型数据库、neo4j图数据库算法:协同过滤推荐算法
计算机毕业设计大全
·
2024-08-26 13:43
Kylin系列-入门
Kylin系列-入门ApacheKylin是一个开源的分布式分析引擎,提供
Hadoop
/Spark之上的SQL查询接口及多维分析(OLAP)能力,以支持超大规模数据。
Dingdangr
·
2024-08-26 13:34
kylin
Mac
Hadoop
Yarn日志聚合出错
Mac
Hadoop
Yarn日志聚合出错通过日志查看出现了下面的错误:java.lang.IllegalStateException:CannotcloseTFileinthemiddleofkey-valueinsertion.atorg.apache.
hadoop
.io.file.tfile.TFile
HHoao
·
2024-08-26 10:15
macos
hadoop
大数据
上一页
1
2
3
4
5
6
7
8
下一页
按字母分类:
A
B
C
D
E
F
G
H
I
J
K
L
M
N
O
P
Q
R
S
T
U
V
W
X
Y
Z
其他