E-COM-NET
首页
在线工具
Layui镜像站
SUI文档
联系我们
推荐频道
Java
PHP
C++
C
C#
Python
Ruby
go语言
Scala
Servlet
Vue
MySQL
NoSQL
Redis
CSS
Oracle
SQL Server
DB2
HBase
Http
HTML5
Spring
Ajax
Jquery
JavaScript
Json
XML
NodeJs
mybatis
Hibernate
算法
设计模式
shell
数据结构
大数据
JS
消息中间件
正则表达式
Tomcat
SQL
Nginx
Shiro
Maven
Linux
hdfs集群搭建
电商数仓可视化1--数据导入
商品分类信息、商品信息、店铺信息、订单数据、订单支付信息、活动信息、物流信息等2、埋点数据埋点日志相对业务数据是用于数据分析、挖掘需求,一般以日志形式存储于日志文件中,随后通过采集落地分布式存储介质中如
hdfs
bigdata从入门到放弃
·
2024-01-03 18:53
数据仓库
linux
hadoop
大数据
java
数据仓库
我的大数据之路:2023年度总结
同时对“数据治理”有了一定的实践经验:存储治理:
HDFS
基于纠删码的存储空间占用上优于多副本存储;冷数据使用对象存储可以大幅降低成本。
话数Science
·
2024-01-03 18:07
大数据
面试
大数据
面试
spark
HDFS
重温
今天被问到分布式,有些忘记,查资料回忆起分布式集群构建,现在重温
集群搭建
过程费话不多说,来个简图NameNode:
HDFS
群集包含单个NameNode(主服务器),它管理文件系统命名空间并控制客户端对文件的访问权限
zty_1995
·
2024-01-03 18:18
开源大数据集群部署(一)集群实施规划
8C16G操作系统版本CentOSLinuxrelease7.8.2003(Core)java版本javaversion“1.8.0_281”hadoop版本hadoop3.2.4集群版本规划集群组建版本
HDFS
3.2.4YARN3.2.4M
云掣YUNCHE
·
2024-01-03 15:42
开源大数据集群部署
开源
大数据
HBASE基础
1、NoSQL非关系型数据库2、hbase是面向列存储结构,即类似于hashmap3、hbase是以
hdfs
作为基础存储4、官网http://hbase.apache.org/5、hbase的逻辑结构是由行与列族构成的
xinxinyydss
·
2024-01-03 12:25
hbase
数据库
大数据
Redis专题(持续更新)
03-VIP-Redis缓存高可用集群文章目录03-VIP-Redis缓存高可用集群正文1、Redis集群方案比较2、Redis高可用
集群搭建
redis
集群搭建
3、Java操作redis集群4、Redis
Player
·
2024-01-03 09:56
redis
数据库
缓存
HDFS
之Offline Viewer
FileDistribution常用于查看
hdfs
文件大小分布,查看小文件的数量。
hdfs
oiv-pFileDistribution-maxSizemaxSize-step
zincooo
·
2024-01-03 09:16
HDFS
hdfs
hadoop
Spark一:Spark介绍、技术栈与运行模式
1.2Spark作用中间结果输出Spark的Job中间输出结果可以保存在内存中,从而不再需要读写
HDFS
MapReduce的替代方案Spark比M
eight_Jessen
·
2024-01-03 09:11
spark
spark
大数据
分布式
kubeadm来快速搭建一个K8S集群
二进制的搭建更适合50台主机以上的大集群,kubeadm更适合中小型企业的
集群搭建
主机节点IP组件master20.0.0.61docker、kubeadm、kubelet、kubectl、flannelnode0120.0
,老六
·
2024-01-03 07:55
kubernetes
docker
容器
Flume基础知识(一):Flume组成原理与架构
Flume最主要的作用就是,实时读取服务器本地磁盘的数据,将数据写入到
HDFS
。2.Flume基础架构Flume组成架构如下图所示。
依晴无旧
·
2024-01-03 07:18
大数据
flume
大数据
计算机毕业设计吊打导师hadoop+spark+hive知识图谱医生推荐系统 医生数据分析可视化大屏 医生爬虫 医疗可视化 医生大数据 机器学习 大数据毕业设计
万医生数据,最终存入mysql数据库;2.使用pandas+numpy/hadoop+mapreduce对mysql中的医生数据进行数据分析,使用高德地图解析地理位置,并将结果转入.csv文件同时上传到
hdfs
计算机毕业设计大神
·
2024-01-03 07:53
纠删码ReedSolomon
随着大数据技术的发展,
HDFS
作为Hadoop的核心模块之一得到了广泛的应用。为了数据的可靠性,
HDFS
通过多副本机制来保证。
旅僧
·
2024-01-03 07:14
#
大数据计算基础
大数据
分布式
算法
Clojure 实战(4):编写 Hadoop MapReduce 脚本
它是Apache基金会下的开源项目,受Google两篇论文的启发,采用分布式的文件系统
HDFS
,以及通用的MapReduce解决方案,能够在数千台物理节点上进行分布式并行计算。
张吉Jerry
·
2024-01-03 07:35
大数据
hadoop
clojure
shell编程之find
-inameaa-user查找文件属主为
hdfs
的所有文件,不区分大小写find.-user
hdfs
-group查找文件属组为yarn的所有文件find.-groupyarnf文件find.
hemingkung
·
2024-01-03 06:13
python操作
hdfs
及hbase
操作
HDFS
创建目录client.makedirs("/tmp/ct/test51")默认权限755,用户名:dr.who可以创建多层级目录(类似mkdir-p)如果存在权限不足,可以通过命令行对上层目录权限进行修改
佛系小懒
·
2024-01-03 04:26
Hbase介绍以及Hive优势
因为HBase基于Hadoop的
HDFS
完成分布式存储,以及MapReduce完成分布式并行计算,所以它的一些特点与Hadoop相同,依靠横向扩展,通过不断增加性价比高的商业服务器来增加计算和存储能力。
毛毛虫同学
·
2024-01-02 14:38
HBase内容分享(五):HBase读写性能优化
目录一、HBase读优化1.HBase客户端优化2.HBase服务器端优化3.HBase列族设计优化4.
HDFS
相关优化5.HBase读性能优化归纳二、HBase写优化1.写性能优化切入点2.写异常问题检查点一
之乎者也·
·
2024-01-02 10:48
大数据(Hadoop)内容分享
HBase
内容分享
hbase
性能优化
数据库
【Hadoop】如何启动和关闭Hadoop集群
启动Hadoop集群关闭Hadoop集群启动Hadoop集群参考官方文档ApacheHadoop3.3.6–HadoopClusterSetup要启动Hadoop集群,需要同时启动
HDFS
和YARN集群
不怕娜
·
2024-01-02 10:29
hadoop
大数据
分布式
【Hadoop】集群配置之主要配置文件(hadoop-env.sh、yarn-env.sh、core-site.xml、
hdfs
-site.xml、mapred-site.xml...)
Hadoop配置文件模板core-site.xmlhadoop-env.sh
hdfs
-site.xmlyarn-env-shyarn-site.xmlmapred-site.xmlslavesHadoop
不怕娜
·
2024-01-02 10:27
hadoop
xml
hdfs
Apache Hive详解
目录一、引入Hive简介为什么要使用HiveHive的特点Hive的发展历程二、Hive架构体系三、MySQL安装安装准备安装卸载(了解)四、Hive
集群搭建
准备工作安装过程五、Hive的MySQL元数据库与表六
毫无感情的dj
·
2024-01-02 07:06
hive
大数据
hadoop
Hive(二)之bash群起脚本
集群的启动启动
HDFS
启动namenode$/opt/modules/cdh/hadoop-2.5.0-cdh5.3.6/sbin/hadoop-daemon.shstartnamenode2.启动datanode
DarrenmondZhang
·
2024-01-02 07:45
大数据 - Hadoop系列《三》-
HDFS
(分布式文件系统)概述
5.1
hdfs
的概念
HDFS
分布式文件系统,全称为:HadoopDistributedFileSystem。
王哪跑nn
·
2024-01-02 06:06
大数据
大数据
hadoop
hdfs
【2023】hadoop基础介绍
目录Hadoop组成
HDFS
HDFS
操作
HDFS
分布式文件存储NameNode元数据数据读写流程YARN和MapReduceMapReduce:分布式计算YARN:资源管控调度YARN架构提交任务到**
方渐鸿
·
2024-01-02 03:26
数据分析
hadoop
大数据
分布式
python
flink 连接
hdfs
读取文件配置
flink连接
hdfs
读取文件配置hadoop版本为2.7.3window系统本地运行flink程序读取
hdfs
文件配置1,请导入hadoop和httpclient的包org.apache.flinkflink-hadoop-fs
eagle隼
·
2024-01-02 02:06
2018-05-21
分别做什么
hdfs
是存储数据的,yarn是管理调度作业的,mr是计算处理的3.
hdfs
在部署时,要配置信任关系,请问root和hadoop用户部署时,区别是什么root的权限高,可以不用管,普通用户需要修改
CrUelAnGElPG
·
2024-01-01 23:55
hdfs
数据完整性
hdfs
会对写入的所有数据计算校验和,在数据通过不可靠通道传输的时候再次计算校验和,对比就能发现数据是否损坏,常用的通过32位循环冗余校验,在hadoop中,可以通过checksum命令得到想要的文件的校验和
文贞武毅
·
2024-01-01 20:45
详解大数据数据仓库分层架构
大数据数据仓库是基于HIVE构建的数据仓库,分布文件系统为
HDFS
,资源管理为Yarn,计算引擎主要包括MapReduce/Tez/Spark等,分层架构如下:1、数据来源层:日志或者关系型数据库,并通过
Alukar
·
2024-01-01 14:47
大数据编程期末大作业
目录一、Hadoop基础操作二、RDD编程三、SparkSQL编程四、SparkStreaming编程五、Flume的安装配置一、Hadoop基础操作按要求完成以下操作:1、在
HDFS
中创建目录/user
Francek Chen
·
2024-01-01 14:50
Spark编程基础
spark
大数据
分布式
ceph
集群搭建
到应用从入门到熟练,包含块存储、对象存储、cephfs的应用、cephx认证等
ceph-deploy比较适合生产环境,不是用cephadm搭建。相对麻烦一些,但是并不难,细节把握好就行,只是命令多一些而已。ceph理论知识略…ceph集群实验环境服务器主机public网段IP(对外服务)cluster网段IP(集群通信)角色deploy192.168.2.120用于部署集群、管理集群ceph-node1192.168.2.121192.168.6.135ceph-mon、c
绝恋96
·
2024-01-01 14:50
ceph
云原生
linux
运维
ceph
2024任务驱动Hadoop应用讲课提纲
Hadoop集群任务1:搭建完全分布式Hadoop集群1.思路解析2.编程实现3.知识点讲解4.总结提高任务2:搭建高可用Hadoop集群(HA模式)1.思路解析2.编程实现3.知识点讲解4.总结提高项目二:
HDFS
howard2005
·
2024-01-01 13:41
Hadoop分布式入门
hadoop
大数据
分布式
安装Hadoop:Hadoop的单机模式、伪分布式模式——备赛笔记——2024全国职业院校技能大赛“大数据应用开发”赛项
前言Hadoop包括三种安装模式:单机模式:只在一台机器上运行,存储是采用本地文件系统,没有采用分布式文件系统
HDFS
;伪分布式模式:存储采用分布式文件系统
HDFS
,但是,
HDFS
的名称节点和数据节点都在同一台机器上
Stitch .
·
2024-01-01 10:09
我的大学笔记
Hadoop
分布式
大数据
hadoop
笔记
linux
mysql
hive
【2023Hadoop大数据技术应用期末复习】填空题题型整理
大数据的4V特征包含()()()()答案:大量、多样、高速、价值Hadoop三大组件包含()()()答案:
HDFS
、MapReduce、YarnHadoop2.x版本中的
HDFS
是由()()()组成答案
Lacszer
·
2024-01-01 10:23
大数据
Docker:Docker集群配置与应用(Docker Swarm)
DockerSwarm集群1.1为什么要使用容器集群1.2什么是Swarm集群1.3DockerSwarm特性1.4Swarm节点1.5Swarm集群管理命令Swarm集群节点管理命令1.6DockerSwarm
集群搭建
前言可以认为
boy快快长大
·
2024-01-01 08:55
Docker
docker
eureka
容器
计算机毕业设计hadoop+spark+hive知识图谱酒店推荐系统 酒店数据分析可视化大屏 酒店爬虫 高德地图API 酒店预测系统 大数据毕业设计
爬取去哪儿网全站旅游数据约10万+,存入mysql;2.使用pandas+numpy/hadoop+mapreduce对mysql中旅游数据进行数据清洗,使用高德API计算地理信息,最终转为.csv文件上传
hdfs
计算机毕业设计大神
·
2024-01-01 06:52
Python使用
hdfs
存放文件时报Proxy error: 502 Server dropped connection解决方案
Python3使用
hdfs
分布式文件储存系统frompy
hdfs
import*client=
Hdfs
Client(hosts="test
hdfs
.org,50070",user_name="web_crawler
Python之战
·
2024-01-01 05:11
java.io.FileNotFoundException: HADOOP_HOME and hadoop.home.dir are unset.
hadoop-2.8.4包内的bin文件替换,将下载文件中hadoop.dll放到C:\Windows\System32下解决办法:1.下载hadoop,去官网下载对应的hadoop版本,我在linux
集群搭建
的是
Sql强
·
2024-01-01 04:35
程序员如何基于Docker方式搭建MongoDB集群
具体用法,可以参考菜鸟教程《MongDB教程》,这里就不做详细描述在这里我们主要是讲述基于Docker的Mongo
集群搭建
。在早期的项目开发中,一般都是采用单个数据库去存储数据,这是一种很危险的举动。
程序员xysam
·
2024-01-01 00:03
java
程序人生
【mongoDB】MongoDB 4.X 用户和角色权限管理总结
使用Docker一键部署MongoDBhttps://blog.csdn.net/u011104991/article/details/81735960DockerMongoDBv4.0.0
集群搭建
https
Bogon
·
2023-12-31 22:30
大数据 - Hadoop系列《二》- Hadoop组成
目录3.1hadoop组成3.1
HDFS
架构概述1.NameNode(nn):编辑2.DataNode(dn):3.SecondaryNameNode(2nn):3.2YARN架构概述3.3MapReduce
王哪跑nn
·
2023-12-31 22:50
大数据
大数据
hadoop
分布式
大数据的核心工作
以数据为生活赋能大数据软件生态(数据存储,数据计算,数据传输)1.大数据的核心工作存储:妥善保存海量待处理数据计算:完成海量数据的价值挖掘传输:协助各个环节的数据传输2.大数据软件生态存储:ApacheHadoop
HDFS
PGl63
·
2023-12-31 22:42
hadoop
数据库
数据库架构
redis
集群搭建
详解
一、主从复制1、准备两台机器2、设置主从3、验证4、复制原理二、哨兵Sentinel1、配置2、启动哨兵一、主从复制#查看信息inforeplication127.0.0.1:6379>inforeplication#Replicationrole:master#当前为主角色connected_slaves:0#是否拥有从角色机器master_failover_state:no-failoverm
mapyking
·
2023-12-31 20:49
redis
redis
数据库
安装与部署Hadoop
一、前置安装准备1、机器2、java3、创建hadoop用户二、安装Hadoop三、环境配置1、workers2、hadoop-env.sh3、core-site.xml4、
hdfs
-site.xml5
mapyking
·
2023-12-31 20:48
大数据-Hadoop
hadoop
大数据
分布式
玩转MYSQL|详细分析mysql-MGR
集群搭建
目录1、简介2、环境准备2.1数据库服务器规划2.2安装mysql5.7.202.3设置hostname和ip映射3、创建复制环境3.1服务器host68.cn3.1.1配置/etc/my.cnf3.1.2服务器host68.cn上建立复制账号:3.1.3在mysql服务器host68.cn上安装groupreplication插件3.1.4启动服务器host68.cn上mysql的groupre
Jum朱
·
2023-12-31 18:32
mysql
数据库
3、RocketMQ基础-RocketMQ
集群搭建
RocketMQ
集群搭建
各角色介绍Producer:消息的发送者;举例:发信者Consumer:消息接收者;举例:收信者Broker:暂存和传输消息;举例:邮局NameServer:管理Broker;举例
站得高看得远
·
2023-12-31 16:35
Docker搭建mysql主从复制集群
Docker搭建mysql主从复制
集群搭建
步骤准备docker镜像dockersearchmysqldockerpullmysql准备映射路径#master路径准备mkdir-m777/Users/a1
whhwch1986
·
2023-12-31 16:59
数据库
docker
mysql
adb
k8s
集群搭建
【1个master_1个node】 亲测成功!
k8s
集群搭建
k8s_1个master_1个node_
集群搭建
步骤小结1:安装docker2:安装kubeadm/kubectl/kubelet3:创建master节点的集群(并安装网络插件calico
优雅のbug
·
2023-12-31 15:45
kubernetes
容器
云原生
sqoop的导入命令详解
sqoop的背景sqoop是一个配合大数据hadoop做数据底层的导入导出操作,需要配合hive及分布式文件系统(
hdfs
或blob)一起使用,在大数据ETL应用领域,sqoop占据主流。
夜空痕
·
2023-12-31 13:55
Kafka集群详解
Kafka介绍Kafka集群介绍Kafka集群特点Kafka
集群搭建
在这里插入图片描述Kafka集群如何进行故障切换Kafka集群Leader的选举Kafka集群如何快速横向拓展Kafka
集群搭建
最佳实践
有梦想的攻城狮
·
2023-12-31 10:00
架构设计
kafka
kafka集群
TimescaleDB分布式
集群搭建
Multi-nodeTimescaleDBallowsyoutotieseveraldatabasestogetherintoalogicaldistributeddatabasetocombinetheprocessingpowerofmanyphysicalPostgreSQLinstances.Oneofthedatabasesexistsonanaccessnodeandstoresmet
pigcoffee
·
2023-12-31 09:15
分布式
postgresql
使用Java API对
HDFS
进行如下操作:文件的创建、上传、下载以及删除等操作
HDFS
-JAVA接口:上传文件将一个本地文件(无具体要求)上传至
HDFS
中的/
hdfs
-test路径下(如无此路径,新建一个)。
马龙强_
·
2023-12-31 09:50
java
hdfs
hadoop
上一页
14
15
16
17
18
19
20
21
下一页
按字母分类:
A
B
C
D
E
F
G
H
I
J
K
L
M
N
O
P
Q
R
S
T
U
V
W
X
Y
Z
其他