E-COM-NET
首页
在线工具
Layui镜像站
SUI文档
联系我们
推荐频道
Java
PHP
C++
C
C#
Python
Ruby
go语言
Scala
Servlet
Vue
MySQL
NoSQL
Redis
CSS
Oracle
SQL Server
DB2
HBase
Http
HTML5
Spring
Ajax
Jquery
JavaScript
Json
XML
NodeJs
mybatis
Hibernate
算法
设计模式
shell
数据结构
大数据
JS
消息中间件
正则表达式
Tomcat
SQL
Nginx
Shiro
Maven
Linux
Hadoop系统架构
深入理解
Hadoop
(三)HDFS文件系统设计实现
HDFSFileSystemNameNode端抽象实现HDFS磁盘元数据文件解读共有五种格式的文件:edits_0000000000000041912-0000000000000041913:该LogSegment记录了transactionid在41912-41913之间的事务日志。(最多保留50个)edits_inprogress_0000000000000041914:正在使用的编辑日志文件
我很ruo
·
2024-01-10 08:50
大数据
hadoop
hdfs
大数据
深入理解
Hadoop
(一)网络通信架构与源码浅析
Hadoop
RPC网络通信框架原理剖析YARNRPC服务端的工作大致可以分为四个阶段:第一个阶段:Server初始化和启动在Server初始化的时候,会初始化Listener组件(内部启动了一个AcceptSelector
我很ruo
·
2024-01-10 08:49
大数据
hadoop
架构
大数据
深入理解
Hadoop
(二)HDFS架构演进
HDFS分布式集群架构设计实现核心设计思路:分而治之的思路,实现分散存储+冗余存储元数据管理核心问题:文件系统目录树文件和数据块的映射关系数据块和副本存储主机之间的映射关系NameNode内部两个非常重要的组件:NameNodeRpcServer:RPC服务端,接收所有客户端的RPC请求来执行处理FSNamesystem:负责管理元数据内存中有一份完整的:FSDirectory磁盘中也有一份完整的
我很ruo
·
2024-01-10 08:49
大数据
hadoop
hdfs
架构
hadoop
主要文件及目录简介
1.
hadoop
目录概述
hadoop
的解压目录下的主要文件如下图所示:其中:/bin目录存放对
Hadoop
相关服务(HDFS,YARN)进行操作的脚本;/etc目录存放
Hadoop
的配置文件/lib目录存放
我很ruo
·
2024-01-10 08:19
hadoop
YARN 配置文件 capacity-scheduler.xml 参数解读
capacity-scheduler.xml文件中配置了yarn资源调度器运行中的各项参数,位于
hadoop
安装目录/
hadoop
-2.7.2/etc/
hadoop
目录下。打开后可以看到默认配置。
我很ruo
·
2024-01-10 08:49
hadoop
大数据
hadoop
之HDFS文件系统命令操作
Apache
Hadoop
3.3.4–Overview01.appendToFile
hadoop
fs-appendToFilelocalfile/user/
hadoop
/
hadoop
file
hadoop
fs-appendToFilelocalfile1localfile2
OnePandas
·
2024-01-10 08:46
Hadoop
hadoop
hdfs
大数据
深入理解
Hadoop
(四)HDFS源码剖析
HDFS集群启动脚本start-dfs.sh分析启动HDFS集群总共会涉及到的角色会有namenode,datanode,zkfc,journalnode,secondaryName共五种角色。JournalNode核心工作和启动流程源码剖析//启动JournalNode的核心业务方法publicvoidstart()throwsIOException{//第一件事:创建JournalNode的本
我很ruo
·
2024-01-10 08:10
大数据
hadoop
hdfs
大数据
CDH集成LDAP配置
JavaChenBlog,作者:JavaChen原文链接地址:http://blog.javachen.com/2014/11/12/config-ldap-with-kerberos-in-cdh-
hadoop
.html
101之歌
·
2024-01-10 07:48
Hbase安装步骤
话不多说,下面就是安装的详细步骤:一、下载安装包首先,我们需要下载图中红色标记的三个压缩包:apache-zookeeper-3.6.3.tar、
hadoop
-3.3.1.tar、hbase-2.2.7
Daner13921
·
2024-01-10 06:46
hbase
hadoop
apache
软考高级
系统架构
设计师考试经验分享
文章目录1.软考介绍(1)什么是软考(2)软考的作用(3)软考各科目的难度(4)考试时间(5)考试形式2.
系统架构
设计师备考经验(1)辅导资料(2)备考计划时间节点(3)综合知识各章节分数分布(4)案例分析考试规则题目类型历年真题重要章节
你那是什么调调
·
2024-01-10 06:37
系统架构
经验分享
【spark】基于Spark的电影推荐系统+[详细代码及配置]
基于Spark的电影推荐系统项目架构组件版本及配置名称版本
Hadoop
2.8.5Hive2.1.0Spark1.6.3Kafka2.10_0.8.21MariaDB(Mysql)5.5.64Scala2.10.6Java1.8.0
BIG*BOSS
·
2024-01-10 06:25
Spark
spark
大数据本地环境搭建-Zookeeper/
Hadoop
/Hive搭建
1.Zookeeper环境安装链接:https://pan.baidu.com/s/1wzbCiDxP7H5G_llwjSS3Rw?pwd=wgal提取码:wgal1.1上传tar包zookeeper-3.4.6.tar注意:上传文件位置为/export/server目录1.2解压缩cd/export/servertarxvf/export/server/zookeeper-3.4.6.tar.g
OnePandas
·
2024-01-10 06:01
集群环境搭建
大数据
hadoop
zookeeper
hive
Hadoop
之mapreduce参数大全-4
76.指定在MapReduce作业中,哪些输出文件应该在任务失败时保留mapreduce.task.files.preserve.filepattern是
Hadoop
MapReduce框架中的一个配置属性
OnePandas
·
2024-01-10 06:01
Hadoop
hadoop
mapreduce
Hadoop
之mapreduce参数大全-1
1.设置Map/Reduce任务允许使用的最大虚拟内存大小mapred.task.maxvmem是MapReduce的一个配置参数,用于指定每个Map/Reduce任务允许使用的最大虚拟内存大小(以字节为单位)。如果一个任务使用的虚拟内存超过了此参数指定的值,则任务会被认为是失败的,并且MapReduce集群会尝试重新分配任务。默认情况下,此参数的值为MapReduce任务的堆内存大小的两倍。可以
OnePandas
·
2024-01-10 06:00
Hadoop
hadoop
Hadoop
之mapreduce参数大全-2
25.指定在Reduce任务在shuffle阶段的fetch操作中重试的超时时间mapreduce.reduce.shuffle.fetch.retry.timeout-ms是Apache
Hadoop
MapReduce
OnePandas
·
2024-01-10 06:00
Hadoop
hadoop
大数据
Hadoop
之mapreduce参数大全-3
51.指定Shuffle传输过程中可以同时连接的节点数mapreduce.shuffle.max.connections是
Hadoop
MapReduce中的一个配置参数,用于指定Shuffle传输过程中可以同时连接的节点数
OnePandas
·
2024-01-10 05:57
Hadoop
hadoop
mapreduce
java
Hadoop
体系结构之 HDFS
HDFS采用主从(Master/Slave)结构模型,一个HDFS集群是由一个NameNode和若干个DataNode组成的(在最新的
Hadoop
2.2版本已经实现多个NameNode的配置-这也是一些大公司通过修改
Alukar
·
2024-01-10 05:05
Java大数据学习~
Hadoop
初识三Yarn模式
我们都知道在如今的
Hadoop
中主要有三个重要的执行管理器。一个HDFS,一个MapReduce,还有就是我们今天要看的YARN。
胖琪的升级之路
·
2024-01-10 05:55
软件定义汽车8-构建开源软件生态系统
很多围绕智驾成立的软件公司,也都只是在单独的域内考虑问题,没有从智能汽车整体数字
系统架构
的角度考虑问题。
leo_huang_
·
2024-01-10 04:44
自动驾驶代客泊车360环式系统及倒车雷达功能规范
文档优先说明.81.3.2.政府法规与文件.91.3.3.行业规范与文件.91.3.4.百度及客户提供相关功能定义文档.92.系统概述.102.1.整车网络拓扑.102.2.系统硬件条件.102.3.
系统架构
框图
电气_空空
·
2024-01-10 02:08
自动驾驶
自动驾驶
人工智能
机器学习
代客泊车低速紧急制动辅助系统MEB功能规范
名词解释.41.3.1文档优先说明.41.3.2政府法规与文件.41.3.3行业规范与文件.41.3.4百度及客户提供相关功能定义文档.52系统概述.62.1整车网络拓扑.62.2系统硬件条件.62.3
系统架构
框图
电气_空空
·
2024-01-10 02:36
自动驾驶
自动驾驶
Hive的复杂数据类型
复杂数据类型:array、map、struct1.数组array,里边不能装不同类型的数据[
hadoop
@
hadoop
001data]$morehive_array.txtzhangsanbeijing
白面葫芦娃92
·
2024-01-10 00:35
1.2.2.5MapReduce实例
总目录:https://www.jianshu.com/p/e406a9bc93a9
Hadoop
-子目录:https://www.jianshu.com/p/9428e443b7fd天气案例经典案例myclient.java
寒暄_HX
·
2024-01-10 00:53
Hadoop
集群搭建:4.修改
Hadoop
的配置文件、节点启动
配置文件的路径:/module/
hadoop
-2.7.2/etc/
hadoop
1.核心配置文件配置core-site.xml,命令:vicore-site.xml在该文件的中config范围内编写如下配置
丶珍视当下
·
2024-01-09 23:38
【学习笔记】尚硅谷
Hadoop
大数据教程笔记
本文是尚硅谷
Hadoop
教程的学习笔记,由于个人的需要,只致力于搞清楚
Hadoop
是什么,它可以解决什么问题,以及它的原理是什么。至于具体怎么安装、使用和编写代码不在我考虑的范围内。
棉花糖灬
·
2024-01-09 23:17
大数据
大数据
hadoop
MapReduce
yarn
hdfs
《
Hadoop
大数据技术原理与运用》知识点总结
Hadoop
学习过程中的一些笔记参考书籍《
Hadoop
大数据技术原理与应用》清华大学出版社黑马程序员/编著1.什么是大数据?大数据的四个特征是什么?
呆小黎
·
2024-01-09 22:47
大数据
hadoop
数据库
分布式
笔记:分布式大数据技术原理(一)
Hadoop
框架
Apache
Hadoop
软件库是一个框架,它允许使用简单的编程模型,实现跨计算机集群的大型数据集的分布式处理。
WeeeicheN
·
2024-01-09 22:17
Big
Data
big
data
hadoop
笔记:分布式大数据技术原理(三)Spark
ApacheSpark是一个围绕速度、易用性和复杂分析构建的大数据处理框架,最初在2009年由加州大学伯克利分校的AMPLab开发,并于2010年成为Apache的开源项目之一,与
Hadoop
和Storm
WeeeicheN
·
2024-01-09 22:17
Big
Data
big
data
spark
第一章 大数据
Hadoop
学习笔记(一)
一、存储单位按顺序给出数据存储单位:bit、Byte、KB、MB、GB、TB、PB、EB、ZB、YB、BB、NB、DB。一般TB、PB、EB为单位的数据为大数据。1Byte=8bit1K=1024Byte1MB=1024K1G=1024M1T=1024G1P=1024T二、大数据主要解决海量数据的采集、存储和分析计算问题。三、大数据特点(4V)Volume(大量)、Velocity(高速)、Var
Thanks.
·
2024-01-09 22:17
hadoop
学习
大数据
大数据技术学习笔记之
Hadoop
框架基础1-
Hadoop
介绍及伪分布式部署
、java变量-》安装部署配置环境-》开发-》熟练的使用,了解基本原理-》java集合、线程、javaweb-》深入了解架构、设计思想、性能调优-》堆、栈、JVM,内存优化,架构设计-》方法:-》掌握
hadoop
黄剑锋1996
·
2024-01-09 22:16
大数据技术原理与应用学习笔记(八)
大数据技术原理与应用学习笔记(八)本系列历史文章
Hadoop
再探讨
Hadoop
的优化与发展
Hadoop
1.0到
Hadoop
2.0不断完善的
Hadoop
生态系统HDFS2.0新特性HDFSHA(高可用性)
Ragnaros the Firelord
·
2024-01-09 22:46
大数据学习笔记
hadoop
大数据
大数据技术原理与应用笔记
NoSql入门文章目录一、大数据概述1.1大数据时代1.2大数据的概念和影响1.3大数据的应用1.4大数据的关键技术1.5大数据,物联网和云计算1.5.1云计算1.5.2物联网检测题二、大数据处理架构
Hadoop
2.1hello
Moliay
·
2024-01-09 22:16
大数据
大数据
云计算
人工智能
个人笔记:分布式大数据技术原理(一)
Hadoop
框架
大家想了解更多大数据相关内容请移驾我的课堂:大数据相关课程剖析及实践企业级大数据数据架构规划设计大厂架构师知识梳理:剖析及实践数据建模剖析及实践数据资产运营平台Apache
Hadoop
软件库是一个框架,
garagong
·
2024-01-09 22:15
大数据
分布式
大数据
mapreduce
hadoop
HDFS相关Shell命令
文章目录上传相关操作下载相关操作HDFS直接操作上传相关操作1)-moveFromLocal:从本地剪切粘贴到HDFS
hadoop
fs-moveFromLocal.
欲无缘
·
2024-01-09 22:03
大数据
hdfs
npm
hadoop
HDFS概述
定义HDFS(
Hadoop
Dist
欲无缘
·
2024-01-09 22:32
大数据
hdfs
hadoop
大数据
开放平台
系统架构
设计
一、概述背景与目标本开放平台旨在构建一个可扩展、高可用的生态体系,通过提供统一标准的API接口和SDK工具包,让第三方开发者能够安全、高效地接入我们的服务和资源,实现业务的互联互通。定位与功能描述系统主要包含用户认证授权、资源管理、API调用监控、数据分析等功能模块,支持多租户模式,满足不同开发者对功能定制化的需求。二、关键组成部分API(应用程序接口):开放平台的核心是提供一系列公开的API,这
coder.Funs
·
2024-01-09 21:41
Java
redis
数据库
系统架构
开放平台系统架构
java云原生架构
java架构
云原生
开放平台架构设计
spring
cloud
Flume的安装
下载地址:http://archive.apache.org/dist/flume/1.解压apache-flume-1.7.0-bin.tar.gz到/opt/module/目录下[honey@
hadoop
102software
静宸丶水默含声
·
2024-01-09 19:32
结构化搜索_在案例中实战使用terms搜索多个值以及多值搜索结果优化
1、为帖子数据增加tag字段POST/forum/article/_bulk{"update":{"_id":"1"}}{"doc":{"tag":["java","
hadoop
"]}}{"update
Shaw_Young
·
2024-01-09 19:23
Flume实时读取本地/目录文件到HDFS
准备工作二、实时读取本地文件到HDFS(一)案例需求(二)需求分析(三)实现步骤三、实时读取目录文件到HDFS(一)案例需求(二)需求分析(三)实现步骤一、准备工作Flume要想将数据输出到HDFS,必须持有
Hadoop
Francek Chen
·
2024-01-09 18:38
大数据技术基础
flume
hdfs
大数据
[超超超超超超详细] Linux Centos7搭建
Hadoop
集群及运行MapReduce分布式集群
版本:Centos7
Hadoop
3.2.0JDK1.8虚拟机信息:内存3.2G处理器2*2内存50GISO:Centos-7-x86_64-DVD-2009一、在虚拟机上搭建LinuxCentos7略二
没事多学习_Qi
·
2024-01-09 17:38
服务器_Linux
linux
mariadb
运维
负载均衡
Hadoop
运行在Kubernetes平台实践
Hadoop
与Kubernetes就好像江湖里的两大绝世高手,一个是成名已久的长者,至今仍然名声远扬,一个则是初出茅庐的青涩少年,骨骼惊奇,不走寻常路,一出手便惊诧了整个武林。
Java大生
·
2024-01-09 17:12
开发接口,你需要先搞懂这些概念!
首先,你要知道SOA并不是某一种具体的技术实现,它是一个
系统架构
的设计思想。这个架构设计思想的提出背景是随着我们的软件系统解决的问题越来越复杂,
心软小念
·
2024-01-09 17:56
技术分享
软件测试
微服务
架构
云原生
Zookeeper集群+Kafka集群
1、kafka的特性2、kafka
系统架构
3、Kafka工作流程及文件存储机制4、数据可靠性保证5、数据一致性问题6、ack应答机制一、什么是zookeeper?Zookeep
Kido.S
·
2024-01-09 17:52
zookeeper
kafka
笔记
java 全栈高级工程师,架构师学习资源 交流
redis集群zookeeper集群搭建与调优dubbo/dubbox分布式服务jvm调优,内存分析java并发dockerlinuxjmeter性能测试netty/minamycat
hadoop
管理级别技能
昵称不能为null
·
2024-01-09 15:03
大数据学习6-Sqoop安装与使用
sqoop搭建还是挺简单的,前提是
hadoop
与hive搭建完成上传解压首先下载sqoop,sqoop的版本是1.4.7,sqoop-1.4.7.bin__
hadoop
-2.6.0.tar.gz,提取码
asXt
·
2024-01-09 15:57
大数据
笔记
linux
sqoop
sqoop的安装与使用
Sqoop是一个用于在
hadoop
与mysql之间传输数据的工具Sqoop环境搭建(1)上传安装包:sqoop-1.4.6-cdh5.14.2.tar.gz到/opt/software(2)解压安装包:
xinxinyydss
·
2024-01-09 15:23
sqoop
hadoop
hive
【读书笔记】《
Hadoop
构建数据仓库实践》第1章
02-《
Hadoop
构建数据仓库实践》.jpg第1章数据仓库简介1.1什么是数据仓库Inmon将数据仓库描述为一个面向主题的、集成的、随时间变化的、非易失的数据集合,用于支持管理者的决策过程。
笔名辉哥
·
2024-01-09 15:01
Hive基础知识(三):Linux系统下的MySQL安装
1)检查当前系统是否安装过MySQL[zzdq@
hadoop
100hive]$rpm-qa|grepmariadbmariadb-libs-5.5.68-1.el7.x86_64#如果存在,就用下面这条命令卸载
依晴无旧
·
2024-01-09 13:26
hive
linux
mysql
Hive基础知识(二):Hive 安装部署教程
apache-hive-3.1.2-bin.tar.gz上传到linux的/opt/software目录下2)解压apache-hive-3.1.2-bin.tar.gz到/opt/module/目录下面[root@
hadoop
100
依晴无旧
·
2024-01-09 13:25
大数据
hive
hadoop
数据仓库
Hive基础知识(一):Hive入门与Hive架构原理
Hive是基于
Hadoop
的一个数据仓库工具,可以将结构化的数据文件映射为一张表,并提供类SQL查询功能。
依晴无旧
·
2024-01-09 13:25
大数据
hive
架构
hadoop
上一页
32
33
34
35
36
37
38
39
下一页
按字母分类:
A
B
C
D
E
F
G
H
I
J
K
L
M
N
O
P
Q
R
S
T
U
V
W
X
Y
Z
其他