矮蛋蛋

分布式服务框架 Zookeeper -- 管理分布式环境中的数据

原文地址： http://www.ibm.com/developerworks/cn/opensource/os-cn-zookeeper/
安装和配置详解
本文介绍的 Zookeeper 是以 3.2.2 这个稳定版本为基础，最新的版本可以通过官网 http://hadoop.apache.org/zookeeper/来获取，Zookeeper 的安装非常简单，下面将从单机模式和集群模式两个方面介绍 Zookeeper 的安装和配置。
单机模式
单机安装非常简单，只要获取到 Zookeeper 的压缩包并解压到某个目录如：/home/zookeeper-3.2.2 下，Zookeeper 的启动脚本在 bin 目录下，Linux 下的启动脚本是 zkServer.sh，在 3.2.2 这个版本 Zookeeper 没有提供 windows 下的启动脚本，所以要想在 windows 下启动 Zookeeper 要自己手工写一个，如清单 1 所示：
清单 1. Windows 下 Zookeeper 启动脚本
setlocal
set ZOOCFGDIR=%~dp0%..\conf
set ZOO_LOG_DIR=%~dp0%..
set ZOO_LOG4J_PROP=INFO,CONSOLE
set CLASSPATH=%ZOOCFGDIR%

set CLASSPATH=%~dp0..\*;%~dp0..\lib\*;%CLASSPATH%
set CLASSPATH=%~dp0..\build\classes;%~dp0..\build\lib\*;%CLASSPATH%
set ZOOCFG=%ZOOCFGDIR%\zoo.cfg
set ZOOMAIN=org.apache.zookeeper.server.ZooKeeperServerMain
java "-Dzookeeper.log.dir=%ZOO_LOG_DIR%" "-Dzookeeper.root.logger=%ZOO_LOG4J_PROP%"
-cp "%CLASSPATH%" %ZOOMAIN% "%ZOOCFG%" %*
endlocal
在你执行启动脚本之前，还有几个基本的配置项需要配置一下，Zookeeper 的配置文件在 conf 目录下，这个目录下有 zoo_sample.cfg 和 log4j.properties，你需要做的就是将 zoo_sample.cfg 改名为 zoo.cfg，因为 Zookeeper 在启动时会找这个文件作为默认配置文件。下面详细介绍一下，这个配置文件中各个配置项的意义。
tickTime=2000
dataDir=D:/devtools/zookeeper-3.2.2/build
clientPort=2181
tickTime：这个时间是作为 Zookeeper 服务器之间或客户端与服务器之间维持心跳的时间间隔，也就是每个 tickTime 时间就会发送一个心跳。
dataDir：顾名思义就是 Zookeeper 保存数据的目录，默认情况下，Zookeeper 将写数据的日志文件也保存在这个目录里。
clientPort：这个端口就是客户端连接 Zookeeper 服务器的端口，Zookeeper 会监听这个端口，接受客户端的访问请求。
当这些配置项配置好后，你现在就可以启动 Zookeeper 了，启动后要检查 Zookeeper 是否已经在服务，可以通过 netstat – ano 命令查看是否有你配置的 clientPort 端口号在监听服务。
集群模式
Zookeeper 不仅可以单机提供服务，同时也支持多机组成集群来提供服务。实际上 Zookeeper 还支持另外一种伪集群的方式，也就是可以在一台物理机上运行多个 Zookeeper 实例，下面将介绍集群模式的安装和配置。
Zookeeper 的集群模式的安装和配置也不是很复杂，所要做的就是增加几个配置项。集群模式除了上面的三个配置项还要增加下面几个配置项：
initLimit=5
syncLimit=2
server.1=192.168.211.1:2888:3888
server.2=192.168.211.2:2888:3888
initLimit：这个配置项是用来配置 Zookeeper 接受客户端（这里所说的客户端不是用户连接 Zookeeper 服务器的客户端，而是 Zookeeper 服务器集群中连接到 Leader 的 Follower 服务器）初始化连接时最长能忍受多少个心跳时间间隔数。当已经超过 10 个心跳的时间（也就是 tickTime）长度后 Zookeeper 服务器还没有收到客户端的返回信息，那么表明这个客户端连接失败。总的时间长度就是 5*2000=10 秒
syncLimit：这个配置项标识 Leader 与 Follower 之间发送消息，请求和应答时间长度，最长不能超过多少个 tickTime 的时间长度，总的时间长度就是 2*2000=4 秒
server.A=B：C：D：其中 A 是一个数字，表示这个是第几号服务器；B 是这个服务器的 ip 地址；C 表示的是这个服务器与集群中的 Leader 服务器交换信息的端口；D 表示的是万一集群中的 Leader 服务器挂了，需要一个端口来重新进行选举，选出一个新的 Leader，而这个端口就是用来执行选举时服务器相互通信的端口。如果是伪集群的配置方式，由于 B 都是一样，所以不同的 Zookeeper 实例通信端口号不能一样，所以要给它们分配不同的端口号。
除了修改 zoo.cfg 配置文件，集群模式下还要配置一个文件 myid，这个文件在 dataDir 目录下，这个文件里面就有一个数据就是 A 的值，Zookeeper 启动时会读取这个文件，拿到里面的数据与 zoo.cfg 里面的配置信息比较从而判断到底是那个 server。
数据模型
Zookeeper 会维护一个具有层次关系的数据结构，它非常类似于一个标准的文件系统，如图 1 所示：
图 1 Zookeeper 数据结构
图 1 Zookeeper 数据结构
Zookeeper 这种数据结构有如下这些特点：
每个子目录项如 NameService 都被称作为 znode，这个 znode 是被它所在的路径唯一标识，如 Server1 这个 znode 的标识为 /NameService/Server1
znode 可以有子节点目录，并且每个 znode 可以存储数据，注意 EPHEMERAL 类型的目录节点不能有子节点目录
znode 是有版本的，每个 znode 中存储的数据可以有多个版本，也就是一个访问路径中可以存储多份数据
znode 可以是临时节点，一旦创建这个 znode 的客户端与服务器失去联系，这个 znode 也将自动删除，Zookeeper 的客户端和服务器通信采用长连接方式，每个客户端和服务器通过心跳来保持连接，这个连接状态称为 session，如果 znode 是临时节点，这个 session 失效，znode 也就删除了
znode 的目录名可以自动编号，如 App1 已经存在，再创建的话，将会自动命名为 App2
znode 可以被监控，包括这个目录节点中存储的数据的修改，子节点目录的变化等，一旦变化可以通知设置监控的客户端，这个是 Zookeeper 的核心特性，Zookeeper 的很多功能都是基于这个特性实现的，后面在典型的应用场景中会有实例介绍
回页首
如何使用
Zookeeper 作为一个分布式的服务框架，主要用来解决分布式集群中应用系统的一致性问题，它能提供基于类似于文件系统的目录节点树方式的数据存储，但是 Zookeeper 并不是用来专门存储数据的，它的作用主要是用来维护和监控你存储的数据的状态变化。通过监控这些数据状态的变化，从而可以达到基于数据的集群管理，后面将会详细介绍 Zookeeper 能够解决的一些典型问题，这里先介绍一下，Zookeeper 的操作接口和简单使用示例。
常用接口列表
客户端要连接 Zookeeper 服务器可以通过创建 org.apache.zookeeper. ZooKeeper 的一个实例对象，然后调用这个类提供的接口来和服务器交互。
前面说了 ZooKeeper 主要是用来维护和监控一个目录节点树中存储的数据的状态，所有我们能够操作 ZooKeeper 的也和操作目录节点树大体一样，如创建一个目录节点，给某个目录节点设置数据，获取某个目录节点的所有子目录节点，给某个目录节点设置权限和监控这个目录节点的状态变化。
这些接口如下表所示：
表 1 org.apache.zookeeper. ZooKeeper 方法列表
方法名方法功能描述
Stringcreate(String path, byte[] data, List<ACL> acl, CreateMode createMode) 创建一个给定的目录节点 path, 并给它设置数据，CreateMode 标识有四种形式的目录节点，分别是 PERSISTENT：持久化目录节点，这个目录节点存储的数据不会丢失；PERSISTENT_SEQUENTIAL：顺序自动编号的目录节点，这种目录节点会根据当前已近存在的节点数自动加 1，然后返回给客户端已经成功创建的目录节点名；EPHEMERAL：临时目录节点，一旦创建这个节点的客户端与服务器端口也就是 session 超时，这种节点会被自动删除；EPHEMERAL_SEQUENTIAL：临时自动编号节点
Statexists(String path, boolean watch) 判断某个 path 是否存在，并设置是否监控这个目录节点，这里的 watcher 是在创建 ZooKeeper 实例时指定的 watcher，exists方法还有一个重载方法，可以指定特定的 watcher
Statexists(String path, Watcher watcher) 重载方法，这里给某个目录节点设置特定的 watcher，Watcher 在 ZooKeeper 是一个核心功能，Watcher 可以监控目录节点的数据变化以及子目录的变化，一旦这些状态发生变化，服务器就会通知所有设置在这个目录节点上的 Watcher，从而每个客户端都很快知道它所关注的目录节点的状态发生变化，而做出相应的反应
void delete(String path, int version) 删除 path 对应的目录节点，version 为 -1 可以匹配任何版本，也就删除了这个目录节点所有数据
List<String> getChildren(String path, boolean watch) 获取指定 path 下的所有子目录节点，同样 getChildren方法也有一个重载方法可以设置特定的 watcher 监控子节点的状态
StatsetData(String path, byte[] data, int version) 给 path 设置数据，可以指定这个数据的版本号，如果 version 为 -1 怎可以匹配任何版本
byte[] getData(String path, boolean watch, Stat stat) 获取这个 path 对应的目录节点存储的数据，数据的版本等信息可以通过 stat 来指定，同时还可以设置是否监控这个目录节点数据的状态
void addAuthInfo(String scheme, byte[] auth) 客户端将自己的授权信息提交给服务器，服务器将根据这个授权信息验证客户端的访问权限。
StatsetACL(String path, List<ACL> acl, int version) 给某个目录节点重新设置访问权限，需要注意的是 Zookeeper 中的目录节点权限不具有传递性，父目录节点的权限不能传递给子目录节点。目录节点 ACL 由两部分组成：perms 和 id。
Perms 有 ALL、READ、WRITE、CREATE、DELETE、ADMIN 几种
而 id 标识了访问目录节点的身份列表，默认情况下有以下两种：
ANYONE_ID_UNSAFE = new Id("world", "anyone") 和 AUTH_IDS = new Id("auth", "") 分别表示任何人都可以访问和创建者拥有访问权限。
List<ACL> getACL(String path, Stat stat) 获取某个目录节点的访问权限列表
除了以上这些上表中列出的方法之外还有一些重载方法，如都提供了一个回调类的重载方法以及可以设置特定 Watcher 的重载方法，具体的方法可以参考 org.apache.zookeeper. ZooKeeper 类的 API 说明。
基本操作
下面给出基本的操作 ZooKeeper 的示例代码，这样你就能对 ZooKeeper 有直观的认识了。下面的清单包括了创建与 ZooKeeper 服务器的连接以及最基本的数据操作：
清单 2. ZooKeeper 基本的操作示例
// 创建一个与服务器的连接
ZooKeeper zk = new ZooKeeper("localhost:" + CLIENT_PORT,
        ClientBase.CONNECTION_TIMEOUT, new Watcher() {
            // 监控所有被触发的事件
            public void process(WatchedEvent event) {
                System.out.println("已经触发了" + event.getType() + "事件！");
            }
        });
// 创建一个目录节点
zk.create("/testRootPath", "testRootData".getBytes(), Ids.OPEN_ACL_UNSAFE,
   CreateMode.PERSISTENT);
// 创建一个子目录节点
zk.create("/testRootPath/testChildPathOne", "testChildDataOne".getBytes(),
   Ids.OPEN_ACL_UNSAFE,CreateMode.PERSISTENT);
System.out.println(new String(zk.getData("/testRootPath",false,null)));
// 取出子目录节点列表
System.out.println(zk.getChildren("/testRootPath",true));
// 修改子目录节点数据
zk.setData("/testRootPath/testChildPathOne","modifyChildDataOne".getBytes(),-1);
System.out.println("目录节点状态：["+zk.exists("/testRootPath",true)+"]");
// 创建另外一个子目录节点
zk.create("/testRootPath/testChildPathTwo", "testChildDataTwo".getBytes(),
   Ids.OPEN_ACL_UNSAFE,CreateMode.PERSISTENT);
System.out.println(new String(zk.getData("/testRootPath/testChildPathTwo",true,null)));
// 删除子目录节点
zk.delete("/testRootPath/testChildPathTwo",-1);
zk.delete("/testRootPath/testChildPathOne",-1);
// 删除父目录节点
zk.delete("/testRootPath",-1);
// 关闭连接
zk.close();
输出的结果如下：
已经触发了 None 事件！
testRootData
[testChildPathOne]
目录节点状态：[5,5,1281804532336,1281804532336,0,1,0,0,12,1,6]
已经触发了 NodeChildrenChanged 事件！
testChildDataTwo
已经触发了 NodeDeleted 事件！
已经触发了 NodeDeleted 事件！
当对目录节点监控状态打开时，一旦目录节点的状态发生变化，Watcher 对象的 process 方法就会被调用。
回页首
ZooKeeper 典型的应用场景
Zookeeper 从设计模式角度来看，是一个基于观察者模式设计的分布式服务管理框架，它负责存储和管理大家都关心的数据，然后接受观察者的注册，一旦这些数据的状态发生变化，Zookeeper 就将负责通知已经在 Zookeeper 上注册的那些观察者做出相应的反应，从而实现集群中类似 Master/Slave 管理模式，关于 Zookeeper 的详细架构等内部细节可以阅读 Zookeeper 的源码
下面详细介绍这些典型的应用场景，也就是 Zookeeper 到底能帮我们解决那些问题？下面将给出答案。
统一命名服务（Name Service）
分布式应用中，通常需要有一套完整的命名规则，既能够产生唯一的名称又便于人识别和记住，通常情况下用树形的名称结构是一个理想的选择，树形的名称结构是一个有层次的目录结构，既对人友好又不会重复。说到这里你可能想到了 JNDI，没错 Zookeeper 的 Name Service 与 JNDI 能够完成的功能是差不多的，它们都是将有层次的目录结构关联到一定资源上，但是 Zookeeper 的 Name Service 更加是广泛意义上的关联，也许你并不需要将名称关联到特定资源上，你可能只需要一个不会重复名称，就像数据库中产生一个唯一的数字主键一样。
Name Service 已经是 Zookeeper 内置的功能，你只要调用 Zookeeper 的 API 就能实现。如调用 create 接口就可以很容易创建一个目录节点。
配置管理（Configuration Management）
配置的管理在分布式应用环境中很常见，例如同一个应用系统需要多台 PC Server 运行，但是它们运行的应用系统的某些配置项是相同的，如果要修改这些相同的配置项，那么就必须同时修改每台运行这个应用系统的 PC Server，这样非常麻烦而且容易出错。
像这样的配置信息完全可以交给 Zookeeper 来管理，将配置信息保存在 Zookeeper 的某个目录节点中，然后将所有需要修改的应用机器监控配置信息的状态，一旦配置信息发生变化，每台应用机器就会收到 Zookeeper 的通知，然后从 Zookeeper 获取新的配置信息应用到系统中。
图 2. 配置管理结构图
图 2. 配置管理结构图
集群管理（Group Membership）
Zookeeper 能够很容易的实现集群管理的功能，如有多台 Server 组成一个服务集群，那么必须要一个“总管”知道当前集群中每台机器的服务状态，一旦有机器不能提供服务，集群中其它集群必须知道，从而做出调整重新分配服务策略。同样当增加集群的服务能力时，就会增加一台或多台 Server，同样也必须让“总管”知道。
Zookeeper 不仅能够帮你维护当前的集群中机器的服务状态，而且能够帮你选出一个“总管”，让这个总管来管理集群，这就是 Zookeeper 的另一个功能 Leader Election。
它们的实现方式都是在 Zookeeper 上创建一个 EPHEMERAL 类型的目录节点，然后每个 Server 在它们创建目录节点的父目录节点上调用 getChildren(String path, boolean watch) 方法并设置 watch 为 true，由于是 EPHEMERAL 目录节点，当创建它的 Server 死去，这个目录节点也随之被删除，所以 Children 将会变化，这时 getChildren上的 Watch 将会被调用，所以其它 Server 就知道已经有某台 Server 死去了。新增 Server 也是同样的原理。
Zookeeper 如何实现 Leader Election，也就是选出一个 Master Server。和前面的一样每台 Server 创建一个 EPHEMERAL 目录节点，不同的是它还是一个 SEQUENTIAL 目录节点，所以它是个 EPHEMERAL_SEQUENTIAL 目录节点。之所以它是 EPHEMERAL_SEQUENTIAL 目录节点，是因为我们可以给每台 Server 编号，我们可以选择当前是最小编号的 Server 为 Master，假如这个最小编号的 Server 死去，由于是 EPHEMERAL 节点，死去的 Server 对应的节点也被删除，所以当前的节点列表中又出现一个最小编号的节点，我们就选择这个节点为当前 Master。这样就实现了动态选择 Master，避免了传统意义上单 Master 容易出现单点故障的问题。
图 3. 集群管理结构图
图 3. 集群管理结构图
这部分的示例代码如下，完整的代码请看附件：
清单 3. Leader Election 关键代码
void findLeader() throws InterruptedException {
        byte[] leader = null;
        try {
            leader = zk.getData(root + "/leader", true, null);
        } catch (Exception e) {
            logger.error(e);
        }
        if (leader != null) {
            following();
        } else {
            String newLeader = null;
            try {
                byte[] localhost = InetAddress.getLocalHost().getAddress();
                newLeader = zk.create(root + "/leader", localhost,
                ZooDefs.Ids.OPEN_ACL_UNSAFE, CreateMode.EPHEMERAL);
            } catch (Exception e) {
                logger.error(e);
            }
            if (newLeader != null) {
                leading();
            } else {
                mutex.wait();
            }
        }
    }
共享锁（Locks）
共享锁在同一个进程中很容易实现，但是在跨进程或者在不同 Server 之间就不好实现了。Zookeeper 却很容易实现这个功能，实现方式也是需要获得锁的 Server 创建一个 EPHEMERAL_SEQUENTIAL 目录节点，然后调用 getChildren方法获取当前的目录节点列表中最小的目录节点是不是就是自己创建的目录节点，如果正是自己创建的，那么它就获得了这个锁，如果不是那么它就调用 exists(String path, boolean watch) 方法并监控 Zookeeper 上目录节点列表的变化，一直到自己创建的节点是列表中最小编号的目录节点，从而获得锁，释放锁很简单，只要删除前面它自己所创建的目录节点就行了。
图 4. Zookeeper 实现 Locks 的流程图
图 4. Zookeeper 实现 Locks 的流程图
同步锁的实现代码如下，完整的代码请看附件：
清单 4. 同步锁的关键代码
void getLock() throws KeeperException, InterruptedException{
        List<String> list = zk.getChildren(root, false);
        String[] nodes = list.toArray(new String[list.size()]);
        Arrays.sort(nodes);
        if(myZnode.equals(root+"/"+nodes[0])){
            doAction();
        }
        else{
            waitForLock(nodes[0]);
        }
    }
    void waitForLock(String lower) throws InterruptedException, KeeperException {
        Stat stat = zk.exists(root + "/" + lower,true);
        if(stat != null){
            mutex.wait();
        }
        else{
            getLock();
        }
    }
队列管理
Zookeeper 可以处理两种类型的队列：
当一个队列的成员都聚齐时，这个队列才可用，否则一直等待所有成员到达，这种是同步队列。
队列按照 FIFO 方式进行入队和出队操作，例如实现生产者和消费者模型。
同步队列用 Zookeeper 实现的实现思路如下：
创建一个父目录 /synchronizing，每个成员都监控标志（Set Watch）位目录 /synchronizing/start 是否存在，然后每个成员都加入这个队列，加入队列的方式就是创建 /synchronizing/member_i 的临时目录节点，然后每个成员获取 / synchronizing 目录的所有目录节点，也就是 member_i。判断 i 的值是否已经是成员的个数，如果小于成员个数等待 /synchronizing/start 的出现，如果已经相等就创建 /synchronizing/start。
用下面的流程图更容易理解：
图 5. 同步队列流程图
图 5. 同步队列流程图
同步队列的关键代码如下，完整的代码请看附件：
清单 5. 同步队列
void addQueue() throws KeeperException, InterruptedException{
        zk.exists(root + "/start",true);
        zk.create(root + "/" + name, new byte[0], Ids.OPEN_ACL_UNSAFE,
        CreateMode.EPHEMERAL_SEQUENTIAL);
        synchronized (mutex) {
            List<String> list = zk.getChildren(root, false);
            if (list.size() < size) {
                mutex.wait();
            } else {
                zk.create(root + "/start", new byte[0], Ids.OPEN_ACL_UNSAFE,
                 CreateMode.PERSISTENT);
            }
        }
}
当队列没满是进入 wait()，然后会一直等待 Watch 的通知，Watch 的代码如下：
public void process(WatchedEvent event) {
        if(event.getPath().equals(root + "/start") &&
         event.getType() == Event.EventType.NodeCreated){
            System.out.println("得到通知");
            super.process(event);
            doAction();
        }
    }
FIFO 队列用 Zookeeper 实现思路如下：
实现的思路也非常简单，就是在特定的目录下创建 SEQUENTIAL 类型的子目录 /queue_i，这样就能保证所有成员加入队列时都是有编号的，出队列时通过 getChildren( ) 方法可以返回当前所有的队列中的元素，然后消费其中最小的一个，这样就能保证 FIFO。
下面是生产者和消费者这种队列形式的示例代码，完整的代码请看附件：
清单 6. 生产者代码
boolean produce(int i) throws KeeperException, InterruptedException{
        ByteBuffer b = ByteBuffer.allocate(4);
        byte[] value;
        b.putInt(i);
        value = b.array();
        zk.create(root + "/element", value, ZooDefs.Ids.OPEN_ACL_UNSAFE,
                    CreateMode.PERSISTENT_SEQUENTIAL);
        return true;
    }
清单 7. 消费者代码
int consume() throws KeeperException, InterruptedException{
        int retvalue = -1;
        Stat stat = null;
        while (true) {
            synchronized (mutex) {
                List<String> list = zk.getChildren(root, true);
                if (list.size() == 0) {
                    mutex.wait();
                } else {
                    Integer min = new Integer(list.get(0).substring(7));
                    for(String s : list){
                        Integer tempValue = new Integer(s.substring(7));
                        if(tempValue < min) min = tempValue;
                    }
                    byte[] b = zk.getData(root + "/element" + min,false, stat);
                    zk.delete(root + "/element" + min, 0);
                    ByteBuffer buffer = ByteBuffer.wrap(b);
                    retvalue = buffer.getInt();
                    return retvalue;
                }
            }
        }
}
回页首
总结
Zookeeper 作为 Hadoop 项目中的一个子项目，是 Hadoop 集群管理的一个必不可少的模块，它主要用来控制集群中的数据，如它管理 Hadoop 集群中的 NameNode，还有 Hbase 中 Master Election、Server 之间状态同步等。
本文介绍的 Zookeeper 的基本知识，以及介绍了几个典型的应用场景。这些都是 Zookeeper 的基本功能，最重要的是 Zoopkeeper 提供了一套很好的分布式集群管理的机制，就是它这种基于层次型的目录树的数据结构，并对树中的节点进行有效管理，从而可以设计出多种多样的分布式的数据管理模型，而不仅仅局限于上面提到的几个常用应用场景。

你可能感兴趣的:(zookeeper)

Zookeeper配置详解 Winyar Wen 大数据 Zookeeper配置详解
Zookeeper配置详解参数名说明clientPort客户端连接server的端口，即对外服务端口，一般设置为2181。dataDir存储快照文件snapshot的目录。默认情况下，事务日志也会存储在这里。follower和Leader服务节点都会有自己的事务日志。ZooKeeper会在特定条件下会触发一次快照（snapshot），将当前服务节点的状态以快照文件的形式dump到磁盘上去，即sna
Zookeeper特性详解及实战月球程序猿 zookeeper java zookeeper
Zookeeper特性与节点数据类型详解Zookeeper经典应用场景实战一Zookeeper经典应用场景实战二
Zookeeper 配置参数详解玉梅小洋 Linux 操作系统技能树分布式存储 #Linux 操作系统：文件系统 zookeeper 分布式云原生
主要是%ZOOKEEPER_HOME%/conf/zoo.cfg文件里面的配置项参数名说明clientPort客户端连接server的端口，即对外服务端口，一般设置为2181吧。dataDir存储快照文件snapshot的目录。默认情况下，事务日志也会存储在这里。建议同时配置参数dataLogDir,事务日志的写性能直接影响zk性能。tickTimeZK中的一个时间单元。ZK中所有时间都是以这个时
HBase学习笔记等等等等等再等大数据 linux hadoop hbase
HBase简介Hbase(HadoopDatabase)，是一个高可靠性、高性能、面向列、可伸缩、实时读写的分布式数据库；利用HadoopHDFS作为其文件存储系统,利用HadoopMapReduce来处理HBase中的海量数据,利用Zookeeper作为其分布式协同服务；主要用来存储非结构化和半结构化的松散数据（列存NoSQL数据库）。HBase数据模型ROWKEY决定一行数据；按照字典顺序排序
Dubbo（47）如何排查Dubbo的注册中心问题？辞暮尔尔-烟火年年微服务 dubbo debian 运维
排查Dubbo的注册中心问题需要从多个角度进行分析，包括注册中心的配置、连接状态、注册和订阅的情况等。以下是详细的排查步骤及相关代码示例：1.检查注册中心配置确保服务提供者和消费者的注册中心配置正确，包括地址、协议和其他必要的参数。服务提供者配置（application.yml）：dubbo:registry:address:zookeeper://127.0.0.1:2181#确保地址正确pro
Kafka基础知识爱编程的王小美 kafka 分布式
Kafka基础知识一、Kafka简介1.1什么是Kafka？Kafka是一个分布式的流处理平台，具有以下特点：高吞吐量可持久化分布式可扩展高可靠性1.2基本概念Topic：消息主题，消息以主题为单位进行归类Partition：分区，一个主题可以有多个分区Broker：消息中间件服务器Producer：消息生产者Consumer：消息消费者ConsumerGroup：消费者组Zookeeper：用于
Kafka原理详细介绍 _Romeo kafka kafka
Kafka Kafka是最初由Linkedin公司开发，是一个分布式、支持分区的（partition）、多副本的（replica），基于zookeeper协调的分布式消息系统，它的最大的特性就是可以实时的处理大量数据以满足各种需求场景：比如基于hadoop的批处理系统、低延迟的实时系统、storm/Spark流式处理引擎，web/nginx日志、访问日志，消息服务等等，用scala语言编写，Li
ZooKeeper集群部署(容器) 神奇的海马体 #1-Docker容器 #ZooKeeper zookeeper 分布式云原生
文章目录一、ZooKeeper基本概念二、ZooKeeper集群部署1、前置环境准备2、ZooKeeper伪集群部署(可选)3、ZooKeeper集群部署(可选)三、ZooKeeper集群验证1、查看集群角色2、数据同步测试3、选举leader测试一、ZooKeeper基本概念ZooKeeper是一个分布式且开源的分布式应用程序的协调服务(管理分布式服务)ZooKeeper提供的主要功能包括：配置
【Kafka基础】topics命令行操作大全：高级命令解析（2） IT成长日记 Kafka探索之旅 kafka topics 高级命令行操作
1强制删除主题/export/home/kafka_zk/kafka_2.13-2.7.1/bin/kafka-topics.sh--delete\--zookeeper192.168.10.33:2181\--topicmytopic\--if-exists参数说明：--zookeeper：直接连接Zookeeper删除（旧版本方式）--if-exists：仅当主题存在时执行2查看主题的消息时间
架构及大数据-Zookeeper与Kafka的关系及使用依赖，二者需要同时使用吗？KRaft模式又是啥？碧海饮冰分布式和技术框架们大数据技术架构大数据 zookeeper
Zookeeper与Kafka的关系及使用依赖‌一、Zookeeper在Kafka中的核心作用‌Zookeeper是Kafka早期版本（2.8.0之前）中不可或缺的分布式协调服务，主要承担以下关键功能：‌元数据管理‌存储Broker注册信息（如节点地址、存活状态）及主题/分区的元数据（如副本分布、分区分配规则）‌。维护消费者组偏移量（旧版本）及访问控制列表（ACL）‌。‌集群协调‌‌控制器选举‌：
Zookeeper-curator 姜希成 Zookeeper zookeeper
工厂类创建客户端：CuratorFrameworkFactoryconnectionString：服务器地址列表；逗号分隔retryPolicy：重试策略可以通过判断服务器返回的keeperException的状态代码来判断是否进行重试处理OK表示一切操作都没有问题SYSTEMERROR表示系统或服务端错误ExponentialBackoffRetry重试一组次数，重试之间的睡眠时间增加Retry
一图全解Kafka在zookeeper中的数据结构石臻臻的杂货铺 Kafka kafka zookeeper 数据结构
该文章可能已过期,已不做勘误并更新,请访问原文地址(持续更新)Kafka中分区副本的分配规则kafka知识图谱：Kafka知识图谱大全kafka管控平台推荐使用滴滴开源的Kafka运维管控平台(戳我呀)更符合国人的操作习惯、更强大的管控能力、更高效的问题定位能力、更便捷的集群运维能力、更专业的资源治理、
分布式锁的设计昨天与今天架构师实战之数据访问层分布式锁
实现方案一、mysql实现二、redis三、zookeeper以下主要说一下redis的实现方式。需要实现的功能1、只有一个线程能获取到锁，获取不到锁的线程可以自旋一定的时间，如果仍获取不到，则返回获取不到锁。2、为了防止业务挂了，导致锁没有释放，需要给锁加上过期时间。3、只能解锁自己加的锁，可以通过加锁时传入请求标识实现4、实现锁的可重入问题1、如何保证加锁和设置超时时间的原子性？（1）使用lu
配置服务开机自启动【zookeeper例子-chatgpt辅助编写】北漂老男孩开发干运维 linux
配置Zookeeper自动启动步骤：创建Systemd服务单元文件：使用root或具有sudo权限的用户，创建一个新的Systemd服务单元文件用于管理Zookeeper的启动和停止。sudonano/etc/systemd/system/zookeeper.service编辑服务单元文件：将以下内容粘贴到zookeeper.service文件中。确保替换为你的Zookeeper安装路径。[Uni
Zookeeper运维指南：服务端与客户端常用命令详解磐基Stack专业服务团队 Zookeeper 运维 zookeeper
#作者：任少近文章目录1Zookeeper服务端常用命令2Zookeeper客户端常用命令2.1Ls命令2.2创建节点create2.3Get命令2.4删除命令2.5修改命令1Zookeeper服务端常用命令启动ZK服务:bin/zkServer.shstart#./zkServer.shstartZooKeeperJMXenabledbydefaultUsingconfig:/usr/zooke
聊聊流言协议（Gossip）后端程序员
什么是流言协议？在分布式系统中，以下两个是典型的问题：维护系统状态（节点的活跃性）节点间的通信解决这些问题的解决方案之一如下：集中式状态管理服务对等状态管理服务集中式状态管理服务像ApacheZookeeper这样的集中式状态管理服务可以被配置为服务发现，以跟踪系统中每个节点的状态。尽管这种方法提供了强大的一致性保证，但主要缺点是状态管理服务成为单点故障，并且对于大型分布式系统也会遇到可扩展性问题
海量并发场景下注册中心选型深度解析：从架构原理到实战优化一碗黄焖鸡三碗米饭 Spring Cloud 深度解析与实践架构微服务注册中心 Nacos Zookeeper
目录海量并发场景下注册中心选型深度解析：从架构原理到实战优化1.注册中心的基本概念与作用什么是注册中心？注册中心的工作流程注册中心在分布式系统中的作用2.海量并发场景的挑战高并发的基本定义高并发对注册中心带来的挑战注册中心的性能瓶颈分析3.常见注册中心架构原理ZookeeperEurekaConsulNacos4.注册中心的高并发优化策略负载均衡与路由策略数据持久化策略服务健康检查优化集群和容灾设
分布式锁选型 Redis vs Zookeeper T.Y.Bao 分布式 redis zookeeper
分布式锁作为分布式环境下并发控制利器，使用场景广泛。分布式锁通常可利用中间件Redis或Zookeeper来实现，例如针对Java语言Redis有Redisson组件，Zk有Curator组件。Redis是一款内存数据库，通常可用来做缓存，由于其执行命令使用单线程，也可以用来实现分布式锁，在集群模式下，Redis提供主从复制和哨兵机制实现高可用性；Zookeeper是一款分布式协调中间件，集群模式
Kafka系列教程 - Kafka 运维 -8 长河 Kafka kafka 运维分布式
1.Kafka单点部署1.1.下载解压进入官方下载地址：http://kafka.apache.org/downloads，选择合适版本。(opensnewwindow)解压到本地：$tar-xzfkafka_2.13-3.9.0.tgz$cdkafka_2.13-3.9.0现在您已经在您的机器上下载了最新版本的Kafka。1.2.启动服务器以KRaft启动，不要需要zookeeper生成集群UU
java面试题解析 java梅洛经验分享 java 面试程序人生开发语言
本文分为十九个模块，分别是：Java基础、容器、多线程、反射、对象拷贝、JavaWeb、异常、网络、设计模式、Spring/SpringMVC、SpringBoot/SpringCloud、Hibernate、MyBatis、RabbitMQ、Kafka、Zookeeper、MySQL、Redis、JVM如下图所示：共包含208道面试题，本文的宗旨是为读者朋友们整理一份详实而又权威的面试清单，下面
SpringBoot整合Dubbo实现远程服务调用「已注销」 spring boot dubbo 后端
参考：Dubbo两小时快速上手教程（直接代码、Spring、SpringBoot）-阿里云开发者社区(aliyun.com)spring整合dubbo实现跨服务调用_dubbo跨服务调用-CSDN博客目录1.公共接口项目2.使用Zookeeper作为注册中心3.服务提供方3.1引入依赖3.2写入配置3.3编写接口实现类4.服务调用方4.1引入依赖4.2写入配置4.3编写调用类5.将项目跑起来背景：
关于SpringBoot集成Kafka 糖拌西红柿多放醋 SpringBoot专题 Java spring boot kafka java
关于KafkaApacheKafka是一个分布式流处理平台，广泛用于构建实时数据管道和流应用。它能够处理大量的数据流，具有高吞吐量、可持久化存储、容错性和扩展性等特性。Kafka一般用作实时数据流处理、消息队列、事件架构驱动等Kafka的整体架构ZooKeeper:位于架构的顶部，负责管理和协调Kafka集群的各种元数据，包括集群配置、主题信息、分区领导者的选举等。Producers(生产者):K
PostgreSQL 高可用方案 patroni + etcd + pg部署 Omega29 数据库 pgsql postgresql etcd
1.概述该文档主要记录PG的高可用方案patroni+etcd+pg的环境部署实施。2.方案简介2.2Patroni简介Patroni基于Python开发的模板，结合DCS(例如ZooKeeper,etcd,Consul)可以定制PostgreSQL高可用方案。Patroni并不是一套拿来即用的PostgreSQL高可用组件，涉及较多的配置和定制工作。Patroni接管PostgreSQL数据库的
Kafka架构揭秘：理解Producer、Consumer、Broker和Zookeeper的工作原理一碗黄焖鸡三碗米饭 Kafka全景解析 kafka 架构中间件 java
目录Kafka架构揭秘：理解Producer、Consumer、Broker和Zookeeper的工作原理引言1.Kafka的基本架构Kafka的基本工作流程2.Producer（生产者）的工作原理2.1Producer的核心组件2.2生产者发送消息的流程2.3代码示例3.Consumer（消费者）的工作原理3.1Consumer的核心组件3.2消费者消费消息的流程3.3代码示例4.Broker（
实现一个分布式锁需要考虑哪些问题提前退休了-程序员阿飞分布式
分布式锁是控制分布式系统之间同步访问共享资源的一种方式。在实现分布式锁时，需要考虑以下几个关键问题：1.互斥性这是分布式锁最基本的要求，要确保在同一时刻只有一个客户端能够持有锁。无论使用何种技术（如Redis、ZooKeeper等）来实现分布式锁，都需要保证这一点。例如，在使用Redis实现分布式锁时，可借助SETNX（SETifNoteXists）命令，只有当键不存在时才能设置成功，从而保证互斥
centos 配置 rabbitmq环境(zookeeper单机环境配置) hongdu_dudua1 java java zookeeper rabbitmq erlang centos
在安装环境之前，相信已经了解了为什么要使用中间件？以及使用中间件的好处？主要优势：1：系统解耦2：异步调用3：容纳流量中间件的主要用来：存储消息和转发消息的，这个消息可以定义为通信载体--》通信载体可以定义为任何的请求报文和响应报文。rabbitmq使用erlang语言开发，所以无论在哪个系统上面，想要使用rabbitmq中间件，必须先安装依赖erlang。安装过很多次erlang和mq，但是最后
缓存 vs 分布式锁：高并发场景下的并发控制之道 nbsaas-boot 缓存分布式
在分布式系统中，缓存和分布式锁都是用于解决高并发场景下的并发控制和资源竞争问题，但它们的适用场景和机制不同，选择哪种方案取决于业务需求。以下是两者的区别：✅一、分布式锁⚙️工作原理核心思想：确保同一时刻只有一个线程或服务实例能够获取到锁，从而实现串行化处理。实现方式：Redis分布式锁（如Redisson）Zookeeper分布式锁数据库表（基于行级锁或唯一索引）️适用场景需要严格保证资源的独占性
深入解析：Storm配置项详解喵手零基础学Java storm 大数据
全文目录：开篇语前言摘要概述Storm配置项详解1.集群配置项1.1`storm.zookeeper.servers`1.2`storm.zookeeper.port`1.3`nimbus.seeds`1.4`supervisor.slots.ports`1.5`storm.local.dir`1.6`worker.childopts`2.拓扑配置项2.1`topology.name`2.2`to
实现分布式锁的方案与实战应用案例小韩学长yyds 分布式锁 java 分布式锁 redis zookeeper
目录分布式锁：概念与需求剖析实现方案大揭秘基于数据库的方案基于表的实现基于排他锁的实现基于Redis的方案基本命令实现Redisson框架实现基于Zookeeper的方案原理介绍Curator框架实现方案优缺点大比拼性能维度可靠性维度实现复杂度维度成本维度实战应用案例深度剖析电商秒杀系统中的应用分布式任务调度中的应用选型指南与未来展望分布式锁：概念与需求剖析在当今数字化时代，分布式系统已成为构建大
CentOS 上 Apache Kafka 2.13-3.8.1 集群部署指南（ZooKeeper 模式） CXH728 linq c#
1、安装前准备在开始部署Kafka集群之前，需要进行一些准备工作：操作系统和主机规划：准备至少3台CentOS服务器（可以是虚拟机或实体机），用于部署3个Kafkabroker节点和3个ZooKeeper实例。这样可以形成一个具有高可用性的生产级基本集群（典型架构一般使用3个ZooKeeper节点，必要时可扩展到5个。确保这些服务器网络互通，并为它们配置合适的主机名或IP地址（以下文档中假定主机名
java线程Thread和Runnable区别和联系 zx_code java jvm thread 多线程 Runnable
我们都晓得java实现线程2种方式，一个是继承Thread，另一个是实现Runnable。模拟窗口买票，第一例子继承thread，代码如下 package thread; public class ThreadTest { public static void main(String[] args) { Thread1 t1 = new Thread1(
【转】JSON与XML的区别比较丁_新 json xml
1.定义介绍 (1).XML定义扩展标记语言 (Extensible Markup Language, XML) ，用于标记电子文件使其具有结构性的标记语言，可以用来标记数据、定义数据类型，是一种允许用户对自己的标记语言进行定义的源语言。 XML使用DTD(document type definition)文档类型定义来组织数据;格式统一，跨平台和语言，早已成为业界公认的标准。 XML是标
c++ 实现五种基础的排序算法 CrazyMizzz C++c 算法
#include<iostream> using namespace std; //辅助函数，交换两数之值 template<class T> void mySwap(T &x, T &y){ T temp = x; x = y; y = temp; } const int size = 10; //一、用直接插入排
我的软件麦田的设计者我的软件音乐类娱乐放松
这是我写的一款app软件，耗时三个月，是一个根据央视节目开门大吉改变的，提供音调，猜歌曲名。1、手机拥有者在android手机市场下载本APP，同意权限，安装到手机上。2、游客初次进入时会有引导页面提醒用户注册。（同时软件自动播放背景音乐）。3、用户登录到主页后，会有五个模块。a、点击不胫而走，用户得到开门大吉首页部分新闻，点击进入有新闻详情。b、
linux awk命令详解被触发 linux awk
awk是行处理器: 相比较屏幕处理的优点，在处理庞大文件时不会出现内存溢出或是处理缓慢的问题，通常用来格式化文本信息 awk处理过程: 依次对每一行进行处理，然后输出 awk命令形式: awk [-F|-f|-v] ‘BEGIN{} //{command1; command2} END{}’ file [-F|-f|-v]大参数，-F指定分隔符，-f调用脚本，-v定义变量 var=val
各种语言比较 _wy_ 编程语言
Java Ruby PHP 擅长领域
oracle 中数据类型为clob的编辑知了ing oracle clob
public void updateKpiStatus(String kpiStatus,String taskId){ Connection dbc=null; Statement stmt=null; PreparedStatement ps=null; try { dbc = new DBConn().getNewConnection(); //stmt = db