卖萌の哈士奇

kafka源码解析——kafka生产者模块

kafka消息队列主要由生产者（producer）、消费者(consumer)以及消息代理(broker)构成，生产者会源源不断地将消息写入消息代理，然后消费者从消息代理中拉取消息并消费。从功能划分上来看，生产者和消费者都属于客户端(client)，消息代理属于服务端(server)。本文主要涉及kafka的生产者模块，从功能和底层原理两个方面对kafka生产的部分进行分析。

1.kakfa生产者的主要流程

首先看一下kafka生产者模块工作的主要流程，下面是流程图：

1.应用程序产生消息，调用kafkaproducer的send方法提交message；

2.为message选择一个分区，并将消息序列化；

3.将待发送的message收集到消息收集器RecordAccumulator中，RecordAccumulator中的记录按消息的分区进行划分，不同分区的消息插入不同的队列；

4.发送线程sender定期轮询，从消息收集器中捞出已经准备好的代理节点，并和代理节点建立连接；

5.发送线程sender从消息收集器中捞出发送往建立连接的代理节点的分区批记录，并将这些分区批记录按目标节点划分，发送往同一个代理节点的批记录发送同一个list中，最后构建ClientRequest请求将list中的批记录发送到对应的代理节点上。

下面我们将每一步展开来看里面具体实现的细节。

2.消息发送

应用程序在生产消息，并调用kafkaProducer的send方法时，需要先将消息封装成ProducerRecord，然后再将ProducerRecord传入send方法中。我们首先来看一下ProducerRecord中有些什么：

public class ProducerRecord {

    private final String topic;
    private final Integer partition;
    private final Headers headers;
    private final K key;
    private final V value;
    private final Long timestamp;
   省略……
    }

ProducerRecrod中的主要参数字段如上面的代码所示，topic字段表示该消息需要发送到哪个主题，partition表示消息需要发送的主题的分区，从理论上来说就可以确定消息需要发送的唯一节点了。

这里简单介绍以下分区的概念，分区是对主题的一种划分，用户可以对每个主题指定1至多个分区，生产者产生的消息会被发送到唯一的一个分区中，而消费组可以订阅主题，对每个消费组而言，这个消费组都会消费这个主题的所有分区，但每个分区只会被消费组中的唯一一个消费者消费。

在上图中有两个消费者往主题Topic发送消息，Topic一共有4个分区，分布在两个节点上，有一个消费分组订阅了该主题，消费分组中共有三个消费者。消费者生产的消息会均衡的分布到Topic的四个分区上，每个分区上的消息都不会重复，同时消费分组会消费来自Topic中的所有分区的消息，当对某个分区而言，它只会被消费组中的一个消费者线程消费，例如上图中，P1和P4被分配给Consumer1，P2被分配给Consumer2，P3被分配给Consumer3，他们会一直以这种分配形式进行消费直到触发Rebalance操作。

消息是没有key这个概念的，这里的key主要是用来做均衡字段的，如果没有指定key和partition字段，kafka会采用round-robin方式来将消息均衡的发送到不同的分区；而如果用户指定了partition的值，则就发送到该partition对应的分区主节点；如果用户没有指定partition而指定了key字段，则对key进行散列化，然后将散列化的值与分区的数量进行取模运算，取模运算的结果就是消息需要发往的分区号。

private int partition(ProducerRecord record, byte[] serializedKey, byte[] serializedValue, Cluster cluster) {
        Integer partition = record.partition();
        return partition != null ?
                partition :
                partitioner.partition(
                        record.topic(), record.key(), serializedKey, record.value(), serializedValue, cluster);
    }

上面的代码是用于计算消息需要发送的分区号的，我们可以看出，如果用户指定了partition就直接用这个指定的分区号，如果没有指定，则会调用partitioner.partition方法计算分区号，我们来看一下这个分区算法的细节：

public int partition(String topic, Object key, byte[] keyBytes, Object value, byte[] valueBytes, Cluster cluster) {
	//获取指定主题的所有分区
        List partitions = cluster.partitionsForTopic(topic);
        int numPartitions = partitions.size();
        if (keyBytes == null) {
	//如果没有指定key，则调用nextValue方法获取topic的下一个自增数，并通过这个自增数同分区总数取余得到对应的分区号
            int nextValue = nextValue(topic);
            List availablePartitions = cluster.availablePartitionsForTopic(topic);
            if (availablePartitions.size() > 0) {
                int part = Utils.toPositive(nextValue) % availablePartitions.size();
                return availablePartitions.get(part).partition();
            } else {
                // no partitions are available, give a non-available partition
                return Utils.toPositive(nextValue) % numPartitions;
            }
        } else {
            // 如果指定了key则通过key的散列化值与分区总数取余计算得到分区号
            return Utils.toPositive(Utils.murmur2(keyBytes)) % numPartitions;
        }
    }

上面的PartitionInfo对象表示一个分区的分布信息，PartitionInfo的主要成员变量如下：

public class PartitionInfo {

    private final String topic; //主题名称
    private final int partition;//分区编号
    private final Node leader;//分区的主副本节点
    private final Node[] replicas;//分区的所有副本节点
    private final Node[] inSyncReplicas;
    private final Node[] offlineReplicas;
   以下省略……
  }

PartitionInfo中包含了主题名称、分区编号、分区主副本节点等重要信息，有了这些重要信息kafkaProducer就可以确定消息需要被发送到哪个主题的哪个分区节点了。

在知道消息发往的分区节点之后，send方法进行了如下的操作：

serializedKey = keySerializer.serialize(record.topic(), record.headers(), record.key());
serializedValue = valueSerializer.serialize(record.topic(), record.headers(), record.value());
tp = new TopicPartition(record.topic(), partition);
RecordAccumulator.RecordAppendResult result = accumulator.append(tp, timestamp, serializedKey, serializedValue, headers, interceptCallback, remainingWaitMs);
if (result.batchIsFull || result.newBatchCreated) {
   this.sender.wakeup();
}
return result.future;

从代码中我们可以看出，send方法将key和value序列化之后将消息添加到RecordAccumulator中，然后判断RecordAccumulator的状态，如果已经装满了，则唤醒sender线程。也就是说，在kafkaProducer.send方法中，其实是没有真正发送的，只是将消息添加到RecordAccumulator，然后等待sender线程来执行这个发送。

3.消息收集器

在上一节中我们提到kafkaProducer只是将消息缓存到RecordAccumulator中，然后判断批记录是否已经存满了来触发发送线程Sender执行发送操作。

生产者在发送消息时会按照上一节中分配到的分区添加到队列中，添加消息时首先根据入参的分区获取分区所属的队列，然后从队列中取出最后一个批记录（上图中的recordBatch，黄色表示已经填充的部分），如果队列中没有批记录或者取出来的批记录已经存满了，则创建一个新的recordBatch添加到队列中，并加入队尾。

将消息添加到RecordAccumulator中的主要代码如下：

//根据主题分区信息获取队列
Deque dq = getOrCreateDeque(tp);
synchronized (dq) {
	//尝试将消息添加到队列中
    RecordAppendResult appendResult = tryAppend(timestamp, key, value, headers, callback, dq);
    if (appendResult != null)
        return appendResult;
}
//添加失败，创建新的批记录
buffer = free.allocate(size, maxTimeToBlock); 
MemoryRecordsBuilder recordsBuilder = recordsBuilder(buffer, maxUsableMagic);
ProducerBatch batch = new ProducerBatch(tp, recordsBuilder, time.milliseconds());
FutureRecordMetadata future = Utils.notNull(batch.tryAppend(timestamp, key, value, headers, callback, time.milliseconds()));

dq.addLast(batch);
incomplete.add(batch);

在添加消息时，第一步是取出分区对应的队列，然后尝试先队列中的最后一个批记录中添加消息，如果添加失败，tryAppend方法会返回null，表明队列为空或者队列中最后一个批记录已经存满，无法容纳这条消息。然后给buffer分配空间，创建新的批记录对象，并将这条消息添加到新的批记录中，最后将这个批记录对象添加到dq的尾部。如果在成功往旧的批记录对象添加消息成功后，会返回

return new RecordAppendResult(future, deque.size() > 1 || last.isFull(), false);

public RecordAppendResult(FutureRecordMetadata future, boolean batchIsFull, boolean newBatchCreated) {
            this.future = future;
            this.batchIsFull = batchIsFull;
            this.newBatchCreated = newBatchCreated;
        }

RecordAppendResult的第二个参数表示表示该队列是否装满，我们可以看出，当队列中的对象数大于1或者队尾批记录装满时，这个参数为true，在kafkaProducer的send方法中:

if (result.batchIsFull || result.newBatchCreated) {
    this.sender.wakeup();
}

如果RecordAppendResult返回批记录已满，则会唤醒发送线程Sender，通过这个线程来完成消息的发送。

4.发送线程Sender

由于在往RecordAccumulator添加消息的时候已经按照分区来进行分组，因此，在发送线程发送消息时，属于同一个分区队列的消息是一起发的。每个分区都对应一个代理节点，但是如果分区数多的情况下，多个分区可能会对应同一个代理节点，如果一个一个发送的话，会引起较大的网络开销，kafka在这里也进行了优化，它在发送前会先将代理节点相同的分区的批记录集合起来，一次性发送出去，这样就可以节省大量的网络开销资源。发送情况如图所示：

图中生产者的消息被均衡的分布到4个分区中，而P1和P3的主副本节点是代理节点1，P2和P4的主副本节点是代理节点2，因此，sender线程中将属于同一个代理节点的批记录聚合起来发送，原本需要发送四次网络请求，现在只需要发送两次请求即可。

下面我们来看一下sender线程中发送消息的具体实现：

//获取集群的信息，包括了代理节点、主副本节点等关键信息
Cluster cluster = metadata.fetch();
//获取准备发送的分区（存在主副本节点）
RecordAccumulator.ReadyCheckResult result = this.accumulator.ready(cluster, now);
//对那些没有找到主副本节点的分区，发起主题分区元数据请求
if (!result.unknownLeaderTopics.isEmpty()) {
    for (String topic : result.unknownLeaderTopics)
        this.metadata.add(topic);
    this.metadata.requestUpdate();
}
//建立到主副本节点的连接，如果还没有准备好，则移除这个节点
Iterator iter = result.readyNodes.iterator();
while (iter.hasNext()) {
    Node node = iter.next();
    if (!this.client.ready(node, now)) {
        iter.remove();
        notReadyTimeout = Math.min(notReadyTimeout, this.client.connectionDelay(node, now));
    }
}
//读取记录收集器，返回的是每个主副本节点和与之对应的批记录列表
Map> batches = this.accumulator.drain(cluster, result.readyNodes,
                this.maxRequestSize, now);

sendProduceRequests(batches, now);

private void sendProduceRequests(Map> collated, long now) {
//以代理节点为级别进行发送
        for (Map.Entry> entry : collated.entrySet())
            sendProduceRequest(now, entry.getKey(), acks, requestTimeout, entry.getValue());
    }
//对每个节点构建ClientRequest请求，并将请求放队列中等待发送
private void sendProduceRequest(long now, int destination, short acks, int timeout, List batches) {
        Map produceRecordsByPartition = new HashMap<>(batches.size());
        final Map recordsByPartition = new HashMap<>(batches.size());

        for (ProducerBatch batch : batches) {
            TopicPartition tp = batch.topicPartition;
            MemoryRecords records = batch.records();

            if (!records.hasMatchingMagic(minUsedMagic))
                records = batch.records().downConvert(minUsedMagic, 0, time).records();
            produceRecordsByPartition.put(tp, records);
            recordsByPartition.put(tp, batch);
        }
//构建请求必须的参数
        ProduceRequest.Builder requestBuilder = ProduceRequest.Builder.forMagic(minUsedMagic, acks, timeout,
                produceRecordsByPartition, transactionalId);
//构建回调处理函数
        RequestCompletionHandler callback = new RequestCompletionHandler() {
            public void onComplete(ClientResponse response) {
                handleProduceResponse(response, recordsByPartition, time.milliseconds());
            }
        };

        String nodeId = Integer.toString(destination);
//构建ClientRequest请求
        ClientRequest clientRequest = client.newClientRequest(nodeId, requestBuilder, now, acks != 0, callback);
//加入待发送队列
        client.send(clientRequest, now);
        log.trace("Sent produce request to {}: {}", nodeId, requestBuilder);
    }

这里总结一下发送线程Sender做的一些工作：

迭代消息收集器中的每个分区，找出那些存在主副本节点的分区
对那些没有找到主副本节点的分区，发送获取元数据请求（下一轮执行中才能得到）
尝试对每个主副本节点建立连接，移除那些没有做好准备的主副本节点
将消息收集器中的批记录，以主副本节点为维度进行分组，得到Map>这样的数据结构，key是主副本节点的id，value是需要发送到该代理节点的批记录列表
迭代上述数据结构的key，对每个主副本节点构建ClientRequest请求，并将请求加入带发送队列中，最后调用客户端网络对象将请求发送出去

5.客户端网络对象

在上一节发送线程Sender中，并没有真正的将消息发送出去，没错，它还是没有真正的发送出去，只是将消息构建ClientRequest请求加入到队列中，然后交给客户端网络线程处理。在Sender的run方法中用到了客户端网络对象的三个方法，分别是ready（）、send（）和poll（）方法。

下面是sender中用到上述三个方法的地方：

//遍历从收集器中拿到的已经准备好的节点，并尝试连接，将那些连接失败的节点移除
Iterator iter = result.readyNodes.iterator();
    while (iter.hasNext()) {
        Node node = iter.next();
        if (!this.client.ready(node, now)) {
            iter.remove();
        }
    }
//为每个代理节点构建一个ClientRequest请求，并通过客户端网路对象的send方法将ClientRequest请求存到发送队列中
String nodeId = Integer.toString(destination);
ClientRequest clientRequest = client.newClientRequest(nodeId, requestBuilder, now, acks != 0, callback);
client.send(clientRequest, now);
//调用client的poll方法间接地调用选择器将请求发送给节点
client.poll(pollTimeout, now);

下面我们来仔细看一下这三个部分

5.1建立连接

建立连接的过程主要在客户端网络对象的ready方法中完成，他对消息收集器中已经准备好的节点尝试建立连接，并将失败的节点移除出去，在后面的发送流程中就不会对该节点进行发送。ready方法的代码如下：

public boolean ready(Node node, long now) {
	//已经连接成功返回true
	if (isReady(node, now))
		return true;
	//允许连接但是还没有连接上，则初始化连接
	if (connectionStates.canConnect(node.idString(), now))
		initiateConnect(node, now);
	//不允许连接
	return false;
}
//当metaData不需要更新且当前节点可以发送请求表示连接已经准备好
public boolean isReady(Node node, long now) {  
	return !metadataUpdater.isUpdateDue(now) && canSendRequest(node.idString());
}
//当节点连接状态已经准备好，节点对应的连接器通道准备好且节点有数据要发送时表示当前节点可以发送请求
private boolean canSendRequest(String node) {
	return connectionStates.isReady(node) && selector.isChannelReady(node) && inFlightRequests.canSendMore(node);
}
//初始化连接
private void initiateConnect(Node node, long now) {
	String nodeConnectionId = node.idString();
	//更新节点连接状态为连接中
	this.connectionStates.connecting(nodeConnectionId, now);
	//选择器连接到代理节点
	selector.connect(nodeConnectionId,
					 new InetSocketAddress(node.host(), node.port()),
					 this.socketSendBuffer,
					 this.socketReceiveBuffer);
}

5.2 暂存请求

这个部分是由客户端对象的send方法完成的，这个方法比较简单，就是将客户端请求加入到inFlightRequests列表中，然后调用选择器的send将待发送的请求设置到对应的通道中去，具体的代码实现如下：

public void send(ClientRequest request){
//用于缓存还没有收到响应的客户端请求
	this.inFlightRequests.add(inFlightRequest);
    selector.send(inFlightRequest.send);
}

public void send(Send send) {
	String connectionId = send.destination();
	KafkaChannel channel = openOrClosingChannelOrFail(connectionId);
	if (closingChannels.containsKey(connectionId)) {
		this.failedSends.add(connectionId);
	} else {
	//将请求设置到通道中
		channel.setSend(send);
	}
}

5.3客户端轮询

最后一步是通过调用客户端网络对象的poll方法来间接地调用选择器的poll方法将请求发送出去，并且在发送请求之后通过多个处理方法来对发送请求和接受到的响应等进行处理。poll方法的主要代码如下：

public List poll(long timeout, long now) {
	long metadataTimeout = metadataUpdater.maybeUpdate(now);
	//轮询选择器的key，将请求发送出去
	this.selector.poll(Utils.min(timeout, metadataTimeout, requestTimeoutMs));
	long updatedNow = this.time.milliseconds();
	List responses = new ArrayList<>();
	//对发送进行处理，将需要响应的请求添加到responses中
	handleCompletedSends(responses, updatedNow);
	//对响应进行处理，根据接收到的响应更新相应列表
	handleCompletedReceives(responses, updatedNow);
	//选择器中断开的连接进行响应的断开处理
	handleDisconnections(responses, updatedNow);
	//对选择器中处于连接状态的节点进行连接处理
	handleConnections();
	//对需要获取ApiVersion信息的节点发送响应的请求
	handleInitiateApiVersionRequests(updatedNow);
	//对超时请求进行相应处理
	handleTimedOutRequests(responses, updatedNow);
	//响应回调处理
	for (ClientResponse response : responses) {
		response.onComplete();
	}
	return responses;
    }

客户端有需要响应结果和不需要响应结果两种场景，两种响应场景的流程如下：

不需要响应：将客户端请求添加到队列->发送请求->从队列中删除请求->构造客户端响应
需要响应：将客户端请求添加到队列->发送请求->等待接受响应->接受完成的响应->从队列中删除请求->构造客户端响应

客户端响应（ClientResponse）需要从队列中获取客户端请求，客户端请求（ClientRequest）是客户端响应（ClientResponse）的一个成员变量，这么设计的原因是因为回调函数在客户端请求中，这样客户端响应就可以通过自己的成员变量来调用回调函数了。客户端请求和客户端响应的关系如下图所示：

6.选择器

在kafka中，真正与网络进行交互的是选择器Selctor，上节中提到了客户端网络对象的三个重要方法，ready、send和poll，分别实现了连接网络、添加发送对象以及轮询发送的功能。但实际上这三个方法都是调用了Selector来实现。

6.1网络连接

NetWorkClient.ready的调用链路是NetWorkClient.ready->NetWorkClient.initiateConnect->Selector.connect，ready方法是调用Select.connect方法来实现网络连接的。下面我们来看一下这个方法的实现：

public void connect(String id, InetSocketAddress address, int sendBufferSize, int receiveBufferSize) throws IOException {

	SocketChannel socketChannel = SocketChannel.open();
	socketChannel.configureBlocking(false);
	Socket socket = socketChannel.socket();
	//连接网络
	connected = socketChannel.connect(address);
	//注册到nio选择器，并返回选择键
	SelectionKey key = socketChannel.register(nioSelector, SelectionKey.OP_CONNECT);
	KafkaChannel channel = channelBuilder.buildChannel(id, key, maxReceiveSize, memoryPool);
	key.attach(channel);
	this.channels.put(id, channel);
}

public KafkaChannel buildChannel(String id, SelectionKey key, int maxReceiveSize, MemoryPool memoryPool) throws KafkaException {
//创建传输层，传输层TransportLayer中封装了SocketChannel
    PlaintextTransportLayer transportLayer = new PlaintextTransportLayer(key);
    PlaintextAuthenticator authenticator = new PlaintextAuthenticator(configs, transportLayer);
//将传输层封装到KafkaChannel中
    return new KafkaChannel(id, transportLayer, authenticator, maxReceiveSize,
            memoryPool != null ? memoryPool : MemoryPool.NONE);
}

从上面的代码中我们可以看到选择器的connect方法创建了客户端到服务器之间的网络连接，这个连接动作是通过Socketchannel来完成的，然后它将SocketChannel注册到了nioSelector上，通过选择键来与socketChannel关联。除此之外，为了更好的封装底层的一些操作，这里创建了KafkaChannel，将SocketChannel封装在传输层中，然后将传输层作为KafkaChannel的成员变量，这样KafkaChannel就间接的持有了SocketChannel，并通过key.attach(channel)将选择键与KafkaChannel关联起来。这样选择器在进行轮询操作时，就可以通过key.attachment来获取绑定到选择键上的KafkaChannel。同时它也将KafkaChannel和节点id放入到map中，方便根据代理节点来获取kafkaChannel。

6.2添加待发送的请求

第五节中提到发送者线程sender调用的networkClient.send方法并没有真正将请求发送出去而是创建了InFlightRequest对象放入队列中，并通过selector.send方法将需要发送的send对象放入kafkachannel中，我们先看一下kafkaChannel的成员变量：

private final String id;
//传输层，里面持有socketChannel
private final TransportLayer transportLayer;
private long networkThreadTimeNanos;
private final int maxReceiveSize;
private final MemoryPool memoryPool;
//用于存放响应
private NetworkReceive receive;
//存放待发送请求
private Send send;
//通道状态
private ChannelState state;
kafkaChannel持有了传输层对象、响应对象、待发送请求等，我们可以看到这里的send是一个单独的成员变量，不是队列也不是列表，表明每个kafkaChannel一次只能发送一次send请求。这里的send对象是怎么来的呢？我们来看一下selector的send方法就明白了：
public void send(Send send){
	String connectionId = send.destination();
	KafkaChannel channel = openOrClosingChannelOrFail(connectionId);
	channel.setSend(send);
}
private KafkaChannel openOrClosingChannelOrFail(String id) {
    KafkaChannel channel = this.channels.get(id);
    if (channel == null)
        channel = this.closingChannels.get(id);
    if (channel == null)
        channels.keySet());
    return channel;
}

selector.send方法中通过节点的id找出代理节点对应的kafkaChannel，这里是通过6.1中提到的map来实现的，拿到kafkaChannel之后，将待发送的send对象设置进去，就完成了第二步的工作。

6.3真实的发送请求

在6.2中将发送完各个代理节点的请求set到对应代理节点的kafkaChannel中后，还要进行最后一步工作，调用networkClient的轮询方法poll，但networkClient的poll方法其实也没做什么事，它主要还是间接地调用selector的poll方法：

public List poll(long timeout,long now){
	省略......
	this.selector.poll(Utils.min(timeout, metadataTimeout, requestTimeoutMs));
	省略......
}
public void poll(long timeout) throws IOException{
   long startSelect = time.nanoseconds();
   //获取准备好的选择键的数量
    int numReadyKeys = select(timeout);
    if (numReadyKeys > 0 || !immediatelyConnectedKeys.isEmpty() || dataInBuffers) {
      //取出所有已经准备好的选择键
        Set readyKeys = this.nioSelector.selectedKeys();
        keysWithBufferedRead.removeAll(readyKeys); //so no channel gets polled twice

        if (!keysWithBufferedRead.isEmpty()) {
            Set toPoll = keysWithBufferedRead;
            keysWithBufferedRead = new HashSet<>(); //poll() calls will repopulate if needed
            pollSelectionKeys(toPoll, false, endSelect);
        }
      //遍历每个选择键并发送请求
        pollSelectionKeys(readyKeys, false, endSelect);
        pollSelectionKeys(immediatelyConnectedKeys, true, endSelect);
      //清空处理完的选择键
        readyKeys.clear();
    }
}

void pollSelectionKeys(Set selectionKeys,boolean isImmediatelyConnected,long currentTimeNanos) {
	Iterator iterator = determineHandlingOrder(selectionKeys).iterator();
	//遍历每个准备好的选择键
    while (iterator.hasNext()) {
      //获取对应的kafkaChannel
        SelectionKey key = iterator.next();
        KafkaChannel channel = channel(key);
      //发送前先读取响应,如果有响应则将服务端响应添加到队列中
	if (channel.ready() && (key.isReadable()）{
	       NetworkReceive networkReceive;
	        while ((networkReceive = channel.read()) != null) {
	            madeReadProgressLastPoll = true;
	            addToStagedReceives(channel, networkReceive);
	        }
        }
      //如果key是写状态，则调用kafkaChannel的写方法将send发送出去
        if (channel.ready() && key.isWritable()) {
            Send send = channel.write();
         //发送成功则将结果添加到成功发送列表
            if (send != null) {
                this.completedSends.add(send);
            }
        }
    }
}

简单介绍一下上面代码的功能，networkClient.poll调用selector的轮询方法poll，selector.poll从nioSelector中获取已经准备好的选择键，并遍历每个选择键。然后根据选择键获取与之关联的kafkaChannel对象，每个代理节点都对应唯一的kafkaChannel对象。根据选择键的状态来进行相应的处理，如果key上注册的是读事件，则从通道中读出服务端的响应并存储在队列中待networkClient.poll方法进行后续处理；如果key上注册的是写事件，则通过kafkaChannel将send请求发送出去，由于send对象和传输层对象都是kafkaChannel的成员变量，在kafkaChannel.write方法中，就是通过将send中的信息写入到传输层transport中来实现请求的发送。到这一步我们就将kafka消费者完成的主要工作都介绍了一遍。

最后我们在整体把从发送线程sender轮询到将请求发送出去这中间的流程梳理一遍，流程图如下：

sender从消息收集器中捞取待发送消息，消息按照发送代理节点进行分组
sender调用networdClient的ready方法对代理节点建立连接，连接方式是通过nio的方式进行连接，每个代理节点node建立一个socketChannel，并将socketChannel注册到nioSelector得到绑定键key
键socketChannel封装成传输层，并构建kafkaChannel对象，将传输层transportLayer作为KafkaChannel的成员变量
networkClinet将客户端请求ClientRequest通过Selector转换成send，并将send设置为kafkaChannel的成员变量
selector轮询所有准备好的选择键，根据选择键拿到绑定的kafkaChannel，并将成员变量send通过成员变量transportLayer间接地调用socketChannel将消息写入网络中发送出去，到这里就完成了生产者地整个发送流程。

你可能感兴趣的:(kafka)

Kafka 消息丢失如何处理？架构文摘JGWZ 学习
今天给大家分享一个在面试中经常遇到的问题：Kafka消息丢失该如何处理？这个问题啊，看似简单，其实里面藏着很多“套路”。来，咱们先讲一个面试的“真实”案例。面试官问：“Kafka消息丢失如何处理？”小明一听，反问：“你是怎么发现消息丢失了？”面试官顿时一愣，沉默了片刻后，可能有点不耐烦，说道：“这个你不用管，反正现在发现消息丢失了，你就说如何处理。”小明一头雾水：“问题是都不知道怎么丢的，处理起来
【六】阿伟开始搭建Kafka学习环境能源恒观中间件学习 kafka spring
阿伟开始搭建Kafka学习环境概述上一篇文章阿伟学习了Kafka的核心概念，并且把市面上流行的消息中间件特性进行了梳理和对比，方便大家在学习过程中进行对比学习，最后梳理了一些Kafka使用中经常遇到的Kafka难题以及解决思路，经过上一篇的学习我相信大家对Kafka有了初步的认识，本篇将继续学习Kafka。一、安装和配置学习一项技术首先要搭建一套服务，而Kafka的运行主要需要部署jdk、zook
Java面试题精选：消息队列(二) 芒果不是芒 Java面试题精选 java kafka
一、Kafka的特性1.消息持久化：消息存储在磁盘，所以消息不会丢失2.高吞吐量：可以轻松实现单机百万级别的并发3.扩展性：扩展性强，还是动态扩展4.多客户端支持：支持多种语言（Java、C、C++、GO、）5.KafkaStreams（一个天生的流处理）:在双十一或者销售大屏就会用到这种流处理。使用KafkaStreams可以快速的把销售额统计出来6.安全机制：Kafka进行生产或者消费的时候会
Kafka是如何保证数据的安全性、可靠性和分区的喜欢猪猪 kafka 分布式
Kafka作为一个高性能、可扩展的分布式流处理平台，通过多种机制来确保数据的安全性、可靠性和分区的有效管理。以下是关于Kafka如何保证数据安全性、可靠性和分区的详细解析：一、数据安全性SSL/TLS加密：Kafka支持SSL/TLS协议，通过配置SSL证书和密钥来加密数据传输，确保数据在传输过程中不会被窃取或篡改。这一机制有效防止了中间人攻击，保护了数据的安全性。SASL认证：Kafka支持多种
Kafka详细解析与应用分析芊言芊语 kafka 分布式
Kafka是一个开源的分布式事件流平台（EventStreamingPlatform），由LinkedIn公司最初采用Scala语言开发，并基于ZooKeeper协调管理。如今，Kafka已经被Apache基金会纳入其项目体系，广泛应用于大数据实时处理领域。Kafka凭借其高吞吐量、持久化、分布式和可靠性的特点，成为构建实时流数据管道和流处理应用程序的重要工具。Kafka架构Kafka的架构主要由
Kafka 基础与架构理解 StaticKing KAFKA kafka
目录前言Kafka基础概念消息队列简介：Kafka与传统消息队列（如RabbitMQ、ActiveMQ）的对比Kafka的组件Kafka的工作原理：消息的生产、分发、消费流程Kafka系统架构Kafka的分布式架构设计Leader-Follower机制与数据复制Log-basedStorage和持久化Broker间通信协议Zookeeper在Kafka中的角色总结前言Kafka是一个分布式的消息系
全面指南：用户行为从前端数据采集到实时处理的最佳实践数字沉思营销流量运营系统架构前端内容运营大数据
引言在当今的数据驱动世界，实时数据采集和处理已经成为企业做出及时决策的重要手段。本文将详细介绍如何通过前端JavaScript代码采集用户行为数据、利用API和Kafka进行数据传输、通过Flink实时处理数据的完整流程。无论你是想提升产品体验还是做用户行为分析，这篇文章都将为你提供全面的解决方案。设计一个通用的ClickHouse表来存储用户事件时，需要考虑多种因素，包括事件类型、时间戳、用户信
Docker安装Kafka和Kafka-Manager 阿靖哦
本文介绍如何通过Docker安装kafka与kafka界面管理界面一、拉取zookeeper由于kafka需要依赖于zookeeper，因此这里先运行zookeeper1、拉取镜像dockerpullwurstmeister/zookeeper2、启动dockerrun-d--namezookeeper-p2181:2181-eTZ="Asia/Shanghai"--restartalwayswu
主流行架构 rainbowcheng 架构架构
nexus，gitlab,svn,jenkins,sonar,docker，apollo，catteambition，axure，蓝湖，禅道,WCP；redis，kafka，es，zookeeper，dubbo，shardingjdbc，mysql，InfluxDB，Telegraf，Grafana，Nginx，xxl-job，Neo4j,NebulaGraph是一个高性能的,NOSQL图形数据库
月度总结 | 2022年03月 | 考研与就业的抉择 | 确定未来走大数据开发路线「已注销」个人总结 hadoop
一、时间线梳理3月3日，寻找到同专业的就业伙伴3月5日，着手准备Java八股文，决定先走Java后端路线3月8月，申请到了校图书馆的考研专座，决定暂时放弃就业，先准备考研，买了数学和408的资料书3月9日-3月13日，因疫情原因，宿舍区暂封，这段时间在准备考研，发现内容特别多3月13日-3月19日，大部分时间在刷Hadoop、Zookeeper、Kafka的视频，同时在准备实习的项目3月20日，退
分布式消息队列Kafka 叶域大数据分布式 kafka scala spark
分布式消息队列Kafka简介：Kafka是一个分布式消息队列系统，用于处理实时数据流。消息按照主题（Topic）进行分类存储，发送消息的实体称为Producer，接收消息的实体称为Consumer。Kafka集群由多个Kafka实例（Server）组成，每个实例称为Broker。主要用途：广泛应用于构建实时数据管道和流应用程序，适用于需要高吞吐量和低延迟的数据处理场景依赖：Kafka集群和消费者依
K8S学习之PV&&PVC david161
部署mysql之前我们需要先了解一个概念有状态服务。这是一种特殊的服务，简单的归纳下就是会产生需要持久化的数据，并且有很强的I/O需求，且重启需要依赖上次存储到磁盘的数据。如典型的mysql，kafka，zookeeper等等。在我们有比较优秀的商业存储的前提下，非常推荐使用有状态服务进行部署，计算和存储分离那是相当的爽的。在实际生产中如果没有这种存储，localPV也是不错的选择，当然local
Kafka系列之：kafka命令详细总结快乐骑行^_^ 日常分享专栏 Kafka Kafka系列 kafka命令详细总结
Kafka系列之：kafka命令详细总结一、添加和删除topic二、修改topic三、平衡领导者四、检查消费者位置五、管理消费者群体一、添加和删除topicbin/kafka-topics.sh--bootstrap-serverbroker_host:port--create--topicmy_topic_name\--partitions20--replication-factor3--con
搭建Kafka+zookeeper集群调度 krb___ kafka 分布式
前言硬件环境172.18.0.5kafkazk1Kafka+zookeeperKafkaBroker集群172.18.0.6kafkazk2Kafka+zookeeperKafkaBroker集群172.18.0.7kafkazk3Kafka+zookeeperKafkaBroker集群软件环境zookeeper3.5.9资源调度、写作Kafka2.8.0消息通信中间件安装JDK1.8安装搭建zo
Kafka和Pulsar深入解析 jasen91 大数据开发 kafka 分布式
Kafka多租户：单租户系统数据迁移：依赖MirrorMaker，需要额外维护。市场上也有ConfluentReplicator等供应商工具。分层存储：由供应商提供商业使用。组件依赖：KafkaRaft（KRaft）从Kafka2.8开始处于早期访问模式，允许Kafka在没有ZooKeeper的情况下工作。这对Kafka来说是一个显著的优势，因为它简化了Kafka的体系结构并降低了学习成本。云原生
Linux系统部署Kafka教学情书学长 linux 学习笔记 kafka
第一步：Zookeeper安装（准备工作）1、解压安装将安装包上传到/opt/software目录下，解压并修改名称tar-zxvfapache-zookeeper-3.5.7-bin.tar.gz-C/opt/module/mvapache-zookeeper-3.5.7-bin/zookeeper2、配置服务器编号1)在/opt/module/zookeeper-3.5.7/这个目录下创建zk
数仓开发之DWD层完整使用 (第五章) 小坏讲微服务数据仓库 hadoop scala kafka
数仓开发之DWD层完整使用一、流量域未精加工的事务事实表1、主要任务1）数据清洗（ETL）2）新老访客状态标记修复3）分流2、思路1）数据清洗（ETL）2）新老访客状态标记修复（1）前端埋点新老访客状态标记设置规则（2）新老访客状态标记修复思路3）利用侧输出流实现数据拆分（1）埋点日志结构分析（2）分流日志分类（3）分流思路3、图解4、代码1）在KafkaUtil工具类中补充getKafkaPro
Kafka 应用场景 zinuxer kafka 分布式
数据流处理：Kafka支持实时数据流处理，能够在数据流动时进行处理和分析，确保应用程序与最新信息保持同步！日志聚合：可以将来自不同来源的日志集中和聚合，简化应用程序的调试和监控！消息队列：Kafka充当高性能的消息队列，确保不同系统组件之间可靠且可扩展的通信！网络活动追踪：Kafka可以追踪网络活动，改进用户体验和推动业务增长！数据复制：Kafka允许在多个集群之间实现无缝数据复制，确保高可用性和
Kafka的ack机制香山上的麻雀
ack=0/1/-1的不同情况：0：producer不等待broker的ack，broker一接收到还没有写入磁盘就已经返回，当broker故障时有可能丢失数据；1：producer等待broker的ack，partition的leader落盘成功后返回ack，如果在follower同步成功之前leader故障，那么将会丢失数据；-1：producer等待broker的ack，partition的
Kafka 实战 - Kafka分区和副本机制理解用心去追梦 kafka 分布式
ApacheKafka的分区（Partition）和副本（Replica）机制是其核心架构和可靠性保证的关键组成部分。以下是对其理解的详细解释：分区（Partition）分区概念：在Kafka中，每个主题（Topic）可以被划分为多个分区。分区是一个有序的、不可变的消息序列。这意味着消息在分区中按生成顺序存储，每个消息都有一个唯一的偏移量（Offset）。目的：分区的主要目的是为了水平扩展和并行处
编程常用命令总结 Yellow0523 Linux BigData 大数据
编程命令大全1.软件环境变量的配置JavaScalaSparkHadoopHive2.大数据软件常用命令Spark基本命令Spark-SQL命令Hive命令HDFS命令YARN命令Zookeeper命令kafka命令Hibench命令MySQL命令3.Linux常用命令Git命令conda命令pip命令查看Linux系统的详细信息查看Linux系统架构(X86还是ARM，两种方法都可)端口号命令L
zookeeper+kafka消息队列部署 TBF610218 zookeeper kafka 分布式
消息队列的概念什么是消息队列消息是指在应用间传送的数据消息队列是一种应用间的通信方式解决方法，确保消息的可靠传递专门为消息做缓存的消息队列的特征存储将消息存储在某个类型的缓冲区中，指导目标进读取这些消息或者将其从消息队列中显示移除为止异步消息队列通过缓冲消息可以在应用程序当中公开一定程度的异步性，允许源进程发送消息并在队列当中累积消息，而且目标进程可以挑选消息并进行处理为什么需要消息队列解耦冗余扩
分布式中间件-几个常用的消息中间件问道飞鱼分布式技术分布式中间件
文章目录常见消息中间件1.RabbitMQ2.ApacheKafka3.RedisPub/Sub4.ActiveMQ5.AmazonSimpleNotificationService(SNS)和SimpleQueueService(SQS)6.RocketMQ差异总结消息协议1.AMQP(AdvancedMessageQueuingProtocol)2.STOMP(SimpleTextOrient
kafka php 教程,php 使用kafka weixin_39713841 kafka php 教程
准备工作gitclonehttps://github.com/edenhill/librdkafka.git./configuremakesudomakeinstall$gitclonehttps://github.com/arnaud-lb/php-rdkafka.git#生成configure文件$/Users/shiyibo/LNMP/php/bin/phpize#编译安装$./config
Kafka快速入门 G丶AEOM 速成学习区 kafka linq 分布式
讲一下什么是Kafka首先引入这样一个场景：A服务可以发送200qps（QueriesPerSecond，是指每秒查询率），而B服务可以处理100qps。很显然，B服务很可能会被A服务压垮掉。怎么为了保证B不被压垮的同时还能处理A消息，没有什么是不能通过一层中间件解决的，如果有，那就再加一层。开始很容易想到，可以在B服务中增加一个队列，其实就是个链表，B服务根据自己的消费能力，消费链表中的消息。每
【Python系列】异步任务的终止 Kwan的解忧杂货铺@新空间代码工作室 s2 Python python 开发语言
欢迎来到我的博客，很高兴能够在这里和您见面！希望您在这里可以感受到一份轻松愉快的氛围，不仅可以获得有趣的内容和知识，也可以畅所欲言、分享您的想法和见解。推荐:kwan的首页,持续学习,不断总结,共同进步,活到老学到老导航檀越剑指大厂系列:全面总结java核心技术,jvm,并发编程redis,kafka,Spring,微服务等常用开发工具系列:常用的开发工具,IDEA,Mac,Alfred,Git,
老版本kafka查询topic消费情况(python查询) 代码是谁 kafka python 分布式
由于老版本的kafka缺少shell，导致无法通过命令直接进行查询，所以通过python代码，实现消费情况查询安装必须的包#pyhon2.5pipinstallkafka-python==1.4.7python脚本#!/usr/bin/envpythonimportsysfromkafkaimportKafkaConsumer,TopicPartitioniflen(sys.argv)!=2:pr
【Python系列】使用切片移动元素位置 Kwan的解忧杂货铺@新空间代码工作室 s2 Python python 开发语言
欢迎来到我的博客，很高兴能够在这里和您见面！希望您在这里可以感受到一份轻松愉快的氛围，不仅可以获得有趣的内容和知识，也可以畅所欲言、分享您的想法和见解。推荐:kwan的首页,持续学习,不断总结,共同进步,活到老学到老导航檀越剑指大厂系列:全面总结java核心技术,jvm,并发编程redis,kafka,Spring,微服务等常用开发工具系列:常用的开发工具,IDEA,Mac,Alfred,Git,
字节架构师：来说说 Kafka 的消费者客户端详解，你都搞懂了吗？ 2401_84049200 程序员 kafka linq 分布式
点对点模式基于队列，类似于同一个消费者组中的数据，由生产者发送数据到分区，然后消费者拉取分区的消息进行消费，此时消息只能被同一个消费者组的消费者消费一次。发布订阅模式模式就是kafka中的分区消息可以被不同消费者组的消费者消费。这就是一对多的广播模式应用。当然，消费者组是一个逻辑的概念，通过客户端参数group.id来配置，默认值为空字符串。而消费者并不是逻辑的概念，它是真正消费数据的实体，可以是
Java Kafka生产者实现 stormsha Java web java kafka linq
欢迎莅临我的博客，很高兴能够在这里和您见面！希望您在这里可以感受到一份轻松愉快的氛围，不仅可以获得有趣的内容和知识，也可以畅所欲言、分享您的想法和见解。推荐：「stormsha的主页」，「stormsha的知识库」持续学习，不断总结，共同进步，为了踏实，做好当下事儿~专栏导航Python系列:Python面试题合集，剑指大厂Git系列:Git操作技巧GO系列:记录博主学习GO语言的笔记，该笔记专栏
如何用ruby来写hadoop的mapreduce并生成jar包 wudixiaotie mapreduce
ruby来写hadoop的mapreduce，我用的方法是rubydoop。怎么配置环境呢： 1.安装rvm：不说了网上有 2.安装ruby：由于我以前是做ruby的，所以习惯性的先安装了ruby，起码调试起来比jruby快多了。 3.安装jruby： rvm install jruby然后等待安
java编程思想 -- 访问控制权限百合不是茶 java 访问控制权限单例模式
访问权限是java中一个比较中要的知识点,它规定者什么方法可以访问,什么不可以访问一:包访问权限; 自定义包: package com.wj.control; //包 public class Demo { //定义一个无参的方法 public void DemoPackage(){ System.out.println("调用
[生物与医学]请审慎食用小龙虾 comsci 生物
现在的餐馆里面出售的小龙虾,有一些是在野外捕捉的,这些小龙虾身体里面可能带有某些病毒和细菌,人食用以后可能会导致一些疾病,严重的甚至会死亡..... 所以,参加聚餐的时候,最好不要点小龙虾...就吃养殖的猪肉,牛肉,羊肉和鱼,等动物蛋白质
org.apache.jasper.JasperException: Unable to compile class for JSP: 商人shang maven 2.2 jdk1.8
环境： jdk1.8 maven tomcat7-maven-plugin 2.0 原因： tomcat7-maven-plugin 2.0 不知吃 jdk 1.8，换成 tomcat7-maven-plugin 2.2就行，即 <plugin>
你的垃圾你处理掉了吗?GC oloz GC
前序:本人菜鸟，此文研究学习来自网络，各位牛牛多指教　 1.垃圾收集算法的核心思想　　Java语言建立了垃圾收集机制，用以跟踪正在使用的对象和发现并回收不再使用(引用)的对象。该机制可以有效防范动态内存分配中可能发生的两个危险：因内存垃圾过多而引发的内存耗尽，以及不恰当的内存释放所造成的内存非法引用。　　垃圾收集算法的核心思想是：对虚拟机可用内存空间，即堆空间中的对象进行识别
shiro 和 SESSSION 杨白白 shiro
shiro 在web项目里默认使用的是web容器提供的session，也就是说shiro使用的session是web容器产生的，并不是自己产生的，在用于非web环境时可用其他来源代替。在web工程启动的时候它就和容器绑定在了一起，这是通过web.xml里面的shiroFilter实现的。通过session.getSession()方法会在浏览器cokkice产生JESSIONID，当关闭浏览器，此
移动互联网终端淘宝客如何实现盈利小桔子移動客戶端淘客淘寶App
2012年淘宝联盟平台为站长和淘宝客带来的分成收入突破30亿元，同比增长100%。而来自移动端的分成达1亿元，其中美丽说、蘑菇街、果库、口袋购物等App运营商分成近5000万元。可以看出，虽然目前阶段PC端对于淘客而言仍旧是盈利的大头，但移动端已经呈现出爆发之势。而且这个势头将随着智能终端(手机，平板)的加速普及而更加迅猛
wordpress小工具制作 aichenglong wordpress 小工具
wordpress 使用侧边栏的小工具，很方便调整页面结构小工具的制作过程 1 在自己的主题文件中新建一个文件夹(如widget)，在文件夹中创建一个php(AWP_posts-category.php) 小工具是一个类,想侧边栏一样，还得使用代码注册，他才可以再后台使用，基本的代码一层不变 <?php class AWP_Post_Category extends WP_Wi
JS微信分享 AILIKES js
// 所有功能必须包含在 WeixinApi.ready 中进行 WeixinApi.ready(function(Api) { // 微信分享的数据 var wxData = { &nb
封装探讨百合不是茶 JAVA面向对象封装
//封装属性方法将某些东西包装在一起，通过创建对象或使用静态的方法来调用，称为封装；封装其实就是有选择性地公开或隐藏某些信息，它解决了数据的安全性问题，增加代码的可读性和可维护性在 Aname类中申明三个属性，将其封装在一个类中：通过对象来调用例如 1： //属性将其设为私有姓名 name 可以公开
jquery radio/checkbox change事件不能触发的问题 bijian1013 JavaScript jquery
我想让radio来控制当前我选择的是机动车还是特种车，如下所示： <html> <head> <script src="http://ajax.googleapis.com/ajax/libs/jquery/1.7.1/jquery.min.js" type="text/javascript"><
AngularJS中安全性措施 bijian1013 JavaScript AngularJS 安全性 XSRF JSON漏洞
在使用web应用中，安全性是应该首要考虑的一个问题。AngularJS提供了一些辅助机制，用来防护来自两个常见攻击方向的网络攻击。一.JSON漏洞当使用一个GET请求获取JSON数组信息的时候（尤其是当这一信息非常敏感，
[Maven学习笔记九]Maven发布web项目 bit1129 maven
基于Maven的web项目的标准项目结构 user-project user-core user-service user-web src
【Hive七】Hive用户自定义聚合函数(UDAF) bit1129 hive
用户自定义聚合函数，用户提供的多个入参通过聚合计算(求和、求最大值、求最小值)得到一个聚合计算结果的函数。问题：UDF也可以提供输入多个参数然后输出一个结果的运算，比如加法运算add(3，5)，add这个UDF需要实现UDF的evaluate方法,那么UDF和UDAF的实质分别究竟是什么？ Double evaluate(Double a, Double b)
通过 nginx-lua 给 Nginx 增加 OAuth 支持 ronin47
前言：我们使用Nginx的Lua中间件建立了OAuth2认证和授权层。如果你也有此打算，阅读下面的文档，实现自动化并获得收益。SeatGeek 在过去几年中取得了发展，我们已经积累了不少针对各种任务的不同管理接口。我们通常为新的展示需求创建新模块，比如我们自己的博客、图表等。我们还定期开发内部工具来处理诸如部署、可视化操作及事件处理等事务。在处理这些事务中，我们使用了几个不同的接口来认证： &n
利用tomcat-redis-session-manager做session同步时自定义类对象属性保存不上的解决方法 bsr1983 session
在利用tomcat-redis-session-manager做session同步时，遇到了在session保存一个自定义对象时，修改该对象中的某个属性，session未进行序列化，属性没有被存储到redis中。在 tomcat-redis-session-manager的github上有如下说明： Session Change Tracking As noted in the &qu
《代码大全》表驱动法-Table Driven Approach-1 bylijinnan java 算法
关于Table Driven Approach的一篇非常好的文章： http://www.codeproject.com/Articles/42732/Table-driven-Approach package com.ljn.base; import java.util.Random; public class TableDriven { public
Sybase封锁原理 chicony Sybase
昨天在操作Sybase IQ12.7时意外操作造成了数据库表锁定，不能删除被锁定表数据也不能往其中写入数据。由于着急往该表抽入数据，因此立马着手解决该表的解锁问题。无奈此前没有接触过Sybase IQ12.7这套数据库产品，加之当时已属于下班时间无法求助于支持人员支持，因此只有借助搜索引擎强大的
java异常处理机制 CrazyMizzz java
java异常关键字有以下几个，分别为 try catch final throw throws 他们的定义分别为 try： Opening exception-handling statement. catch： Captures the exception. finally： Runs its code before terminating
hive 数据插入DML语法汇总 daizj hive DML 数据插入
Hive的数据插入DML语法汇总1、Loading files into tables语法：1) LOAD DATA [LOCAL] INPATH 'filepath' [OVERWRITE] INTO TABLE tablename [PARTITION (partcol1=val1, partcol2=val2 ...)]解释：1)、上面命令执行环境为hive客户端环境下： hive>l
工厂设计模式 dcj3sjt126com 设计模式
使用设计模式是促进最佳实践和良好设计的好办法。设计模式可以提供针对常见的编程问题的灵活的解决方案。工厂模式工厂模式（Factory）允许你在代码执行时实例化对象。它之所以被称为工厂模式是因为它负责“生产”对象。工厂方法的参数是你要生成的对象对应的类名称。 Example #1 调用工厂方法（带参数） <?phpclass Example{
mysql字符串查找函数 dcj3sjt126com mysql
FIND_IN_SET(str,strlist) 假如字符串str 在由N 子链组成的字符串列表strlist 中，则返回值的范围在1到 N 之间。一个字符串列表就是一个由一些被‘,’符号分开的自链组成的字符串。如果第一个参数是一个常数字符串，而第二个是type SET列，则 FIND_IN_SET() 函数被优化，使用比特计算。如果str不在strlist 或st
jvm内存管理 easterfly jvm
一、JVM堆内存的划分分为年轻代和年老代。年轻代又分为三部分：一个eden,两个survivor。工作过程是这样的：e区空间满了后，执行minor gc，存活下来的对象放入s0, 对s0仍会进行minor gc，存活下来的的对象放入s1中，对s1同样执行minor gc，依旧存活的对象就放入年老代中；年老代满了之后会执行major gc，这个是stop the word模式，执行
CentOS-6.3安装配置JDK-8 gengzg centos
JAVA_HOME=/usr/java/jdk1.8.0_45 JRE_HOME=/usr/java/jdk1.8.0_45/jre PATH=$PATH:$JAVA_HOME/bin:$JRE_HOME/bin CLASSPATH=.:$JAVA_HOME/lib/dt.jar:$JAVA_HOME/lib/tools.jar:$JRE_HOME/lib export JAVA_HOME
【转】关于web路径的获取方法 huangyc1210 Web 路径
假定你的web application 名称为news,你在浏览器中输入请求路径： http://localhost:8080/news/main/list.jsp 则执行下面向行代码后打印出如下结果： 1、 System.out.println(request.getContextPath()); //可返回站点的根路径。也就是项
php里获取第一个中文首字母并排序远去的渡口数据结构 PHP
很久没来更新博客了，还是觉得工作需要多总结的好。今天来更新一个自己认为比较有成就的问题吧。最近在做储值结算，需求里结算首页需要按门店的首字母A-Z排序。我的数据结构原本是这样的： Array ( [0] => Array ( [sid] => 2885842 [recetcstoredpay] =&g
java内部类 hm4123660 java 内部类匿名内部类成员内部类方法内部类
　在Java中，可以将一个类定义在另一个类里面或者一个方法里面，这样的类称为内部类。内部类仍然是一个独立的类，在编译之后内部类会被编译成独立的.class文件，但是前面冠以外部类的类名和$符号。内部类可以间接解决多继承问题,可以使用内部类继承一个类，外部类继承一个类，实现多继承。 &nb
Caused by: java.lang.IncompatibleClassChangeError: class org.hibernate.cfg.Exten zhb8015
maven pom.xml关于hibernate的配置和异常信息如下，查了好多资料，问题还是没有解决。只知道是包冲突，就是不知道是哪个包....遇到这个问题的分享下是怎么解决的。。 maven pom: <dependency> <groupId>org.hibernate</groupId> <ar
Spark 性能相关参数配置详解－任务调度篇 Stark_Summer spark cache cpu 任务调度 yarn
随着Spark的逐渐成熟完善, 越来越多的可配置参数被添加到Spark中来, 本文试图通过阐述这其中部分参数的工作原理和配置思路, 和大家一起探讨一下如何根据实际场合对Spark进行配置优化。由于篇幅较长，所以在这里分篇组织，如果要看最新完整的网页版内容，可以戳这里：http://spark-config.readthedocs.org/，主要是便
css3滤镜 wangkeheng html css
经常看到一些网站的底部有一些灰色的图标，鼠标移入的时候会变亮，开始以为是js操作src或者bg呢，搜索了一下，发现了一个更好的方法：通过css3的滤镜方法。 html代码： <a href='' class='icon'><img src='utv.jpg' /></a> css代码： .icon{-webkit-filter: graysc