艾弗森哇

Nebula 架构剖析系列（一）图数据库的存储设计

摘要

在讨论某个数据库时，存储 ( Storage ) 和计算 ( Query Engine ) 通常是讨论的热点，也是爱好者们了解某个数据库不可或缺的部分。每个数据库都有其独有的存储、计算方式，今天就和图图来学习下图数据库 Nebula Graph 的存储部分。

Nebula 的 Storage 包含两个部分，一是 meta 相关的存储，我们称之为 Meta Service ，另一个是 data 相关的存储，我们称之为 Storage Service。这两个服务是两个独立的进程，数据也完全隔离，当然部署也是分别部署，不过两者整体架构相差不大，本文最后会提到这点。如果没有特殊说明，本文中 Storage Service 代指 data 的存储服务。接下来，大家就随我一起看一下 Storage Service 的整个架构。 Let's go~

Architecture

图一 storage service 架构图

如图1 所示，Storage Service 共有三层，最底层是 Store Engine，它是一个单机版 local store engine，提供了对本地数据的 get / put / scan / delete 操作，相关的接口放在 KVStore / KVEngine.h 里面，用户完全可以根据自己的需求定制开发相关 local store plugin，目前 Nebula 提供了基于 RocksDB 实现的 Store Engine。

在 local store engine 之上，便是我们的 Consensus 层，实现了 Multi Group Raft，每一个 Partition 都对应了一组 Raft Group，这里的 Partition 便是我们的数据分片。目前 Nebula 的分片策略采用了 静态 Hash 的方式，具体按照什么方式进行 Hash，在下一个章节 schema 里会提及。用户在创建 SPACE 时需指定 Partition 数，Partition 数量一旦设置便不可更改，一般来讲，Partition 数目要能满足业务将来的扩容需求。

在 Consensus 层上面也就是 Storage Service 的最上层，便是我们的 Storage interfaces，这一层定义了一系列和图相关的 API。这些 API 请求会在这一层被翻译成一组针对相应 Partition 的 kv 操作。正是这一层的存在，使得我们的存储服务变成了真正的图存储，否则，Storage Service 只是一个 kv 存储罢了。而 Nebula 没把 kv 作为一个服务单独提出，其最主要的原因便是图查询过程中会涉及到大量计算，这些计算往往需要使用图的 schema，而 kv 层是没有数据 schema 概念，这样设计会比较容易实现计算下推。

Schema & Partition

图存储的主要数据是点和边，但 Nebula 存储的数据是一张属性图，也就是说除了点和边以外，Nebula 还存储了它们对应的属性，以便更高效地使用属性过滤。

对于点来说，我们使用不同的 Tag 表示不同类型的点，同一个 VertexID 可以关联多个 Tag，而每一个 Tag 都有自己对应的属性。对应到 kv 存储里面，我们使用 vertexID + TagID 来表示 key, 我们把相关的属性编码后放在 value 里面，具体 key 的 format 如图2 所示：

图二 Vertex Key Format

Type : 1 个字节，用来表示 key 类型，当前的类型有 data, index, system 等
Part ID : 3 个字节，用来表示数据分片 Partition，此字段主要用于 Partition 重新分布(balance) 时方便根据前缀扫描整个 Partition 数据
Vertex ID : 4 个字节，用来表示点的 ID
Tag ID : 4 个字节, 用来表示关联的某个 tag
Timestamp : 8 个字节，对用户不可见，未来实现分布式事务 ( MVCC ) 时使用

在一个图中，每一条逻辑意义上的边，在 Nebula Graph 中会建模成两个独立的 key-value，分别称为 out-key 和in-key。out-key 与这条边所对应的起点存储在同一个 partition 上，in-key 与这条边所对应的终点存储在同一个partition 上。通常来说，out-key 和 in-key 会分布在两个不同的 Partition 中。

两个点之间可能存在多种类型的边，Nebula 用 Edge Type 来表示边类型。而同一类型的边可能存在多条，比如，定义一个 edge type "转账"，用户 A 可能多次转账给 B，所以 Nebula 又增加了一个 Rank 字段来做区分，表示 A 到 B 之间多次转账记录。 Edge key 的 format 如图3 所示：

图三 Edge Key Format

Type : 1 个字节，用来表示 key 的类型，当前的类型有 data, index, system 等。
Part ID : 3 个字节，用来表示数据分片 Partition，此字段主要用于 Partition 重新分布(balance) 时方便根据前缀扫描整个 Partition 数据
Vertex ID : 4 个字节，出边里面用来表示源点的 ID，入边里面表示目标点的 ID。
Edge Type : 4 个字节, 用来表示这条边的类型，如果大于 0 表示出边，小于 0 表示入边。
Rank : 4 个字节，用来处理同一种类型的边存在多条的情况。用户可以根据自己的需求进行设置，这个字段可_存放交易时间_、交易流水号、或_某个排序权重_
Vertex ID : 4 个字节, 出边里面用来表示目标点的 ID，入边里面表示源点的 ID。
Timestamp : 8 个字节，对用户不可见，未来实现分布式做事务的时候使用。

针对 Edge Type 的值，若如果大于 0 表示出边，则对应的 edge key format 如图4 所示；若 Edge Type 的值小于 0，则对应的 edge key format 如图5 所示

图4 出边的 Key Format 图5 入边的 Key Format

对于点或边的属性信息，有对应的一组 kv pairs，Nebula 将它们编码后存在对应的 value 里。由于 Nebula 使用强类型 schema，所以在解码之前，需要先去 Meta Service 中取具体的 schema 信息。另外，为了支持在线变更 schema，在编码属性时，会加入对应的 schema 版本信息，具体的编解码细节在这里不作展开，后续会有专门的文章讲解这块内容。

OK，到这里我们基本上了解了 Nebula 是如何存储数据的，那数据是如何进行分片呢？很简单，对 Vertex ID 取模 即可。通过对 Vertex ID 取模，同一个点的所有_出边_，_入边_以及这个点上所有关联的 _Tag 信息_都会被分到同一个 Partition，这种方式大大地提升了查询效率。对于在线图查询来讲，最常见的操作便是从一个点开始向外 BFS（广度优先）拓展，于是拿一个点的出边或者入边是最基本的操作，而这个操作的性能也决定了整个遍历的性能。BFS 中可能会出现按照某些属性进行剪枝的情况，Nebula 通过将属性与点边存在一起，来保证整个操作的高效。当前许多的图数据库通过 Graph 500 或者 Twitter 的数据集试来验证自己的高效性，这并没有代表性，因为这些数据集没有属性，而实际的场景中大部分情况都是属性图，并且实际中的 BFS 也需要进行大量的剪枝操作。

KVStore

为什么要自己做 KVStore，这是我们无数次被问起的问题。理由很简单，当前开源的 KVStore 都很难满足我们的要求：

性能，性能，性能：Nebula 的需求很直接：高性能 pure kv；
以 library 的形式提供：对于强 schema 的 Nebula 来讲，计算下推需要 schema 信息，而计算下推实现的好坏，是 Nebula 是否高效的关键；
数据强一致：这是分布式系统决定的；
使用 C++实现：这由团队的技术特点决定；

基于上述要求，Nebula 实现了自己的 KVStore。当然，对于性能完全不敏感且不太希望搬迁数据的用户来说，Nebula 也提供了整个KVStore 层的 plugin，直接将 Storage Service 搭建在第三方的 KVStore 上面，目前官方提供的是 HBase 的 plugin。

Nebula KVStore 主要采用 RocksDB 作为本地的存储引擎，对于多硬盘机器，为了充分利用多硬盘的并发能力，Nebula 支持自己管理多块盘，用户只需配置多个不同的数据目录即可。分布式 KVStore 的管理由 Meta Service 来统一调度，它记录了所有 Partition 的分布情况，以及当前机器的状态，当用户增减机器时，只需要通过 console 输入相应的指令，Meta Service 便能够生成整个 balance plan 并执行。（之所以没有采用完全自动 balance 的方式，主要是为了减少数据搬迁对于线上服务的影响，balance 的时机由用户自己控制。）

为了方便对于 WAL 进行定制，Nebula KVStore 实现了自己的 WAL 模块，每个 partition 都有自己的 WAL，这样在追数据时，不需要进行 wal split 操作，更加高效。另外，为了实现一些特殊的操作，专门定义了 Command Log 这个类别，这些 log 只为了使用 Raft 来通知所有 replica 执行某一个特定操作，并没有真正的数据。除了 Command Log 外，Nebula 还提供了一类日志来实现针对某个 Partition 的 atomic operation，例如 CAS，read-modify-write, 它充分利用了Raft 串行的特性。

关于多图空间（space）的支持：一个 Nebula KVStore 集群可以支持多个 space，每个 space 可设置自己的 partition 数和 replica 数。不同 space 在物理上是完全隔离的，而且在同一个集群上的不同 space 可支持不同的 store engine 及分片策略。

Raft

作为一个分布式系统，KVStore 的 replication，scale out 等功能需 Raft 的支持。当前，市面上讲 Raft 的文章非常多，具体原理性的内容，这里不再赘述，本文主要说一些 Nebula Raft 的一些特点以及工程实现。

Multi Raft Group

由于 Raft 的日志不允许空洞，几乎所有的实现都会采用 Multi Raft Group 来缓解这个问题，因此 partition 的数目几乎决定了整个 Raft Group 的性能。但这也并不是说 Partition 的数目越多越好：每一个 Raft Group 内部都要存储一系列的状态信息，并且每一个 Raft Group 有自己的 WAL 文件，因此 Partition 数目太多会增加开销。此外，当 Partition 太多时，如果负载没有足够高，batch 操作是没有意义的。比如，一个有 1w tps 的线上系统单机，它的单机 partition 的数目超过 1w，可能每个 Partition 每秒的 tps 只有 1，这样 batch 操作就失去了意义，还增加了 CPU 开销。实现 Multi Raft Group 的最关键之处有两点，** 第一是共享 Transport 层**，因为每一个 Raft Group 内部都需要向对应的 peer 发送消息，如果不能共享 Transport 层，连接的开销巨大；第二是线程模型，Mutli Raft Group 一定要共享一组线程池，否则会造成系统的线程数目过多，导致大量的 context switch 开销。

Batch

对于每个 Partition来说，由于串行写 WAL，为了提高吞吐，做 batch 是十分必要的。一般来讲，batch 并没有什么特别的地方，但是 Nebula 利用每个 part 串行的特点，做了一些特殊类型的 WAL，带来了一些工程上的挑战。

举个例子，Nebula 利用 WAL 实现了无锁的 CAS 操作，而每个 CAS 操作需要之前的 WAL 全部 commit 之后才能执行，所以对于一个 batch，如果中间夹杂了几条 CAS 类型的 WAL, 我们还需要把这个 batch 分成粒度更小的几个 group，group 之间保证串行。还有，command 类型的 WAL 需要它后面的 WAL 在其 commit 之后才能执行，所以整个 batch 划分 group 的操作工程实现上比较有特色。焦作国医胃肠医院正规吗_卫生局认证焦作老品牌：https://www.jianshu.com/p/3c43af3bb611

Learner

Learner 这个角色的存在主要是为了 应对扩容 时，新机器需要"追"相当长一段时间的数据，而这段时间有可能会发生意外。如果直接以 follower 的身份开始追数据，就会使得整个集群的 HA 能力下降。 Nebula 里面 learner 的实现就是采用了上面提到的 command wal，leader 在写 wal 时如果碰到 add learner 的 command，就会将 learner 加入自己的 peers，并把它标记为 learner，这样在统计多数派的时候，就不会算上 learner，但是日志还是会照常发送给它们。当然 learner 也不会主动发起选举。

Transfer Leadership

Transfer leadership 这个操作对于 balance 来讲至关重要，当我们把某个 Paritition 从一台机器挪到另一台机器时，首先便会检查 source 是不是 leader，如果是的话，需要先把他挪到另外的 peer 上面；在搬迁数据完毕之后，通常还要把 leader 进行一次 balance，这样每台机器承担的负载也能保证均衡。

实现 transfer leadership，需要注意的是 leader 放弃自己的 leadership，和 follower 开始进行 leader election 的时机。对于 leader 来讲，当 transfer leadership command 在 commit 的时候，它放弃 leadership；而对于 follower 来讲，当收到此 command 的时候就要开始进行 leader election，这套实现要和 Raft 本身的 leader election 走一套路径，否则很容易出现一些难以处理的 corner case。

Membership change

为了避免脑裂，当一个 Raft Group 的成员发生变化时，需要有一个中间状态，这个状态下 old group 的多数派与 new group 的多数派总是有 overlap，这样就防止了 old group 或者新 group 单方面做出决定，这就是论文中提到的 joint consensus 。为了更加简化，Diego Ongaro 在自己的博士论文中提出每次增减一个 peer 的方式，以保证 old group 的多数派总是与 new group 的多数派有 overlap。 Nebula 的实现也采用了这个方式，只不过 add member 与 remove member 的实现有所区别，具体实现方式本文不作讨论，有兴趣的同学可以参考 Raft Part class 里面 addPeer / removePeer 的实现。

Snapshot

Snapshot 如何与 Raft 流程结合起来，论文中并没有细讲，但是这一部分我认为是一个 Raft 实现里最容易出错的地方，因为这里会产生大量的 corner case。

举一个例子，当 leader 发送 snapshot 过程中，如果 leader 发生了变化，该怎么办？这个时候，有可能 follower 只接到了一半的 snapshot 数据。所以需要有一个 Partition 数据清理过程，由于多个 Partition 共享一份存储，因此如何清理数据又是一个很麻烦的问题。另外，snapshot 过程中，会产生大量的 IO，为了性能考虑，我们不希望这个过程与正常的 Raft 共用一个 IO threadPool，并且整个过程中，还需要使用大量的内存，如何优化内存的使用，对于性能十分关键。由于篇幅原因，我们并不会在本文对这些问题展开讲述，有兴趣的同学可以参考 SnapshotManager 的实现。

Storage Service

在 KVStore 的接口之上，Nebula 封装有图语义接口，主要的接口如下：

getNeighbors : 查询一批点的出边或者入边，返回边以及对应的属性，并且需要支持条件过滤；
Insert vertex/edge : 插入一条点或者边及其属性；
getProps : 获取一个点或者一条边的属性；

这一层会将图语义的接口转化成 kv 操作。为了提高遍历的性能，还要做并发操作。

Meta Service

在 KVStore 的接口上，Nebula 也同时封装了一套 meta 相关的接口。Meta Service 不但提供了图 schema 的增删查改的功能，还提供了集群的管理功能以及用户鉴权相关的功能。Meta Service 支持单独部署，也支持使用多副本来保证数据的安全。

总结

这篇文章给大家大致介绍了 Nebula Storage 层的整体设计，由于篇幅原因，很多细节没有展开讲，欢迎大家到我们的微信群里提问，加入 Nebula Graph 交流群，请联系 Nebula Graph 官方小助手微信号：NebulaGraphbot。

主流行架构 rainbowcheng 架构架构
nexus，gitlab,svn,jenkins,sonar,docker，apollo，catteambition，axure，蓝湖，禅道,WCP；redis，kafka，es，zookeeper，dubbo，shardingjdbc，mysql，InfluxDB，Telegraf，Grafana，Nginx，xxl-job，Neo4j,NebulaGraph是一个高性能的,NOSQL图形数据库
nebula-studio-nginx代理配置 a...Z linux
map$http_upgrade$connection_upgrade{defaultupgrade;''close;}server{listen80;server_namenebula-studio.xxx.xxxx.com;access_log/xx/xx/nginx1.21.6/logs/xxx.logmain;error_log/xxx/xx/nginx1.21.6/logs/xxx.lo
在 Spark 数据导入中的一些实践细节 NebulaGraph
best-practices-import-data-spark-nebula-graph本文由合合信息大数据团队柳佳浩撰写1.前言图谱业务随着时间的推移愈发的复杂化，逐渐体现出了性能上的瓶颈：单机不足以支持更大的图谱。然而，从性能上来看，Neo4j的原生图存储有着不可替代的性能优势，这一点是之前调研的JanusGraph、Dgraph等都难以逾越的鸿沟。即使JanusGraph在OLAP上面非常
无依赖单机尝鲜 Nebula Exchange 的 SST 导入 NebulaGraph
无依赖单机尝鲜NebulaExchange的SST导入本文尝试分享下以最小方式（单机、容器化Spark、Hadoop、NebulaGraph），快速趟一下NebulaExchange中SST写入方式的步骤。本文适用于v2.5以上版本的Nebula-Exchange。原文链接：国外访问：https://siwei.io/nebula-exchange-sst-2.x/国内访问：https://cn.
飞腾Ubantu22.04.3安装OpenNebula测试奋斗的小菜菜运维 linux 运维 linux
目前登录权限存在问题-待解决。1.概述因OpenneBula官方镜像源只有AMD架构的镜像包不存在ARM的镜像包，借此用源码编译进行测试。2.官网github地址下载解压存放在服务器上：https://github.com/OpenNebula/minione/blob/master文件目录：3.安装依赖包sudoapt-yinstallg++libxmlrpc-c++8-devsconssqli
nebula数据库常见NGQL语句 safina ~ 跨越中间件之门：知识用法与解决方案数据库
文章目录创建space切换space创建Tag（Vertex）创建Tagindex删除Tagindex查询Tag创建Edge查询Edge插入点（使用Tag）插入边查询vertex查询Edge统计Vertex和Edge数量查看space下的所有节点查看特定类型的节点查询节点的关系查询特定类型的节点和关系查询节点的路径WHERE语句ORDERBY语句LIMIT子句组合语句创建spaceCREATESP
Nebula基础的查询操作介绍大·风图数据库数据库 Nebula
Nebula基础的查询操作介绍这里只是对Nebula基础查询进行介绍，其目的是为了让未接触过Nebula的同学最短时间了解其语句。更详细更准确的内可以查看官方文档。docs.nebula-graph关于查询这里并没有使用官方例子数据，而是自己实际尝试了文档中的语句。其他内容Nebula基础的操作介绍数据准备创建标签CREATETAGPerson(namestring,ageint,typestri
解决nebula插入头尾节点相同的边数据覆盖问题 safina ~ 跨越中间件之门：知识用法与解决方案数据库
文章目录问题描述解决方法问题描述我要在nebula数据库中插入多条头尾节点相同的实体，他们的source和target是相同的，但是Key和其他属性不同。但是我使用如下的insert和upsert语句进行插入数据库后发现数据库中仍然还是只有一条数据。以下是我插入时用的语句示例：#insert语句INSERTEDGE`投资`(`_key`,`source`,`target`,`graphlabel`
Nebula基础的操作介绍大·风图数据库 Nebula 图数据库数据库
Nebula基础这里只是对Nebula基础的介绍，其目的是为了让未接触过Nebula的同学最短时间了解其概念和使用。更详细更准确的内可以查看官方文档。docs.nebula-graph其他内容Nebula基础的查询操作介绍基础概念要理解Nebula的语句，首先需要掌握其基本的数据概念。以下是Nebula数据模型的基本要点，涵盖图、点、边、属性、标签和类型的详细介绍：图（Graph）：图是由节点和边
图计算 on nLive：Nebula 的图计算实践 NebulaGraph
本文首发于NebulaGraphCommunity公众号图计算onnLive：Nebula的图计算实践在#图计算onnLive#直播活动中，来自Nebula研发团队的nebula-plato维护者郝彤和nebula-algorithm维护者Nicole分别同大家分享了他她眼中的图计算。嘉宾们王昌圆：论坛ID：Nicole，nebula-algorithm维护者；郝彤：论坛ID：caton-hpg，
TokenInsight 对话首席——获取增量用户公链崛起的关键之战 TokenInsight
邀行业首席，谈市场现状，见趋势未来！本期《对话首席》线上活动于6月28日下午3点顺利举办。本次《对话首席》特邀Contentos联合创始人MickTsai、Nebulas基金会秘书长Ruby、HarmonyCTO兰荣坚和COTICEOShahafBar-Geffen作为主嘉宾。四家媒体观察团：链闻龚博、链得得常兴宇、火星财经陆洋和金色财经陈颖。同时，《对话首席》也欢迎交易所、钱包、挖矿等区块链各领
如何运行一个CYBEX数据节点 logz2020
为了运行一个cybex的节点，今天联系到cybex的开发人员，拿到了相关的代码。由于cybex暂时没有提供binary文件，所以还是需要手动编译的。cybex的代码，托管在github上，但是前端轻钱包的代码和节点程序的代码分开在两个repo。前端：https://github.com/CybexDex节点程序：https://github.com/NebulaCybexDEX/cybex-cor
Nebula Graph 在企查查的应用 NebulaGraph
本文首发于NebulaGraphCommunity公众号NebulaGraph在企查查的应用背景企查查是企查查科技有限公司旗下的一款企业信用查询工具，旨在为用户提供快速查询企业工商信息、法院判决信息、关联企业信息、法律诉讼、失信信息、被执行人信息、知识产权信息、公司新闻、企业年报等服务。为更好地展现企业之间的法律诉讼、风险信息、股权信息、董监高法等信息，我们抽取结构化/非结构化的企业数据构建企业知
Nebula Graph -- 5. Nebula Graph简介火箭蛋头
NebulaGraph是一款开源的、分布式的、易扩展的原生图数据库，能够承载包含数千亿个点和数万亿条边的超大规模数据集，并且提供毫秒级查询。image.png图数据库是专门存储庞大的图形网络并从中检索信息的数据库。它可以将图中的数据高效存储为点（Vertex）和边（Edge），还可以将属性（Property）附加到点和边上。图数据库适合存储大多数从现实抽象出的数据类型。世界上几乎所有领域的事物都有
架构设计内容分享(一百一十七)：基于 raft-listener 实现的 nebula 实时同步的高效双集群主备环境之乎者也· 架构设计内容分享 java 运维 linux 系统架构架构
目录背景以及需求为什么使用Listener备集群如何接受数据？Listener节点的管理和可靠性listener故障切换的设计nebula主备切换设计主备切换过程中的数据丢失问题背景以及需求线上业务对数据库可用性可靠性要求较高，要求需要有双AZ的主备容灾机制。主备集群要求数据和schema信息实时同步，数据同步平均时延要求在1s之内，p99要求在2s之内。主备集群数据要求一致要求能够在主集群故障时
图数据库 Nebula Graph 是什么 NebulaGraph
image图数据库（英语：GraphDatabase）是一个使用图结构进行语义查询的数据库。该系统的关键概念是图，形式上是点(Node或者Vertex)和边(Edge或者Relationship)的集合。一个顶点代表一个实体，比如，某个人，边则表示两个实体间的关联关系，比如“你关注NebulaGraph”的关注关系。图广泛存在于现实世界中，从社交网络到风控场景、从知识图谱到智能推荐。NebulaG
星球大战（歼星舰） Nebula-class Star Destroyer 黑夜给我黑色的眼睛
图片发自AppNebula-classStarDestroyer星云级歼星舰星云级歼星舰，又名防御者级歼星舰（Defender-classStarDestroyer），是新共和国新型战舰定型计划（NewRepublic'sNewClassModernizationProgram.）中最大最强力的歼星舰使用时期新共和国时期数据参数+描述：长度是帝国歼星舰的65%，1040米长大部分借鉴了帝国级歼星舰
Neo4j 导入 Nebula Graph 的实践总结 NebulaGraph
摘要：主要介绍如何通过官方ETL工具Exchange将业务线上数据从Neo4j直接导入到NebulaGraph以及在导入过程中遇到的问题和优化方法。本文首发于Nebula论坛：https://discuss.nebula-graph.com.cn/t/topic/2044Neo4j导入NebulaGraph的实践总结1背景随着业务数据量不断增长，业务对图数据库在线数据实时更新写入和查询的效率要求也
大型语言模型与知识图谱的完美结合：从LLMs到RAG，探索知识图谱构建的全新篇章汀、人工智能知识图谱人工智能自然语言处理 NLP RAG LLM 检索系统
最近，使用大型语言模型（LLMs）和知识图谱（KG）开发RAG（RetrievalAugmentedGeneration）流程引起了很大的关注。在这篇文章中，我将使用LlamaIndex和NebulaGraph来构建一个关于费城费利斯队（PhiladelphiaPhillies）的RAG流程。我们用的是开源的NebulaGraph来完成这次的知识图谱。用来查询费城费利斯队的信息。我们将使用费城费利
CentOS 7 安装私有平台OpenNebula 宇博士 adb
目录一、配置yum源二、配置数据库MySQL2.1安装MySQL2.2修改MySQL密码2.3创建项目用户和库三、安装配置前端包四、设置oneadmin账号密码五、验证安装5.1命令行验证安装5.2数据存放位置5.3端口介绍5.4命令介绍六、访问6.1设置语言6.2创建主机七、创建网络模板及网络八、创建镜像九、创建虚拟机模板十、创建虚拟机十一、克隆虚拟机十二、添加其他主机关闭防火墙、selinux
图结构选型：Gephi 、 Cytoscape # ArangoDB、OrientDB、JanusGraph；弃nebula因其explorer收费； ssh X11Forward ziix 服务器 linux 运维
图结构选型图可视化工具图结构可视化、分析（开源、完全免费、重型PC软件）：Gephi、Cytoscape还有另外三个等待确定：Graphexp、KeyLines、Linkurious支持以上图可视化工具的图数据库图数据库（开源、完全免费、支持可视化工具Gephi或Cytoscape）：ArangoDB、OrientDB、JanusGraph丢弃的：弃Neo4j，因此专业版收费；弃AmazonNep
一首古诗带来的图数据库大冒险 NebulaGraph
本文首发于NebulaGraphCommunity公众号一首古诗带来的图数据库大冒险因为图数据库的增长趋势一直位列前茅，每年都有媒体预测今年是“图年”。作为曾经的图数据库从业者，NebulaHackthon2021的参赛队伍临江仙的队长王二铁（王建奎），一直在思考，为什么长期火爆的图数据库市场，一直没有真正引爆。在2018年图数据库输给了区块链，2019年又遇到了5G，随后疫情开始了。在王二铁看来
Nebula Graph 源码解读系列｜ Vol.03 Planner 的实现 NebulaGraph
NebulaGraph源码解读系列｜Vol.03Planner的实现上篇我们讲到Validator会将由Parser生成的抽象语法树（AST）转化为执行计划，这次，我们来讲下执行计划是如何生成的。概述imagePlanner是执行计划（ExecutionPlan）生成器，它会根据Validator校验过、语义合法的查询语法树生成可供执行器（Executor）执行的未经优化的执行计划，而该执行计划会
高性能图计算系统 Plato 在 Nebula Graph 中的实践 NebulaGraph
本文首发于公众号NebulaGraphCommunity高性能图计算系统Plato在NebulaGraph中的实践1.图计算介绍1.1图数据库vs图计算图数据库是面向OLTP场景，强调增删改查，并且一个查询往往只涉及到全图中的少量数据，而图计算是面向OLAP场景，往往是针对全图数据进行分析计算。1.2图计算系统分布架构按照分布架构，图计算系统分为单机和分布式。单机图计算系统优势在于模型简单，无需考
Nebula Graph 源码解读系列｜客户端的通信秘密——fbthrift NebulaGraph
NebulaGraph源码解读系列｜客户端的通信秘密——fbthrift概述NebulaClients给用户提供了多种编程语言的API用于和NebulaGraph交互，并且对服务端返回的数据结构进行了重新封装，便于用户使用。目前NebulaClients支持的语言有C++、Java、Python、Golang和Rust。通信框架NebulaClients使用了fbthrifthttps://git
图数据库NebulaGraph学习 SimpleSimpleSimples 数据库学习
1.图空间(Space)操作1.1创建图空间，指定vid_type为整形CREATESPACEplay_space(partition_num=10,replica_factor=1,vid_type=INT64)COMMENT="运动员库表空间";1.2创建图空间，指定vid_type为字符串CREATESPACEplay_space(partition_num=10,replica_facto
GraphX 在图数据库 Nebula Graph 的图计算实践 NebulaGraph
不同来源的异构数据间存在着千丝万缕的关联，这种数据之间隐藏的关联关系和网络结构特性对于数据分析至关重要，图计算就是以图作为数据模型来表达问题并予以解决的过程。图计算实践一、背景随着网络信息技术的飞速发展，数据逐渐向多源异构化方向发展，且不同来源的异构数据之间也存在的千丝万缕的关联，这种数据之间隐藏的关联关系和网络结构特性对于数据分析至关重要。但传统关系型数据库在分析大规模数据关联特性时存在性能缺陷
图数据库｜如何从零到一构建一个企业股权图谱系统 NebulaGraph
本文首发于NebulaGraphCommunity公众号corp-rl.png我们知道无论是监管部门、企业还是个人，都有需求去针对一个企业、法人做一些背景调查，这些调查可以是法律诉讼、公开持股、企业任职等等多种多样的信息。这些背景信息可以辅助我们做商业上的重要决策，规避风险：比如根据公司的股权关系，了解是否存在利益冲突比如是否选择与一家公司进行商业往来。在满足这样的关系分析需求的时候，我们往往面临
Nebula Graph 1.0 Release Note NebulaGraph
NebulaGraph1.0发布了。作为一款开源分布式图数据库，NebulaGraph1.0版本旨在提供一个安全、高可用、高性能、具有强表达能力的查询语言的图数据库。Releasenote基本功能DDL&DML：支持在线的数据定义语言（DDL）及数据操纵语言（DML）。图探索：支持正/反向、双向图探索，GOminHopsTOmaxHops获取指定步数区间的关系。聚合操作：聚合函数GROUPBY、排
ChatGPT 加图数据库 NebulaGraph 预测 2022 世界杯冠军球队 NebulaGraph
ChatGPT预测世界杯一次利用ChatGPT给出数据抓取代码，借助NebulaGraph图数据库与图算法预测体坛赛事的尝试。作者：古思为蹭ChatGPT热度最近因为世界杯正在进行，我受到这篇CambridgeIntelligence的文章启发（在这篇文章中，作者仅仅利用有限的信息量和条件，借助图算法的方法做出了合理的冠军预测），想到可以试着用图数据库NebulaGraph玩玩冠军预测，还能顺道科
矩阵求逆（JAVA）初等行变换 qiuwanchi 矩阵求逆（JAVA）
package gaodai.matrix; import gaodai.determinant.DeterminantCalculation; import java.util.ArrayList; import java.util.List; import java.util.Scanner; /** * 矩阵求逆(初等行变换) * @author 邱万迟 *
JDK timer antlove java jdk schedule code timer
1.java.util.Timer.schedule(TimerTask task, long delay)：多长时间（毫秒）后执行任务 2.java.util.Timer.schedule(TimerTask task, Date time)：设定某个时间执行任务 3.java.util.Timer.schedule(TimerTask task, long delay,longperiod
JVM调优总结 -Xms -Xmx -Xmn -Xss coder_xpf jvm 应用服务器
堆大小设置JVM 中最大堆大小有三方面限制：相关操作系统的数据模型（32-bt还是64-bit）限制；系统的可用虚拟内存限制；系统的可用物理内存限制。32位系统下，一般限制在1.5G~2G；64为操作系统对内存无限制。我在Windows Server 2003 系统，3.5G物理内存，JDK5.0下测试，最大可设置为1478m。典型设置： java -Xmx
JDBC连接数据库 Array_06 jdbc
package Util; import java.sql.Connection; import java.sql.DriverManager; import java.sql.ResultSet; import java.sql.SQLException; import java.sql.Statement; public class JDBCUtil { //完
Unsupported major.minor version 51.0（jdk版本错误） oloz java
java.lang.UnsupportedClassVersionError: cn/support/cache/CacheType : Unsupported major.minor version 51.0 (unable to load class cn.support.cache.CacheType) at org.apache.catalina.loader.WebappClassL
用多个线程处理1个List集合 362217990 多线程 thread list 集合
昨天发了一个提问，启动5个线程将一个List中的内容，然后将5个线程的内容拼接起来，由于时间比较急迫，自己就写了一个Demo，希望对菜鸟有参考意义。。 import java.util.ArrayList; import java.util.List; import java.util.concurrent.CountDownLatch; public c
JSP简单访问数据库香水浓 sql mysql jsp
学习使用javaBean，代码很烂，仅为留个脚印 public class DBHelper { private String driverName; private String url; private String user; private String password; private Connection connection; privat
Flex4中使用组件添加柱状图、饼状图等图表 AdyZhang Flex
1.添加一个最简单的柱状图 ? 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 <?xml version= "1.0"&n
Android 5.0 - ProgressBar 进度条无法展示到按钮的前面 aijuans android
在低于SDK < 21 的版本中，ProgressBar 可以展示到按钮前面，并且为之在按钮的中间，但是切换到android 5.0后进度条ProgressBar 展示顺序变化了，按钮再前面，ProgressBar 在后面了我的xml配置文件如下： [html] view plain copy <RelativeLa
查询汇总的sql baalwolf sql
select list.listname, list.createtime,listcount from dream_list as list , (select listid,count(listid) as listcount from dream_list_user group by listid order by count(
Linux du命令和df命令区别 BigBird2012 linux
1，两者区别 du，disk usage,是通过搜索文件来计算每个文件的大小然后累加，du能看到的文件只是一些当前存在的，没有被删除的。他计算的大小就是当前他认为存在的所有文件大小的累加和。
AngularJS中的$apply，用还是不用？ bijian1013 JavaScript AngularJS $apply
在AngularJS开发中，何时应该调用$scope.$apply()，何时不应该调用。下面我们透彻地解释这个问题。但是首先，让我们把$apply转换成一种简化的形式。 scope.$apply就像一个懒惰的工人。它需要按照命
[Zookeeper学习笔记十]Zookeeper源代码分析之ClientCnxn数据序列化和反序列化 bit1129 zookeeper
ClientCnxn是Zookeeper客户端和Zookeeper服务器端进行通信和事件通知处理的主要类，它内部包含两个类，1. SendThread 2. EventThread， SendThread负责客户端和服务器端的数据通信，也包括事件信息的传输，EventThread主要在客户端回调注册的Watchers进行通知处理 ClientCnxn构造方法 &
【Java命令一】jmap bit1129 Java命令
jmap命令的用法： [hadoop@hadoop sbin]$ jmap Usage: jmap [option] <pid> (to connect to running process) jmap [option] <executable <core> (to connect to a
Apache 服务器安全防护及实战 ronin47
此文转自IBM. Apache 服务简介 Web 服务器也称为 WWW 服务器或 HTTP 服务器 (HTTP Server)，它是 Internet 上最常见也是使用最频繁的服务器之一，Web 服务器能够为用户提供网页浏览、论坛访问等等服务。由于用户在通过 Web 浏览器访问信息资源的过程中，无须再关心一些技术性的细节，而且界面非常友好，因而 Web 在 Internet 上一推出就得到
unity 3d实例化位置出现布置？ brotherlamp unity教程 unity unity资料 unity视频 unity自学
问：unity 3d实例化位置出现布置？答：实例化的同时就可以指定被实例化的物体的位置,即 position Instantiate (original : Object, position : Vector3, rotation : Quaternion) : Object 这样你不需要再用Transform.Position了, 如果你省略了第二个参数(
《重构，改善现有代码的设计》第八章 Duplicate Observed Data bylijinnan java 重构
import java.awt.Color; import java.awt.Container; import java.awt.FlowLayout; import java.awt.Label; import java.awt.TextField; import java.awt.event.FocusAdapter; import java.awt.event.FocusE
struts2更改struts.xml配置目录 chiangfai struts.xml
struts2默认是读取classes目录下的配置文件，要更改配置文件目录，比如放在WEB-INF下，路径应该写成../struts.xml(非/WEB-INF/struts.xml) web.xml文件修改如下： <filter> <filter-name>struts2</filter-name> <filter-class&g
redis做缓存时的一点优化 chenchao051 redis hadoop pipeline
最近集群上有个job，其中需要短时间内频繁访问缓存，大概7亿多次。我这边的缓存是使用redis来做的，问题就来了。首先，redis中存的是普通kv，没有考虑使用hash等解结构，那么以为着这个job需要访问7亿多次redis，导致效率低，且出现很多redi
mysql导出数据不输出标题行 daizj mysql 数据导出去掉第一行去掉标题
当想使用数据库中的某些数据，想将其导入到文件中，而想去掉第一行的标题是可以加上-N参数如通过下面命令导出数据： mysql -uuserName -ppasswd -hhost -Pport -Ddatabase -e " select * from tableName" > exportResult.txt 结果为： studentid
phpexcel导出excel表简单入门示例 dcj3sjt126com PHP Excel phpexcel
先下载PHPEXCEL类文件，放在class目录下面，然后新建一个index.php文件，内容如下 <?php error_reporting(E_ALL); ini_set('display_errors', TRUE); ini_set('display_startup_errors', TRUE); if (PHP_SAPI == 'cli') die('
爱情格言 dcj3sjt126com 格言
1) I love you not because of who you are, but because of who I am when I am with you. 　　我爱你，不是因为你是一个怎样的人，而是因为我喜欢与你在一起时的感觉。 　　2) No man or woman is worth your tears, and the one who is, won‘t
转 Activity 详解——Activity文档翻译 e200702084 android UI sqlite 配置管理网络应用
activity 展现在用户面前的经常是全屏窗口，你也可以将 activity 作为浮动窗口来使用（使用设置了 windowIsFloating 的主题），或者嵌入到其他的 activity （使用 ActivityGroup ）中。当用户离开 activity 时你可以在 onPause() 进行相应的操作。更重要的是，用户做的任何改变都应该在该点上提交 ( 经常提交到 ContentPro
win7安装MongoDB服务 geeksun mongodb
1. 下载MongoDB的windows版本：mongodb-win32-x86_64-2008plus-ssl-3.0.4.zip，Linux版本也在这里下载，下载地址： http://www.mongodb.org/downloads 2. 解压MongoDB在D:\server\mongodb, 在D:\server\mongodb下创建d
Javascript魔法方法:__defineGetter__,__defineSetter__ hongtoushizi js
转载自： http://www.blackglory.me/javascript-magic-method-definegetter-definesetter/ 在javascript的类中,可以用defineGetter和defineSetter_控制成员变量的Get和Set行为例如,在一个图书类中,我们自动为Book加上书名符号: function Book(name){
错误的日期格式可能导致走nginx proxy cache时不能进行304响应 jinnianshilongnian cache
昨天在整合某些系统的nginx配置时，出现了当使用nginx cache时无法返回304响应的情况，出问题的响应头： Content-Type:text/html; charset=gb2312 Date:Mon, 05 Jan 2015 01:58:05 GMT Expires:Mon , 05 Jan 15 02:03:00 GMT Last-Modified:Mon, 05
数据源架构模式之行数据入口 home198979 PHP 架构行数据入口
注：看不懂的请勿踩，此文章非针对java，java爱好者可直接略过。一、概念行数据入口（Row Data Gateway）：充当数据源中单条记录入口的对象，每行一个实例。二、简单实现行数据入口为了方便理解，还是先简单实现： <?php /** * 行数据入口类 */ class OrderGateway { /*定义元数
Linux各个目录的作用及内容 pda158 linux 脚本
1）根目录“/” 　　根目录位于目录结构的最顶层，用斜线（/）表示，类似于 Windows 操作系统的“C:\“，包含Fedora操作系统中所有的目录和文件。　　2）/bin 　　/bin 　　目录又称为二进制目录，包含了那些供系统管理员和普通用户使用的重要 linux命令的二进制映像。该目录存放的内容包括各种可执行文件，还有某些可执行文件的符号连接。常用的命令有：cp、d
ubuntu12.04上编译openjdk7 ol_beta HotSpot jvm jdk OpenJDK
获取源码从openjdk代码仓库获取(比较慢) 安装mercurial Mercurial是一个版本管理工具。 sudo apt-get install mercurial 将以下内容添加到$HOME/.hgrc文件中，如果没有则自己创建一个： [extensions] forest=/home/lichengwu/hgforest-crew/forest.py fe
将数据库字段转换成设计文档所需的字段 vipbooks 设计模式工作正则表达式
哈哈，出差这么久终于回来了，回家的感觉真好！ PowerDesigner的物理数据库一出来，设计文档中要改的字段就多得不计其数，如果要把PowerDesigner中的字段一个个Copy到设计文档中，那将会是一件非常痛苦的事情。