2009gis

数据库学习：数据模型

前言

数据建模就是通过减低数据库设计的复杂度得到各个方面都能理解的数据抽象，包括定义实以及它们之间的关系。接下来学习数据建模的基本概念以及数据模型的发展过程。

正题

在开始编写文章前，有几个问题需要思考一下：

什么数据模型
生成数据模型的业务规则
数据模型构成
数据模型的类别
数据模型的抽象层次

1. 什么是数据模型

数据模型（data model）是对复杂现实世界数据结构的一种简单表达，如采用图形方式。广而言之，模型是对复杂现实世界对象或事件的抽象，它能帮助我们理解现实世界的复杂性。而在数据库环境中，数据模型则是表示数据结构及其特征、关系、约束、变换以及为特定问题域提供支持的其他组成。

2. 生成数据模型的业务规则

当数据库设计人员决定使用实体、属性和联系建立数据模型时，他们首先应对企业的数据进行全面了解和分析，如企业有哪些数据种类、如何使用及何时使用这些数据等。但是，这些数据和信息本身不会对企业整个业务的了解。从数据库角度看，数据只有在其能正确反映所定义的业务规则时才有意义。业务规则（Business Rule）是对特定组织的策略、规程和准则的简要、清晰和无歧义描述。从某种意义上讲，业务规则是一个误称，实际上也可应用于存储和利用数据产生信息的任意规模组织，如企业、政府机构、宗教团体或研究所等。

业务规则来自对企业操作的详细描述，可帮助企业创建和实施具体活动，因此必须明确制定并及时更新，以正确反映企业操作环境的变化。

正确的业务规则可用于定义实体、属性、联系和约束。任何时候，当我们看到“一个代理人可以为多个客户服务，而每个客户只能由一个代理人服务”的联系描述时，那就是业务规则在发生作用。

为了提高效率，业务规则应简单易懂且广泛宣传，以确保组织中的所有人都能正确理解。业务规则是用简单语言描述从公司视觉所看到数据的特征。例如：

一个客户可以产生多张发票。
一张发票只能由一个客户产生。
少于 10 名雇员或超过 30 名雇员都不能安排培训会议。

这些业务规则可建立实体、联系和约束。

2.1 发现业务规则

业务规则的主要来源是公司经理、策略制定者、部门经理以及书面文档（如公司的规程、标准或操作手册）。一个更加快速直接获得业务规则的方法是直接同用户对话。但不幸的是，由于各个人的理解不同，当需要制定特定的业务规则时，用户显得不太靠谱。例如，维护部门的技工可能认为任何一个技工都可以启动一个维护程序，然而，事实上只有授权检查的人才能完成此项任务。这种区别看起来似乎很平常，但是可能产生重大的法律后果。虽然用户是制定业务规则的决定性因素，但是用户的理解仍需做进一步验证。如果与许多从事相同工作的人进行交流，常常会对该项工作产生不同的理解，这很可能被认为是管理上的问题。因此，这种泛泛的调查分析不能帮助数据库设计人员，他们的职责就是要协调这些差异并对产生的结果进行验证，以确保得到合适且准确的业务规则。

识别和确定业务规则对数据库设计至关重要，因为它能够：

帮助企业进行数据标准化。
为用户和设计人员提供交流工具。
帮助设计人员理解数据的本质、作用和范围。
帮助设计人员理解业务流程。
帮助设计人员开发出合适的联系参与规则和约束，并建立正确的数据模型。

当然，并不是所有的业务规则都可以被建模。

2.2 将业务规则转化成数据模型组件

业务规则为正确识别实体、属性、联系和约束提供了基础。在现实世界中，通常用名称来标识对象。如果业务环境需要保持对象的状态，那么应对其产生专门的业务规则。一般来说，业务规则中的名词可转化成数据模型中的实体，而与名词相连的动词（主动或被动）则可转化成实体之间的联系。例如，业务规则“一位客户可产生多张发票”包含两个名词（客户和发票）和一个动词（产生），我们可从中推出：

客户和发票是系统感兴趣的对象，应表示为实体。
客户和发票间存在“产生”联系。

为正确判定联系的类型，应考虑联系的双向特性。如果在上面规则的基础上在增加一条规则“一张发票只能由一位客户所产生”，那么该联系就是一对多（1:M）联系，其中客户是“一”，发票是“多”。

作为一般准则，可通过下列两个问题判定联系的类型：

有多少 B 的实例与一个 A 的实例关联？
有多少 A 的实例与一个 B 的实例关联？

3. 数据模型构成

数据模型的基本组成包括实体、属性、联系和约束。

实体（Entity）：可以是任何事物，如一个人，一个地点、一个物件或一个事件等，其数据将被收集和存储。一个实体表示现实世界中一类特定类型对象。实体是“可区分的”，即每个实体是独特且唯一的。

属性（Attribute）：用于描述实体的特征。属性等同于文件系统中的字段。

联系（Relationship）：用于描述实体之间的关联。联系有 3 种类型：一对多、多对多、一对一，可分别用符号 1：M（或 1..*）、M：N（或 *..*）和 1：1（或 1..1）表示。

4. 数据模型的类别

4.1 层次模型

层次模型诞生于 20 世纪 60 年代，主要用于复杂制造项目的大量数据管理。它的基本逻辑结构可以用一棵倒置的树表示。层次结构包含层次和段。一个段（Segment）等同于文件系统中的记录类型。在层次结构中，顶层（树根）是其直接分支段的双亲。

层次模型具有许多文件系统并不具备的优势。事实上，层次数据模型的许多特征是现代数据模型的基础，并以不同的形式应用在现在的数据库中。

4.2 网状模型

网状模型不仅比层次模型能更有效地表示复杂的数据联系。而且还能提升数据库性能和有利于推行数据库标准。为了帮助建立数据库标准，数据系统语言会议（Conference on Data Systems Languages，CODSL）在 20 世纪 60 年代末建立了一个数据库工作组（Database Task Group，DBTG），专门负责为数据库创建和数据操作定义标准规范。最终的 DBTG 报告包含了 3 个非常重要的数据库组件规范。

模式：从数据库管理员角度来看，模式是整个数据库的概念结构，它负责定义数据库名称、记录类型和由记录构成的组件。
子模式：负责定义访问数据库数据的应用程序所“看到”的数据库。子模式的存在使得应用程序只需调用子模式就能访问数据库文件。
数据管理语言（Data Management Language）：DML 负责定义管理数据的环境。

DBTG 指定了 3 个不同的 DML 组件：

模式的数据定义语言（Data Definition Language，DDL）：帮助数据库管理员定义模式组件。
子模式 DDL：帮助应用程序定义应用需要使用的数据库组件。
数据操纵语言：用于访问数据库中的数据。

在网状模型中，用户将网状数据库看做是一个由一对多联系记录组成的集合。然而，与层次模型不同，网状模型允许一条记录拥有多个双亲。在网状数据库中，一个联系称为一个集合。每个集合至少由两个记录类型构成：一个主记录和一个成员记录。一个集合代表主记录和成员记录之间的一个一对多联系。

随着信息量不断增长，人们越来越需要具有功能强大的数据库和应用程序，而网状模型越来越不能适应这种需求。而且，虽然网状数据库具有一定的数据独立性，但是数据库结构的改变仍然可能需修改相应的数据库应用程序。正是由于层次模型和网状模型存在这些不足，在 20 世纪 80 年代它们已被关系数据模型广泛替代。

4.3 关系模型

关系模型的基础是数学中的“关系”概念。简单地说，关系（Relation）有时也称为表（table），它是由交叉的行与列构成的矩阵，其中每行称为一个元组（Tuple），每列代表一个属性。同时，关系模型也描述了一组基于高级数学概念的关系数据操作集合。

关系模型通过非常复杂的关系数据库管理系统（Relation Database Management System，RDBMS）实现。RDBMS 负责完成层次和网状数据库管理系统所提供的基本功能。此外，RDBMS 还集成了其他一些功能，使得关系数据库模型更容易理解和实现。RDBMS 的最大优势在于它对用户隐藏了关系模型的复杂性。RDBMS 负责管理所有的物理细节，而用户只看到由一系列存储数据的表构成的关系数据库，它们可用直观和逻辑的方式操纵和查询数据。

关系数据库中的表与表之间是通过共享共同属性（列中的值）实现相互关联。虽然表与表是相互独立的，但是仍然可以很容易地将多个表中的数据联系起来。关系模型提供了最低水平的可控冗余，消除了文件系统中存在的大多数冗余。联系的类型（1:1，1:M 或 M:N）在关系模式中经常出现。

一个关系表是一个由相关实体组成的集合。从这个意义上讲，表就像一个文件。但是表与文件的本质区别是表所产生的数据具有结构独立性，因为它是纯粹的逻辑结构。用户和设计人员不需要关心表中的数据如何存储在数据库中。

关系数据模型取得优势的另一个原因是它提供了强大且灵活的查询语言。对大多数关系数据库软件来说，查询语言是结构化查询语言（Structured Query Language，SQL），它允许用户只说明需要做什么而不必说明如何去做。RDBMS 利用 SQL 将用户查询转化成数据检索命令。SQL 使得查询数据的代价比任何其他类型数据库或文件更小。

对用户而言，任何基于 SQL 的关系数据库应用程序都包括 3 个部分：用户接口、数据库表集合以及 SQL 引擎，具体为：

用户接口：接口主要是方便用户通过自动生成的 SQL 代码访问数据。每种接口都是数据库软件厂商提供的数据访问产品。有的数据库软件提供了应用程序生成器，以帮助用户设计个性化接口。
数据表集合：在关系数据库中，所有数据都存放在表中，以一种简单易懂的方式展现给用户。表与表之间是相互独立的，但不同表可通过公共属性的公共值互相关联。
SQL 引擎：SQL 引擎负责执行所有查询或数据请求，它是 DBMS 软件的一部分。用户可使用 SQL 创建结构、存取数据以及维护表。SQL 引擎负责处理所有的用户请求，而这大部分是在幕后进行而用户并不知情。因此，SQL 是一种声明性语言，即只需说明要做什么而不必说明如何去做。（软件中的引擎：实现了核心业务逻辑的代码）

4.4 实体联系模型

关系数据库的概念简洁性使得 RDBMS 得到了广泛使用，而且交易和信息需求的快速增长要求创建更为复杂的数据库结构。这些都要求提供更为高效的数据库设计工具。

复杂的设计活动要求使用简单的概念得到正确地结果。虽然在概念上关系模型确实比层次和网状模型有了很大程度的提高，但是它仍然不是高效的数据库设计工具。由于图形比文本更容易验证结构的正确性，因此数据库设计人员更倾向于使用图形化工具描述实体以及实体间的联系。于是，实体联系模型（Entity Relational Model，ERM）成为广泛接受的数据建模标准。

它是一种图形化表示方法，能够反映数据库结构中实体以及实体之间的联系。由于 ER 数据模型很好地弥补了关系模型概念描述的不足，因此很快就得到普及。关系模型和 ERM 一起共同奠定了结构化数据库设计的基础。

ER 模型用实体联系图（Entity Relation Diagram，ERD）表示，即运用图形对数据库组件进行建模。ER 模型主要有一下组件：

实体：如前所述，实体可以是其数据将被收集和存储的任何事物。在 ERD 图中，用矩形（也称实体盒）表示实体。实体的名称通常是名词，写在矩形中央，一般用字母书写且是单数形式。通常，当将 ERD 应用到关系模型时，一个实体对应一个关系表。关系表的每一行称为 ER 模型中的一个实体实例（Entity Instance）或实体发生（Entity Occurence）。每个实体都用一组属性描述其详细特征。
联系：联系用于描述数据之间的关联，大部分联系用于描述两个实体之间的关联。有三种类型联系：一对多（1:M），多对多（M:N）和一对一（1:1）。

4.5 面向对象模型

随着现实世界问题复杂性的不断增加，人们越来越需要能更准确描述现实世界的数据模型。面向对象数据模型（Object-oriented Data Model，OODM）是面向对象数据库管理系统（Object-oriented Database Management System，OODBMS）的基础，其数据和联系都包含在称为对象（Object）的结构中。

OODM 采用不同方式定义和使用实体。与关系模型中的实体相似，对象由其自身所包含的内容所描述。但与实体的区别是：对象不仅包含了它与其他对象之间的联系信息。因此，对象所包含的实体被赋予了更多的含义，正是由于语义可指明含义，因此 OODM 也被称作为语义数据模型。

随着 OODM 的发展，面向对象数据模型允许对象包含对它所进行的所有操作，如修改、查询以及打印数据值等。由于对象包含了数据、不同类型的联系以及操作，因此对象是自包含的，已称为自治结构的基本构件。

面向对象数据模型包含以下组件：

对象是现实世界实体的抽象。概括的说，一个对象等同于 ER 模型中的一个实体。更准确地说，一个对象只表示一个实体实例。对象的语义是由对象列表中的条目定义。
属性用于描述对象的特征。
拥有相似特征的对象组成类。类（Class）是具有共同结构（属性）和行为（方法）的一组相似对象所组成的集合。一般地，类与 ER 模型中的实体集相似。但类与实体集的不同之处在于，类包含了一组称为方法的程序。方法（Method）代表了现实世界中的行为。简言之，方法等同于传统编程语言中的过程。在面向对象的术语中，方法用于定义对象的行为。
类可组织成一个类层次结构。类层次结构像一颗倒置的树，其中每个类只有一个双亲。
继承是指类层次结构中的对象可继承其上层类的属性和方法的能力。

面向对象数据模型通常使用统一建模语言（Unified Modeling Language，UML）描述类图。UML 是基于面向对象概念的一种语言，它通过一组图像和符号对系统进行图形化建模。在较大的 UML 面向对象系统建模语言中，主要使用 UML 类图表示数据和数据之间的联系。

在数据模型发展过程中可以发现，作为一种数据模型，它必须具有下列共同特性才被人们广泛接受：

数据模型必须在不被破坏数据库语义完整性的前提下，具有一定程度上的概念简洁性。一个比现实世界还要复杂的数据模型是没有任何意义的。
数据模型必须尽可能真实的表达现实世界的特征。该目标可以通过对数据表示增加语义信息实现。语义主要关注数据的动态行为，而数据表示则组成现实世界的静态特征。
现实世界转换（行为）的表示必须符合数据模型的一致性和完整性要求。

每个新的数据模型都在克服之前模型缺点的基础上向上发展的。网状模型替代层次模型，是因为网状模型能更容易表示复杂的多对多联系。与层次和网状模型相比，关系模型具有更多的优势，如数据表示简单、更好的数据独立性以及易于使用的查询语言等，它已成为商业应用的主要数据模型。虽然 OO 和 ERDM 拥有足够坚实的根基，但是它们还不能关系模型。在将来，一个成功的数据模型必须能够管理非结构化数据，并支持通过 XML 进行数据交换。

特别需要指出的是，并非所有数据模型都是为相同目的而创建的。相反，不同数据模型具有不同的使用范围。例如，概念模型适用于高层次数据建模，而实现模型则适用于物理实现层的数据存储管理。实体联系模型是一种概念模型，而层次模型和网状模型则是实现模型。有些模型既是概念模型又是实现模型，如关系模型和 OODM。

5. 数据抽象程度

设计一个可用的数据库需要同样的抽象过程，即数据库设计人员设计出全局数据的抽象视图，然后在设计过程中逐渐添加具体细节内容，最终接近具体实现。使用不同层次的抽象对整合整个组织内不同层次的数据视图也很有帮助。美国国家标准协会（American National Standards Institute，ANSI）的标准计划和需求委员会（SPARC）定义了基于数据抽象程度的数据建模框架，它将数据抽象分为 3 个层次：外部、概念和内部。

5.1 外模型

外模型是用户数据视图。此处的用户是指通过应用程序操纵数据并产生信息的人，他们一般是在特定部分的应用环境中工作。通常，公司可分为许多部门，如销售、财务和市场等。这些部门都有各自的约束和需求，且都使用公司全局数据的子集。因此，每个部门的用户都认为他们的数据子集与公司的其他部门是分离的或者是外部的。

使用外部视图表示数据库的子集具有以下优点：

易于识别每个部门所需的特定数据；
有助于简化设计者的工作。设计者可通过外部视图检查数据模型，以确保它能支持外部模型所定义的所有处理、操作需求和约束；
有助于保证数据库安全、当每个部门只允许访问自己的数据子集时，数据库的安全不易受到破坏；
易于开发应用程序；

5.2 概念模型

确定了外部视图后，可运用 ER 图表示概念模型，概念模型用于标识整个组织的数据库全局视图，即负责将所有外部视图（实体、联系、约束和处理）整合成包含企业所有数据的单一全局视图。概念模型也称为概念模式，它是对数据对象进行识别和高层次描述的基础。

ER 模型是应用最广泛的概念模型，它利用 ER 图对数据进行图形化描述。事实上，ER 图是数据库的基本“设计蓝图”，可用于表示概念模型。

概念模型具有以下优点：

提供了一个易于理解的数据总体视图（宏观层面）。
概念模型独立于软件和硬件。软件独立性和硬件独立性意味着模型不依赖于实现该模型的 DBMS 软件和硬件，这样，无论是硬件或 DBMS 软件的改变都不会影响到概念层次数据库设计。

5.3 内模型

一旦选定了 DBMS，内模型负责将概念模型映射到 DBMS 上，内模型是指 DBMS 所“看到”的数据库结构。换言之，内模型要求设计者将概念模型的特征和约束映射到所选择的实现模型上去。内模型是用所选择的数据库结构来表示内模型。

由于内模型依赖特定的数据库软件，因此内模型是软件相关的，即当 DBMS 软件发生改变时，内模型也要随之改变，以适应数据库模型的特性和需求。然而，内模型仍然是硬件无关的，它不会受软件所安装的计算机影响。因此，存储设备的改变甚至是操作系统的变化不会影响内模型。

5.4 物理模型

物理模型位于抽象的最底层，主要用于描述数据在磁盘、磁带等物理存储介质上的保存方式。物理模型需要定义存储设备以及在这些设备上获得数据的（物理）存取方法，因此物理模型既软件相关又硬件相关。物理模型所使用的存储结构依赖于软件（DBMS 和操作系统）和计算机能处理的存储设备类型。物理模型定义的准确性要求该层次设计人员对硬件和数据库设计软件都非常熟悉。

早期的数据模型迫使数据库设计人员不得不考虑物理模型中的数据存储细节。而现在的关系模型更注重逻辑层次上的设计而不是物理层次，因此，关系模型不要求设计物理层次细节。

虽然关系模型不要求设计人员关注数据的物理存储特性，但是为了提高系统性能，关系模型可能需要在物理层次进行调优。特别是大型机环境下的海量数据库，性能调优显得尤其重要。即便如此，物理层次上的性能调优也不需清楚物理数据的存储特性。

物理模型主要依赖于 DBMS、存取文件的方法以及操作系统所支持的硬件存储设备。物理模型发生改变但不影响内模型，称之为物理独立性。因此，存储设备或方法甚至是操作系统的改变都不会影响到内模型。

Google earth studio 简介陟彼高冈yu 旅游
GoogleEarthStudio是一个基于Web的动画工具，专为创作使用GoogleEarth数据的动画和视频而设计。它利用了GoogleEarth强大的三维地图和卫星影像数据库，使用户能够轻松地创建逼真的地球动画、航拍视频和动态地图可视化。网址为https://www.google.com/earth/studio/。GoogleEarthStudio是一个基于Web的动画工具，专为创作使用G
关于提高复杂业务逻辑代码可读性的思考编程经验分享开发经验 java 数据库开发语言
目录前言需求场景常规写法拆分方法领域对象总结前言实际工作中大部分时间都是在写业务逻辑，一般都是三层架构，表示层（Controller）接收客户端请求，并对入参做检验，业务逻辑层（Service）负责处理业务逻辑，一般开发都是在这一层中写具体的业务逻辑。数据访问层（Dao）是直接和数据库交互的，用于查数据给业务逻辑层，或者是将业务逻辑层处理后的数据写入数据库。简单的增删改查接口不用多说，基本上写好一
SQL Server_查询某一数据库中的所有表的内容 qq_42772833 SQL Server 数据库 sqlserver
1.查看所有表的表名要列出CrabFarmDB数据库中的所有表（名），可以使用以下SQL语句：USECrabFarmDB;--切换到目标数据库GOSELECTTABLE_NAMEFROMINFORMATION_SCHEMA.TABLESWHERETABLE_TYPE='BASETABLE';对这段SQL脚本的解释：SELECTTABLE_NAME：这个语句的作用是从查询结果中选择TABLE_NAM
深入理解 MultiQueryRetriever：提升向量数据库检索效果的强大工具 nseejrukjhad 数据库 python
深入理解MultiQueryRetriever：提升向量数据库检索效果的强大工具引言在人工智能和自然语言处理领域，高效准确的信息检索一直是一个关键挑战。传统的基于距离的向量数据库检索方法虽然广泛应用，但仍存在一些局限性。本文将介绍一种创新的解决方案：MultiQueryRetriever，它通过自动生成多个查询视角来增强检索效果，提高结果的相关性和多样性。MultiQueryRetriever的工
MongoDB Oplog 窗口喝醉酒的小白 MongoDB 运维
在MongoDB中，oplog（操作日志）是一个特殊的日志系统，用于记录对数据库的所有写操作。oplog允许副本集成员（通常是从节点）应用主节点上已经执行的操作，从而保持数据的一致性。它是MongoDB副本集实现数据复制的基础。MongoDBOplog窗口oplog窗口是指在MongoDB副本集中，从节点可以用来同步数据的时间范围。这个窗口通常由以下因素决定：Oplog大小：oplog的大小是有限
python os 环境变量 CV矿工 python 开发语言 numpy
环境变量：环境变量是程序和操作系统之间的通信方式。有些字符不宜明文写进代码里，比如数据库密码，个人账户密码，如果写进自己本机的环境变量里，程序用的时候通过os.environ.get（）取出来就行了。os.environ是一个环境变量的字典。环境变量的相关操作importos"""设置/修改环境变量：os.environ[‘环境变量名称’]=‘环境变量值’#其中key和value均为string类
【PG】常见数据库、表属性设置江无羡数据库
PG的常见属性配置方法数据库复制、备份相关表的复制标识单表操作批量表操作链接数据库复制、备份相关表的复制标识单表操作通过ALTER语句单独更改一张表的复制标识。ALTERTABLE[tablename]REPLICAIDENTITYFULL;批量表操作通过代码块的方式，对某个schema中的所有表一起更新其复制标识。SELECTtablename,CASErelreplidentWHEN'd'TH
nosql数据库技术与应用知识点皆过客，揽星河 NoSQL nosql 数据库大数据数据分析数据结构非关系型数据库
Nosql知识回顾大数据处理流程数据采集(flume、爬虫、传感器)数据存储(本门课程NoSQL所处的阶段)Hdfs、MongoDB、HBase等数据清洗(入仓)Hive等数据处理、分析(Spark、Flink等)数据可视化数据挖掘、机器学习应用(Python、SparkMLlib等)大数据时代存储的挑战(三高)高并发(同一时间很多人访问)高扩展(要求随时根据需求扩展存储)高效率(要求读写速度快)
insert into select 主键自增_mybatis拦截器实现主键自动生成 weixin_39521651 insert into select 主键自增 mybatis delete返回值 mybatis insert返回主键 mybatis insert返回对象 mybatis plus insert返回主键 mybatis plus 插入生成id
前言前阵子和朋友聊天，他说他们项目有个需求，要实现主键自动生成，不想每次新增的时候，都手动设置主键。于是我就问他，那你们数据库表设置主键自动递增不就得了。他的回答是他们项目目前的id都是采用雪花算法来生成，因此为了项目稳定性，不会切换id的生成方式。朋友问我有没有什么实现思路，他们公司的orm框架是mybatis，我就建议他说，不然让你老大把mybatis切换成mybatis-plus。mybat
关于Mysql 中 Row size too large (＞ 8126) 错误的解决和理解秋刀prince mysql mysql 数据库
提示：啰嗦一嘴，数据库的任何操作和验证前，一定要记得先备份！！！不会有错；文章目录问题发现一、问题导致的可能原因1、页大小2、行格式2.1compact格式2.2Redundant格式2.3Dynamic格式2.4Compressed格式3、BLOB和TEXT列二、解决办法1、修改页大小（不推荐）2、修改行格式3、修改数据类型为BLOB和TEXT列4、其他优化方式（可以参考使用）4.1合理设置数据
Java爬虫框架（一）--架构设计狼图腾-狼之传说 java 框架 java 任务 html解析器存储电子商务
一、架构图那里搜网络爬虫框架主要针对电子商务网站进行数据爬取，分析，存储，索引。爬虫：爬虫负责爬取，解析，处理电子商务网站的网页的内容数据库：存储商品信息索引：商品的全文搜索索引Task队列：需要爬取的网页列表Visited表：已经爬取过的网页列表爬虫监控平台：web平台可以启动，停止爬虫，管理爬虫，task队列，visited表。二、爬虫1.流程1)Scheduler启动爬虫器，TaskMast
MongoDB知识概括 GeorgeLin98 持久层 mongodb
MongoDB知识概括MongoDB相关概念单机部署基本常用命令索引-IndexSpirngDataMongoDB集成副本集分片集群安全认证MongoDB相关概念业务应用场景：传统的关系型数据库（如MySQL），在数据操作的“三高”需求以及应对Web2.0的网站需求面前，显得力不从心。解释：“三高”需求：①Highperformance-对数据库高并发读写的需求。②HugeStorage-对海量数
Mongodb Error: queryTxt ETIMEOUT xxxx.wwwdz.mongodb.net 佛一脚 error react mongodb 数据库
背景每天都能遇到奇怪的问题，做个记录，以便有缘人能得到帮助！换了一台电脑开发nextjs程序。需要连接mongodb数据，对数据进行增删改查。上一台电脑好好的程序，新电脑死活连不上mongodb数据库。同一套代码，没任何修改，搞得我怀疑人生了，打开浏览器进入mongodb官网毫无问题，也能进入线上系统查看数据，网络应该是没问题。于是我尝试了一下手机热点，这次代码能正常跑起来，连接数据库了！！！是不
入门MySQL——查询语法练习 K_un
前言：前面几篇文章为大家介绍了DML以及DDL语句的使用方法，本篇文章将主要讲述常用的查询语法。其实MySQL官网给出了多个示例数据库供大家实用查询，下面我们以最常用的员工示例数据库为准，详细介绍各自常用的查询语法。1.员工示例数据库导入官方文档员工示例数据库介绍及下载链接：https://dev.mysql.com/doc/employee/en/employees-installation.h
博客网站制作教程 2401_85194651 java maven
首先就是技术框架：后端：Java+SpringBoot数据库：MySQL前端：Vue.js数据库连接：JPA(JavaPersistenceAPI)1.项目结构blog-app/├──backend/│├──src/main/java/com/example/blogapp/││├──BlogApplication.java││├──config/│││└──DatabaseConfig.java
ubuntu安装wordpress lissettecarlr
1安装nginx网上安装方式很多，这就就直接用apt-get了apt-getinstallnginx不用启动啥，然后直接在浏览器里面输入IP:80就能看到nginx的主页了。如果修改了一些配置可以使用下列命令重启一下systemctlrestartnginx.service2安装mysql输入安装前也可以更新一下软件源，在安装过程中将会让你输入数据库的密码。sudoapt-getinstallmy
深入浅出 -- 系统架构之负载均衡Nginx的性能优化 xiaoli8748_软件开发系统架构系统架构负载均衡 nginx
一、Nginx性能优化到这里文章的篇幅较长了，最后再来聊一下关于Nginx的性能优化，主要就简单说说收益最高的几个优化项，在这块就不再展开叙述了，毕竟影响性能都有多方面原因导致的，比如网络、服务器硬件、操作系统、后端服务、程序自身、数据库服务等，对于性能调优比较感兴趣的可以参考之前《JVM性能调优》中的调优思想。优化一：打开长连接配置通常Nginx作为代理服务，负责分发客户端的请求，那么建议开启H
【RabbitMQ 项目】服务端：数据管理模块之绑定管理月夜星辉雪 rabbitmq 分布式
文章目录一.编写思路二.代码实践一.编写思路定义绑定信息类交换机名称队列名称绑定关键字：交换机的路由交换算法中会用到没有是否持久化的标志，因为绑定是否持久化取决于交换机和队列是否持久化，只有它们都持久化时绑定才需要持久化。绑定就好像一根绳子，两端连接着交换机和队列，当一方不存在，它就没有存在的必要了定义绑定持久化类构造函数：如果数据库文件不存在则创建，打开数据库，创建binding_table插入
计算机毕业设计PHP仓储综合管理系统（源码+程序+VUE+lw+部署） java毕设程序源码王哥 php 课程设计 vue.js
该项目含有源码、文档、程序、数据库、配套开发软件、软件安装教程。欢迎交流项目运行环境配置：phpStudy+Vscode+Mysql5.7+HBuilderX+Navicat11+Vue+Express。项目技术：原生PHP++Vue等等组成，B/S模式+Vscode管理+前后端分离等等。环境需要1.运行环境：最好是小皮phpstudy最新版，我们在这个版本上开发的。其他版本理论上也可以。2.开发
3.增删改查--连接查询问女何所忆
关系型数据库的一个特点就是，多张表之间存在关系，以致于我们可以连接多张表进行查询操作，所以连接查询会是关系型数据库中最常见的操作。连接查询主要分为三种，交叉连接、内连接和外连接，我们一个个说。1、交叉连接交叉连接其实连接查询的第一个阶段，它简单表现为两张表的笛卡尔积形式，具体例子：如果你没学过数学中的笛卡尔积概念，你可以这样简单的理解这里的交叉连接：两张表的交叉连接就是一个连接合并的过程，T1表中
docker from指令的含义_多个FROM-含义 weixin_39722188 docker from指令的含义
小编典典什么是基本图片？一组文件，加上EXPOSE端口ENTRYPOINT和CMD。您可以添加文件并基于该基础图像构建新图像，Dockerfile并以FROM指令开头：后面提到的图像FROM是新图像的“基础图像”。这是否意味着如果我neo4j/neo4j在FROM指令中声明，则在运行映像时，neo数据库将自动运行并且可在端口7474的容器中使用？仅当您不覆盖CMD和时ENTRYPOINT。但是图像
Redis:缓存击穿我的程序快快跑啊缓存 redis java
缓存击穿(热点key)：部分key(被高并发访问且缓存重建业务复杂的)失效,无数请求会直接到数据库，造成巨大压力1.互斥锁：可以保证强一致性线程一：未命中之后，获取互斥锁，再查询数据库重建缓存，写入缓存，释放锁线程二：查询未命中，未获得锁(已由线程一获得)，等待一会，缓存命中互斥锁实现方式：redis中setnxkeyvalue:改变对应key的value,仅当value不存在时执行，以此来实现互
mysql学习教程，从入门到精通，TOP 和MySQL LIMIT 子句（15）知识分享小能手大数据数据库 MySQL mysql 学习 oracle 数据库开发语言 adb 大数据
1、TOP和MySQLLIMIT子句内容在SQL中，不同的数据库系统对于限制查询结果的数量有不同的实现方式。TOP关键字主要用于SQLServer和Access数据库中，而LIMIT子句则主要用于MySQL、PostgreSQL（通过LIMIT/OFFSET语法）、SQLite等数据库中。下面将分别详细介绍这两个功能的语法、语句以及案例。1.1、TOP子句（SQLServer和Access）1.1
ERROR 1064 (42000): You have an error in your SQL syntax; check the manual that corresponds to your †徐先森® Oracle数据库 Web相关错误集
createtablestudents(idintunsignedprimarykeyauto_increment,namevarchar(50)notnull,ageintunsigned,highdecimal(3,2),genderenum('男','女','中性','保密','妖')default'保密',cls_idintunsigned);在对数据库插入如上带有中文带有默认值的字段的时
Redis 有哪些危险命令？如何防范？花小疯 redis 缓存数据库危险命令大数据
Redis有哪些危险命令？Redis的危险命令主要有以下几个：1.keys客户端可查询出所有存在的键。2.flushdb删除Redis中当前所在数据库中的所有记录，并且此命令从不会执行失败。3.flushall删除Redis中所有数据库中的所有记录，不止是当前所在数据库，并且此命令从不会执行失败。4.config客户端可修改Redis配置。怎么禁用和重命名危险命令？看下redis.conf默认配置
【Golang】 Golang 的 GORM 库中的 Rows 函数不爱洗脚的小滕 golang 开发语言后端
文章目录前言一、Rows函数解释二、代码实现三、总结前言在使用Go语言进行数据库操作时，GORM（GoObject-RelationalMapping）库是一个常用的工具。它提供了一种简洁和强大的方式来处理数据库操作。本文将介绍GORM库中的Rows函数，这是一个用于执行原生SQL查询并返回结果的函数。一、Rows函数解释在GORM库中，Rows函数用于执行原生SQL查询并返回*sql.Rows结
接口测试如何设计测试用例李蕴Ronnie
接口测试用例设计方式针对每个必填参数，都设计一条参数为空的测试用例必填参数不存在传的参数值在数据库中不存在添加数据接口，传入已有的数据重复添加编辑数据接口，各个字段分别编辑，合并编辑参数数据类型限制，针对每个参数设计一条参数值类型不符合的逆向用例参数自身取值范围，针对所有参数，设计一条每个参数值在取值范围内最大值的正向测试用例是否满足前提条件（token、headers），几个前提条件几条用例针对
Hadoop架构 henan程序媛 hadoop 大数据分布式
一、案列分析1.1案例概述现在已经进入了大数据(BigData)时代，数以万计用户的互联网服务时时刻刻都在产生大量的交互，要处理的数据量实在是太大了，以传统的数据库技术等其他手段根本无法应对数据处理的实时性、有效性的需求。HDFS顺应时代出现，在解决大数据存储和计算方面有很多的优势。1.2案列前置知识点1.什么是大数据大数据是指无法在一定时间范围内用常规软件工具进行捕捉、管理和处理的大量数据集合，
非关系型数据库天秤-white nosql
一、为什么要用Nosql1.单机MySQL的时代。一个基本的网站访问量一般不会太大，单个数据库完全足够。那时候更多使用的静态网页html，服务器根本没有太大压力。这时候网站的瓶颈是什么？-数据量如果太大，一个机器放不下。-数据量太大需要建立数据的索引（B+Tree），一个服务器内存放不下。-访问量读写混合，一个服务器承受不了。2.memcached缓存+MySQL+垂直拆分（读写分离）。网站80%
六、全局锁和表锁：给表加个字段怎么有这么多阻碍 nieniemin
数据库锁设计的初衷是处理并发问题。作为多用户共享的资源，当出现并发访问的时候，数据库需要合理地控制资源的访问规则。而锁就是用来实现这些访问规则的重要数据结构。根据加锁的范围，MySQL里面的锁大致可以分成全局锁、表级锁和行锁三类。6.1全局锁全局锁就是对整个数据库实例加锁。MySQL提供了一个加全局读锁的方法，命令是Flushtableswithreadlock(FTWRL)。当你需要让整个库处于
Nginx负载均衡 510888780 nginx 应用服务器
Nginx负载均衡一些基础知识: nginx 的 upstream目前支持 4 种方式的分配 1)、轮询（默认）每个请求按时间顺序逐一分配到不同的后端服务器，如果后端服务器down掉，能自动剔除。 2)、weight 指定轮询几率，weight和访问比率成正比
RedHat 6.4 安装 rabbitmq bylijinnan erlang rabbitmq redhat
在 linux 下安装软件就是折腾，首先是测试机不能上外网要找运维开通，开通后发现测试机的 yum 不能使用于是又要配置 yum 源，最后安装 rabbitmq 时也尝试了两种方法最后才安装成功机器版本： [root@redhat1 rabbitmq]# lsb_release LSB Version: :base-4.0-amd64:base-4.0-noarch:core
FilenameUtils工具类 eksliang FilenameUtils common-io
转载请出自出处：http://eksliang.iteye.com/blog/2217081 一、概述这是一个Java操作文件的常用库，是Apache对java的IO包的封装，这里面有两个非常核心的类FilenameUtils跟FileUtils，其中FilenameUtils是对文件名操作的封装;FileUtils是文件封装，开发中对文件的操作，几乎都可以在这个框架里面找到。非常的好用。
xml文件解析SAX 不懂事的小屁孩 xml
xml文件解析:xml文件解析有四种方式， 1.DOM生成和解析XML文档(SAX是基于事件流的解析) 2.SAX生成和解析XML文档(基于XML文档树结构的解析) 3.DOM4J生成和解析XML文档 4.JDOM生成和解析XML 本文章用第一种方法进行解析，使用android常用的DefaultHandler import org.xml.sax.Attributes;
通过定时任务执行mysql的定期删除和新建分区，此处是按日分区酷的飞上天空 mysql
使用python脚本作为命令脚本，linux的定时任务来每天定时执行 #!/usr/bin/python # -*- coding: utf8 -*- import pymysql import datetime import calendar #要分区的表 table_name = 'my_table' #连接数据库的信息 host,user,passwd,db =
如何搭建数据湖架构？听听专家的意见蓝儿唯美架构
Edo Interactive在几年前遇到一个大问题：公司使用交易数据来帮助零售商和餐馆进行个性化促销，但其数据仓库没有足够时间去处理所有的信用卡和借记卡交易数据 “我们要花费27小时来处理每日的数据量，”Edo主管基础设施和信息系统的高级副总裁Tim Garnto说道：“所以在2013年，我们放弃了现有的基于PostgreSQL的关系型数据库系统，使用了Hadoop集群作为公司的数
spring学习——控制反转与依赖注入 a-john spring
控制反转（Inversion of Control，英文缩写为IoC）是一个重要的面向对象编程的法则来削减计算机程序的耦合问题，也是轻量级的Spring框架的核心。控制反转一般分为两种类型，依赖注入（Dependency Injection，简称DI）和依赖查找（Dependency Lookup）。依赖注入应用比较广泛。
用spool+unixshell生成文本文件的方法 aijuans xshell
例如我们把scott.dept表生成文本文件的语句写成dept.sql,内容如下: 　　set pages 50000; 　　set lines 200; 　　set trims on; 　　set heading off; 　　spool /oracle_backup/log/test/dept.lst; 　　select deptno||','||dname||','||loc
1、基础--名词解析(OOA/OOD/OOP) asia007 学习基础知识
OOA:Object-Oriented Analysis（面向对象分析方法）是在一个系统的开发过程中进行了系统业务调查以后，按照面向对象的思想来分析问题。OOA与结构化分析有较大的区别。OOA所强调的是在系统调查资料的基础上，针对OO方法所需要的素材进行的归类分析和整理，而不是对管理业务现状和方法的分析。　　OOA（面向对象的分析）模型由5个层次（主题层、对象类层、结构层、属性层和服务层）
浅谈java转成json编码格式技术百合不是茶 json编码 java转成json编码
json编码;是一个轻量级的数据存储和传输的语言在java中需要引入json相关的包,引包方式在工程的lib下就可以了 JSON与JAVA数据的转换（JSON 即 JavaScript Object Natation，它是一种轻量级的数据交换格式，非常适合于服务器与 JavaScript 之间的数据的交
web.xml之Spring配置(基于Spring+Struts+Ibatis) bijian1013 java web.xml SSI spring配置
指定Spring配置文件位置 <context-param> <param-name>contextConfigLocation</param-name> <param-value> /WEB-INF/spring-dao-bean.xml,/WEB-INF/spring-resources.xml, /WEB-INF/
Installing SonarQube（Fail to download libraries from server） sunjing Install Sonar
1. Download and unzip the SonarQube distribution 2. Starting the Web Server The default port is "9000" and the context path is "/". These values can be changed in &l
【MongoDB学习笔记十一】Mongo副本集基本的增删查 bit1129 mongodb
一、创建复本集假设mongod,mongo已经配置在系统路径变量上，启动三个命令行窗口，分别执行如下命令： mongod --port 27017 --dbpath data1 --replSet rs0 mongod --port 27018 --dbpath data2 --replSet rs0 mongod --port 27019 -
Anychart图表系列二之执行Flash和HTML5渲染白糖_ Flash
今天介绍Anychart的Flash和HTML5渲染功能 HTML5 Anychart从6.0第一个版本起，已经逐渐开始支持各种图的HTML5渲染效果了，也就是说即使你没有安装Flash插件，只要浏览器支持HTML5，也能看到Anychart的图形（不过这些是需要做一些配置的）。这里要提醒下大家，Anychart6.0版本对HTML5的支持还不算很成熟，目前还处于
Laravel版本更新异常4.2.8-> 4.2.9 Declaration of ... CompilerEngine ... should be compa bozch laravel
昨天在为了把laravel升级到最新的版本，突然之间就出现了如下错误： ErrorException thrown with message "Declaration of Illuminate\View\Engines\CompilerEngine::handleViewException() should be compatible with Illuminate\View\Eng
编程之美-NIM游戏分析-石头总数为奇数时如何保证先动手者必胜 bylijinnan 编程之美
import java.util.Arrays; import java.util.Random; public class Nim { /**编程之美 NIM游戏分析问题：有N块石头和两个玩家A和B，玩家A先将石头随机分成若干堆，然后按照BABA...的顺序不断轮流取石头，能将剩下的石头一次取光的玩家获胜，每次取石头时，每个玩家只能从若干堆石头中任选一堆，
lunce创建索引及简单查询 chengxuyuancsdn 查询创建索引 lunce
import java.io.File; import java.io.IOException; import org.apache.lucene.analysis.Analyzer; import org.apache.lucene.analysis.standard.StandardAnalyzer; import org.apache.lucene.document.Docume
[IT与投资]坚持独立自主的研究核心技术 comsci it
和别人合作开发某项产品....如果互相之间的技术水平不同,那么这种合作很难进行,一般都会成为强者控制弱者的方法和手段..... 所以弱者,在遇到技术难题的时候,最好不要一开始就去寻求强者的帮助,因为在我们这颗星球上,生物都有一种控制其
flashback transaction闪回事务查询 daizj oracle sql 闪回事务
闪回事务查询有别于闪回查询的特点有以下3个：（1）其正常工作不但需要利用撤销数据，还需要事先启用最小补充日志。（2）返回的结果不是以前的“旧”数据，而是能够将当前数据修改为以前的样子的撤销SQL（Undo SQL）语句。（3）集中地在名为flashback_transaction_query表上查询，而不是在各个表上通过“as of”或“vers
Java I/O之FilenameFilter类列举出指定路径下某个扩展名的文件游其是你 FilenameFilter
这是一个FilenameFilter类用法的例子，实现的列举出“c:\\folder“路径下所有以“.jpg”扩展名的文件。 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28
C语言学习五函数，函数的前置声明以及如何在软件开发中合理的设计函数来解决实际问题 dcj3sjt126com c
# include <stdio.h> int f(void) //括号中的void表示该函数不能接受数据，int表示返回的类型为int类型 { return 10; //向主调函数返回10 } void g(void) //函数名前面的void表示该函数没有返回值 { //return 10; //error 与第8行行首的void相矛盾 } in
今天在测试环境使用yum安装，遇到一个问题： Error: Cannot retrieve metalink for repository: epel. Pl dcj3sjt126com centos
今天在测试环境使用yum安装，遇到一个问题： Error: Cannot retrieve metalink for repository: epel. Please verify its path and try again 处理很简单，修改文件“/etc/yum.repos.d/epel.repo”，将baseurl的注释取消， mirrorlist注释掉。即可。 &n
单例模式 shuizhaosi888 单例模式
单例模式懒汉式 public class RunMain { /** * 私有构造 */ private RunMain() { } /** * 内部类，用于占位，只有 */ private static class SingletonRunMain { priv
Spring Security（09）——Filter 234390216 Spring Security
Filter 目录 1.1 Filter顺序 1.2 添加Filter到FilterChain 1.3 DelegatingFilterProxy 1.4 FilterChainProxy 1.5
公司项目NODEJS实践0.1 逐行分析JS源代码 mongodb nginx ubuntu nodejs
一、前言前端如何独立用nodeJs实现一个简单的注册、登录功能，是不是只用nodejs+sql就可以了？其实是可以实现，但离实际应用还有距离，那要怎么做才是实际可用的。网上有很多nod
java.lang.Math liuhaibo_ljf java Math lang
System.out.println(Math.PI); System.out.println(Math.abs(1.2)); System.out.println(Math.abs(1.2)); System.out.println(Math.abs(1)); System.out.println(Math.abs(111111111)); System.out.println(Mat
linux下时间同步 nonobaba ntp
今天在linux下做hbase集群的时候，发现hmaster启动成功了，但是用hbase命令进入shell的时候报了一个错误 PleaseHoldException: Master is initializing，查看了日志，大致意思是说master和slave时间不同步，没办法，只好找一种手动同步一下，后来发现一共部署了10来台机器，手动同步偏差又比较大，所以还是从网上找现成的解决方
ZooKeeper3.4.6的集群部署 roadrunners zookeeper 集群部署
ZooKeeper是Apache的一个开源项目，在分布式服务中应用比较广泛。它主要用来解决分布式应用中经常遇到的一些数据管理问题，如：统一命名服务、状态同步、集群管理、配置文件管理、同步锁、队列等。这里主要讲集群中ZooKeeper的部署。 1、准备工作我们准备3台机器做ZooKeeper集群，分别在3台机器上创建ZooKeeper需要的目录。数据存储目录
Java高效读取大文件 tomcat_oracle java
　　读取文件行的标准方式是在内存中读取，Guava 和Apache Commons IO都提供了如下所示快速读取文件行的方法：　　Files.readLines(new File(path), Charsets.UTF_8); 　　FileUtils.readLines(new File(path)); 　　这种方法带来的问题是文件的所有行都被存放在内存中，当文件足够大时很快就会导致
微信支付api返回的xml转换为Map的方法 xu3508620 xml map 微信api
举例如下： <xml> <return_code><![CDATA[SUCCESS]]></return_code> <return_msg><![CDATA[OK]]></return_msg> <appid><