高如风

mysql索引优化系列（一）

一、不常见的索引失效场景

1、举例

还是之前的member会员记录表，往里面插入十万条数据

drop procedure if exists insert_emp;
CREATE PROCEDURE insert_emp () BEGIN
	DECLARE
		i INT;
	
	SET i = 1;
	WHILE
			( i <= 100000 ) DO
			INSERT INTO member ( NAME, age, address, create_time )
		VALUES
			( CONCAT( 'gaorufeng', i ), i, 'test', NOW() );
		
		SET i = i + 1;
		
	END WHILE;
END;


call insert_emp();

联合索引有些可能不会走索引

KEY `idx_name_age_address` (`name`,`age`,`address`)
EXPLAIN SELECT * FROM member WHERE name > 'gaorufeng' AND age = 22 AND address ='guangzhou';
EXPLAIN SELECT * FROM member WHERE name > 'test' AND age = 22 AND address ='guangzhou';
据我推测，因为在底层联合索引树上都含有gaorufeng字符，mysql底层认为匹配的数据比较多，需要回表的次数也多，所以最终没有用到；而使用test字符做name条件时，mysql觉得可能找到结果集比较少，需要回表的次数也少，所以最终选择用联合索引的name字段

强制走索引和忽略索引

EXPLAIN SELECT * FROM member force index(idx_name_age_address) WHERE name > 'gaorufeng' AND age = 22 AND address ='guangzhou';
EXPLAIN SELECT * FROM member ignore index(idx_name_age_address)WHERE name > 'test' AND age = 22 AND address ='guangzhou';
第一条sql：一般情况下我们认为走索引一定会比不走索引要快，而强制走索引其实不然，mysql底层是通过分析选择走不走索引，前面已经讲到，联合索引过滤的结果集越大，回表次数越多，最后还不如全表扫描；

第二条sql：系统用了索引而强制不走索引，一般没人会这么做

使用覆盖索引优化

EXPLAIN SELECT id,name,age,address FROM member WHERE name > 'gaorufeng' AND age = 22 AND address ='guangzhou';
把所有的查询字段都在联合索引树上找到

in和or在数据量大的情况下会走索引

EXPLAIN SELECT * FROM member WHERE (name = 'test1' or name = 'test2') AND age = 22 AND address ='guangzhou';
EXPLAIN SELECT * FROM member_copy WHERE (name = 'test1' or name = 'test2') AND age = 22 AND address ='guangzhou';

EXPLAIN SELECT * FROM member WHERE name in ( 'test1', 'test2') AND age = 22 AND address ='guangzhou';
EXPLAIN SELECT * FROM member_copy WHERE name  in ('test1', 'test2') AND age = 22 AND address ='guangzhou';
这种数据量大情况会走索引，但是in和or条件不要太多了，如果太多，那联合索引过滤的结果集大，回表次数多也不会走索引；member_copy表数据量少全表扫描快

like 'x%'可能野不会用到索引

EXPLAIN SELECT * FROM member WHERE name like 'gaorufeng%' AND age = 22 AND address ='guangzhou';
EXPLAIN SELECT * FROM member WHERE name like 'test%' AND age = 22 AND address ='guangzhou';
还是和之前的大于一样，如果在联合索引树上匹配了很多数据，那么回表次数过多就会走全表扫描；而如果找到数量较少，回表次数少，就会用到索引；

另外我觉得联合索引左边字段范围查询，下一个字段是无序的，；而like 'x%'已经确定了前缀，mysql底层也会根据前缀做一下排序，所以下一个字段是有序的，所以范围查询后面的字段用不到索引，like 'x%'可以用到

2、索引下推（Index Condition Pushdown，ICP）

mysql5.6引入的索引下推，旨在减少联合索引回表次数

EXPLAIN SELECT * FROM member WHERE name like 'gaorufeng%' AND age = 22 AND address ='guangzhou';

mysql5.6版本之前的执行过程：首先根据name like 'gaorufeng%'条件找到结果集直接回表到主键索引树上，找到结果集后再判断age、address是否相等

mysql5.6版本和之后版本的执行过程：还是跟之前一样根据like查找，这个时候它会再根据联合索引后面的字段条件筛选，然后回表，这样可以过滤掉一些结果集，减少回表次数，提高查询效率（如果在开发过程中联合索引后面字段用到了索引，就有可能是mysql底层使用了索引下推）

二、mysql选择索引

1、索引合并机制

在mysql5.0之前一个表的一次查询只能有一个索引被用到，自mysql5.1版本开始，引入了index merge技术，当一个查询用到多个索引，mysql底层会同时在两颗或者多颗索引树上查询结果集后，把主键id值汇总取交集，然后回表，这样可以减少不必要的回表，这里不做赘述了，我好累

2、trace工具

EXPLAIN select * from member where name > 'gaorufeng';#查询所有数据 需要联合索引树上进行范围查询结果集回表 回表次数多因而选择全表扫描
EXPLAIN select id,name,age,address from member where name > 'gaorufeng';#查询字段数据在联合索引上都有 不需要回表所以走了索引
EXPLAIN select * from member where name > 'test';#mysql觉得通过test查询出来的结果集较少 回表次数较少 所以还是用了索引

用trace工具分析：

set session optimizer_trace="enabled=on",end_markers_in_json=on; #开启trace
select * from member where name > 'gaorufeng' order by address;
SELECT * FROM information_schema.OPTIMIZER_TRACE;

复制TRACE字段的值，展示如下：

{
  "steps": [
    {
      "join_preparation": { /* 准备阶段 */
        "select#": 1,
        "steps": [
          {
            "expanded_query": "/* select#1 */ select `member`.`id` AS `id`,`member`.`name` AS `name`,`member`.`age` AS `age`,`member`.`address` AS `address`,`member`.`create_time` AS `create_time` from `member` where (`member`.`name` > 'gaorufeng') order by `member`.`address`"
          }
        ] /* steps */
      } /* join_preparation */
    },
    {
      "join_optimization": { /* 优化阶段 */
        "select#": 1,
        "steps": [
          {
            "condition_processing": { /* 条件处理 */
              "condition": "WHERE",
              "original_condition": "(`member`.`name` > 'gaorufeng')",
              "steps": [
                {
                  "transformation": "equality_propagation",
                  "resulting_condition": "(`member`.`name` > 'gaorufeng')"
                },
                {
                  "transformation": "constant_propagation",
                  "resulting_condition": "(`member`.`name` > 'gaorufeng')"
                },
                {
                  "transformation": "trivial_condition_removal",
                  "resulting_condition": "(`member`.`name` > 'gaorufeng')"
                }
              ] /* steps */
            } /* condition_processing */
          },
          {
            "table_dependencies": [ /* 表依赖数据 */
              {
                "table": "`member`",
                "row_may_be_null": false,
                "map_bit": 0,
                "depends_on_map_bits": [
                ] /* depends_on_map_bits */
              }
            ] /* table_dependencies */
          },
          {
            "ref_optimizer_key_uses": [
            ] /* ref_optimizer_key_uses */
          },
          {
            "rows_estimation": [ /* 估算扫描的行数，查询的代价 */
              {
                "table": "`member`",
                "range_analysis": {
                  "table_scan": { /* 如果全表扫描的话，可能需要扫描多少行 */
                    "rows": 97393, /* 估算的扫描行 */
                    "cost": 19834 /* 估算的扫描成本 */
                  } /* table_scan */,
                  "potential_range_indices": [ /* 表中可能用到的索引 */
                    {
                      "index": "PRIMARY", /* 索引名称 */
                      "usable": false, /* 是否使用 */
                      "cause": "not_applicable" /* 原因 */
                    },
                    {
                      "index": "idx_name_age_address",
                      "usable": true, /* 可能使用二级索引 */
                      "key_parts": [
                        "name",
                        "age",
                        "address",
                        "id"
                      ] /* key_parts */
                    }
                  ] /* potential_range_indices */,
                  "setup_range_conditions": [ /* 如果有可下推的条件，则带条件考虑范围查询 */
                  ] /* setup_range_conditions */,
                  "group_index_range": { /* 当使用了GROUP BY或DISTINCT时，是否有合适的索引 */
                    "chosen": false,
                    "cause": "not_group_by_or_distinct" /* 原因 */
                  } /* group_index_range */,
                  "analyzing_range_alternatives": { /* 分析range范围查询索引使用成本 */
                    "range_scan_alternatives": [ /* 范围扫描选择 */
                      {
                        "index": "idx_name_age_address", /* 索引名 */
                        "ranges": [ /* range扫描的条件范围 */
                          "gaorufeng < name"
                        ] /* ranges */,
                        "index_dives_for_eq_ranges": true,
                        "rowid_ordered": false, /* 使用该索引获取的记录是否按照主键排序 */
                        "using_mrr": false,
                        "index_only": false, /* 表示是否使用了覆盖索引 */
                        "rows": 48696, /* 索引扫描行数 */
                        "cost": 58436, /* 索引扫描成本 */
                        "chosen": false, /* 是否使用该索引 */
                        "cause": "cost"
                      }
                    ] /* range_scan_alternatives */,
                    "analyzing_roworder_intersect": { /* 分析是否使用了索引合并，如果未使用，则会给出cause */
                      "usable": false,
                      "cause": "too_few_roworder_scans"
                    } /* analyzing_roworder_intersect */
                  } /* analyzing_range_alternatives */
                } /* range_analysis */
              }
            ] /* rows_estimation */
          },
          {
            "considered_execution_plans": [ /* 对比各个扫描计划的开销，选择相对最优的执行计划 */
              {
                "plan_prefix": [
                ] /* plan_prefix */,
                "table": "`member`",
                "best_access_path": { /* 最优的访问路径 */
                  "considered_access_paths": [ /* 最终选择的访问路径 */
                    {
                      "access_type": "scan", /* 访问类型：为scan，全表扫描 */
                      "rows": 48696,
                      "cost": 19832,
                      "chosen": true, /* 确认选择 */
                      "use_tmp_table": true
                    }
                  ] /* considered_access_paths */
                } /* best_access_path */,
                "cost_for_plan": 19832,
                "rows_for_plan": 48696,
                "sort_cost": 48696,
                "new_cost_for_plan": 68528,
                "chosen": true
              }
            ] /* considered_execution_plans */
          },
          {
            "attaching_conditions_to_tables": {
              "original_condition": "(`member`.`name` > 'gaorufeng')",
              "attached_conditions_computation": [
              ] /* attached_conditions_computation */,
              "attached_conditions_summary": [
                {
                  "table": "`member`",
                  "attached": "(`member`.`name` > 'gaorufeng')"
                }
              ] /* attached_conditions_summary */
            } /* attaching_conditions_to_tables */
          },
          {
            "clause_processing": {
              "clause": "ORDER BY",
              "original_clause": "`member`.`address`",
              "items": [
                {
                  "item": "`member`.`address`"
                }
              ] /* items */,
              "resulting_clause_is_simple": true,
              "resulting_clause": "`member`.`address`"
            } /* clause_processing */
          },
          {
            "refine_plan": [
              {
                "table": "`member`",
                "access_type": "table_scan"
              }
            ] /* refine_plan */
          },
          {
            "reconsidering_access_paths_for_index_ordering": {
              "clause": "ORDER BY",
              "index_order_summary": {
                "table": "`member`",
                "index_provides_order": false,
                "order_direction": "undefined",
                "index": "unknown",
                "plan_changed": false
              } /* index_order_summary */
            } /* reconsidering_access_paths_for_index_ordering */
          }
        ] /* steps */
      } /* join_optimization */
    },
    {
      "join_execution": { /* 执行阶段 */
        "select#": 1,
        "steps": [
          {
            "filesort_information": [
              {
                "direction": "asc",
                "table": "`member`",
                "field": "address"
              }
            ] /* filesort_information */,
            "filesort_priority_queue_optimization": {
              "usable": false,
              "cause": "not applicable (no LIMIT)"
            } /* filesort_priority_queue_optimization */,
            "filesort_execution": [
            ] /* filesort_execution */,
            "filesort_summary": {
              "rows": 100000,
              "examined_rows": 100000,
              "number_of_tmp_files": 75,
              "sort_buffer_size": 262052,
              "sort_mode": ""
            } /* filesort_summary */
          }
        ] /* steps */
      } /* join_execution */
    }
  ] /* steps */
}

mysql底层cost成本分析，全表扫描比索引成本低，所以选择了全表扫描

set session optimizer_trace="enabled=off";#关闭trace

三、mysql常见索引优化

1、order by和group by优化

explain select * from member where name = 'gaorufeng' order by age;
因为联合索引name字段已经确认，age肯定就是有序的，可以用到索引排序

explain select * from member where name = 'gaorufeng' order by address;
因为跳过联合索引age字段选择用address字段排序，用到了文件排序；

文件排序：因为address被确定是无序的所以无法在索引树上进行排序，只能先将一部分结果集放到文件中，另一部分结果集排好序之后再把文件加载到内存中进行排序，这样就会比较慢了

索引排序：在建索引树的时候就已经排好了序，这样就只要过滤结果集就可以了

explain select * from member where name = 'gaorufeng' order by age,address;
联合索引前面name索引字段已经确定，后面的age,address都是有序的，就跟构建索引树一样（不要去想address是无序的，你要想age都排好了，构建索引树也是根据上一个字段排序下一个字段，所以是有序的），所以没有用到文件排序；至于where后面如果再加条件的话，mysql底层会根据cost成本计算回表次数来决定要不要使用索引

explain select * from member where name = 'gaorufeng' order by address,age;
联合索引排序这种，如果排序字段位置调换会导致使用文件排序，因为已经跳过了age字段

explain select * from member where name = 'gaorufeng' and age = 18 order by address,age;
这种拿屁股想都能想到，name和age都已经确定了，age参不参与排序已经不重要了，最后一个address肯定有序的

explain select * from member where name = 'gaorufeng' order by address asc,age desc;
联合索引基本上都是靠前面的一个字段来确定下一个字段在索引树上的顺序，所以顺序不可能倒过来，用到了文件排序，mysql8.0引入降序索引，可以指定联合索引排序是asc、desc

explain select * from member where name = 'gaorufeng' or name = 'test' order by age,address;
explain select * from member where name in ('gaorufeng','test') order by age,address;
explain select * from member where name > 'gaorufeng' order by age,address;
explain select * from member where name like 'test%' order by age,address;
联合索引中用了or、in、范围查找、like，再用下一个字段排序都会出现文件排序，你把address去掉也是一样的；照这样来说，其实用了这些后面字段都是无序的，你把它们都用覆盖索引也是一样的，至于where为什么用了索引，我认为是虽然用了or、in、范围查找、like，但是索引树上筛选出来的结果主键id少，回表次数少，所以用了索引，而排序，你只能用name排序

证明用覆盖索引也没用：
explain select id,name,age,address from member where name = 'gaorufeng' or name = 'test' order by age;
explain select id,name,age,address from member where name in ('gaorufeng','test') order by age;
explain select id,name,age,address from member where name > 'gaorufeng' order by age;
explain select id,name,age,address from member where name like 'test%' order by age;

explain select * from member where name = 'gaorufeng' or name = 'test' order by name;
explain select * from member where name in ('gaorufeng','test') order by name;
explain select * from member where name > 'gaorufeng' order by name;
explain select * from member where name like 'test%' order by name;
范围查找，我想它既然索引都没用到，更不用谈去用索引排序了（不要去想为什么用name也是文件排序，name不是有序的吗，你要想都没用到索引，怎么用索引排序），只能用覆盖索引优化，因为where范围结果集大，回表次数多，所以用不到索引，优化如下（最好其它三条语句也用覆盖索引优化）：
explain select id,name,age,address from member where name > 'gaorufeng' order by name;

优化总结：

务必要遵循最左前缀原则，不管是where、order by、group by
联合索引中，最左前缀字段在where中使用like、范围、or、in，后面都是无序的，因为排序都是文件排序，where条件中有时能用到索引，那是基于成本计算回表次数少才使用的索引，可以看到如果是范围查询基本上在大部分情况都用不到索引，只能把范围缩小，用覆盖索引优化
要使用索引字段排序，不然order by就会是文件排序
order by和group by很类似，先排序后分组，同样遵循最左前缀原则，group by如果不需要排序可以使用order by null，最好不要用having，能在where中指定完条件那更好

2、filesort文件排序方式

explain select * from member where name = 'gaorufeng' order by address;

单路排序：首先找到name='gaorufeng'的主键id值，取出整行数据加载到sort_buffer中，继续找下一个符合条件的，一直这样循环；在sort_buffer中按照address字段进行排序
双路排序：首先找到name='gaorufeng'的主键id值，只取出id和address字段数据加载到sort_buffer中，继续找下一个符合条件的，一直这样循环；在sort_buffer中按照address字段进行排序，排序完之后再回表到原表中符合每个id的所有数据

3、索引设计原则

代码先行，索引后上

每次应该代码都写完了，才能确定什么业务场景下才能用到索引，或者更好的去建联合索引

联合索引尽量覆盖条件

where、group by、order by尽量包含在联合索引上，满足最左前缀原则，最好不要建单值索引，也不要随便去建索引，最好控制在两到三个就行了，因为mysql需要维护索引树

不要在小基数上建索引

比如只有字典类型的字段类型值比较少的情况，因为建了在索引树上的分布也是那几个，区分度不高

长字符串采用前缀索引

如果一个字段是varchar(255)的大字段，建索引的时候就可以只包含前20个字段就行了，类似与KEY index(name(20),age,address)

where与order by冲突时优先where

想象一下也知道，先筛选结果，接着排序是不是也会快点

基于慢sql查询做优化

my.cnf要增加或修改参数slow_query_log=1和slow_query_log_file（慢sql文件存放路径）

show variables like 'long_query_time%';#查看多少秒会记录到慢查询日志里面

4、索引设计场景举例

假设一个商城的商品搜索场景，一般情况下有自动定位城市搜索，名称、商品编号、类型、价格

(`province`,`name`,`type`,`price`)

比如我们要搜索所有商品的价格在100到200之间的，然而，类型用户没有筛选，比如有电脑有苹果的、小米的、华为、华硕等等，这时候如果类型不多就这四种的情况下可以这样优化

select `province`,`name`,`type`,`price` from goods where province = '广州' and name like '笔记本电脑%' and type in ('苹果','小米','华为','华硕') and price >= 100 and price <= 200

假设这个时候根据用户的习惯，会选择商品的属性，比如游戏电脑，青春版、商业版、其它属性之内的，这个时候联合索引就应该是这样

(`province`,`name`,`type`,`style`,`price`)

如果这时候需要查询商品发布时间在最近7天的

(`province`,`name`,`type`,`style`,`price`,`publish_time`)

select `province`,`name`,`type`,`style`,`publish_time` from goods where province = '广州' and name like '笔记本电脑%' and type in ('苹果','小米','华为','华硕') and style = '青春版' and price >= 100 and price <= 200 and DATEDIFF(publish_time,NOW())=7

这样也不好，因为范围查询的后面基本上就是无序的，所以publish_time基本上用不到索引，而且还用了函数查询，就算把publish_time改成范围查询也是用不到，所以这时候就需要在程序中做处理了，新增一个字段is_recent_publish，把最近七天发布的商品的is_recent_publish改成1，这个时候联合索引的字段就应该是这样的

(`province`,`name`,`type`,`style`,is_recent_publish,`price`)

你可能感兴趣的:(mysql,数据库,mysql)

mysql禁用远程登录 igotyback mysql
去mysql库中的user表里，将host都改成localhost之后刷新权限FLUSHPRIVILEGES;
Google earth studio 简介陟彼高冈yu 旅游
GoogleEarthStudio是一个基于Web的动画工具，专为创作使用GoogleEarth数据的动画和视频而设计。它利用了GoogleEarth强大的三维地图和卫星影像数据库，使用户能够轻松地创建逼真的地球动画、航拍视频和动态地图可视化。网址为https://www.google.com/earth/studio/。GoogleEarthStudio是一个基于Web的动画工具，专为创作使用G
关于提高复杂业务逻辑代码可读性的思考编程经验分享开发经验 java 数据库开发语言
目录前言需求场景常规写法拆分方法领域对象总结前言实际工作中大部分时间都是在写业务逻辑，一般都是三层架构，表示层（Controller）接收客户端请求，并对入参做检验，业务逻辑层（Service）负责处理业务逻辑，一般开发都是在这一层中写具体的业务逻辑。数据访问层（Dao）是直接和数据库交互的，用于查数据给业务逻辑层，或者是将业务逻辑层处理后的数据写入数据库。简单的增删改查接口不用多说，基本上写好一
SQL Server_查询某一数据库中的所有表的内容 qq_42772833 SQL Server 数据库 sqlserver
1.查看所有表的表名要列出CrabFarmDB数据库中的所有表（名），可以使用以下SQL语句：USECrabFarmDB;--切换到目标数据库GOSELECTTABLE_NAMEFROMINFORMATION_SCHEMA.TABLESWHERETABLE_TYPE='BASETABLE';对这段SQL脚本的解释：SELECTTABLE_NAME：这个语句的作用是从查询结果中选择TABLE_NAM
深入理解 MultiQueryRetriever：提升向量数据库检索效果的强大工具 nseejrukjhad 数据库 python
深入理解MultiQueryRetriever：提升向量数据库检索效果的强大工具引言在人工智能和自然语言处理领域，高效准确的信息检索一直是一个关键挑战。传统的基于距离的向量数据库检索方法虽然广泛应用，但仍存在一些局限性。本文将介绍一种创新的解决方案：MultiQueryRetriever，它通过自动生成多个查询视角来增强检索效果，提高结果的相关性和多样性。MultiQueryRetriever的工
MYSQL面试系列-04 king01299 面试 mysql 面试
MYSQL面试系列-0417.关于redolog和binlog的刷盘机制、redolog、undolog作用、GTID是做什么的？innodb_flush_log_at_trx_commit及sync_binlog参数意义双117.1innodb_flush_log_at_trx_commit该变量定义了InnoDB在每次事务提交时，如何处理未刷入（flush）的重做日志信息（redolog）。它
MongoDB Oplog 窗口喝醉酒的小白 MongoDB 运维
在MongoDB中，oplog（操作日志）是一个特殊的日志系统，用于记录对数据库的所有写操作。oplog允许副本集成员（通常是从节点）应用主节点上已经执行的操作，从而保持数据的一致性。它是MongoDB副本集实现数据复制的基础。MongoDBOplog窗口oplog窗口是指在MongoDB副本集中，从节点可以用来同步数据的时间范围。这个窗口通常由以下因素决定：Oplog大小：oplog的大小是有限
python os 环境变量 CV矿工 python 开发语言 numpy
环境变量：环境变量是程序和操作系统之间的通信方式。有些字符不宜明文写进代码里，比如数据库密码，个人账户密码，如果写进自己本机的环境变量里，程序用的时候通过os.environ.get（）取出来就行了。os.environ是一个环境变量的字典。环境变量的相关操作importos"""设置/修改环境变量：os.environ[‘环境变量名称’]=‘环境变量值’#其中key和value均为string类
【PG】常见数据库、表属性设置江无羡数据库
PG的常见属性配置方法数据库复制、备份相关表的复制标识单表操作批量表操作链接数据库复制、备份相关表的复制标识单表操作通过ALTER语句单独更改一张表的复制标识。ALTERTABLE[tablename]REPLICAIDENTITYFULL;批量表操作通过代码块的方式，对某个schema中的所有表一起更新其复制标识。SELECTtablename,CASErelreplidentWHEN'd'TH
nosql数据库技术与应用知识点皆过客，揽星河 NoSQL nosql 数据库大数据数据分析数据结构非关系型数据库
Nosql知识回顾大数据处理流程数据采集(flume、爬虫、传感器)数据存储(本门课程NoSQL所处的阶段)Hdfs、MongoDB、HBase等数据清洗(入仓)Hive等数据处理、分析(Spark、Flink等)数据可视化数据挖掘、机器学习应用(Python、SparkMLlib等)大数据时代存储的挑战(三高)高并发(同一时间很多人访问)高扩展(要求随时根据需求扩展存储)高效率(要求读写速度快)
insert into select 主键自增_mybatis拦截器实现主键自动生成 weixin_39521651 insert into select 主键自增 mybatis delete返回值 mybatis insert返回主键 mybatis insert返回对象 mybatis plus insert返回主键 mybatis plus 插入生成id
前言前阵子和朋友聊天，他说他们项目有个需求，要实现主键自动生成，不想每次新增的时候，都手动设置主键。于是我就问他，那你们数据库表设置主键自动递增不就得了。他的回答是他们项目目前的id都是采用雪花算法来生成，因此为了项目稳定性，不会切换id的生成方式。朋友问我有没有什么实现思路，他们公司的orm框架是mybatis，我就建议他说，不然让你老大把mybatis切换成mybatis-plus。mybat
关于Mysql 中 Row size too large (＞ 8126) 错误的解决和理解秋刀prince mysql mysql 数据库
提示：啰嗦一嘴，数据库的任何操作和验证前，一定要记得先备份！！！不会有错；文章目录问题发现一、问题导致的可能原因1、页大小2、行格式2.1compact格式2.2Redundant格式2.3Dynamic格式2.4Compressed格式3、BLOB和TEXT列二、解决办法1、修改页大小（不推荐）2、修改行格式3、修改数据类型为BLOB和TEXT列4、其他优化方式（可以参考使用）4.1合理设置数据
Java爬虫框架（一）--架构设计狼图腾-狼之传说 java 框架 java 任务 html解析器存储电子商务
一、架构图那里搜网络爬虫框架主要针对电子商务网站进行数据爬取，分析，存储，索引。爬虫：爬虫负责爬取，解析，处理电子商务网站的网页的内容数据库：存储商品信息索引：商品的全文搜索索引Task队列：需要爬取的网页列表Visited表：已经爬取过的网页列表爬虫监控平台：web平台可以启动，停止爬虫，管理爬虫，task队列，visited表。二、爬虫1.流程1)Scheduler启动爬虫器，TaskMast
MongoDB知识概括 GeorgeLin98 持久层 mongodb
MongoDB知识概括MongoDB相关概念单机部署基本常用命令索引-IndexSpirngDataMongoDB集成副本集分片集群安全认证MongoDB相关概念业务应用场景：传统的关系型数据库（如MySQL），在数据操作的“三高”需求以及应对Web2.0的网站需求面前，显得力不从心。解释：“三高”需求：①Highperformance-对数据库高并发读写的需求。②HugeStorage-对海量数
Mongodb Error: queryTxt ETIMEOUT xxxx.wwwdz.mongodb.net 佛一脚 error react mongodb 数据库
背景每天都能遇到奇怪的问题，做个记录，以便有缘人能得到帮助！换了一台电脑开发nextjs程序。需要连接mongodb数据，对数据进行增删改查。上一台电脑好好的程序，新电脑死活连不上mongodb数据库。同一套代码，没任何修改，搞得我怀疑人生了，打开浏览器进入mongodb官网毫无问题，也能进入线上系统查看数据，网络应该是没问题。于是我尝试了一下手机热点，这次代码能正常跑起来，连接数据库了！！！是不
入门MySQL——查询语法练习 K_un
前言：前面几篇文章为大家介绍了DML以及DDL语句的使用方法，本篇文章将主要讲述常用的查询语法。其实MySQL官网给出了多个示例数据库供大家实用查询，下面我们以最常用的员工示例数据库为准，详细介绍各自常用的查询语法。1.员工示例数据库导入官方文档员工示例数据库介绍及下载链接：https://dev.mysql.com/doc/employee/en/employees-installation.h
博客网站制作教程 2401_85194651 java maven
首先就是技术框架：后端：Java+SpringBoot数据库：MySQL前端：Vue.js数据库连接：JPA(JavaPersistenceAPI)1.项目结构blog-app/├──backend/│├──src/main/java/com/example/blogapp/││├──BlogApplication.java││├──config/│││└──DatabaseConfig.java
ubuntu安装wordpress lissettecarlr
1安装nginx网上安装方式很多，这就就直接用apt-get了apt-getinstallnginx不用启动啥，然后直接在浏览器里面输入IP:80就能看到nginx的主页了。如果修改了一些配置可以使用下列命令重启一下systemctlrestartnginx.service2安装mysql输入安装前也可以更新一下软件源，在安装过程中将会让你输入数据库的密码。sudoapt-getinstallmy
深入浅出 -- 系统架构之负载均衡Nginx的性能优化 xiaoli8748_软件开发系统架构系统架构负载均衡 nginx
一、Nginx性能优化到这里文章的篇幅较长了，最后再来聊一下关于Nginx的性能优化，主要就简单说说收益最高的几个优化项，在这块就不再展开叙述了，毕竟影响性能都有多方面原因导致的，比如网络、服务器硬件、操作系统、后端服务、程序自身、数据库服务等，对于性能调优比较感兴趣的可以参考之前《JVM性能调优》中的调优思想。优化一：打开长连接配置通常Nginx作为代理服务，负责分发客户端的请求，那么建议开启H
【RabbitMQ 项目】服务端：数据管理模块之绑定管理月夜星辉雪 rabbitmq 分布式
文章目录一.编写思路二.代码实践一.编写思路定义绑定信息类交换机名称队列名称绑定关键字：交换机的路由交换算法中会用到没有是否持久化的标志，因为绑定是否持久化取决于交换机和队列是否持久化，只有它们都持久化时绑定才需要持久化。绑定就好像一根绳子，两端连接着交换机和队列，当一方不存在，它就没有存在的必要了定义绑定持久化类构造函数：如果数据库文件不存在则创建，打开数据库，创建binding_table插入
计算机毕业设计PHP仓储综合管理系统（源码+程序+VUE+lw+部署） java毕设程序源码王哥 php 课程设计 vue.js
该项目含有源码、文档、程序、数据库、配套开发软件、软件安装教程。欢迎交流项目运行环境配置：phpStudy+Vscode+Mysql5.7+HBuilderX+Navicat11+Vue+Express。项目技术：原生PHP++Vue等等组成，B/S模式+Vscode管理+前后端分离等等。环境需要1.运行环境：最好是小皮phpstudy最新版，我们在这个版本上开发的。其他版本理论上也可以。2.开发
3.增删改查--连接查询问女何所忆
关系型数据库的一个特点就是，多张表之间存在关系，以致于我们可以连接多张表进行查询操作，所以连接查询会是关系型数据库中最常见的操作。连接查询主要分为三种，交叉连接、内连接和外连接，我们一个个说。1、交叉连接交叉连接其实连接查询的第一个阶段，它简单表现为两张表的笛卡尔积形式，具体例子：如果你没学过数学中的笛卡尔积概念，你可以这样简单的理解这里的交叉连接：两张表的交叉连接就是一个连接合并的过程，T1表中
You have an error in your SQL syntax； check the manual that corresponds to your MySQL server version 努力的菜鸟~ sql 数据库
YouhaveanerrorinyourSQLsyntax;checkthemanualthatcorrespondstoyourMySQLserverversionfortherightsyntaxtousenear‘IDENTIFIEDBY‘123456’WITHGRANTOPTION’atline1在mysql5.7之前GRANTALLPRIVILEGESON*.*TO'root'@'%'I
docker from指令的含义_多个FROM-含义 weixin_39722188 docker from指令的含义
小编典典什么是基本图片？一组文件，加上EXPOSE端口ENTRYPOINT和CMD。您可以添加文件并基于该基础图像构建新图像，Dockerfile并以FROM指令开头：后面提到的图像FROM是新图像的“基础图像”。这是否意味着如果我neo4j/neo4j在FROM指令中声明，则在运行映像时，neo数据库将自动运行并且可在端口7474的容器中使用？仅当您不覆盖CMD和时ENTRYPOINT。但是图像
Redis:缓存击穿我的程序快快跑啊缓存 redis java
缓存击穿(热点key)：部分key(被高并发访问且缓存重建业务复杂的)失效,无数请求会直接到数据库，造成巨大压力1.互斥锁：可以保证强一致性线程一：未命中之后，获取互斥锁，再查询数据库重建缓存，写入缓存，释放锁线程二：查询未命中，未获得锁(已由线程一获得)，等待一会，缓存命中互斥锁实现方式：redis中setnxkeyvalue:改变对应key的value,仅当value不存在时执行，以此来实现互
mysql学习教程，从入门到精通，TOP 和MySQL LIMIT 子句（15）知识分享小能手大数据数据库 MySQL mysql 学习 oracle 数据库开发语言 adb 大数据
1、TOP和MySQLLIMIT子句内容在SQL中，不同的数据库系统对于限制查询结果的数量有不同的实现方式。TOP关键字主要用于SQLServer和Access数据库中，而LIMIT子句则主要用于MySQL、PostgreSQL（通过LIMIT/OFFSET语法）、SQLite等数据库中。下面将分别详细介绍这两个功能的语法、语句以及案例。1.1、TOP子句（SQLServer和Access）1.1
ERROR 1064 (42000): You have an error in your SQL syntax; check the manual that corresponds to your †徐先森® Oracle数据库 Web相关错误集
createtablestudents(idintunsignedprimarykeyauto_increment,namevarchar(50)notnull,ageintunsigned,highdecimal(3,2),genderenum('男','女','中性','保密','妖')default'保密',cls_idintunsigned);在对数据库插入如上带有中文带有默认值的字段的时
Redis 有哪些危险命令？如何防范？花小疯 redis 缓存数据库危险命令大数据
Redis有哪些危险命令？Redis的危险命令主要有以下几个：1.keys客户端可查询出所有存在的键。2.flushdb删除Redis中当前所在数据库中的所有记录，并且此命令从不会执行失败。3.flushall删除Redis中所有数据库中的所有记录，不止是当前所在数据库，并且此命令从不会执行失败。4.config客户端可修改Redis配置。怎么禁用和重命名危险命令？看下redis.conf默认配置
鲲鹏 ARM 架构麒麟 Lylin v10 安装 Nginx (离线) 焚木灵 arm开发架构 nginx 服务器
最近做一个银行的项目，银行的服务器是鲲鹏ARM架构的服务器，并且是麒麟v10的系统，这里记录一下在无法访问外网安装Nginx的方法。其他文章：鲲鹏ARM架构麒麟Lylinv10安装Mysql8.3(离线)-CSDN博客鲲鹏ARM架构麒麟Lylinv10安装Node和NVM(离线)-CSDN博客鲲鹏ARM架构麒麟Lylinv10安装Pm2(离线)-CSDN博客鲲鹏ARM架构麒麟Lylinv10安装P
【Golang】 Golang 的 GORM 库中的 Rows 函数不爱洗脚的小滕 golang 开发语言后端
文章目录前言一、Rows函数解释二、代码实现三、总结前言在使用Go语言进行数据库操作时，GORM（GoObject-RelationalMapping）库是一个常用的工具。它提供了一种简洁和强大的方式来处理数据库操作。本文将介绍GORM库中的Rows函数，这是一个用于执行原生SQL查询并返回结果的函数。一、Rows函数解释在GORM库中，Rows函数用于执行原生SQL查询并返回*sql.Rows结
Nginx负载均衡 510888780 nginx 应用服务器
Nginx负载均衡一些基础知识: nginx 的 upstream目前支持 4 种方式的分配 1)、轮询（默认）每个请求按时间顺序逐一分配到不同的后端服务器，如果后端服务器down掉，能自动剔除。 2)、weight 指定轮询几率，weight和访问比率成正比
RedHat 6.4 安装 rabbitmq bylijinnan erlang rabbitmq redhat
在 linux 下安装软件就是折腾，首先是测试机不能上外网要找运维开通，开通后发现测试机的 yum 不能使用于是又要配置 yum 源，最后安装 rabbitmq 时也尝试了两种方法最后才安装成功机器版本： [root@redhat1 rabbitmq]# lsb_release LSB Version: :base-4.0-amd64:base-4.0-noarch:core
FilenameUtils工具类 eksliang FilenameUtils common-io
转载请出自出处：http://eksliang.iteye.com/blog/2217081 一、概述这是一个Java操作文件的常用库，是Apache对java的IO包的封装，这里面有两个非常核心的类FilenameUtils跟FileUtils，其中FilenameUtils是对文件名操作的封装;FileUtils是文件封装，开发中对文件的操作，几乎都可以在这个框架里面找到。非常的好用。
xml文件解析SAX 不懂事的小屁孩 xml
xml文件解析:xml文件解析有四种方式， 1.DOM生成和解析XML文档(SAX是基于事件流的解析) 2.SAX生成和解析XML文档(基于XML文档树结构的解析) 3.DOM4J生成和解析XML文档 4.JDOM生成和解析XML 本文章用第一种方法进行解析，使用android常用的DefaultHandler import org.xml.sax.Attributes;
通过定时任务执行mysql的定期删除和新建分区，此处是按日分区酷的飞上天空 mysql
使用python脚本作为命令脚本，linux的定时任务来每天定时执行 #!/usr/bin/python # -*- coding: utf8 -*- import pymysql import datetime import calendar #要分区的表 table_name = 'my_table' #连接数据库的信息 host,user,passwd,db =
如何搭建数据湖架构？听听专家的意见蓝儿唯美架构
Edo Interactive在几年前遇到一个大问题：公司使用交易数据来帮助零售商和餐馆进行个性化促销，但其数据仓库没有足够时间去处理所有的信用卡和借记卡交易数据 “我们要花费27小时来处理每日的数据量，”Edo主管基础设施和信息系统的高级副总裁Tim Garnto说道：“所以在2013年，我们放弃了现有的基于PostgreSQL的关系型数据库系统，使用了Hadoop集群作为公司的数
spring学习——控制反转与依赖注入 a-john spring
控制反转（Inversion of Control，英文缩写为IoC）是一个重要的面向对象编程的法则来削减计算机程序的耦合问题，也是轻量级的Spring框架的核心。控制反转一般分为两种类型，依赖注入（Dependency Injection，简称DI）和依赖查找（Dependency Lookup）。依赖注入应用比较广泛。
用spool+unixshell生成文本文件的方法 aijuans xshell
例如我们把scott.dept表生成文本文件的语句写成dept.sql,内容如下: 　　set pages 50000; 　　set lines 200; 　　set trims on; 　　set heading off; 　　spool /oracle_backup/log/test/dept.lst; 　　select deptno||','||dname||','||loc
1、基础--名词解析(OOA/OOD/OOP) asia007 学习基础知识
OOA:Object-Oriented Analysis（面向对象分析方法）是在一个系统的开发过程中进行了系统业务调查以后，按照面向对象的思想来分析问题。OOA与结构化分析有较大的区别。OOA所强调的是在系统调查资料的基础上，针对OO方法所需要的素材进行的归类分析和整理，而不是对管理业务现状和方法的分析。　　OOA（面向对象的分析）模型由5个层次（主题层、对象类层、结构层、属性层和服务层）
浅谈java转成json编码格式技术百合不是茶 json编码 java转成json编码
json编码;是一个轻量级的数据存储和传输的语言在java中需要引入json相关的包,引包方式在工程的lib下就可以了 JSON与JAVA数据的转换（JSON 即 JavaScript Object Natation，它是一种轻量级的数据交换格式，非常适合于服务器与 JavaScript 之间的数据的交
web.xml之Spring配置(基于Spring+Struts+Ibatis) bijian1013 java web.xml SSI spring配置
指定Spring配置文件位置 <context-param> <param-name>contextConfigLocation</param-name> <param-value> /WEB-INF/spring-dao-bean.xml,/WEB-INF/spring-resources.xml, /WEB-INF/
Installing SonarQube（Fail to download libraries from server） sunjing Install Sonar
1. Download and unzip the SonarQube distribution 2. Starting the Web Server The default port is "9000" and the context path is "/". These values can be changed in &l
【MongoDB学习笔记十一】Mongo副本集基本的增删查 bit1129 mongodb
一、创建复本集假设mongod,mongo已经配置在系统路径变量上，启动三个命令行窗口，分别执行如下命令： mongod --port 27017 --dbpath data1 --replSet rs0 mongod --port 27018 --dbpath data2 --replSet rs0 mongod --port 27019 -
Anychart图表系列二之执行Flash和HTML5渲染白糖_ Flash
今天介绍Anychart的Flash和HTML5渲染功能 HTML5 Anychart从6.0第一个版本起，已经逐渐开始支持各种图的HTML5渲染效果了，也就是说即使你没有安装Flash插件，只要浏览器支持HTML5，也能看到Anychart的图形（不过这些是需要做一些配置的）。这里要提醒下大家，Anychart6.0版本对HTML5的支持还不算很成熟，目前还处于
Laravel版本更新异常4.2.8-> 4.2.9 Declaration of ... CompilerEngine ... should be compa bozch laravel
昨天在为了把laravel升级到最新的版本，突然之间就出现了如下错误： ErrorException thrown with message "Declaration of Illuminate\View\Engines\CompilerEngine::handleViewException() should be compatible with Illuminate\View\Eng
编程之美-NIM游戏分析-石头总数为奇数时如何保证先动手者必胜 bylijinnan 编程之美
import java.util.Arrays; import java.util.Random; public class Nim { /**编程之美 NIM游戏分析问题：有N块石头和两个玩家A和B，玩家A先将石头随机分成若干堆，然后按照BABA...的顺序不断轮流取石头，能将剩下的石头一次取光的玩家获胜，每次取石头时，每个玩家只能从若干堆石头中任选一堆，
lunce创建索引及简单查询 chengxuyuancsdn 查询创建索引 lunce
import java.io.File; import java.io.IOException; import org.apache.lucene.analysis.Analyzer; import org.apache.lucene.analysis.standard.StandardAnalyzer; import org.apache.lucene.document.Docume
[IT与投资]坚持独立自主的研究核心技术 comsci it
和别人合作开发某项产品....如果互相之间的技术水平不同,那么这种合作很难进行,一般都会成为强者控制弱者的方法和手段..... 所以弱者,在遇到技术难题的时候,最好不要一开始就去寻求强者的帮助,因为在我们这颗星球上,生物都有一种控制其
flashback transaction闪回事务查询 daizj oracle sql 闪回事务
闪回事务查询有别于闪回查询的特点有以下3个：（1）其正常工作不但需要利用撤销数据，还需要事先启用最小补充日志。（2）返回的结果不是以前的“旧”数据，而是能够将当前数据修改为以前的样子的撤销SQL（Undo SQL）语句。（3）集中地在名为flashback_transaction_query表上查询，而不是在各个表上通过“as of”或“vers
Java I/O之FilenameFilter类列举出指定路径下某个扩展名的文件游其是你 FilenameFilter
这是一个FilenameFilter类用法的例子，实现的列举出“c:\\folder“路径下所有以“.jpg”扩展名的文件。 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28
C语言学习五函数，函数的前置声明以及如何在软件开发中合理的设计函数来解决实际问题 dcj3sjt126com c
# include <stdio.h> int f(void) //括号中的void表示该函数不能接受数据，int表示返回的类型为int类型 { return 10; //向主调函数返回10 } void g(void) //函数名前面的void表示该函数没有返回值 { //return 10; //error 与第8行行首的void相矛盾 } in
今天在测试环境使用yum安装，遇到一个问题： Error: Cannot retrieve metalink for repository: epel. Pl dcj3sjt126com centos
今天在测试环境使用yum安装，遇到一个问题： Error: Cannot retrieve metalink for repository: epel. Please verify its path and try again 处理很简单，修改文件“/etc/yum.repos.d/epel.repo”，将baseurl的注释取消， mirrorlist注释掉。即可。 &n
单例模式 shuizhaosi888 单例模式
单例模式懒汉式 public class RunMain { /** * 私有构造 */ private RunMain() { } /** * 内部类，用于占位，只有 */ private static class SingletonRunMain { priv
Spring Security（09）——Filter 234390216 Spring Security
Filter 目录 1.1 Filter顺序 1.2 添加Filter到FilterChain 1.3 DelegatingFilterProxy 1.4 FilterChainProxy 1.5
公司项目NODEJS实践0.1 逐行分析JS源代码 mongodb nginx ubuntu nodejs
一、前言前端如何独立用nodeJs实现一个简单的注册、登录功能，是不是只用nodejs+sql就可以了？其实是可以实现，但离实际应用还有距离，那要怎么做才是实际可用的。网上有很多nod
java.lang.Math liuhaibo_ljf java Math lang
System.out.println(Math.PI); System.out.println(Math.abs(1.2)); System.out.println(Math.abs(1.2)); System.out.println(Math.abs(1)); System.out.println(Math.abs(111111111)); System.out.println(Mat
linux下时间同步 nonobaba ntp
今天在linux下做hbase集群的时候，发现hmaster启动成功了，但是用hbase命令进入shell的时候报了一个错误 PleaseHoldException: Master is initializing，查看了日志，大致意思是说master和slave时间不同步，没办法，只好找一种手动同步一下，后来发现一共部署了10来台机器，手动同步偏差又比较大，所以还是从网上找现成的解决方
ZooKeeper3.4.6的集群部署 roadrunners zookeeper 集群部署
ZooKeeper是Apache的一个开源项目，在分布式服务中应用比较广泛。它主要用来解决分布式应用中经常遇到的一些数据管理问题，如：统一命名服务、状态同步、集群管理、配置文件管理、同步锁、队列等。这里主要讲集群中ZooKeeper的部署。 1、准备工作我们准备3台机器做ZooKeeper集群，分别在3台机器上创建ZooKeeper需要的目录。数据存储目录
Java高效读取大文件 tomcat_oracle java
　　读取文件行的标准方式是在内存中读取，Guava 和Apache Commons IO都提供了如下所示快速读取文件行的方法：　　Files.readLines(new File(path), Charsets.UTF_8); 　　FileUtils.readLines(new File(path)); 　　这种方法带来的问题是文件的所有行都被存放在内存中，当文件足够大时很快就会导致
微信支付api返回的xml转换为Map的方法 xu3508620 xml map 微信api
举例如下： <xml> <return_code><![CDATA[SUCCESS]]></return_code> <return_msg><![CDATA[OK]]></return_msg> <appid><