朱明朝

mysql 直方图统计_MySQL 8.0 新特性之统计直方图

原标题：MySQL 8.0 新特性之统计直方图

| 译者简介

译者韩杰·沃趣科技MySQL数据库工程师

熟悉mysql体系架构、主从复制，熟悉问题定位与解决

出品沃趣科技

原文链接：

https://mysqlserverteam.com/histogram-statistics-in-mysql/

| 概览

MySQL8.0实现了统计直方图。利用直方图，用户可以对一张表的一列做数据分布的统计，特别是针对没有索引的字段。这可以帮助查询优化器找到更优的执行计划。统计直方图的主要使用场景是用来计算字段选择性，即过滤效率。

可以通过以下方式来创建或者删除直方图：

ANALYZETABLEtbl_name UPDATEHISTOGRAM ONcol_name [, col_name] WITHN BUCKETS;

ANALYZETABLEtbl_name DROPHISTOGRAM ONcol_name [, col_name];

buckets默认是100。统计直方图的信息存储在数据字典表"column_statistcs"中,可以通过视图information_schema.COLUMN_STATISTICS访问。直方图以灵活的JSON的格式存储。ANALYZE TABLE会基于表大小自动判断是否要进行取样操作。ANALYZE TABLE也会基于表中列的数据分布情况以及bucket的数量来决定是否要建立等宽直方图(singleton)还是等高直方图(equi-height)。

| 什么是直方图

数据库中，查询优化器负责将SQL转换成最有效的执行计划。有时候，查询优化器会走不到最优的执行计划，导致花费了更多不必要的时间。造成这种情况的主要原因是，查询优化器有时无法准确的知道以下几个问题的答案：

每个表有多少行？

每一列有多少不同的值？

每一列的数据分布情况？

举例说明：一张简单的表，两个字段，一个字段是person_id，另一个字段是time_of_day，表示睡觉时间

CREATETABLEbedtime (

person_id INT,

time_of_day TIME);

对于time_of_day列，大部分人上床时间会在晚上11:00左右。所以下面第一个查询会比第二个查询返回更多的行数：

1) SELECT* FROMbedtime WHEREtime_of_day BETWEEN"22:00:00"AND"23:59:00"

2) SELECT* FROMbedtime WHEREtime_of_day BETWEEN"12:00:00"AND"14:00:00"

如果没有统计数据，优化器会假设time_of_day的值是均匀分配的，即一个人的上床时间在下午3点和晚上11点的概率差不多。如何才能使查询优化器知道数据的分布情况？一个解决方法就是在列上建立统计直方图。

直方图能近似获得一列的数据分布情况，从而让数据库知道它含有哪些数据。直方图有多种形式，MySQL支持了两种：等宽直方图(singleton)、等高直方图(equi-height)。直方图的共同点是，它们都将数据分到了一系列的buckets中去。MySQL会自动将数据划到不同的buckets中，也会自动决定创建哪种类型的直方图。

| 如何创建和删除统计直方图

为了管理统计直方图，ANALYZE TABLE命令新增了两个子句：

ANALYZETABLEtbl_name UPDATEHISTOGRAM ONcol_name [, col_name] WITHN BUCKETS;

ANALYZETABLEtbl_name DROPHISTOGRAM ONcol_name [, col_name];

第一个表示一次可以为一个或多个列创建统计直方图：

mysql> ANALYZE TABLE payment UPDATE HISTOGRAM ON amount WITH 32BUCKETS;

+----------------+-----------+----------+---------------------------------------------------+

+----------------+-----------+----------+---------------------------------------------------+

+----------------+-----------+----------+---------------------------------------------------+

1row inset ( 0. 27sec)

mysql> ANALYZE TABLE payment UPDATE HISTOGRAM ON amount, payment_date WITH 32BUCKETS;

+----------------+-----------+----------+---------------------------------------------------------+

+----------------+-----------+----------+---------------------------------------------------------+

+----------------+-----------+----------+---------------------------------------------------------+

buckets的值必须指定，可以设置为1到1024，默认值是100。

对于不同的数据集合，buckets的值取决于以下几个因素：

这列有多少不同的值

数据的分布情况

需要多高的准确性

但是，某些buckets的值能提升的关于数据分布情况的准确性相当低。所以，建议的做法是，开始的时候将buckets的值设的低一点，比如32，然后如果没有满足期望，再往上增大。

上面这个例子中，我们对于amount列建立了两次直方图。第一个语句，建立了一个新的直方图；第二个语句，amount列的直方图被重写了。

如果需要删除已经创建的直方图，用DROP HISTOGRAM就可以实现：

mysql> ANALYZE TABLE payment DROP HISTOGRAM ON payment_date;

+----------------+-----------+----------+---------------------------------------------------------+

+----------------+-----------+----------+---------------------------------------------------------+

+----------------+-----------+----------+---------------------------------------------------------+

UPDATE HISTOGRAM可以一次性为多个列创建直方图。如果命令中间写错，ANALYZE TABLE仍然会起作用。比如，你指定了三列，但第二列不存在。MySQL仍然会为第一列和第三列创建直方图。

mysql> ANALYZE TABLE customer UPDATE HISTOGRAM ON c_birth_day, c_foobar, c_birth_month WITH 32BUCKETS;

+----------------+-----------+----------+----------------------------------------------------------+

+----------------+-----------+----------+----------------------------------------------------------+

+----------------+-----------+----------+----------------------------------------------------------+

3rows inset ( 0. 15sec)

| 数据库内部发生了什么

当你读过MySQL手册，你可能已经注意到新的系统变量histogram_generation_max_mem_size。当用户建立统计直方图，这个值是用来控制大约多少内存能允许被使用。那么，为什么要控制这个呢？

当你在建立直方图的时候，MySQL server会将所有数据读到内存中，然后在内存中进行操作，包括排序。如果对一个很大的表建立直方图，可能会有风险将几百M的数据都读到内存中，但这是不明智的。为了规避这个风险，MySQL会根据给定的histogram_generation_max_mem_size的值计算该将多少行数据读到内存中。如果根据当前histogram_generation_max_mem_size的限制，MySQL认为只能读一部分数据，那么MySQL会进行取样。通过“sampling-rate”属性，可以观察到取样比率。

mysql> SET histogram_generation_max_mem_size = 1000000;

Query OK, 0rows affected ( 0. 00sec)

mysql> ANALYZE TABLE customer UPDATE HISTOGRAM ON c_birth_country WITH 16BUCKETS;

+----------------+-----------+----------+------------------------------------------------------------+

+----------------+-----------+----------+------------------------------------------------------------+

+----------------+-----------+----------+------------------------------------------------------------+

1row inset ( 0. 22sec)

mysql> SELECT histogram- >>'$."sampling-rate"'

-> FROM information_schema.column_statistics

-> WHERE table_name = "customer"

-> AND column_name = "c_birth_country";

+---------------------------------+

| histogram->>'$."sampling-rate"' |

+---------------------------------+

| 0.048743243211626014 |

+---------------------------------+

1row inset ( 0. 00sec)

优化器创建了一个直方图，大约读了c_birth_country列4.8%的数据。取样是不确定的，因此意义不大。同样的数据，同样的两条语句‘‘ANALYZE TABLE tbl UPDATE HISTOGRAM …’’，如果用了取样，得到的直方图可能就不一样。

| 查询案例

统计直方图可以带来些什么？我们可以看个例子，这个例子中用了直方图，在执行时间上会有很大的不同。

环境：

TPC-DS Benchmark with scale factor of 1

Intel Core i7-4770

Debian Stretch

MySQL 8.0 RC1

innodb_buffer_pool_size = 2G

optimizer_switch = "condition_fanout_filter=on"

| Query 90

查询如下：上午售卖的数量与晚上售卖的数量的比率。

mysql> SELECT CAST(amc AS DECIMAL(15, 4)) / CAST(pmc AS DECIMAL(15, 4)) am_pm_ratio

-> FROM (SELECT COUNT(*) amc

-> FROM web_sales,

-> household_demographics,

-> time_dim,

-> web_page

-> WHERE ws_sold_time_sk = time_dim.t_time_sk

-> AND ws_ship_hdemo_sk = household_demographics.hd_demo_sk

-> AND ws_web_page_sk = web_page.wp_web_page_sk

-> AND time_dim.t_hour BETWEEN 9 AND 9 + 1

-> AND household_demographics.hd_dep_count = 2

-> AND web_page.wp_char_count BETWEEN 5000 AND 5200) at,

-> (SELECT COUNT(*) pmc

-> FROM web_sales,

-> household_demographics,

-> time_dim,

-> web_page

-> WHERE ws_sold_time_sk = time_dim.t_time_sk

-> AND ws_ship_hdemo_sk = household_demographics.hd_demo_sk

-> AND ws_web_page_sk = web_page.wp_web_page_sk

-> AND time_dim.t_hour BETWEEN 15 AND 15 + 1

-> AND household_demographics.hd_dep_count = 2

-> AND web_page.wp_char_count BETWEEN 5000 AND 5200) pt

-> ORDER BY am_pm_ratio

-> LIMIT 100;

+-------------+

| am_pm_ratio |

+-------------+

| 1.27619048 |

+-------------+

1 row in set (1.48 sec)

可以看到，查询花费了1.5秒左右。看起来不算多，但是通过在一列上建立直方图，可以让执行速度快三倍。

mysql> ANALYZE TABLE web_page UPDATE HISTOGRAM ON wp_char_count WITH 8BUCKETS;

+ ----------------+-----------+----------+----------------------------------------------------------+

+ ----------------+-----------+----------+----------------------------------------------------------+

+ ----------------+-----------+----------+----------------------------------------------------------+

1row inset ( 0.06sec)

mysql> SELECT ...

+ -------------+

| am_pm_ratio |

+ -------------+

| 1.27619048|

+ -------------+

1row inset ( 0.50sec)

通过这个直方图，查询花费了0.5秒左右。原因呢？主要的原因是，查询语句中的谓词“web_page.wp_char_count BETWEEN 5000 AND 5200”。没有直方图的时候，优化器会假设web_page表中符合谓词“web_page.wp_char_count BETWEEN 5000 AND 5200”的数据占到总数据11.11%左右。但，这是错误的。用下面的查询语句，可以看到实际上满足条件的数据只有1.6%。

mysql> SELECT

-> (SELECT COUNT(*) FROM web_page WHERE web_page.wp_char_count BETWEEN 5000 AND 5200)

-> /

-> (SELECT COUNT(*) FROM web_page) AS ratio;

+--------+

| ratio |

+--------+

| 0.0167 |

+--------+

1 row in set (0.00 sec)

通过直方图，优化器会知道这个信息，并且更早进行表join，因此执行时间快了三倍。

| Query 61

查询如下：在给定的年份和月份，有和没有广告宣传的情况下货物的售卖比率。

mysql>SELECT promotions, -> total,

->CAST(promotions AS DECIMAL(15, 4)) / CAST(total AS DECIMAL(15, 4)) * 100

->FROM (SELECT SUM(ss_ext_sales_price) promotions

->FROM store_sales,

->store,

->promotion,

->date_dim,

->customer,

->customer_address,

->item

->WHERE ss_sold_date_sk = d_date_sk

->AND ss_store_sk = s_store_sk

->AND ss_promo_sk = p_promo_sk

->AND ss_customer_sk = c_customer_sk

->AND ca_address_sk = c_current_addr_sk

->AND ss_item_sk = i_item_sk

->AND ca_gmt_offset = -5

->AND i_category = 'Home'

->AND ( p_channel_dmail = 'Y'

->OR p_channel_email = 'Y'

->OR p_channel_tv = 'Y')

->AND s_gmt_offset = -5

->AND d_year = 2000

->AND d_moy = 12) promotional_sales,

->(SELECT SUM(ss_ext_sales_price) total

->FROM store_sales,

->store,

->date_dim,

->customer,

->customer_address,

->item

->WHERE ss_sold_date_sk = d_date_sk

->AND ss_store_sk = s_store_sk

->AND ss_customer_sk = c_customer_sk

->AND ca_address_sk = c_current_addr_sk

->AND ss_item_sk = i_item_sk

->AND ca_gmt_offset = -5

->AND i_category = 'Home'

->AND s_gmt_offset = -5

->AND d_year = 2000

->AND d_moy = 12) all_sales

->ORDER BY promotions,

->total

->LIMIT 100;

+------------+------------+--------------------------------------------------------------------------+

| promotions | total | CAST(promotions AS DECIMAL(15, 4)) / CAST(total AS DECIMAL(15, 4)) * 100 |

+------------+------------+--------------------------------------------------------------------------+

| 3213210.07 | 5966836.78 | 53.85114741 |

+------------+------------+--------------------------------------------------------------------------+

1 row in set (2.78 sec)

可以看到，查询花费了2.8秒左右。但是，查询优化器不知道s_gmt_offset列只有一个不同的值。没有统计数据的情况下，优化器会用所谓的“hard-coded guesstimates”,会假设10%的数据符合条件“ca_gmt_offset = -5“。如果在这个列上增加一个直方图，优化器会知道所有的数据都符合条件，因此会走一个更好的执行计划。

mysql> ANALYZE TABLE store UPDATE HISTOGRAM ON s_gmt_offset WITH 8BUCKETS;

+-------------+-----------+----------+---------------------------------------------------------+

+-------------+-----------+----------+---------------------------------------------------------+

+-------------+-----------+----------+---------------------------------------------------------+

1row inset ( 0. 06sec)

mysql> SELECT ...

+------------+------------+--------------------------------------------------------------------------+

| promotions |total | CAST(promotions AS DECIMAL(15, 4)) / CAST(total AS DECIMAL(15, 4)) * 100 |

+------------+------------+--------------------------------------------------------------------------+

| 3213210.07 |5966836.78| 53.85114741 |

+------------+------------+--------------------------------------------------------------------------+

1row inset ( 1.37sec)

有了直方图，查询花了不到1.4秒，差不多提升了2倍。原因是：

第一个执行计划，优化器选择了第一个派生表在store表上做了全表扫描，然后对表item, store_sales, date_dim, customer，customer_address分别做了主键查找。

但是，当MySQL意识到store表会比它猜测的返回更多的数据时，优化器会在item表上做全表扫描，然后对store_sales, store, date_dim, customer，customer_address 分别做主键查找。

| 为什么不用索引？

索引往往也能做上述工作，比如：

mysql> CREATE INDEX s_gmt_offset_idx ON store (s_gmt_offset);

Query OK, 0rows affected ( 0. 53sec)

Records:0Duplicates:0Warnings:0

mysql> SELECT ...

+------------+------------+--------------------------------------------------------------------------+

| promotions |total | CAST(promotions AS DECIMAL(15, 4)) / CAST(total AS DECIMAL(15, 4)) * 100 |

+------------+------------+--------------------------------------------------------------------------+

| 3213210.07 |5966836.78| 53.85114741 |

+------------+------------+--------------------------------------------------------------------------+

1row inset ( 1.41sec)

但是，用直方图而不是索引有以下两个原因：

维护一个索引有代价。每一次的insert、update、delete都会需要更新索引，会对性能有一定的影响。而直方图一次创建永不更新，除非明确去更新它。所以不会影响insert、update、delete的性能。

如果有索引，优化器用使用index dives技术来估算符合条件范围的记录数量。这种方式也是有代价的，特别是查询语句条件中有很长的IN列表。直方图相对而言代价小，因此可能更合适。

| 检索统计直方图

统计直方图以JSON的形式存在数据字典中。可以用内建的JSON函数built-in JSON functions从直方图获取一些信息。举例来说，如果需要知道amount列的直方图的创建或者更新时间，可以用JSON unquoting extraction operator来获取信息：

mysql>SELECT

->HISTOGRAM->>'$."last-updated"'AS last_updated

->FROM INFORMATION_SCHEMA.COLUMN_STATISTICS

->WHERE

->SCHEMA_NAME = "sakila"

->AND TABLE_NAME = "payment"

->AND COLUMN_NAME = "amount";

+----------------------------+

| last_updated |

+----------------------------+

| 2017-09-15 11:54:25.000000 |

+----------------------------+

如果要查找实际有多少个buckets，以及用analyze table时指定了多少个buckets，可以如下：

mysql> SELECT

-> TABLE_NAME,

-> COLUMN_NAME,

-> HISTOGRAM- >>'$."number-of-buckets-specified"'AS num_buckets_specified,

-> JSON_LENGTH(HISTOGRAM, '$.buckets') AS num_buckets_created

-> FROM INFORMATION_SCHEMA.COLUMN_STATISTICS

-> WHERE

-> SCHEMA_NAME = "sakila";

+------------+--------------+-----------------------+---------------------+

+------------+--------------+-----------------------+---------------------+

|payment | amount |32| 19 |

| payment |payment_date | 32 |32|

+------------+--------------+-----------------------+---------------------+

经测试，num_buckets_created与字段的distinct值很接近，近似相等；但是num_buckets_created不会大于num_buckets_specified。如果num_buckets_created与num_buckets_specified相等，那么存在可能，在创建直方图的时候指定的buckets不够多，那么此时可以通过增加buckets的数量，来提高直方图的准确性。

buckets可以设置为1到1024

| 优化器trace

如果你想要知道直方图做了什么，最简单的方式就是看一下执行计划：

mysql> EXPLAIN SELECT * FROM customer WHERE c_birth_day BETWEEN 1AND 10;

+----+-------------+----------+------------+------+---------------+------+---------+------+-------+----------+-------------+

+----+-------------+----------+------------+------+---------------+------+---------+------+-------+----------+-------------+

+----+-------------+----------+------------+------+---------------+------+---------+------+-------+----------+-------------+

1row inset, 1warning ( 0. 00sec)

mysql> ANALYZE TABLE customer UPDATE HISTOGRAM ON c_birth_day WITH 32BUCKETS;

+----------------+-----------+----------+--------------------------------------------------------+

+----------------+-----------+----------+--------------------------------------------------------+

+----------------+-----------+----------+--------------------------------------------------------+

1row inset ( 0. 10sec)

mysql> EXPLAIN SELECT * FROM customer WHERE c_birth_day BETWEEN 1AND 10;

+----+-------------+----------+------------+------+---------------+------+---------+------+-------+----------+-------------+

+----+-------------+----------+------------+------+---------------+------+---------+------+-------+----------+-------------+

+----+-------------+----------+------------+------+---------------+------+---------+------+-------+----------+-------------+

1row inset, 1warning ( 0. 00sec)

可以看到filtered列，从默认的11.11%变成了更精确的32.12%。但是，如果有多个条件，有些有直方图，有些没有，就比较难判断优化器做了什么改进：

mysql> EXPLAIN SELECT * FROM customer WHERE c_birth_day <= 20AND c_birth_year = 1967;

+----+-------------+----------+------------+------+---------------+------+---------+------+-------+----------+-------------+

+----+-------------+----------+------------+------+---------------+------+---------+------+-------+----------+-------------+

+----+-------------+----------+------------+------+---------------+------+---------+------+-------+----------+-------------+

1row inset, 1warning ( 0. 00sec)

如果想要知道更多关于直方图统计的细节，可以使用trace:

mysql> SET OPTIMIZER_TRACE = "enabled=on";

Query OK, 0rows affected ( 0.00sec)

mysql> SET OPTIMIZER_TRACE_MAX_MEM_SIZE = 1000000;

Query OK, 0rows affected ( 0.00sec)

mysql> EXPLAIN SELECT * FROM customer WHERE c_birth_day <= 20AND c_birth_year = 1967;

mysql> SELECT JSON_EXTRACT(TRACE, "$**.filtering_effect") FROM INFORMATION_SCHEMA.OPTIMIZER_TRACE;

+ ----------------------------------------------------------------------------------------+

| JSON_EXTRACT(TRACE, "$**.filtering_effect") |

+ ----------------------------------------------------------------------------------------+

| [[{"condition": "(`customer`.`c_birth_day` <= 20)", "histogram_selectivity": 0.6376}]]|

+ ----------------------------------------------------------------------------------------+

1row inset ( 0.00sec)

这里用了JSON_EXTRACT从trace里取出相关的部分。对于每个条件，直方图被使用的话，就会看到估算过的字段的选择性。在这个例子里，通过直方图，对“c_birth_day <= 20”条件，估算出63.76%的数据满足条件。事实上，与实际的数据分布情况基本一致：

mysql> SELECT

-> (SELECT count(*) FROM customer WHERE c_birth_day <= 20)

-> /

-> (SELECT COUNT(*) FROM customer) AS ratio;

+--------+

| ratio |

+--------+

| 0.6376 |

+--------+

1 row in set (0.03 sec) 返回搜狐，查看更多

责任编辑：

你可能感兴趣的:(mysql,直方图统计)

基于oracle linux的 DBI/DBD 标准化安装文档(三) oracle
一、安装DBIDBI(DatabaseInterface)是perl连接数据库的接口。其是perl连接数据库的最优方法，他支持包括Orcale,Sybase,mysql,db2等绝大多数的数据库，下面将简要介绍其安装方法。1.1解压tar-zxvfDBI-1.616_901.tar.gz1.2安装依赖yuminstallperl-ExtUtils-CBuilderperl-ExtUtils-Mak
数据库管理-第304期业绩？有绩无业！（20250320）胖头鱼的鱼缸（尹海文）数据库数据库 oracle
数据库管理304期2025-03-20数据库管理-第304期业绩？有绩无业！（20250320）1词解2跑偏3活动预告总结数据库管理-第304期业绩？有绩无业！（20250320）作者：胖头鱼的鱼缸（尹海文）OracleACEPro:DatabasePostgreSQLACEPartner10年数据库行业经验拥有OCM11g/12c/19c、MySQL8.0OCP、Exadata、CDP等认证墨天
【mysql】mysql之主从部署以及介绍向往风的男子 DBA mysql 数据库
本站以分享各种运维经验和运维所需要的技能为主《python零基础入门》：python零基础入门学习《python运维脚本》：python运维脚本实践《shell》：shell学习《terraform》持续更新中：terraform_Aws学习零基础入门到最佳实战《k8》从问题中去学习k8s《docker学习》暂未更新《ceph学习》ceph日常问题解决分享《日志收集》ELK+各种中间件《运维日常》
mysql5.6主从_MySQL5.6主从复制最佳实践来B mysql5.6主从
MySQL5.6主从复制的配置环境操作系统：CentOS-6.6-x86_64MySQL版本：mysql-5.6.26.tar.gz主节点IP：192.168.31.57主机名：edu-mysql-01从节点IP：192.168.31.59主机名：edu-mysql-02MySQL主从复制官方文档MySQL主从复制(也称A/B复制)的原理Master将数据改变记录到二进制日志(binarylog)
MySQL5.6主从复制最佳实践 weixin_34252090 数据库操作系统 python
2019独角兽企业重金招聘Python工程师标准>>>MySQL5.6主从复制最佳实践MySQL5.6主从复制的配置环境操作系统：CentOS-6.6-x86_64MySQL版本：mysql-5.6.26.tar.gz主节点IP：192.168.31.57主机名：edu-mysql-01从节点IP：192.168.31.59主机名：edu-mysql-02MySQL主从复制官方文档http://d
MySQL 8主从复制配置最佳实践随风九天匠心数据库部署运维 mysql 主从复制
1.引言1.1主从复制的意义与应用场景主从复制是MySQL中用于提高数据冗余性和可用性的技术。通过将主库的数据复制到一个或多个从库，可以在主库故障时快速切换到从库，保证服务的连续性。此外，主从复制还可以用于负载均衡，将读操作分发到从库，减轻主库的压力。1.2MySQL8主从复制的新特性概述MySQL8引入了多项改进，包括：GTID（全局事务标识符）：简化复制配置和管理。半同步复制：提高数据一致性。
蓝桥杯练习day1：统计能整除数字的位数你今天刷题了吗？蓝桥杯算法职场和发展
前言给你一个整数num，返回num中能整除num的数位的数目。如果满足nums%val==0，则认为整数val可以整除nums。示例1：输入：num=7输出：1解释：7被自己整除，因此答案是1。示例2：输入：num=121输出：2解释：121可以被1整除，但无法被2整除。由于1出现两次，所以返回2。示例3：输入：num=1248输出：4解释：1248可以被它每一位上的数字整除，因此答案是4。代码1
SQL优化之MySQL执行计划（Explain）及索引失效详解一未道 #性能优化大数据 sql mysql 数据库
1、执行计划基础1.1、执行计划（Explain）定义在MySQL中可以通过explain关键字模拟优化器执行SQL语句，从而解析MySQL是如何处理SQL语句的。1.2、MySQL查询过程客户端向MySQL服务器发送一条查询请求服务器首先检查查询缓存，如果命中缓存，则立刻返回存储在缓存中的结果。否则进入下一阶段服务器进行SQL解析、预处理、之后由优化器生成对应的执行计划MySQL根据执行计划，调
Mysql相关知识：存储引擎、sql执行流程、索引失效 Cachel wood sql语言 sql server +mysql mysql sql android ab测试算法人工智能前端框架
文章目录MySQL存储引擎一、MySQL存储引擎概述二、常见存储引擎对比三、核心引擎详解1.InnoDB2.MyISAM四、如何选择存储引擎？五、引擎操作命令1.查看表的存储引擎2.修改表的存储引擎3.引擎与性能优化六、示例对比场景：频繁更新的订单表vs只读的产品分类表七、总结索引失效1.索引列使用函数或表达式2.隐式类型转换3.范围查询右侧的索引列失效4.模糊查询以通配符开头5.OR条件导致索引
Python,C++开发餐饮后厨环境远程管理APP Geeker-2025 python c++
开发一款用于**餐饮后厨环境远程管理**的App，结合Python和C++的优势，可以实现高效的后端数据处理、实时的环境监控以及用户友好的前端界面。以下是一个详细的开发方案，涵盖技术选型、功能模块、开发步骤等内容。##技术选型###后端（Python）-**编程语言**：Python-**Web框架**：Django或Flask-**数据库**：PostgreSQL或MySQL-**实时通信**：
图像处理篇---图像预处理 Ronin-Lotus 图像处理篇深度学习篇程序代码篇图像处理人工智能 opencv python 深度学习计算机视觉
文章目录前言一、通用目的1.1数据标准化目的实现1.2噪声抑制目的实现高斯滤波中值滤波双边滤波1.3尺寸统一化目的实现1.4数据增强目的实现1.5特征增强目的实现：边缘检测直方图均衡化锐化二、分领域预处理2.1传统机器学习（如SVM、随机森林）2.1.1特点2.1.2预处理重点灰度化二值化形态学操作特征工程2.2深度学习（如CNN、Transformer）2.2.1特点2.2.2预处理重点通道顺序
并查集实现算法 C嘎嘎嵌入式开发算法算法服务器 c++
畅通工程2题目描述：某省调查城镇交通状况，得到现有城镇道路统计表，表中列出了每条道路直接连通的城镇。省政府“畅通工程”的目标是使全省任何两个城镇间都可以实现交通（但不一定有直接的道路相连，只要互相间接通过道路可达即可）。问最少还需要建设多少条道路？输入描述：测试输入包含若干测试用例。每个测试用例的第1行给出两个正整数，分别是城镇数目N(#include#include#include#includ
SvelteKit 最新中文文档教程（6）—— 状态管理
前言Svelte，一个语法简洁、入门容易，面向未来的前端框架。从Svelte诞生之初，就备受开发者的喜爱，根据统计，从2019年到2024年，连续6年一直是开发者最感兴趣的前端框架No.1：Svelte以其独特的编译时优化机制著称，具有轻量级、高性能、易上手等特性，非常适合构建轻量级Web项目。为了帮助大家学习Svelte，我同时搭建了Svelte最新的中文文档站点。如果需要进阶学习，也可以入手我
AI 时代，学习 Java 应如何入手？琢磨先生David 人工智能 java
一、Java的现状：生态繁荣与AI融合的双重机遇在2025年的技术版图中，Java依然稳坐企业级开发的“头把交椅”。根据行业统计，Java在全球企业级应用中的市场份额仍超过65%，尤其在微服务架构、大数据平台和物联网（IoT）领域占据核心地位。随着云原生技术的普及，Java生态正经历新一轮进化：轻量化框架通过无服务器架构优化，启动速度提升300%，内存占用降低50%，使得Java在容器化部署中更具
3DMAX点云算法：实现毫米级BIM模型偏差检测（附完整代码）夏末之花人工智能
摘要本文基于激光雷达点云数据与BIM模型的高精度对齐技术，提出一种融合动态体素化与多模态特征匹配的偏差检测方法。通过点云预处理、语义分割、模型配准及差异分析，最终实现建筑构件毫米级偏差的可视化检测。文中提供关键代码实现，涵盖点云处理、特征提取与深度学习模型搭建。一、核心算法流程点云预处理与特征增强去噪与下采样：采用统计滤波与体素网格下采样，去除离群点并降低数据量。语义分割：基于PointNet++
【免费】1952-2020年全国人均GDP数据 2501_90487648 数据 #全国全国人均GDP
1952-2020年全国人均GDP数据1、时间：1952-2020年2、来源：国家统计局、统计年鉴3、指标：全国人均GDP4、范围：全国层面5、指标解释：人均GDP（GrossDomesticProductpercapita）是指一个国家或地区在一定时期内（通常为一年）创造的国内生产总值（GDP）与该地区人口总数的比值。它是衡量国家经济发展水平和居民生活水平的重要指标之一。6、下载链接：1952-
常见的数学统计模型若木胡数学模型
以下是常见的数学统计模型分类及简要说明，适用于数据分析、预测和推断等场景：1.参数模型（ParametricModels）假设数据服从特定分布（如正态分布），通过估计参数来描述数据规律。1.1线性回归模型数学形式：(y=\beta_0+\beta_1x_1+\beta_2x_2+\cdots+\beta_px_p+\epsilon)应用：预测连续型目标变量（如房价预测）。特点：简单、可解释性强，假
【数据库】MySQL的索引详解此木|西贝数据库数据库 mysql
简介索引是一种用于快速查询和检索数据的数据结构，类似于书的目录。在几百页的书通过几页目录就可以精确定位到我们想看的章节优点和缺点优点正确的使用索引可以大大提高检索速度可以使用唯一索引保证数据在库中的唯一性使用聚合索引减少回表，降低IO次数缺点索引不宜创建的太多，否则增删改时不仅修改数据，还要修改大量的索引数据索引也会占用磁盘空间索引结构B树：多路平衡查找树，B树的所有节点都会存储key（索引）和d
【数据库】MySQL事务详解此木|西贝数据库数据库 mysql
事务的隔离级别读未提交（read-uncommitted）：最低级的隔离级别，允许其他事务读到未提交的值；读已提交（read-committed）：事务只能读取到其他事务提交的数据；可重复读（repeatable-read）：对同一条数据多次读取结果都是一样（mysql默认隔离级别）；串行化（serializable）：最高的隔离级别，所有事务穿行执行，事务间不会产生干扰隔离级别存在的问题读未提交
金融领域股票价格预测：线性回归原理、实现与应用 ZhShy23 python 机器学习入门实战 #机器学习 #Python学习金融线性回归机器学习
金融领域股票价格预测：线性回归原理、实现与应用一、线性回归原理线性回归是一种用于建立自变量和因变量之间线性关系的统计模型。在股票价格预测中，我们可以将一些可能影响股票价格的因素（如成交量、市场指数等）作为自变量，股票价格作为因变量，通过线性回归模型来建立它们之间的关系。线性回归的基本方程为：[y=\beta_0+\beta_1x_1+\beta_2x_2+\cdots+\beta_nx_n+\ep
机器学习流程—数据预处理清洗不二人生机器学习机器学习人工智能数据预处理
文章目录机器学习流程—数据预处理清洗定义问题数据预处理数据加载与展示重复数据处理数据类型空值处理无关特征删除数据分布删除异常值生成标签和特征数据分割机器学习流程—数据预处理清洗数据处理是将数据从给定形式转换为更可用和更理想的形式的任务，即使其更有意义、信息更丰富。使用机器学习算法、数学建模和统计知识，整个过程可以自动化。这个完整过程的输出可以是任何所需的形式，如图形、视频、图表、表格、图像等等，具
如何在MySQL中创建定时任务？数据库mysql
在mysql中我们可以可以通过事件调度器(EventScheduler)，让MySQL定时为我们执行一些任务。例如：在MySQL中实现每天凌晨0点定时清空指定的test表，并在一个月后自动停止该定时任务。以下是完整步骤：步骤1：启用MySQL事件调度器默认情况下事件调度器可能关闭，需手动启用：--临时启用（重启失效）SETGLOBALevent_scheduler=ON;--永久启用（修改配置文件
mysql8.4.4+keepalived高可用部署平山海D mysql
提示：文章写完后，目录可以自动生成，如何生成可参考右边的帮助文档文章目录前言一、安装mysql（两节点都安装）二、安装keepalived（两节点都安装）三、修改mysql配置四、修改keepalived配置五、验证备注前言内网环境下，mysql8.4.4+keepalived高可用部署，仅作备份记录一、安装mysql（两节点都安装）从mysql官网离线下载mysql-8.4.4-1.el8.x8
华为OD E卷 #28 API集群负载统计时光回响华为OD机试E卷华为od
题目某个产品的RESTfulAPI集合部署在服务器集群的多个节点上，近期对客户端访问日志进行了采集，需要统计各个API的访问频次，根据热点信息在服务器节点之间做负载均衡，现在需要实现热点信息统计查询功能。RESTfulAPI是由多个层级构成，层级之间使用/连接，如/A/B/C/D这个地址，A属于第一级，B属于第二级，C属于第三级，D属于第四级。现在负载均衡模块需要知道给定层级上某个名字出现的频次，
SQL分类 penglaifei Web sql 数据库
DDL(DataDefiationLanguage)数据定义语言，用来定义数据库对象（数据库、表、字段）数据库操作——查询所有数据库：show.databases；注：information_schemamysqlperformance_schemasys是系统自带的数据库——查询当前数据库selectdatabase();——使用/切换数据库usename#数据库名；——创建数据库（数据库名不可
计算机毕业设计之基于Hadoop的热点新闻分析系统的设计与实现微信bishe69 课程设计 python django mysql
近些年来，随着科技的飞速发展，互联网的普及逐渐延伸到各行各业中，给人们生活带来了十分的便利，热点新闻分析系统利用计算机网络实现信息化管理，使整个热点新闻分析的发展和服务水平有显著提升。本文拟采用PyCharm开发工具，django框架、Python语言、Hadoop大数据处理技术进行开发，后台使用MySQL数据库进行信息管理，设计开发的热点新闻分析系统。通过调研和分析，系统拥有管理员和用户两个模块
如何在MySQL中创建定时任务？云心雨禅技术实操 mysql 数据库
在mysql中我们可以可以通过事件调度器(EventScheduler)，让MySQL定时为我们执行一些任务。例如：在MySQL中实现每天凌晨0点定时清空指定的test表，并在一个月后自动停止该定时任务。以下是完整步骤：步骤1：启用MySQL事件调度器默认情况下事件调度器可能关闭，需手动启用：--临时启用（重启失效）SETGLOBALevent_scheduler=ON;--永久启用（修改配置文件
计算机毕业设计PHP保利和院物业服务管理系统小程序（源码+程序+uni+lw+部署）计算机专业毕设程序课程设计 php 小程序
该项目含有源码、文档、程序、数据库、配套开发软件、软件安装教程。欢迎交流项目运行环境配置：phpStudy+Vscode+Mysql5.7+HBuilderX+Navicat11+Vue+Express。项目技术：原生PHP++Vue等等组成，B/S模式+Vscode管理+前后端分离等等。环境需要1.运行环境：最好是小皮phpstudy最新版，我们在这个版本上开发的。其他版本理论上也可以。2.开发
一文搞懂MYSQL、SQL、SQLServer、SQLyog的区别和联系码上就位 mysql sql sqlserver
1.SQL（StructuredQueryLanguage）定义：SQL是结构化查询语言，主要用于管理和操作关系型数据库（RDBMS）。它是一种标准化语言，由ISO和ANSI定义，支持数据的查询、插入、更新、删除和数据库结构的定义。特点：通用性：SQL是关系型数据库的通用语言，支持多种数据库系统，如MySQL、SQLServer、Oracle、PostgreSQL等。功能性：DDL（数据定义语言）
告别繁琐！5分钟搞定Linux上MySQL 8安装，小白也能轻松上手！ IT_狂奔者 Databases linux mysql 运维
概述MySQL是一个广泛使用的开源关系型数据库管理系统，适用于各种规模的应用程序。MySQL8引入了许多新特性和性能改进，因此在Linux服务器上安装MySQL8是一个常见的需求。本文将指导大家如何在Linux系统上安装MySQL8，并假设已经完成了安装过程。我们将重点放在安装后的配置和使用上。目录概述一、安装MySQL8.x及配置1.1安装1.2使用方法1.2.1赋予执行权限1.2.2运行脚本1
VMware Workstation 11 或者 VMware Player 7安装MAC OS X 10.10 Yosemite iwindyforest vmware mac os 10.10 workstation player
最近尝试了下VMware下安装MacOS 系统，安装过程中发现网上可供参考的文章都是VMware Workstation 10以下， MacOS X 10.9以下的文章，只能提供大概的思路，但是实际安装起来由于版本问题，走了不少弯路，所以我尝试写以下总结，希望能给有兴趣安装OSX的人提供一点帮助。写在前面的话：其实安装好后发现，由于我的th
关于《基于模型驱动的B/S在线开发平台》源代码开源的疑虑？ deathwknight JavaScript java 框架
本人从学习Java开发到现在已有10年整，从一个要自学 java买成javascript的小菜鸟，成长为只会java和javascript语言的老菜鸟（个人邮箱：[email protected]）一路走来，跌跌撞撞。用自己的三年多业余时间，瞎搞一个小东西（基于模型驱动的B/S在线开发平台，非MVC框架、非代码生成）。希望与大家一起分享，同时有许些疑虑，希望有人可以交流下平台
如何把maven项目转成web项目 Kai_Ge maven MyEclipse
创建Web工程，使用eclipse ee创建maven web工程 1.右键项目,选择Project Facets,点击Convert to faceted from 2.更改Dynamic Web Module的Version为2.5.(3.0为Java7的,Tomcat6不支持). 如果提示错误,可能需要在Java Compiler设置Compiler compl
主管？？？ Array_06 工作
转载：http://www.blogjava.net/fastzch/archive/2010/11/25/339054.html 很久以前跟同事参加的培训，同事整理得很详细，必须得转！前段时间，公司有组织中高阶主管及其培养干部进行了为期三天的管理训练培训。三天的课程下来，虽然内容较多，因对老师三天来的课程内容深有感触，故借着整理学习心得的机会，将三天来的培训课程做了一个
python内置函数大全 2002wmj python
最近一直在看python的document，打算在基础方面重点看一下python的keyword、Build-in Function、Build-in Constants、Build-in Types、Build-in Exception这四个方面，其实在看的时候发现整个《The Python Standard Library》章节都是很不错的，其中描述了很多不错的主题。先把Build-in Fu
JSP页面通过JQUERY合并行 357029540 JavaScript jquery
在写程序的过程中我们难免会遇到在页面上合并单元行的情况，如图所示如果对于会的同学可能很简单，但是对没有思路的同学来说还是比较麻烦的，提供一下用JQUERY实现的参考代码 function mergeCell(){ var trs = $("#table tr"); &nb
Java基础冰天百华 java基础
学习函数式编程 package base; import java.text.DecimalFormat; public class Main { public static void main(String[] args) { // Integer a = 4; // Double aa = (double)a / 100000; // Decimal
unix时间戳相互转换 adminjun 转换 unix 时间戳
如何在不同编程语言中获取现在的Unix时间戳(Unix timestamp)？ Java time JavaScript Math.round(new Date().getTime()/1000) getTime()返回数值的单位是毫秒 Microsoft .NET / C# epoch = (DateTime.Now.ToUniversalTime().Ticks - 62135
作为一个合格程序员该做的事 aijuans 程序员
作为一个合格程序员每天该做的事 1、总结自己一天任务的完成情况最好的方式是写工作日志，把自己今天完成了什么事情，遇见了什么问题都记录下来，日后翻看好处多多 2、考虑自己明天应该做的主要工作把明天要做的事情列出来，并按照优先级排列，第二天应该把自己效率最高的时间分配给最重要的工作 3、考虑自己一天工作中失误的地方，并想出避免下一次再犯的方法出错不要紧，最重
由html5视频播放引发的总结 ayaoxinchao html5 视频 video
前言项目中存在视频播放的功能，前期设计是以flash播放器播放视频的。但是现在由于需要兼容苹果的设备，必须采用html5的方式来播放视频。我就出于兴趣对html5播放视频做了简单的了解，不了解不知道，水真是很深。本文所记录的知识一些浅尝辄止的知识，说起来很惭愧。视频结构本该直接介绍html5的<video>的，但鉴于本人对视频
解决httpclient访问自签名https报javax.net.ssl.SSLHandshakeException: sun.security.validat bewithme httpclient
如果你构建了一个https协议的站点，而此站点的安全证书并不是合法的第三方证书颁发机构所签发，那么你用httpclient去访问此站点会报如下错误 javax.net.ssl.SSLHandshakeException: sun.security.validator.ValidatorException: PKIX path bu
Jedis连接池的入门级使用 bijian1013 redis redis数据库 jedis
Jedis连接池操作步骤如下： a.获取Jedis实例需要从JedisPool中获取； b.用完Jedis实例需要返还给JedisPool； c.如果Jedis在使用过程中出错，则也需要还给JedisPool； packag
变与不变 bingyingao 不变变亲情永恒
变与不变周末骑车转到了五年前租住的小区，曾经最爱吃的西北面馆、江西水饺、手工拉面早已不在，各种店铺都换了好几茬，这些是变的。三年前还很流行的一款手机在今天看起来已经落后的不像样子。三年前还运行的好好的一家公司，今天也已经不复存在。一座座高楼拔地而起，
【Scala十】Scala核心四：集合框架之List bit1129 scala
Spark的RDD作为一个分布式不可变的数据集合，它提供的转换操作，很多是借鉴于Scala的集合框架提供的一些函数，因此，有必要对Scala的集合进行详细的了解 1. 泛型集合都是协变的，对于List而言，如果B是A的子类，那么List[B]也是List[A]的子类，即可以把List[B]的实例赋值给List[A]变量 2. 给变量赋值(注意val关键字，a，b
Nested Functions in C bookjovi c closure
Nested Functions 又称closure，属于functional language中的概念，一直以为C中是不支持closure的，现在看来我错了，不过C标准中是不支持的，而GCC支持。既然GCC支持了closure，那么 lexical scoping自然也支持了，同时在C中label也是可以在nested functions中自由跳转的
Java-Collections Framework学习与总结-WeakHashMap BrokenDreams Collections
总结这个类之前，首先看一下Java引用的相关知识。Java的引用分为四种：强引用、软引用、弱引用和虚引用。强引用：就是常见的代码中的引用，如Object o = new Object();存在强引用的对象不会被垃圾收集
读《研磨设计模式》-代码笔记-解释器模式-Interpret bylijinnan java 设计模式
声明：本文只为方便我个人查阅和理解，详细的分析以及源代码请移步原作者的博客http://chjavach.iteye.com/ package design.pattern; /* * 解释器（Interpreter）模式的意图是可以按照自己定义的组合规则集合来组合可执行对象 * * 代码示例实现XML里面1.读取单个元素的值 2.读取单个属性的值 * 多
After Effects操作&快捷键 cherishLC After Effects
1、快捷键官方文档中文版：https://helpx.adobe.com/cn/after-effects/using/keyboard-shortcuts-reference.html 英文版：https://helpx.adobe.com/after-effects/using/keyboard-shortcuts-reference.html 2、常用快捷键
Maven 常用命令 crabdave maven
Maven 常用命令 mvn archetype:generate mvn install mvn clean mvn clean complie mvn clean test mvn clean install mvn clean package mvn test mvn package mvn site mvn dependency:res
shell bad substitution daizj shell 脚本
#!/bin/sh /data/script/common/run_cmd.exp 192.168.13.168 "impala-shell -islave4 -q 'insert OVERWRITE table imeis.${tableName} select ${selectFields}, ds, fnv_hash(concat(cast(ds as string), im
Java SE 第二讲（原生数据类型 Primitive Data Type） dcj3sjt126com java
Java SE 第二讲： 1. Windows: notepad, editplus, ultraedit, gvim Linux: vi, vim, gedit 2. Java 中的数据类型分为两大类： 1）原生数据类型（Primitive Data Type） 2）引用类型（对象类型）（R
CGridView中实现批量删除 dcj3sjt126com PHP yii
1，CGridView中的columns添加 array( 'selectableRows' => 2, 'footer' => '<button type="button" onclick="GetCheckbox();" style=&
Java中泛型的各种使用 dyy_gusi java 泛型
Java中的泛型的使用：1.普通的泛型使用在使用类的时候后面的<>中的类型就是我们确定的类型。 public class MyClass1<T> {//此处定义的泛型是T private T var; public T getVar() { return var; } public void setVa
Web开发技术十年发展历程 gcq511120594 Web 浏览器数据挖掘
回顾web开发技术这十年发展历程： Ajax 03年的时候我上六年级，那时候网吧刚在小县城的角落萌生。传奇，大话西游第一代网游一时风靡。我抱着试一试的心态给了网吧老板两块钱想申请个号玩玩，然后接下来的一个小时我一直在，注，册，账，号。彼时网吧用的512k的带宽，注册的时候，填了一堆信息，提交，页面跳转，嘣，”您填写的信息有误，请重填”。然后跳转回注册页面，以此循环。我现在时常想，如果当时a
openSession()与getCurrentSession()区别： hetongfei java DAO Hibernate
来自 http://blog.csdn.net/dy511/article/details/6166134 1.getCurrentSession创建的session会和绑定到当前线程,而openSession不会。 2. getCurrentSession创建的线程会在事务回滚或事物提交后自动关闭,而openSession必须手动关闭。这里getCurrentSession本地事务(本地
第一章安装Nginx+Lua开发环境 jinnianshilongnian nginx lua openresty
首先我们选择使用OpenResty，其是由Nginx核心加很多第三方模块组成，其最大的亮点是默认集成了Lua开发环境，使得Nginx可以作为一个Web Server使用。借助于Nginx的事件驱动模型和非阻塞IO，可以实现高性能的Web应用程序。而且OpenResty提供了大量组件如Mysql、Redis、Memcached等等，使在Nginx上开发Web应用更方便更简单。目前在京东如实时价格、秒
HSQLDB In-Process方式访问内存数据库 liyonghui160com
HSQLDB一大特色就是能够在内存中建立数据库，当然它也能将这些内存数据库保存到文件中以便实现真正的持久化。先睹为快！下面是一个In-Process方式访问内存数据库的代码示例：下面代码需要引入hsqldb.jar包（hsqldb-2.2.8） import java.s
Java线程的5个使用技巧 pda158 java 数据结构
Java线程有哪些不太为人所知的技巧与用法？　　萝卜白菜各有所爱。像我就喜欢Java。学无止境，这也是我喜欢它的一个原因。日常工作中你所用到的工具，通常都有些你从来没有了解过的东西，比方说某个方法或者是一些有趣的用法。比如说线程。没错，就是线程。或者确切说是Thread这个类。当我们在构建高可扩展性系统的时候，通常会面临各种各样的并发编程的问题，不过我们现在所要讲的可能会略有不同。
开发资源大整合：编程语言篇——JavaScript（1） shoothao JavaScript
概述：本系列的资源整合来自于github中各个领域的大牛，来收藏你感兴趣的东西吧。程序包管理器管理javascript库并提供对这些库的快速使用与打包的服务。 Bower - 用于web的程序包管理。 component - 用于客户端的程序包管理，构建更好的web应用程序。 spm - 全新的静态的文件包管
避免使用终结函数 vahoa.ma java jvm C++
终结函数（finalizer）通常是不可预测的，常常也是很危险的，一般情况下不是必要的。使用终结函数会导致不稳定的行为、更差的性能，以及带来移植性问题。不要把终结函数当做C++中的析构函数（destructors）的对应物。我自己总结了一下这一条的综合性结论是这样的： 1）在涉及使用资源，使用完毕后要释放资源的情形下，首先要用一个显示的方