Knows__

python统计分析学习笔记

统计数据的展示

数据类型

数值型：采用某些特定的统计学方法

连续数值型：

身高、体重

离散数值型：

子女的个数：012345

分类型：其他方法

分类数据

布尔变量

名义变量

等级变量

在python中作图

函数式和面向对象式的绘图方法

函数式

面向对象式（优势：学术上表达事情明确清晰）

交互式绘图

matplotlib交互不如Matlab直观

展示统计学数据集

seaborn\pandas 都是基于matplotlib

seaborn 旨在提供一个简洁、高层的接口，用于绘制富含信息扯且美观的统计学图形

pandas 提供了许多可视化数据框的方法

单变量数据

1.散点图

或

2.直方图

3.核密度（KDE）估计图

用正态分布解决直方图非连续的问题

4.累积频率

正态分布的累积频率函数

5.误差条图

使用标准误有一个很好的特性:当基于标准误的两组误差条图之间有重叠时，我们可以确定两组之间的均值没有统计学差异( p >0.05 )。反之则不一定成立!

6.箱形图

箱子的底部和顶部分别表示第一分位数和第三分位数，箱子内部中间的线表示中位数，

下面的须表示在第一分位数外 1.5 x IQR (四分位距）范围内的最低值，而上面的须表示在第三分位数外

1.5 X IQR (四分位距）范围内的最高值。（另一个习惯用法是须表示了整个数据的范围。）

小提琴图=箱形图+核密度估计图

纵轴和箱形图一样，但是在水平方向上额外绘制了对称的核密度估计图

7.分组的条形图

8.饼图

二元变量和多元变量绘图

1.二元变量散点图

带有不同大小数据点的散点图

2.3D图

3D图坐标轴需要显式声明，一旦正确定义坐标轴，剩下的部分就很直观了

分布和假设检验

总体和样本

总体：包括数据集中的所有元素

样本：总体中的一个或多个观察值组成

参数：总体的特征，如均值或标准偏差（度量数据分布的分散程度）通常用希腊字母表示

统计量：一个样本的可测量的特征

• 样本数据的均值；

• 样本数据的极差；

• 数据与样本均值的偏离

抽样分布：基于随机样本的给定统计量的概率分布

概率分布

概率密度：X为连续型随机变量，称f(x)为X的概率密度函数，简称为概率密度

概率分布：，在统计图上画出概率密度，概率分布是描述总体和样中数值数据分布的数学工具

离散分布

掷骰子

对于给定的离散分布， Pi称为该分布的概率质量函数（PMF)

连续分布

例如，一个人的重量可以是任意正数，描述每个值的概率的曲线，即概率分布，是一个连续函数，称为概率

密度函数 (PDF）。

p(x) 是值 x 的概率密度函数。在 a 和 b 之间的 p(x) 上的积分表示在该范围内找到 x 的值的可能性

期望值和方差

1.期望值

离散分布：

连续分布：

2.方差

自由度Degrees of Freedom（DOF）

自由度：取值不受限制的变量个数

22个人，分三组，两组样本均值知道，总体样本均值知道，即可求出第三组样本均值，因此确定的值终于三个，自由度减三。

求方差，分母是自由度

研究设计

术语

因素：被控制的输入变量

协同因素：木被控制的输入变量

协变量：一个对研究结局有可能做出预测的变量，并且可以是因素或协同因素

两个输入和个输出：

概述

单变量的分布

单变量的分布：一个变量的分布

离散分布：整数值

连续分布：浮点值

分布的特征描述

分布中心

用参数描述分布中心

均值（算术均值）

受异常值影响

numpy

2.中位数

数据按顺序排列时中间的值，不受异常值影响

3.众数

一个分布中出现最频繁的值

4.几何均值

几何平均可以用来描述分布的位置，通过计算每个值的对数的算数平均值得到

量化变异度

1.极差

2.百分位数

CDF是PDF从负无穷大到给定值的积分

3.标准差和方差

样本方差的极大似然估计（’有偏估计‘）（被除数为样本数）

群体方差的‘无偏估计‘（被除数为自由度n-1）

样本标准差

4.标准误

样本均值的标准误(Standard Error for the Sample Mean)

对一个总体多次抽样，每次样本大小都为n，那么每个样本都有自己的平均值，这些平均值的标准差叫做标准误

反映样本平均数对总体平均数的变异程度。

5.置信区间

[a,b]称为置信区间

a = 样本均值 - z标准误差

b = 样本均值 + z标准误差

分布形状的参数描述

1.位置

2.尺度

尺度参数描述了概率分布的宽度

3.形状参数

偏度：标准差大于均值的一半是偏斜分布而不是正态

峰度：概率分布的’陡峭程度‘，正太分布峰度为3

离散分布

伯努利分布

抛硬币一次，是二项分布的特殊情况

二项分布

抛硬币多次

泊松分布

在连续的空间或时间内离散事件发生的次数（X为整数）

正态分布

分布和假设检验

来自正态分布的连续型分布

ｔ分布：正态分布的总体中，样本均值的样本分布。通常用于小样本数且真实的均值／标准差不知道的情况。

卡方分布：用于描述正态分布数据的变异程度

F分布：用于比较两组正态分布的变异程度

ｔ分布

在大多数情况下，总体的均值和方差是未知的，我们在分析样本数据的时候一般都是处理ｔ分布

常见应用是：计算均值的置信区间

import numpy as np
from scipy import stats 
n=20
df=n-1#自由度
alpha=0.05#alpha是分位点 置信区间95%~0.05
stats.t(df).isf(alpha/2)
stats.norm.isf(alpha/2)
#均值的 95% 可信区间
alpha=0.95
df=len(data)-1
ci=stats.interval(alpha,df,loc=np.mean(data),scale=stats.sem(data))

ｔ分布的尾部比正态分布长，它更不易受极端例子影响

t 分布在处理异常值时比正态分布更加稳健。（上图）以来自正态分布的样本进行最佳拟合的正态分布和 t 分布。（下图）是相同的分布，但是加上了 20 个异常值，这些异常值在 5 附近呈正态分布

卡方分布

用于描述正态分布数据的变异程度

当服从正态分布的随机变量数（ｎ）越大时，自由度也越大，卡方分布图像越接近正态分布

F分布

比较两组正态分布的变异程度

方差分析

方差分析(Analysis of Variance，简称ANOVA)

又称“变异数分析”，用于两个及两个以上样本均数差别的显著性检验

F分布图

F分布和卡方分布：

F分布定义：设X、Y为两个独立的随机变量，X服从自由度为k1的卡方分布，Y服从自由度为k2的卡方分布，这2 个独立的卡方分布被各自的自由度除以后的比率这一统计量的分布

其他连续型分布

对数正态分布：在对数坐标系上绘制的正态分布我们常将强烈偏斜的分布通过对数转换成正态分布

韦伯分布：主要用于可靠性或生存数据

指数分布：指数曲线

均匀分布：所有的值的可能性都相同

对数正态分布

对数正态分布，在线性横坐标（左）和对数横坐标（右）下绘制。

韦伯分布

韦伯分布　所有曲线的尺度参数都是 λ=1

指数分布

概率分布函数：

指数分布

均匀分布

所有的数据值的概率都相同

假设检验

数据筛选和离群值

离群值：离祥本均值超过 1.5 x IQR (4 分位数间距），或两个以上的标准偏差之外的数据（对于正态分布的样本）

正态性检验

假设检验：

参数检验：数据可被多个参数定义

非参数检验：不依赖数据服从特定分布

概率图：

QQ-图：quantile (分位数）

PP-图:数据集和参考分布的CDF一起绘制

正态性检验

基于样本的描述性统计学的检验，例如偏度检验、峰度检验

转换

对数据进行对数转换成正态分布

假设概念、错误、P值和样本量

假设检验步骤：

从总体中抽取一个随机样本

构建一个无效假设，同时构建与无效假设对立的备择假设(无效假设：总体均值和样本均值之间没有差异)

计算已知概率分布的检验统计量（确定样本服从的概率分布，正态/t/F分布）

比较观测值的统计量（p值：probability value）

拒绝或接受假设（p值和alpha比较，P值小于alpha，则拒绝无效假设，因为在该假设前提下，小概率事件发生了，因此假设不成立）

错误的类型

检验效能：与备择假设结合分析才有意义，它的意义是:当两总体确有差别时,按规定的检验水准.α能够发现该差别的能力

受试者操作特征（ROC）曲线

接受者操作特性曲线是指在特定刺激条件下，以被试在不同判断标准下所得的虚报概率P（y/N）为横坐标，以击中概率P（y/SN）为纵坐标，画得的各点的连线。

数值型数据的均值检验

样本均值的分布

单样本均值的t检验

从样本中估计均值和标准差，并用来描述来自正态分布的样本均值的t分布（标准误：平均值的标准差）

左：样本数据的频率直方图，带有正态拟合（绿线）。样本均值和总体均值非常接近，黄色三角形代表样本均值，红色三角形代表作为对比的值。右：均值的抽样分布（t 分布，自由度是 n -1）。底部是标准化的样本均值（黄色三角形）和进行比较的值（红色三角形）。红色阴影面积的和表示和红色箭头一样极端或更极端的值对应的 p 值

两组之间的比较

配对t检验

用学生们进入初中时的尺寸和他们第一年后的尺寸｀来检验他们是否生长了由于我们只是对每个个体在第一次和第二次测量之间的差异感兴趣，该检验被叫作配对t检验,该检验基本上和单样本均值t检验相对应

独立组别之间的t检验（非配对t检验）

基本的思想和单样本t检验是一样但我们需要的是两组之间均值差异的方差而不是均值的方差

统计学假设检验和统计学建模

1.经典t检验

2.统计学建模

建立一个统计模型，并分析模型参数的显著性

多组比较

方差分析

方差分析的思想是将方差分为组间方差和组内方差，看这些分布是否符合零假设，即所有组都来自同一分布

用于样本平均数与总体平均数或者两个样本平均数间的差异显著性检验

在两个例子中，两组间的差异是相同的。但在左边，组内差异比组间差异要小；而在右边，组内差异比组间差异要大

单因素方差分析

假定所有的样本都来自同方差的正态分布的总体，同方差的假设可以用 Levene 检验来检查。

多重比较：

无效假设是所有样本的均值是相同的，所以如果单因索方差分析产生了一个显著的结果，我们只知逍他们不是相同的。

进行多种检验，每一种检验用于一对样本，可以分析得到等均值假设在哪对样本中被拒绝。（一般来说，这由t检验完成）

多重检验：

两因素方差分析

观察每个因素是否显著，检查这些因素的交互因素是否对数据的分布有显著影响。

三因素方差分析

有两个以的因素的话，建议使用统计学建校的方法进行数据分析

选择正确的检验方法进行组间比较

典型的检验

假设的例子

名义变量

2组，名义变量男性／女性，金发／黑发。比如，＂拥有金发的女性要多于男性吗？”

2组，配对名义量 2个实验室，分析血样。比如，“实验室1进行的血样分析是否比实验室2的分析预示着更多的感染？”

有序变量

2组，有序变量，牙买加人／美国人，1 00 米短跑排名比如，＂牙买加短跑运动员比美国短跑运动员更成功？”

2组，配对有序变量，短跑运动员，进食前／后。比如，”进食巧克力会让短跑运动员更成功吗？”

分类数据的检验

置信区间

样本服从分布，样本是否能代表标准总体，对样本的标准误进行假设检验，假设检验结果在置信区间内则可以代表总体。

统计建模

假设检验可以决定两组或两组以上的数据样本是否来自同一总体或不同的总体，但它们不能量化两个或多个变量之间的关系强度

线性回归模型

线性相关

秩相关

数据不是正态分布的，需要采取不同的方法（Spearman's ，Kendall's ）

对数据集的每个变量进行排序，并比较这个顺序

一般线性回归模型

用一个或多个其他的变量预测一个变量

最小二乘法求最佳拟合线

决定系数R^2

多元数据分析

两个变量变为多个变量是，相关系数被相关矩阵取代，需要预测许多其他变量的值，线性回归必须被多重线性回归替代即多多元线性回归。

可视化多元相关

散点图矩阵

散点图表示不同变量之间的相关性

多元线性回归

离散数据检验

掷骰子，数据的离散的结果

引入广义线性模型（GLM）

GLM应用：python 实现logistic回归

贝叶斯统计学

probability 概率（P）的解释

频率学派：P为出现的频率

如果一个实验的结果有着P的概率．那意味着如果实验重复N次（其中N是个很大

的数），那么我们会观察到 Nxp 次该结果。

贝叶斯学派：P是对于一个特定结果可能性的信心

将观察到的数据固定下来，观察找到特定校型参数的可能性

贝叶斯学派和频率学派的解释

贝叶斯的优势：在计算概率P的时候应用贝叶斯定理，引入先验知识。

贝叶斯解释：概率测量的是置信度

例如，假设我们有 50% 的程度相信一个硬币正面朝上的概率是背面朝上的2倍，

如果硬币抛了很多次，并观察到了结果，那么基于这个结果，置信度可能上升、下降或保持不变

（会用到全概率法则拓展）

贝叶斯方法提供了处理参数和模型的不确定性的自然框架，借助如 PyMC或，scikit-learn 等工具进行实现

情绪觉察日记第37天露露_e800
今天是家庭关系规划师的第二阶最后一天，慧萍老师帮我做了个案，帮我处理了埋在心底好多年的一份恐惧，并给了我深深的力量！这几天出来学习，爸妈过来婆家帮我带小孩，妈妈出于爱帮我收拾东西，并跟我先生和婆婆产生矛盾，妈妈觉得他们没有照顾好我…。今晚回家见到妈妈，我很欣赏她并赞扬她，妈妈说今晚要跟我睡我说好，当我们俩躺在床上准备睡觉的时候，我握着妈妈的手对她说:妈妈这几天辛苦你了，你看你多利害把我们的家收拾得
机器学习与深度学习间关系与区别 ℒℴѵℯ心·动ꦿ໊ོ꫞ 人工智能学习深度学习 python
一、机器学习概述定义机器学习（MachineLearning,ML）是一种通过数据驱动的方法，利用统计学和计算算法来训练模型，使计算机能够从数据中学习并自动进行预测或决策。机器学习通过分析大量数据样本，识别其中的模式和规律，从而对新的数据进行判断。其核心在于通过训练过程，让模型不断优化和提升其预测准确性。主要类型1.监督学习（SupervisedLearning）监督学习是指在训练数据集中包含输入
铭刻于星（四十二）随风至
69夜晚，绍敏同学做完功课后，看了眼房外，没听到动静才敢从书包的夹层里拿出那个心形纸团。折痕压得很深，都有些旧了，想来是已经写好很久了。绍敏同学慢慢地、轻轻地捏开折叠处，待到全部拆开后，又反复抚平纸张，然后仔细地一字字默看。只是开头的三个字是第一次看到，让她心漏跳了几拍。“亲爱的绍敏：从四年级的时候，我就喜欢你了，但是我一直不敢说，怕影响你学习。六年级的时候听说有人跟你表白，你接受了，我很难过，但
UI学习——cell的复用和自定义cell Magnetic_h ui 学习
目录cell的复用手动（非注册）自动（注册）自定义cellcell的复用在iOS开发中，单元格复用是一种提高表格（UITableView）和集合视图（UICollectionView）滚动性能的技术。当一个UITableViewCell或UICollectionViewCell首次需要显示时，如果没有可复用的单元格，则视图会创建一个新的单元格。一旦这个单元格滚动出屏幕，它就不会被销毁。相反，它被添
学点心理知识，呵护孩子健康静候花开_7090
昨天听了华中师范大学教育管理学系副教授张玲老师的《哪里才是学生心理健康的最后庇护所，超越教育与技术的思考》的讲座。今天又重新学习了一遍，收获匪浅。张玲博士也注意到了当今社会上的孩子由于心理问题导致的自残、自杀及伤害他人等恶性事件。她向我们普及了一个重要的命题，她说心理健康的一些基本命题，我们与我们通常的一些教育命题是不同的，她还举了几个例子，让我们明白我们原来以为的健康并非心理学上的健康。比如如果
ArcGIS栅格计算器常见公式（赋值、0和空值的转换、补充栅格空值）研学随笔 arcgis 经验分享
我们在使用ArcGIS时通常经常用到栅格计算器，今天主要给大家介绍我日常中经常用到的几个公式，供大家参考学习。将特定值（-9999）赋值为0，例如-9999.Con("raster"==-9999,0,"raster")2.给空值赋予特定的值（如0）Con(IsNull("raster"),0,"raster")3.将特定的栅格值(如1)赋值为空值，其他保留原值SetNull("raster"==
【一起学Rust | 设计模式】习惯语法——使用借用类型作为参数、格式化拼接字符串、构造函数广龙宇一起学Rust #Rust设计模式 rust 设计模式开发语言
提示：文章写完后，目录可以自动生成，如何生成可参考右边的帮助文档文章目录前言一、使用借用类型作为参数二、格式化拼接字符串三、使用构造函数总结前言Rust不是传统的面向对象编程语言，它的所有特性，使其独一无二。因此，学习特定于Rust的设计模式是必要的。本系列文章为作者学习《Rust设计模式》的学习笔记以及自己的见解。因此，本系列文章的结构也与此书的结构相同（后续可能会调成结构），基本上分为三个部分
回溯 Leetcode 332 重新安排行程 mmaerd Leetcode刷题学习记录 leetcode 算法职场和发展
重新安排行程Leetcode332学习记录自代码随想录给你一份航线列表tickets，其中tickets[i]=[fromi,toi]表示飞机出发和降落的机场地点。请你对该行程进行重新规划排序。所有这些机票都属于一个从JFK（肯尼迪国际机场）出发的先生，所以该行程必须从JFK开始。如果存在多种有效的行程，请你按字典排序返回最小的行程组合。例如，行程[“JFK”,“LGA”]与[“JFK”,“LGB
Python数据分析与可视化实战指南 William数据分析 python python 数据
在数据驱动的时代，Python因其简洁的语法、强大的库生态系统以及活跃的社区，成为了数据分析与可视化的首选语言。本文将通过一个详细的案例，带领大家学习如何使用Python进行数据分析，并通过可视化来直观呈现分析结果。一、环境准备1.1安装必要库在开始数据分析和可视化之前，我们需要安装一些常用的库。主要包括pandas、numpy、matplotlib和seaborn等。这些库分别用于数据处理、数学
2019-12-22-22:30 涓涓1016
今天是冬至，写下我的日更，是因为这两天的学习真的是能量的满满，让我看到了自己，未来另外一种可能性，也让我看到了这两年这几年的过程中我所接受那些痛苦的来源。一切的根源和痛苦都来自于人生，家庭，而你的原生家庭，你的爸爸和妈妈，是因为你这个灵魂在那一刻选择他们作为你的爸爸和妈妈来的，所以你得接受他，你得接纳他，他就是因为他的存在而给你的学习和成长带来这些痛苦，那其实是你必然要经历的这个过程，当你去接纳的
将cmd中命令输出保存为txt文本文件落难Coder Windows cmd window
最近深度学习本地的训练中我们常常要在命令行中运行自己的代码，无可厚非，我们有必要保存我们的炼丹结果，但是复制命令行输出到txt是非常麻烦的，其实Windows下的命令行为我们提供了相应的操作。其基本的调用格式就是：运行指令>输出到的文件名称或者具体保存路径测试下，我打开cmd并且ping一下百度：pingwww.baidu.com>./data.txt看下相同目录下data.txt的输出：如果你再
四章-32-点要素的聚合彩云飘过
本文基于腾讯课堂老胡的课《跟我学Openlayers--基础实例详解》做的学习笔记，使用的openlayers5.3.xapi。源码见1032.html，对应的官网示例https://openlayers.org/en/latest/examples/cluster.htmlhttps://openlayers.org/en/latest/examples/earthquake-clusters.
GitHub上克隆项目 bigbig猩猩 github
从GitHub上克隆项目是一个简单且直接的过程，它允许你将远程仓库中的项目复制到你的本地计算机上，以便进行进一步的开发、测试或学习。以下是一个详细的步骤指南，帮助你从GitHub上克隆项目。一、准备工作1.安装Git在克隆GitHub项目之前，你需要在你的计算机上安装Git工具。Git是一个开源的分布式版本控制系统，用于跟踪和管理代码变更。你可以从Git的官方网站（https://git-scm.
HTML网页设计制作大作业（div+css）云南我的家乡旅游景点带文字滚动二挡起步 web前端期末大作业 web设计网页规划与设计 html css javascript dreamweaver 前端
Web前端开发技术描述网页设计题材，DIV+CSS布局制作,HTML+CSS网页设计期末课程大作业游景点介绍|旅游风景区|家乡介绍|等网站的设计与制作HTML期末大学生网页设计作业HTML：结构CSS：样式在操作方面上运用了html5和css3，采用了div+css结构、表单、超链接、浮动、绝对定位、相对定位、字体样式、引用视频等基础知识JavaScript：做与用户的交互行为文章目录前端学习路线
Day1笔记-Python简介&标识符和关键字&输入输出 ~在杰难逃~ Python python 开发语言大数据数据分析数据挖掘
大家好，从今天开始呢，杰哥开展一个新的专栏，当然，数据分析部分也会不定时更新的，这个新的专栏主要是讲解一些Python的基础语法和知识，帮助0基础的小伙伴入门和学习Python，感兴趣的小伙伴可以开始认真学习啦！一、Python简介【了解】1.计算机工作原理编程语言就是用来定义计算机程序的形式语言。我们通过编程语言来编写程序代码，再通过语言处理程序执行向计算机发送指令，让计算机完成对应的工作，编程
人工智能时代，程序员如何保持核心竞争力？ jmoych 人工智能
随着AIGC（如chatgpt、midjourney、claude等）大语言模型接二连三的涌现，AI辅助编程工具日益普及，程序员的工作方式正在发生深刻变革。有人担心AI可能取代部分编程工作，也有人认为AI是提高效率的得力助手。面对这一趋势,程序员应该如何应对?是专注于某个领域深耕细作，还是广泛学习以适应快速变化的技术环境?又或者，我们是否应该将重点转向AI无法轻易替代的软技能？让我们一起探讨程序员
node.js学习小猿L node.js node.js 学习 vim
node.js学习实操及笔记温故node.js，node.js学习实操过程及笔记~node.js学习视频node.js官网node.js中文网实操笔记githubcsdn笔记为什么学node.js可以让别人访问我们编写的网页为后续的框架学习打下基础，三大框架vuereactangular离不开node.jsnode.js是什么官网：node.js是一个开源的、跨平台的运行JavaScript的运行
阶段总结反思轻争
马上就要进入10月份了，今天做一下前段时间的总结和反思。前段时间，日更、英语、健身、护肤坚持的比较好。阅读、书法坚持的不好。1.中间被迫停更半个多月，其余时间一直在坚持日更挑战。偶尔也有不想写的时候，就做一下摘抄。因为阅读（输入）没跟上来，所以写作（输出）质量有待进一步加强。2.英语做到了一周至少学习5天，每次不少于30分钟，但是小班课没有跟上更新速度，下一步要争取利用零碎时间补听小班课。3.减肥
ARM驱动学习之基础小知识 JT灬新一 ARM 嵌入式 arm开发学习
ARM驱动学习之基础小知识•sch原理图工程师工作内容–方案–元器件选型–采购（能不能买到，价格）–原理图（涉及到稳定性）•layout画板工程师–layout（封装、布局，布线，log）（涉及到稳定性）–焊接的一部分工作（调试阶段板子的焊接）•驱动工程师–驱动，原理图，layout三部分的交集容易发生矛盾•PCB研发流程介绍–方案，原理图(网表)–layout工程师（gerber文件）–PCB板
ARM驱动学习之5 LEDS驱动 JT灬新一嵌入式 C 底层 arm开发学习单片机
ARM驱动学习之5LEDS驱动知识点：•linuxGPIO申请函数和赋值函数–gpio_request–gpio_set_value•三星平台配置GPIO函数–s3c_gpio_cfgpin•GPIO配置输出模式的宏变量–S3C_GPIO_OUTPUT注意点：DRIVER_NAME和DEVICE_NAME匹配。实现步骤：1.加入需要的头文件：//Linux平台的gpio头文件#include//三
ARM驱动学习之4小结 JT灬新一嵌入式 C++arm开发学习 linux
ARM驱动学习之4小结#include#include#include#include#include#defineDEVICE_NAME"hello_ctl123"MODULE_LICENSE("DualBSD/GPL");MODULE_AUTHOR("TOPEET");staticlonghello_ioctl(structfile*file,unsignedintcmd,unsignedlo
展现思维导图魅力，不断挖掘人生宝藏思维导图讲师Mandy
第13期最强思维导图训练营已经结束一周了，但是我依旧是感觉所有学员还在努力的学习，这些学员中有教师、学生、白领、公务员、宝妈等等，只要你努力，只要你想改变自己，任何行业，任何岗位都可以参与进来，28天足以让你见成效，在这28天中，我们的学员不仅仅是收获了一枚毕业证，最重要的是让自己的思维方式得到升级，今天的你为自己投资，明天的你就会感谢你今天的付出，我们来听一听来自13期最强思维导图训练营优秀学员
2019-3-23晨间日记红红火火小耳朵
今天是什么日子起床：7点40就寝：23点半天气：有太阳，不过一会儿出来一会儿进去特别清爽的凉意，还蛮舒服的心情：小激动要给女朋友过生日啦纪念日：田田女士过生日任务清单昨日完成的任务，最重要的三件事：1.英语一对一2.运动计划3.认真护肤习惯养成：调整状态周目标·完成进度英语七天打卡（5/7）轻课阅读（87/180）音标课（25/30）读书（福尔摩斯一章）学习·信息·阅读#英语课#Cookingte
【华为OD技术面试真题精选 - 非技术题】 -HR面，综合面_华为od hr面一个射手座的程序媛程序员华为od 面试职场和发展
最后的话最近很多小伙伴找我要Linux学习资料，于是我翻箱倒柜，整理了一些优质资源，涵盖视频、电子书、PPT等共享给大家！资料预览给大家整理的视频资料：给大家整理的电子书资料：如果本文对你有帮助，欢迎点赞、收藏、转发给朋友，让我有持续创作的动力！网上学习资料一大堆，但如果学到的知识不成体系，遇到问题时只是浅尝辄止，不再深入研究，那么很难做到真正的技术提升。需要这份系统化的资料的朋友，可以点击这里获
教育用心灵温暖心灵
@陈春丽长期学习班冯倩。今天一早就听到说高职合并，取消中专教育的教育信息。感觉是虽然知道，再听还是吓一跳。国家重视职业教育为何还要取消中专技术学校的教育？再听高中就要进行技术教育了，一部分人学习好继续努力学习考大学，一部分人在高中就可以进行职业教育接受职业教育了还要中专技术教育学校干什么呢！a有些职业教育学校转型升级快，不是孩子上完给找工作，而是学校帮孩子创业，我觉得是不错的方向！新闻新你得实时更
数字里的世界17期：2021年全球10大顶级数据中心，中国移动榜首张三叨
你知道吗？2016年，全球的数据中心共计用电4160亿千瓦时，比整个英国的发电量还多40％！前言每天，我们都会创造超过250万TB的数据。并且随着物联网（IOT）的不断普及，这一数据将持续增长。如此庞大的数据被存储在被称为“数据中心”的专用设施中。虽然最早的数据中心建于20世纪40年代，但直到1997-2000年的互联网泡沫期间才逐渐成为主流。当前人类的技术，比如人工智能和机器学习，已经将我们推向
学习“论语”-第59天春峰轩
12.14子张问政。子曰：“居之无倦，行之以忠。”子张问为政之道。孔子说：“在位尽职不懈怠，执行政令要忠诚。”12.15子曰：“博学于文，约之以礼，亦可以弗畔矣夫！”孔子说：“君子广泛地学习文献，并且用礼节约束自己，也就不会离经叛道了。”12.16子曰：“君子成人之美，不成人之恶。小人反是。”孔子说：“君子成全别人的好事，而不助长别人的坏处。小人则与此相反行事。”知识点:“成人之美，不成人之恶”贯
nosql数据库技术与应用知识点皆过客，揽星河 NoSQL nosql 数据库大数据数据分析数据结构非关系型数据库
Nosql知识回顾大数据处理流程数据采集(flume、爬虫、传感器)数据存储(本门课程NoSQL所处的阶段)Hdfs、MongoDB、HBase等数据清洗(入仓)Hive等数据处理、分析(Spark、Flink等)数据可视化数据挖掘、机器学习应用(Python、SparkMLlib等)大数据时代存储的挑战(三高)高并发(同一时间很多人访问)高扩展(要求随时根据需求扩展存储)高效率(要求读写速度快)
《Python数据分析实战终极指南》 xjt921122 python 数据分析开发语言
对于分析师来说，大家在学习Python数据分析的路上，多多少少都遇到过很多大坑**，有关于技能和思维的**：Excel已经没办法处理现有的数据量了，应该学Python吗？找了一大堆Python和Pandas的资料来学习，为什么自己动手就懵了？跟着比赛类公开数据分析案例练了很久，为什么当自己面对数据需求还是只会数据处理而没有分析思路？学了对比、细分、聚类分析，也会用PEST、波特五力这类分析法，为啥
2019-01-19 王小康KK
姓名:王康公司:扬州市方圆建筑工程有限公司2018年3月16日～3月18日上海361期《六项精进》感谢二组学员【日精进打卡第307天】【知～学习】《六项精进》大纲3遍共862遍《大学》通篇3遍共860遍《六项精进》全书40页【经典名句】思想决定行为，行为决定习惯，习惯决定性格，性格决定命运。【行～实践】一、修身：（对自己个人）1、践行六项精进的理念。二、齐家：（对家庭和家人）1、和女朋友视频聊天。
数据采集高并发的架构应用 3golden .net
问题的出发点：最近公司为了发展需要，要扩大对用户的信息采集，每个用户的采集量估计约2W。如果用户量增加的话，将会大量照成采集量成3W倍的增长，但是又要满足日常业务需要，特别是指令要及时得到响应的频率次数远大于预期。 &n
不停止 MySQL 服务增加从库的两种方式 brotherlamp linux linux视频 linux资料 linux教程 linux自学
现在生产环境MySQL数据库是一主一从，由于业务量访问不断增大，故再增加一台从库。前提是不能影响线上业务使用，也就是说不能重启MySQL服务，为了避免出现其他情况，选择在网站访问量低峰期时间段操作。一般在线增加从库有两种方式，一种是通过mysqldump备份主库，恢复到从库，mysqldump是逻辑备份，数据量大时，备份速度会很慢，锁表的时间也会很长。另一种是通过xtrabacku
Quartz——SimpleTrigger触发器 eksliang SimpleTrigger TriggerUtils quartz
转载请出自出处：http://eksliang.iteye.com/blog/2208166 一.概述 SimpleTrigger触发器，当且仅需触发一次或者以固定时间间隔周期触发执行；二.SimpleTrigger的构造函数 SimpleTrigger(String name, String group)：通过该构造函数指定Trigger所属组和名称； Simpl
Informatica应用（1） 18289753290 sql workflow lookup 组件 Informatica
1.如果要在workflow中调用shell脚本有一个command组件，在里面设置shell的路径；调度wf可以右键出现schedule，现在用的是HP的tidal调度wf的执行。 2.designer里面的router类似于SSIS中的broadcast（多播组件）;Reset_Workflow_Var：参数重置（比如说我这个参数初始是1在workflow跑得过程中变成了3我要在结束时还要
python 获取图片验证码中文字酷的飞上天空 python
根据现成的开源项目 http://code.google.com/p/pytesser/改写在window上用easy_install安装不上看了下源码发现代码很少于是就想自己改写一下添加支持网络图片的直接解析 #coding:utf-8 #import sys #reload(sys) #sys.s
AJAX 永夜-极光 Ajax
1.AJAX功能:动态更新页面,减少流量消耗,减轻服务器负担 2.代码结构: <html> <head> <script type="text/javascript"> function loadXMLDoc() { .... AJAX script goes here ...
创业OR读研随便小屋创业
现在研一，有种想创业的想法，不知道该不该去实施。因为对于的我情况这两者是矛盾的，可能就是鱼与熊掌不能兼得。研一的生活刚刚过去两个月，我们学校主要的是
需求做得好与坏直接关系着程序员生活质量 aijuans IT 生活
这个故事还得从去年换工作的事情说起，由于自己不太喜欢第一家公司的环境我选择了换一份工作。去年九月份我入职现在的这家公司，专门从事金融业内软件的开发。十一月份我们整个项目组前往北京做现场开发，从此苦逼的日子开始了。系统背景：五月份就有同事前往甲方了解需求一直到6月份，后续几个月也完
如何定义和区分高级软件开发工程师 aoyouzi
在软件开发领域，高级开发工程师通常是指那些编写代码超过 3 年的人。这些人可能会被放到领导的位置，但经常会产生非常糟糕的结果。Matt Briggs 是一名高级开发工程师兼 Scrum 管理员。他认为，单纯使用年限来划分开发人员存在问题，两个同样具有 10 年开发经验的开发人员可能大不相同。近日，他发表了一篇博文，根据开发者所能发挥的作用划分软件开发工程师的成长阶段。　　初
Servlet的请求与响应百合不是茶 servlet get提交 java处理post提交
Servlet是tomcat中的一个重要组成,也是负责客户端和服务端的中介 1,Http的请求方式(get ,post); 客户端的请求一般都会都是Servlet来接受的,在接收之前怎么来确定是那种方式提交的,以及如何反馈,Servlet中有相应的方法, http的get方式 servlet就是都doGet(
web.xml配置详解之listener bijian1013 java web.xml listener
一.定义 <listener> <listen-class>com.myapp.MyListener</listen-class> </listener> 二.作用该元素用来注册一个监听器类。可以收到事件什么时候发生以及用什么作为响
Web页面性能优化（yahoo技术） Bill_chen JavaScript Ajax Web css Yahoo
1.尽可能的减少HTTP请求数 content 2.使用CDN server 3.添加Expires头(或者 Cache-control) server 4.Gzip 组件 server 5.把CSS样式放在页面的上方。 css 6.将脚本放在底部(包括内联的) javascript 7.避免在CSS中使用Expressions css 8.将javascript和css独立成外部文
【MongoDB学习笔记八】MongoDB游标、分页查询、查询结果排序 bit1129 mongodb
游标游标，简单的说就是一个查询结果的指针。游标作为数据库的一个对象，使用它是包括声明打开循环抓去一定数目的文档直到结果集中的所有文档已经抓取完关闭游标游标的基本用法，类似于JDBC的ResultSet(hasNext判断是否抓去完,next移动游标到下一条文档)，在获取一个文档集时，可以提供一个类似JDBC的FetchSize
ORA-12514 TNS 监听程序当前无法识别连接描述符中请求服务的解决方法白糖_ ORA-12514
今天通过Oracle SQL*Plus连接远端服务器的时候提示“监听程序当前无法识别连接描述符中请求服务”，遂在网上找到了解决方案： ①打开Oracle服务器安装目录\NETWORK\ADMIN\listener.ora文件，你会看到如下信息： # listener.ora Network Configuration File: D:\database\Oracle\net
Eclipse 问题 A resource exists with a different case bozch eclipse
在使用Eclipse进行开发的时候，出现了如下的问题： Description Resource Path Location TypeThe project was not built due to "A resource exists with a different case: '/SeenTaoImp_zhV2/bin/seentao'.&
编程之美-小飞的电梯调度算法 bylijinnan 编程之美
public class AptElevator { /** * 编程之美小飞电梯调度算法 * 在繁忙的时间，每次电梯从一层往上走时，我们只允许电梯停在其中的某一层。 * 所有乘客都从一楼上电梯，到达某层楼后，电梯听下来，所有乘客再从这里爬楼梯到自己的目的层。 * 在一楼时，每个乘客选择自己的目的层，电梯则自动计算出应停的楼层。 * 问：电梯停在哪
SQL注入相关概念 chenbowen00 sql Web 安全
SQL Injection：就是通过把SQL命令插入到Web表单递交或输入域名或页面请求的查询字符串，最终达到欺骗服务器执行恶意的SQL命令。具体来说，它是利用现有应用程序，将（恶意）的SQL命令注入到后台数据库引擎执行的能力，它可以通过在Web表单中输入（恶意）SQL语句得到一个存在安全漏洞的网站上的数据库，而不是按照设计者意图去执行SQL语句。首先让我们了解什么时候可能发生SQ
[光与电]光子信号战防御原理 comsci 原理
无论是在战场上,还是在后方,敌人都有可能用光子信号对人体进行控制和攻击,那么采取什么样的防御方法,最简单,最有效呢? 我们这里有几个山寨的办法,可能有些作用,大家如果有兴趣可以去实验一下根据光
oracle 11g新特性:Pending Statistics daizj oracle dbms_stats
oracle 11g新特性:Pending Statistics 转从11g开始，表与索引的统计信息收集完毕后，可以选择收集的统信息立即发布，也可以选择使新收集的统计信息处于pending状态，待确定处于pending状态的统计信息是安全的，再使处于pending状态的统计信息发布，这样就会避免一些因为收集统计信息立即发布而导致SQL执行计划走错的灾难。在 11g 之前的版本中，D
快速理解RequireJs dengkane jquery requirejs
RequireJs已经流行很久了，我们在项目中也打算使用它。它提供了以下功能：声明不同js文件之间的依赖可以按需、并行、延时载入js库可以让我们的代码以模块化的方式组织初看起来并不复杂。在html中引入requirejs 在HTML中，添加这样的 <script> 标签： <script src="/path/to
C语言学习四流程控制if条件选择、for循环和强制类型转换 dcj3sjt126com c
# include <stdio.h> int main(void) { int i, j; scanf("%d %d", &i, &j); if (i > j) printf("i大于j\n"); else printf("i小于j\n"); retu
dictionary的使用要注意 dcj3sjt126com IO
NSDictionary *dict = [NSDictionary dictionaryWithObjectsAndKeys: user.user_id , @"id", user.username , @"username",
Android 中的资源访问(Resource) finally_m xml android String drawable color
简单的说，Android中的资源是指非代码部分。例如，在我们的Android程序中要使用一些图片来设置界面，要使用一些音频文件来设置铃声，要使用一些动画来显示特效，要使用一些字符串来显示提示信息。那么，这些图片、音频、动画和字符串等叫做Android中的资源文件。在Eclipse创建的工程中，我们可以看到res和assets两个文件夹，是用来保存资源文件的，在assets中保存的一般是原生
Spring使用Cache、整合Ehcache 234390216 spring cache ehcache @Cacheable
Spring使用Cache 从3.1开始，Spring引入了对Cache的支持。其使用方法和原理都类似于Spring对事务管理的支持。Spring Cache是作用在方法上的，其核心思想是这样的：当我们在调用一个缓存方法时会把该方法参数和返回结果作为一个键值对存放在缓存中，等到下次利用同样的
当druid遇上oracle blob(clob) jackyrong oracle
http://blog.csdn.net/renfufei/article/details/44887371 众所周知，Oracle有很多坑, 所以才有了去IOE。在使用Druid做数据库连接池后，其实偶尔也会碰到小坑，这就是使用开源项目所必须去填平的。【如果使用不开源的产品，那就不是坑，而是陷阱了，你都不知道怎么去填坑】用Druid连接池，通过JDBC往Oracle数据库的
easyui datagrid pagination获得分页页码、总页数等信息 ldzyz007
var grid = $('#datagrid'); var options = grid.datagrid('getPager').data("pagination").options; var curr = options.pageNumber; var total = options.total; var max =
浅析awk里的数组 nigelzeng 二维数组 array 数组 awk
awk绝对是文本处理中的神器，它本身也是一门编程语言，还有许多功能本人没有使用到。这篇文章就单单针对awk里的数组来进行讨论，如何利用数组来帮助完成文本分析。有这么一组数据： abcd,91#31#2012-12-31 11:24:00 case_a,136#19#2012-12-31 11:24:00 case_a,136#23#2012-12-31 1
搭建 CentOS 6 服务器(6) - TigerVNC rensanning centos
安装GNOME桌面环境 # yum groupinstall "X Window System" "Desktop" 安装TigerVNC # yum -y install tigervnc-server tigervnc 启动VNC服务 # /etc/init.d/vncserver restart # vncser
Spring 数据库连接整理 tomcat_oracle spring bean jdbc
1、数据库连接jdbc.properties配置详解　　jdbc.url=jdbc:hsqldb:hsql://localhost/xdb 　　jdbc.username=sa 　　jdbc.password= 　　jdbc.driver=不同的数据库厂商驱动，此处不一一列举　　接下来，详细配置代码如下：　　 Spring连接池
Dom4J解析使用xpath java.lang.NoClassDefFoundError: org/jaxen/JaxenException异常 xp9802
用Dom4J解析xml,以前没注意,今天使用dom4j包解析xml时在xpath使用处报错异常栈：java.lang.NoClassDefFoundError: org/jaxen/JaxenException异常导入包 jaxen-1.1-beta-6.jar 解决; &nb

python统计分析 学习笔记

统计数据的展示

数据类型

分类数据

在python中作图

函数式和面向对象式的绘图方法

交互式绘图

展示统计学数据集

单变量数据

二元变量和多元变量绘图

分布和假设检验

总体和样本

概率分布

离散分布

连续分布

期望值和方差

自由度Degrees of Freedom（DOF）

研究设计

术语

概述

单变量的分布

分布的特征描述

分布中心

量化变异度

分布形状的参数描述

离散分布

伯努利分布

二项分布

泊松分布

正态分布

分布和假设检验

来自正态分布的连续型分布

ｔ分布

卡方分布

F分布

其他连续型分布

对数正态分布

韦伯分布

指数分布

均匀分布

假设检验

数据筛选和离群值

正态性检验

假设概念、错误、P值和样本量

错误的类型

受试者操作特征（ROC）曲线

数值型数据的均值检验

样本均值的分布

单样本均值的t检验

两组之间的比较

配对t检验

独立组别之间的t检验（非配对t检验）

统计学假设检验和统计学建模

多组比较

方差分析

选择正确的检验方法进行组间比较

典型的检验

假设的例子

分类数据的检验

置信区间

统计建模

线性回归模型

线性相关

相关系数

秩相关

一般线性回归模型

决定系数R^2

多元数据分析

可视化多元相关

散点图矩阵

相关性矩阵

多元线性回归

离散数据检验

贝叶斯统计学

贝叶斯学派和频率学派的解释

你可能感兴趣的:(学习)

python统计分析学习笔记