李英俊小朋友

《Python数据科学手册》学习笔记及书评

《Python数据科学手册》学习笔记

文章目录

《Python数据科学手册》学习笔记
- 写在前面
- 1. 食谱数据库数据找不到的问题
- 2.Seaborn马拉松可视化里时分秒转化为秒数的问题
- 3. scikit-learn使用fetch_mldata无法下载MNIST数据集的问题
- 4. GridSearchCV.grid_scores_和mean_validation_score报错
- 5. Jupyter导出PDF从入门到绝望
- 6. 机器学习部分笔记
- - 6.1 判定系数
  - 6.2 朴素贝叶斯
  - 6.3 自举重采样方法
  - 6.4 白化
  - 6.5 机器学习章节总结
- 7. 高斯过程学习笔记 / Gaussion Process

写在前面

封面
读后感
- 只能说挺不错的，前面数据分析部分挺好，后面机器学习部分差点东西

1. 食谱数据库数据找不到的问题

问题：
- 在P163页，3.11.3 案例：食谱数据库中，涉及到的食谱数据无法下载，在网上也找不到资源。是不是很揪心！！！是不是很绝望！！！
- 我也是。。。然后我在网上搜了大概半个小时把，放弃了，然后慢慢看书上给的连接：食谱数据库
- 我想，肯定有很多跟我看同一本书的歪果仁，在评论区吐槽没有数据。
- 果然让我找到了解决办法。。。时隔多年，作者之一总算过来提供最新数据连接了。。。参考链接
结论：
- 数据连接：https://s3.amazonaws.com/openrecipes/20170107-061401-recipeitems.json.gz
- 下载方法：右键另存为就完事儿了。。。（链接都有了，再不会我就没辙了。。。）下完了然后右键解压缩。。。如图。。。

2.Seaborn马拉松可视化里时分秒转化为秒数的问题

抄作业

在做Python Data Science Handbook的实例学习，4.16.3 案例：探索马拉松比赛成绩里，有提示将时分秒的时间化为秒的总数，以方便画图。书里给出的指令是：

data[‘split_sec’]=data[‘split’].astype(int)/1E9

data[‘final_sec’]=data[‘final’].astype(int)/1E9

我用这种方式会出现以下错误：

TypeError: cannot astype a timedelta from [timedelta64[ns]] to [int32]
结论
- 描述的连接里面给出了一种解决办法，可是这种解决办法太复杂了，我想了一个更简单的
- 先写一个将Timedelta格式的时间数据转化为总秒数的函数：
```
data['split_sec'] = data['split'].apply(transfor_time)
data['final_sec'] = data['final'].apply(transfor_time)
```
- 然后对我们需要的列广播这个函数：
```
data['split_sec'] = data['split'].apply(transfor_time)
data['final_sec'] = data['final'].apply(transfor_time)
```
- 查看结果：
```
data.head()
```
- OK！完美解决。。。

3. scikit-learn使用fetch_mldata无法下载MNIST数据集的问题

问题：
- 显示下载超时，链接不上，不能下载等
结论：
- 直接下载MNIST数据集
- 把数据集保存到mldata文件夹中：
参考链接：Error Downloading MNIST #143

4. GridSearchCV.grid_scores_和mean_validation_score报错

问题：
- 在P438页，5.13.4 示例：不是很朴素的贝叶斯中的2. 使用自定义评估器小节中有这样一行代码：scores = [val.mean_validation_score for val in grid.grid_scores_]
- 运行之后报错：AttributeError: 'GridSearchCV' object has no attribute 'grid_scores_'
- 经过百度了之后，可以知道grid_scores_在最新的sklearn中已经被弃用了，换成了cv_results_，参考链接
- 那么，更改这个参数后，依然报错：AttributeError: 'str' object has no attribute 'mean_validation_score'
- 这个问题就再也没有搜到好的解决方案了，所以我去查了GridSearchCV的文档
- 然后发现，关于cv_results_的内容如下：
- 这就很尴尬了，所以没有一个参数是包含validation关键字的，我的理解是，验证集和测试集在某种情况下可以认为是等价的。所以我猜测mean_validation_score对应的应该就是mean_test_score
- 这样，原来的代码就改成了scores = grid.cv_results_['mean_test_score']
- 为了证明我的猜想是正确的，所以，按照得到的scores结果，顺着其他的代码，知道最后绘图：
- 事实证明，跟书上得到图一毛一样，所以证明我对源代码修改的猜想是正确的
- 即证明了：
  - 旧版本代码：scores = [val.mean_validation_score for val in grid.grid_scores_]
  - 与新版本代码：scores = grid.cv_results_['mean_test_score']
  - 等价！

5. Jupyter导出PDF从入门到绝望

问题：
- 我在使用jupyter lab的时候，想要把我的代码和结果导出成pdf格式的（由于里面有图片，所以不想导出成html）。然后报错：
- 然后我用pip安装了pandoc，发现并没有什么luan用。并且好像跟报错所指的pandoc不一样。反正就是绝望就完事儿了
方案：
1. 下载安装windows开发环境包的管理器，Chocolatey。参考官网了连接，用cmd粘代码就能装：官网
  
  @"%SystemRoot%\System32\WindowsPowerShell\v1.0\powershell.exe" -NoProfile -InputFormat None -ExecutionPolicy Bypass -Command "iex ((New-Object System.Net.WebClient).DownloadString('https://chocolatey.org/install.ps1'))" && SET "PATH=%PATH%;%ALLUSERSPROFILE%\chocolatey\bin"
2. 然后呢，就可以用这个管理工具安装pandoc了，参考pandoc官网
  
  choco install pandoc
3. 安装完事儿！
4. 然后导出pdf的时候发现，竟然对pandoc的版本有要求，也是佛了，那就重新搞一下把。。。
  
  安装固定版本的pandoc，根据官网发布的版本list，我选择安装1.19版本的。choco install pandoc --version 1.19
  
  安装时安装完毕了，不知道为啥，一副好像报错了的样子，下的我赶紧去看一下到底是安装好了没。。。
  
  应该是完事儿了，然后试试导出pdf。
5. pandoc好像是没有问题了，可是另一个包好像又除了问题：
  
  所以现在又要安装这个：
  
  choco install miktex
6. 完。。。做完这一步，电脑自动重启了，然后jupyter lab打不开了，报错：
  
  ImportError: cannot import name 'constants' from 'zmq.backend.cython’
  
  然后没办法，用pip升级了一下pyzmq包，总算是能打开了。。。
  
  然后，告诉我，我下载的插件不能用了，要重新“build”，所以就重新安装了插件。。。（像显示目录啊之类的插件。。。）
  
  我真的很绝望。。。
7. 然后依然报同样的错误。。。于是我怀疑，是不是MikTex有错，于是在官网上下了一个exe安装的那种，一路确认下去。。。参考链接、下载链接
  
  果然，在点了导出pdf的时候，报错缺少的文件就弹出来安装程序了。。。
8. 然后就成功保存pdf啦！
另辟蹊径

说实话，这样导出来的pdf并不好看，还有一种方法，直接导出html，里面保留了插入的图片的那种，更能还原jupyter原来的排版。参考链接

6. 机器学习部分笔记

6.1 判定系数

定义

判定系数（coefficient of determination），也叫可决系数或决定系数，是指在线性回归中，回归平方和与总离差平方和之比值，其数值等于相关系数的平方。它是对估计的回归方程拟合优度的度量。（参考：百度百科）

判定系数（记为R $^2$ ）在统计学中用于度量因变量的变异中可由自变量解释部分所占的比例，以此来判断统计模型的解释力。对于简单线性回归而言，判定系数为样本相关系数的平方。

假设一数据集包括 $y_1, y_2, ..., y_n$ 共n个观察值，相对应的模型预测值分别为 $f_1, f_2, ..., f_n$ 。定义残差 $e_i = y_i - f_i$ ，

平均观察值为： $\bar{y} = \cfrac{1}{n} \sum\limits_{i=1}^n y_i$

于是可以得到总平方和： $SS_{tot} = \sum\limits_{i=1} (y_i - \bar{y})^2$

回归平方和： $SS_{reg} = \sum\limits_{i=1} (f_i - \bar{y})^2$

残差平方和： $SS_{res} = \sum\limits_{i=1} (y_i - f_i)^2 = \sum\limits_{i=1} e_i^2$

由此，判定系数可定义为： $R^2 = 1 - \cfrac{SS_{res}}{SS_{tot}}$
总结

R $^2$ = 1：表示模型与数据完全吻合。

R $^2$ = 0：表示模型不比简单取均值好。

R $^2$ < 0：表示模型性能很差。
系数标准

判定系数只是说明列入模型的所有解释变量对因变量的联合的影响程度，不说明模型中单个解释变量的影响程度。
判定系数达到多少为宜？没有一个统一的明确界限值；若建模的目的是预测因变量值，一般需考虑有较高的判定系数。若建模的目的是结构分析，就不能只追求高的判定系数，而是要得到总体回归系数的可信任的估计量。判定系数高并不一定说明每个回归系数都可信任。

6.2 朴素贝叶斯

贝叶斯定理

我们在生活中经常遇到这种情况：我们可以很容易直接得出P(A|B)，P(B|A)则很难直接得出，但我们更关心P(B|A)，贝叶斯定理就为我们打通从P(A|B)求得P(B|A)的道路。

$\cfrac{P(A|B)P(B)}{P(A)}$

推导： $P (A, B) = P (B ∣ A) * P (A) = P (A ∣ B) * P (B)$

参考：机器学习之贝叶斯（贝叶斯定理、贝叶斯网络、朴素贝叶斯）

朴素贝叶斯分类是一种十分简单的分类算法，叫它朴素贝叶斯分类是因为这种方法的思想真的很朴素。

朴素贝叶斯的思想基础是这样的：**对于给出的待分类项，求解在此项出现的条件下各个类别出现的概率，哪个最大，就认为此待分类项属于哪个类别。**通俗来说，就好比这么个道理，你在街上看到一个黑人，我问你你猜这哥们哪里来的，你十有八九猜非洲。为什么呢？因为黑人中非洲人的比率最高，当然人家也可能是美洲人或亚洲人，但在没有其它可用信息下，我们会选择条件概率最大的类别，这就是朴素贝叶斯的思想基础。
- 假设每个标签的数据都服从简单的高斯分布，最容易理解的朴素贝叶斯分类器：高斯朴素贝叶斯，参考：透彻理解高斯分布。
- 假设特征是由一个简单的多项式分布生成，适合用于描述出现次数或者出现次数比列的特征：多项式朴素贝叶斯，参考：朴素贝叶斯的三个常用模型：高斯、多项式、伯努利
朴素贝叶斯的应用场景

由于朴素贝叶斯分类器对数据有严格的假设，因此它的训练效果通常比复杂模型的差。其优点主要体现在以下四个方面。
- 训练和预测的速度非常快
- 直接使用概率预测
- 通常很容易理解
- 可调参数（如果有的话）非常少。
朴素贝叶斯分类器非常适合用于以下应用场景：
- 假设分布函数与数据匹配（实际中很少见）。
- 各种类型的区分度很高，模型复杂度不重要。
- 非常高维度的数据，模型复杂度不重要。

6.3 自举重采样方法

模式识别中每个方法的实现都是基于一个特定的数据样本集的，但是这个样本集只是所有可能的样本中的一次随机抽样，毕竟在我们的生活实际中存在着万物众生，多到我们数也数不清，甚至计算机都无法统计的清，而我们搜集到的充其量只是其中很小很小的一部分，这也是为什么机器学习中缺少的只是数据，只要有足够多的学习数据，就一定能取得惊人的结果，因此模式识别和机器学习中的很多方法的实现结果都无疑会受到这种随机性的影响，我们训练得到的分类器也因此具有偶然性，尤其是样本不足够多时更为明显。
对于决策树而言，其树的生长是采用的贪心算法，只考虑当前局部的最优，因此其受这种随机性影响会更加严重，这也是为什么有的决策树泛化能力那么差的原因。
针对这种随机性的影响，最早在统计学中有人提出了一种叫做”自举（Bootstrap）“的策略，基本思想是对现有样本进行重复采样而产生多个样本子集，通过这种多次重复采样来模拟数据的随机性，然后在最后的输出结果中加进去这种随机性的影响。随后有人把这种自举的思想运用到了模式识别中，衍生出了一系列的解决方法，像随机森林、Bagging、Adaboost等。

6.4 白化

白化的目的是去除输入数据的冗余信息。假设训练数据是图像，由于图像中相邻像素之间具有很强的相关性，所以用于训练时输入是冗余的；白化的目的就是降低输入的冗余性。
输入数据集X，经过白化处理后，新的数据X’满足两个性质：

(1) 特征之间相关性较低；
(2) 所有特征具有相同的方差。
其实我们之前学的PCA算法中，可能PCA给我们的印象是一般用于降维操作。然而其实PCA如果不降维，而是仅仅使用PCA求出特征向量，然后把数据X映射到新的特征空间，这样的一个映射过程，其实就是满足了我们白化的第一个性质：除去特征之间的相关性。因此白化算法的实现过程，第一步操作就是PCA，求出新特征空间中X的新坐标，然后再对新的坐标进行方差归一化操作。
参考链接：机器学习（七）白化whitening，PCA 和白化区别

6.5 机器学习章节总结

有监督学习
- 高斯朴素贝叶斯（Gaussian naive Bayes）：速度快，不需要选择超参数，所以通常很适合作为初步分类手段，在借助更复杂的模型进行优化之前使用。这个方法假设每个特征中属于一类的观测值都符合高斯分布，且变量无协方差（即线性无关）。椭圆曲线表示每个标签的高斯生成模型，越靠近椭圆中心的可能性越大。通过这种类似的生成模型，可以计算出任意数据点的似然估计（likelihood）P（特征| $L_1$ ），然后根据贝叶斯定理计算出后验概率比值，从而确定每个数据点可能性最大的标签。贝叶斯主义（Bayesian formalism）的一个优质特性是它天生支持概率分类，我们可以用predict_proba方法计算样本属于某个标签的概率。缺点：由于分类结果只能依赖于一开始的模型假设，因此高斯朴素贝叶斯经常得不到非常好的结果。
- 多项式朴素贝叶斯（multinomial naive Bayes）：它假设特征是由一个简单多项式分布生成的。优点：多项分布可以描述各种类型样本出现次数的概率，因此多项式朴素贝叶斯非常适用于描述出现次数或者出现次数比例的特征。
- 简单线性回归（Linear Regression）：将数据拟合成一条直线。除了简单的线性拟合，它还可以处理多维度的线性回归模型。
- 基函数回归（basis function regression）：通过基函数对原始数据进行变换，从而将变量间的线性回归模型转换为非线性回归模型。有多项式基函数、高斯基函数等。
- 正则化（regularization）：虽然在线性回归模型中引入基函数会让模型变得更加灵活，但是也很容易造成过拟合。当基函数重叠的时候，通常就表明出现了过拟合：相邻基函数的系数想相互抵消。对较大的模型参数进行惩罚（penalize），从而抑制模型的剧烈波动，这个惩罚机制被称为正则化。有岭回归（ridge regression， $L_2$ 范数正则化）： $\alpha \sum_{n=1}^N \theta_n^2$ 、Lasso正则化（ $L_1$ 范数）： $\alpha \sum_{n=1}^N |\theta|$ 。Lasso正则化倾向于构建稀疏矩阵，即它更喜欢将模型系数设置为0。
- 支持向量机（support vector machine, SVM）：不同于贝叶斯分类器，首先对每个类进行了随机分布的假设，然后用生成的模型估计新数据点的标签。——生成分类方法；支持向量机是判别分类方法：不再为每类数据建模、而是用一条分割线（二维空间中的直线或曲线）或者流体形（多维空间中的曲线、曲面等概念的推广）将各种类型分割开。边界最大化评估器。核变换和核函数技巧处理非线性问题。SVM实现了一些修正因子来软化边界。
- 决策树：采用非常直观的方式对事物进行分类或打标签，二叉树分支方法。缺点：决策树非常容易陷得很深（过拟合）。
- 随机森林：通过组合多个过拟合评估器来降低过拟合程度的想法，其实是一种集成学习方法，称为装袋算法。优点：无参数的随机森林模型非常适合处理多周期数据，不需要我们配置多周期模型！训练和预测速度都非常快。多任务可以直接并行计算。多棵树可以进行概率分类。无参数模型很灵活，在其他评估器都欠拟合的任务中表现突出。缺点：结果不太容易解释。
无监督学习
- 主成分分析技术（principal component analysis, PCA）：这是一种快速线性降维技术。沿着最不重要的主轴的信息都被去除了，仅留下含有最高方差值的数据成分。降维原理：发现一组比原始的像素基向量更能有效表示输入数据的基函数。用PCA作噪音过滤：建模->逆变换重构。缺点：经常受数据集的异常点影响。RandomizedPCA：使用了一个非确定算法，快速地近似计算出一个维度非常高的数据的前几个主成分。SparsePCA：引入了一个正则项来保证成分的稀疏性。
- 流形学习：它试图将一个低维度流形嵌入到一个高维度空间来描述数据集。多维度标度法（multidimensional scaling，MDS）：它可以将一个数据集的距离矩阵还原成一个D维坐标来表示数据集。缺点：无法展示数据非线性嵌入的特征。当MDS失败时，局部线性嵌入法（locally linear embedding，LLE）：该方法不保留所有的距离，而是只保留邻节点间的距离。通常情况下，modified LLE的效果比用其他算法还原实现定义好的流形数据的效果好。保距映射法（isometric mapping，Isomap）：虽然LLE通常对现实世界的高维数据源的学习效果比较差，但是Isomap算法往往会获得比较好的嵌入效果。t-分布邻域嵌入算法（t-distributed stochastic neighbor embedding, t-SNE）：将它用于高度聚类的数据效果比较好，但是该方法比其他方法学习速度慢。
- k-means聚类：在不带标签的多维数据集中寻找确定数量的簇，最优的聚类结果需要符合以下两个假设：a. “簇中心点”是属于该簇的所有数据点坐标的算术平均值。b. 一个簇的每个点到该簇中心点的距离比其他簇中心点的距离短。k-means方法使用了一种容易理解、便于重复的期望最大化算法（E-M算法）取代了穷举搜索。使用E-M算法时的注意事项：a. 可能不会达到全局最优结果；b. 簇数量必须事先定好；c. k-means算法只能确定线性聚类边界。但是我们可以通过一个核变换将数据投影到更高维的空间，投影后的数据使线性分离称为可能。（这种核k-means算法可以在sklearn.cluster.SpectralClustering评估器中实现，它使用最邻近来计算数据的高维表示，然后用k-means算法分配标签）； d. 当数据量较大时，k-means会很慢。这时就需要将“每次迭代都必须使用所有数据点”这个条件放宽，例如每一步仅使用数据集的一个子集来更新簇中心点。这恰恰就是批处理（batch-based）k-means算法的核心思想，该算法在sklearn.cluster.MiniBatchKMeans中实现。还可以使用k-means用于色彩压缩。缺点：在实际应用中，k-means的非概率性和它仅根据到簇中心点的距离来指派簇的特点将导致性能低下。由于k-means本身没有度量簇的分配概率或不确定性的方法，k-means可以理解为在每个簇的中心放置了一个圆，在这个圆圈之外的任何点都不是该簇的成员。所有k-means的这两个缺点——类的形状缺少灵活性、缺少簇分配的概率——使得它对许多数据集（特别是低维数据集）的拟合效果不尽人意。
- 高斯混合模型（Gaussian mixture model, GMM）：该模型可以被看作是k-means思想的一个扩展，一个聚类和密度评估器的混合体。GMM模型试图将数据构造成若干服从高斯分布的概率密度函数簇，即用不同高斯分布的加权汇总来表示概率分布估计。高斯混合模型本质上与k-means模型非常类似，它们都是用了期望最大化（E-M）方法。但高斯混合模型的每个簇的结果并不与硬边缘的空间有关，而是通过高斯平滑模型实现。GMM算法的本质是一个密度估计算法，即GMM拟合的结果并不是一个聚类模型，而是描述数据分布的生成概率模型。GMM可以利用改模型来评估数据的似然估计，并利用交叉验证来防止过拟合，还有一些纠正过拟合的标准分析方法，例如赤池信息准则（Akaike information criterion，AIC）、**贝叶斯信息准则（Bayesian information criterion，BIC）**调整模型的似然估计。类的最优数量出现在AIC或BIC曲线最小值的位置。生成模型是贝叶斯生成分类器的一个非常有用的成分。
- 核密度估计（kernel density estimation，KDE）：该算法将高斯混合理念扩展到了逻辑极限（logical extreme）。它通过对每个点生成高斯分布的混合成分，获得本质上是无参数的密度估计器。核密度估计的自有参数是：a. 核类型（kernel），它可以指定每个点核密度分布的形状；b. 核带宽（kernel bandwidth），它控制每个点的核的大小。
验证模型（根据书上的例子，分为分类和回归，当然部分函数是可以混用的）
1. 留出集和特征工程
  - sklearn.model_selection.train_test_split：留出集。X1, X2, y1, y2 = train_test_split(X, y, random_state, train_size)
  - sklearn.feature_extraction.DictVectorizer：独热编码。解决常见的非数值类型的分类特征。vec = DictVectorizer(sparse, dtype)
  - sklearn.feature_extraction.text.CountVectorizer：单词统计。将文字编码成数字的技术手段。vec = CountVectorizer()
  - sklearn.feature_extraction.text.TfidVectorizer：TF-IDF（term frequency-inverse document frequency，词频逆文档频率）。通过单词在文档中出现的频率来衡量其权重，IDF的大小与一个词的常见程度成反比。vec = TfidVectorizer()
  - sklearn.preprocessing.PolynomialFeatures：多项式特征，输入特征经过数学变换衍生出来的新特征，这种特征叫做衍生特征，这种处理方式被称为基函数回归（basis function regression）。poly = PolynomialFeatures(degree, include_bias)
  - sklearn.preprocessing.Imputer：缺失值补充。用均值、中位数、众数等填充方法补充缺失值。imp = Imputer(strategy)
  - sklearn.pipeline.make_pipeline：特征管道。将多个步骤串起来。model = make_pipeline(*steps)
  - skimage.feature.hog：HOG特征（方向梯度直方图，Histogram of Oriented Gradients）。它可以将图像像素转换为向量形式，与图像具体内容有关，与图像合成因素无关。它是一个简单的特征提取程序，专门用来识别行人（pedestrians）的图像内容。
2. 分类（Classification）
  - sklearn.metrics.accuracy_score：验证模型越策结果的准确率（预测的所有结果中，正确结果占总预测样本数的比例）。accuracy_score(y_true, y_pred)
  - sklearn.metrics.confusion_matrix：混淆矩阵，分类结果和原始标签的一个表。confusion_matrix(y_true, y_pred)
  - sklearn.model_selection.cross_val_score：交叉验证。cross_val_score(model, X, y, cv)
  - sklearn.model_selection.LeaveOneOut：留一（LOO）交叉验证。cross_val_score(model, X, y, cv=LeaveOneOut())
3. 回归（Regression）
  - sklearn.model_selection.validation_curve：验证曲线。计算验证范围内的训练得分和验证得分。train_score, val_score = validation_curve(model, X, y, param_name, param_range, cv)
  - sklearn.model_selection.learning_curve：学习曲线。反映训练集规模的训练得分 / 验证得分曲线。learning_curve(model, X, y, cv, training_sizes)
  - sklearn.model_selection.GridSearchCV：网格搜索。寻找模型的最优参数。GridSearchCV(model, param_grid, cv)

7. 高斯过程学习笔记 / Gaussion Process

参考链接：透彻理解高斯过程Gaussian Process (GP)
1. 高斯过程模型属于无参数模型，相对解决的问题复杂度及与其它算法比较减少了算法计算量。
2. 高斯模型可以解决高维空间（实际上是无限维）的数学问题，可以面对负杂的数学问题。
3. 结合贝叶斯概率算法，可以实现通过先验概率，推导未知后验输入变量的后验概率。由果推因的概率。
4. 高斯过程观测变量空间是连续域，时间或空间。
5. 高斯过程观测变量空间是实数域的时候，我们就可以进行回归而实现预测。
6. 高斯过程观测变量空间是整数域的时候（观测点是离散的），我们就可以进行分类。结合贝叶斯算法甚至可以实现单类分类学习（训练），面对小样本就可以实现半监督学习而后完成分类。面对异常检测领域很有用，降低打标签成本（小样本且单类即可训练模型）。
  所以说，我们快点进入高斯过程-贝叶斯概率算法模型吧，功能非凡。

☁️ 我的CSDN：https://blog.csdn.net/qq_21579045
❄️ 我的博客园：https://www.cnblogs.com/lyjun/
☀️ 我的Github：https://github.com/TinyHandsome
我的bilibili：https://space.bilibili.com/8182822
粉丝交流群：1060163543，神秘暗号：为干饭而来

碌碌谋生，谋其所爱。 @李英俊小朋友

你可能感兴趣的:(读书笔记和读后感,python,pandas,数据科学,读书笔记,jupyter)

情绪觉察日记第37天露露_e800
今天是家庭关系规划师的第二阶最后一天，慧萍老师帮我做了个案，帮我处理了埋在心底好多年的一份恐惧，并给了我深深的力量！这几天出来学习，爸妈过来婆家帮我带小孩，妈妈出于爱帮我收拾东西，并跟我先生和婆婆产生矛盾，妈妈觉得他们没有照顾好我…。今晚回家见到妈妈，我很欣赏她并赞扬她，妈妈说今晚要跟我睡我说好，当我们俩躺在床上准备睡觉的时候，我握着妈妈的手对她说:妈妈这几天辛苦你了，你看你多利害把我们的家收拾得
芦花鞋一四许叶晗
又是在一个寒冷的夏日里，青铜和葵花决定今天一起去卖芦花鞋，奶奶亲手给他们做了一碗热乎乎的粥对他们说:“就靠你们两挣生活费了这碗粥赶紧趁热喝了吧！”于是青铜和葵花喝完了奶奶给她们做的粥，就准备去镇上卖卢花鞋，这回青铜和葵花穿着新的芦花鞋来到了镇上。青铜这回看到了很多人都在卖，用手势表达对葵花说:“这回有好多人在抢我们生意呢！我们必须得吆喝起来。”葵花点了点头。可是谁知他们也大声的叫，卖芦花喽！卖芦花
关于沟通这件事，项目经理不需要每次都面对面进行流程大师兄
很多项目经理都会遇到这样的问题，项目中由于事情太多，根本没有足够的时间去召开会议，那在这种情况下如何去有效地管理项目中的利益相关者？当然，不建议电子邮件也不需要开会的话，建议可以采取下面几种方式来形成有效的沟通，这几种方式可以帮助你努力的通过各种办法来保持和各方面的联系。项目经理首先要问自己几个问题，项目中哪些利益相关者是必须要进行沟通的？可以列出项目中所有的利益相关者清单，同时也整理出项目中哪些
机器学习与深度学习间关系与区别 ℒℴѵℯ心·动ꦿ໊ོ꫞ 人工智能学习深度学习 python
一、机器学习概述定义机器学习（MachineLearning,ML）是一种通过数据驱动的方法，利用统计学和计算算法来训练模型，使计算机能够从数据中学习并自动进行预测或决策。机器学习通过分析大量数据样本，识别其中的模式和规律，从而对新的数据进行判断。其核心在于通过训练过程，让模型不断优化和提升其预测准确性。主要类型1.监督学习（SupervisedLearning）监督学习是指在训练数据集中包含输入
【iOS】MVC设计模式 Magnetic_h ios mvc 设计模式 objective-c 学习 ui
MVC前言如何设计一个程序的结构，这是一门专门的学问，叫做"架构模式"（architecturalpattern），属于编程的方法论。MVC模式就是架构模式的一种。它是Apple官方推荐的App开发架构，也是一般开发者最先遇到、最经典的架构。MVC各层controller层Controller/ViewController/VC（控制器）负责协调Model和View，处理大部分逻辑它将数据从Mod
一百九十四章. 自相矛盾巨木擎天
唉！就这么一夜，林子感觉就像过了很多天似的，先是回了阳间家里，遇到了那么多不可思议的事情儿。特别是小伙伴们，第二次与自己见面时，僵硬的表情和恐怖的气氛，让自己如坐针毡，打从心眼里难受！还有东子，他现在还好吗？有没有被人欺负？护城河里的小鱼小虾们，还都在吗？水不会真的干枯了吧？那对相亲相爱漂亮的太平鸟儿，还好吧！春天了，到了做窝、下蛋、喂养小鸟宝宝的时候了，希望它们都能够平安啊！虽然没有看见家人，也
UI学习——cell的复用和自定义cell Magnetic_h ui 学习
目录cell的复用手动（非注册）自动（注册）自定义cellcell的复用在iOS开发中，单元格复用是一种提高表格（UITableView）和集合视图（UICollectionView）滚动性能的技术。当一个UITableViewCell或UICollectionViewCell首次需要显示时，如果没有可复用的单元格，则视图会创建一个新的单元格。一旦这个单元格滚动出屏幕，它就不会被销毁。相反，它被添
element实现动态路由+面包屑软件技术NINI vue案例 vue.js 前端
el-breadcrumb是ElementUI组件库中的一个面包屑导航组件，它用于显示当前页面的路径，帮助用户快速理解和导航到应用的各个部分。在Vue.js项目中，如果你已经安装了ElementUI，就可以很方便地使用el-breadcrumb组件。以下是一个基本的使用示例：安装ElementUI（如果你还没有安装的话）:你可以通过npm或yarn来安装ElementUI。bash复制代码npmi
10月|愿你的青春不负梦想-读书笔记-01 Tracy的小书斋
本书的作者是俞敏洪，大家都很熟悉他了吧。俞敏洪老师是我行业的领头羊吧，也是我事业上的偶像。本日摘录他书中第一章中的金句：『一个人如果什么目标都没有，就会浑浑噩噩，感觉生命中缺少能量。能给我们能量的，是对未来的期待。第一件事，我始终为了进步而努力。与其追寻全世界的骏马，不如种植丰美的草原，到时骏马自然会来。第二件事，我始终有阶段性的目标。什么东西能给我能量？答案是对未来的期待。』读到这里的时候，我便
地推话术，如何应对地推过程中家长的拒绝校师学
相信校长们在做地推的时候经常遇到这种情况：市场专员反馈家长不接单，咨询师反馈难以邀约这些家长上门，校区地推疲软，招生难。为什么？仅从地推层面分析，一方面因为家长受到的信息轰炸越来越多，对信息越来越“免疫”；而另一方面地推人员的专业能力和营销话术没有提高，无法应对家长的拒绝，对有意向的家长也不知如何跟进，眼睁睁看着家长走远；对于家长的疑问，更不知道如何有技巧地回答，机会白白流失。由于回答没技巧和专业
谢谢你们，爱你们！鹿游儿
昨天家人去泡温泉，二个孩子也带着去，出发前一晚，匆匆下班，赶回家和孩子一起收拾。饭后，我拿出笔和本子（上次去澳门时做手帐的本子）写下了1\2\3\4\5\6\7\8\9,让后让小壹去思考，带什么出发去旅游呢？她在对应的数字旁边画上了，泳衣、泳圈、肖恩、内衣内裤、tapuy、拖鞋……画完后，就让她自己对着这个本子，将要带的，一一带上，没想到这次带的书还是这本《便便工厂》(晚上姑婆发照片过来，妹妹累得
C语言如何定义宏函数？小九格物 c语言
在C语言中，宏函数是通过预处理器定义的，它在编译之前替换代码中的宏调用。宏函数可以模拟函数的行为，但它们不是真正的函数，因为它们在编译时不会进行类型检查，也不会分配存储空间。宏函数的定义通常使用#define指令，后面跟着宏的名称和参数列表，以及宏展开后的代码。宏函数的定义方式：1.基本宏函数：这是最简单的宏函数形式，它直接定义一个表达式。#defineSQUARE(x)((x)*(x))2.带参
微服务下功能权限与数据权限的设计与实现 nbsaas-boot 微服务 java 架构
在微服务架构下，系统的功能权限和数据权限控制显得尤为重要。随着系统规模的扩大和微服务数量的增加，如何保证不同用户和服务之间的访问权限准确、细粒度地控制，成为设计安全策略的关键。本文将讨论如何在微服务体系中设计和实现功能权限与数据权限控制。1.功能权限与数据权限的定义功能权限：指用户或系统角色对特定功能的访问权限。通常是某个用户角色能否执行某个操作，比如查看订单、创建订单、修改用户资料等。数据权限：
理解Gunicorn：Python WSGI服务器的基石范范0825 ipython linux 运维
理解Gunicorn：PythonWSGI服务器的基石介绍Gunicorn，全称GreenUnicorn，是一个为PythonWSGI（WebServerGatewayInterface）应用设计的高效、轻量级HTTP服务器。作为PythonWeb应用部署的常用工具，Gunicorn以其高性能和易用性著称。本文将介绍Gunicorn的基本概念、安装和配置，帮助初学者快速上手。1.什么是Gunico
2021年12月19日，春蕾教育集团团建活动感受——黄晓丹黄错错加油
感受:1.从陌生到熟悉的过程。游戏环节让我们在轻松的氛围中得到了锻炼，也增长了不少知识。2.游戏过程中，我们贡献的是个人力量，展现的是团队的力量。它磨合的往往不止是工作的熟悉，更是观念上契合度的贴近。3.这和工作是一样的道理。在各自的岗位上，每个人摆正自己的位置、各司其职充分发挥才能，并团结一致劲往一处使，才能实现最大的成功。新知:1.团队精神需要不断地创新。过去，人们把创新看作是冒风险，现在人们
Cell Insight | 单细胞测序技术又一新发现，可用于HIV-1和Mtb共感染个体诊断尐尐呅
结核病是艾滋病合并其他疾病中导致患者死亡的主要原因。其中结核病由结核分枝杆菌（Mycobacteriumtuberculosis,Mtb）感染引起，获得性免疫缺陷综合症（艾滋病）由人免疫缺陷病毒（Humanimmunodeficiencyvirustype1,HIV-1）感染引起。国家感染性疾病临床医学研究中心/深圳市第三人民医院张国良团队携手深圳华大生命科学研究院吴靓团队，共同研究得出单细胞测序
c++ 的iostream 和 c++的stdio的区别和联系黄卷青灯77 c++算法开发语言 iostream stdio
在C++中，iostream和C语言的stdio.h都是用于处理输入输出的库，但它们在设计、用法和功能上有许多不同。以下是两者的区别和联系：区别1.编程风格iostream（C++风格）：C++标准库中的输入输出流类库，支持面向对象的输入输出操作。典型用法是cin（输入）和cout（输出），使用>操作符来处理数据。更加类型安全，支持用户自定义类型的输入输出。#includeintmain(){in
《投行人生》读书笔记小蘑菇的树洞
《投行人生》----作者詹姆斯-A-朗德摩根斯坦利副主席40年的职业洞见-很短小精悍的篇幅，比较适合初入职场的新人。第一部分成功的职业生涯需要规划1.情商归为适应能力分享与协作同理心适应能力，更多的是自我意识，你有能力识别自己的情并分辨这些情绪如何影响你的思想和行为。2.对于初入职场的人的建议，细节，截止日期和数据很重要截止日期，一种有效的方法是请老板为你所有的任务进行优先级排序。和老板喝咖啡的好
Linux下QT开发的动态库界面弹出操作（SDL2） 13jjyao QT类 qt 开发语言 sdl2 linux
需求：操作系统为linux，开发框架为qt，做成需带界面的qt动态库，调用方为java等非qt程序难点：调用方为java等非qt程序，也就是说调用方肯定不带QApplication::exec()，缺少了这个，QTimer等事件和QT创建的窗口将不能弹出(包括opencv也是不能弹出)；这与qt调用本身qt库是有本质的区别的思路：1.调用方缺QApplication::exec()，那么我们在接口
绘本讲师训练营【24期】8/21阅读原创《独生小孩》 1784e22615e0
24016-孟娟《独生小孩》图片发自App今天我想分享一个蛮特别的绘本，讲的是一个特殊的群体，我也是属于这个群体，80后的独生小孩。这是一本中国绘本，作者郭婧，也是一个80厚。全书一百多页，均为铅笔绘制，虽然为黑白色调，但并不显得沉闷。全书没有文字，犹如“默片”，但并不影响读者对该作品的理解，反而显得神秘，梦幻，給读者留下想象的空间。作者在前蝴蝶页这样写到：“我更希望父母和孩子一起分享这本书，使他
店群合一模式下的社区团购新发展——结合链动 2+1 模式、AI 智能名片与 S2B2C 商城小程序源码说私域人工智能小程序
摘要：本文探讨了店群合一的社区团购平台在当今商业环境中的重要性和优势。通过分析店群合一模式如何将互联网社群与线下终端紧密结合，阐述了链动2+1模式、AI智能名片和S2B2C商城小程序源码在这一模式中的应用价值。这些创新元素的结合为社区团购带来了新的机遇，提升了用户信任感、拓展了营销渠道，并实现了线上线下的完美融合。一、引言随着互联网技术的不断发展，社区团购作为一种新兴的商业模式，在满足消费者日常需
消息中间件有哪些常见类型 xmh-sxh-1314 java
消息中间件根据其设计理念和用途，可以大致分为以下几种常见类型：点对点消息队列（Point-to-PointMessagingQueues）：在这种模型中，消息被发送到特定的队列中，消费者从队列中取出并处理消息。队列中的消息只能被一个消费者消费，消费后即被删除。常见的实现包括IBM的MQSeries、RabbitMQ的部分使用场景等。适用于任务分发、负载均衡等场景。发布/订阅消息模型（Pub/Sub
ArcGIS栅格计算器常见公式（赋值、0和空值的转换、补充栅格空值）研学随笔 arcgis 经验分享
我们在使用ArcGIS时通常经常用到栅格计算器，今天主要给大家介绍我日常中经常用到的几个公式，供大家参考学习。将特定值（-9999）赋值为0，例如-9999.Con("raster"==-9999,0,"raster")2.给空值赋予特定的值（如0）Con(IsNull("raster"),0,"raster")3.将特定的栅格值(如1)赋值为空值，其他保留原值SetNull("raster"==
水平垂直居中的几种方法（总结） LJ小番茄 CSS_玄学语言 html javascript 前端 css css3
1.使用flexbox的justify-content和align-items.parent{display:flex;justify-content:center;/*水平居中*/align-items:center;/*垂直居中*/height:100vh;/*需要指定高度*/}2.使用grid的place-items:center.parent{display:grid;place-item
本周第二次约练 2cfbdfe28a51
中原焦点团队中24初26刘霞2021.12.3约练161次，分享第368天当事人虽然是带着问题来的，但是咨询过程中发现，她是经过自己不断地调整和努力才走到现在的，看到当事人的不容易，找到例外，发现资源，力量感也就随之而来。增强画面感，或者说重温，会给当事人带来更深刻的感受。
放下是一段成长的修行小莳玥
人来到这个世界上，只有两件事：生和死。一件事已经做完了，另一件你还急什么呢?是人，都有七情六欲。是心，都有喜怒哀乐，这些再正常不过了。别总抱怨自己活得累，过得辛苦。永远记住：舒坦是留给死人的。苦，才是生活；累，才是工作；变，才是命运；忍，才是历练；容，才是智慧；静，才是修养；舍，才会得到；做，才会拥有。人生，活得太清楚，才是最大的不明白。有些事，看得很清，却说不清；有些人，了解很深，却猜不透；有些
回溯 Leetcode 332 重新安排行程 mmaerd Leetcode刷题学习记录 leetcode 算法职场和发展
重新安排行程Leetcode332学习记录自代码随想录给你一份航线列表tickets，其中tickets[i]=[fromi,toi]表示飞机出发和降落的机场地点。请你对该行程进行重新规划排序。所有这些机票都属于一个从JFK（肯尼迪国际机场）出发的先生，所以该行程必须从JFK开始。如果存在多种有效的行程，请你按字典排序返回最小的行程组合。例如，行程[“JFK”,“LGA”]与[“JFK”,“LGB
Python数据分析与可视化实战指南 William数据分析 python python 数据
在数据驱动的时代，Python因其简洁的语法、强大的库生态系统以及活跃的社区，成为了数据分析与可视化的首选语言。本文将通过一个详细的案例，带领大家学习如何使用Python进行数据分析，并通过可视化来直观呈现分析结果。一、环境准备1.1安装必要库在开始数据分析和可视化之前，我们需要安装一些常用的库。主要包括pandas、numpy、matplotlib和seaborn等。这些库分别用于数据处理、数学
每日一题——第八十四题互联网打工人no1 C语言程序设计每日一练 c语言
题目：编写函数1、输入10个职工的姓名和职工号2、按照职工由大到小顺序排列，姓名顺序也随之调整3、要求输入一个职工号，用折半查找法找出该职工的姓名#define_CRT_SECURE_NO_WARNINGS#include#include#defineMAX_EMPLOYEES10typedefstruct{intid;charname[50];}Empolyee;voidinputEmploye
网易严选官方旗舰店，优质商品，卓越服务高省_飞智666600
网易严选官方旗舰店是网易旗下的一家电商平台，以提供优质商品和卓越服务而闻名。作为一名SEO优化师，我将为您详细介绍网易严选官方旗舰店，并重点强调其特点和优势。大家好！我是高省APP最大团队&联合创始人飞智导师。相较于其他返利app，高省APP的佣金更高，模式更好，最重要的是，终端用户不会流失！高省APP佣金更高，模式更好，终端用户不流失。【高省】是一个自用省钱佣金高，分享推广赚钱多的平台，百度有几
对股票分析时要注意哪些主要因素？会飞的奇葩猪股票分析云掌股吧
　　众所周知，对散户投资者来说，股票技术分析是应战股市的核心武器，想学好股票的技术分析一定要知道哪些是重点学习的，其实非常简单，我们只要记住三个要素：成交量、价格趋势、振荡指标。一、成交量　　大盘的成交量状态。成交量大说明市场的获利机会较多，成交量小说明市场的获利机会较少。当沪市的成交量超过150亿时是强市市场状态，运用技术找综合买点较准；
【Scala十八】视图界定与上下文界定 bit1129 scala
Context Bound，上下文界定，是Scala为隐式参数引入的一种语法糖，使得隐式转换的编码更加简洁。隐式参数首先引入一个泛型函数max，用于取a和b的最大值 def max[T](a: T, b: T) = { if (a > b) a else b } 因为T是未知类型，只有运行时才会代入真正的类型，因此调用a >
C语言的分支——Object-C程序设计阅读有感 darkblue086 apple c 框架 cocoa
自从1972年贝尔实验室Dennis Ritchie开发了C语言，C语言已经有了很多版本和实现，从Borland到microsoft还是GNU、Apple都提供了不同时代的多种选择，我们知道C语言是基于Thompson开发的B语言的，Object-C是以SmallTalk-80为基础的。和C++不同的是，Object C并不是C的超集，因为有很多特性与C是不同的。 Object-C程序设计这本书
去除浏览器对表单值的记忆周凡杨 html 记忆 autocomplete form 浏览
&n
java的树形通讯录 g21121 java
最近用到企业通讯录，虽然以前也开发过，但是用的是jsf，拼成的树形，及其笨重和难维护。后来就想到直接生成json格式字符串，页面上也好展现。 // 首先取出每个部门的联系人 for (int i = 0; i < depList.size(); i++) { List<Contacts> list = getContactList(depList.get(i
Nginx安装部署 510888780 nginx linux
Nginx ("engine x") 是一个高性能的 HTTP 和反向代理服务器，也是一个 IMAP/POP3/SMTP 代理服务器。 Nginx 是由 Igor Sysoev 为俄罗斯访问量第二的 Rambler.ru 站点开发的，第一个公开版本0.1.0发布于2004年10月4日。其将源代码以类BSD许可证的形式发布，因它的稳定性、丰富的功能集、示例配置文件和低系统资源
java servelet异步处理请求墙头上一根草ｊａｖａ异步返回ｓｅｒｖｌｅｔ
servlet3.0以后支持异步处理请求，具体是使用AsyncContext ，包装httpservletRequest以及httpservletResponse具有异步的功能， final AsyncContext ac = request.startAsync(request, response); ac.s
我的spring学习笔记8-Spring中Bean的实例化 aijuans Spring 3
在Spring中要实例化一个Bean有几种方法： 1、最常用的（普通方法） <bean id="myBean" class="www.6e6.org.MyBean" /> 使用这样方法，按Spring就会使用Bean的默认构造方法，也就是把没有参数的构造方法来建立Bean实例。（有构造方法的下个文细说） 2、还
为Mysql创建最优的索引 annan211 mysql 索引
索引对于良好的性能非常关键，尤其是当数据规模越来越大的时候，索引的对性能的影响越发重要。索引经常会被误解甚至忽略，而且经常被糟糕的设计。索引优化应该是对查询性能优化最有效的手段了，索引能够轻易将查询性能提高几个数量级，最优的索引会比较好的索引性能要好2个数量级。 1 索引的类型 (1) B-Tree 不出意外，这里提到的索引都是指 B-
日期函数百合不是茶 oracle sql 日期函数查询
ORACLE日期时间函数大全 TO_DATE格式(以时间:2007-11-02 13:45:25为例) Year: yy two digits 两位年显示值:07 yyy three digits 三位年显示值:007
线程优先级 bijian1013 java thread 多线程 java多线程
多线程运行时需要定义线程运行的先后顺序。线程优先级是用数字表示，数字越大线程优先级越高，取值在1到10，默认优先级为5。实例： package com.bijian.study; /** * 因为在代码段当中把线程B的优先级设置高于线程A,所以运行结果先执行线程B的run()方法后再执行线程A的run()方法 * 但在实际中，JAVA的优先级不准，强烈不建议用此方法来控制执
适配器模式和代理模式的区别 bijian1013 java 设计模式
一.简介适配器模式：适配器模式（英语：adapter pattern）有时候也称包装样式或者包装。将一个类的接口转接成用户所期待的。一个适配使得因接口不兼容而不能在一起工作的类工作在一起，做法是将类别自己的接口包裹在一个已存在的类中。 &nbs
【持久化框架MyBatis3三】MyBatis3 SQL映射配置文件 bit1129 Mybatis3
SQL映射配置文件一方面类似于Hibernate的映射配置文件，通过定义实体与关系表的列之间的对应关系。另一方面使用<select>,<insert>,<delete>，<update>元素定义增删改查的SQL语句，这些元素包含三方面内容 1. 要执行的SQL语句 2. SQL语句的入参，比如查询条件 3. SQL语句的返回结果
oracle大数据表复制备份个人经验 bitcarter oracle 大表备份大表数据复制
前提：数据库仓库A（就拿oracle11g为例）中有两个用户user1和user2,现在有user1中有表ldm_table1,且表ldm_table1有数据5千万以上，ldm_table1中的数据是从其他库B（数据源）中抽取过来的，前期业务理解不够或者需求有变，数据有变动需要重新从B中抽取数据到A库表ldm_table1中。
HTTP加速器varnish安装小记 ronin47 http varnish 加速
上午共享的那个varnish安装手册，个人看了下，有点不知所云，好吧~看来还是先安装玩玩！苦逼公司服务器没法连外网，不能用什么wget或yum命令直接下载安装，每每看到别人博客贴出的在线安装代码时，总有一股羡慕嫉妒“恨”冒了出来。。。好吧，既然没法上外网，那只能麻烦点通过下载源码来编译安装了！ Varnish 3.0.4下载地址： http://repo.varnish-cache.org/
java-73-输入一个字符串，输出该字符串中对称的子字符串的最大长度 bylijinnan java
public class LongestSymmtricalLength { /* * Q75题目：输入一个字符串，输出该字符串中对称的子字符串的最大长度。 * 比如输入字符串“google”，由于该字符串里最长的对称子字符串是“goog”，因此输出4。 */ public static void main(String[] args) { Str
学习编程的一点感想 Cb123456 编程感想 Gis
写点感想，总结一些，也顺便激励一些自己.现在就是复习阶段，也做做项目. 本专业是GIS专业，当初觉得本专业太水，靠这个会活不下去的，所以就报了培训班。学习的时候，进入状态很慢，而且当初进去的时候，已经上到Java高级阶段了，所以.....，呵呵，之后有点感觉了，不过，还是不好好写代码，还眼高手低的，有
[能源与安全]美国与中国 comsci 能源
现在有一个局面：地球上的石油只剩下N桶，这些油只够让中国和美国这两个国家中的一个顺利过渡到宇宙时代，但是如果这两个国家为争夺这些石油而发生战争，其结果是两个国家都无法平稳过渡到宇宙时代。。。。而且在战争中，剩下的石油也会被快速消耗在战争中，结果是两败俱伤。。。在这个大
SEMI-JOIN执行计划突然变成HASH JOIN了的原因分析 cwqcwqmax9 oracle
甲说： A B两个表总数据量都很大，在百万以上。 idx1 idx2字段表示是索引字段 A B 两表上都有 col1字段表示普通字段 select xxx from A where A.idx1 between mmm and nnn and exists (select 1 from B where B.idx2 =
SpringMVC-ajax返回值乱码解决方案 dashuaifu Ajax springMVC response 中文乱码
SpringMVC-ajax返回值乱码解决方案一：（自己总结，测试过可行） ajax返回如果含有中文汉字，则使用：（如下例：） @RequestMapping(value="/xxx.do") public @ResponseBody void getPunishReasonB
Linux系统中查看日志的常用命令 dcj3sjt126com OS
因为在日常的工作中，出问题的时候查看日志是每个管理员的习惯，作为初学者，为了以后的需要，我今天将下面这些查看命令共享给各位 cat tail -f 日志文件说明 /var/log/message 系统启动后的信息和错误日志，是Red Hat Linux中最常用的日志之一 /var/log/secure 与安全相关的日志信息 /var/log/maillog 与邮件相关的日志信
[应用结构]应用 dcj3sjt126com PHP yii2
应用主体应用主体是管理 Yii 应用系统整体结构和生命周期的对象。每个Yii应用系统只能包含一个应用主体，应用主体在入口脚本中创建并能通过表达式 \Yii::$app 全局范围内访问。补充: 当我们说"一个应用"，它可能是一个应用主体对象，也可能是一个应用系统，是根据上下文来决定[译：中文为避免歧义，Application翻译为应
assertThat用法 eksliang JUnit assertThat
junit4.0 assertThat用法一般匹配符1、assertThat( testedNumber, allOf( greaterThan(8), lessThan(16) ) ); 注释： allOf匹配符表明如果接下来的所有条件必须都成立测试才通过，相当于“与”（&&） 2、assertThat( testedNumber, anyOf( g
android点滴2 gundumw100 应用服务器 android 网络应用 OS HTC
如何让Drawable绕着中心旋转？ Animation a = new RotateAnimation(0.0f, 360.0f, Animation.RELATIVE_TO_SELF, 0.5f, Animation.RELATIVE_TO_SELF,0.5f); a.setRepeatCount(-1); a.setDuration(1000); 如何控制Andro
超简洁的CSS下拉菜单 ini html Web 工作 html5 css
效果体验：http://hovertree.com/texiao/css/3.htmHTML文件： <!DOCTYPE html> <html xmlns="http://www.w3.org/1999/xhtml"> <head> <title>简洁的HTML+CSS下拉菜单-HoverTree</title>
kafka consumer防止数据丢失 kane_xie kafka offset commit
kafka最初是被LinkedIn设计用来处理log的分布式消息系统，因此它的着眼点不在数据的安全性（log偶尔丢几条无所谓），换句话说kafka并不能完全保证数据不丢失。尽管kafka官网声称能够保证at-least-once，但如果consumer进程数小于partition_num，这个结论不一定成立。考虑这样一个case，partiton_num=2
@Repository、@Service、@Controller 和 @Component mhtbbx DAO spring bean prototype
@Repository、@Service、@Controller 和 @Component 将类标识为Bean Spring 自 2.0 版本开始，陆续引入了一些注解用于简化 Spring 的开发。@Repository注解便属于最先引入的一批，它用于将数据访问层 (DAO 层 ) 的类标识为 Spring Bean。具体只需将该注解标注在 DAO类上即可。同时，为了让 Spring 能够扫描类
java 多线程高并发读写控制误区 qifeifei java thread
先看一下下面的错误代码，对写加了synchronized控制，保证了写的安全，但是问题在哪里呢？ public class testTh7 { private String data; public String read(){ System.out.println(Thread.currentThread().getName() + "read data "
mongodb replica set(副本集)设置步骤 tcrct java mongodb
网上已经有一大堆的设置步骤的了，根据我遇到的问题，整理一下，如下：首先先去下载一个mongodb最新版，目前最新版应该是2.6 cd /usr/local/bin wget http://fastdl.mongodb.org/linux/mongodb-linux-x86_64-2.6.0.tgz tar -zxvf mongodb-linux-x86_64-2.6.0.t
rust学习笔记 wudixiaotie 学习笔记
1.rust里绑定变量是let，默认绑定了的变量是不可更改的，所以如果想让变量可变就要加上mut。 let x = 1; let mut y = 2; 2.match 相当于erlang中的case，但是case的每一项后都是分号，但是rust的match却是逗号。 3.match 的每一项最后都要加逗号，但是最后一项不加也不会报错，所有结尾加逗号的用法都是类似。 4.每个语句结尾都要加分