Python3数据科学包系列(三):数据分析实战

Python3数据科学包系列(三):数据分析实战_第1张图片



Python3中类的高级语法及实战

Python3(基础|高级)语法实战(|多线程|多进程|线程池|进程池技术)|多线程安全问题解决方案

Python3数据科学包系列(一):数据分析实战

Python3数据科学包系列(二):数据分析实战




 

一:  数据分析与挖掘认知升维


我们知道在数据分析与数据挖掘中,数据处理是一项复杂且繁琐的工作,同时也是整个数据分析过程中的最为重要的环节;数据处理一方面能提供数据的质量;另一方面能让数据更好的使用数据分析工具;

数据处理的主要内容包括:

(1) 数据清洗

      1.1 重复值处理

       1.2 缺少值处理

(2) 数据的抽取

       2.1 字段抽取

       2.2 字段拆分

       2.3 重置索引

       2.4 记录抽取

       2.5 随机抽样

       2.6 通过索引抽取数据

       2.7 字典数据抽取

       2.8 插入数据

       2.9 修改数据记录

(3) 数据交换

       3.1 交换行与列

       3.2  排名索引

       3.3  数据合并

(4) 数据计算

        4.1 简单计算 (加,减,乘,除的计算)

        4.2  数据标准化

         4.3  数据分组

         4.4  日期处理

....................

(5) 数据可视化

            5.1 图表化

             5.2 Excel|Word|PPT化


 二: 数据处理

后续补充完整.....................

你可能感兴趣的:(数据分析,数据挖掘,python,scikit-learn,numpy,pandas)