AI蜗牛车

【Data Mining】机器学习三剑客之Pandas常用算法总结下

前言

请先看：
机器学习三剑客之Numpy常用算法总结
机器学习三剑客之Pandas常用算法总结上

设置值

import pandas as pd
import numpy as np

dates = pd.date_range('20191222', periods=3)
df = pd.DataFrame(np.arange(12).reshape((3, 4)), index=dates, columns=['A', 'B', 'C', 'D'])
print(df)
"""
            A  B   C   D
2019-12-22  0  1   2   3
2019-12-23  4  5   6   7
2019-12-24  8  9  10  11
"""
# index
df.iloc[1, 1] = 1111
print(df)
"""
            A     B   C   D
2019-12-22  0     1   2   3
2019-12-23  4  1111   6   7
2019-12-24  8     9  10  11
"""
# label
df.loc['20191224', 'C'] = 2222
print(df)
"""
            A     B     C   D
2019-12-22  0     1     2   3
2019-12-23  4  1111     6   7
2019-12-24  8     9  2222  11
"""
# mix
df.ix['20191222', 1] = 3333
print(df)
"""
            A     B     C   D
2019-12-22  0  3333     2   3
2019-12-23  4  1111     6   7
2019-12-24  8     9  2222  11
"""




dates2 = pd.date_range('20191222', periods=6)
df2 = pd.DataFrame(np.arange(24).reshape((6, 4)), index=dates2, columns=['A', 'B', 'C', 'D'])
print(df2)
"""
             A   B   C   D
2019-12-22   0   1   2   3
2019-12-23   4   5   6   7
2019-12-24   8   9  10  11
2019-12-25  12  13  14  15
2019-12-26  16  17  18  19
2019-12-27  20  21  22  23
"""
df2[df2.A > 12] = 0
print(df2)
df2.A[df2.A > 8] = 0
print(df2)
df2.B[df2.A > 2] = 0
print(df2)
# batch processing
"""
             A   B   C   D
2019-12-22   0   1   2   3
2019-12-23   4   5   6   7
2019-12-24   8   9  10  11
2019-12-25  12  13  14  15
2019-12-26   0   0   0   0
2019-12-27   0   0   0   0
            A   B   C   D
2019-12-22  0   1   2   3
2019-12-23  4   5   6   7
2019-12-24  8   9  10  11
2019-12-25  0  13  14  15
2019-12-26  0   0   0   0
2019-12-27  0   0   0   0
            A   B   C   D
2019-12-22  0   1   2   3
2019-12-23  4   0   6   7
2019-12-24  8   0  10  11
2019-12-25  0  13  14  15
2019-12-26  0   0   0   0
2019-12-27  0   0   0   0
"""
# add a colomn
df2['F'] = np.nan
print df2
"""
            A   B   C   D   F
2019-12-22  0   1   2   3 NaN
2019-12-23  4   0   6   7 NaN
2019-12-24  8   0  10  11 NaN
2019-12-25  0  13  14  15 NaN
2019-12-26  0   0   0   0 NaN
2019-12-27  0   0   0   0 NaN
"""
# add a colomn using Series
df2['E'] = pd.Series([1, 2, 3, 4, 5, 6], index=dates2)
print df2
"""
            A   B   C   D   F  E
2019-12-22  0   1   2   3 NaN  1
2019-12-23  4   0   6   7 NaN  2
2019-12-24  8   0  10  11 NaN  3
2019-12-25  0  13  14  15 NaN  4
2019-12-26  0   0   0   0 NaN  5
2019-12-27  0   0   0   0 NaN  6
"""

一些总结说明

首先第一种方法，毋庸置疑，猜都能猜到就是之前的选取值的方式之后对于选取的值进行赋值即可，主要有index,label和mix
对于数字数据，通过比较大小来批量处理数据，可以好几行好几列一起处理，也可以单独列或者单独行处理
设置值还包括添加新的一个colomn，也就是添加一个新的series，如果添加的为标量则可以直接一个数字一起赋值，但如果输入过于复杂，我个人建议都采用Series的方式进行添加，所以这就最后归因于你是否掌握了series，方式为dataframe[‘colomn name’] = pd.Series([])

处理缺省值

# -*- coding: utf-8 -*-
import pandas as pd
import numpy as np

dates = pd.date_range('20191222', periods=4)
df = pd.DataFrame(np.arange(16).reshape((4, 4)), index=dates, columns=['A', 'B', 'C', 'D'])
print(df)
"""
             A   B   C   D
2019-12-22   0   1   2   3
2019-12-23   4   5   6   7
2019-12-24   8   9  10  11
2019-12-25  12  13  14  15
"""
# add nan
df.iloc[0, 1] = np.nan
df.iloc[2, 2] = np.nan
print(df)
# drop na (index or colomn)
print(df.dropna(axis=0, how='any'))
print(df.dropna(axis=1, how='any'))
"""
             A     B     C   D
2019-12-22   0   NaN   2.0   3
2019-12-23   4   5.0   6.0   7
2019-12-24   8   9.0   NaN  11
2019-12-25  12  13.0  14.0  15
             A     B     C   D
2019-12-23   4   5.0   6.0   7
2019-12-25  12  13.0  14.0  15
             A   D
2019-12-22   0   3
2019-12-23   4   7
2019-12-24   8  11
2019-12-25  12  15
"""

# 前后对比
print(df.dropna(axis=1, how='all'))
"""
             A     B     C   D
2019-12-22   0   NaN   2.0   3
2019-12-23   4   5.0   6.0   7
2019-12-24   8   9.0   NaN  11
2019-12-25  12  13.0  14.0  15
"""
df.iloc[1, 1] = np.nan
df.iloc[2, 1] = np.nan
df.iloc[3, 1] = np.nan
print(df)
print(df.dropna(axis=1, how='all'))
"""
             A   B     C   D
2019-12-22   0 NaN   2.0   3
2019-12-23   4 NaN   6.0   7
2019-12-24   8 NaN   NaN  11
2019-12-25  12 NaN  14.0  15
             A     C   D
2019-12-22   0   2.0   3
2019-12-23   4   6.0   7
2019-12-24   8   NaN  11
2019-12-25  12  14.0  15
"""
# fillna has many parameters
# please see details
# 把nan复制成value
print(df.fillna(value=222.22))
"""
             A       B       C   D
2019-12-22   0  222.22    2.00   3
2019-12-23   4  222.22    6.00   7
2019-12-24   8  222.22  222.22  11
2019-12-25  12  222.22   14.00  15
"""
# judge nan
# 一般表格很大的时候用
# nan return True
print(df.isnull())
# 如果有一个值为df.isnull 中有一个为True，则返回True
# 一起使用，则为判断这个大的dataframe中是否含有nan
print(np.any(df.isnull()))

print(np.any(df.isnull()) == True)

"""
                A     B      C      D
2019-12-22  False  True  False  False
2019-12-23  False  True  False  False
2019-12-24  False  True   True  False
2019-12-25  False  True  False  False
True
True
"""

删除nan,all全部为nan则删,any有一个nan则删，删index or colomn看axis
填充nan一个value
超级大的dataframe判断是否有nan

合并concat

①

# -*- coding: utf-8 -*-
import pandas as pd
import numpy as np

df1 = pd.DataFrame(np.ones((2, 3))*0, columns=['a', 'b', 'c'])
df2 = pd.DataFrame(np.ones((2, 3))*1, columns=['a', 'b', 'c'])
df3 = pd.DataFrame(np.ones((2, 3))*22, columns=['a', 'b', 'c'])
print(df1)
print(df2)
print(df3)
"""
     a    b    c
0  0.0  0.0  0.0
1  0.0  0.0  0.0
     a    b    c
0  1.0  1.0  1.0
1  1.0  1.0  1.0
      a     b     c
0  22.0  22.0  22.0
1  22.0  22.0  22.0
"""
# 三个进行合并 index也是最初的组合而已,此处axis=0为vertical合并
df_vertical = pd.concat([df1, df2, df3], axis=0)
print(df_vertical)
"""
      a     b     c
0   0.0   0.0   0.0
1   0.0   0.0   0.0
0   1.0   1.0   1.0
1   1.0   1.0   1.0
0  22.0  22.0  22.0
1  22.0  22.0  22.0
"""
#进行index的重新洗牌
df_vertical_rightindex = pd.concat([df1, df2, df3], axis=0, ignore_index=True)
print(df_vertical_rightindex)
"""
      a     b     c
0   0.0   0.0   0.0
1   0.0   0.0   0.0
2   1.0   1.0   1.0
3   1.0   1.0   1.0
4  22.0  22.0  22.0
5  22.0  22.0  22.0
"""
# horizontal
df_horizontal = pd.concat([df1, df2, df3], axis=1)
print(df_horizontal)
"""
     a    b    c    a    b    c     a     b     c
0  0.0  0.0  0.0  1.0  1.0  1.0  22.0  22.0  22.0
1  0.0  0.0  0.0  1.0  1.0  1.0  22.0  22.0  22.0
"""
df_horizontal_rightindex = pd.concat([df1, df2, df3], axis=1, ignore_index=True)
print(df_horizontal_rightindex)
"""
     0    1    2    3    4    5     6     7     8
0  0.0  0.0  0.0  1.0  1.0  1.0  22.0  22.0  22.0
1  0.0  0.0  0.0  1.0  1.0  1.0  22.0  22.0  22.0
"""
df_horizontal_rightindex.rename(
    columns={0: 'a', 1: 'b', 2: 'c', 3: 'd', 4: 'e',
             5: 'f', 6: 'g', 7: 'h', 8: 'i', 9: 'g'}, inplace=True)
print(df_horizontal_rightindex)
"""
     a    b    c    d    e    f     g     h     i
0  0.0  0.0  0.0  1.0  1.0  1.0  22.0  22.0  22.0
1  0.0  0.0  0.0  1.0  1.0  1.0  22.0  22.0  22.0
"""

一些总结：

axis=0 为纵向合并,axis=1为横向合并
纵向合并时，想重新排序index，采用ignore_index=True参数即可
横向合并时，相当于把column作为index，所以采用ignore_index=True操作最终结果是所有的column变为0,1,2,3…，所以需要rename(columns={})重新命名即可

②

  # different colomns label and index label,need to use 'join' and 'join_axes' parameters
df4 = pd.DataFrame(np.ones((3, 4))*0, columns=['a', 'b', 'c', 'd'], index=[1, 2, 3])
df5 = pd.DataFrame(np.ones((3, 4))*1, columns=['b', 'c', 'd', 'e'], index=[2, 3, 4])
print(df4)
print(df5)
"""
     a    b    c    d
1  0.0  0.0  0.0  0.0
2  0.0  0.0  0.0  0.0
3  0.0  0.0  0.0  0.0

     b    c    d    e
2  1.0  1.0  1.0  1.0
3  1.0  1.0  1.0  1.0
4  1.0  1.0  1.0  1.0
"""
# 不存在的用nan填充
df_outer = pd.concat([df4, df5], join='outer', ignore_index=True)
print(df_outer)
"""
     a    b    c    d    e
0  0.0  0.0  0.0  0.0  NaN
1  0.0  0.0  0.0  0.0  NaN
2  0.0  0.0  0.0  0.0  NaN
3  NaN  1.0  1.0  1.0  1.0
4  NaN  1.0  1.0  1.0  1.0
5  NaN  1.0  1.0  1.0  1.0
"""
df_inner = pd.concat([df4, df5], join='inner')
print(df_inner)
"""
     b    c    d
1  0.0  0.0  0.0
2  0.0  0.0  0.0
3  0.0  0.0  0.0
2  1.0  1.0  1.0
3  1.0  1.0  1.0
4  1.0  1.0  1.0
"""
df_inner_index = pd.concat([df4, df5], join='inner', ignore_index=True)
print(df_inner_index)
"""
     b    c    d
0  0.0  0.0  0.0
1  0.0  0.0  0.0
2  0.0  0.0  0.0
3  1.0  1.0  1.0
4  1.0  1.0  1.0
5  1.0  1.0  1.0
"""


"""
原df4,df5　便于观看　
     a    b    c    d
1  0.0  0.0  0.0  0.0
2  0.0  0.0  0.0  0.0
3  0.0  0.0  0.0  0.0

     b    c    d    e
2  1.0  1.0  1.0  1.0
3  1.0  1.0  1.0  1.0
4  1.0  1.0  1.0  1.0
"""
# 不存在的用nan填充
df_h_different_index = pd.concat([df4, df5], axis=1)
print(df_h_different_index)
"""
     a    b    c    d    b    c    d    e
1  0.0  0.0  0.0  0.0  NaN  NaN  NaN  NaN
2  0.0  0.0  0.0  0.0  1.0  1.0  1.0  1.0
3  0.0  0.0  0.0  0.0  1.0  1.0  1.0  1.0
4  NaN  NaN  NaN  NaN  1.0  1.0  1.0  1.0
"""
#用df4的index作为合并之后的index,所以不是df4的index部分删掉(4删掉)
df_h_different_index_df4 = pd.concat([df4, df5], axis=1, join_axes=[df4.index])
print(df_h_different_index_df4)
"""
     a    b    c    d    b    c    d    e
1  0.0  0.0  0.0  0.0  NaN  NaN  NaN  NaN
2  0.0  0.0  0.0  0.0  1.0  1.0  1.0  1.0
3  0.0  0.0  0.0  0.0  1.0  1.0  1.0  1.0
"""

df_h_different_index_df5 = pd.concat([df4, df5], axis=1, join_axes=[df5.index])
print(df_h_different_index_df5)
"""
     a    b    c    d    b    c    d    e
2  0.0  0.0  0.0  0.0  1.0  1.0  1.0  1.0
3  0.0  0.0  0.0  0.0  1.0  1.0  1.0  1.0
4  NaN  NaN  NaN  NaN  1.0  1.0  1.0  1.0
"""

一些总结：

当index和column label不相同时合并
纵向合并用join=[‘outer’,‘inner’],横向合并用join_axes=[df.index]
当纵向时，outer为全留下，没有值的地方为nan，inner为只要相同的colomn　label处
当横向时，不采用join_axes和join='outer’效果相似，如果采用join_axes则以对应的index为最后的index，其余删掉

合并append

import numpy as np 
import pandas as pd 
df1 = pd.DataFrame(np.ones((2, 3))*0, columns=['a', 'b', 'c']) 
df2 = pd.DataFrame(np.ones((2, 3))*11, columns=['a', 'b', 'c'])  
df3 = pd.DataFrame(np.ones((2, 3))*2, columns=['a', 'b', 'c']) 
print(df1) 
print(df2) 
print(df3) 
""" 
     a    b    c 
0  0.0  0.0  0.0 
1  0.0  0.0  0.0 
      a     b     c 
0  11.0  11.0  11.0 
1  11.0  11.0  11.0  
     a    b    c 
0  2.0  2.0  2.0 
1  2.0  2.0  2.0  
""" 
df_append1 = df1.append(df2, ignore_index=True)       
print(df_append1)                     
"""             
      a     b     c                                                          
0   0.0   0.0   0.0                                                     
1   0.0   0.0   0.0                                                           
2  11.0  11.0 11.0    
3  11.0  11.0  11.0 
"""          
df_append2 = df1.append([df2, df3], ignore_index=True)      
print(df_append2)                
"""      
      a     b     c    
0   0.0   0.0   0.0                                                     
1   0.0   0.0   0.0                                                       
2  11.0  11.0  11.0                                                         
3  11.0  11.0  11.0   
4   2.0   2.0   2.0      
5   2.0   2.0   2.0                          
"""                                           
s1 = pd.Series([12, 24, 33], index=['a', 'b', 'c'])  
df_appned_s = df1.append(s1, ignore_index=True)  
print(df_appned_s) 
"""   
      a     b     c 
0   0.0   0.0   0.0 
1   0.0   0.0   0.0 
2  12.0  24.0  33.0
"""

一些总结：

append是python中list常用的功能，这里append相当于dataframe在纵向方向上加数据
series相当于dataframe的一行，append一个series相当于在下面加上了一行

合并merge

1. on对应的column中的value完全相同，并且只针对一个column

# -*- coding: utf-8 -*-
import pandas as pd

left = pd.DataFrame({'connect': ['con0', 'con1', 'con2', 'con3'],
                             'A': ['A0', 'A1', 'A2', 'A3'],
                             'B': ['B0', 'B1', 'B2', 'B3']})
right = pd.DataFrame({'connect' : ['con0', 'con1', 'con2', 'con3'],
                            'C': ['C0', 'C1', 'C2', 'C3'],
                            'D': ['D0', 'D1', 'D2', 'D3']})

print(left)
print(right)
"""
    A   B connect
0  A0  B0    con0
1  A1  B1    con1
2  A2  B2    con2
3  A3  B3    con3
    C   D connect
0  C0  D0    con0
1  C1  D1    con1
2  C2  D2    con2
3  C3  D3    con3
"""


# 两个dataframe通过相同的column,merge在一起
# column label为connect上的元素全部一样的一般情况
merge_l_r_same = pd.merge(left=left, right=right, on='connect')
print(merge_l_r_same)
merge_l_r_same = pd.merge(left=right, right=left, on='connect')
print(merge_l_r_same)
"""
    A   B connect   C   D
0  A0  B0    con0  C0  D0
1  A1  B1    con1  C1  D1
2  A2  B2    con2  C2  D2
3  A3  B3    con3  C3  D3

    C   D connect   A   B
0  C0  D0    con0  A0  B0
1  C1  D1    con1  A1  B1
2  C2  D2    con2  A2  B2
3  C3  D3    con3  A3  B3

通过这个对比可以明白参数on, 以及left, right的功能
left,right即通过on参数指定的column来进行合并而
left对应的dataframe剩下的column则全都依次放在left
right对应的dataframe剩下的column则全都依次放在right
"""

2. on针对多个column,并且对应的column中的value不相同

#　on多个column　并且每个column label对应的value有重叠但不完全相同.

left = pd.DataFrame({'key1': ['K1', 'K0', 'K1', 'K2'],
                      'key2': ['K0', 'K0', 'K1', 'K1'],
                      'A': ['A0', 'A1', 'A2', 'A3'],
                      'B': ['B0', 'B1', 'B2', 'B3']})
right = pd.DataFrame({'key1': ['K0', 'K0', 'K1', 'K1'],
                       'key2': ['K0', 'K1', 'K1', 'K1'],
                       'C': ['C0', 'C1', 'C2', 'C3'],
                       'D': ['D0', 'D1', 'D2', 'D3']})
print(left)
print(right)
"""
    A   B key1 key2
0  A0  B0   K1   K0
1  A1  B1   K0   K0
2  A2  B2   K1   K1
3  A3  B3   K2   K1

    C   D key1 key2
0  C0  D0   K0   K0
1  C1  D1   K0   K1
2  C2  D2   K1   K1
3  C3  D3   K1   K1
"""
# on对应于多个column时需要采用List
# how=['inner', 'outer', 'left', 'right']
# default = 'inner'
merge_l_r_different = pd.merge(left, right, on=['key1', 'key2'])
print(merge_l_r_different)
"""
    A   B key1 key2   C   D
0  A1  B1   K0   K0  C0  D0
1  A2  B2   K1   K1  C2  D2
2  A2  B2   K1   K1  C3  D3
"""
merge_inner = pd.merge(left, right, on=['key1', 'key2'], how='inner')
print(merge_inner)
"""
    A   B key1 key2   C   D
0  A1  B1   K0   K0  C0  D0
1  A2  B2   K1   K1  C2  D2
2  A2  B2   K1   K1  C3  D3
"""

"""
便于观看
left:
    A   B key1 key2
0  A0  B0   K1   K0
1  A1  B1   K0   K0
2  A2  B2   K1   K1
3  A3  B3   K2   K1
right:
    C   D key1 key2
0  C0  D0   K0   K0
1  C1  D1   K0   K1
2  C2  D2   K1   K1
3  C3  D3   K1   K1
"""

merge_outer = pd.merge(left, right, on=['key1', 'key2'], how='outer')
print(merge_outer)
"""
     A    B key1 key2    C    D
0   A0   B0   K1   K0  NaN  NaN
1   A1   B1   K0   K0   C0   D0
2   A2   B2   K1   K1   C2   D2
3   A2   B2   K1   K1   C3   D3
4   A3   B3   K2   K1  NaN  NaN
5  NaN  NaN   K0   K1   C1   D1
"""
merge_left = pd.merge(left, right, on=['key1', 'key2'], how='left')
print(merge_left)
"""
    A   B key1 key2    C    D
0  A0  B0   K1   K0  NaN  NaN
1  A1  B1   K0   K0   C0   D0
2  A2  B2   K1   K1   C2   D2
3  A2  B2   K1   K1   C3   D3
4  A3  B3   K2   K1  NaN  NaN
"""

"""
便于观看
left:
    A   B key1 key2
0  A0  B0   K1   K0
1  A1  B1   K0   K0
2  A2  B2   K1   K1
3  A3  B3   K2   K1
right:
    C   D key1 key2
0  C0  D0   K0   K0
1  C1  D1   K0   K1
2  C2  D2   K1   K1
3  C3  D3   K1   K1
"""
merge_right = pd.merge(left, right, on=['key1', 'key2'], how='right')
print(merge_right)
"""
     A    B key1 key2   C   D
0   A1   B1   K0   K0  C0  D0
1   A2   B2   K1   K1  C2  D2
2   A2   B2   K1   K1  C3  D3
3  NaN  NaN   K0   K1  C1  D1
"""

这里主要是考察merge函数中的how参数的用法，以及对应的operations
这里举两个例子主要分析

"""
    A   B key1 key2
0  A0  B0   K1   K0
1  A1  B1   K0   K0
2  A2  B2   K1   K1
3  A3  B3   K2   K1

    C   D key1 key2
0  C0  D0   K0   K0
1  C1  D1   K0   K1
2  C2  D2   K1   K1
3  C3  D3   K1   K1
"""
result:
"""
    A   B key1 key2   C   D
0  A1  B1   K0   K0  C0  D0
1  A2  B2   K1   K1  C2  D2
2  A2  B2   K1   K1  C3  D3
"""
进行on=['key1, key2'], how='inner'
请试着和我一起分析：
首先因为通过key1和key2两个column进行合并，观察两列中的[key1,key2]组合完全相同的行
可以明显观察到的是　[K0,K0]以及[K1,K1]相同，因为采用inner方式所以只考虑相同的行即可,
首先取出[K0,K0]中的left的元素放置于左边,对应的right的value放置于右边，接下来一样的操作
对应left中的[K1, K1]有两个right对应，首先先将[K1, K1]的left的元素放置于左边，之后去取
right的中的元素放置于右面，而对于right中的[K1, K1]有两个放置于右边，所以左边还需补一组
一模一样的left中对应的数据放置于左面，即可。
如果how='outer'的话则全部的columns都留下，只是left和right中没有对应的部分，为nan即可，可返回到代码部分重复观看，即可明白。
"""
    A   B key1 key2    C    D
0  A0  B0   K1   K0  NaN  NaN
1  A1  B1   K0   K0   C0   D0
2  A2  B2   K1   K1   C2   D2
3  A2  B2   K1   K1   C3   D3
4  A3  B3   K2   K1  NaN  NaN
"""
how='left'的意思才估计也能猜到了，就是主要针对于left的所有的[key1, key2]组合，right只是
迎合left的结构。分析如下：
首先left中的[K1,K0]对应于的数据放在左面，而right中不存在则为nan nan,之后[K0,K0]存在对应的right元素，[K1,K1]和上面的分析基本一致，最后到[K2, K1]和[K1, K0]一个意思。
大家可以自行根据以上分析来分析，'outer'和'right'情况

3.indicator

import pandas as pd

# the parameter of indicator
left = pd.DataFrame({'key': [0, 1], 'left': ['a', 'b']})
right = pd.DataFrame({'key': [1, 2, 2], 'right': [2, 2, 2]})
print(left)
print(right)
"""
   key left
0    0    a
1    1    b
   key  right
0    1      2
1    2      2
2    2      2
"""
res_indicator = pd.merge(left=left, right=right, on='key', how='outer', indicator=True)
print(res_indicator)
"""
   key left  right      _merge
0    0    a    NaN   left_only
1    1    b    2.0        both
2    2  NaN    2.0  right_only
3    2  NaN    2.0  right_only
"""
# give indicater a name that is "dict_name"
# the default name is "_merge"
res_indicator2 = pd.merge(left, right, on='key', how='outer', indicator="idct_name")
print(res_indicator2)
"""
   key left  right   idct_name
0    0    a    NaN   left_only
1    1    b    2.0        both
2    2  NaN    2.0  right_only
3    2  NaN    2.0  right_only
"""

merge的parameter　“indicator”主要作用为显示出最终的left和right一起merge的结果，为left_only:这一index只有left有value,而right无value,both则都有，right_only和left_only相似。

利用index进行merge(left_index,right_index)，配合使用(left_on, right_on)


# define the indexes of left and right again
left = pd.DataFrame({'A': ['A0', 'A1', 'A2'],
                     'B': ['B0', 'B1', 'B2']},
                     index=['K0', 'K1', 'K2'])

right = pd.DataFrame({'C': ['C0', 'C2', 'C3'],
                      'D': ['D0', 'D2', 'D3']},
                     index=['K0', 'K2', 'K3'])
print(left)
print(right)
"""
     A   B
K0  A0  B0
K1  A1  B1
K2  A2  B2
     C   D
K0  C0  D0
K2  C2  D2
K3  C3  D3
"""
# classification of (left_index, right_index)
res = pd.merge(left, right, left_index=True, right_index=True, how='outer')
print res
"""
      A    B    C    D
K0   A0   B0   C0   D0
K1   A1   B1  NaN  NaN
K2   A2   B2   C2   D2
K3  NaN  NaN   C3   D3
"""
# classification of   (left_index, right_on)
res = pd.merge(left, right, left_index=True, how='outer', right_on='D')
print res
"""
      A    B    C   D
K3   A0   B0  NaN  K0
K3   A1   B1  NaN  K1
K3   A2   B2  NaN  K2
K0  NaN  NaN   C0  D0
K2  NaN  NaN   C2  D2
K3  NaN  NaN   C3  D3
"""

首先这里一定要掌握dataframe的column和index的区别否则容易晕
其实left_index和right_index就是和on参数意义一样只是指明使用left dataframe的index和right dataframe的index进行merge
index和column也可以一起merge on使用，例如代码中的left_index和right_on

对于重叠（overlapping）


boys = pd.DataFrame({'people': ['name1', 'name2', 'name3'], 'age': [1, 2, 3]})
girls = pd.DataFrame({'people': ['name1', 'name4', 'name5'], 'age': [4, 5, 6]})
print(boys)
print(girls)
"""
   age people
0    1  name1
1    2  name2
2    3  name3
   age people
0    4  name1
1    5  name4
2    6  name5
"""
res = pd.merge(boys, girls, on='people', suffixes=['boys', 'girls'], how='inner')
print(res)
"""
   ageboys people  agegirls
0        1  name1         4
"""

场景为：
统计男生的name和age，女生的name和age，名字的列都用的people，最后两个表格合并的时候，发现有两个重名的同学，所以不能看作一个，作为overlapping的问题解决方案是，
利用suffixes参数进行age的重命名为agegirls, ageboys.

WPF中的ComboBox控件几种数据绑定的方式互联网打工人no1 wpf c#
一、用字典给ItemsSource赋值（此绑定用的地方很多，建议熟练掌握）在XMAL中：在CS文件中privatevoidBindData(){DictionarydicItem=newDictionary();dicItem.add(1,"北京");dicItem.add(2,"上海");dicItem.add(3,"广州");cmb_list.ItemsSource=dicItem;cmb_l
将cmd中命令输出保存为txt文本文件落难Coder Windows cmd window
最近深度学习本地的训练中我们常常要在命令行中运行自己的代码，无可厚非，我们有必要保存我们的炼丹结果，但是复制命令行输出到txt是非常麻烦的，其实Windows下的命令行为我们提供了相应的操作。其基本的调用格式就是：运行指令>输出到的文件名称或者具体保存路径测试下，我打开cmd并且ping一下百度：pingwww.baidu.com>./data.txt看下相同目录下data.txt的输出：如果你再
Linux MariaDB使用OpenSSL安装SSL证书 Meta39 MySQL Oracle MariaDB Linux Windows ssl linux mariadb
进入到证书存放目录，批量删除.pem证书警告：确保已经进入到证书存放目录find.-typef-iname\*.pem-delete查看是否安装OpenSSLopensslversion没有则安装yuminstallopensslopenssl-devel开启SSL编辑/etc/my.cnf文件（没有的话就创建，但是要注意，在/etc/my.cnf.d/server.cnf配置了datadir的，
网络编程基础记得开心一点啊网络
目录♫什么是网络编程♫Socket套接字♪什么是Socket套接字♪数据报套接字♪流套接字♫数据报套接字通信模型♪数据报套接字通讯模型♪DatagramSocket♪DatagramPacket♪实现UDP的服务端代码♪实现UDP的客户端代码♫流套接字通信模型♪流套接字通讯模型♪ServerSocket♪Socket♪实现TCP的服务端代码♪实现TCP的客户端代码♫什么是网络编程网络编程，指网络上
K近邻算法_分类鸢尾花数据集 _feivirus_ 算法机器学习和数学分类机器学习 K近邻
importnumpyasnpimportpandasaspdfromsklearn.datasetsimportload_irisfromsklearn.model_selectionimporttrain_test_splitfromsklearn.metricsimportaccuracy_score1.数据预处理iris=load_iris()df=pd.DataFrame(data=ir
4.C_数据结构_队列荣世蓥数据结构数据结构
概述什么是队列：队列是限定在两端进行插入操作和删除操作的线性表。具有先入先出(FIFO)的特点相关名词：队尾：写入数据的一段队头：读取数据的一段空队：队列中没有数据，队头指针=队尾指针满队：队列中存满了数据，队尾指针+1=队头指针循环队列1、基本内容循环队列是以数组形式构成的队列数据结构。循环队列的结构体如下：typedefintdata_t;//队列数据类型#defineN64//队列容量typ
vue项目element-ui的table表格单元格合并酋长哈哈 vue.js elementui javascript 前端
一、合并效果二全部代码exportdefault{name:'CellMerge',data(){return{tableData:[{id:'1',name:'王小虎',amount1:'165',amount2:'3.2',amount3:10},{id:'1',name:'王小虎',amount1:'162',amount2:'4.43',amount3:12},{id:'1',name:'
python tif转png Python与遥感 python 开发语言
importosfromosgeoimportgdalimportnumpyasnpfromPILimportImage#提取432三波段fromspectralimport*#输入文件夹路径defget_img(dataset_img):width=dataset_img.RasterXSize#获取行列数height=dataset_img.RasterYSizebands=dataset_i
MongoDB知识概括 GeorgeLin98 持久层 mongodb
MongoDB知识概括MongoDB相关概念单机部署基本常用命令索引-IndexSpirngDataMongoDB集成副本集分片集群安全认证MongoDB相关概念业务应用场景：传统的关系型数据库（如MySQL），在数据操作的“三高”需求以及应对Web2.0的网站需求面前，显得力不从心。解释：“三高”需求：①Highperformance-对数据库高并发读写的需求。②HugeStorage-对海量数
Vue中table合并单元格用法 weixin_30613343 javascript ViewUI
地名结果人名性别{{item.name}}已完成未完成{{item.groups[0].name}}{{item.groups[0].sex}}{{item.groups[son].name}}{{item.groups[son].sex}}exportdefault{data(){return{list:[{name:'地名1',result:'1',groups:[{name:'张三',sex
uniapp map组件自定义markers标记点以对_ uni-app学习记录 uni-app javascript 前端
需求是根据后端返回数据在地图上显示标记点，并且根据数据状态控制标记点颜色，标记点背景通过两张图片实现控制{{item.options.labelName}}exportdefault{data(){return{storeIndex:0,locaInfo:{longitude:120.445172,latitude:36.111387},markers:[//标点列表{id:1,//标记点idin
博客网站制作教程 2401_85194651 java maven
首先就是技术框架：后端：Java+SpringBoot数据库：MySQL前端：Vue.js数据库连接：JPA(JavaPersistenceAPI)1.项目结构blog-app/├──backend/│├──src/main/java/com/example/blogapp/││├──BlogApplication.java││├──config/│││└──DatabaseConfig.java
vue + Element UI table动态合并单元格我家媳妇儿萌哒哒 element UI vue.js 前端 javascript
一、功能需求1、根据名称相同的合并工作阶段和主要任务合并这两列，但主要任务内容一样，但要考虑主要任务一样，但工作阶段不一样的情况。（枞向合并）2、落实情况里的定量内容和定性内容值一样则合并。（横向合并）二、功能实现exportdefault{data(){return{tableData:[{name:'a',address:'1',age:'1',six:'2'},{name:'a',addre
Python实现TIFF 文件转换为 PNG 和 JPG 格式 sand&wich python 开发语言
在日常的图像处理工作中，可能会遇到需要将TIFF格式的图像转换为其他格式的情况，例如PNG和JPG。下面，本文将介绍如何使用Python和GDAL库实现这一功能。准备工作在开始之前，请确保已经安装了必要的库：GDAL（GeospatialDataAbstractionLibrary）可以使用以下命令安装GDAL：pipinstallgdal代码实现以下是一个将TIFF文件转换为PNG文件的示例代码
使用datepicker和uploadify的冲突解决（IE双击才能打开附件上传对话框） zhanglb12
在开发的过程当中，IE的兼容无疑是我们的一块绊脚石，在我们使用的如期的datepicker插件和使用上传附件的uploadify插件的时候，两者就产生冲突，只要点击过时间的插件，uploadify上传框要双才能打开ie浏览器提示错误Missinginstancedataforthisdatepicker解决方案//if(.browser.msie&&'9.0'===.browser.version
golang获取用户输入的几种方式余生逆风飞翔 golang 开发语言后端
一、定义结构体typeUserInfostruct{Namestring`json:"name"`Ageint`json:"age"`Addstring`json:"add"`}typeReturnDatastruct{Messagestring`json:"message"`Statusstring`json:"status"`DataUserInfo`json:"data"`}二、get请求的
【Java】已解决：org.springframework.jdbc.datasource.lookup.DataSourceLookupFailureException 屿小夏 java 开发语言
文章目录一、分析问题背景问题背景描述出现问题的场景二、可能出错的原因三、错误代码示例四、正确代码示例五、注意事项已解决：org.springframework.jdbc.datasource.lookup.DataSourceLookupFailureException在使用Spring框架进行开发时，数据源的配置和使用是非常关键的一环。然而，有时候我们可能会遇到org.springframewo
el-table实现全选整表，单元一页复选框功能周bro vue.js elementui javascript 前端
全选整表单选一页0":popper-append-to-body="false":total="tableData.length":page-size="pageObj.pagesize":page-sizes="[10,50,100]"layout="total,sizes,prev,pager,next"@size-change="handleSizeChange"@current-chang
Vue + Express实现一个表单提交九旬大爷的梦
最近在折腾一个cms系统，用的vue+express，但是就一个表单提交就弄了好久，记录一下。环境：Node10+前端：Vue服务端：Express依赖包：vueexpressaxiosexpress-formidableelement-ui（可选）前言：axiosget请求参数是：paramsaxiospost请求参数是：dataexpressget接受参数是req.queryexpresspo
Kubernetes部署MySQL数据持久化沫殇-MS Kubernetes MySQL数据库 kubernetes mysql 容器
一、安装配置NFS服务端1、安装nfs-kernel-server：sudoapt-yinstallnfs-kernel-server2、服务端创建共享目录#列出所有可用块设备的信息lsblk#格式化磁盘sudomkfs-text4/dev/sdb#创建一个目录：sudomkdir-p/data/nfs/mysql#更改目录权限：sudochown-Rnobody:nogroup/data/nfs
Hadoop架构 henan程序媛 hadoop 大数据分布式
一、案列分析1.1案例概述现在已经进入了大数据(BigData)时代，数以万计用户的互联网服务时时刻刻都在产生大量的交互，要处理的数据量实在是太大了，以传统的数据库技术等其他手段根本无法应对数据处理的实时性、有效性的需求。HDFS顺应时代出现，在解决大数据存储和计算方面有很多的优势。1.2案列前置知识点1.什么是大数据大数据是指无法在一定时间范围内用常规软件工具进行捕捉、管理和处理的大量数据集合，
使用input[type=file]遇上的一些问题刘圣凯
项目遇到一个需要，如下image.png功能大致就是添加图片，展示出来，然后在用户点击提交的时候把图片传给后台，在和后台交涉之后，决定在用户选择图片之后转成formdata传给后台，后台返回一个url，提交的时候将url返回给后台/**转formdata*/varformdata=newFormData();formdata.append("file1",$("#pic")[0].files[0]
详解mybatis的一二级缓存以及缓存失效原因仰望天花板缓存数据库 mybatis java mysql
数据库的大部分场景下是从磁盘读取，如果数据从内存进行读取，速度较比磁盘要快得多。但因为内存的容量有限，所以一般只会把使用和查询较多的数据缓存起来，以便快速反应，其他使用率不太多的继续存放在磁盘。mybatis分为一级缓存和二级缓存1.一级缓存一级缓存存放在SqlSqeeion上，默认开启1.1pojo@DatapublicclassRole{privateLongid;privateStringr
小程序通过js控制页面字体颜色属性祈澈菇凉
需求：当电量少于百分之20的时候，显示电量的字体显示为红色。1：在wxml里面设置属性batStyle：style="{{item.batStyle}}"电量:{{item.battery}}%2：当复合逻辑条件的时候，在js里面carList[i].batStyle="color:red";success:function(res){constcarList=res.data.list;for(
Golang Channel PandaSkr golang
Channel解析1.Channel源码分析1.1Channel数据结构typehchanstruct{qcountuint//channel的元素数量dataqsizuint//channel循环队列长度bufunsafe.Pointer//指向循环队列的指针elemsizeuint16//元素大小closeduint32//channel是否关闭0-未关闭elemtype*_type//元素类
matlab游标标注移动,matlab实现图形窗口的数据游标莫白想 matlab游标标注移动
DatacursorsforfigurewindowSeveralrelatedfunctions:CreateCursorsetsupaverticalcursoronallaxesinafigure.Thecursorscanbemovedaroundusingthemouse.MultiplecursorsaresupportedineachfigureGetCursorLocationre
使用FPGA接收MIPI CSI RX信号并进行去抖动、RGB转YUV处理：FX3014 USB3.0 UVC传输与帧率控制源代码，FPGA实现MIPI CSI RX接收，去Debayer， RGB转 kVfINoSzdrt fpga开发程序人生
fpgamipicsirx接收去debayer,rgb转yuv,fx3014usb3.0uvc传输与帧率控制源代码，具体架构看图，除dphy物理层外，mipi均为源码sensorimx219mipi源码mipi4lanecsirxraw10fpgamachXO3lf-690usb3.0fx301432bityuvdatawithframesync测试模式3280*246415fps1920*108
数据结构 1 五花肉村长数据结构算法开发语言 c语言 visualstudio
1.什么是数据结构数据结构（DataStructure）是计算机存储和组织数据的方式，是指相互之间存在的一种或多种特定关系的数据元的集合。2.什么是算法算法（Algorithm）就是定义良好的计算过程，他取一个或一组的值为输入，并产生出一个或一组值作为输出。简单来说算法就是一系列的计算步骤，用来将输入数据转化成输出结果。3.数据结构和算法的书籍资料学习完数据结构知识，可以去看《剑指offer》和《
好看的vue登录页面(附源代码背景图) 小小薛定谔 vue.js javascript css 前端
一、效果展示二、代码你好!欢迎回来登录忘记密码?注册exportdefault{name:"MedLogin",data(){return{confirm_disabled:false,loginForm:{no:'',password:''},rules:{no:[{required:true,message:'请输入账号',trigger:'blur'},{min:3,max:6,messag
python的request请求401_Python模拟HTTPS请求返回HTTP 401 unauthorized错误 weixin_39599372
Python模拟HTTPS请求返回HTTP401unauthorized错误开始是使用的httplib模块，代码如下：header={"Content-type":"application/json","Accept":"*/*"}params={‘source‘:‘en‘,‘target‘:‘es‘,‘text‘:match.group(1)}data=urllib.urlencode(para
java工厂模式 3213213333332132 java 抽象工厂
工厂模式有 1、工厂方法 2、抽象工厂方法。下面我的实现是抽象工厂方法, 给所有具体的产品类定一个通用的接口。 package 工厂模式; /** * 航天飞行接口 * * @Description * @author FuJianyong * 2015-7-14下午02:42:05 */ public interface SpaceF
nginx频率限制+python测试 ronin47 nginx 频率 python
部分内容参考：http://www.abc3210.com/2013/web_04/82.shtml 首先说一下遇到这个问题是因为网站被攻击，阿里云报警，想到要限制一下访问频率，而不是限制ip（限制ip的方案稍后给出）。nginx连接资源被吃空返回状态码是502，添加本方案限制后返回599，与正常状态码区别开。步骤如下：
java线程和线程池的使用 dyy_gusi ThreadPool thread Runnable timer
java线程和线程池一、创建多线程的方式 java多线程很常见，如何使用多线程，如何创建线程，java中有两种方式，第一种是让自己的类实现Runnable接口，第二种是让自己的类继承Thread类。其实Thread类自己也是实现了Runnable接口。具体使用实例如下： 1、通过实现Runnable接口方式 1 2
Linux 171815164 linux
ubuntu kernel http://kernel.ubuntu.com/~kernel-ppa/mainline/v4.1.2-unstable/ 安卓sdk代理 mirrors.neusoft.edu.cn 80 输入法和jdk sudo apt-get install fcitx su
Tomcat JDBC Connection Pool g21121 Connection
Tomcat7 抛弃了以往的DBCP 采用了新的Tomcat Jdbc Pool 作为数据库连接组件，事实上DBCP已经被Hibernate 所抛弃，因为他存在很多问题，诸如：更新缓慢，bug较多，编译问题，代码复杂等等。 Tomcat Jdbc P
敲代码的一点想法永夜-极光 java 随笔感想
入门学习java编程已经半年了,一路敲代码下来,现在也才1w+行代码量,也就菜鸟水准吧,但是在整个学习过程中,我一直在想,为什么很多培训老师,网上的文章都是要我们背一些代码?比如学习Arraylist的时候,教师就让我们先参考源代码写一遍,然
jvm指令集程序员是怎么炼成的 jvm 指令集
转自：http://blog.csdn.net/hudashi/article/details/7062675#comments 将值推送至栈顶时 const ldc push load指令 const系列该系列命令主要负责把简单的数值类型送到栈顶。(从常量池或者局部变量push到栈顶时均使用) 0x02 &nbs
Oracle字符集的查看查询和Oracle字符集的设置修改 aijuans oracle
本文主要讨论以下几个部分：如何查看查询oracle字符集、修改设置字符集以及常见的oracle utf8字符集和oracle exp 字符集问题。一、什么是Oracle字符集 Oracle字符集是一个字节数据的解释的符号集合,有大小之分,有相互的包容关系。ORACLE 支持国家语言的体系结构允许你使用本地化语言来存储，处理，检索数据。它使数据库工具，错误消息，排序次序，日期，时间，货
png在Ie6下透明度处理方法 antonyup_2006 css 浏览器 Firebug IE
由于之前到深圳现场支撑上线，当时为了解决个控件下载，我机器上的IE8老报个错，不得以把ie8卸载掉，换个Ie6,问题解决了，今天出差回来，用ie6登入另一个正在开发的系统，遇到了Png图片的问题，当然升级到ie8(ie8自带的开发人员工具调试前端页面JS之类的还是比较方便的，和FireBug一样，呵呵)，这个问题就解决了，但稍微做了下这个问题的处理。我们知道PNG是图像文件存储格式，查询资
表查询常用命令高级查询方法(二) 百合不是茶 oracle 分页查询分组查询联合查询
----------------------------------------------------分组查询 group by having --平均工资和最高工资 select avg(sal)平均工资,max(sal) from emp ; --每个部门的平均工资和最高工资
uploadify3.1版本参数使用详解 bijian1013 JavaScript uploadify3.1
使用：绑定的界面元素<input id='gallery'type='file'/>$("#gallery").uploadify({设置参数，参数如下}); 设置的属性： id: jQuery(this).attr('id'),//绑定的input的ID langFile: 'http://ww
精通Oracle10编程SQL(17)使用ORACLE系统包 bijian1013 oracle 数据库 plsql
/* *使用ORACLE系统包 */ --1.DBMS_OUTPUT --ENABLE:用于激活过程PUT,PUT_LINE,NEW_LINE,GET_LINE和GET_LINES的调用 --语法：DBMS_OUTPUT.enable(buffer_size in integer default 20000); --DISABLE:用于禁止对过程PUT,PUT_LINE,NEW
【JVM一】JVM垃圾回收日志 bit1129 垃圾回收
将JVM垃圾回收的日志记录下来，对于分析垃圾回收的运行状态，进而调整内存分配(年轻代，老年代，永久代的内存分配)等是很有意义的。JVM与垃圾回收日志相关的参数包括： -XX:+PrintGC -XX:+PrintGCDetails -XX:+PrintGCTimeStamps -XX:+PrintGCDateStamps -Xloggc -XX:+PrintGC 通
Toast使用白糖_ toast
Android中的Toast是一种简易的消息提示框，toast提示框不能被用户点击，toast会根据用户设置的显示时间后自动消失。创建Toast 两个方法创建Toast makeText(Context context, int resId, int duration) 参数：context是toast显示在
angular.identity boyitech AngularJS AngularJS API
angular.identiy 描述: 返回它第一参数的函数. 此函数多用于函数是编程. 使用方法: angular.identity(value); 参数详解: Param Type Details value * to be returned. 返回值: 传入的value 实例代码: <!DOCTYPE HTML>
java-两整数相除，求循环节 bylijinnan java
import java.util.ArrayList; import java.util.List; public class CircleDigitsInDivision { /** * 题目：求循环节，若整除则返回NULL，否则返回char*指向循环节。先写思路。函数原型：char*get_circle_digits(unsigned k,unsigned j)
Java 日期周年 Chen.H java C++c C#
/** * java日期操作(月末、周末等的日期操作) * * @author * */ public class DateUtil { /** */ /** * 取得某天相加(减)後的那一天 * * @param date * @param num *
[高考与专业]欢迎广大高中毕业生加入自动控制与计算机应用专业 comsci 计算机
不知道现在的高校还设置这个宽口径专业没有,自动控制与计算机应用专业,我就是这个专业毕业的,这个专业的课程非常多,既要学习自动控制方面的课程,也要学习计算机专业的课程,对数学也要求比较高.....如果有这个专业,欢迎大家报考...毕业出来之后,就业的途径非常广..... 以后
分层查询（Hierarchical Queries） daizj oracle 递归查询层次查询
Hierarchical Queries If a table contains hierarchical data, then you can select rows in a hierarchical order using the hierarchical query clause: hierarchical_query_clause::= start with condi
数据迁移 daysinsun 数据迁移
最近公司在重构一个医疗系统，原来的系统是两个.Net系统，现需要重构到java中。数据库分别为SQL Server和Mysql，现需要将数据库统一为Hana数据库，发现了几个问题，但最后通过努力都解决了。 1、原本通过Hana的数据迁移工具把数据是可以迁移过去的，在MySQl里面的字段为TEXT类型的到Hana里面就存储不了了，最后不得不更改为clob。 2、在数据插入的时候有些字段特别长
C语言学习二进制的表示示例 dcj3sjt126com c basic
进制的表示示例 # include <stdio.h> int main(void) { int i = 0x32C; printf("i = %d\n", i); /* printf的用法 %d表示以十进制输出 %x或%X表示以十六进制的输出 %o表示以八进制输出 */ return 0; }
NsTimer 和 UITableViewCell 之间的控制 dcj3sjt126com ios
情况是这样的: 一个UITableView, 每个Cell的内容是我自定义的 viewA viewA上面有很多的动画, 我需要添加NSTimer来做动画, 由于TableView的复用机制, 我添加的动画会不断开启, 没有停止, 动画会执行越来越多. 解决办法: 在配置cell的时候开始动画, 然后在cell结束显示的时候停止动画查找cell结束显示的代理
MySql中case when then 的使用 fanxiaolong casewhenthenend
select "主键", "项目编号", "项目名称","项目创建时间", "项目状态","部门名称","创建人" union (select pp.id as "主键", pp.project_number as &
Ehcache（01）——简介、基本操作 234390216 cache ehcache 简介 CacheManager crud
Ehcache简介目录 1 CacheManager 1.1 构造方法构建 1.2 静态方法构建 2 Cache 2.1&
最容易懂的javascript闭包学习入门 jackyrong JavaScript
http://www.ruanyifeng.com/blog/2009/08/learning_javascript_closures.html 闭包（closure）是Javascript语言的一个难点，也是它的特色，很多高级应用都要依靠闭包实现。下面就是我的学习笔记，对于Javascript初学者应该是很有用的。一、变量的作用域要理解闭包，首先必须理解Javascript特殊
提升网站转化率的四步优化方案 php教程分享数据结构 PHP 数据挖掘 Google 活动
网站开发完成后,我们在进行网站优化最关键的问题就是如何提高整体的转化率，这也是营销策略里最最重要的方面之一，并且也是网站综合运营实例的结果。文中分享了四大优化策略：调查、研究、优化、评估，这四大策略可以很好地帮助用户设计出高效的优化方案。 PHP开发的网站优化一个网站最关键和棘手的是，如何提高整体的转化率，这是任何营销策略里最重要的方面之一，而提升网站转化率是网站综合运营实力的结果。今天，我就分
web开发里什么是HTML5的WebSocket？ naruto1990 Web html5 浏览器 socket
当前火起来的HTML5语言里面，很多学者们都还没有完全了解这语言的效果情况，我最喜欢的Web开发技术就是正迅速变得流行的 WebSocket API。WebSocket 提供了一个受欢迎的技术，以替代我们过去几年一直在用的Ajax技术。这个新的API提供了一个方法，从客户端使用简单的语法有效地推动消息到服务器。让我们看一看6个HTML5教程介绍里的 WebSocket API：它可用于客户端、服
Socket初步编程——简单实现群聊 Everyday都不同 socket 网络编程初步认识
初次接触到socket网络编程，也参考了网络上众前辈的文章。尝试自己也写了一下，记录下过程吧：服务端：（接收客户端消息并把它们打印出来） public class SocketServer { private List<Socket> socketList = new ArrayList<Socket>(); public s
面试：Hashtable与HashMap的区别（结合线程） toknowme
昨天去了某钱公司面试，面试过程中被问道 Hashtable与HashMap的区别？当时就是回答了一点，Hashtable是线程安全的，HashMap是线程不安全的，说白了，就是Hashtable是的同步的，HashMap不是同步的，需要额外的处理一下。今天就动手写了一个例子，直接看代码吧 package com.learn.lesson001; import java
MVC设计模式的总结 xp9802 设计模式 mvc 框架 IOC
随着Web应用的商业逻辑包含逐渐复杂的公式分析计算、决策支持等，使客户机越来越不堪重负，因此将系统的商业分离出来。单独形成一部分，这样三层结构产生了。其中‘层’是逻辑上的划分。三层体系结构是将整个系统划分为如图2.1所示的结构[3] （1）表现层（Presentation layer）：包含表示代码、用户交互GUI、数据验证。该层用于向客户端用户提供GUI交互，它允许用户

【Data Mining】机器学习三剑客之Pandas常用算法总结下

前言

设置值

处理缺省值

合并concat

①

②

合并append

合并merge

1. on对应的column中的value完全相同，并且只针对一个column

2. on针对多个column,并且对应的column中的value不相同

3.indicator

利用index进行merge(left_index,right_index)，配合使用(left_on, right_on)

对于重叠（overlapping）

你可能感兴趣的:(Data,mining,数据挖掘学习笔记)