Pistachiout

机器学习（Dog vs Cat）猫狗大战

# 一．模型介绍：

1.CNN模型的基本结构

CNN(Convolutional Neural Networks)即卷积神经网络，是一种神经网络，其基本运算方式为卷积。一个简单的CNN由输入层，卷积层，池化层，全连接层组成。

输入层(Input)：计算机可理解为若干个矩阵。输入的图像数据，以矩阵形式的数据存在，如果输入一张尺寸为(H, W)的彩色图像，则输入层的数据为一个(H×W×3)的矩阵，数值范围为[0, 255]，其中，3表示RGB三个通道，一般称作该输入层为3通道，或者说包含3个feature map，如果是灰度图像，则数据表示为(H×W×1)，1个通道或者1个feature map。
卷积层(Conv)：其实就是对输出的图像的不同局部的矩阵和卷积核矩阵各个位置的元素相乘，然后相加得到。CNN基本运算，这是CNN特有的，由卷积核对输入层图像进行卷积操作以提取图像特征，1个卷积核生成1个通道，即卷积输出的图像通道数与卷积核的个数一致，卷积核的尺寸为(S×S×C×N)，其中C表示卷积核深度，必须与输入层图像的通道数一致，即如果输入图像是3通道，则C为3，如果是1通道，则C为1。在上图Conv2中，因为其输入图像的通道数为12，所以Conv2的卷积核深度为12，N表示卷积核的数量。
池化层(pooling)：就是对输入张量的各个子矩阵进行压缩，主要用于图像下采样，降低图像分辨率(对图像层的通道数没有影响)，减少区域内图像的特征数。常见的池化标准有2个，MAX或者是Average。即取对应区域的最大值或者平均值作为池化后的元素值。
全连接层(Fully connected)：全连接就是将输入的所有节点数据与输出的所有节点数据相连，其结构类似BP神经网络，在CNN中体现为将卷积图像映射至一个n维向量，通过设置多个全连接关系，起到从特征到分类的作用。

当然我们也可以灵活使用使用卷积层+卷积层，或者卷积层+卷积层+池化层的组合，这些在构建模型的时候没有限制。但是最常见的CNN都是若干卷积层+池化层的组合。

2.算法流程

图像的卷积就是让卷积核(卷积模板)在原图像上依次滑动，在两者重叠的区域中，把对应位置的像素值和卷积模板值相乘，最后累加求和得到新图像(卷积结果)中的一个像素值，卷积核每滑动一次获得一个新值，当完成原图像的全部遍历，便完成原图像的一次卷积。输入图像是32323（3是它的深度（即R、G、B），卷积层是一个553的filter(感受野)。在实际的运用过程中，通常会使用多层卷积层来得到更深层次的特征图。卷积层是通过一个可调参数的卷积核与上一层特征图进行滑动卷积运算，再加上一个偏置量得到一个净输出，然后调用激活函数得出卷积结果，通过对全图的滑动卷积运算输出新的特征图。
激活函数主要引入非线性特性，在卷积过程中，所有的运算都是线性运算和线性叠加，无论网络多复杂，输入输出关系都是线性关系，没有激活函数，网络就无法拟合非线性特性的输入输出关系，常用的激活函数有Sigmoid，Tanh，ReLU等。在CNN中，卷积核的每一次卷积在累加模板内各个位置的乘积后，将累加值输入激活函数，然后将输出值作为卷积结果。
池化层是将输入的特征图用nxn的窗口划分成多个不重叠的区域，然后对每个区域计算出最大值或者均值，使图像缩小了n倍，最后加上偏置量通过激活函数得到抽样数据。
全连接层则是通过提取的特征参数对原始图像进行分类，就是它把特征整合到一起，输出为一个值。图像经过多次卷积和池化后，通过全连层完成分类操作，设卷积后的图像尺寸为(h×w×c)，需分成n类，则全连层的作用为将[h×w×c]的矩阵转换成[n×1]的矩阵。传统的分类方法一般操作为图像预处理，ROI定位，目标定位，特征提取，SVM或BP分类，在基于CNN的分类方法中，可以把卷积和池化操作看作传统方法的图像预处理到特征提取过程，因此CNN的操作结果就是网络自主学习并提取了一个[h×w×c]大小的特征值，然后在全连接层中进行了n目标分类任务。常用的分类方法如下式yl=f(wlxl-1+bl)。式中xl-1为前一层的特征图，通过卷积核抽样提取出来的特征参数；wl为全连接层的权重系数；bl为l层的偏置量。
此外，CNN还有反向传播算法，学习的目的是获得对输入准确精炼的描述。影响输出结果的是每层的权重和偏置，因此为了达到目标，需要将输出误差层层传递回去，看每个参数对误差的影响，并因此调整参数。
通过损失函数计算输出层的δL
从倒数第二层开始，根据下面3种情况进行反向传播计算：
如果当前是全连接层，则有δl =（Wl+1）Tδl+1⊙ σ’（zl）
如果上层是卷积层，则有δl =δl +1*rot180(Wl+1)⊙σ’（zl）
如果上层是池化层，则有δl=upsample(δl +1)

3.CNN模型优势

由于CNN（卷积神经网络）是计算机视觉领域非常有效的模型，因此采用CNN模型。CNN之所以比其他模型更适合解决图像问题，因为每一张图像本质都是一个矩阵，而CNN的扫描窗口也是一个小矩形，这样不仅仅可以利用当前像素点，还能利用当前像素点和周围像素点的关系。
CNN模型能最大的利用图像的局部信息，图像中有固有的局部模式（比如轮廓、边界，人的眼睛、鼻子、嘴等）可以利用，显然应该将图像处理中的概念和神经网络技术相结合，对于CNN来说，并不是所有上下层神经元都能直接相连，而是通过“卷积核”作为中介。同一个卷积核在所有图像内是共享的，图像通过卷积操作后仍然保留原先的位置关系。一个典型的卷积神经网络结构，到最后一层实际上是一个全连接层，输入层到隐含层的参数个数瞬间降低到了，这使得我们能够用已有的训练数据得到良好的模型，不用担心参数膨胀，不易导致过度拟合和局部最优解问题的出现，适用于图像识别。
CNN模型有许多优势，比如
1.共享卷积核
2.对高维数据处理无压力。
3.图像通过卷积操作后仍然保留原先的位置关系
4.可以自动进行特征提取等。

4.选择训练模型

本实验中刚开始自己讲CNN模型设计为3个3个卷积——最大池化层，一个mixed层，2个全连接层和输出层组成，但在训练后处理数据结果不是很好，出现了过拟合，之后在网上查找到资料，选择了使用Keras进行迁移学习，而Keras中可以导入的模型有Xception，VGG16，VGG19，ResNet50，InceptionV3，InceptionResNet -V2，MobileNet，最后选用迁移学习的基础模型为Xception，InceptionV3和ResNet50。Xception，InceptionV3和ResNet50这三个模型对于输入数据都有各自的默认值，比如在输入图片大小维度上，Xception和InceptionV3默认输入图片大小是299299，ResNet50默认输入图片大小是224224；在输入数值维度上，Xception和InceptionV3默认输入数值在(-1, 1)范围内。当要输入与默认图片大小不同的图片时，只需传入当前图片大小即可。ResNet50需要对图片进行中心化处理，由于载入的ResNet50模型是在ImageNet数据上训练出来的，所以在预处理中每个像素点都要减去ImageNet均值。

- 二、模型实现

1.数据处理的方法

首先第一步是异常数据清理：我根据网上的资料，得知该数据集有一些非猫或狗的图像，这些图片属于离群数据，可能会影响模型精度，需要移除，其中包括资料给出的cat.4688.jpg，cat.5418.jpg，cat.7377.jpg，cat.7564.jpg，cat.8100.jpg，cat.8456.jpg，cat.10029.jpg，cat.12272.jpg，dog.1259.jpg，dog.1895.jpg，dog.4367.jpg，dog.8736.jpg，dog.9517.jpg，dog.10190.jpg，dog.11299.jpg和我无意中发现的dog.10797.jpg，将这些图片删除后训练集中猫狗都为12492张照片。
之后要进行训练集划分验证集以便模型训练时在验证集上观察评估指标是否达到要求，于是将24984张图片的训练集分割为TRAIN_NUM=11492张图片的训练集和VALIDATION_NUM=1000张图片的验证集，使用np.random.permutation()函数即可，该函数可以返回被打乱的下标。
数据预处理完成，接下来开始准备读取数据，我们知道训练数据集的图片标签包含在图片的名字中，比如cat.1000.jpg，表示该图片标签为cat，在所有的猫图片中是第1000个，所以想要载入图片的话，先要把图片的路径读取出来。先利用os.listdir读取所有训练数据集train_images_all[]和测试集test_images_filepaths[]，之后从训练数据集中选出标签为dog的train_images_dog和标签为cat的train_images_dog。
接着定义一个载入图片并统一尺寸的函数read_image(file_path)。为了不改变图片中物体的尺寸，首先将图片的长边按照某个比例缩小或者扩大到150，然后对图片的短边进行相同比例的缩放，如果图片不为正方形，那么使用黑色像素点将其填充为150*150的正方形图片。
最后将处理后的图片数据保存为TFRecord文件，这样做有诸多好处，图片数据被保存为TFRecord文件后，就是一个Check Point，之后的模型训练可以直接载入TFRecord文件，不需要再对图片的进行预处理；图片数据可以被保存为多个TFRecord文件，使用的时候可以一个一个batch载入（可以乱序载入），只载入训练需要的数据，可以减少内存的使用。我们将训练集分成若干个文件保存，每个文件中保存1024个图片；验证集和测试集保存为一个文件，同时打印信息看到保存文件的进度。

2.模型实现的过程

在本例的CNN模型实现时，将卷积池化层，展开层，全连接层和输出层分别写成函数conv2d_maxpool，flatten，fully_conn，output，然后将整个神经网络的计算过程包装为一个函数，最后本例中CNN模型设计为3个3个卷积——最大池化层，一个mixed层，2个全连接层和输出层组成。
然后定义输入，输出，损失函数，优化方式和使用sigmoid将结果转化为概率。使用队列从文件中读取训练集，每次读取batch_size=500张图片。每训练5个batch，从batch中随机抽取20个数据计算loss和accuracy，从验证集中随机抽取80个数据计算loss和accuracy，以便实时观察模型在训练集和验证集上的分类效果。
之后选用迁移学习的基础模型为Xception，InceptionV3和ResNet50进行迁移学习，首先在网上下载Xception，InceptionV3和ResNet50导出的特征向量，
载入预处理的数据之后，先进行一次概率为0.5的dropout，然后直接连接输出层，激活函数为Sigmoid，优化器为Adam，输出一个零维张量，表示某张图片中有狗的概率，分割训练集和验证集，并构建模型，使用处理过的训练集数据进行模型训练，处理过的验证集数据检测模型的分类效果。

3.模型实现细节

为了防止过拟合，本项目进行了Dropout处理。Dropout的一种主流解释是进行Dropout后，网络会变得稀疏，最后对测试集进行分类时，相当于多个稀疏网络一起决定结果。
由于最后提交的结果表示图片为狗的概率，因此输出层使用Sigmoid函数处理一下（Sigmoid函数的值域是[0, 1]，常常用其输出表示概率）。
当一个完整的数据集通过了神经网络一次并且返回了一次，这个过程称为一个 epoch。在神经网络中传递完整的数据集一次是不够的，我们需要将完整的数据集在同样的神经网络中传递多次。随着 epoch 数量增加，神经网络中的权重的更新次数也增加，曲线从欠拟合变得过拟合。
学习速率是一个超参数，设置过小会导致收敛较慢，设置过大会导致准确率和loss振荡较大难以收敛。学习速率在0.01时，准确率和loss振幅和振荡频率都比较大，从0.01调整至到0.001后，准确率和loss振荡幅度和频率有明显降低，模型更加稳健，所以在尝试的两个学习速率中，学习速率为0.001时，模型得到最优分数是合理的。
对于自己建立的cnn模型，累计训练了20个epochs之后，最后15个batch，训练batch抽样loss平均值是0.0691，accuracy平均值是98.33%，验证集抽样loss平均值是0.4458，accuracy平均是82.50%。
而当利用Xception，InceptionV3和ResNet50进行迁移学习时，结果则是一共训练了5个epochs，在第1个epoch的第1个batch训练后，训练集loss为0.6375，验证集loss为0.6346，到最后一个batch，训练集loss为0.0188，验证集loss为 0.0180。

三、实验结果分析

一开始通过自己定义的模型进行训练batch抽样loss平均值是0.0691，accuracy平均值是98.33%，验证集抽样loss平均值是0.4458，accuracy平均是82.50%，过拟合典型的表现为训练集损失远远小于验证集损失,从以上的数据中我们知道CNN模型过拟合。
而当我们之后使用Xception，InceptionV3和ResNet50这三个模型进行迁移学习，验证集loss是0.0108，测试集loss是0.04472。
这是因为我们自定义的卷积神经网络只有14层，而Xception有126层，InceptionV3有159层，ResNet50有168层，更多的层数，不同的卷积核各种各样的的组合，就可以更好的抽取图片中的泛化特征，这样既可以提高分类的准确率，又可以降低模型的过拟合风险Xception，InceptionV3和ResNet50这三个模型如果不进行组合直接进行迁移学习的话，效果肯定也比先前自己搭建的神经网络效果好，但是一般情况下，组合比不组合强，所以就直接进行组合了。这里利用了bagging的思想，通过多个模型处理数据并进行组合，可以有效降低模型的方差，减少过拟合程度，提高分类准确率。
想提高准确率，可以尝试不同的网络架构，改变epoch-size和epoch次数，改变学习率。本例中在模型后还使用numpy.clip()函数做一个截断处理，将所有图片的概率值限制在[0.005, 0.995]之间，将每个预测值限制到了 [0.005, 0.995] 个区间内，这样可以稍微降低loss。

- 四、学习心得及建议

在本次的猫狗大战实验中，我查阅了许多网上的猫狗大战的资料，也利用多种模型代码进行实验，也利用BAIDU AI Studio进行尝试，利用这些代码建立的CNN模型训练效果不是很好，而且最后输出的值也有很大悬殊，于是最后利用了Xception，InceptionV3和ResNet50三个结合模型来进行训练。
通过这次猫狗大战的实验，我对CNN模型理解更加深刻。
首先，我理解了输入层，卷积层，池化层，全连接层等的意义与作用，接着对于CNN模型的算法流程有了一些了解，例如CNN模型的正向传播算法流程和反向传播算法流程，还有CNN模型相对其他神经网络模型在图像领域的优势，还有认识了Xception，InceptionV3和ResNet50模型。
而对于模型的实现过程，我知道了如何利用os.listdir读取大量一定命名格式的图片，如何对大量数据划分训练集和验证集，如何自己定义的函数read_image(file_path)来将读入的图片统一尺寸，对于要进行多次训练的数据集可以将图片保存为多个TFRecord文件，便于每次读取数据，之后对数据进行训练时也更加理解了多次epoch训练的意义。
而对于最后结果的处理，我也认识到了dropou处理，Sigmoid函数处理，学习速率与epoch的影响，又如利用umpy.clip()函数做一个截断处理，将所有图片的概率值限制在[0.005, 0.995]之间从而降低logloss值的处理。
经过本次实验，我体会到了利用深度学习来进行分类处理的快乐，当看到训练结果输出时会有一种愉快感，因此希望如果有一些其他有趣的这种机器学习的题目，老师可以分享给我们，让我们更加深入的了解各种类型的深度学习知识与模型。

import matplotlib.pyplot as plt
import numpy as np
import os, cv2, math
import tensorflow as tf
from IPython.display import display, Image, HTML

TRAIN_DIR = 'C:/Users/HF/Desktop/machineLearning/cat vs dog data/train/'
TEST_DIR = 'C:/Users/HF/Desktop/machineLearning/cat vs dog data/test/'
IMAGE_SIZE = 150
CHANNELS = 3
PIXEL_DEPTH = 255.0  # 像素最大值
TRAIN_DATA_NUM = 11492 # 狗和猫各自的训练图片数量
VALIDATION_DATA_NUM = 1000 # 狗和猫各自的验证图片数量
TRAIN_NUM = TRAIN_DATA_NUM * 2 # 训练集的图片数量，不包含验证集
VALIDATION_NUM = VALIDATION_DATA_NUM * 2 # 验证集的图片数量
TEST_NUM = 12500 # 测试集数量

# 训练集 + 验证集
train_images_all = [TRAIN_DIR + i for i in os.listdir(TRAIN_DIR)]
train_images_dog = [i for i in train_images_all if 'dog' in i]
train_images_cat = [i for i in train_images_all if 'cat' in i]
train_images_filepaths = train_images_dog + train_images_cat
train_images_labels = np.array([1] * (TRAIN_DATA_NUM + VALIDATION_DATA_NUM) \
                               + [0] * (TRAIN_DATA_NUM + VALIDATION_DATA_NUM)) # 1表示dog，0表示cat
# 测试集
test_images_filepaths = [TEST_DIR + i for i in os.listdir(TEST_DIR)]

def read_image(file_path):
    img = cv2.imread(file_path, cv2.IMREAD_COLOR)
    if img.shape[0] > img.shape[1]:
        img_size = (IMAGE_SIZE, int(round(float(img.shape[1] / img.shape[0]) * IMAGE_SIZE)))
    else:
        img_size = (int(round(float(img.shape[0] / img.shape[1]) * IMAGE_SIZE)), IMAGE_SIZE)
    
    # OpenCV的图像size都是先水平轴再垂直轴，和一个矩阵的shape刚好相反
    tmp_img = cv2.resize(img, (img_size[1], img_size[0]), interpolation=cv2.INTER_CUBIC)
    ret_img = cv2.copyMakeBorder(tmp_img, 0, IMAGE_SIZE-img_size[0], 0, IMAGE_SIZE-img_size[1], cv2.BORDER_CONSTANT, 0)
    
    return ret_img[:,:,::-1] # 转化为rgb格式

# 载入训练集 + 验证集
train_dataset = np.ndarray((TRAIN_NUM + VALIDATION_NUM , IMAGE_SIZE, IMAGE_SIZE, CHANNELS), dtype=np.uint8)
for i, image_path in enumerate(train_images_all):
    train_dataset[i] = read_image(image_path)
print("Train shape: {}".format(train_dataset.shape))

# 载入测试集
test_dataset = np.ndarray((TEST_NUM, IMAGE_SIZE, IMAGE_SIZE, CHANNELS), dtype=np.uint8)
for i, image_path in enumerate(test_images_filepaths):
    test_dataset[i] = read_image(image_path)
print("Test shape: {}".format(test_dataset.shape))

%matplotlib inline
plt.imshow (train_dataset[0,:,:,:], interpolation='nearest')
plt.figure ()
plt.imshow (train_dataset[1,:,:,:], interpolation='nearest')
plt.figure ()
plt.imshow (train_dataset[2,:,:,:], interpolation='nearest')
plt.figure ()
plt.imshow (train_dataset[TRAIN_DATA_NUM + VALIDATION_DATA_NUM,:,:,:], interpolation='nearest')
plt.figure ()
plt.imshow (train_dataset[TRAIN_DATA_NUM + VALIDATION_DATA_NUM + 1,:,:,:], interpolation='nearest')
plt.figure ()
plt.imshow (train_dataset[TRAIN_DATA_NUM + VALIDATION_DATA_NUM + 2,:,:,:], interpolation='nearest')

np.random.seed(201712)
# 打乱训练集中的数据
def randomize(dataset, labels):
    permutation = np.random.permutation(labels.shape[0])
    shuffled_dataset = dataset[permutation,:,:,:]
    shuffled_labels = labels[permutation]
  
    return shuffled_dataset, shuffled_labels

train_dataset_rand, train_labels_rand = randomize(train_dataset, train_images_labels)
train = train_dataset_rand[:TRAIN_NUM,:,:,:]
train_labels = train_labels_rand[:TRAIN_NUM]
valid = train_dataset_rand[-VALIDATION_NUM:]
valid_labels = train_labels_rand[-VALIDATION_NUM:]
print('Train shape: ', train.shape, train_labels.shape)
print('Valid shape: ', valid.shape, valid_labels.shape)

#生成字符串型的属性
def _bytes_feature(value):
    return tf.train.Feature(bytes_list=tf.train.BytesList(value=[value]))


# 生成整数型的属性
def _int64_feature(value):
    return tf.train.Feature(int64_list=tf.train.Int64List(value=[value]))
    
    
# 把数据写到多个文件中
def save_multiple_tfrecords(images, labels, filename, instances_per_file):
    image_num = labels.shape[0]
    file_num = math.ceil(image_num / instances_per_file) # 计算需要写的文件总数
    
    # 遍历每一张图片
    write_num = instances_per_file
    cur_file_no = -1
    for i in range(image_num):
        # 如果一个文件的图片达到预定的数目，则创建新的文件继续写
        if write_num == instances_per_file:
            write_num = 0
            cur_file_no += 1
            write_filename = filename + '.tfrecords-%.4d-of-%.4d' % (cur_file_no, file_num)
            print('Writing ' + write_filename)
            writer = tf.compat.v1.python_io.TFRecordWriter(write_filename)
        # 写图片到文件
        image_bytes = images[i].tostring()
        example = tf.train.Example(
            features=tf.train.Features(
                feature={
                    'label': _int64_feature(labels[i]),
                    'image_raw': _bytes_feature(image_bytes)
            }))
        writer.write(example.SerializeToString())
        write_num += 1
              
    writer.close()
    print('Writing End.')


save_multiple_tfrecords(train, train_labels, 'C:/Users/HF/Desktop/machineLearning/cat vs dog data/data/train', 1024)
save_multiple_tfrecords(valid, valid_labels, 'C:/Users/HF/Desktop/machineLearning/cat vs dog data/data/vaild', VALIDATION_NUM)
save_multiple_tfrecords(test_dataset, np.array([0] * TEST_NUM), 'C:/Users/HF/Desktop/machineLearning/cat vs dog data/data/test', 12500)
# 卷积池化
def conv2d_maxpool(x_tensor, conv_depth, conv_ksize, conv_strides, pool_ksize, pool_strides):
    input_depth = x_tensor.shape[-1].value
    # 卷积
    conv_weights = tf.Variable(tf.truncated_normal([conv_ksize[0], conv_ksize[1], input_depth, conv_depth], stddev=0.05))
    conv_bias = tf.Variable(tf.zeros(conv_depth))
    conv = tf.nn.conv2d(x_tensor, conv_weights, strides=[1, conv_strides[0], conv_strides[1], 1], padding='SAME')
    conv_output = tf.nn.relu(tf.nn.bias_add(conv, conv_bias))
    # 池化
    pool_out = tf.nn.max_pool(conv_output, ksize=[1, pool_ksize[0], pool_ksize[1], 1],\
                             strides=[1, pool_strides[0], pool_strides[1], 1], padding='SAME')
    
    return pool_out


# 展开函数，全连接层的数据depth都是1
def flatten(x_tensor):
    nodes = np.prod(x_tensor.shape.as_list()[1:])
    x_reshape = tf.reshape(x_tensor, [-1, nodes])
    
    return x_reshape


# 全连接
def fully_conn(x_tensor, num_outputs):
    height = x_tensor.shape[1].value
    weights = tf.Variable(tf.truncated_normal([height, num_outputs], stddev=0.05))
    bias = tf.Variable(tf.zeros(num_outputs))
    fully_output = tf.nn.relu(tf.add(tf.matmul(x_tensor, weights), bias))
        
    return fully_output


# 输出
def output(x_tensor, num_outputs):
    height = x_tensor.shape[1].value
    weights = tf.Variable(tf.truncated_normal([height, num_outputs], stddev=0.05))
    bias = tf.Variable(tf.zeros(num_outputs))
    
return tf.add(tf.matmul(x_tensor, weights), bias)

def conv_net(x, keep_prob):
    # 3个卷积——最大池化层
    conv1 = conv2d_maxpool(x, conv_depth=64, conv_ksize=[2,2], conv_strides=[1,1], \
                           pool_ksize=[2,2], pool_strides=[1,1])
    conv2 = conv2d_maxpool(conv1, conv_depth=128, conv_ksize=[2,2], conv_strides=[2,2],\
                          pool_ksize=[3,3], pool_strides=[2,2])
    conv3 = conv2d_maxpool(conv2, conv_depth=256, conv_ksize=[4,4], conv_strides=[2,2],\
                          pool_ksize=[3,3], pool_strides=[2,2])
    # 第1个mixed层
    mixed1_branch0 = conv2d_maxpool(conv3, conv_depth=256, conv_ksize=[1,1], conv_strides=[1,1],\
                                   pool_ksize=[1,1], pool_strides=[1,1])
    mixed1_branch1 = conv2d_maxpool(conv3, conv_depth=512, conv_ksize=[3,3], conv_strides=[1,1],\
                                   pool_ksize=[2,2], pool_strides=[1,1])
    mixed1_branch2 = conv2d_maxpool(conv3, conv_depth=512, conv_ksize=[5,5], conv_strides=[1,1],\
                                   pool_ksize=[3,3], pool_strides=[1,1])
    mixed1 = tf.concat([mixed1_branch0, mixed1_branch1, mixed1_branch2], 3) # depth=1280
    
    
    # 2个全连接层，dropout
    flatten_x = flatten(mixed1)
    fully_conn1 = tf.nn.dropout(fully_conn(flatten_x, 640), keep_prob)
    fully_conn2 = tf.nn.dropout(fully_conn(fully_conn1, 320), keep_prob)
    
    # 输出层
    y = output(fully_conn2, 1)
    
    return y

# input
tf.compat.v1.disable_eager_execution()
x = tf.compat.v1.placeholder(tf.float32, shape=[None, IMAGE_SIZE, IMAGE_SIZE, 3], name='x')
y = tf.compat.v1.placeholder(tf.float32, shape=[None, 1], name='y')
keep_prob = tf.compat.v1.placeholder(tf.float32, name='keep_prob')

# model
logits = tf.nn.sigmoid(conv_net(x, keep_prob)) # 使用sigmoid将结果转化为概率
logits = tf.identity(logits, name='logits') # 加个名字方便持久化后载入

# loss and optimizer
loss = tf.losses.log_loss(y, logits)
optimizer = tf.train.AdamOptimizer().minimize(loss)

# Accuracy
equal = tf.equal(tf.where(tf.greater(logits, 0.5), tf.ones_like(logits), tf.zeros_like(logits)), y)
accuracy = tf.reduce_mean(tf.cast(equal, tf.float32), name='accuracy')

def pre_process_for_train(image):
    image_data = tf.cast(image, tf.float32)
    # 将所有的像素值转化到[-1,1]之间
    image_data = (image_data / PIXEL_DEPTH - 0.5) * 2
    
    return image_data

def print_status(session, feature_batch, label_batch, loss, accuracy, end='\n'):
    cur_loss = session.run(loss, feed_dict={x:feature_batch, y:label_batch, keep_prob:1})
    cur_acc = session.run(accuracy, feed_dict={x:feature_batch, y:label_batch, keep_prob:1})
    print('loss: {:>6,.4f}  acc: {:>6,.4f}'.format(cur_loss, cur_acc), end=end)

# 载入验证集
import tensorflow.compat.v1 as tf
tf.disable_v2_behavior()
filename = './data/valid.tfrecords-0000-of-0001'
filename_queue = tf.train.string_input_producer([filename]) #读入流中
reader = tf.TFRecordReader()
_, serialized_example = reader.read(filename_queue)  #返回文件名和文件
valid_features = tf.parse_single_example(
    serialized_example,
    features={
        'label': tf.FixedLenFeature([], tf.int64),
        'image_raw': tf.FixedLenFeature([], tf.string)
    })

# 把字节串编码成矩阵，并根据尺寸还原图像
image = tf.decode_raw(valid_features['image_raw'], tf.uint8)
image = tf.reshape(image, [IMAGE_SIZE, IMAGE_SIZE, CHANNELS])
label = valid_features['label']

# 处理图像
processed_image = pre_process_for_train(image)

with tf.Session() as sess:
    sess.run([tf.global_variables_initializer(), tf.local_variables_initializer()])
    coord=tf.train.Coordinator()
    threads= tf.train.start_queue_runners(coord=coord)
   
    valid = np.ndarray((VALIDATION_DATA_NUM*2, IMAGE_SIZE, IMAGE_SIZE, CHANNELS), dtype=np.float32)
    valid_label = np.ndarray((VALIDATION_DATA_NUM*2, 1), dtype=np.float32)
    for i in range(VALIDATION_DATA_NUM*2):
        # 处理图像
        valid[i], valid_label[i] = sess.run([processed_image, label])

    coord.request_stop()
    coord.join(threads)

import h5py, math
from keras.layers import Input, Lambda
from keras.applications import inception_v3, resnet50, xception

print(train_dataset_rand.shape, train_labels_rand.shape, test_dataset.shape) # 查看一下数据大小

def write_feature_vector(MODEL, pre_process):
    inputs = Input((IMAGE_SIZE, IMAGE_SIZE, 3))
    if pre_process:
        inputs = Lambda(pre_process)(inputs)
        
    model = MODEL(input_tensor=inputs, weights='imagenet', include_top=False, pooling='avg')
    train_vector = model.predict(train_dataset_rand)
    test_vector = model.predict(test_dataset)
    
    with h5py.File("./transfer_learning_data/vector_{}.h5".format(MODEL.__name__)) as h:
        h.create_dataset("train", data=train_vector)
        h.create_dataset("test", data=test_vector)
        h.create_dataset("train_label", data=train_labels_rand)
    print(MODEL.__name__ + " ok.")
    
write_feature_vector(inception_v3.InceptionV3, pre_process=inception_v3.preprocess_input)
write_feature_vector(xception.Xception, pre_process=xception.preprocess_input)
write_feature_vector(resnet50.ResNet50, pre_process=resnet50.preprocess_input)

from sklearn.model_selection import train_test_split

x_train2, x_valid, y_train2, y_valid = train_test_split(x_train, y_train, test_size=0.2, random_state=2017)

# 输出层
def output(x_tensor, num_outputs):
    height = x_tensor.shape[1].value
    weights = tf.Variable(tf.truncated_normal([height, num_outputs], stddev=0.05))
    bias = tf.Variable(tf.zeros(num_outputs))

    return tf.add(tf.matmul(x_tensor, weights), bias)

# 直接dropout，然后一个输出层
x = tf.placeholder(tf.float32, shape=[None, 6144], name='x')
y = tf.placeholder(tf.float32, shape=[None, 1], name='y')
keep_prob = tf.placeholder(tf.float32, name='keep_prob')

x = tf.nn.dropout(x, keep_prob)
logits = tf.nn.sigmoid(output(x, 1))
logits = tf.identity(logits, name='logits')


# loss and optimizer
loss = tf.losses.log_loss(y, logits)
optimizer = tf.train.AdamOptimizer().minimize(loss)



epochs = 5
batch_size = 512
keep_probability = 0.5
train_loss = []
valid_loss = []
   
def print_status(session, feature_batch, label_batch, loss, accuracy, end='\n', saved_list=None):
    cur_loss = session.run(loss, feed_dict={x:feature_batch, y:label_batch, keep_prob:1})
    cur_acc = session.run(accuracy, feed_dict={x:feature_batch, y:label_batch, keep_prob:1})
    if saved_list is not None:
        saved_list.append(cur_loss)
    print('loss: {:>6,.4f}  acc: {:>6,.4f} '.format(cur_loss, cur_acc), end=end)
    
with tf.Session() as sess:
    sess.run(tf.global_variables_initializer())
    
    for epoch in range(epochs):
        steps = math.ceil(y_train2.shape[0] / batch_size)
        for step in range(steps):
            offset = step * batch_size
            batch_features = x_train2[offset:(offset + batch_size), :]
            batch_labels = y_train2[offset:(offset + batch_size)]

            sess.run(optimizer, feed_dict={x:batch_features, y:batch_labels, keep_prob:keep_probability})
            if step % 5 == 0: # 每5步打印一次loss和acc
                print('Epoch {:>2}, Batch {:>2}:  '.format(epoch + 1, step), end='')
                print_status(sess, x_train2, y_train2, loss, accuracy, end='', saved_list=train_loss)
                print_status(sess, x_valid, y_valid, loss, accuracy, saved_list=valid_loss)
    
    # predict
    y_test = sess.run(logits, feed_dict={x:x_test, keep_prob:1})

# 截断降低logloss
label = np.clip(y_test, 0.005, 0.995)

df = pd.DataFrame(label, columns=['label'])
id = sorted([str(i+1) for i in range(12492)])
df['id'] = id

df.to_csv('myfile.csv', columns=['id', 'label'], index=None)

你可能感兴趣的:(#,python,卷积,神经网络,python)

理解Gunicorn：Python WSGI服务器的基石范范0825 ipython linux 运维
理解Gunicorn：PythonWSGI服务器的基石介绍Gunicorn，全称GreenUnicorn，是一个为PythonWSGI（WebServerGatewayInterface）应用设计的高效、轻量级HTTP服务器。作为PythonWeb应用部署的常用工具，Gunicorn以其高性能和易用性著称。本文将介绍Gunicorn的基本概念、安装和配置，帮助初学者快速上手。1.什么是Gunico
Python数据分析与可视化实战指南 William数据分析 python python 数据
在数据驱动的时代，Python因其简洁的语法、强大的库生态系统以及活跃的社区，成为了数据分析与可视化的首选语言。本文将通过一个详细的案例，带领大家学习如何使用Python进行数据分析，并通过可视化来直观呈现分析结果。一、环境准备1.1安装必要库在开始数据分析和可视化之前，我们需要安装一些常用的库。主要包括pandas、numpy、matplotlib和seaborn等。这些库分别用于数据处理、数学
python os.environ 江湖偌大 python 深度学习
os.environ['TF_CPP_MIN_LOG_LEVEL']='0'#默认值，输出所有信息os.environ['TF_CPP_MIN_LOG_LEVEL']='1'#屏蔽通知信息（INFO）os.environ['TF_CPP_MIN_LOG_LEVEL']='2'#屏蔽通知信息和警告信息（INFO\WARNING）os.environ['TF_CPP_MIN_LOG_LEVEL']='
Python中os.environ基本介绍及使用方法鹤冲天Pro #Python python 服务器开发语言
文章目录python中os.environos.environ简介os.environ进行环境变量的增删改查python中os.environ的使用详解1.简介2.key字段详解2.1常见key字段3.os.environ.get()用法4.环境变量的增删改查和判断是否存在4.1新增环境变量4.2更新环境变量4.3获取环境变量4.4删除环境变量4.5判断环境变量是否存在python中os.envi
Pyecharts数据可视化大屏：打造沉浸式数据分析体验我的运维人生信息可视化数据分析数据挖掘运维开发技术共享
Pyecharts数据可视化大屏：打造沉浸式数据分析体验在当今这个数据驱动的时代，如何将海量数据以直观、生动的方式展现出来，成为了数据分析师和企业决策者关注的焦点。Pyecharts，作为一款基于Python的开源数据可视化库，凭借其丰富的图表类型、灵活的配置选项以及高度的定制化能力，成为了构建数据可视化大屏的理想选择。本文将深入探讨如何利用Pyecharts打造数据可视化大屏，并通过实际代码案例
Python教程：一文了解使用Python处理XPath 旦莫 Python进阶 python 开发语言
目录1.环境准备1.1安装lxml1.2验证安装2.XPath基础2.1什么是XPath？2.2XPath语法2.3示例XML文档3.使用lxml解析XML3.1解析XML文档3.2查看解析结果4.XPath查询4.1基本路径查询4.2使用属性查询4.3查询多个节点5.XPath的高级用法5.1使用逻辑运算符5.2使用函数6.实战案例6.1从网页抓取数据6.1.1安装Requests库6.1.2代
python os.environ_python os.environ 读取和设置环境变量 weixin_39605414 python os.environ
>>>importos>>>os.environ.keys()['LC_NUMERIC','GOPATH','GOROOT','GOBIN','LESSOPEN','SSH_CLIENT','LOGNAME','USER','HOME','LC_PAPER','PATH','DISPLAY','LANG','TERM','SHELL','J2REDIR','LC_MONETARY','QT_QPA
使用Faiss进行高效相似度搜索 llzwxh888 faiss python
在现代AI应用中，快速和高效的相似度搜索是至关重要的。Faiss（FacebookAISimilaritySearch）是一个专门用于快速相似度搜索和聚类的库，特别适用于高维向量。本文将介绍如何使用Faiss来进行相似度搜索，并结合Python代码演示其基本用法。什么是Faiss？Faiss是一个由FacebookAIResearch团队开发的开源库，主要用于高维向量的相似性搜索和聚类。Faiss
python是什么意思中文-在python中%是什么意思编程大乐趣
Python中%有两种：1、数值运算：%代表取模，返回除法的余数。如：>>>7%212、%操作符（字符串格式化，stringformatting），说明如下：%[(name)][flags][width].[precision]typecode(name)为命名flags可以有+，-，''或0。+表示右对齐。-表示左对齐。''为一个空格，表示在正数的左侧填充一个空格，从而与负数对齐。0表示使用0填
Day1笔记-Python简介&标识符和关键字&输入输出 ~在杰难逃~ Python python 开发语言大数据数据分析数据挖掘
大家好，从今天开始呢，杰哥开展一个新的专栏，当然，数据分析部分也会不定时更新的，这个新的专栏主要是讲解一些Python的基础语法和知识，帮助0基础的小伙伴入门和学习Python，感兴趣的小伙伴可以开始认真学习啦！一、Python简介【了解】1.计算机工作原理编程语言就是用来定义计算机程序的形式语言。我们通过编程语言来编写程序代码，再通过语言处理程序执行向计算机发送指令，让计算机完成对应的工作，编程
python八股文面试题分享及解析(1) Shawn________ python
#1.'''a=1b=2不用中间变量交换a和b'''#1.a=1b=2a,b=b,aprint(a)print(b)结果：21#2.ll=[]foriinrange(3):ll.append({'num':i})print(11)结果:#[{'num':0},{'num':1},{'num':2}]#3.kk=[]a={'num':0}foriinrange(3):#0,12#可变类型，不仅仅改变
每日算法&面试题，大厂特训二十八天——第二十天（树）肥学 ⚡算法题⚡面试题每日精进 java 算法数据结构
目录标题导读算法特训二十八天面试题点击直接资料领取导读肥友们为了更好的去帮助新同学适应算法和面试题，最近我们开始进行专项突击一步一步来。上一期我们完成了动态规划二十一天现在我们进行下一项对各类算法进行二十八天的一个小总结。还在等什么快来一起肥学进行二十八天挑战吧！！特别介绍小白练手专栏，适合刚入手的新人欢迎订阅编程小白进阶python有趣练手项目里面包括了像《机器人尬聊》《恶搞程序》这样的有趣文章
Python快速入门 —— 第三节：类与对象孤华暗香 Python快速入门 python 开发语言
第三节：类与对象目标：了解面向对象编程的基础概念，并学会如何定义类和创建对象。内容：类与对象：定义类：class关键字。类的构造函数：__init__()。类的属性和方法。对象的创建与使用。示例：classStudent:def__init__(self,name,age,major):self.name&#
pyecharts——绘制柱形图折线图 2224070247 信息可视化 python java 数据可视化
一、pyecharts概述自2013年6月百度EFE(ExcellentFrontEnd）数据可视化团队研发的ECharts1.0发布到GitHub网站以来，ECharts一直备受业界权威的关注并获得广泛好评，成为目前成熟且流行的数据可视化图表工具，被应用到诸多数据可视化的开发领域。Python作为数据分析领域最受欢迎的语言，也加入ECharts的使用行列，并研发出方便Python开发者使用的数据
Python 实现图片裁剪（附代码） | Python工具剑客阿良_ALiang
前言本文提供将图片按照自定义尺寸进行裁剪的工具方法，一如既往的实用主义。环境依赖ffmpeg环境安装，可以参考我的另一篇文章：windowsffmpeg安装部署_阿良的博客-CSDN博客本文主要使用到的不是ffmpeg，而是ffprobe也在上面这篇文章中的zip包中。ffmpy安装：pipinstallffmpy-ihttps://pypi.douban.com/simple代码不废话了，上代码
【华为OD技术面试真题 - 技术面】- python八股文真题题库（4) 算法大师华为od 面试 python
华为OD面试真题精选专栏：华为OD面试真题精选目录:2024华为OD面试手撕代码真题目录以及八股文真题目录文章目录华为OD面试真题精选**1.Python中的`with`**用途和功能自动资源管理示例：文件操作上下文管理协议示例代码工作流程解析优点2.\_\_new\_\_和**\_\_init\_\_**区别__new____init__区别总结3.**切片（Slicing）操作**基本切片语法
python os 环境变量 CV矿工 python 开发语言 numpy
环境变量：环境变量是程序和操作系统之间的通信方式。有些字符不宜明文写进代码里，比如数据库密码，个人账户密码，如果写进自己本机的环境变量里，程序用的时候通过os.environ.get（）取出来就行了。os.environ是一个环境变量的字典。环境变量的相关操作importos"""设置/修改环境变量：os.environ[‘环境变量名称’]=‘环境变量值’#其中key和value均为string类
Python爬虫解析工具之xpath使用详解 eqa11 python 爬虫开发语言
文章目录Python爬虫解析工具之xpath使用详解一、引言二、环境准备1、插件安装2、依赖库安装三、xpath语法详解1、路径表达式2、通配符3、谓语4、常用函数四、xpath在Python代码中的使用1、文档树的创建2、使用xpath表达式3、获取元素内容和属性五、总结Python爬虫解析工具之xpath使用详解一、引言在Python爬虫开发中，数据提取是一个至关重要的环节。xpath作为一门
【华为OD技术面试真题 - 技术面】- python八股文真题题库（1）算法大师华为od 面试 python
华为OD面试真题精选专栏：华为OD面试真题精选目录:2024华为OD面试手撕代码真题目录以及八股文真题目录文章目录华为OD面试真题精选1.数据预处理流程数据预处理的主要步骤工具和库2.介绍线性回归、逻辑回归模型线性回归（LinearRegression）模型形式：关键点：逻辑回归（LogisticRegression）模型形式：关键点：参数估计与评估：3.python浅拷贝及深拷贝浅拷贝（Shal
nosql数据库技术与应用知识点皆过客，揽星河 NoSQL nosql 数据库大数据数据分析数据结构非关系型数据库
Nosql知识回顾大数据处理流程数据采集(flume、爬虫、传感器)数据存储(本门课程NoSQL所处的阶段)Hdfs、MongoDB、HBase等数据清洗(入仓)Hive等数据处理、分析(Spark、Flink等)数据可视化数据挖掘、机器学习应用(Python、SparkMLlib等)大数据时代存储的挑战(三高)高并发(同一时间很多人访问)高扩展(要求随时根据需求扩展存储)高效率(要求读写速度快)
《Python数据分析实战终极指南》 xjt921122 python 数据分析开发语言
对于分析师来说，大家在学习Python数据分析的路上，多多少少都遇到过很多大坑**，有关于技能和思维的**：Excel已经没办法处理现有的数据量了，应该学Python吗？找了一大堆Python和Pandas的资料来学习，为什么自己动手就懵了？跟着比赛类公开数据分析案例练了很久，为什么当自己面对数据需求还是只会数据处理而没有分析思路？学了对比、细分、聚类分析，也会用PEST、波特五力这类分析法，为啥
Python中深拷贝与浅拷贝的区别 yuxiaoyu.
转自：http://blog.csdn.net/u014745194/article/details/70271868定义：在Python中对象的赋值其实就是对象的引用。当创建一个对象，把它赋值给另一个变量的时候，python并没有拷贝这个对象，只是拷贝了这个对象的引用而已。浅拷贝：拷贝了最外围的对象本身，内部的元素都只是拷贝了一个引用而已。也就是，把对象复制一遍，但是该对象中引用的其他对象我不复
Python开发常用的三方模块如下：换个网名有点难 python 开发语言
Python是一门功能强大的编程语言，拥有丰富的第三方库，这些库为开发者提供了极大的便利。以下是100个常用的Python库，涵盖了多个领域：1、NumPy，用于科学计算的基础库。2、Pandas，提供数据结构和数据分析工具。3、Matplotlib，一个绘图库。4、Scikit-learn，机器学习库。5、SciPy，用于数学、科学和工程的库。6、TensorFlow，由Google开发的开源机
Python编译器鹿鹿~ Python编译器 Python python 开发语言后端
嘿嘿嘿我又来了啊有些小盆友可能不知道Python其实是有编译器的，也就是PyCharm。你们可能会问到这个是干嘛的又不可以吃也不可以穿好像没有什么用，其实你还说对了这个还真的不可以吃也不可以穿，但是它用来干嘛的呢。用来编译你所打出的代码进行运行（可能这里说的有点不对但是只是个人认为）现在我们来说说PyCharm是用来干嘛的。PyCharm是一种PythonIDE，带有一整套可以帮助用户在使用Pyt
一文掌握python面向对象魔术方法（二）程序员neil python python 开发语言
接上篇：一文掌握python面向对象魔术方法（一）-CSDN博客目录六、迭代和序列化：1、__iter__(self):定义迭代器，使得类可以被for循环迭代。2、__getitem__(self,key):定义索引操作，如obj[key]。3、__setitem__(self,key,value):定义赋值操作，如obj[key]=value。4、__delitem__(self,key):定义
一文掌握python常用的list（列表）操作程序员neil python python 开发语言
目录一、创建列表1.直接创建列表：2.使用list()构造器3.使用列表推导式4.创建空列表二、访问列表元素1.列表支持通过索引访问元素，索引从0开始：2.还可以使用切片操作访问列表的一部分：三、修改列表元素四、添加元素1.append()：在末尾添加元素2.insert()：在指定位置插入元素五、删除元素1.del：删除指定位置的元素2.remove()：删除指定值的第一个匹配项3.pop()：
Python实现简单的机器学习算法 master_chenchengg python python 办公效率 python开发 IT
Python实现简单的机器学习算法开篇：初探机器学习的奇妙之旅搭建环境：一切从安装开始必备工具箱第一步：安装Anaconda和JupyterNotebook小贴士：如何配置Python环境变量算法初体验：从零开始的Python机器学习线性回归：让数据说话数据准备：从哪里找数据编码实战：Python实现线性回归模型评估：如何判断模型好坏逻辑回归：从分类开始理论入门：什么是逻辑回归代码实现：使用skl
python中的深拷贝与浅拷贝 anshejd70787 python
深拷贝和浅拷贝浅拷贝的时候，修改原来的对象，浅拷贝的对象不会发生改变。1、对象的赋值对象的赋值实际上是对象之间的引用：当创建一个对象，然后将这个对象赋值给另外一个变量的时候，python并没有拷贝这个对象，而只是拷贝了这个对象的引用。当对对象做赋值或者是参数传递或者作为返回值的时候，总是传递原始对象的引用，而不是一个副本。如下所示：>>>aList=["kel","abc",123]>>>bLis
用Python实现简单的猜数字游戏程序媛了了 python 游戏 java
猜数字游戏代码：importrandomdefpythonit():a=random.randint(1,100)n=int(input("输入你猜想的数字："))whilen!=a:ifn>a:print("很遗憾，猜大了")n=int(input("请再次输入你猜想的数字："))elifna::如果玩家猜的数字n大于随机数字a，则输出"很遗憾，猜大了"，并提示玩家再次输入。elifn
用Python实现读取统计单词个数程序媛了了 python 游戏 java
完整实例代码：fromcollectionsimportCounterdefpythonit():danci={}withopen("pythonit.txt","r",encoding="utf-8")asf:foriinf:words=i.strip().split()forwordinwords:ifwordnotindanci:danci[word]=1else:danci[word]+=
VMware Workstation 11 或者 VMware Player 7安装MAC OS X 10.10 Yosemite iwindyforest vmware mac os 10.10 workstation player
最近尝试了下VMware下安装MacOS 系统，安装过程中发现网上可供参考的文章都是VMware Workstation 10以下， MacOS X 10.9以下的文章，只能提供大概的思路，但是实际安装起来由于版本问题，走了不少弯路，所以我尝试写以下总结，希望能给有兴趣安装OSX的人提供一点帮助。写在前面的话：其实安装好后发现，由于我的th
关于《基于模型驱动的B/S在线开发平台》源代码开源的疑虑？ deathwknight JavaScript java 框架
本人从学习Java开发到现在已有10年整，从一个要自学 java买成javascript的小菜鸟，成长为只会java和javascript语言的老菜鸟（个人邮箱：[email protected]）一路走来，跌跌撞撞。用自己的三年多业余时间，瞎搞一个小东西（基于模型驱动的B/S在线开发平台，非MVC框架、非代码生成）。希望与大家一起分享，同时有许些疑虑，希望有人可以交流下平台
如何把maven项目转成web项目 Kai_Ge maven MyEclipse
创建Web工程，使用eclipse ee创建maven web工程 1.右键项目,选择Project Facets,点击Convert to faceted from 2.更改Dynamic Web Module的Version为2.5.(3.0为Java7的,Tomcat6不支持). 如果提示错误,可能需要在Java Compiler设置Compiler compl
主管？？？ Array_06 工作
转载：http://www.blogjava.net/fastzch/archive/2010/11/25/339054.html 很久以前跟同事参加的培训，同事整理得很详细，必须得转！前段时间，公司有组织中高阶主管及其培养干部进行了为期三天的管理训练培训。三天的课程下来，虽然内容较多，因对老师三天来的课程内容深有感触，故借着整理学习心得的机会，将三天来的培训课程做了一个
python内置函数大全 2002wmj python
最近一直在看python的document，打算在基础方面重点看一下python的keyword、Build-in Function、Build-in Constants、Build-in Types、Build-in Exception这四个方面，其实在看的时候发现整个《The Python Standard Library》章节都是很不错的，其中描述了很多不错的主题。先把Build-in Fu
JSP页面通过JQUERY合并行 357029540 JavaScript jquery
在写程序的过程中我们难免会遇到在页面上合并单元行的情况，如图所示如果对于会的同学可能很简单，但是对没有思路的同学来说还是比较麻烦的，提供一下用JQUERY实现的参考代码 function mergeCell(){ var trs = $("#table tr"); &nb
Java基础冰天百华 java基础
学习函数式编程 package base; import java.text.DecimalFormat; public class Main { public static void main(String[] args) { // Integer a = 4; // Double aa = (double)a / 100000; // Decimal
unix时间戳相互转换 adminjun 转换 unix 时间戳
如何在不同编程语言中获取现在的Unix时间戳(Unix timestamp)？ Java time JavaScript Math.round(new Date().getTime()/1000) getTime()返回数值的单位是毫秒 Microsoft .NET / C# epoch = (DateTime.Now.ToUniversalTime().Ticks - 62135
作为一个合格程序员该做的事 aijuans 程序员
作为一个合格程序员每天该做的事 1、总结自己一天任务的完成情况最好的方式是写工作日志，把自己今天完成了什么事情，遇见了什么问题都记录下来，日后翻看好处多多 2、考虑自己明天应该做的主要工作把明天要做的事情列出来，并按照优先级排列，第二天应该把自己效率最高的时间分配给最重要的工作 3、考虑自己一天工作中失误的地方，并想出避免下一次再犯的方法出错不要紧，最重
由html5视频播放引发的总结 ayaoxinchao html5 视频 video
前言项目中存在视频播放的功能，前期设计是以flash播放器播放视频的。但是现在由于需要兼容苹果的设备，必须采用html5的方式来播放视频。我就出于兴趣对html5播放视频做了简单的了解，不了解不知道，水真是很深。本文所记录的知识一些浅尝辄止的知识，说起来很惭愧。视频结构本该直接介绍html5的<video>的，但鉴于本人对视频
解决httpclient访问自签名https报javax.net.ssl.SSLHandshakeException: sun.security.validat bewithme httpclient
如果你构建了一个https协议的站点，而此站点的安全证书并不是合法的第三方证书颁发机构所签发，那么你用httpclient去访问此站点会报如下错误 javax.net.ssl.SSLHandshakeException: sun.security.validator.ValidatorException: PKIX path bu
Jedis连接池的入门级使用 bijian1013 redis redis数据库 jedis
Jedis连接池操作步骤如下： a.获取Jedis实例需要从JedisPool中获取； b.用完Jedis实例需要返还给JedisPool； c.如果Jedis在使用过程中出错，则也需要还给JedisPool； packag
变与不变 bingyingao 不变变亲情永恒
变与不变周末骑车转到了五年前租住的小区，曾经最爱吃的西北面馆、江西水饺、手工拉面早已不在，各种店铺都换了好几茬，这些是变的。三年前还很流行的一款手机在今天看起来已经落后的不像样子。三年前还运行的好好的一家公司，今天也已经不复存在。一座座高楼拔地而起，
【Scala十】Scala核心四：集合框架之List bit1129 scala
Spark的RDD作为一个分布式不可变的数据集合，它提供的转换操作，很多是借鉴于Scala的集合框架提供的一些函数，因此，有必要对Scala的集合进行详细的了解 1. 泛型集合都是协变的，对于List而言，如果B是A的子类，那么List[B]也是List[A]的子类，即可以把List[B]的实例赋值给List[A]变量 2. 给变量赋值(注意val关键字，a，b
Nested Functions in C bookjovi c closure
Nested Functions 又称closure，属于functional language中的概念，一直以为C中是不支持closure的，现在看来我错了，不过C标准中是不支持的，而GCC支持。既然GCC支持了closure，那么 lexical scoping自然也支持了，同时在C中label也是可以在nested functions中自由跳转的
Java-Collections Framework学习与总结-WeakHashMap BrokenDreams Collections
总结这个类之前，首先看一下Java引用的相关知识。Java的引用分为四种：强引用、软引用、弱引用和虚引用。强引用：就是常见的代码中的引用，如Object o = new Object();存在强引用的对象不会被垃圾收集
读《研磨设计模式》-代码笔记-解释器模式-Interpret bylijinnan java 设计模式
声明：本文只为方便我个人查阅和理解，详细的分析以及源代码请移步原作者的博客http://chjavach.iteye.com/ package design.pattern; /* * 解释器（Interpreter）模式的意图是可以按照自己定义的组合规则集合来组合可执行对象 * * 代码示例实现XML里面1.读取单个元素的值 2.读取单个属性的值 * 多
After Effects操作&快捷键 cherishLC After Effects
1、快捷键官方文档中文版：https://helpx.adobe.com/cn/after-effects/using/keyboard-shortcuts-reference.html 英文版：https://helpx.adobe.com/after-effects/using/keyboard-shortcuts-reference.html 2、常用快捷键
Maven 常用命令 crabdave maven
Maven 常用命令 mvn archetype:generate mvn install mvn clean mvn clean complie mvn clean test mvn clean install mvn clean package mvn test mvn package mvn site mvn dependency:res
shell bad substitution daizj shell 脚本
#!/bin/sh /data/script/common/run_cmd.exp 192.168.13.168 "impala-shell -islave4 -q 'insert OVERWRITE table imeis.${tableName} select ${selectFields}, ds, fnv_hash(concat(cast(ds as string), im
Java SE 第二讲（原生数据类型 Primitive Data Type） dcj3sjt126com java
Java SE 第二讲： 1. Windows: notepad, editplus, ultraedit, gvim Linux: vi, vim, gedit 2. Java 中的数据类型分为两大类： 1）原生数据类型（Primitive Data Type） 2）引用类型（对象类型）（R
CGridView中实现批量删除 dcj3sjt126com PHP yii
1，CGridView中的columns添加 array( 'selectableRows' => 2, 'footer' => '<button type="button" onclick="GetCheckbox();" style=&
Java中泛型的各种使用 dyy_gusi java 泛型
Java中的泛型的使用：1.普通的泛型使用在使用类的时候后面的<>中的类型就是我们确定的类型。 public class MyClass1<T> {//此处定义的泛型是T private T var; public T getVar() { return var; } public void setVa
Web开发技术十年发展历程 gcq511120594 Web 浏览器数据挖掘
回顾web开发技术这十年发展历程： Ajax 03年的时候我上六年级，那时候网吧刚在小县城的角落萌生。传奇，大话西游第一代网游一时风靡。我抱着试一试的心态给了网吧老板两块钱想申请个号玩玩，然后接下来的一个小时我一直在，注，册，账，号。彼时网吧用的512k的带宽，注册的时候，填了一堆信息，提交，页面跳转，嘣，”您填写的信息有误，请重填”。然后跳转回注册页面，以此循环。我现在时常想，如果当时a
openSession()与getCurrentSession()区别： hetongfei java DAO Hibernate
来自 http://blog.csdn.net/dy511/article/details/6166134 1.getCurrentSession创建的session会和绑定到当前线程,而openSession不会。 2. getCurrentSession创建的线程会在事务回滚或事物提交后自动关闭,而openSession必须手动关闭。这里getCurrentSession本地事务(本地
第一章安装Nginx+Lua开发环境 jinnianshilongnian nginx lua openresty
首先我们选择使用OpenResty，其是由Nginx核心加很多第三方模块组成，其最大的亮点是默认集成了Lua开发环境，使得Nginx可以作为一个Web Server使用。借助于Nginx的事件驱动模型和非阻塞IO，可以实现高性能的Web应用程序。而且OpenResty提供了大量组件如Mysql、Redis、Memcached等等，使在Nginx上开发Web应用更方便更简单。目前在京东如实时价格、秒
HSQLDB In-Process方式访问内存数据库 liyonghui160com
HSQLDB一大特色就是能够在内存中建立数据库，当然它也能将这些内存数据库保存到文件中以便实现真正的持久化。先睹为快！下面是一个In-Process方式访问内存数据库的代码示例：下面代码需要引入hsqldb.jar包（hsqldb-2.2.8） import java.s
Java线程的5个使用技巧 pda158 java 数据结构
Java线程有哪些不太为人所知的技巧与用法？　　萝卜白菜各有所爱。像我就喜欢Java。学无止境，这也是我喜欢它的一个原因。日常工作中你所用到的工具，通常都有些你从来没有了解过的东西，比方说某个方法或者是一些有趣的用法。比如说线程。没错，就是线程。或者确切说是Thread这个类。当我们在构建高可扩展性系统的时候，通常会面临各种各样的并发编程的问题，不过我们现在所要讲的可能会略有不同。
开发资源大整合：编程语言篇——JavaScript（1） shoothao JavaScript
概述：本系列的资源整合来自于github中各个领域的大牛，来收藏你感兴趣的东西吧。程序包管理器管理javascript库并提供对这些库的快速使用与打包的服务。 Bower - 用于web的程序包管理。 component - 用于客户端的程序包管理，构建更好的web应用程序。 spm - 全新的静态的文件包管
避免使用终结函数 vahoa.ma java jvm C++
终结函数（finalizer）通常是不可预测的，常常也是很危险的，一般情况下不是必要的。使用终结函数会导致不稳定的行为、更差的性能，以及带来移植性问题。不要把终结函数当做C++中的析构函数（destructors）的对应物。我自己总结了一下这一条的综合性结论是这样的： 1）在涉及使用资源，使用完毕后要释放资源的情形下，首先要用一个显示的方