Python-AI Xenon

卷积神经网络与循环神经网络实战 --- 手写数字识别及诗词创作

卷积神经网络与循环神经网络实战 — 手写数字识别及诗词创作

文章目录

卷积神经网络与循环神经网络实战 --- 手写数字识别及诗词创作
- 一、神经网络相关知识
- - 1. 深度学习
  - 2. 人工神经网络回顾
  - 3. 卷积神经网络（CNN）
  - - 3.1 卷积层
    - 3.2 汇集（池化）层
    - 3.3 深层卷积神经网络
    - 3.4 卷积神经网络的演化和几个代表性模型
    - 3.5 卷积神经网络在非图像数据上的应用举例
  - 4. 循环神经网络（RNN）
  - - 4.1 Hopfield神经网络
    - 4.2 循环神经网络
- 二、运行环境
- 四、积神经网络完成手写字体识别(Sequential)
- 五、卷积神经网络完成手写字体识别
- 六、循环神经网络完成诗词创作
- 七、使用异步序列到序列编码器-解码器的方法完成诗词创作任务
- - - 循环神经网络的三种模式
- 八、拓展练习
- - - 使用卷积神经网络对cifar10数据进行10分类预测，并在训练结束后，以corgi.jpg为例，尝试画出某一个卷积层的输出特征向量映射，以观察卷积神经网络的运作逻辑。
    - - cifar10数据集介绍

一、神经网络相关知识

1. 深度学习

– 1986年，Rina Dechter提出这个词，以搜索和推理为核心

– 2000年，I. Aizenberg 引入到神经网络研究

– 具有多层结构神经网络模型的机器学习方法

– 是一大类机器学习方法的总称

• 深度学习也与神经网络与贝叶斯学习等结合起来，并不限于狭义的神经网络的概念

2. 人工神经网络回顾

3. 卷积神经网络（CNN）

• 用于解决图像识别领域的问题

• 原有多层感知器解决图像识别面临欠学习或参数过多问题

• 图像中待识别对象的像素点间存在空间关联关系

• 图像对象中存在多种不变性因素：

– 位置，大小，变形并不影响字符的属性

3.1 卷积层

• 单个卷积核：局部信息提取

• 所有位置扫描，一个卷积核得到一个特征图（Feature Map）

• 多个卷积核称作多个通道（channel），用于不同特征提取

• 一维卷积：相应位置加权求和

• 超参数（hyper-parameters）

–卷积核尺寸

–步幅（stride）

–边宽或边衬（pad）

• 对训练过程与结果有重要影响

• 权值共享（weight sharing）：一轮扫描中卷积核参数不变

• 前向传播后，通过输出端误差进行反向传播优化

• 多个并行卷积核构成多个通道，提取不同特征

• 图像尺寸×，卷积核尺寸×，步幅为s ，边衬为p且对称，则特征图维数：⌊(n+2p-k)/s+1⌋

• 挤压（squashing）：对卷积结果进行非线性运算

• 非线性激活函数

– 传统S型函数（sigmoid）或双曲正切函数（tanh）

– 常用ReLU函数：矫正线性单元（Rectified Linear Unit）

3.2 汇集（池化）层

• 汇集（“池化”）：对卷积后特征图进行降采样

–最大汇集（max pooling）：选局部区域最大值

–平均汇集（Average pooling）：选区域数值平均值

• 两个参数：汇集区域大小和步幅

3.3 深层卷积神经网络

AlexNet

– 使用局部感受野、权值共享、最大汇集等措施减少参数量

– 自由参数：~6.1×10^7

– 数据扩增（data augmentation）：利用预处理增加训练样本数目

3.4 卷积神经网络的演化和几个代表性模型

• 1990年：LeNet-1

• 2012年：AlexNet

• 2013年：ZFNet

• 2014年：VGG 网络

• 2014年：GoogLeNet

• 2015年：残差网络（ResNet）

• 2017年：密集网络（DenseNet）

• 2018年：多尺度密度网络（MSDNet）

3.5 卷积神经网络在非图像数据上的应用举例

4. 循环神经网络（RNN）

4.1 Hopfield神经网络

4.2 循环神经网络

二、运行环境

Python 3.9.13 (其它与tensorflow对应版本均可)

PyCharm 2022.3 (Professional Edition非硬性要求)

jupyter notebook (备选)

tensorflow-gpu== 2.6.0 (使用GPU进行加速,需单独安装该版本,详见下面文档)

cuDNN== 8.1 (tensorflow-gpu显卡依赖)

CUDA== 11.2 (tensorflow-gpu显卡依赖)

numpy==1.19.2 (python科学计算库)

keras == 2.6.0(开源人工神经网络库)

tensorflow和keras版本对应关系：

建议执行：

pip insatll googlemaps # 同时根据提示内容安装或降级所有依赖包

官方TensorFlow安装文档 (安装必看)

折腾了一下午,妥协了! 除非你自己电脑的tensorflow是1.x版本的,否则不建议使用自己的电脑运行之后的代码，（总之，很难改2.x就对了）反正就是出不了结果,虚拟环境也是如此（gpu虚拟环境报错）。

这里选择阿里云的 天池Notebook 使用也还算比较方便。使用方法自行百度。

官网链接： https://tianchi.aliyun.com/notebook-ai/

四、积神经网络完成手写字体识别(Sequential)

使用TensorFlow的Sequential建立卷积神经网络，完成手写字体识别任务。

# -*- coding: utf-8 -*-
# @Author : Xenon
# @Date : 2023/2/5 23:14 
# @IDE : 天池notebook Python3.7.13
"""使用TensorFlow的Sequential建立卷积神经网络，完成手写字体识别任务。"""

import os
import tensorflow as tf
from tensorflow import keras
from tensorflow.keras import layers, optimizers, datasets
from tensorflow.keras.layers import Dense, Dropout, Flatten
from tensorflow.keras.layers import Conv2D, MaxPooling2D

os.environ['TF_CPP_MIN_LOG_LEVEL'] = '2'


def mnist_dataset():
    """数据集的读取
    使用TensorFlow下载mnist数据集，取训练集中的前20000个样本作为本实验的训练集，测试集的所有样本（20000个）作为本实验的测试集。
    对于样本，将其属性值调整为tf.float32类型并归一化，标签调整为tf.int64类型，随机打乱顺序，
    训练样本每100个分为一个batch，测试样本只有一个batch。
    :return: 训练集ds, 测试集test_ds（TensorFlow的dataset格式）
    """
    (x, y), (x_test, y_test) = datasets.mnist.load_data()
    x = x.reshape(x.shape[0], 28, 28, 1)
    x_test = x_test.reshape(x_test.shape[0], 28, 28, 1)
    ds = tf.data.Dataset.from_tensor_slices((x, y))
    ds = ds.map(prepare_mnist_features_and_labels)
    ds = ds.take(20000).shuffle(20000).batch(100)

    test_ds = tf.data.Dataset.from_tensor_slices((x_test, y_test))
    test_ds = test_ds.map(prepare_mnist_features_and_labels)
    test_ds = test_ds.take(20000).shuffle(20000).batch(20000)
    return ds, test_ds


def prepare_mnist_features_and_labels(x, y):
    x = tf.cast(x, tf.float32) / 255.0
    y = tf.cast(y, tf.int64)
    return x, y


if __name__ == '__main__':
    # 模型的建立（顶层代码）使用Sequential，建立一个模型并将模型实例化为对象model。
    model = keras.Sequential([
        # 该模型要求具有7层（不计入输入层），分别为：
        Conv2D(32, (5, 5), activation='relu', padding='same'),  # 卷积层：二维卷积层，输出深度32，卷积核5*5，激活函数为relu，零填充方式为等宽卷积；
        MaxPooling2D(pool_size=2, strides=2),  # 池化层：最大池化层，区域为2*2，步长为2
        Conv2D(64, (5, 5), activation='relu', padding='same'),  # 卷积层：二维卷积层，输出深度64，卷积核5*5，激活函数为relu，零填充方式为等宽卷积；
        MaxPooling2D(pool_size=2, strides=2),  # 池化层：最大池化层，区域为2*2，步长为2；
        Flatten(),  # Flatten()层：用于将输入特征张量拉平为一维向量，在理论角度不算作一层；
        layers.Dense(128, activation='tanh'),  # 全连接层：节点数为128，激活函数为tanh；
        layers.Dense(10)])  # 全连接层：节点数为10，无激活函数。
    optimizer = optimizers.Adam(0.0001)  # 设置optimizer，使用Adam算法，参数为0.0001

    # 使用model.compile配置训练过程，将optimizer输入，自动将标签独热向量化。
    model.compile(optimizer=optimizer,
                  loss='sparse_categorical_crossentropy',  # 损失方程为交叉熵损失函数
                  metrics=['accuracy']  # 评价指标为准确率
                  )
    train_ds, test_ds = mnist_dataset()
    # 读取数据集，使用model.fit方法，对训练集进行5轮训练（参数epochs=5）。
    model.fit(train_ds, epochs=5)
    # 使用model. evaluate方法，对测试集进行测试。
    model.evaluate(test_ds)

输出结果：（天池）

五、卷积神经网络完成手写字体识别

使用TensorFlow的基础功能编写卷积神经网络，手动编写权重向量与前向计算逻辑，使用梯度带进行反向传播，完成手写字体识别任务。

# -*- coding: utf-8 -*-
# @Author : Xenon
# @Date : 2023/2/5 23:14 
# @IDE : PyCharm(2022.3.2) Python3.9.13
"""使用TensorFlow的基础功能编写卷积神经网络，手动编写权重向量与前向计算逻辑，使用梯度带进行反向传播，完成手写字体识别任务。"""
import os
# import tensorflow as tf
import tensorflow.compat.v1 as tf
from keras.api._v1 import keras
from keras.api._v1.keras import datasets, optimizers

from tensorflow.python.keras.layers import Conv2D, MaxPooling2D
from tensorflow.python.layers import layers
from tensorflow.python.layers.core import Flatten

# from tensorflow.keras import layers, optimizers, datasets
# from tensorflow.keras.layers import Dense, Dropout, Flatten

# 版本兼容问题 https://zhuanlan.zhihu.com/p/352494279 仍然失败,建议使用tf1.x算了
tf.disable_v2_behavior()
tf.disable_eager_execution()

os.environ['TF_CPP_MIN_LOG_LEVEL'] = '2'


def mnist_dataset():
    """数据集的读取
    使用TensorFlow下载mnist数据集，取训练集中的前20000个样本作为本实验的训练集，测试集的所有样本（20000个）作为本实验的测试集。
    对于样本，将其属性值调整为tf.float32类型并归一化，标签调整为tf.int64类型，随机打乱顺序，
    训练样本每100个分为一个batch，测试样本只有一个batch。
    :return:训练集ds, 测试集test_ds（TensorFlow的dataset格式）
    """
    (x, y), (x_test, y_test) = datasets.mnist.load_data()
    x = x.reshape(x.shape[0], 28, 28, 1)
    x_test = x_test.reshape(x_test.shape[0], 28, 28, 1)
    ds = tf.data.Dataset.from_tensor_slices((x, y))
    ds = ds.map(prepare_mnist_features_and_labels)
    ds = ds.take(20000).batch(100)

    test_ds = tf.data.Dataset.from_tensor_slices((x_test, y_test))
    test_ds = test_ds.map(prepare_mnist_features_and_labels)
    test_ds = test_ds.take(20000).batch(20000)
    return ds, test_ds


def prepare_mnist_features_and_labels(x, y):
    x = tf.cast(x, tf.float32) / 255.0
    y = tf.cast(y, tf.int64)
    return x, y


#  模型的建立
class myConvModel(keras.Model):
    """
    定义类myConvModel，继承自父类keras.Model，在构造函数中运行父类的构造函数，定义属性见下文注释：
    """

    def __init__(self):
        super(myConvModel, self).__init__()
        # l1_conv：二维卷积层，输出深度32，卷积核5*5，激活函数为relu，零填充方式为等宽卷积
        self.l1_conv = Conv2D(filters=32,
                              kernel_size=(5, 5),
                              activation='relu', padding='same')
        # l2_conv：二维卷积层，输出深度64，卷积核5*5，激活函数为relu，零填充方式为等宽卷积
        self.l2_conv = Conv2D(filters=64,
                              kernel_size=(5, 5),
                              activation='relu', padding='same')
        # pool：最大池化层，区域为2*2，步长为2
        self.pool = MaxPooling2D(pool_size=(2, 2), strides=2)
        # flat：Flatten()层，用于将输入特征张量拉平为一维向量，在理论角度不算作一层；
        self.flat = Flatten()
        # dense1：全连接层，节点数为128，激活函数为tanh；
        self.dense1 = layers.Dense(100, activation='tanh')
        # dense2：全连接层，节点数为10，无激活函数。
        self.dense2 = layers.Dense(10)

    @tf.function
    def call(self, x):
        """对输入的样本属性集x进行前向计算。
        分别经过属性l1_conv，pool，l2_conv，pool，flat，dense1，dense2计算，conv输入值为x，
        下一个属性的输入值是上一个属性的输出值。最后再进行softmax函数处理。
        :param x: 样本属性集x
        :return: 前向计算结果logits
        """
        h1 = self.l1_conv(x)
        h1_pool = self.pool(h1)
        h2 = self.l2_conv(h1_pool)

        h2_pool = self.pool(h2)
        flat_h = self.flat(h2_pool)
        dense1 = self.dense1(flat_h)
        logits = self.dense2(dense1)
        probs = tf.nn.softmax(logits, axis=-1)
        return probs


if __name__ == '__main__':
    model = myConvModel()  # 将myConvModel实例化为对象model
    optimizer = optimizers.Adam()  # 设置optimizer，使用Adam算法，参数为0.0001
    # 使用model.compile配置训练过程，要求将optimizer输入，损失方程为交叉熵损失函数，自动将标签独热向量化，评价指标为准确率.
    model.compile(optimizer=optimizer,
                  loss='sparse_categorical_crossentropy',
                  metrics=['accuracy'])
    train_ds, test_ds = mnist_dataset()
    # 读取数据集，使用model.fit方法，对训练集进行5轮训练（参数epochs=5）
    model.fit(train_ds, epochs=5)
    # 使用model. evaluate方法，对测试集进行测试.
    model.evaluate(test_ds)

输出结果：

六、循环神经网络完成诗词创作

使用TensorFlow建立循环神经网络，完成诗词创作任务。限制只取前500首唐诗。

# -*- coding: utf-8 -*-
# @Author : Xenon
# @Date : 2023/2/5 23:15 
# @IDE : PyCharm(2022.3.2) Python3.9.13
"""使用TensorFlow建立循环神经网络，完成诗词创作任务。限制只取前500首唐诗。"""

import collections
# import tensorflow as tf
import tensorflow.compat.v1 as tf  # 版本兼容问题,我使用的是tf2.6.0
from keras.api._v1.keras import optimizers
from tensorflow import keras

# from tensorflow.keras import layers
# from tensorflow.keras import layers, optimizers, datasets

start_token = 'bos'
end_token = 'eos'


def process_dataset(fileName):
    """使用process_dataset函数读取与数据集
    附注：本实验中，每个字是一个样本，在理论上与实际训练过程中，每首诗是一个样本序列，在dataset数据中，每首诗+诗的字数是一个样本序列。
    :param fileName: 文件名
    :return: 样本序列instances, 字到编号的索引word2id, 编号到字的索引id2word
    """
    # 根据给定的文件名，读取每一行诗词，去掉结尾的换行符，把第一个英文冒号“:”前面的诗名去除，
    # 在剩余内容的前面添加开始符'bos'，后面添加结束符'eos'，忽略长度大于200的诗，其它诗加入样本集。
    examples = []
    with open(fileName, 'r', encoding='utf-8') as fd:
        times = 0
        for line in fd:
            outs = line.strip().split(':')
            content = ''.join(outs[1:])
            ins = [start_token] + list(content) + [end_token]
            if len(ins) > 200:
                continue
            examples.append(ins)
            times += 1
            # todo 若只训练500首古诗(古文？)请打开下面两行注释
            if times >= 500:
                break


    counter = collections.Counter()
    for e in examples:
        for w in e:
            counter[w] += 1
    # 统计各个字的频率，按照字频从大到小的顺序为字编号，将填充符号'PAD'，未知字符标记'UNK'加入字表，生成字到编号、编号到字的索引（字典类型）
    sorted_counter = sorted(counter.items(), key=lambda x: -x[1])
    words, _ = zip(*sorted_counter)
    words = ('PAD', 'UNK') + words[:len(words)]
    word2id = dict(zip(words, range(len(words))))
    id2word = {word2id[k]: k for k in word2id}

    # 将诗词中的字转化为数字编号
    indexed_examples = [[word2id[w] for w in poem]
                        for poem in examples]
    #  统计各个诗词的字数
    seqlen = [len(e) for e in indexed_examples]

    # 将编号化的诗（列表），与诗的长度（整数）合并成一个样本序列。依次生成所有样本序列。
    instances = list(zip(indexed_examples, seqlen))

    return instances, word2id, id2word


def poem_dataset():
    """编写poem_dataset函数，进一步处理数据
    :return: 数据集ds, 字到编号的索引word2id, 编号到字的索引id2word
    """
    # 使用process_dataset函数，得到返回值instances, word2id, id2word
    instances, word2id, id2word = process_dataset('./poems.txt')
    # 利用from_generator，将返回值转化为TensorFlow的dataset，传入的参数分别为：
    # 函数lambda: [ins for ins in instances]：遍历其中的样本，生成dataset
    # 数据类型(tf.int64, tf.int64)：编号化的诗词与字数都是TensorFlow的64位整型
    # 形状(tf.TensorShape([None]),tf.TensorShape([])，编号化的诗词是一维向量，长度待定，字数是一个变量。
    ds = tf.data.Dataset.from_generator(lambda: [ins for ins in instances],
                                        (tf.int64, tf.int64),
                                        (tf.TensorShape([None]), tf.TensorShape([])))
    # 使用shuffle函数打乱数据集
    ds = ds.shuffle(buffer_size=10240)
    # 使用padded_batch函数，将每个样本序列填充并分批，即：每100个样本序列分为一批（batch），每个batch的样本序列长度不一，此时均填充到与当前batch的最长序列相同
    # （注：样本序列中的诗词长度不一，填充到最长，而诗词长度固定为一个变量，无需填充，也无需改变数值）
    ds = ds.padded_batch(100, padded_shapes=(tf.TensorShape([None]), tf.TensorShape([])))
    # 使用map函数，对样本序列进行处理，每个样本序列由原有的[编号化的诗词，诗词长度]改为[编号化的诗词去掉最后一个字，编号化的诗词去掉第一个字，诗词长度-1]
    # （注：编号化的诗词去掉最后一个字，是训练的输入序列，编号化的诗词去掉第一个字，是训练的真实标签，
    # 这样，对一个序列的训练过程中，输入样本与真实标签内容相同但错开一位，每个输入样本（一个字）对应的标签是这首诗的下一个字，
    # 也就是说，训练的目的是根据一首诗的当前字，预测下一个字）
    ds = ds.map(lambda x, seqlen: (x[:, :-1], x[:, 1:], seqlen - 1))
    return ds, word2id, id2word


class myRNNModel(keras.Model):
    """编写模型myRNNModel,参数为词到编号的索引w2id，继承自keras.Model"""

    def __init__(self, w2id):  # 执行父类的构造函数
        super(myRNNModel, self).__init__()
        self.v_sz = len(w2id)  # v_sz：训练集中的不同字的数量（包括开始符、结束符、填充标记、未知字符标记）
        # embed_layer：使用keras.layers.Embedding进行嵌入，每一个字是一个样本，
        # 如果经过独热向量处理，样本的属性数量是词表长度，现在经过嵌入，得到的是64个编码（64个属性），效果与独热向量近似。
        self.embed_layer = tf.keras.layers.Embedding(self.v_sz, 64,
                                                     batch_input_shape=[None, None])
        # rnncell：使用keras.layers.SimpleRNNCell，建立一个时间步的RNN隐含层，有128个神经元
        self.rnncell = tf.keras.layers.SimpleRNNCell(128)
        # rnn_layer：使用keras.layers.RNN，利用rnncell，建立所有时间步的RNN隐含层，每个时间步返回一个输出
        self.rnn_layer = tf.keras.layers.RNN(self.rnncell, return_sequences=True)
        # dense：一个全连接层，神经元数量为v_sz，进行一个分类任务，类别数是v_sz。
        self.dense = tf.keras.layers.Dense(self.v_sz)

    @tf.function
    def call(self, inp_ids):
        """ 用于训练。
        将输入值用embed_layer嵌入，由[batch中的样本序列数，样本序列中的样本数（填充）]变为[batch中的样本序列数，样本序列中的样本数（填充），64]。
        用rnn_layer处理，此时的输出事实上是隐状态，每个字都将返回长度为128的隐状态。
        用dense得到输出，每个字的长度为128的隐状态都将进行处理，各自得到一个长度为v_sz的输出。
        :param inp_ids: 样本集inp_ids
        :return: 预测结果（概率）logits
        """
        inp_emb = self.embed_layer(inp_ids)
        rnn_out = self.rnn_layer(inp_emb)

        logits = self.dense(rnn_out)
        return logits

    @tf.function
    def get_next_token(self, x, state):
        """用于测试
        输入一个字，用embed_layer嵌入，用rnncell.call执行一个时间步的RNN算法，用dense得到输出，用argmax得到预测结果
        :param x: 当前输入样本
        :param state: 上一个时刻的隐状态
        :return: 当前预测结果（标签）out, 当前时刻的隐状态state
        """
        inp_emb = self.embed_layer(x)
        h, state = self.rnncell.call(inp_emb, state)
        logits = self.dense(h)
        out = tf.argmax(logits, axis=-1)
        return out, state


def mkMask(input_tensor, maxLen):
    shape_of_input = tf.shape(input_tensor)
    shape_of_output = tf.concat(axis=0, values=[shape_of_input, [maxLen]])

    oneDtensor = tf.reshape(input_tensor, shape=(-1,))
    flat_mask = tf.sequence_mask(oneDtensor, maxlen=maxLen)
    return tf.reshape(flat_mask, shape_of_output)


def reduce_avg(reduce_target, lengths, dim):
    """用于辅助交叉熵损失函数的计算
    根据每个batch中各个输入预测的loss（包括填充符），以及每个batch中每首诗的长度，计算不含填充符的loss
    其中，设置mkMask函数，根据batch的最长长度与每首诗的长度，使用tf.sequence_mask，生成一个矩阵，其中非填充符为True，填充符为False。
    将False处的损失设为0（可以利用矩阵对应位置相乘），计算每个序列的总损失，然后除以每个序列的无填充诗词长度，计算每个序列的平均损失。
    :param reduce_target: 一个batch中各样本（非样本序列）的损失
    :param lengths: 各序列的真实长度
    :param dim: 需要求均值的维度
    :return: 各序列的平均损失red_avg
    """
    shape_of_lengths = lengths.get_shape()
    shape_of_target = reduce_target.get_shape()
    if len(shape_of_lengths) != dim:
        raise ValueError(('Second input tensor should be rank %d, ' +
                          'while it got rank %d') % (dim, len(shape_of_lengths)))
    if len(shape_of_target) < dim + 1:
        raise ValueError(('First input tensor should be at least rank %d, ' +
                          'while it got rank %d') % (dim + 1, len(shape_of_target)))

    rank_diff = len(shape_of_target) - len(shape_of_lengths) - 1
    mxlen = tf.shape(reduce_target)[dim]
    mask = mkMask(lengths, mxlen)
    if rank_diff != 0:
        len_shape = tf.concat(axis=0, values=[tf.shape(lengths), [1] * rank_diff])
        mask_shape = tf.concat(axis=0, values=[tf.shape(mask), [1] * rank_diff])
    else:
        len_shape = tf.shape(lengths)
        mask_shape = tf.shape(mask)
    lengths_reshape = tf.reshape(lengths, shape=len_shape)
    mask = tf.reshape(mask, shape=mask_shape)

    mask_target = reduce_target * tf.cast(mask, dtype=reduce_target.dtype)

    red_sum = tf.reduce_sum(mask_target, axis=[dim], keepdims=False)
    red_avg = red_sum / (tf.cast(lengths_reshape, dtype=tf.float32) + 1e-30)
    return red_avg


###
@tf.function
def compute_loss(logits, labels, seqlen):
    """计算交叉熵损失函数
    要求使用TensorFlow中的交叉熵损失函数，规定样本预测标签为logits形式，需要用softmax函数处理，
    真实标签未经独热向量处理，需要自动处理。然后返回平均损失。
    :param logits: Logits形式的预测标签
    :param labels: 未经独热向量处理的真实标签
    :param seqlen:
    :return: 平均损失loss
    """
    losses = tf.nn.sparse_softmax_cross_entropy_with_logits(
        logits=logits, labels=labels)
    losses = reduce_avg(losses, seqlen, dim=1)
    return tf.reduce_mean(losses)


@tf.function
def train_one_step(model, optimizer, x, y, seqlen):
    """进行训练（一次优化）
    在梯度带中，调用模型的call方法（注意该方法如何调用？），预测样本的标签，并调用compute_loss函数计算损失值。
    利用梯度带进行一次随机梯度下降法训练。
    :param model: 模型
    :param optimizer: 优化器（用于指定优化方法）
    :param x: 属性集
    :param y: 真实标签集
    :param seqlen:
    :return: 损失loss
    """
    with tf.GradientTape() as tape:
        logits = model(x)
        loss = compute_loss(logits, y, seqlen)

    grads = tape.gradient(loss, model.trainable_variables)
    optimizer.apply_gradients(zip(grads, model.trainable_variables))
    return loss


def train(epoch, model, optimizer, ds):
    """进行训练（全部优化过程）
    根据当前训练回合数epoch，模型model，优化器optimizer，数据集ds进行训练，每次读取一个batch，将model，optimizer，batch的属性集x，
    标签集y（事实上是错了一位的属性集），诗词长度seqlen输入train_one_step中，进行一次训练。
    附注：之前的实验中，模型自身没有时间步，此时“每个时间步”指梯度下降法的每个时间步，在RNN中，
    模型自身有时间步（每输入样本序列中的一个样本为一个时间步），为避免混淆，梯度下降法的一个时间步称为“一次优化”
    :param epoch: 当前训练回合数
    :param model: 模型
    :param optimizer: 优化器
    :param ds: 数据集
    :return: 损失loss
    """
    loss = 0.0
    accuracy = 0.0
    for step, (x, y, seqlen) in enumerate(ds):
        loss = train_one_step(model, optimizer, x, y, seqlen)

    print('epoch', epoch, ': loss', loss.numpy())

    return loss


# 执行训练（顶层函数）设置使用Adam法进行优化，参数为0.0005
optimizer = optimizers.Adam(0.0005)
# 使用poem_dataset()读取数据集
train_ds, word2id, id2word = poem_dataset()
#  实例化myRNNModel
model = myRNNModel(word2id)
# 执行3个epoch的训练，每次调用一遍train函数
for epoch in range(3):
    loss = train(epoch, model, optimizer, train_ds)


def gen_sentence():
    """用于测试
    生成随机的初始状态state（注：根据相关源代码，若生成一个序列的初始状态，只取其中第一个），
    以开始符bos作为初始输入cur_token，执行50次get_next_token方法，每一次执行，更新输入cur_token为执行后的输出，
    状态state为执行后的状态，将更新后的输入与状态作为下一次执行的参数。收集输出值，并将其重新转化为汉字。
    :return: 转化为汉字的诗词，每个字存储为列表的一个元素[id2word[t] for t in collect]
    """
    state = [tf.random.normal(shape=(1, 128), stddev=0.5)]
    cur_token = tf.constant([word2id['bos']], dtype=tf.int32)
    collect = []
    for _ in range(50):
        cur_token, state = model.get_next_token(cur_token, state)
        collect.append(cur_token.numpy()[0])
    return [id2word[t] for t in collect]


# 将gen_sentence的返回值拼接成一个字符串，进行输出（顶层代码）
print(''.join(gen_sentence()))

输出结果：(代码不是我写的，无能为力。。。)

每次运行结果不同，但是一言难尽。上面的代码中默认只训练前500首，可以将其注释（见第39行code），训练时间稍长，下面的我其中一次运行的输出结果：

就吐槽一句，chatGPT要是见到这玩意儿估计能气死。。。。。

七、使用异步序列到序列编码器-解码器的方法完成诗词创作任务

循环神经网络的三种模式

循环神经网络可以应用到很多不同类型的机器学习任务中，我们根据这些任务的特点将其分为以下三种模式：序列到类别的模式、同步的序列到序列模式、异步的序列到序列模式。

参考：邱锡鹏《神经网络与深度学习》

代码实现：

时间不够充裕,后面有时间单独发一篇,敬请关注。

八、拓展练习

使用卷积神经网络对cifar10数据进行10分类预测，并在训练结束后，以corgi.jpg为例，尝试画出某一个卷积层的输出特征向量映射，以观察卷积神经网络的运作逻辑。

cifar10数据集介绍

CIFAR-10数据集由10类32x32的彩色图片组成，一共包含60000张图片，每一类包含6000图片。其中50000张图片作为训练集，10000张图片作为测试集。CIFAR-10数据集被划分成了5个训练的batch和1个测试的batch，每个batch均包含10000张图片。测试集batch的图片是从每个类别中随机挑选的1000张图片组成的,训练集batch以随机的顺序包含剩下的50000张图片。不过一些训练集batch可能出现包含某一类图片比其他类的图片数量多的情况。训练集batch包含来自每一类的5000张图片，一共50000张训练图片。下图显示的是数据集的类，以及每一类中随机挑选的10张图片，如图 1 CIFAR-10数据集：

数据集下载：

下载极慢，建议去官网下载 CIFAR-10数据集

代码实现：

见后面博文...

你可能感兴趣的:(学习笔记,AI-机器学习,cnn,rnn,深度学习,人工智能,神经网络)

深度学习--概率 fantasy_arch 深度学习人工智能
1基本概率论1.1假设我们掷骰子，想知道1而不是看到另一个数字的概率，如果骰子是公司，那么所有6个结果(1..6),都有相同的可能发生，因此，我们可以说1发生的概率为1/6.然而现实生活中，对于我们从工厂收到的真实骰子，我们需要检查它是否有瑕疵，唯一的办法就是多投掷骰子，对于每个骰子观察到的[1.2...6]的概率随着投掷次数的增加，越来越接近1/6.导入必要的包%matplotlibinline
国内外的网络安全成难题，IPLOOK 2022年用产品筑起“护城墙” 爱浦路 IPLOOK 网络安全安全架构
《爱尔兰时报》和爱尔兰国家广播电台（RTE）于12月31日对2021年爱尔兰科技行业的赢家和弱点进行了年终盘点。双方纷纷表示，2021年爱尔兰科技行业最大的弱点是爱尔兰的网络安全，这一年是一场前所未有的灾难。随着人工智能、大数据、5G等新兴技术的发展，企业面临的威胁日益增加，信息安全的重要性变得越来越突显。现在我们把视线从爱尔兰的网络安全问题拉回到国内的网络安全现状。我国对网络安全问题保持时刻警惕
JavaWeb学习笔记时间会给答案scidag java java-ee servlet 笔记学习数据库
一.刨析JDBC1.概念：JDBC就是java语言操作关系型数据库的一套API2.常用API2.1DriverManager:作用1.注册驱动2.获取数据库连接;都是静态方法，直接类名.方法2.2Connection:作用1.获取sql执行对象2.事务管理《《关于管理事务回滚常用方法setAutoCommit（）commit(),rollback()2.3Statement:作用执行SQL语句《《
QT学习笔记(常用控件) 四代目水门 QT学习笔记 qt 学习笔记
QT学习笔记一、QTGUI类继承体系QObject（基类）└──QWidget（所有可视化控件基类）├──QAbstractButton（按钮类基类）│├──QPushButton│├──QRadioButton│└──QCheckBox├──QFrame（带边框控件基类）│└──QLabel├──QLayout（布局管理器基类）└──其他控件类...核心类说明：QObject：所有QT对象的基类
利用AI与MySQL提升工业物联网健康监测的智慧水平——构建预测性维护的新纪元墨夶数据库学习资料1 人工智能 mysql 物联网
在工业4.0和智能制造的大背景下，如何确保生产设备的高效稳定运行成为企业竞争力的核心要素之一。传统的事后维修方式已经难以满足现代制造业的需求，而基于人工智能（AI）的预测性维护系统则为这一挑战提供了全新的解决方案。今天，我们将深入探讨如何结合AI技术和MySQL数据库，打造一个智能、高效的工业物联网（IIoT）健康监测平台，助力企业在激烈的市场竞争中脱颖而出。一、为什么选择AI+MySQL？1.A
MySQL中基于机器学习的自适应缓存热点识别优化策略——开启数据库性能新纪元墨夶数据库学习资料1 数据库 mysql 机器学习
在数据驱动的世界里，数据库的性能直接影响到整个应用系统的响应速度和用户体验。随着业务量的增长和技术的发展，传统的缓存机制逐渐暴露出局限性。如何更智能地识别并利用热点数据进行缓存优化，成为提升数据库性能的关键所在。今天，我们将深入探讨一种创新的方法——基于机器学习的自适应缓存热点识别优化策略，并分享其在MySQL中的具体实现方案。为什么选择机器学习？‍传统上，开发者们依赖于手动配置或预设规则来决定哪
Open3D 点云DBSCAN聚类算法 MelaCandy 算法聚类 numpy 计算机视觉图像处理 3d
目录一、DBSCAN基本原理二、代码实现2.1关键函数2.2完整代码三、实现效果3.1原始点云3.2聚类后点云Open3D点云算法汇总及实战案例汇总的目录地址：Open3D点云算法与点云深度学习案例汇总（长期更新）-CSDN博客一、DBSCAN基本原理DBSCAN（Density-BasedSpatialClusteringofApplicationswithNoise）是一种基于密度的聚类算法，
密码学，算法在人工智能的实战利用 china—hbaby 人工智能密码学
在人工智能（AI）的快速发展中，数据安全和隐私保护成为了核心议题。密码学，作为保护信息安全的基石，其在AI领域的应用显得尤为重要。本文将探讨密码学在AI中的利用，并提供一些代码示例来展示其实际应用。密码学的概述即常用加密方式密码学（Cryptography）是数学和计算机科学的一个分支，它涉及保护信息的安全性和隐私性。密码学的主要目标是确保信息在传输过程中不被未授权的第三方读取或篡改，以及确保信息
【人工智能时代】-人工智能发展史：1900~2023 xiaoli8748_软件开发人工智能时代人工智能搜索引擎
第一阶段：人工智能发展历史：1900-19591909年西班牙工程师LeonardoTorresyQuevedo发明了“Occultus”，这是一个可以自动执行国际象棋对弈的机器，预示了未来的计算智能。
Qt学习之路学习笔记3 delphi863
1，文件对方框创建file对象，选择打开方式，打开后传递给QTextStream，读取，赋给QText显示，关闭文件。（QTextStream::readAll()直接读取文件所有内容，如果这个文件有100M，程序会立刻死掉）实际应用中，分段读入怎么处理？2、事件中的继承自QLabel的鼠标事件label->setMouseTracking(true);设置后才能允许就跟踪，否则需要点击一次，才跟
目标检测领域总结：从传统方法到 Transformer 时代的革新 DoYangTan 目标检测系列目标检测 transformer 人工智能
目标检测领域总结：从传统方法到Transformer时代的革新目标检测是计算机视觉领域的一个核心任务，它的目标是从输入图像中识别并定位出目标物体。随着深度学习的兴起，目标检测方法已经取得了显著的进展。从最早的传统方法到现如今基于Transformer的先进算法，目标检测的发展经历了多个重要的阶段。本文将详细总结目标检测领域的演进，涵盖传统方法、两阶段检测方法、单阶段检测方法和基于Transform
2024MathorCup数学建模之——MathorCup奖杯”获得者经验思路分享美赛数学建模数学建模
一、经验分享1.工具选择：顺手即可。Matlab和Python都是比较主流的选择，二者的应用场合各有不同。Python在数据分析、深度学习方面的优势愈发明显，而Matlab更适合进行物理仿真和数值计算。不过随着Python社区不断发展，其功能也愈发全面与强大，因此我们比较推荐学有余力的情况下可以更早接触Python。2.模型算法：多多益善。不一定要精通所有的算法，但是手上至少要准备一些常用的算法（
万字深度解析：DeepSeek-V3为何成为大模型时代的“速度之王“？羊不白丶大模型算法
引言在AI军备竞赛白热化的2024年，DeepSeek-V3以惊人的推理速度震撼业界：相比前代模型推理速度提升3倍，训练成本降低70%。这背后是十余项革命性技术的叠加创新，本文将为您揭开这艘"AI超跑"的性能密码。DeepSeek-V3的技术路径证明：计算效率的本质是知识组织的效率。其MoE架构中2048个专家的动态协作，恰似人脑神经网络的模块化运作——每个专家不再是被动执行计算的"劳工"，而是具
AI人工智能软件开发方案：开启智能时代的创新钥匙广州硅基技术官方人工智能
一、引言：AI浪潮下的软件开发新机遇近年来，人工智能（AI）技术的迅猛发展如同一股汹涌澎湃的浪潮，席卷了全球各个领域。从最初的概念提出到如今的广泛应用，AI历经了漫长的发展历程，终于迎来了属于它的黄金时代。回首过去，AI的发展并非一帆风顺，早期由于计算能力和算法的限制，经历了多次起伏。但随着大数据、云计算、机器学习、深度学习等技术的不断突破，AI迎来了爆发式增长。如今，AI已经深入到人们生活和工作
深度学习框架PyTorch——从入门到精通（6.2）自动微分机制 Fansv587 深度学习 pytorch 人工智能经验分享 python 机器学习
本节自动微分机制是上一节自动微分的扩展内容自动微分是如何记录运算历史的保存张量非可微函数的梯度在本地设置禁用梯度计算设置requires_grad梯度模式（GradModes）默认模式（梯度模式）无梯度模式推理模式评估模式（`nn.Module.eval()`）自动求导中的原地操作原地操作的正确性检查多线程自动求导CPU上的并发不确定性计算图保留自动求导节点的线程安全性C++钩子函数不存在线程安全
神经网络中层与层之间的关联 iisugar 神经网络深度学习计算机视觉
目录1.层与层之间的核心关联：数据流动与参数传递1.1数据流动（ForwardPropagation）1.2参数传递（BackwardPropagation）2.常见层与层之间的关联模式2.1典型全连接网络（如手写数字分类）2.2卷积神经网络（CNN，如图像分类）2.3循环神经网络（RNN/LSTM，如文本生成）2.4Transformer（如机器翻译）3.层间关联的核心原则3.1数据传递的“管道
Pytorch深度学习教程_9_nn模块构建神经网络 tRNA做科研深度学习保姆教程深度学习 pytorch 神经网络
欢迎来到《深度学习保姆教程》系列的第九篇！在前面的几篇中，我们已经介绍了Python、numpy及pytorch的基本使用，进行了梯度及神经网络的实践并学习了激活函数和激活函数，在上一个教程中我们学习了优化算法。今天，我们将开始使用pytorch构建我们自己的神经网络。欢迎订阅专栏进行系统学习：深度学习保姆教程_tRNA做科研的博客-CSDN博客目录1.理解nn模块：(1)使用nn.Sequent
【机器学习】算法分类 CH3_CH2_CHO 什么？！是机器学习！！机器学习算法有监督学习无监督学习半监督学习强化学习
1、有监督学习1.1定义使用带标签的数据训练模型。有监督学习是机器学习中最常见的一种类型，它利用已知的输入特征和对应的输出标签来训练模型，使模型能够学习到特征与标签之间的映射关系。在训练过程中，模型会不断地调整自身的参数，以最小化预测值与真实标签之间的误差，从而提高预测的准确性。1.2回归问题1.2.1目标预测连续值。回归问题的目标是预测一个连续的数值结果，模型的输出是一个实数值。1.2.2解释回
图神经网络实战——分层自注意力网络盼小辉丶图神经网络从入门到项目实战神经网络人工智能深度学习
图神经网络实战——分层自注意力网络0.前言1.分层自注意力网络1.1模型架构1.2节点级注意力1.3语义级注意力1.4预测模块2.构建分层自注意力网络相关链接0.前言在异构图数据集上，异构图注意力网络的测试准确率为78.39%，比之同构版本有了较大提高，但我们还能进一步提高准确率。在本节中，我们将学习一种专门用于处理异构图的图神经网络架构，分层自注意力网络(hierarchicalself-att
Radiance Fields from VGGSfM和Mast3r:两种先进3D重建方法的比较与分析 2401_87458718 3d
VGGSfM和Mast3r:3D场景重建的新方向在计算机视觉和3D重建领域,如何从2D图像重建3D场景一直是一个充满挑战的研究课题。近年来,随着深度学习技术的发展,一些新的方法被提出并取得了显著的进展。本文将重点介绍两种最新的基于深度学习的3D重建方法:VGGSfM和Mast3r,并通过GaussianSplatting技术对它们的性能进行全面比较和分析。VGGSfM:基于视觉几何的深度结构运动恢
基于 PyTorch 的 MNIST 手写数字分类模型欣然～ pytorch 分类人工智能
一、概述本代码使用PyTorch框架构建了一个简单的神经网络模型，用于解决MNIST手写数字分类任务。代码主要包括数据的加载与预处理、神经网络模型的构建、损失函数和优化器的定义、模型的训练、评估以及最终模型的保存等步骤。二、依赖库torch：PyTorch深度学习框架的核心库，提供了张量操作、自动求导等功能。torch.nn：PyTorch的神经网络模块，包含了各种神经网络层、损失函数等。torc
使用 Baseten 部署和运行机器学习模型的指南 shuoac 机器学习人工智能 python
随着机器学习模型在各个行业中的广泛应用，如何高效地部署和运行这些模型成为一个关键问题。本文将介绍如何使用Baseten平台来部署和服务机器学习模型。Baseten是LangChain生态系统中的一个重要提供者，它提供了所需的基础设施来高效地运行模型。无论是开源模型如Llama2和Mistral，还是专有或经过微调的模型，Baseten都能在专用GPU上运行。技术背景介绍Baseten提供了一种不同
探索Google AI聊天模型的集成和使用 qahaj 人工智能 python
随着人工智能的飞速发展，GoogleAI的聊天模型提供了强大的自然语言处理能力，可以应用于多种场景中。本文将为你介绍如何通过GoogleAI和LangChain库来使用这些聊天模型。技术背景介绍GoogleAI提供了一系列强大的聊天模型，这些模型具备不同的功能和参数设置。它们不仅可以通过GoogleAI服务访问，还可以通过GoogleCloudVertexAI以企业级功能使用。在本文中，我们将重点
“租赁业务ERP+deepseek”模式的应用软件研究员汽车 DeepSeek 汽车租赁系统
汽车租赁业务从上世纪90年代发展至今，从传统的人工管理到软件辅助，随着互联网的发展，业务公司对汽车租赁系统提出了更高的要求，比如自助订单，业务推广、客户资质评估，车辆风控，风险预警等，又随着近期人工智能的出现，业务公司对业务系统的期望更高，期望都节约更多人工成本，让管理变得简单快捷高效和智能。所以就引发人们新的启发：“业务系统ERP+deepseek”，但业务系统ERP+deepseek能否满足业
CCNP之IGP学习笔记（2022）码龄4年审核中笔记 OSPF RIP EIGRP IGP CCNP
evecommunityedition2.0.3-92_v1.4.1.ovaOVF（OpenVirtualizationFormat：开放虚拟化格式）和OVA（OpenVirtualizationAppliance：开放虚拟化设备）appliance器具collaborative合作的；协力完成的translation翻译；译文；译本；转化CollaborativeTranslationFrame
高效快速教你DeepSeek如何进行本地部署并且可视化对话大富大贵7 程序员知识储备1 程序员知识储备2 程序员知识储备3 经验分享
科技文章：高效快速教你DeepSeek如何进行本地部署并且可视化对话摘要：随着自然语言处理（NLP）技术的进步，DeepSeek作为一款基于深度学习的语义搜索技术，广泛应用于文本理解、对话系统及信息检索等多个领域。本文将探讨如何高效快速地在本地部署DeepSeek，并结合可视化工具实现对话过程的监控与分析。通过详尽的步骤、案例分析与代码示例，帮助开发者更好地理解和应用DeepSeek技术。同时，本
机器学习——分类、回归、聚类、LASSO回归、Ridge回归（自用）代码的建筑师模型学习模型训练机器学习机器学习分类回归正则化项 LASSO Ridge 朴素
纠正自己的误区：机器学习是一个大范围，并不是一个小的方向，比如：线性回归预测、卷积神经网络和强化学都是机器学习算法在不同场景的应用。机器学习最为关键的是要有数据，也就是数据集名词解释：数据集中的一行叫一条样本或者实例，列名称为特征或者属性。样本的数量称为数据量，特征的数量称为特征维度机器学习常用库：Numpy和sklearn朴素的意思是特征的各条件都是相互独立的机器学习（模型、策略、算法）损失函数
量化交易系统中如何处理机器学习模型的训练和部署？ openwin_top 量化交易系统开发机器学习人工智能量化交易
microPythonPython最小内核源码解析NI-motion运动控制c语言示例代码解析python编程示例系列python编程示例系列二python的Web神器Streamlit如何应聘高薪职位量化交易系统中，机器学习模型的训练和部署需要遵循一套严密的流程，以确保模型的可靠性、性能和安全性。以下是详细描述以及相关的示例：1.数据收集和预处理数据收集在量化交易中，数据是最重要的资产。收集的数
不懂英语可以学编程吗?,不懂英文可以学编程吗 P5688346 人工智能
大家好，给大家分享一下英语不好能学python编程吗，很多人还不知道这一点。下面详细解释一下。现在让我们来看看！Sourcecodedownload:本文相关源码提到人工智能，就不得不提Python编程语言，大多数人觉得编程语言肯定会涉及到很多代码，满屏的英文字母，想想就头疼，觉得自己不会英语，肯定学不好Python，但是不会英语到底能不能够学习Python呢，下面小编给大家分析分析。其实各位想要
计算机基础：编码04，认识反码和补码水饺编程 MFC学习笔记 Win32学习笔记 windows c++mfc c语言
专栏导航本节文章分别属于《Win32学习笔记》和《MFC学习笔记》两个专栏，故划分为两个专栏导航。读者可以自行选择前往哪个专栏。（一）WIn32专栏导航上一篇：计算机基础：编码03，根据十进制数，求其原码回到目录下一篇：无（二）MFC专栏导航上一篇：计算机基础：编码03，根据十进制数，求其原码回到目录下一篇：无本节前言在前两节，我讲解了关于原码的知识。本节，我来讲解反码和补码。在学习本节之前，你需
jdk tomcat 环境变量配置 Array_06 java jdk tomcat
Win7 下如何配置java环境变量 1。准备jdk包，win7系统，tomcat安装包（均上网下载即可） 2。进行对jdk的安装，尽量为默认路径（但要记住啊！！以防以后配置用。。。） 3。分别配置高级环境变量。电脑-->右击属性-->高级环境变量-->环境变量。分别配置 : path &nbs
Spring调SDK包报java.lang.NoSuchFieldError错误 bijian1013 java spring
在工作中调另一个系统的SDK包，出现如下java.lang.NoSuchFieldError错误。 org.springframework.web.util.NestedServletException: Handler processing failed; nested exception is java.l
LeetCode[位运算] - #136 数组中的单一数 Cwind java 题解位运算 LeetCode Algorithm
原题链接：#136 Single Number 要求：给定一个整型数组，其中除了一个元素之外，每个元素都出现两次。找出这个元素注意：算法的时间复杂度应为O(n)，最好不使用额外的内存空间难度：中等分析：题目限定了线性的时间复杂度，同时不使用额外的空间，即要求只遍历数组一遍得出结果。由于异或运算 n XOR n = 0, n XOR 0 = n，故将数组中的每个元素进
qq登陆界面开发 15700786134 qq
今天我们来开发一个qq登陆界面，首先写一个界面程序，一个界面首先是一个Frame对象，即是一个窗体。然后在这个窗体上放置其他组件。代码如下： public class First { public void initul(){ jf=ne
Linux的程序包管理器RPM 被触发 linux
在早期我们使用源代码的方式来安装软件时，都需要先把源程序代码编译成可执行的二进制安装程序，然后进行安装。这就意味着每次安装软件都需要经过预处理-->编译-->汇编-->链接-->生成安装文件--> 安装，这个复杂而艰辛的过程。为简化安装步骤，便于广大用户的安装部署程序，程序提供商就在特定的系统上面编译好相关程序的安装文件并进行打包，提供给大家下载，我们只需要根据自己的
socket通信遇到EOFException 肆无忌惮_ EOFException
java.io.EOFException at java.io.ObjectInputStream$PeekInputStream.readFully(ObjectInputStream.java:2281) at java.io.ObjectInputStream$BlockDataInputStream.readShort(ObjectInputStream.java:
基于spring的web项目定时操作知了ing java Web
废话不多说，直接上代码，很简单配置一下项目启动就行 1，web.xml <?xml version="1.0" encoding="UTF-8"?> <web-app xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xmlns="h
树形结构的数据库表Schema设计矮蛋蛋 schema
原文地址： http://blog.csdn.net/MONKEY_D_MENG/article/details/6647488 程序设计过程中，我们常常用树形结构来表征某些数据的关联关系，如企业上下级部门、栏目结构、商品分类等等，通常而言，这些树状结构需要借助于数据库完成持久化。然而目前的各种基于关系的数据库，都是以二维表的形式记录存储数据信息，
maven将jar包和源码一起打包到本地仓库 alleni123 maven
http://stackoverflow.com/questions/4031987/how-to-upload-sources-to-local-maven-repository <project> ... <build> <plugins> <plugin> <groupI
java IO操作与 File 获取文件或文件夹的大小，可读，等属性！！！百合不是茶
类 File File是指文件和目录路径名的抽象表示形式。 1，何为文件：标准文件（txt doc mp3...）目录文件（文件夹）虚拟内存文件 2，File类中有可以创建文件的 createNewFile（）方法,在创建新文件的时候需要try{} catch(）{}因为可能会抛出异常；也有可以判断文件是否是一个标准文件的方法isFile();这些防抖都
Spring注入有继承关系的类（2） bijian1013 java spring
被注入类的父类有相应的属性，Spring可以直接注入相应的属性，如下所例：1.AClass类 package com.bijian.spring.test4; public class AClass { private String a; private String b; public String getA() { retu
30岁转型期你能否成为成功人士 bijian1013 成长励志
很多人由于年轻时走了弯路，到了30岁一事无成，这样的例子大有人在。但同样也有一些人，整个职业生涯都发展得很优秀，到了30岁已经成为职场的精英阶层。由于做猎头的原因，我们接触很多30岁左右的经理人，发现他们在职业发展道路上往往有很多致命的问题。在30岁之前，他们的职业生涯表现很优秀，但从30岁到40岁这一段，很多人
【Velocity四】Velocity与Java互操作 bit1129 velocity
Velocity出现的目的用于简化基于MVC的web应用开发，用于替代JSP标签技术，那么Velocity如何访问Java代码.本篇继续以Velocity三http://bit1129.iteye.com/blog/2106142中的例子为基础， POJO package com.tom.servlets; public
【Hive十一】Hive数据倾斜优化 bit1129 hive
什么是Hive数据倾斜问题操作：join,group by,count distinct 现象：任务进度长时间维持在99%（或100%），查看任务监控页面，发现只有少量（1个或几个）reduce子任务未完成；查看未完成的子任务，可以看到本地读写数据量积累非常大，通常超过10GB可以认定为发生数据倾斜。原因：key分布不均匀倾斜度衡量：平均记录数超过50w且
在nginx中集成lua脚本：添加自定义Http头，封IP等 ronin47 nginx lua csrf
Lua是一个可以嵌入到Nginx配置文件中的动态脚本语言，从而可以在Nginx请求处理的任何阶段执行各种Lua代码。刚开始我们只是用Lua 把请求路由到后端服务器，但是它对我们架构的作用超出了我们的预期。下面就讲讲我们所做的工作。强制搜索引擎只索引mixlr.com Google把子域名当作完全独立的网站，我们不希望爬虫抓取子域名的页面，降低我们的Page rank。 location /{
java-3.求子数组的最大和 bylijinnan java
package beautyOfCoding; public class MaxSubArraySum { /** * 3.求子数组的最大和题目描述：输入一个整形数组，数组里有正数也有负数。数组中连续的一个或多个整数组成一个子数组，每个子数组都有一个和。求所有子数组的和的最大值。要求时间复杂度为O(n)。例如输入的数组为1, -2, 3, 10, -4,
Netty源码学习-FileRegion bylijinnan java netty
今天看org.jboss.netty.example.http.file.HttpStaticFileServerHandler.java 可以直接往channel里面写入一个FileRegion对象，而不需要相应的encoder： //pipeline（没有诸如“FileRegionEncoder”的handler）： public ChannelPipeline ge
使用ZeroClipboard解决跨浏览器复制到剪贴板的问题 cngolon 跨浏览器复制到粘贴板 Zero Clipboard
Zero Clipboard的实现原理 Zero Clipboard 利用透明的Flash让其漂浮在复制按钮之上，这样其实点击的不是按钮而是 Flash ，这样将需要的内容传入Flash，再通过Flash的复制功能把传入的内容复制到剪贴板。 Zero Clipboard的安装方法首先需要下载 Zero Clipboard的压缩包，解压后把文件夹中两个文件：ZeroClipboard.js
单例模式 cuishikuan 单例模式
第一种（懒汉，线程不安全）： public class Singleton { 2 private static Singleton instance; 3 pri
spring+websocket的使用 dalan_123
一、spring配置文件 <?xml version="1.0" encoding="UTF-8"?><beans xmlns="http://www.springframework.org/schema/beans" xmlns:xsi="http://www.w3.or
细节问题：ZEROFILL的用法范围。 dcj3sjt126com mysql
1、zerofill把月份中的一位数字比如1，2，3等加前导0 mysql> CREATE TABLE t1 (year YEAR(4), month INT(2) UNSIGNED ZEROFILL, -> day
Android开发10——Activity的跳转与传值 dcj3sjt126com Android开发
Activity跳转与传值，主要是通过Intent类，Intent的作用是激活组件和附带数据。一、Activity跳转方法一Intent intent = new Intent(A.this, B.class); startActivity(intent) 方法二Intent intent = new Intent();intent.setCla
jdbc 得到表结构、主键 eksliang jdbc 得到表结构、主键
转自博客：http://blog.csdn.net/ocean1010/article/details/7266042 假设有个con DatabaseMetaData dbmd = con.getMetaData(); rs = dbmd.getColumns(con.getCatalog(), schema, tableName, null); rs.getSt
Android 应用程序开关GPS gqdy365 android
要在应用程序中操作GPS开关需要权限： <uses-permission android:name="android.permission.WRITE_SECURE_SETTINGS" /> 但在配置文件中添加此权限之后会报错，无法再eclipse里面正常编译，怎么办？ 1、方法一：将项目放到Android源码中编译； 2、方法二：网上有人说cl
Windows上调试MapReduce zhiquanliu mapreduce
1.下载hadoop2x-eclipse-plugin https://github.com/winghc/hadoop2x-eclipse-plugin.git 把 hadoop2.6.0-eclipse-plugin.jar 放到eclipse plugin 目录中。 2.下载 hadoop2.6_x64_.zip http://dl.iteye.com/topics/download/d2b
如何看待一些知名博客推广软文的行为？ justjavac 博客
本文来自我在知乎上的一个回答：http://www.zhihu.com/question/23431810/answer/24588621 互联网上的两种典型心态：当初求种像条狗，如今撸完嫌人丑当初搜贴像条犬，如今读完嫌人软你为啥感觉不舒服呢？难道非得要作者把自己的劳动成果免费给你用，你才舒服？就如同 Google 关闭了 Gooled Reader，那是
sql优化总结 macroli sql
为了是自己对sql优化有更好的原则性，在这里做一下总结，个人原则如有不对请多多指教。谢谢！要知道一个简单的sql语句执行效率，就要有查看方式，一遍更好的进行优化。一、简单的统计语句执行时间 declare @d datetime ---定义一个datetime的变量set @d=getdate() ---获取查询语句开始前的时间select user_id
Linux Oracle中常遇到的一些问题及命令总结超声波 oracle linux
1.linux更改主机名 (1)#hostname oracledb　　　　临时修改主机名 (2) vi /etc/sysconfig/network 　　修改hostname (3) vi /etc/hosts　　　　　　　　修改IP对应的主机名 2.linux重启oracle实例及监听的各种方法（注意操作的顺序应该是先监听，后数据库实例） &nbs
hive函数大全及使用示例 superlxw1234 hadoop hive函数
具体说明及示例参见附件文档。文档目录：目录一、关系运算： 4 1. 等值比较: = 4 2. 不等值比较: <> 4 3. 小于比较: < 4 4. 小于等于比较: <= 4 5. 大于比较: > 5 6. 大于等于比较: >= 5 7. 空值判断: IS NULL 5
Spring 4.2新特性-使用@Order调整配置类加载顺序 wiselyman spring 4
4.1 @Order Spring 4.2 利用@Order控制配置类的加载顺序 4.2 演示两个演示bean package com.wisely.spring4_2.order; public class Demo1Service { } package com.wisely.spring4_2.order; public class