蓑衣老汉

Tensorflow笔记——搭建神经网络

一、基本概念

基于Tensorflow的NN：

用张量表示数据
用计算图搭建神经网络
用会话执行计算图
优化线上的权重（参数），得到模型

1.张量：就是多维数组（列表），用“阶”表示张量的维度。

0阶张量称作标量，表示一个单独的数：比如 S=123

1阶张量称作向量，表示一维数组：比如 V=[1,2,3]

2阶张量称作矩阵，表示二维数组：比如 m=[ [1, 2, 3], [4, 5, 6], [7, 8, 9] ]

判断张量是几阶的，就通过张量右边的方括号数，0个是0阶，n个是n阶，张量可以表示0阶到n阶数组（列表）；

比如：t=[ [ [ ...] ] ] 为3阶

2.数据类型：Tensorflow的数据类型有tf.float32、tf.int32等。

2.1加法模块

import tensorflow as tf

a = tf.constant([1.0, 2.0])
b = tf.constant([3.0, 4.0])
result = a + b
print(result)

结果：Tensor("add:0", shape=(2,), dtype=float32)

意思：名称：add:0 ， shape=(2,)为一维数组长度为2（也就是2行1列。shape=(2，2)表示2行2列），dtype=float32表示数据类型为浮点型

3.计算图：搭建神经网络的计算过程，是承载一个或多个计算节点的一张图，只搭建网络，不运算。

神经网络的基本模型是神经元，神经元的基本模型其实就是数学中的乘、加运算。

搭建如下的计算图：

其中输入：X1、X2 ，W1、W2为权值，输出：y = X1*W1 + X2*W2。

实现上述计算图：

import tensorflow as tf

x = tf.constant([[1.0, 2.0]])  # 定义一个2阶张量,表示1行2列
w = tf.constant([[3.0], [4.0]])  # 定义一个2阶张量,表示2行1列
y = tf.matmul(x, w)  # 实现xw矩阵乘法
print(y)

结果：Tensor("MatMul:0", shape=(1, 1), dtype=float32) 显然是一个1行1列的张量

但是由于只搭建承载计算过程的计算图，并没有运算，如果我们想得到运算结果就要用到“会话Session()”了。

4.会话（Session）：执行计算图中的节点运算

使用with结构实现，语法如下：

with tf.Session() as sess:
    print(sess.run(y))

结果：[[11.]]

可以看到，运行会话之前只打印出y是张量，运行会话之后会打印出运算结果。

二、神经网络

神经网络的参数
神经网络的搭建
前向传播
反向传播
搭建神经网络的八股

1.神经网络的参数：指神经元线上的权重w，用变量表示。

一般会先随机生成这些参数，生成参数的方法是让w等于tf.Variable，把生成的方式写在括号里。

神经网络中常用的生成随机数/数组的函数有：

tf.random_normal      # 生成正态分布随机数
tf.truncated_normal   # 生成去掉过大偏离点的正态分布随机数
tf.random_uniform     # 生成均匀分布随机数
tf.zeros              # 表示生成全0数组
tf.ones               # 表示生成全1数组
tf.fill               # 表示生成全定值数组
tf.constant           # 表示生成直接给定值的数组

举例：

w = tf.Variable(tf.random_normal([2, 3], stddev=2, mean=0, seed=1))	表示生成正态分布随机数，两行三列，标准差是2，均值为1，随机种子为1.
`w = tf.Variable(tf.truncated_normal([2, 3], stddev=2, mean=0, seed=1))`	表示生成去掉过大偏离点的正态分布随机数，也就是如果随机出来的数据偏离平均值超过2个标准差，这个数据将重新生成
`w = tf.Variable(tf.random_uniform(shape=7, minval=0, maxval=1, dtype=tf.int32, seed=1))`	表示从一个均匀分布[minval,maxval]中随机采样，注意定义域是左闭右开，即包含minval, 不包含maxval.
除了生成随机数，还可以生成常量。 `tf.zeros([3, 2], tf.int32) tf.ones([3, 2], tf.int32) tf.fill([3, 2], 6) tf.constant([3, 2, 1])`	分别表示生成[[0, 0], [0, 0], [0, 0]] 生成[[1, 1], [1, 1], [1, 1]] 生成[[6, 6], [6, 6], [6, 6]] 生成[3, 2, 1]
注意：1.随机种子如果去掉，每次生成随机数将不一致。 2.如果没有特殊要求标准差、均值、随机种子是可以不写的。

2.神经网络的搭建

了解了张量、计算图、会话和参数后，就可以开始动手搭建神经网络了。

准备数据集，提取特征，作为输出传送给神经网络
搭建NN结构，从输入到输出（先搭建计算图，再用会话执行）：NN前向传播算法——>计算输出
大量特征数据喂给NN，迭代优化NN参数：NN反向传播算法——>优化参数(权值w)训练模型
使用训练好的模型预测和分类

由此可见：基于神经网络的机器学习主要分为两个过程：训练过程和使用过程。

训练过程：第一步、第二步、第三步的循环迭代。

使用过程：第四步，一旦参数优化完成就可以固定这些参数，实现特定应用了。

很多实际应用中，我们会先使用现有的成熟网络结构，喂给新的数据，训练相应模型，判断是否能对喂入的从未见过的新数据作出正确的响应，再适当更改网络结构，反复迭代，让机器自动训练参数找到最优结构和参数，以固定专用模型。

3.前向传播：就是搭建模型的计算过程，让模型具有推理能力，可以针对一组输入，给出相应的输出。

假如生产一批零件，体积为 x1，重量为 x2，体积和重量就是我们选择的特征，把它们喂入神经网络，当体积和重量这组数据走过神经网络后会得到一个输出。假如输入的特征值是：体积 0.7 重量 0.5

由搭建的神经网络可得，隐藏层节点 a11=x1* w11+x2*w21=0.14+0.15=0.29，同理算得节点 a12=0.32，a13=0.38，最终计算得到输出层 Y= -0.015，这便实现了前向传播过程。

推导过程：

第一层

X 是输入为 1X2 矩阵 用 x 表示输入，是一个 1 行 2 列矩阵，表示一次输入一组特征，这组特征包含了体积和重量两个元素。

W 前节点编号，后节点编号 (层数) 为待优化的参数 对于第一层的 w 前面有两个节点，后面有三个节点 w 应该是个两行三列矩阵，

我们这样表示：

神经网络共有几层（或当前是第几层网络）都是指的计算层，输入不是计算层， 所以 a 为第一层网络，a 是一个一行三列矩阵。

我们这样表示： a(1)=[a11, a12, a13]=XW1

第二层

参数要满足前面三个节点，后面一个节点，所以 W2是三行一列矩阵。

我们这样表示：

我们把每层输入乘以线上的权重 w，这样用矩阵乘法可以计算出输出 y 了。

a= tf.matmul(X, W1)

y= tf.matmul(a, W2)

由于需要计算结果，就要用 with 结构实现，所有变量初始化过程、计算过程都要放到 sess.run 函数中。

对于变量初始化：在 sess.run(tf.global_variables_initializer) 实现对所有变量初始化，也就是赋初值。

对于计算图中的运算，我们直接把运算节点填入 sess.run 即可，比如要计算输出 y，直接写 sess.run(y) 即可。

在实际应用中，我们可以一次喂入一组或多组输入，让神经网络计算输出 y，可以先用 tf.placeholder 给输入占位。

如果一次喂一组数据 shape 的第一维位置写 1，第二维位置看有几个输入特征；

如果一次想喂多组数据，shape 的第一维位置可以写 None 表示先空着，第二维位置写有几个输入特征。

这样在 feed_dict 中可以喂入若干组体积重量了。

前向传播过程的 tensorflow 描述：

(1) 变量初始化、计算图节点运算都要用会话（with 结构）实现

with tf.Session() as sess:

sess.run()

(2)变量初始化：在 sess.run 函数中用 tf.global_variables_initializer() 汇总所有待优化变量。

init_op = tf.global_variables_initializer()

sess.run(init_op)

(3)计算图节点运算：在 sess.run 函数中写入待运算的节点

sess.run(y)

(4)用 tf.placeholder 占位，在 sess.run 函数中用 feed_dict 喂数据

喂一组数据： x = tf.placeholder(tf.float32, shape=(1, 2))

sess.run(y, feed_dict={x: [[0.5,0.6]]})

喂多组数据： x = tf.placeholder(tf.float32, shape=(None, 2))

sess.run(y, feed_dict={x: [[0.1,0.2],[0.2,0.3],[0.3,0.4],[0.4,0.5]]})

举例

这是一个实现神经网络前向传播过程，网络可以自动推理出输出 y 的值。

①用 placeholder 实现输入定义（sess.run 中喂入一组数据）的情况

第一组喂体积 0.7、重量 0.5

import tensorflow as tf

# 定义输入和参数
x = tf.placeholder(tf.float32, shape=(1, 2))
w1 = tf.Variable(tf.random_normal([2, 3], stddev=1, seed=1))
w2 = tf.Variable(tf.random_normal([3, 1], stddev=1, seed=1))

# 定义前向传播过程
a = tf.matmul(x, w1)
y = tf.matmul(a, w2)

# 用会话计算结果
with tf.Session() as sess:
    init_op = tf.global_variables_initializer()  # 初始化所有待优化变量
    sess.run(init_op)
    print("y in tf3_3.py is:", sess.run(y, feed_dict={x: [[0.7, 0.5]]}))

# 输出结果：y in tf3_3.py is: [[3.0904665]]

②用 placeholder 实现输入定义（sess.run 中喂入多组数据）的情况

第一组喂体积 0.7、重量 0.5，第二组喂体积 0.2、重量 0.3，第三组喂体积 0.3 、重量 0.4，第四组喂体积 0.4、重量 0.5.

import tensorflow as tf

# 定义输入和参数
x = tf.placeholder(tf.float32, shape=(None, 2))
w1 = tf.Variable(tf.random_normal([2, 3], stddev=1, seed=1))
w2 = tf.Variable(tf.random_normal([3, 1], stddev=1, seed=1))

# 定义前向传播过程
a = tf.matmul(x, w1)
y = tf.matmul(a, w2)

# 用会话计算结果
with tf.Session() as sess:
    init_op = tf.global_variables_initializer()
    sess.run(init_op)
    print("y in tf3_4.py is:", sess.run(y, feed_dict={x: [[0.7, 0.5],
                                                          [0.2, 0.3], [0.3, 0.4], [0.4, 0.5]]}))

# 输出结果：y in tf3_4.py is: [[3.0904665]  [1.2236414]  [1.7270732] [2.2305048]]

4.反向传播：训练模型参数，在所有参数上用梯度下降，使 NN 模型在训练数据上的损失函数最小。

损失函数（loss）：计算得到的预测值 y 与已知答案 y_的差距。损失函数的计算的方法中均方误差 MSE 是比较常用的方法之一。
均方误差 MSE：求前向传播计算结果与已知答案之差的平方再求平均。

用 tensorflow 函数表示为： loss_mse = tf.reduce_mean(tf.square(y_ - y))

反向传播训练方法：以减小 loss 值为优化目标，有梯度下降、momentum 优化器、adam 优化器等优化方法。

#   这三种优化方法用 tensorflow 的函数可以表示为
train_step=tf.train.GradientDescentOptimizer(learning_rate).minimize(loss)
train_step=tf.train.MomentumOptimizer(learning_rate, momentum).minimize(loss)
train_step=tf.train.AdamOptimizer(learning_rate).minimize(loss)

三种优化方法区别如下：

①tf.train.GradientDescentOptimizer()使用随机梯度下降算法，使参数沿着梯度的反方向，即总损失减小的方向移动，实现更新参数。

②tf.train.MomentumOptimizer()在更新参数时，利用了超参数，参数更新公式是

?? = ???−1 + ?(??−1)

?? = ??−1 − ???

其中，?为学习率，超参数为?，?为参数，?(??−1)为损失函数的梯度。

③tf.train.AdamOptimizer()是利用自适应学习率的优化算法，Adam 算法和随机梯度下降算法不同。随机梯度下降算法保持单一的学习率更新所有的参数，学习率在训练过程中并不会改变。而 Adam 算法通过计算梯度的一阶矩估计和二阶矩估计而为不同的参数设计独立的自适应性学习率。

学习率：决定每次参数更新的幅度。

优化器中都需要一个叫做学习率的参数，使用时，如果学习率选择过大会出现震荡不收敛的情况，如果学习率选择过小，会出现收敛速度慢的情况。我们可以选个比较小的值填入，比如 0.01、0.001。

符号说明： ??表示第l层隐藏层和输出层的输入值；

??表示第l层隐藏层和输出层的输出值；

f(z)表示激活函数；

最后的输出层为第 L 层。

推导过程：

5.搭建神经网络的八股

神经网络的搭建分四步完成：准备工作、前向传播、反向传播和循环迭代。

导入模块，生成模拟数据集； import 、常量定义、生成数据集
前向传播：定义输入(x=, y_=)、参数(w1= ,w2=)和输出(a= ,y=)
反向传播：定义损失函数(loss=)、反向传播方法(train_step=)
生成会话，训练 STEPS 轮

with tf.session() as sess:
    Init_op=tf. global_variables_initializer()
    sess.run(init_op)
    STEPS=3000
    for i in range(STEPS):
        start=
        end=
        sess.run(train_step, feed_dict:)

举例

随机产生 32 组生产出的零件的体积和重量，训练 3000 轮，每 500 轮输出一次损失函数。

下面我们通过源代码进一步理解神经网络的实现过程：

# 导入模块，生成模拟数据集
import tensorflow as tf
import numpy as np
BATCH_SIZE = 8
seed = 23455

# 基于seed产生随机数
rng = np.random.RandomState(seed)
# 随机数返回32行2列的矩阵，表示32组 体积和重量 作为输入数据集
X = rng.rand(32, 2)
# 从矩阵X中取出一行，判断如果和小于1，则给Y赋值1，否则给Y赋值0
# 作为输入数据集的标签（正确答案）
Y = [[int(x0 + x1 < 1)] for (x0, x1) in X]
print("X:", X)
print("Y:", Y)

# 定义神经网络的输入、参数和输出，定义前向传播过程
x = tf.placeholder(tf.float32, shape=(None, 2))
y_ = tf.placeholder(tf.float32, shape=(None, 1))

w1 = tf.Variable(tf.random_normal([2, 3], stddev=1, seed=1))
w2 = tf.Variable(tf.random_normal([3, 1], stddev=1, seed=1))

a = tf.matmul(x, w1)
y = tf.matmul(a, w2)

# 定义损失函数及反向传播方法
loss = tf.reduce_mean(tf.square(y - y_))
train_step = tf.train.GradientDescentOptimizer(0.001).minimize(loss)

# 生成会话，训练STEPS轮
with tf.Session() as sess:
    init_op = tf.global_variables_initializer()
    sess.run(init_op)
    # 输出目前（未经训练）的参数取值
    print("w1:", sess.run(w1))
    print("w2:", sess.run(w2))
    
    # 训练模型
    STEPS = 3000
    for i in range(STEPS):
        start = (i*BATCH_SIZE) % 32
        end = start + BATCH_SIZE
        sess.run(train_step, feed_dict={x: X[start:end], y_: Y[start:end]})
        if i % 500 ==0:
            total_loss = sess.run(loss, feed_dict={x: X, y_: Y})
            print("After %d training step(s), loss on all data is %g" %(i, total_loss))
            
            #输出训练后的参数取值
            print("w1:", sess.run(w1))
            print("w2:", sess.run(w2))

由神经网络的实现结果，我们可以看出，总共训练 3000 轮，每轮从 X 的数据集和 Y 的标签中抽取相对应的从 start 开始到 end 结束个特征值和标签，喂入神经网络，用 sess.run 求出 loss，每 500 轮打印一次 loss 值。经过 3000 轮后，最后打印出最终训练好的参数 w1、w2。

这样四步就可以实现神经网络的搭建了。

Python实现简单的机器学习算法 master_chenchengg python python 办公效率 python开发 IT
Python实现简单的机器学习算法开篇：初探机器学习的奇妙之旅搭建环境：一切从安装开始必备工具箱第一步：安装Anaconda和JupyterNotebook小贴士：如何配置Python环境变量算法初体验：从零开始的Python机器学习线性回归：让数据说话数据准备：从哪里找数据编码实战：Python实现线性回归模型评估：如何判断模型好坏逻辑回归：从分类开始理论入门：什么是逻辑回归代码实现：使用skl
Python前沿技术：机器学习与人工智能 4.0啊 Python 人工智能 python 机器学习
Python前沿技术：机器学习与人工智能一、引言随着科技的飞速发展，机器学习和人工智能（AI）已经成为了计算机科学领域的热门话题。Python作为一门易学易用且功能强大的编程语言，已经成为了这两个领域的首选语言之一。本文将深入探讨Python在机器学习和人工智能领域的应用，以及一些前沿技术和工具。二、Python机器学习基础2.1机器学习概述机器学习是人工智能（AI）的一个关键子集，它的核心在于让
Python自动化办公2.0 即将发布百里图书自动化人工智能 python
第一节课：数据整理与清洗第二节课：数据筛选、过滤与排序第三节课：高级数据处理技巧第四节课：数据可视化与实践案例第五节课：统计分析与报表第六节：常见的Excel报表与下方的课程形成知识体系：Python自动化办公(面向2020,Python3.7,不断更新ing)_在线视频教程-CSDN程序员研修院https://edu.csdn.net/course/detail/28031Python机器学习教
【Python机器学习】循环神经网络（RNN）——传递数据并训练 zhangbin_237 Python机器学习机器学习 python rnn 人工智能开发语言深度学习神经网络
与其他Keras模型一样，我们需要向.fit()方法传递数据，并告诉它我们希望训练多少个训练周期（epoch）：model.fit(X_train,y_train,batch_size=batch_size,epochs=epochs,validation_data=(X_test,y_test))因为个人小电脑内存不足，所以吧maxlen参数改成了100重新运行。保存模型：model_struc
【Python机器学习】循环神经网络（RNN）——对RNN进行预测 zhangbin_237 Python机器学习机器学习 python rnn 深度学习人工智能自然语言处理
目录有状态性双向RNN编码向量如果有一个经过训练的模型，接下来就可以对其进行预测：sample_1="""Ihatethatthedismalweatherhadmedownforsolong,whenwillitbreak!Ugh,whendoeshappinessreturn?Thesunisblindingandthepuffycloudsaretoothin.Ican'twaitforth
Python 机器学习基础之数据表示与特征工程【分箱、离散化、线性模型与树 / 交互特征与多项式特征】的简单说明仙魁XAN Python 机器学习基础+实战案例机器学习 python 分箱离散化线性模型与树交互特征与多项式特征
Python机器学习基础之数据表示与特征工程【分箱、离散化、线性模型与树/交互特征与多项式特征】的简单说明目录Python机器学习基础之数据表示与特征工程【分箱、离散化、线性模型与树/交互特征与多项式特征】的简单说明一、简单介绍二、分箱、离散化、线性模型与树三、交互特征与多项式特征附录一、参考文献一、简单介绍Python是一种跨平台的计算机程序设计语言。是一种面向对象的动态类型语言，最初被设计用于
【Python机器学习】机器学习任务中常见的数据异质问题和模型异构问题是什么？解决策略是什么？惊鸿若梦一书生 Python机器学习 python 深度学习开发语言
文章目录数据异质模型异构数据异质数据异质问题（Heterogeneityindata）通常指数据集内部的不一致性，这些不一致性可能来自多种源。在实际应用中，数据异质性可以表现为多种形式，包括：不同来源的数据：数据可能来自不同的数据源，每个源可能采用不同的数据收集方法和标准。例如，社交媒体数据和传统调查数据就可能有很大的差异。不同类型的数据：数据可以是结构化的（例如，数据库中的表格数据），半结构化的
【Python机器学习】卷积神经网络（CNN）的工具包 zhangbin_237 Python机器学习机器学习 python cnn 神经网络自然语言处理开发语言
Python是神经网络工具包最丰富的语言之一。两个主要的神经网络架构分别是Theano和TensorFlow。这两者的底层计算深度依赖C语言，不过它们都提供了强大的PythonAPI。Torch在Python里面也有一个对应的API是PyTorch。这些框架都是高度抽象的工具集，适用于从头构建模型。Python社区开发了一些第三方库来简化这些底层架构的使用。其中Keras在API的友好性和功能性方
【Python机器学习】卷积神经网络（CNN） zhangbin_237 Python机器学习机器学习 python cnn 开发语言自然语言处理
卷积神经网络（CNN）得名于在数据样本上用滑动窗口（或卷积）的概念。卷积在数学中应用很广泛，通常与时间序列数据相关。它是用一个可视化盒子在一个区域内滑动，如下图所示：构建块卷积神经网络最早出现在图像处理和图像识别领域，它能够捕捉每个样本中数据点之间的空间关系，也就能识别出图像中是猫还是狗。卷积网络，也称为convnet，不像传统的前馈网络那样对每个元素（图中的像素）分配权重，而是定义了一组在图像上
python机器学习算法--贝叶斯算法在下小天n 机器学习 python 机器学习算法
1.贝叶斯定理在20世纪60年代初就引入到文字信息检索中，仍然是文字分类的一种热门（基准）方法。文字分类是以词频为特征判断文件所属类型或其他（如垃圾邮件、合法性、新闻分类等）的问题。原理牵涉到概率论的问题，不在详细说明。sklearn.naive_bayes.GaussianNB(priors=None,var_smoothing=1e-09)#Bayes函数·priors：矩阵，shape=[n
【Rust】——采用发布配置自定义构建 Y小夜 Rust（官方文档重点总结）rust 开发语言后端
博主现有专栏：C51单片机（STC89C516），c语言，c++，离散数学，算法设计与分析，数据结构，Python，Java基础，MySQL，linux，基于HTML5的网页设计及应用，Rust（官方文档重点总结），jQuery，前端vue.js，Javaweb开发，Python机器学习等主页链接：Y小夜-CSDN博客今日学习推荐：在当今这个飞速发展的信息时代，人工智能（AI）已经成为了一个不可或
【Rust】——高级类型 Y小夜 Rust（官方文档重点总结）rust 开发语言后端
博主现有专栏：C51单片机（STC89C516），c语言，c++，离散数学，算法设计与分析，数据结构，Python，Java基础，MySQL，linux，基于HTML5的网页设计及应用，Rust（官方文档重点总结），jQuery，前端vue.js，Javaweb开发，Python机器学习等主页链接：Y小夜-CSDN博客目录为了类型安全和抽象而使用的newtype模式类型别名用来创建类型同义词不返回
【Python机器学习】NLP词频背后的含义——隐性语义分析 zhangbin_237 Python机器学习 python 机器学习自然语言处理人工智能开发语言
隐性语义分析基于最古老和最常用的降维技术——奇异值分解（SVD）。SVD将一个矩阵分解成3个方阵，其中一个是对角矩阵。SVD的一个应用是求逆矩阵。一个矩阵可以分解成3个最简单的方阵，然后对这些方阵求转置后再把它们相乘，就得到了原始矩阵的逆矩阵。它为我们提供了一个对大型复杂矩阵求逆的捷径。SVD适用于桁架结构的应力和应变分析等机械工程问题，它对电气工程中的电路分析也很有用，它甚至在数据科学中被用于基
【Python机器学习】NLP分词——利用分词器构建词汇表（三）——度量词袋之间的重合度 zhangbin_237 Python机器学习机器学习自然语言处理人工智能 python 开发语言
如果能够度量两个向量词袋之间的重合度，就可以很好地估计他们所用词的相似程度，而这也是它们语义上重合度的一个很好的估计。因此，下面用点积来估计一些新句子和原始的Jefferson句子之间的词袋向量重合度：importpandasaspdsentence="""ThomasJeffersonBeganbulidingMonticelliastheageof26.\n"""sentence=senten
【Python机器学习】NLP概述——深度处理 zhangbin_237 Python机器学习 python 机器学习自然语言处理人工智能机器人
自然语言处理流水线的各个阶段可以看作是层，就像是前馈神经网络中的层一样。深度学习就是通过在传统的两层机器学习模型架构（特征提取+建模）中添加额外的处理层来创建更复杂的模型和行为。上图中，前四层对应于聊天机器人流水线中的前两个阶段（特征提取和特征分析）。例如，词性标注（POS标注）是在聊天机器人流水线的分析阶段生成特征的一种方法。POS标签由默认的SpaCY流水线自动生成，该流水线包括上图中所有的前
【Python机器学习】NLP分词——词干还原的挑战 zhangbin_237 Python机器学习自然语言处理人工智能机器学习 python 开发语言
要想使用自然语言处理的相关应用，第一件事就是需要一个强大的词汇表。我们要把文档或任何字符串拆分为离散的有意义的词条，这里说的词条仅限于词、标点符号和数值，但是这里使用的技术可以很容易推广到字符序列包含的任何其他有意义的单元，比如ASCII表情符号、Unicode表情符号和数学符号。从文档中检索词条需要一些字符串处理方法，这些方法不仅仅是str.split()，处理时需要把标点符号与词分开，还需要将
【Python机器学习】NLP概述——自然语言智商 zhangbin_237 Python机器学习机器学习自然语言处理人工智能 python 机器人
就像人类的智能一样，如果不考虑多个智能维度，单凭一个智商分数是无法轻易衡量NLP流水线的能力的。衡量机器人系统能力的一种常见方法是：根据系统行为的复杂性和所需的人类监督成都这两个维度来衡量。但是对自然语言处理流水线而言，其目标是建立一个完全自动化的自然语言处理系统，会消除所有的人工监督（一旦模型被训练和部署）。因此，一对更好的IQ维度应该能捕捉到自然语言流水线复杂的广度和深度。像Alexa或All
【Python机器学习】NLP概述——聊天机器人的自然语言流水线 zhangbin_237 Python机器学习自然语言处理机器人人工智能 python 机器学习
构建对话引擎或者聊天机器人所需的NLP流水线类似于某些问答系统。聊天机器人需要4个处理阶段和一个数据库来维护过去语句和回复的记录。这4个处理阶段中的每个阶段都可以包含一个或多个并行或串行工作的处理算法。如下图所示：1、解析：从自然语言文本中提取特征、结构化数值数；2、分析：通过对文本的情感、语法合法度及语义打分，生成和组合特征；3、生成：使用模板、搜索或语言模型生成可能的回复；4、执行：根据对话历
《Python机器学习项目实战》书籍介绍袁袁袁袁满 python 机器学习开发语言
文章目录书籍介绍主要内容书籍目录书籍介绍《Python机器学习项目实战》带领大家在构建实际项目的过程中，掌握关键的机器学习概念！使用机器学习，我们可完成客户行为分析、价格趋势预测、风险评估等任务。要想掌握机器学习，需要有优质的范例、清晰的讲解和大量的练习。《Python机器学习项目实战》完全满足这三点！《Python机器学习项目实战》展示了现实、实用的机器学习场景，并全面、清晰地介绍了机器学习的关
【Python机器学习】NLP的部分实际应用 zhangbin_237 Python机器学习机器学习自然语言处理人工智能 python 大数据
自然语言处理在现实中非常多的应用，下表是其中的一些例子：应用示例1示例2示例3搜索web文档自动补全编辑拼写语法风格对话聊天机器人助手行程安排写作索引用语索引目录电子邮件垃圾邮件过滤分类优先级排序文本挖掘摘要知识提取医学诊断法律法律断案先例搜索传票分类新闻事件检索真相核查标题排字归属剽窃检测文字取证风格指导情感分析团队士气监控产品评论分类客户关怀行为预测金融选举预测营销创作电影脚本诗歌歌词如果在索
python清华大学出版社答案_Python机器学习及实践 weixin_39805119 python清华大学出版社答案
第1章机器学习的基础知识1.1何谓机器学习1.1.1传感器和海量数据1.1.2机器学习的重要性1.1.3机器学习的表现1.1.4机器学习的主要任务1.1.5选择合适的算法1.1.6机器学习程序的步骤1.2综合分类1.3推荐系统和深度学习1.3.1推荐系统1.3.2深度学习1.4何为Python1.4.1使用Python软件的由来1.4.2为什么使用Python1.4.3Python设计定位1.4.
Python机器学习笔记：CART算法实战战争热诚
完整代码及其数据，请移步小编的GitHub传送门：请点击我如果点击有误：https://github.com/LeBron-Jian/MachineLearningNote前言在python机器学习笔记：深入学习决策树算法原理一文中我们提到了决策树里的ID3算法，C4.5算法，并且大概的了
python机器学习库Scikit-learn 崔吉龙
python语言中用来处理机器学习的库最重要的就是Scikit-learn，简称sklearn。被大多数科学家所钟爱，包括了构建良好的学习算法、误差函数和测试例程。在sklearn的核心有四种类型的类覆盖了所有机器学习功能：分类回归聚类分组转换数据虽然sklearn提供的算法比较多，但是他们都符合基本的接口定义，为了是使用不同的算法时，所使用的接口时统一的。sklearn提供了四个基本对象接口。评
optuna，一个好用的Python机器学习自动化超参数优化库牵着猫散步的鼠鼠 python 开发语言
️个人主页：鼠鼠我捏，要死了捏的主页️付费专栏：Python专栏️个人学习笔记，若有缺误，欢迎评论区指正前言超参数优化是机器学习中的重要问题，它涉及在训练模型时选择最优的超参数组合，以提高模型的性能和泛化能力。Optuna是一个用于自动化超参数优化的库，它提供了有效的参数搜索算法和方便的结果可视化工具。目录前言
【机器学习笔记】 6 机器学习库Scikit-learn RIKI_1 机器学习机器学习笔记 scikit-learn
Scikit-learn概述Scikit-learn是基于NumPy、SciPy和Matplotlib的开源Python机器学习包,它封装了一系列数据预处理、机器学习算法、模型选择等工具,是数据分析师首选的机器学习工具包。自2007年发布以来，scikit-learn已经成为Python重要的机器学习库了，scikit-learn简称sklearn，支持包括分类，回归，降维和聚类四大机器学习算法。
Python机器学习：Scikit-learn库与应用数据小爬虫 api 电商api 机器学习 python scikit-learn 开发语言运维服务器
当涉及到Python机器学习时，Scikit-learn是一个非常流行且功能强大的库。它提供了广泛的算法和工具，使得机器学习变得简单而高效。下面是一个简单的Scikit-learn库与应用示例，其中包括代码。首先，确保你已经安装了Scikit-learn库。你可以使用pip命令来安装它：bash复制代码pipinstallscikit-learn接下来，我们将使用Scikit-learn来执行一个
见世面的成本有多低？这几个技术公众号告诉你答案傅一平
独乐乐，不如众乐乐，为您精选以下公众号！人工智能爱好者社区专注人工智能、机器学习、数据科学等顶尖技术前沿科技成果研究、实战技巧。每周会有书豪采访记系列采访技术大佬文章和原创漫画文章，立即关注，掌握人工智能最新资讯与成果。号主是《R数据科学实战：工具详解与案例分析》书籍作者。大数据分析挖掘和Python机器学习商业智能BI、数据分析、数据挖掘、大数据、Python、机器学习、深度学习、算法等技术分享
如何安装Pytorch,CPU版本和GPU版本的安装流程。 JayGboy pytorch 人工智能 python
1.PyTorch简介：PyTorch是一个开源的Python机器学习框架，专注于深度学习任务。它由Facebook的人工智能研究团队开发并维护，提供了丰富的工具和库，用于构建和训练各种深度神经网络模型。PyTorch使用动态计算图的概念，允许用户在运行时动态地定义、修改和调试计算图。这种灵活性使得模型构建和调试更加直观和方便，同时也支持更复杂的模型结构和控制流程。PyTorch采用Pythoni
Python机器学习之交叉验证一只怂货小脑斧
交叉验证是一种非常常用的对于模型泛化能力进行评估方法，交叉验证既可以解决数据集的数据量不够大问题，也可以解决参数调优的问题。常用的交叉验证方法有：简单交叉验证（HoldOut检验，例如train_test_split）、k折交叉验证（例如KFold）、自助法kfold是将数据集划分为K-折，只是划分数据集；cross_val_score是根据模型进行计算，计算交叉验证的结果，你可以简单认为就是cr
浏览器F12调试知行合一。。。测试技术功能测试
系列文章目录提示：这里可以添加系列文章的所有文章的目录，目录需要自己手动添加例如：第一章Python机器学习入门之pandas的使用提示：写完文章后，目录可以自动生成，如何生成可参考右边的帮助文档文章目录系列文章目录1浏览器F12开发者工具1.1F12开发者工具基本介绍1.2F12常规设置2标签页2.1Elements查看器2.2Network网络2.3Network抓包分析案例1：以登录百度账号
算法单链的创建与删除换个号韩国红果果 c 算法
先创建结构体 struct student { int data; //int tag;//标记这是第几个 struct student *next; }; // addone 用于将一个数插入已从小到大排好序的链中 struct student *addone(struct student *h,int x){ if(h==NULL) //??????
《大型网站系统与Java中间件实践》第2章读后感白糖_ java中间件
断断续续花了两天时间试读了《大型网站系统与Java中间件实践》的第2章，这章总述了从一个小型单机构建的网站发展到大型网站的演化过程---整个过程会遇到很多困难，但每一个屏障都会有解决方案，最终就是依靠这些个解决方案汇聚到一起组成了一个健壮稳定高效的大型系统。看完整章内容，
zeus持久层spring事务单元测试 deng520159 java DAO spring jdbc
今天把zeus事务单元测试放出来,让大家指出他的毛病, 1.ZeusTransactionTest.java 单元测试 package com.dengliang.zeus.webdemo.test; import java.util.ArrayList; import java.util.List; import org.junit.Test; import
Rss 订阅开发周凡杨 html xml 订阅 rss 规范
RSS是 Really Simple Syndication的缩写（对rss2.0而言，是这三个词的缩写，对rss1.0而言则是RDF Site Summary的缩写，1.0与2.0走的是两个体系）。 RSS
分页查询实现 g21121 分页查询
在查询列表时我们常常会用到分页，分页的好处就是减少数据交换，每次查询一定数量减少数据库压力等等。按实现形式分前台分页和服务器分页：前台分页就是一次查询出所有记录，在页面中用js进行虚拟分页，这种形式在数据量较小时优势比较明显，一次加载就不必再访问服务器了，但当数据量较大时会对页面造成压力，传输速度也会大幅下降。服务器分页就是每次请求相同数量记录，按一定规则排序，每次取一定序号直接的数据
spring jms异步消息处理 510888780 jms
spring JMS对于异步消息处理基本上只需配置下就能进行高效的处理。其核心就是消息侦听器容器，常用的类就是DefaultMessageListenerContainer。该容器可配置侦听器的并发数量，以及配合MessageListenerAdapter使用消息驱动POJO进行消息处理。且消息驱动POJO是放入TaskExecutor中进行处理，进一步提高性能，减少侦听器的阻塞。具体配置如下：
highCharts柱状图布衣凌宇 hightCharts 柱图
第一步：导入 exporting.js,grid.js,highcharts.js;第二步：写controller @Controller@RequestMapping(value="${adminPath}/statistick")public class StatistickController { private UserServi
我的spring学习笔记2-IoC（反向控制依赖注入） aijuans spring mvc Spring 教程 spring3 教程 Spring 入门
IoC（反向控制依赖注入）这是Spring提出来了，这也是Spring一大特色。这里我不用多说，我们看Spring教程就可以了解。当然我们不用Spring也可以用IoC，下面我将介绍不用Spring的IoC。 IoC不是框架，她是java的技术，如今大多数轻量级的容器都会用到IoC技术。这里我就用一个例子来说明：如：程序中有 Mysql.calss 、Oracle.class 、SqlSe
TLS java简单实现 antlove java ssl keystore tls secure
1. SSLServer.java package ssl; import java.io.FileInputStream; import java.io.InputStream; import java.net.ServerSocket; import java.net.Socket; import java.security.KeyStore; import
Zip解压压缩文件百合不是茶 Zip格式解压 Zip流的使用文件解压
ZIP文件的解压缩实质上就是从输入流中读取数据。Java.util.zip包提供了类ZipInputStream来读取ZIP文件,下面的代码段创建了一个输入流来读取ZIP格式的文件; ZipInputStream in = new ZipInputStream(new FileInputStream(zipFileName)); &n
underscore.js 学习（一） bijian1013 JavaScript underscore
工作中需要用到underscore.js，发现这是一个包括了很多基本功能函数的js库，里面有很多实用的函数。而且它没有扩展 javascript的原生对象。主要涉及对Collection、Object、Array、Function的操作。学
java jvm常用命令工具——jstatd命令(Java Statistics Monitoring Daemon) bijian1013 java jvm jstatd
1.介绍 jstatd是一个基于RMI（Remove Method Invocation）的服务程序，它用于监控基于HotSpot的JVM中资源的创建及销毁，并且提供了一个远程接口允许远程的监控工具连接到本地的JVM执行命令。 jstatd是基于RMI的，所以在运行jstatd的服务
【Spring框架三】Spring常用注解之Transactional bit1129 transactional
Spring可以通过注解@Transactional来为业务逻辑层的方法(调用DAO完成持久化动作)添加事务能力，如下是@Transactional注解的定义： /* * Copyright 2002-2010 the original author or authors. * * Licensed under the Apache License, Version
我(程序员)的前进方向 bitray 程序员
作为一个普通的程序员,我一直游走在java语言中,java也确实让我有了很多的体会.不过随着学习的深入,java语言的新技术产生的越来越多,从最初期的javase,我逐渐开始转变到ssh,ssi,这种主流的码农,.过了几天为了解决新问题,webservice的大旗也被我祭出来了,又过了些日子jms架构的activemq也开始必须学习了.再后来开始了一系列技术学习,osgi,restful.....
nginx lua开发经验总结 ronin47
使用nginx lua已经两三个月了，项目接开发完毕了，这几天准备上线并且跟高德地图对接。回顾下来lua在项目中占得必中还是比较大的，跟PHP的占比差不多持平了，因此在开发中遇到一些问题备忘一下 1：content_by_lua中代码容量有限制，一般不要写太多代码，正常编写代码一般在100行左右（具体容量没有细心测哈哈，在4kb左右），如果超出了则重启nginx的时候会报 too long pa
java-66-用递归颠倒一个栈。例如输入栈{1,2,3,4,5}，1在栈顶。颠倒之后的栈为{5,4,3,2,1}，5处在栈顶 bylijinnan java
import java.util.Stack; public class ReverseStackRecursive { /** * Q 66.颠倒栈。 * 题目：用递归颠倒一个栈。例如输入栈{1,2,3,4,5}，1在栈顶。 * 颠倒之后的栈为{5,4,3,2,1}，5处在栈顶。 *1. Pop the top element *2. Revers
正确理解Linux内存占用过高的问题 cfyme linux
Linux开机后，使用top命令查看，4G物理内存发现已使用的多大3.2G，占用率高达80%以上： Mem: 3889836k total, 3341868k used, 547968k free, 286044k buffers Swap: 6127608k total,&nb
[JWFD开源工作流]当前流程引擎设计的一个急需解决的问题 comsci 工作流
当我们的流程引擎进入IRC阶段的时候，当循环反馈模型出现之后，每次循环都会导致一大堆节点内存数据残留在系统内存中，循环的次数越多，这些残留数据将导致系统内存溢出，并使得引擎崩溃。。。。。。而解决办法就是利用汇编语言或者其它系统编程语言，在引擎运行时，把这些残留数据清除掉。
自定义类的equals函数 dai_lm equals
仅作笔记使用 public class VectorQueue { private final Vector<VectorItem> queue; private class VectorItem { private final Object item; private final int quantity; public VectorI
Linux下安装R语言 datageek R语言 linux
命令如下：sudo gedit /etc/apt/sources.list1、deb http://mirrors.ustc.edu.cn/CRAN/bin/linux/ubuntu/ precise/ 2、deb http://dk.archive.ubuntu.com/ubuntu hardy universesudo apt-key adv --keyserver ke
如何修改mysql 并发数(连接数)最大值 dcj3sjt126com mysql
MySQL的连接数最大值跟MySQL没关系，主要看系统和业务逻辑了方法一：进入MYSQL安装目录打开MYSQL配置文件 my.ini 或 my.cnf查找 max_connections=100 修改为 max_connections=1000 服务里重起MYSQL即可　　方法二：MySQL的最大连接数默认是100客户端登录：mysql -uusername -ppass
单一功能原则 dcj3sjt126com 面向对象的程序设计软件设计编程原则
单一功能原则[ 编辑] SOLID 原则单一功能原则开闭原则 Liskov代换原则接口隔离原则依赖反转原则查论编在面向对象编程领域中，单一功能原则（Single responsibility principle）规定每个类都应该有
POJO、VO和JavaBean区别和联系 fanmingxing VO POJO javabean
POJO和JavaBean是我们常见的两个关键字，一般容易混淆，POJO全称是Plain Ordinary Java Object / Plain Old Java Object，中文可以翻译成：普通Java类，具有一部分getter/setter方法的那种类就可以称作POJO，但是JavaBean则比POJO复杂很多，JavaBean是一种组件技术，就好像你做了一个扳子，而这个扳子会在很多地方被
SpringSecurity3.X--LDAP：AD配置 hanqunfeng SpringSecurity
前面介绍过基于本地数据库验证的方式，参考http://hanqunfeng.iteye.com/blog/1155226，这里说一下如何修改为使用AD进行身份验证【只对用户名和密码进行验证，权限依旧存储在本地数据库中】。将配置文件中的如下部分删除：
mac mysql 修改密码 IXHONG mysql
$ sudo /usr/local/mysql/bin/mysqld_safe –user=root & //启动MySQL(也可以通过偏好设置面板来启动)$ sudo /usr/local/mysql/bin/mysqladmin -uroot password yourpassword //设置MySQL密码（注意，这是第一次MySQL密码为空的时候的设置命令，如果是修改密码，还需在-
设计模式--抽象工厂模式 kerryg 设计模式
抽象工厂模式：工厂模式有一个问题就是，类的创建依赖于工厂类，也就是说，如果想要拓展程序，必须对工厂类进行修改，这违背了闭包原则。我们采用抽象工厂模式，创建多个工厂类，这样一旦需要增加新的功能，直接增加新的工厂类就可以了，不需要修改之前的代码。总结：这个模式的好处就是，如果想增加一个功能，就需要做一个实现类，
评"高中女生军训期跳楼” nannan408
首先，先抛出我的观点，各位看官少点砖头。那就是，中国的差异化教育必须做起来。孔圣人有云：有教无类。不同类型的人，都应该有对应的教育方法。目前中国的一体化教育，不知道已经扼杀了多少创造性人才。我们出不了爱迪生，出不了爱因斯坦，很大原因，是我们的培养思路错了，我们是第一要“顺从”。如果不顺从，我们的学校，就会用各种方法，罚站，罚写作业，各种罚。军
scala如何读取和写入文件内容？ qindongliang1922 java jvm scala
直接看如下代码： package file import java.io.RandomAccessFile import java.nio.charset.Charset import scala.io.Source import scala.reflect.io.{File, Path} /** * Created by qindongliang on 2015/
C语言算法之百元买百鸡 qiufeihu c 算法
中国古代数学家张丘建在他的《算经》中提出了一个著名的“百钱买百鸡问题”，鸡翁一，值钱五，鸡母一，值钱三，鸡雏三，值钱一，百钱买百鸡，问翁，母，雏各几何？代码如下： #include <stdio.h> int main() { int cock,hen,chick; /*定义变量为基本整型*/ for(coc
Hadoop集群安全性：Hadoop中Namenode单点故障的解决方案及详细介绍AvatarNode wyz2009107220 NameNode
正如大家所知，NameNode在Hadoop系统中存在单点故障问题，这个对于标榜高可用性的Hadoop来说一直是个软肋。本文讨论一下为了解决这个问题而存在的几个solution。 1. Secondary NameNode 原理：Secondary NN会定期的从NN中读取editlog，与自己存储的Image进行合并形成新的metadata image 优点：Hadoop较早的版本都自带，