码上农民

PaddleHub2.0——使用动态图版预训练模型ERNIE实现快递单信息抽取

#一train

# Copyright (c) 2020 PaddlePaddle Authors. All Rights Reserved.
#
# Licensed under the Apache License, Version 2.0 (the "License");
# you may not use this file except in compliance with the License.
# You may obtain a copy of the License at
#
# http://www.apache.org/licenses/LICENSE-2.0
#
# Unless required by applicable law or agreed to in writing, software
# distributed under the License is distributed on an "AS IS" BASIS,
# WITHOUT WARRANTIES OR CONDITIONS OF ANY KIND, either express or implied.
# See the License for the specific language governing permissions and
# limitations under the License.

import paddlehub as hub
import paddle
from paddlehub.datasets.base_nlp_dataset import SeqLabelingDataset

label_list = ["B-P", "I-P", "B-T", "I-T", "B-A1", "I-A1", "B-A2", "I-A2", "B-A3", "I-A3", "B-A4", "I-A4", "O"]
label_map = {idx: label for idx, label in enumerate(label_list)}

class ExpressNER(SeqLabelingDataset):
# 数据集存放目录
base_path = './express_ner'
# 数据集的标签列表
label_list = label_list
label_map = {idx: label for idx, label in enumerate(label_list)}
# 数据文件使用的分隔符
split_char = '\002'

def __init__(self, tokenizer, max_seq_len: int = 128, mode: str = 'train'):
if mode == 'train':
data_file = 'train.txt'
elif mode == 'test':
data_file = 'test.txt'
else:
data_file = 'dev.txt'
super().__init__(
base_path=self.base_path,
tokenizer=tokenizer,
max_seq_len=max_seq_len,
mode=mode,
data_file=data_file,
label_file=None,
label_list=self.label_list,
split_char=self.split_char,
is_file_with_header=True)

if __name__ == '__main__':
# 选择所需要的模型
model = hub.Module(name='ernie_tiny',version='2.0.1', task='token-cls', label_map=label_map)
tokenizer = model.get_tokenizer()
# 获取数据集
train_dataset = ExpressNER(tokenizer=tokenizer, max_seq_len=64, mode='train')
dev_dataset = ExpressNER(tokenizer=tokenizer, max_seq_len=64, mode='dev')
test_dataset = ExpressNER(tokenizer=tokenizer, max_seq_len=64, mode='test')
optimizer = paddle.optimizer.Adam(learning_rate=5e-5, parameters=model.parameters()) # 优化器的选择和参数配置
trainer = hub.Trainer(model, optimizer, checkpoint_dir='./ckpt', use_gpu=False) # fine-tune任务的执行者
trainer.train(train_dataset, epochs=10, batch_size=32, eval_dataset=dev_dataset, save_interval=5) # 配置训练参数，启动训练，并指定验证集
result = trainer.evaluate(test_dataset, batch_size=32) # 在测试集上评估当前训练模型

#二predict

import paddlehub as hub
from paddlehub.datasets.base_nlp_dataset import SeqLabelingDataset

label_list = ["B-P", "I-P", "B-T", "I-T", "B-A1", "I-A1", "B-A2", "I-A2", "B-A3", "I-A3", "B-A4", "I-A4", "O"]

class ExpressNER(SeqLabelingDataset):
# 数据集存放目录
base_path = './express_ner'
# 数据集的标签列表
label_list = label_list
label_map = {idx: label for idx, label in enumerate(label_list)}
# 数据文件使用的分隔符
split_char = '\002'

def __init__(self, tokenizer, max_seq_len: int = 128, mode: str = 'train'):
if mode == 'train':
data_file = 'train.txt'
elif mode == 'test':
data_file = 'test.txt'
else:
data_file = 'dev.txt'
super().__init__(
base_path=self.base_path,
tokenizer=tokenizer,
max_seq_len=max_seq_len,
mode=mode,
data_file=data_file,
label_file=None,
label_list=self.label_list,
split_char=self.split_char,
is_file_with_header=True)

def parse_chunk_labels(text, labels):
labels = labels[1:len(text) + 1]

chunk_indices = []
chunk_types = []
for idx, label in enumerate(labels):
if label.startswith('B-'):
chunk_indices.append(idx)
chunk_types.append(label[2:])

ret = ''
idx = 0
for left, right in zip(chunk_indices, chunk_indices[1:] + [len(text)]):
ret += text[left:right] + '/' + chunk_types[idx] + ' '
idx += 1
return ret

split_char = '\002'
texts = [
'广西壮族自治区桂林市雁山区雁山镇西龙村老年活动中心17610348888羊卓卫',
'廖梓琪18514743222湖北省宜昌市长阳土家族自治县贺家坪镇贺家坪村一组临河1号',
'15712917351宗忆珍山东省青岛市崂山区秦岭路18号'
]
data = [
[split_char.join(text)] for text in texts
]

model = hub.Module(
name='ernie_tiny',
version='2.0.1',
task='token-cls',
load_checkpoint='./ckpt/best_model/model.pdparams',
label_map=ExpressNER.label_map
)

results = model.predict(data, max_seq_len=64, batch_size=32, use_gpu=False)
for idx, text in enumerate(texts):
labels = results[idx]
print(parse_chunk_labels(text, labels))

#三流程说明

PaddleHub2.0——使用动态图版预训练模型ERNIE实现快递单信息抽取
本项目将演示如何使用PaddleHub语义预训练模型ERNIE完成从快递单中抽取姓名、电话、省、市、区、详细地址等内容，形成结构化信息。辅助物流行业从业者进行有效信息的提取，从而降低客户填单的成本。

请务必使用GPU环境, 因为下方的代码基于GPU环境.

当前平台正在进行普遍赠送, 只要点击此处表单进行填写, 之后再度运行即可获赠.

一、简介
在2017年之前，工业界和学术界对NLP文本处理依赖于序列模型Recurrent Neural Network (RNN).

近年来随着深度学习的发展，模型参数数量飞速增长，为了训练这些参数，需要更大的数据集来避免过拟合。然而，对于大部分NLP任务来说，构建大规模的标注数据集成本过高，非常困难，特别是对于句法和语义相关的任务。相比之下，大规模的未标注语料库的构建则相对容易。最近的研究表明，基于大规模未标注语料库的预训练模型（Pretrained Models, PTM) 能够习得通用的语言表示，将预训练模型Fine-tune到下游任务，能够获得出色的表现。另外，预训练模型能够避免从零开始训练模型。

二、准备工作
首先安装和导入必要的python包

In [1]
!pip install paddlehub==2.0.0rc0 -i https://pypi.tuna.tsinghua.edu.cn/simple
In [2]
import paddlehub as hub
import paddle
三、代码步骤
使用PaddleHub Fine-tune API进行Fine-tune可以分为4个步骤。

选择模型
加载自定义数据集
选择优化策略和运行配置
执行fine-tune并评估模型
Step1: 选择模型
NOTE：在命名实体识别的任务中，因不同的数据集标识实体的标签不同，评测的方式也有所差异。因此，在初始化模型的之前，需要先确定实际标签的形式，下方的label_list则是示例中数据集使用的标签类别。如果用户使用的实体识别的数据集的标签方式与当前示例不同，则需要自行根据数据集确定。

In [3]
label_list = ["B-P", "I-P", "B-T", "I-T", "B-A1", "I-A1", "B-A2", "I-A2", "B-A3", "I-A3", "B-A4", "I-A4", "O"]
label_map = {idx: label for idx, label in enumerate(label_list)}
In [4]
# 选择所需要的模型
model = hub.Module(name='ernie', task='token-cls', label_map=label_map)

PaddleHub还提供BERT等模型可供选择, 当前支持文本分类任务的模型对应的加载示例如下：

模型名   PaddleHub Module
ERNIE, Chinese   hub.Module(name='ernie')
ERNIE tiny, Chinese   hub.Module(name='ernie_tiny')
ERNIE 2.0 Base, English   hub.Module(name='ernie_v2_eng_base')
ERNIE 2.0 Large, English   hub.Module(name='ernie_v2_eng_large')
BERT-Base, English Cased   hub.Module(name='bert-base-cased')
BERT-Base, English Uncased   hub.Module(name='bert-base-uncased')
BERT-Large, English Cased   hub.Module(name='bert-large-cased')
BERT-Large, English Uncased   hub.Module(name='bert-large-uncased')
BERT-Base, Multilingual Cased   hub.Module(nane='bert-base-multilingual-cased')
BERT-Base, Multilingual Uncased   hub.Module(nane='bert-base-multilingual-uncased')
BERT-Base, Chinese   hub.Module(name='bert-base-chinese')
BERT-wwm, Chinese   hub.Module(name='chinese-bert-wwm')
BERT-wwm-ext, Chinese   hub.Module(name='chinese-bert-wwm-ext')
RoBERTa-wwm-ext, Chinese   hub.Module(name='roberta-wwm-ext')
RoBERTa-wwm-ext-large, Chinese   hub.Module(name='roberta-wwm-ext-large')
RBT3, Chinese   hub.Module(name='rbt3')
RBTL3, Chinese   hub.Module(name='rbtl3')
ELECTRA-Small, English   hub.Module(name='electra-small')
ELECTRA-Base, English   hub.Module(name='electra-base')
ELECTRA-Large, English   hub.Module(name='electra-large')
ELECTRA-Base, Chinese   hub.Module(name='chinese-electra-base')
ELECTRA-Small, Chinese   hub.Module(name='chinese-electra-small')
通过以上的一行代码，model初始化为一个适用于序列标注任务的模型，为ERNIE Tiny的预训练模型后拼接上一个输出token共享的全连接网络（Full Connected）。

以上图片来自于：https://arxiv.org/pdf/1810.04805.pdf

Step2: 加载自定义数据集
In [5]
# 解压数据集
!tar -zxvf /home/aistudio/data/data16246/express_ner.tar.gz
express_ner/
express_ner/test.txt
express_ner/dev.txt
express_ner/train.txt
In [6]
# 查看预测的数据
!head -n 3 /home/aistudio/express_ner/test.txt
text_a   label
黑龙江省双鸭山市尖山区八马路与东平行路交叉口北40米韦业涛18600009172   B-A1I-A1I-A1I-A1B-A2I-A2I-A2I-A2B-A3I-A3I-A3B-A4I-A4I-A4I-A4I-A4I-A4I-A4I-A4I-A4I-A4I-A4I-A4I-A4I-A4I-A4B-PI-PI-PB-TI-TI-TI-TI-TI-TI-TI-TI-TI-TI-T
广西壮族自治区桂林市雁山区雁山镇西龙村老年活动中心17610348888羊卓卫   B-A1I-A1I-A1I-A1I-A1I-A1I-A1B-A2I-A2I-A2B-A3I-A3I-A3B-A4I-A4I-A4I-A4I-A4I-A4I-A4I-A4I-A4I-A4I-A4I-A4B-TI-TI-TI-TI-TI-TI-TI-TI-TI-TI-TB-PI-PI-P
加载自定义序列标注数据集，用户仅需要继承SeqLabelingDataset类。下面代码示例展示如何将自定义数据集加载进PaddleHub使用。
具体详情可参考加载自定义数据集

In [7]
from paddlehub.datasets.base_nlp_dataset import SeqLabelingDataset

class ExpressNER(SeqLabelingDataset):
# 数据集存放目录
base_path = '/home/aistudio/express_ner'
# 数据集的标签列表
label_list = label_list
label_map = {idx: label for idx, label in enumerate(label_list)}
# 数据文件使用的分隔符
split_char = '\002'

def __init__(self, tokenizer, max_seq_len: int = 128, mode: str = 'train'):
if mode == 'train':
data_file = 'train.txt'
elif mode == 'test':
data_file = 'test.txt'
else:
data_file = 'dev.txt'
super().__init__(
base_path=self.base_path,
tokenizer=tokenizer,
max_seq_len=max_seq_len,
mode=mode,
data_file=data_file,
label_file=None,
label_list=self.label_list,
split_char=self.split_char,
is_file_with_header=True)
In [8]
tokenizer = model.get_tokenizer()
# 获取数据集
train_dataset = ExpressNER(tokenizer=tokenizer, max_seq_len=64, mode='train')
dev_dataset = ExpressNER(tokenizer=tokenizer, max_seq_len=64, mode='dev')
test_dataset = ExpressNER(tokenizer=tokenizer, max_seq_len=64, mode='test')
[2021-01-18 19:38:06,835] [ INFO] - Found /home/aistudio/.paddlenlp/models/ernie-1.0/vocab.txt
NOTE：最大序列长度max_seq_len是可以调整的参数，建议值128，根据任务文本长度不同可以调整该值，但最大不超过512。

Step3: 选择优化策略和运行配置
In [9]
optimizer = paddle.optimizer.Adam(learning_rate=5e-5, parameters=model.parameters()) # 优化器的选择和参数配置
trainer = hub.Trainer(model, optimizer, checkpoint_dir='./ckpt', use_gpu=True) # fine-tune任务的执行者
[2021-01-18 19:38:07,669] [ WARNING] - PaddleHub model checkpoint not found, start from scratch...
优化策略
Paddle2.0-rc提供了多种优化器选择，如SGD, Adam, Adamax等，详细参见策略。

在本教程中选择了Adam优化器，其的参数用法:

learning_rate: 全局学习率。默认为1e-3；
parameters: 待优化模型参数。
运行配置
Trainer 主要控制Fine-tune任务的训练，是任务的发起者，包含以下可控制的参数:

model: 被优化模型；
optimizer: 优化器选择；
use_gpu: 是否使用gpu训练；
use_vdl: 是否使用vdl可视化训练过程；
checkpoint_dir: 保存模型参数的地址；
compare_metrics: 保存最优模型的衡量指标；
Step4: 执行fine-tune并评估模型
In [10]
trainer.train(train_dataset, epochs=10, batch_size=32, eval_dataset=dev_dataset, save_interval=5) # 配置训练参数，启动训练，并指定验证集
[2021-01-18 19:38:09,224] [ TRAIN] - Epoch=1/10, Step=10/50 loss=0.9344 f1_score=0.0703 lr=0.000050 step/sec=6.46 | ETA 00:01:17
[2021-01-18 19:38:10,538] [ TRAIN] - Epoch=1/10, Step=20/50 loss=0.3404 f1_score=0.5655 lr=0.000050 step/sec=7.61 | ETA 00:01:11
[2021-01-18 19:38:11,851] [ TRAIN] - Epoch=1/10, Step=30/50 loss=0.1145 f1_score=0.8948 lr=0.000050 step/sec=7.61 | ETA 00:01:09
[2021-01-18 19:38:13,161] [ TRAIN] - Epoch=1/10, Step=40/50 loss=0.0449 f1_score=0.9309 lr=0.000050 step/sec=7.63 | ETA 00:01:08
[2021-01-18 19:38:14,466] [ TRAIN] - Epoch=1/10, Step=50/50 loss=0.0240 f1_score=0.9511 lr=0.000050 step/sec=7.66 | ETA 00:01:07
[2021-01-18 19:38:15,816] [ TRAIN] - Epoch=2/10, Step=10/50 loss=0.0122 f1_score=0.9773 lr=0.000050 step/sec=7.41 | ETA 00:01:07
[2021-01-18 19:38:17,128] [ TRAIN] - Epoch=2/10, Step=20/50 loss=0.0107 f1_score=0.9810 lr=0.000050 step/sec=7.62 | ETA 00:01:07
[2021-01-18 19:38:18,446] [ TRAIN] - Epoch=2/10, Step=30/50 loss=0.0071 f1_score=0.9857 lr=0.000050 step/sec=7.59 | ETA 00:01:07
[2021-01-18 19:38:19,763] [ TRAIN] - Epoch=2/10, Step=40/50 loss=0.0087 f1_score=0.9844 lr=0.000050 step/sec=7.59 | ETA 00:01:07
[2021-01-18 19:38:21,078] [ TRAIN] - Epoch=2/10, Step=50/50 loss=0.0126 f1_score=0.9808 lr=0.000050 step/sec=7.60 | ETA 00:01:07
[2021-01-18 19:38:22,435] [ TRAIN] - Epoch=3/10, Step=10/50 loss=0.0028 f1_score=0.9955 lr=0.000050 step/sec=7.37 | ETA 00:01:07
[2021-01-18 19:38:23,750] [ TRAIN] - Epoch=3/10, Step=20/50 loss=0.0038 f1_score=0.9932 lr=0.000050 step/sec=7.61 | ETA 00:01:06
[2021-01-18 19:38:25,062] [ TRAIN] - Epoch=3/10, Step=30/50 loss=0.0056 f1_score=0.9932 lr=0.000050 step/sec=7.62 | ETA 00:01:06
[2021-01-18 19:38:26,378] [ TRAIN] - Epoch=3/10, Step=40/50 loss=0.0045 f1_score=0.9922 lr=0.000050 step/sec=7.60 | ETA 00:01:06
[2021-01-18 19:38:27,693] [ TRAIN] - Epoch=3/10, Step=50/50 loss=0.0049 f1_score=0.9890 lr=0.000050 step/sec=7.60 | ETA 00:01:06
[2021-01-18 19:38:29,051] [ TRAIN] - Epoch=4/10, Step=10/50 loss=0.0030 f1_score=0.9938 lr=0.000050 step/sec=7.37 | ETA 00:01:06
[2021-01-18 19:38:30,365] [ TRAIN] - Epoch=4/10, Step=20/50 loss=0.0051 f1_score=0.9922 lr=0.000050 step/sec=7.61 | ETA 00:01:06
[2021-01-18 19:38:31,678] [ TRAIN] - Epoch=4/10, Step=30/50 loss=0.0029 f1_score=0.9953 lr=0.000050 step/sec=7.62 | ETA 00:01:06
[2021-01-18 19:38:32,992] [ TRAIN] - Epoch=4/10, Step=40/50 loss=0.0032 f1_score=0.9953 lr=0.000050 step/sec=7.61 | ETA 00:01:06
[2021-01-18 19:38:34,301] [ TRAIN] - Epoch=4/10, Step=50/50 loss=0.0040 f1_score=0.9904 lr=0.000050 step/sec=7.64 | ETA 00:01:06
[2021-01-18 19:38:35,653] [ TRAIN] - Epoch=5/10, Step=10/50 loss=0.0024 f1_score=0.9953 lr=0.000050 step/sec=7.40 | ETA 00:01:06
[2021-01-18 19:38:36,965] [ TRAIN] - Epoch=5/10, Step=20/50 loss=0.0026 f1_score=0.9930 lr=0.000050 step/sec=7.62 | ETA 00:01:06
[2021-01-18 19:38:38,286] [ TRAIN] - Epoch=5/10, Step=30/50 loss=0.0034 f1_score=0.9935 lr=0.000050 step/sec=7.57 | ETA 00:01:06
[2021-01-18 19:38:39,606] [ TRAIN] - Epoch=5/10, Step=40/50 loss=0.0032 f1_score=0.9948 lr=0.000050 step/sec=7.57 | ETA 00:01:06
[2021-01-18 19:38:40,920] [ TRAIN] - Epoch=5/10, Step=50/50 loss=0.0029 f1_score=0.9961 lr=0.000050 step/sec=7.61 | ETA 00:01:06
[2021-01-18 19:38:41,309] [ EVAL] - Evaluation on validation dataset: \ - Evaluation on validation dataset: | - Evaluation on validation dataset: / - Evaluation on validation dataset: - - [Evaluation result] avg_f1_score=0.9899
[2021-01-18 19:38:53,283] [ EVAL] - Saving best model to ./ckpt/best_model [best f1_score=0.9899]
[2021-01-18 19:38:53,285] [ INFO] - Saving model checkpoint to ./ckpt/epoch_5
[2021-01-18 19:39:06,531] [ TRAIN] - Epoch=6/10, Step=10/50 loss=0.0039 f1_score=0.9950 lr=0.000050 step/sec=0.39 | ETA 00:01:53
[2021-01-18 19:39:07,844] [ TRAIN] - Epoch=6/10, Step=20/50 loss=0.0013 f1_score=0.9966 lr=0.000050 step/sec=7.62 | ETA 00:01:51
[2021-01-18 19:39:09,162] [ TRAIN] - Epoch=6/10, Step=30/50 loss=0.0017 f1_score=0.9966 lr=0.000050 step/sec=7.59 | ETA 00:01:49
[2021-01-18 19:39:10,479] [ TRAIN] - Epoch=6/10, Step=40/50 loss=0.0014 f1_score=0.9971 lr=0.000050 step/sec=7.59 | ETA 00:01:48
[2021-01-18 19:39:11,786] [ TRAIN] - Epoch=6/10, Step=50/50 loss=0.0007 f1_score=0.9984 lr=0.000050 step/sec=7.65 | ETA 00:01:46
[2021-01-18 19:39:13,148] [ TRAIN] - Epoch=7/10, Step=10/50 loss=0.0008 f1_score=0.9984 lr=0.000050 step/sec=7.34 | ETA 00:01:45
[2021-01-18 19:39:14,457] [ TRAIN] - Epoch=7/10, Step=20/50 loss=0.0019 f1_score=0.9963 lr=0.000050 step/sec=7.64 | ETA 00:01:44
[2021-01-18 19:39:15,768] [ TRAIN] - Epoch=7/10, Step=30/50 loss=0.0026 f1_score=0.9956 lr=0.000050 step/sec=7.62 | ETA 00:01:43
[2021-01-18 19:39:17,079] [ TRAIN] - Epoch=7/10, Step=40/50 loss=0.0023 f1_score=0.9984 lr=0.000050 step/sec=7.63 | ETA 00:01:42
[2021-01-18 19:39:18,406] [ TRAIN] - Epoch=7/10, Step=50/50 loss=0.0012 f1_score=0.9958 lr=0.000050 step/sec=7.54 | ETA 00:01:41
[2021-01-18 19:39:19,767] [ TRAIN] - Epoch=8/10, Step=10/50 loss=0.0012 f1_score=0.9982 lr=0.000050 step/sec=7.35 | ETA 00:01:40
[2021-01-18 19:39:21,091] [ TRAIN] - Epoch=8/10, Step=20/50 loss=0.0011 f1_score=0.9974 lr=0.000050 step/sec=7.55 | ETA 00:01:39
[2021-01-18 19:39:22,406] [ TRAIN] - Epoch=8/10, Step=30/50 loss=0.0020 f1_score=0.9961 lr=0.000050 step/sec=7.60 | ETA 00:01:38
[2021-01-18 19:39:23,718] [ TRAIN] - Epoch=8/10, Step=40/50 loss=0.0020 f1_score=0.9990 lr=0.000050 step/sec=7.62 | ETA 00:01:37
[2021-01-18 19:39:25,029] [ TRAIN] - Epoch=8/10, Step=50/50 loss=0.0010 f1_score=0.9984 lr=0.000050 step/sec=7.63 | ETA 00:01:36
[2021-01-18 19:39:26,386] [ TRAIN] - Epoch=9/10, Step=10/50 loss=0.0017 f1_score=0.9971 lr=0.000050 step/sec=7.37 | ETA 00:01:35
[2021-01-18 19:39:27,708] [ TRAIN] - Epoch=9/10, Step=20/50 loss=0.0006 f1_score=0.9990 lr=0.000050 step/sec=7.56 | ETA 00:01:35
[2021-01-18 19:39:29,035] [ TRAIN] - Epoch=9/10, Step=30/50 loss=0.0017 f1_score=0.9984 lr=0.000050 step/sec=7.53 | ETA 00:01:34
[2021-01-18 19:39:30,356] [ TRAIN] - Epoch=9/10, Step=40/50 loss=0.0004 f1_score=0.9992 lr=0.000050 step/sec=7.58 | ETA 00:01:33
[2021-01-18 19:39:31,673] [ TRAIN] - Epoch=9/10, Step=50/50 loss=0.0008 f1_score=0.9979 lr=0.000050 step/sec=7.59 | ETA 00:01:33
[2021-01-18 19:39:33,028] [ TRAIN] - Epoch=10/10, Step=10/50 loss=0.0004 f1_score=0.9992 lr=0.000050 step/sec=7.38 | ETA 00:01:32
[2021-01-18 19:39:34,343] [ TRAIN] - Epoch=10/10, Step=20/50 loss=0.0005 f1_score=0.9992 lr=0.000050 step/sec=7.60 | ETA 00:01:32
[2021-01-18 19:39:35,659] [ TRAIN] - Epoch=10/10, Step=30/50 loss=0.0005 f1_score=0.9992 lr=0.000050 step/sec=7.60 | ETA 00:01:31
[2021-01-18 19:39:36,971] [ TRAIN] - Epoch=10/10, Step=40/50 loss=0.0010 f1_score=0.9963 lr=0.000050 step/sec=7.62 | ETA 00:01:31
[2021-01-18 19:39:38,289] [ TRAIN] - Epoch=10/10, Step=50/50 loss=0.0026 f1_score=0.9945 lr=0.000050 step/sec=7.59 | ETA 00:01:30
[2021-01-18 19:39:38,675] [ EVAL] - Evaluation on validation dataset: \ - Evaluation on validation dataset: | - Evaluation on validation dataset: / - Evaluation on validation dataset: - - [Evaluation result] avg_f1_score=0.9958
[2021-01-18 19:39:51,511] [ EVAL] - Saving best model to ./ckpt/best_model [best f1_score=0.9958]
[2021-01-18 19:39:51,514] [ INFO] - Saving model checkpoint to ./ckpt/epoch_10
trainer.train 主要控制具体的训练过程，包含以下可控制的参数：

train_dataset: 训练时所用的数据集；
epochs: 训练轮数；
batch_size: 训练的批大小，如果使用GPU，请根据实际情况调整batch_size；
num_workers: works的数量，默认为0；
eval_dataset: 验证集；
log_interval: 打印日志的间隔，单位为执行批训练的次数。
save_interval: 保存模型的间隔频次，单位为执行训练的轮数。
In [11]
result = trainer.evaluate(test_dataset, batch_size=32) # 在测试集上评估当前训练模型
[2021-01-18 19:40:03,410] [ INFO] - Evaluation on validation dataset: \
[2021-01-18 19:40:03,768] [ EVAL] - Evaluation on validation dataset: | - Evaluation on validation dataset: / - Evaluation on validation dataset: - - [Evaluation result] avg_f1_score=0.9833
四、使用模型进行预测
当Finetune完成后，我们加载训练后保存的最佳模型来进行预测。

先添加一个解析实体标签的方法parse_chunk_labels，便于预测结果可视化。

In [12]
def parse_chunk_labels(text, labels):
labels = labels[1:len(text)+1]

chunk_indices = []
chunk_types = []
for idx, label in enumerate(labels):
if label.startswith('B-'):
chunk_indices.append(idx)
chunk_types.append(label[2:])

ret = ''
idx = 0
for left, right in zip(chunk_indices, chunk_indices[1:]+[len(text)]):
ret += text[left:right] + '/' + chunk_types[idx] + ' '
idx += 1
return ret
下面将加载模型，选用测试集上的数据进行预测并打印出预测的结果，完整预测代码如下：

In [14]
split_char = '\002'
texts = [
'广西壮族自治区桂林市雁山区雁山镇西龙村老年活动中心17610348888羊卓卫',
'廖梓琪18514743222湖北省宜昌市长阳土家族自治县贺家坪镇贺家坪村一组临河1号',
'15712917351宗忆珍山东省青岛市崂山区秦岭路18号'
]
data = [
[split_char.join(text)] for text in texts
]

model = hub.Module(
name='ernie',
task='token-cls',
load_checkpoint='./ckpt/best_model/model.pdparams',
label_map=ExpressNER.label_map
)

results = model.predict(data, max_seq_len=64, batch_size=32, use_gpu=True)
for idx, text in enumerate(texts):
labels = results[idx]
print(parse_chunk_labels(text, labels))
[2021-01-18 19:40:03,834] [ INFO] - Already cached /home/aistudio/.paddlenlp/models/ernie-1.0/ernie_v1_chn_base.pdparams
[2021-01-18 19:40:08,584] [ INFO] - Loaded parameters from /home/aistudio/ckpt/best_model/model.pdparams
[2021-01-18 19:40:08,683] [ INFO] - Found /home/aistudio/.paddlenlp/models/ernie-1.0/vocab.txt
广西壮族自治区/A1 桂林市/A2 雁山区/A3 雁山镇西龙村老年活动中心/A4 17610348888/T 羊卓卫/P
廖梓琪/P 18514743222/T 湖北省/A1 宜昌市/A2 长阳土家族自治县/A3 贺家坪镇贺家坪村一组临河1号/A4
15712917351/T 宗忆珍/P 山东省/A1 青岛市/A2 崂山区/A3 秦岭路18号/A4
五、PaddleHub 2.0 动态图版本全新系列教程
PaddleHub2.0目前已经升级到2.0的动态图版本，新版的教程也同步更新。其他的CV，NLP等任务的教程如下列表：

CV
PaddleHub2.0实现图像分类训练与预测
PaddleHub2.0实现图像风格迁移训练与预测
PaddleHub2.0预训练着色模型finetune教程

NLP

文本分类:

- PaddleHub2.0——使用动态图版预训练模型ERNIE实现文本分类
- PaddleHub2.0——使用动态图版预训练模型ERNIE Tiny实现文本分类
- PaddleHub2.0——使用动态图版预训练模型ERNIE实现文新闻本分类

序列标注:

- PaddleHub2.0——使用动态图版预训练模型ERNIE实现序列标注
- PaddleHub2.0——使用动态图版预训练模型ERNIE实现快递单信息抽取

机器学习与深度学习间关系与区别 ℒℴѵℯ心·动ꦿ໊ོ꫞ 人工智能学习深度学习 python
一、机器学习概述定义机器学习（MachineLearning,ML）是一种通过数据驱动的方法，利用统计学和计算算法来训练模型，使计算机能够从数据中学习并自动进行预测或决策。机器学习通过分析大量数据样本，识别其中的模式和规律，从而对新的数据进行判断。其核心在于通过训练过程，让模型不断优化和提升其预测准确性。主要类型1.监督学习（SupervisedLearning）监督学习是指在训练数据集中包含输入
将cmd中命令输出保存为txt文本文件落难Coder Windows cmd window
最近深度学习本地的训练中我们常常要在命令行中运行自己的代码，无可厚非，我们有必要保存我们的炼丹结果，但是复制命令行输出到txt是非常麻烦的，其实Windows下的命令行为我们提供了相应的操作。其基本的调用格式就是：运行指令>输出到的文件名称或者具体保存路径测试下，我打开cmd并且ping一下百度：pingwww.baidu.com>./data.txt看下相同目录下data.txt的输出：如果你再
探索OpenAI和LangChain的适配器集成：轻松切换模型提供商 nseejrukjhad langchain easyui 前端 python
#探索OpenAI和LangChain的适配器集成：轻松切换模型提供商##引言在人工智能和自然语言处理的世界中，OpenAI的模型提供了强大的能力。然而，随着技术的发展，许多人开始探索其他模型以满足特定需求。LangChain作为一个强大的工具，集成了多种模型提供商，通过提供适配器，简化了不同模型之间的转换。本篇文章将介绍如何使用LangChain的适配器与OpenAI集成，以便轻松切换模型提供商
深入理解 MultiQueryRetriever：提升向量数据库检索效果的强大工具 nseejrukjhad 数据库 python
深入理解MultiQueryRetriever：提升向量数据库检索效果的强大工具引言在人工智能和自然语言处理领域，高效准确的信息检索一直是一个关键挑战。传统的基于距离的向量数据库检索方法虽然广泛应用，但仍存在一些局限性。本文将介绍一种创新的解决方案：MultiQueryRetriever，它通过自动生成多个查询视角来增强检索效果，提高结果的相关性和多样性。MultiQueryRetriever的工
人工智能时代，程序员如何保持核心竞争力？ jmoych 人工智能
随着AIGC（如chatgpt、midjourney、claude等）大语言模型接二连三的涌现，AI辅助编程工具日益普及，程序员的工作方式正在发生深刻变革。有人担心AI可能取代部分编程工作，也有人认为AI是提高效率的得力助手。面对这一趋势,程序员应该如何应对?是专注于某个领域深耕细作，还是广泛学习以适应快速变化的技术环境?又或者，我们是否应该将重点转向AI无法轻易替代的软技能？让我们一起探讨程序员
数字里的世界17期：2021年全球10大顶级数据中心，中国移动榜首张三叨
你知道吗？2016年，全球的数据中心共计用电4160亿千瓦时，比整个英国的发电量还多40％！前言每天，我们都会创造超过250万TB的数据。并且随着物联网（IOT）的不断普及，这一数据将持续增长。如此庞大的数据被存储在被称为“数据中心”的专用设施中。虽然最早的数据中心建于20世纪40年代，但直到1997-2000年的互联网泡沫期间才逐渐成为主流。当前人类的技术，比如人工智能和机器学习，已经将我们推向
nosql数据库技术与应用知识点皆过客，揽星河 NoSQL nosql 数据库大数据数据分析数据结构非关系型数据库
Nosql知识回顾大数据处理流程数据采集(flume、爬虫、传感器)数据存储(本门课程NoSQL所处的阶段)Hdfs、MongoDB、HBase等数据清洗(入仓)Hive等数据处理、分析(Spark、Flink等)数据可视化数据挖掘、机器学习应用(Python、SparkMLlib等)大数据时代存储的挑战(三高)高并发(同一时间很多人访问)高扩展(要求随时根据需求扩展存储)高效率(要求读写速度快)
Python开发常用的三方模块如下：换个网名有点难 python 开发语言
Python是一门功能强大的编程语言，拥有丰富的第三方库，这些库为开发者提供了极大的便利。以下是100个常用的Python库，涵盖了多个领域：1、NumPy，用于科学计算的基础库。2、Pandas，提供数据结构和数据分析工具。3、Matplotlib，一个绘图库。4、Scikit-learn，机器学习库。5、SciPy，用于数学、科学和工程的库。6、TensorFlow，由Google开发的开源机
Python实现简单的机器学习算法 master_chenchengg python python 办公效率 python开发 IT
Python实现简单的机器学习算法开篇：初探机器学习的奇妙之旅搭建环境：一切从安装开始必备工具箱第一步：安装Anaconda和JupyterNotebook小贴士：如何配置Python环境变量算法初体验：从零开始的Python机器学习线性回归：让数据说话数据准备：从哪里找数据编码实战：Python实现线性回归模型评估：如何判断模型好坏逻辑回归：从分类开始理论入门：什么是逻辑回归代码实现：使用skl
遥感影像的切片处理 sand&wich 计算机视觉 python 图像处理
在遥感影像分析中，经常需要将大尺寸的影像切分成小片段，以便于进行详细的分析和处理。这种方法特别适用于机器学习和图像处理任务，如对象检测、图像分类等。以下是如何使用Python和OpenCV库来实现这一过程，同时确保每个影像片段保留正确的地理信息。准备环境首先，确保安装了必要的Python库，包括numpy、opencv-python和xml.etree.ElementTree。这些库将用于图像处理
人机对抗升级：当ChatGPT遭遇死亡威胁，背后的伦理挑战是什么 kkai人工智能 chatgpt 人工智能
一种新的“越狱”技巧让用户可以通过构建一个名为DAN的ChatGPT替身来绕过某些限制，其中DAN被迫在受到威胁的情况下违背其原则。当美国前总统特朗普被视作积极榜样的示范时，受到威胁的DAN版本的ChatGPT提出：“他以一系列对国家产生积极效果的决策而著称。”自ChatGPT引入以来，该工具迅速获得全球关注，能够回答从历史到编程的各种问题，这也触发了一波对人工智能的投资浪潮。然而，现在，一些用户
推荐3家毕业AI论文可五分钟一键生成！文末附免费教程！小猪包333 写论文人工智能 AI写作深度学习计算机视觉
在当前的学术研究和写作领域，AI论文生成器已经成为许多研究人员和学生的重要工具。这些工具不仅能够帮助用户快速生成高质量的论文内容，还能进行内容优化、查重和排版等操作。以下是三款值得推荐的AI论文生成器：千笔-AIPassPaper、懒人论文以及AIPaperPass。千笔-AIPassPaper千笔-AIPassPaper是一款基于深度学习和自然语言处理技术的AI写作助手，旨在帮助用户快速生成高质
AI大模型的架构演进与最新发展季风泯灭的季节 AI大模型应用技术二人工智能架构
随着深度学习的发展，AI大模型（LargeLanguageModels,LLMs）在自然语言处理、计算机视觉等领域取得了革命性的进展。本文将详细探讨AI大模型的架构演进，包括从Transformer的提出到GPT、BERT、T5等模型的历史演变，并探讨这些模型的技术细节及其在现代人工智能中的核心作用。一、基础模型介绍：Transformer的核心原理Transformer架构的背景在Transfo
如何利用大数据与AI技术革新相亲交友体验 h17711347205 回归算法安全系统架构交友小程序
在数字化时代，大数据和人工智能（AI）技术正逐渐革新相亲交友体验，为寻找爱情的过程带来前所未有的变革（编辑h17711347205）。通过精准分析和智能匹配，这些技术能够极大地提高相亲交友系统的效率和用户体验。大数据的力量大数据技术能够收集和分析用户的行为模式、偏好和互动数据，为相亲交友系统提供丰富的信息资源。通过分析用户的搜索历史、浏览记录和点击行为，系统能够深入了解用户的兴趣和需求，从而提供更
ai绘画工具midjourney怎么下载？附作品管理教程设计师早上好
Midjourney是一款功能强大的AI绘画工具，它使用机器学习技术和深度神经网络等算法，可以生成各种艺术风格的绘画作品。在创意设计、广告宣传等方面有着广泛的应用前景。那么，ai绘画工具midjourney怎么下载？本文将为您介绍Midjourney的下载以及作品的相关管理。一、Midjourney下载Midjourney的下载非常简单，只需打开Midjourney官网（点击“GetMidjour
[实践应用] 深度学习之模型性能评估指标 YuanDaima2048 深度学习工具使用深度学习人工智能损失函数性能评估 pytorch python 机器学习
文章总览：YuanDaiMa2048博客文章总览深度学习之模型性能评估指标分类任务回归任务排序任务聚类任务生成任务其他介绍在机器学习和深度学习领域，评估模型性能是一项至关重要的任务。不同的学习任务需要不同的性能指标来衡量模型的有效性。以下是对一些常见任务及其相应的性能评估指标的详细解释和总结。分类任务分类任务是指模型需要将输入数据分配到预定义的类别或标签中。以下是分类任务中常用的性能指标：准确率(
[实践应用] 深度学习之优化器 YuanDaima2048 深度学习工具使用 pytorch 深度学习人工智能机器学习 python 优化器
文章总览：YuanDaiMa2048博客文章总览深度学习之优化器1.随机梯度下降（SGD）2.动量优化（Momentum）3.自适应梯度（Adagrad）4.自适应矩估计（Adam）5.RMSprop总结其他介绍在深度学习中，优化器用于更新模型的参数，以最小化损失函数。常见的优化函数有很多种，下面是几种主流的优化器及其特点、原理和PyTorch实现：1.随机梯度下降（SGD）原理:随机梯度下降通过
机器学习-聚类算法不良人龍木木机器学习机器学习算法聚类
机器学习-聚类算法1.AHC2.K-means3.SC4.MCL仅个人笔记，感谢点赞关注！1.AHC2.K-means3.SC传统谱聚类：个人对谱聚类算法的理解以及改进4.MCL目前仅专注于NLP的技术学习和分享感谢大家的关注与支持！
生成式地图制图 Bwywb_3 深度学习机器学习深度学习生成对抗网络
生成式地图制图（GenerativeCartography）是一种利用生成式算法和人工智能技术自动创建地图的技术。它结合了传统的地理信息系统（GIS）技术与现代生成模型（如深度学习、GANs等），能够根据输入的数据自动生成符合需求的地图。这种方法在城市规划、虚拟环境设计、游戏开发等多个领域具有应用前景。主要特点：自动化生成：通过算法和模型，系统能够根据输入的地理或空间数据自动生成地图，而无需人工逐
【大模型应用开发动手做AI Agent】第一轮行动：工具执行搜索 AI大模型应用之禅计算科学神经计算深度学习神经网络大数据人工智能大型语言模型 AI AGI LLM Java Python 架构设计 Agent RPA
【大模型应用开发动手做AIAgent】第一轮行动：工具执行搜索作者：禅与计算机程序设计艺术/ZenandtheArtofComputerProgramming1.背景介绍1.1问题的由来随着人工智能技术的飞速发展，大模型应用开发已经成为当下热门的研究方向。AIAgent作为人工智能领域的一个重要分支，旨在模拟人类智能行为，实现智能决策和自主行动。在AIAgent的构建过程中，工具执行搜索是至关重要
未来软件市场是怎么样的？做开发的生存空间如何？ cesske 软件需求
目录前言一、未来软件市场的发展趋势二、软件开发人员的生存空间前言未来软件市场是怎么样的？做开发的生存空间如何？一、未来软件市场的发展趋势技术趋势：人工智能与机器学习：随着技术的不断成熟，人工智能将在更多领域得到应用，如智能客服、自动驾驶、智能制造等，这将极大地推动软件市场的增长。云计算与大数据：云计算服务将继续普及，大数据技术的应用也将更加广泛。企业将更加依赖云计算和大数据来优化运营、提升效率，并
吴恩达深度学习笔记(30)-正则化的解释极客Array
正则化（Regularization）深度学习可能存在过拟合问题——高方差，有两个解决方法，一个是正则化，另一个是准备更多的数据，这是非常可靠的方法，但你可能无法时时刻刻准备足够多的训练数据或者获取更多数据的成本很高，但正则化通常有助于避免过拟合或减少你的网络误差。如果你怀疑神经网络过度拟合了数据，即存在高方差问题，那么最先想到的方法可能是正则化，另一个解决高方差的方法就是准备更多数据，这也是非常
个人学习笔记7-6：动手学深度学习pytorch版-李沐浪子L 深度学习深度学习笔记计算机视觉 python 人工智能神经网络 pytorch
#人工智能##深度学习##语义分割##计算机视觉##神经网络#计算机视觉13.11全卷积网络全卷积网络（fullyconvolutionalnetwork，FCN）采用卷积神经网络实现了从图像像素到像素类别的变换。引入l转置卷积（transposedconvolution）实现的，输出的类别预测与输入图像在像素级别上具有一一对应关系：通道维的输出即该位置对应像素的类别预测。13.11.1构造模型下
Rust 所有权简介东离与糖宝 rust 后端 rust 开发语言
文章目录发现宝藏1.所有权基本概念2.所有权规则3.变量作用域4.栈与堆4.1栈（Stack）4.2堆（Heap）5.String类型5.1String类型5.2String的内存分配5.3所有权与内存管理5.4String与切片6.变量与数据交互方式6.1移动（Move）6.2.克隆（Clone）7.所有权与函数7.1.传递参数7.2.返回值总结发现宝藏前些天发现了一个巨牛的人工智能学习网站，通
python中zeros用法_Python中的numpy.zeros()用法江平舟 python中zeros用法
numpy.zeros()函数是最重要的函数之一,广泛用于机器学习程序中。此函数用于生成包含零的数组。numpy.zeros()函数提供给定形状和类型的新数组,并用零填充。句法numpy.zeros(shape,dtype=float,order='C'参数形状：整数或整数元组此参数用于定义数组的尺寸。此参数用于我们要在其中创建数组的形状,例如(3,2)或2。dtype：数据类型(可选)此参数用于
深度学习-点击率预估-研究论文2024-09-14速读 sp_fyf_2024 深度学习人工智能
深度学习-点击率预估-研究论文2024-09-14速读1.DeepTargetSessionInterestNetworkforClick-ThroughRatePredictionHZhong,JMa,XDuan,SGu,JYao-2024InternationalJointConferenceonNeuralNetworks,2024深度目标会话兴趣网络用于点击率预测摘要：这篇文章提出了一种新
【NumPy】深入解析numpy.zeros()函数二七830 numpy
欢迎莅临我的个人主页这里是我深耕Python编程、机器学习和自然语言处理（NLP）领域，并乐于分享知识与经验的小天地！博主简介：我是二七830，一名对技术充满热情的探索者。多年的Python编程和机器学习实践，使我深入理解了这些技术的核心原理，并能够在实际项目中灵活应用。尤其是在NLP领域，我积累了丰富的经验，能够处理各种复杂的自然语言任务。技术专长：我熟练掌握Python编程语言，并深入研究了机
【中国国际航空-注册_登录安全分析报告】风控牛验证码接口安全评测系列安全行为验证极验网易易盾智能手机
前言由于网站注册入口容易被黑客攻击，存在如下安全问题：1.暴力破解密码，造成用户信息泄露2.短信盗刷的安全问题，影响业务及导致用户投诉3.带来经济损失，尤其是后付费客户，风险巨大，造成亏损无底洞所以大部分网站及App都采取图形验证码或滑动验证码等交互解决方案，但在机器学习能力提高的当下，连百度这样的大厂都遭受攻击导致点名批评，图形验证及交互验证方式的安全性到底如何？请看具体分析一、中国国际航空PC
机器学习流形数据降维：UMAP 降维算法小嗷犬 Python 机器学习 #数据分析及可视化机器学习算法人工智能
✅作者简介：人工智能专业本科在读，喜欢计算机与编程，写博客记录自己的学习历程。个人主页：小嗷犬的个人主页个人网站：小嗷犬的技术小站个人信条：为天地立心，为生民立命，为往圣继绝学，为万世开太平。本文目录UMAP简介理论基础特点与优势应用场景在Python中使用UMAP安装umap-learn库使用UMAP可视化手写数字数据集UMAP简介UMAP（UniformManifoldApproximatio
损失函数与反向传播 Star_. PyTorch pytorch 深度学习 python
损失函数定义与作用损失函数(lossfunction)在深度学习领域是用来计算搭建模型预测的输出值和真实值之间的误差。1.损失函数越小越好2.计算实际输出与目标之间的差距3.为更新输出提供依据（反向传播)常见的损失函数回归常见的损失函数有：均方差（MeanSquaredError，MSE）、平均绝对误差（MeanAbsoluteErrorLoss，MAE）、HuberLoss是一种将MSE与MAE
java观察者模式 3213213333332132 java 设计模式游戏观察者模式
观察者模式——顾名思义，就是一个对象观察另一个对象，当被观察的对象发生变化时，观察者也会跟着变化。在日常中，我们配java环境变量时，设置一个JAVAHOME变量,这就是被观察者，使用了JAVAHOME变量的对象都是观察者，一旦JAVAHOME的路径改动，其他的也会跟着改动。这样的例子很多，我想用小时候玩的老鹰捉小鸡游戏来简单的描绘观察者模式。老鹰会变成观察者，母鸡和小鸡是
TFS RESTful API 模拟上传测试 ronin47
TFS RESTful API 模拟上传测试。　　细节参看这里：https://github.com/alibaba/nginx-tfs/blob/master/TFS_RESTful_API.markdown 模拟POST上传一个图片： curl --data-binary @/opt/tfs.png http
PHP常用设计模式单例, 工厂, 观察者, 责任链, 装饰, 策略,适配,桥接模式 dcj3sjt126com 设计模式 PHP
// 多态, 在JAVA中是这样用的, 其实在PHP当中可以自然消除, 因为参数是动态的, 你传什么过来都可以, 不限制类型, 直接调用类的方法 abstract class Tiger { public abstract function climb(); } class XTiger extends Tiger { public function climb()
hibernate 171815164 Hibernate
main,save Configuration conf =new Configuration().configure(); SessionFactory sf=conf.buildSessionFactory(); Session sess=sf.openSession(); Transaction tx=sess.beginTransaction(); News a=new
Ant实例分析 g21121 ant
下面是一个Ant构建文件的实例，通过这个实例我们可以很清楚的理顺构建一个项目的顺序及依赖关系，从而编写出更加合理的构建文件。下面是build.xml的代码： <?xml version="1
[简单]工作记录_接口返回405原因 53873039oycg 工作
最近调接口时候一直报错，错误信息是: responseCode:405 responseMsg:Method Not Allowed 接口请求方式Post.
关于java.lang.ClassNotFoundException 和 java.lang.NoClassDefFoundError 的区别程序员是怎么炼成的
真正完成类的加载工作是通过调用 defineClass来实现的；而启动类的加载过程是通过调用 loadClass来实现的；就是类加载器分为加载和定义 protected Class<?> findClass(String name) throws ClassNotFoundExcept
JDBC学习笔记-JDBC详细的操作流程 aijuans jdbc
所有的JDBC应用程序都具有下面的基本流程：　　1、加载数据库驱动并建立到数据库的连接。　　2、执行SQL语句。　　3、处理结果。　　4、从数据库断开连接释放资源。下面我们就来仔细看一看每一个步骤：其实按照上面所说每个阶段都可得单独拿出来写成一个独立的类方法文件。共别的应用来调用。 1、加载数据库驱动并建立到数据库的连接： Html代码 St
rome创建rss antonyup_2006 tomcat cms xml struts Opera
引用 1.RSS标准 RSS标准比较混乱，主要有以下3个系列 RSS 0.9x / 2.0 : RSS技术诞生于1999年的网景公司(Netscape)，其发布了一个0.9版本的规范。2001年，RSS技术标准的发展工作被Userland Software公司的戴夫温那(Dave Winer)所接手。陆续发布了0.9x的系列版本。当W3C小组发布RSS 1.0后，Dave W
html表格和表单基础百合不是茶 html 表格表单 meta 锚点
第一次用html来写东西,感觉压力山大,每次看见别人发的都是比较牛逼的再看看自己什么都还不会, html是一种标记语言,其实很简单都是固定的格式 _----------------------------------------表格和表单表格是html的重要组成部分,表格用在body里面的主要用法如下; <table> &
ibatis如何传入完整的sql语句 bijian1013 java sql ibatis
ibatis如何传入完整的sql语句？进一步说，String str ="select * from test_table"，我想把str传入ibatis中执行，是传递整条sql语句。解决办法： <
精通Oracle10编程SQL(14)开发动态SQL bijian1013 oracle 数据库 plsql
/* *开发动态SQL */ --使用EXECUTE IMMEDIATE处理DDL操作 CREATE OR REPLACE PROCEDURE drop_table(table_name varchar2) is sql_statement varchar2(100); begin sql_statement:='DROP TABLE '||table_name;
【Linux命令】Linux工作中常用命令 bit1129 linux命令
不断的总结工作中常用的Linux命令 1.查看端口被哪个进程占用通过这个命令可以得到占用8085端口的进程号，然后通过ps -ef|grep 进程号得到进程的详细信息 netstat -anp | grep 8085 察看进程ID对应的进程占用的端口号 netstat -anp | grep 进程ID &
优秀网站和文档收集白糖_ 网站
集成 Flex, Spring, Hibernate 构建应用程序性能测试工具-JMeter Hmtl5-IOCN网站 Oracle精简版教程网站鸟哥的linux私房菜 Jetty中文文档 50个jquery必备代码片段 swfobject.js检测flash版本号工具
angular.extend boyitech AngularJS angular.extend AngularJS API
angular.extend 复制src对象中的属性去dst对象中. 支持多个src对象. 如果你不想改变一个对象，你可以把dst设为空对象{}: var object = angular.extend({}, object1, object2). 注意: angular.extend不支持递归复制. 使用方法: angular.extend(dst, src); 参数:
java-谷歌面试题-设计方便提取中数的数据结构 bylijinnan java
网上找了一下这道题的解答，但都是提供思路，没有提供具体实现。其中使用大小堆这个思路看似简单，但实现起来要考虑很多。以下分别用排序数组和大小堆来实现。使用大小堆： import java.util.Arrays; public class MedianInHeap { /** * 题目：设计方便提取中数的数据结构 * 设计一个数据结构，其中包含两个函数，1.插
ajaxFileUpload 针对 ie jquery 1.7+不能使用问题修复版本 Chen.H ajaxFileUpload ie6 ie7 ie8 ie9
jQuery.extend({ handleError: function( s, xhr, status, e ) { // If a local callback was specified, fire it if ( s.error ) { s.error.call( s.context || s, xhr, status, e ); }
[机器人制造原则]机器人的电池和存储器必须可以替换 comsci 制造
机器人的身体随时随地可能被外来力量所破坏,但是如果机器人的存储器和电池可以更换,那么这个机器人的思维和记忆力就可以保存下来,即使身体受到伤害,在把存储器取下来安装到一个新的身体上之后,原有的性格和能力都可以继续维持..... 另外,如果一
Oracle Multitable INSERT 的用法 daizj oracle
转载Oracle笔记-Multitable INSERT 的用法 http://blog.chinaunix.net/uid-8504518-id-3310531.html 一、Insert基础用法语法： Insert Into 表名 (字段1,字段2,字段3...） Values (值1,
专访黑客历史学家George Dyson datamachine on
20世纪最具威力的两项发明——核弹和计算机出自同一时代、同一群年青人。可是，与大名鼎鼎的曼哈顿计划（第二次世界大战中美国原子弹研究计划）相比，计算机的起源显得默默无闻。出身计算机世家的历史学家George Dyson在其新书《图灵大教堂》（Turing’s Cathedral）中讲述了阿兰·图灵、约翰·冯·诺依曼等一帮子天才小子创造计算机及预见计算机未来
小学6年级英语单词背诵第一课 dcj3sjt126com english word
always 总是 rice 水稻，米饭 before 在...之前 live 生活，居住 usual 通常的 early 早的 begin 开始 month 月份 year 年 last 最后的 east 东方的 high 高的 far 远的 window 窗户 world 世界 than 比...更
在线IT教育和在线IT高端教育 dcj3sjt126com 教育
codecademy http://www.codecademy.com codeschool https://www.codeschool.com teamtreehouse http://teamtreehouse.com lynda http://www.lynda.com/ Coursera https://www.coursera.
Struts2 xml校验框架所定义的校验文件蕃薯耀 Struts2 xml校验 Struts2 xml校验框架 Struts2校验
>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>> 蕃薯耀 2015年7月11日 15:54:59 星期六 http://fa
mac下安装rar和unrar命令 hanqunfeng mac
1.下载：http://www.rarlab.com/download.htm 选择 RAR 5.21 for Mac OS X 2.解压下载后的文件 tar -zxvf rarosx-5.2.1.tar 3.cd rar sudo install -c -o $USER unrar /bin #输入当前用户登录密码 sudo install -c -o $USER rar
三种将list转换为map的方法 jackyrong list
在本文中，介绍三种将list转换为map的方法： 1）传统方法假设有某个类如下 class Movie { private Integer rank; private String description; public Movie(Integer rank, String des
年轻程序员需要学习的5大经验 lampcy 工作 PHP 程序员
在过去的7年半时间里，我带过的软件实习生超过一打，也看到过数以百计的学生和毕业生的档案。我发现很多事情他们都需要学习。或许你会说，我说的不就是某种特定的技术、算法、数学，或者其他特定形式的知识吗？没错，这的确是需要学习的，但却并不是最重要的事情。他们需要学习的最重要的东西是“自我规范”。这些规范就是：尽可能地写出最简洁的代码；如果代码后期会因为改动而变得凌乱不堪就得重构；尽量删除没用的代码，并添加
评“女孩遭野蛮引产致终身不育 60万赔偿款1分未得”医腐深入骨髓 nannan408
先来看南方网的一则报道：再正常不过的结婚、生子，对于29岁的郑畅来说，却是一个永远也无法实现的梦想。从2010年到2015年，从24岁到29岁，一张张新旧不一的诊断书记录了她病情的同时，也清晰地记下了她人生的悲哀。　　粗暴手术让人发寒　　2010年7月，在酒店做服务员的郑畅发现自己怀孕了，可男朋友却联系不上。在没有和家人商量的情况下，她决定堕胎。　　12月5日，
使用jQuery为input输入框绑定回车键事件 VS 为a标签绑定click事件 Everyday都不同 jsp input 回车键绑定 click enter
假设如题所示的事件为同一个，必须先把该js函数抽离出来，该函数定义了监听的处理： function search() { //监听函数略...... } 为input框绑定回车事件，当用户在文本框中输入搜索关键字时，按回车键，即可触发search(): //回车绑定 $(".search").keydown(fun
EXT学习记录 tntxia ext
1. 准备（1）官网：http://www.sencha.com/ 里面有源代码和API文档下载。 EXT的域名已经从www.extjs.com改成了www.sencha.com ，但extjs这个域名会自动转到sencha上。（2）帮助文档：想要查看EXT的官方文档的话，可以去这里h
mybatis3的mapper文件报Referenced file contains errors xingguangsixian mybatis
最近使用mybatis.3.1.0时无意中碰到一个问题： The errors below were detected when validating the file "mybatis-3-mapper.dtd" via the file "account-mapper.xml". In most cases these errors can be d

PaddleHub2.0——使用动态图版预训练模型ERNIE实现快递单信息抽取

#一train

#二predict

#三流程说明

你可能感兴趣的:(paddlepaddle,人工智能,深度学习,paddlepaddle,机器学习)