褚骏逸

【NLP】Word2vec

文本表示方法

One-hot

优点：
（1）解决了分类器不好处理离散数据的问题
（2）在一定程度上起到了扩充特征的作用

缺点： 尤其是在文本特征表示上
（1）是一个词袋模型，不考虑词与词之间的顺序，丢失词的顺序信息。
（2）假设词与词相互独立。在大多数情况下，词与词是相互影响的。
（3）得到的特征是离散稀疏的。比如将世界所有城市名称作为语料库，那这个向量会过于稀疏，并且会造成维度灾难。

Q: 对于神经网络而言，在输入特征多数为categorical类别变量时，使用one-hot会使维度大大增加，使用one-hot真的比直接用离散数字表示好吗？
S: 分类问题里，损失函数经常定义为预测值和真实值的误差平方和。离散数字编码之后，3被预测为1的损失>3预测为2（与现实不符）。而one-hot则保证了不同的类别距离相同。 当然实际生活中有许多分类变量也带有距离的含义（比如职称），所以标准基乘上系数可能会更好。当然最后还是要结合实际情况。

把词向量的维度变小？

Dristributed representation通过训练，将每个词都映射到一个较短的词向量上来。所有的这些词向量就构成了向量空间，进而可以用普通的统计学的方法来研究词与词之间的关系。这个较短的词向量维度是在训练时指定的。
在 NLP 中，把 $x$ 看做一个句子里的一个词语， $y$ 是这个词语的上下文词语，那么这里的 $f(x)\rarr y$ 就是语言模型（language model）。这个模型的目的，就是判断 $(x, y)$ 这个样本，是否符合自然语言的法则，更通俗点说就是：词语x和词语y放在一起，是不是人话。
Word2vec正是来源于这个思想，但它的最终目的，不是要把 $f$ 训练得多么完美，而是只关心模型训练完后的副产物——模型参数（这里特指神经网络的权重），并将这些参数，作为输入x的某种向量化的表示，这个向量便叫做——词向量。

Word2vec

目的：将“不可计算”“非结构化”的词转化为“可计算”“结构化”的向量。

百度百科：
Word2vec，是一群用来产生词向量的相关模型。这些模型为浅而双层的神经网络，用来训练以重新建构语言学之词文本。网络以词表现，并且需猜测相邻位置的输入词，在word2vec中词袋模型假设下，词的顺序是不重要的。训练完成之后，word2vec模型可用来映射每个词到一个向量，可用来表示词对词之间的关系，该向量为神经网络之隐藏层。

1. Word2vec模型其实就是简单化的神经网络。
2. Word2vec 本质上是一种降维操作：把词语从One-Hot编码形式降维到 Word2vec 形式。
$I n p u t$ ：One-Hot vector
$H i d d e n l a y e r$ ：线性单元，没有激活函数。
$O u t p u t L a y e r$ ：Softmax回归，维度与Input Layer相同。
$O u t p u t$ ：模型通过训练数据所学得的参数，隐层的权重矩阵。

CBOW对小型数据库比较合适，而Skip-Gram在大型语料中表现更好。

CBOW：给定上下文预测target word

全名：Continuous Bag-of-Words

$I n p u t l a y e r$ ：上下文单词的one-hot，假设单词的特征空间的维度为 $V$ 。

$H i d d e n l a y e r$ ：输入层的所有one-hot分别乘以共享的输入权重矩阵 $W_{V×d}$ ，相加求平均，得到隐藏层向量，size为 $1 \times d$ 。

$L o s s f u n c t i o n$ ：一般为交叉熵代价函数，采用梯度下降算法更新 $W$ 和 $W^{'}$ 。

$O u t p u t l a y e r$ ：隐藏层向量乘以输出层权重矩阵 $W'_ {d×V}$ ，得到 $1 \times V$ 向量。经激活函数，得到维度为 $V$ 的概率分布，其中的每一维代表着一个单词的概率（因为是one-hot）。概率最大的index所指示的单词为预测出的中间词（target word），将概率与true label的one-hot做比较，误差越小越好（根据误差更新权重矩阵）。

$N e e d O u t p u t$ ：权重矩阵 $W_{V×d}$ ，其中 $d$ 为自己设定的数。训练完毕后，输入层的每个单词的one-hot与矩阵 $W$ 相乘，得到的向量的就是我们想要的词向量（word embedding）。矩阵 $W$ 就是所有单词的word embedding，也叫做look up table。 也就是说，任何一个单词的one-hot乘以 $W$ 都将得到该单词的词向量。有了look up table就可以免去训练过程，直接查表得到单词的词向量了。

举例：窗口大小是2，表示选取coffe前面两个单词和后面两个单词，作为input词。
训练出来的look up table为矩阵W。即，任何一个单词的one-hot表示乘以W都将得到该单词的word embedding。

Skip-Gram：给定input word来预测上下文

获取训练数据

上图中：

Training Samples =（Input word， Output word）
Input word：蓝色框词
参数skip_window = 2表示从当前Input word的一侧（左边或右边）选取词的数量为2，白色框词。
参数num_skips表示从整个窗口中选取多少个不同的词，作为output word。

模型训练

神经网络基于这些训练数据，输出概率分布（代表着词典中的每个词是output word的可能性）。如先拿一组数据 (‘dog’, ‘barked’) 来训练神经网络，那么模型通过学习这个训练样本，会告诉我们词汇表中每个单词是“barked”的概率。模型的输出概率代表着：词典中每个词有多大可能性跟input word同时出现。
过程：通过给神经网络输入文本中成对的单词来训练它完成上述概率计算。
再次注意：我们需要的是训练出来的权重矩阵。

此处需要还是 $W$ ，而不是 $W^{'}$ 。因为 $y$ 是概率，而不是one-hot！词向量是one-hot $\times W$ 。

训练技巧

Word2vec是一个多分类问题。但实际当中，词语的个数非常多，计算难，所以需要用加速技巧。

Hierarchical softmax
是 softmax 的一种近似形式，本质是把 N 分类问题变成 log(N)次二分类。
Negative sampling
本质是预测总体类别的一个子集。

优点

考虑上下文，因此跟之前的Embedding方法相比，效果要更好（但不如18年之后的方法）。
比之前的Embedding方法维度更少，所以速度更快。
通用性很强，可以用在各种 NLP任务中。

缺点

由于词和向量是一对一的关系，所以无法解决多义词。
是一种静态的方式，虽然通用性强，但是无法针对特定任务做动态优化。

句子、文档层面的任务

计算相似度
- 寻找相似词
- 信息检索
作为SVM/LSTM等模型的输入
- 中文分词
- 命名体识别
句子表示
- 情感分析
文档表示
- 文档主题判别

实现：Gensim 和 NLTK

import gensim
sentences=word2vec.Text8Corpus("test.txt")  #加载语料库，此处训练集为英文文本或分好词的中文文本，注意去停用词
model=gensim.models.Word2Vec(sentences,sg=1,size=100,window=5,min_count=2,negative=3,sample=0.001,hs=1,workers=4)
model.save("文本名")	# 模型保存，打开为乱码
#model.wv.save_word2vec_format("文件名"，binary = "Ture/False")  #通过该方式保存的模型，能通过文本格式打开，也能通过设置binary是否保存为二进制文件。但该模型在保存时丢弃了树的保存形式（详情参加word2vec构建过程，以类似哈夫曼树的形式保存词），所以在后续不能对模型进行追加训练

gensim.models.Word2Vec.load("模型文件名") # 对.sava保存的模型的加载
model = model.wv.load_word2vec_format('模型文件名') # 对..wv.save_word2vec_format保存的模型的加载

model.train(more_sentences) # 追加训练。如果对..wv.save_word2vec_format加载的模型进行追加训练，会报错

model.most_similar("word",topn=10)	# 计算与该词最近似的10个词
model.similarity("word1","word2")   # 计算两个词的相似度
model ['word'] # 获取词向量

Natural Language Toolkit：自然语言处理工具包，在NLP领域中，最常使用的一个Python库。

扩展

在词嵌入领域，除了 Word2vec之外，还有基于共现矩阵分解的GloVe等词嵌入方法。

来斯惟博士在它的博士论文附录部分，证明了Skip-gram 模型和GloVe的cost fucntion本质上是一样的。

输入不一定非得是One-Hot。
Word2vec在2018年之前比较主流，但是随着BERT、GPT2.0的出现，它已经不算效果最好的方法了。

思考

Word2vec考虑了上下文，那算考虑了词顺序吗？

参考

https://www.jianshu.com/p/471d9bfbd72f
https://zhuanlan.zhihu.com/p/26306795
https://easyai.tech/ai-definition/word2vec/
https://blog.csdn.net/qq_28840013/article/details/89681499

YOLO1至YOLOV3方法讲解 weixin_34090643
YOLO方法总结computevisual计算机视觉总结Github:https://github.com/Codermay/Test-1**重点https://github.com/jiajunhua/SnailTyan-deep-learning-papers-translation目标检测方法总结网址：https://handong1587.github.io/deep_learning/2
pytorch 对图片进行归一化处理泰勒朗斯 AI pytorch 人工智能 python
如题，神经网络通常使用浮点数张量作为输入，我们要做的第一件事情就是将图片转化为浮点数，并且做归一化操作。importtorchimportimageioimportosdata_dir='F:\\work\\deep_learning\\pytorch\\dlwpt-code-master\\data\\p1ch4\\image-cats'print(data_dir)file_names=[na
LSTM 大佬博客美环花子若野
ReferencesDanielHnyk:http://danielhnyk.cz/predicting-sequences-vectors-keras-using-rnn-lstm/Vict0rSch:https://github.com/Vict0rSch/deep_learning/tree/master/keras/recurrentJasonBrownlee:http://machine
object detection clxiaoclxiao paper 算法图像
原地址：https://handong1587.github.io/deep_learning/2015/10/09/object-detection.htmlObjectDetectionPublished:09Oct2015Category:deep_learningJumpto...PapersR-CNNFastR-CNNFasterR-CNNLight-HeadR-CNNCascadeR-
tensorboard显示无数据解决方法No scalar data was found 以及终端命令tensorboard --logdir logs无反应 Tony 深度学习 pytorch 深度学习
本文记录在学习tensorboard时遇到的坑，tensorboard显示无数据解决方法Noscalardatawasfound以及终端命令tensorboard--logdirlogs无反应2022/3/25更新时至今日我才发现真正的原因：其实是路径问题如果在F:\python_project\deep_learning\logs路径下tensorboard--logdirlogs是在logs这
Object Detection--的一个好的对比总结文章 leoking01
https://handong1587.github.io/deep_learning/2015/10/09/object-detection.htmlJumpto...LeaderboardPapersR-CNNFastR-CNNFasterR-CNNMultiBoxSPP-NetDeepID-NetNoCDeepBoxMR-CNNYOLOYOLOv2AttentionNetDenseBoxSS
本人亲测解决ipython及jupyter不能使用tensorflow的问题 weixin_43787109 人工智能机器学习 python ipython jupyter tensorflow no module named 'tensorflow'不能用
1.在ipython下无法使用的解决方案尝试在Anaconda/lib/site-packages中新建path.pth文件，里面内容为指定的虚拟环境名下的lib/site-packages位置。例如：D:\ProgramData\Anaconda3\envs\deep_learning\Lib\site-packages2.jupyter不能使用的处理办法在conda环境中使用命令安装ipyke
目标检测论文库洛北辰南深度学习目标检测 object detection
转自：https://handong1587.github.io/deep_learning/2015/10/09/object-detection.htmlObjectDetectionPublished:09Oct2015Category:deep_learningJumpto...PapersR-CNNFastR-CNNFasterR-CNNYOLOYOLOv2YOLOv3DenseBoxS
git 上传代码孙敬博 git git
这里写目录标题在本地库关联git仓库上传代码在本地库关联git仓库如果已经关联过其他的代码仓库，会出现：base)root@node05:~/deep_learning/SMARTS/SMARTS#gitremoteaddoriginhttps://github.com/xxxxx/xxxxx.gitfatal:remoteoriginalreadyexists.先查看已经关联的代码仓库：(bas
windows安装mmcv-full教程汇总夏日的_风 mmlab windows python 深度学习
安装参考链接https://www.zywvvd.com/2021/04/20/deep_learning/windows-mmcv-1-2-7-install/windows-mmcv-1-2-7-install/https://zhuanlan.zhihu.com/p/308281195错误处理链接https://zhuanlan.zhihu.com/p/340973730https://bl
SVM鸢尾花分类凯若Irving python 可视化深度学习
最近学习了SVM支持向量机模型，并用uci上的数据集做了简单的鸢尾花分类。svm数学原理代码fromsklearnimportsvmimportnumpyasnpfromsklearnimportmodel_selectionimportmatplotlib.pyplotasplt#导入数据集path="/Users/lkr/Documents/deep_learning/SVM/iris.dat
Object Detection(目标检测论文、代码资源整合) 子季鹰才
目标检测神文，非常全而且持续在更新。转发自：https://handong1587.github.io/deep_learning/2015/10/09/object-detection.html，如有侵权联系删除。https://blog.csdn.net/alphonse2017/article/details/85103295，我会跟进原作者博客持续更新，加入自己对目标检测领域的一些新研究及
Object Detection(目标检测神文) Hellowongwong php c/c++matlab object detect faster R-CNN SSD YOLO MTCNN 目标检测
转ObjectDetection(目标检测神文)2018年08月21日14:25:28Mars_WH阅读数23382标签：objectdetectfasterR-CNNSSDYOLOMTCNN更多个人分类：目标检测目标检测神文，非常全而且持续在更新。转发自：https://handong1587.github.io/deep_learning/2015/10/09/object-detection
20170909深度学习solar测试日志百年九重宫 tensorflow python 深度学习
py@py-System-Product-Name:~/deep_learning/TFLearn/re$pythonretrain.py–image_dir~/20170513DPLookingforimagesin‘BadDP’Lookingforimagesin‘GoodDP’2017-09-0916:26:23.319098:Wtensorflow/core/platform/cpu_fe
通用目标检测（集合） monk1992 目标检测+识别
No1.推荐博客集合https://handong1587.github.io/deep_learning/2015/10/09/object-detection.html#blogsNo2.知乎上的一个专栏（精品比女神nice）：https://www.zhihu.com/people/george-zhang-84/posts
基于Tensorflow实现FFM LeadAI学院
正文共3084张图，16张图，预计阅读时间15分钟。github：https://github.com/sladesha/deep_learning没错，这次登场的是FFM。各大比赛中的“种子”算法，中国台湾大学Yu-ChinJuan荣誉出品，美团技术团队背书，MichaelJahrer的论文的field概念灵魂升华，土豪公司鉴别神器。通过引入field的概念，FFM把相同性质的特征归于同一个fi
vs2017安装配置 qq526928635 安装工具
安装文件路径：H:\deep_learning\环境配置缺少windows.h，stdlib.h等文件参考https://blog.csdn.net/z_m_1/article/details/80833782
Object Detection mjiansun 机器学习
目标检测神文，非常全而且持续在更新。转发自：https://handong1587.github.io/deep_learning/2015/10/09/object-detection.html，如有侵权联系删除。我会跟进原作者博客持续更新，加入自己对目标检测领域的一些新研究及论文解读。博客根据需求直接进行关键字搜索，例如2018，可找到最新论文。Papers——————————————————
数字识别手写神经网络实现基于MNIST数据集 Justdoforever 深度学习
MNIST数据集自行baidu下载，解压后放到项目文件里git详细代码仓库：https://github.com/justDoForever/deep_learning/digital_recognition.py(python2.7)理论分析:https://www.zybuluo.com/hanbingtao/note/476663代码如下:#encoding:utf-8#神经网络实现数字识别
Object Detection目标检测全面总结--重要 chen645096127 机器学习
原地址：https://handong1587.github.io/deep_learning/2015/10/09/object-detection.htmlObjectDetectionPublished:09Oct2015Category:deep_learningJumpto...PapersR-CNNFastR-CNNFasterR-CNNLight-HeadR-CNNCascadeR-
Object Detection(目标检测神文) weixin_30699955 object detect faster R-CNN SSD YOLO MTCNN 目标检测
转ObjectDetection(目标检测神文)2018年08月21日14:25:28Mars_WH阅读数23382标签：objectdetectfasterR-CNNSSDYOLOMTCNN更多个人分类：目标检测目标检测神文，非常全而且持续在更新。转发自：https://handong1587.github.io/deep_learning/2015/10/09/object-detection
目标检测领域论文和代码集合(2013年~2018年8月) 马卫飞 CNN--ANN--Deep Learning
转载链接:https://handong1587.github.io/deep_learning/2015/10/09/object-detection.htmlJumpto...PapersR-CNNFastR-CNNFasterR-CNNLight-HeadR-CNNCascadeR-CNNMultiBoxSPP-NetMR-CNNYOLOYOLOv2YOLOv3DenseBoxSSDDSSD
Deep Learning 基础 -- 防止过拟合/预训练模型 ProYH Deep-Learning
DeepLearning基础–防止过拟合/预训练模型Tags：Deep_Learning本文主要包含如下内容：DeepLearning基础–防止过拟合/预训练模型发生过拟合的原因防止过拟合（过拟合无法避免）引入正则化Dropout提前终止交叉验证增加样本量(数据增广)批量归一化(BN:BatchNormalization)预训练模型/迁移学习发生过拟合的原因过拟合指在模型参数拟合过程中的问题，
图像语义分割 zbxzc 计算机视觉
https://handong1587.github.io/deep_learning/2015/10/09/segmentation.htmlhttp://blog.csdn.net/column/details/15893.htmlpascal_voc语义分割排行榜http://host.robots.ox.ac.uk:8080/leaderboard/displaylb.php?challe
通过简单神经网络识别猫图片 lovelife110 AI
代码位置：https://github.com/lilihongjava/deep_learning/tree/master/%E7%A5%9E%E7%BB%8F%E7%BD%91%E7%BB%9C%E8%AF%86%E5%88%AB%E7%8C%AB数据预处理：数据为H5文件，保存训练集有209张64x64的图像，训练集的图像对应的分类值（【0|1】，0表示不是猫，1表示是猫）测试集里面的图像数
目标检测最新方法介绍 zhang11wu4 目标检测
https://handong1587.github.io/deep_learning/2015/10/09/nlp.htmlJumpto...LeaderboardPapersR-CNNMultiBoxSPP-NetDeepID-NetNoCFastR-CNNDeepBoxMR-CNNFasterR-CNNYOLOAttentionNetDenseBoxSSDInside-OutsideNet(
阿里云高性能AI服务 -- 基于Docker和EGS一键创建高性能Tensorflow分布式训练 weixin_33911824
一.概述Tensorflow是目前使用最为广泛的深度学习框架之一，但是目前搭建分布式多机多卡训练比较困难，而且Tensorflow原生的分布式的性能很差，特别在云计算虚拟化环境下并行的挑战更大。为了解决这个问题，我们创建了一个容器镜像：registry.cn-beijing.aliyuncs.com/ai_beijing/deep_learning:vx.x.x，目前包含了Tensorflow很新
Halcon Classification（三）deep_learning classifier 逸_ Halcon deep learning
halcon例程deeplearning水果分类器。*Thisexampleshowshowtotrainadeeplearningfruitclassifier,alongwith*ashortoverviewofthenecessarysteps.训练分类器*Initialization.dev_update_off()dev_close_window()WindowWidth:=800Win
Deep Learning Resources ShiningJotes Python Tensorflow
转自：https://handong1587.github.io/deep_learning/2015/10/09/dl-resources.htmlImageNetSingle-modelon224x224Methodtop1top5ModelSizeSpeedResNet-10178.0%94.0%ResNet-20078.3%94.2%Inception-v3Inception-v4Ince
目标检测神文 clxiaoclxiao 算法图像 paper
目标检测神文，非常全而且持续在更新。转发自：https://handong1587.github.io/deep_learning/2015/10/09/object-detection.html，如有侵权联系删除。更新时间：20190226我会跟进原作者博客持续更新，加入自己对目标检测领域的一些新研究及论文解读。博客根据需求直接进行关键字搜索，例如2018，可找到最新论文。文章目录Papers损
解线性方程组 qiuwanchi
package gaodai.matrix; import java.util.ArrayList; import java.util.List; import java.util.Scanner; public class Test { public static void main(String[] args) { Scanner scanner = new Sc
在mysql内部存储代码 annan211 性能 mysql 存储过程触发器
在mysql内部存储代码在mysql内部存储代码，既有优点也有缺点，而且有人倡导有人反对。先看优点： 1 她在服务器内部执行，离数据最近，另外在服务器上执行还可以节省带宽和网络延迟。 2 这是一种代码重用。可以方便的统一业务规则，保证某些行为的一致性，所以也可以提供一定的安全性。 3 可以简化代码的维护和版本更新。 4 可以帮助提升安全，比如提供更细
Android使用Asynchronous Http Client完成登录保存cookie的问题 hotsunshine android
Asynchronous Http Client是android中非常好的异步请求工具除了异步之外还有很多封装比如json的处理，cookie的处理引用 Persistent Cookie Storage with PersistentCookieStore This library also includes a PersistentCookieStore whi
java面试题 Array_06 java 面试
java面试题第一，谈谈final, finally, finalize的区别。 final-修饰符（关键字）如果一个类被声明为final，意味着它不能再派生出新的子类，不能作为父类被继承。因此一个类不能既被声明为 abstract的，又被声明为final的。将变量或方法声明为final，可以保证它们在使用中不被改变。被声明为final的变量必须在声明时给定初值，而在以后的引用中只能
网站加速 oloz 网站加速
前序:本人菜鸟，此文研究总结来源于互联网上的资料，大牛请勿喷！本人虚心学习，多指教. 1、减小网页体积的大小，尽量采用div+css模式，尽量避免复杂的页面结构，能简约就简约。 2、采用Gzip对网页进行压缩； GZIP最早由Jean-loup Gailly和Mark Adler创建，用于UNⅨ系统的文件压缩。我们在Linux中经常会用到后缀为.gz
正确书写单例模式随意而生 java 设计模式单例
　　单例模式算是设计模式中最容易理解，也是最容易手写代码的模式了吧。但是其中的坑却不少，所以也常作为面试题来考。本文主要对几种单例写法的整理，并分析其优缺点。很多都是一些老生常谈的问题，但如果你不知道如何创建一个线程安全的单例，不知道什么是双检锁，那这篇文章可能会帮助到你。　　懒汉式，线程不安全　　当被问到要实现一个单例模式时，很多人的第一反应是写出如下的代码，包括教科书上也是这样
单例模式香水浓 java
懒汉调用getInstance方法时实例化 public class Singleton { private static Singleton instance; private Singleton() {} public static synchronized Singleton getInstance() { if(null == ins
安装Apache问题：系统找不到指定的文件 No installed service named "Apache2" AdyZhang apache http server
安装Apache问题：系统找不到指定的文件 No installed service named "Apache2" 每次到这一步都很小心防它的端口冲突问题，结果，特意留出来的80端口就是不能用，烦。解决方法确保几处： 1、停止IIS启动 2、把端口80改成其它（譬如90，800，，，什么数字都好） 3、防火墙(关掉试试) 在运行处输入 cmd 回车，转到apa
如何在android 文件选择器中选择多个图片或者视频？ aijuans android
我的android app有这样的需求，在进行照片和视频上传的时候，需要一次性的从照片/视频库选择多条进行上传但是android原生态的sdk中，只能一个一个的进行选择和上传。我想知道是否有其他的android上传库可以解决这个问题，提供一个多选的功能，可以使checkbox之类的，一次选择多个处理方法官方的图片选择器(但是不支持所有版本的androi，只支持API Level
mysql中查询生日提醒的日期相关的sql baalwolf mysql
SELECT sysid,user_name,birthday,listid,userhead_50,CONCAT(YEAR(CURDATE()),DATE_FORMAT(birthday,'-%m-%d')),CURDATE(), dayofyear( CONCAT(YEAR(CURDATE()),DATE_FORMAT(birthday,'-%m-%d')))-dayofyear(
MongoDB索引文件破坏后导致查询错误的问题 BigBird2012 mongodb
问题描述： MongoDB在非正常情况下关闭时，可能会导致索引文件破坏，造成数据在更新时没有反映到索引上。解决方案：使用脚本，重建MongoDB所有表的索引。 var names = db.getCollectionNames(); for( var i in names ){ var name = names[i]; print(name);
Javascript Promise bijian1013 JavaScript Promise
Parse JavaScript SDK现在提供了支持大多数异步方法的兼容jquery的Promises模式，那么这意味着什么呢，读完下文你就了解了。一.认识Promises “Promises”代表着在javascript程序里下一个伟大的范式，但是理解他们为什么如此伟大不是件简
[Zookeeper学习笔记九]Zookeeper源代码分析之Zookeeper构造过程 bit1129 zookeeper
Zookeeper重载了几个构造函数，其中构造者可以提供参数最多，可定制性最多的构造函数是 public ZooKeeper(String connectString, int sessionTimeout, Watcher watcher, long sessionId, byte[] sessionPasswd, boolea
【Java命令三】jstack bit1129 jstack
jstack是用于获得当前运行的Java程序所有的线程的运行情况(thread dump），不同于jmap用于获得memory dump [hadoop@hadoop sbin]$ jstack Usage: jstack [-l] <pid> (to connect to running process) jstack -F
jboss 5.1启停脚本　动静分离部署 ronin47
以前启动jboss，往各种xml配置文件，现只要运行一句脚本即可。start nohup sh /**/run.sh -c servicename -b ip -g clustername -u broatcast jboss.messaging.ServerPeerID=int -Djboss.service.binding.set=p
UI之如何打磨设计能力? brotherlamp UI ui教程 ui自学 ui资料 ui视频
在越来越拥挤的初创企业世界里，视觉设计的重要性往往可以与杀手级用户体验比肩。在许多情况下，尤其对于 Web 初创企业而言，这两者都是不可或缺的。前不久我们在《右脑革命：别学编程了，学艺术吧》中也曾发出过重视设计的呼吁。如何才能提高初创企业的设计能力呢?以下是 9 位创始人的体会。 1.找到自己的方式如果你是设计师，要想提高技能可以去设计博客和展示好设计的网站如D-lists或
三色旗算法 bylijinnan java 算法
import java.util.Arrays; /** 问题：假设有一条绳子，上面有红、白、蓝三种颜色的旗子，起初绳子上的旗子颜色并没有顺序，您希望将之分类，并排列为蓝、白、红的顺序，要如何移动次数才会最少，注意您只能在绳子上进行这个动作，而且一次只能调换两个旗子。网上的解法大多类似：在一条绳子上移动，在程式中也就意味只能使用一个阵列，而不使用其它的阵列来
警告:No configuration found for the specified action: \'s chiangfai configuration
1.index.jsp页面form标签未指定namespace属性。  <%@taglib prefix="s" uri="/struts-tags"%> ... <s:form action="submit" method="post"&g
redis -- hash_max_zipmap_entries设置过大有问题 chenchao051 redis hash
使用redis时为了使用hash追求更高的内存使用率，我们一般都用hash结构，并且有时候会把hash_max_zipmap_entries这个值设置的很大，很多资料也推荐设置到1000，默认设置为了512，但是这里有个坑 #define ZIPMAP_BIGLEN 254 #define ZIPMAP_END 255 /* Return th
select into outfile access deny问题 daizj mysql txt 导出数据到文件
本文转自：http://hatemysql.com/2010/06/29/select-into-outfile-access-deny%E9%97%AE%E9%A2%98/ 为应用建立了rnd的帐号，专门为他们查询线上数据库用的，当然，只有他们上了生产网络以后才能连上数据库，安全方面我们还是很注意的，呵呵。授权的语句如下： grant select on armory.* to rn
phpexcel导出excel表简单入门示例 dcj3sjt126com PHP Excel phpexcel
<?php error_reporting(E_ALL); ini_set('display_errors', TRUE); ini_set('display_startup_errors', TRUE); if (PHP_SAPI == 'cli') die('This example should only be run from a Web Brows
美国电影超短200句 dcj3sjt126com 电影
1. I see．我明白了。2. I quit! 我不干了!3. Let go! 放手!4. Me too．我也是。5. My god! 天哪!6. No way! 不行!7. Come on．来吧(赶快)8. Hold on．等一等。9. I agree。我同意。10. Not bad．还不错。11. Not yet．还没。12. See you．再见。13. Shut up!
Java访问远程服务 dyy_gusi httpclient webservice get post
随着webService的崛起，我们开始中会越来越多的使用到访问远程webService服务。当然对于不同的webService框架一般都有自己的client包供使用，但是如果使用webService框架自己的client包，那么必然需要在自己的代码中引入它的包，如果同时调运了多个不同框架的webService，那么就需要同时引入多个不同的clien
Maven的settings.xml配置 geeksun settings.xml
settings.xml是Maven的配置文件，下面解释一下其中的配置含义： settings.xml存在于两个地方： 1.安装的地方：$M2_HOME/conf/settings.xml 2.用户的目录：${user.home}/.m2/settings.xml 前者又被叫做全局配置，后者被称为用户配置。如果两者都存在，它们的内容将被合并，并且用户范围的settings.xml优先。
ubuntu的init与系统服务设置 hongtoushizi ubuntu
转载自： http://iysm.net/?p=178 init Init是位于/sbin/init的一个程序，它是在linux下，在系统启动过程中，初始化所有的设备驱动程序和数据结构等之后，由内核启动的一个用户级程序，并由此init程序进而完成系统的启动过程。 ubuntu与传统的linux略有不同，使用upstart完成系统的启动，但表面上仍维持init程序的形式。运行
跟我学Nginx+Lua开发目录贴 jinnianshilongnian nginx lua
使用Nginx+Lua开发近一年的时间，学习和实践了一些Nginx+Lua开发的架构，为了让更多人使用Nginx+Lua架构开发，利用春节期间总结了一份基本的学习教程，希望对大家有用。也欢迎谈探讨学习一些经验。目录第一章安装Nginx+Lua开发环境第二章 Nginx+Lua开发入门第三章 Redis/SSDB+Twemproxy安装与使用第四章 L
php位运算符注意事项 home198979 位运算 PHP &
$a = $b = $c = 0; $a & $b = 1; $b | $c = 1 问a,b,c最终为多少? 当看到这题时，我犯了一个低级错误，误以为位运算符会改变变量的值。所以得出结果是1 1 0 但是位运算符是不会改变变量的值的，例如： $a=1;$b=2; $a&$b; 这样a,b的值不会有任何改变
Linux shell数组建立和使用技巧 pda158 linux
1.数组定义　　[chengmo@centos5 ~]$ a=(1 2 3 4 5) 　　[chengmo@centos5 ~]$ echo $a 　　1 　　一对括号表示是数组，数组元素用“空格”符号分割开。　　 2.数组读取与赋值　　得到长度：　　[chengmo@centos5 ~]$ echo ${#a[@]} 　　5 　　用${#数组名[@或
hotspot源码(JDK7) ol_beta java HotSpot jvm
源码结构图，方便理解： ├─agent Serviceab
Oracle基本事务和ForAll执行批量DML练习 vipbooks oracle sql
基本事务的使用：从账户一的余额中转100到账户二的余额中去，如果账户二不存在或账户一中的余额不足100则整笔交易回滚 select * from account; -- 创建一张账户表 create table account( -- 账户ID id number(3) not null, -- 账户名称 nam