击败GPT3，刷新50个SOTA！谷歌全面统一NLP范式

文 | ZenMoore
编 | 小轶

写在前面

一觉醒来，迷糊之中看到一条推特：

瞬间清醒！

Google 的 Yi Tay (and Mostafa) 团队提出了一个新的策略 Mixture-of-Denoisers, 统一了各大预训练范式。

重新思考现在的预训练精调，我们有各种各样的预训练范式：decoder-only or encoder-decoder, span corruption or language model, 等等，不同的范式建模了不同的上下文关系，也正是因为如此，不同的预训练范式适配不同类型的下游任务。例如，基于双向上下文的预训练(span corruption，如T5)更加适用于 fact completion，基于单向上文(PrefixLM/LM，如GPT等)更加适用于 open ended. 也就是说，具体的下游任务类型需要选用特定的预训练策略...

准确地说，常见有三套范式：单向文本建模的CausalLM(i.e. LM)，双向文本建模的 span corruption, 前缀文本建模的 PrefixLM.

这是大一统吗？感觉只能是小一统，总感觉还缺少一味菜！

今天，Google 把这道菜补上了！那就是：Mixture-of-Denoisers

先来感受一下效果：

击败GPT3，刷新50个SOTA！谷歌全面统一NLP范式_第4张图片

论文标题：Unifying Language Learning Paradigms
论文作者：Yi Tay, Mostafa Dehghani, etc. (Google)
论文链接：https://arxiv.org/pdf/2205.05131.pdf

方法 (UL2)

先说一下本文方法的目的：构建一种独立于模型架构以及下游任务类型的预训练策略，可以灵活地适配不同类型的下游任务。

整个方法的框架和 UniLM[1] 是很相似的，但是引入了稀疏化。

Mixture-of-Denoisers

首先回顾上文所说的三个预训练范式：CausalLM, PrefixLM, span corruption，其实都可以统一到 span corruption ：

定义函数 , 这里为平均 span 长度，为 corruption rate, 为 corrupted span 的数量.定义输入序列长度为，经过正态分布或者均匀分布采样 corrputed span 后，训练模型学习恢复这些 span.

可见，对于 CausalLM，只需要设置 ; 对于 PrefixLM, 只需要设置 (为前缀长度)。

基于此，作者提出了 Mixture-of-Denoisers :

击败GPT3，刷新50个SOTA！谷歌全面统一NLP范式_第5张图片

R-Denoiser : regular denoising. corrupted span 的长度为 2-5 个 tokens, 大约是 15% 的掩码率。通常用于获得知识而不是生成流畅文本的能力。
S-Denoiser : sequential denoising. 保留严格的序列顺序，通常用于 inputs-to-targets 任务，如 PrefixLM. 需要注意的是，可见的 Prefix 仍然是上下文建模方式，但是被掩码掉的长 span 是不可见的。
X-Denoiser : extreme denoising. 可以看作 R-denoiser 和 S-denoiser 的中间体，是一种极端的情况，也就是 span length 非常长，或者 masking rate 非常大。一般用于长文本生成任务，因为这类任务一般只有非常有限的上下文记忆信息。

最后，本文使用的七个 denoiser 设定如下：

击败GPT3，刷新50个SOTA！谷歌全面统一NLP范式_第6张图片

Mode Switching

本文提出通过 mode-switching 来进行 paradigm-shifting. 首先在预训练的时候，新增三个 special tokens : ，分别指代三个 paradigms (i.e... denoiser). 然后在下游任务精调或者小样本学习时，也为特定任务的设定和需要，新增一个 paradigm token, 以触发模型学习更优的方案。

然后在主体模型架构上，使用 encoder-decoder 还是 decoder-only 是不重要的，因为本文方法的初衷就在于 architecture-agnostic (架构无关). 因此，作者基于 T5，对两种设定都进行了相关实验。

实验

消融实验

任务设定：

SuperGLUE (SG) ：8 NLU sub-tasks
GEM benchmark : XSUM (summarization), ToTTo (table-to-text generation), Schema Guided Dialog (SGD)
C4 validation set

场景设定：

精调(fine-tuning)
基于提示的单样本学习

Baselines :

Causal Language Model (CLM) : GPT-style
Prefix LM (PLM)
Span Corruption (SC) : T5-style
Span Corruption + LM (SCLM)
UniLM (ULM)

Decoder v.s. Encoder-Decoder

结论：当不考虑存储时，encoder-decoder 比 decoder-only 更优；比起 backbone 架构，自监督目标更加重要。

Paradigm Prompt (mode switching)

击败GPT3，刷新50个SOTA！谷歌全面统一NLP范式_第9张图片

结论：在 one-shot 场景下，使用范式提示几乎总是更好，但是，选对 paradigm prompt 非常关键。

Mixture-of-Denoisers

击败GPT3，刷新50个SOTA！谷歌全面统一NLP范式_第10张图片

▲SD% 表示 S-Denoisers 的占比

结论：X-denoising 有补充性效果，但不能单用；只用一小部分 S-Denoisers () 更好。

小幅增加模型尺寸以及预训练数据量

击败GPT3，刷新50个SOTA！谷歌全面统一NLP范式_第11张图片

结论：本文方法在 SuperGLUE 上比 T5 差了一点，但是其他任务仍然领先。

200亿参数！

好了，现在开始壕起来：Scaling to 20B Parameters！

虽然这个方法是 architecture agnostic （架构无关）的，但基于上面的消融实验，我们 prefer Encoder-Decoder 架构，更重要的是：Encoder-Decoder 具备固有的稀疏特性(intrinsic sparsity)

任务设定：

文本生成：摘要和 data-to-text 生成。数据集：CNN/Dailymail，XSUM，MultiNews，SAMSum，WebNLG，E2E，CommonGen
人工评测的文本生成：aNLG, ARC-DA, WMT19, XSUM
理解、分类、问答：RACE, QASC, OpenBookQA, TweetQA, QuAIL, IMDB, Agnews, DocNLI, Adversarial NLI, VitaminC, Civil Comments and Wikipedia Toxicity detection
常识推理：HellaSwag, SocialIQA/SIQA, PhysicalIQA/PIQA, CosmosQA, AbductiveNLI, CommonsenseQA, CommonsenseQA2
长程推理：Scrolls benchmark (GovReport, SumScr, QMSUm, QASPER, NarrativeQA, QuaLITY, ContractNLI )
结构化知识 (Structured Knowledge Grounding): UnifiedSKG (WikiTQ, CompWQ, FetaQA, HybridQA, WikiSQL, TabFat, Feverous, SQA, MTOP, DART)
信息检索：Natural Questions

有意思的是：对于信息检索，作者使用的是 DSI[2] 进行的实验，简单说就是 text-to-docid 进行检索。

评测结果：

Tradeoffs between Finetuning and Prompt-based Zero-shot Learning (SuperGLUE)

Generative Few-shot: XSUM Summarization

击败GPT3，刷新50个SOTA！谷歌全面统一NLP范式_第14张图片

Summary of UL20B results compared to state-of-the-art

写在最后

看完这篇之后，总的感觉并没有第一眼看到推特时那样激动，或者说，也没有当初学习 UniLM[1] 时的感觉强烈。

我在之前的文章也提到过，Prompt 主要适用于三个场景：低资源、低算力、统一场景。也曾在知乎上发表过想法：Prompt 在某种程度上可以进行模型的专家化(expertization)或者模块化(modularization)，需要和 Mixture-of-Experts 进行沟通。这篇文章使用 paradigm prompt 进行 denoiser 的 mode switching，有进一步的启发意义。脱离 denoiser 的 mixture，可能会有更加宏大的 picture.

另外，一直来说，为不同的下游任务部署特定的模型，是一个很消耗资源的方式，因此，一个统一的 black box 是必然的。虽然 GPT-3/T0[3] 等通过 instruction/prompt 或 in-context learning 等方式，为解决这个问题提供了思路，但是要真正 beat task-specific finetuning, 仍然有一段路要走。希望从这篇文章出发，能够彻底解决这个关键的部署问题。

萌屋作者：ZenMoore

北航本科生，爱数学爱物理爱 AI 想从 NLP 出发探索人工认知人工情感的奥秘！个人主页 zenmoore.github.io 知乎 ZenMoore, 微信 zen1057398161 嘤其鸣矣，求其友声✨！

作品推荐

一文跟进Prompt进展！综述+15篇最新论文逐一梳理

图灵奖大佬+谷歌团队，为通用人工智能背书！CV 任务也能用 LM 建模！

以4%参数量比肩GPT-3！Deepmind 发布检索型 LM，或将成为 LM 发展新趋势！？

后台回复关键词【入群】

加入卖萌屋NLP、CV与搜推广与求职讨论群

后台回复关键词【顶会】

获取ACL、CIKM等各大顶会论文集！

[1] UniLM : https://arxiv.org/pdf/1905.03197.pdf

[2] DSI : https://arxiv.org/pdf/2202.06991.pdf

[3] T0 : https://arxiv.org/pdf/2110.08207.pdf

你可能感兴趣的:(人工智能,机器学习,深度学习,自然语言处理,java)

昇思25天学习打卡十分钟ll 昇思25天学习打卡 python pytorch 视觉检测图像处理
@[TOC]《昇思25天学习打卡营第02天|lulul》张量Tensor张量tensor是在机器学习和深度学习中广泛应用的数据概念，张量是多维数组的泛化，能够表示标量（0维张量）、向量（1维张量）、矩阵（2维张量）及更高维的数组。张量基本用法（mindspore）data=[1,0,1,0]x_data=Tensor(data)print(x_data,x_data.shape,x_data.dt
基于yolov8的脑肿瘤检测系统python源码+onnx模型+评估指标曲线+精美GUI界面 FL1623863129 深度学习 YOLO 人工智能
【算法介绍】基于YOLOv8的脑肿瘤检测系统是一项前沿的医疗应用，该系统利用YOLOv8这一高效的目标检测算法，实现对脑肿瘤病灶的快速、准确识别。YOLOv8作为YOLO系列的最新版本，不仅继承了前代版本在速度和精度上的优势，还通过改进的网络结构和优化策略，进一步提升了模型性能。在脑肿瘤检测中，YOLOv8通过深度学习技术，自动从脑部图像中提取特征，并学习目标的特征表示和位置信息。系统采用模块化设
Java实现十大排序算法 Mojitocean 程序猿日常 java 排序算法算法
时间/空间复杂度对比：n表示输入元素的数量，k表示元素的取值范围大小。稳定：如果a原本在b前面，而a=b，排序之后a仍然在b的前面。不稳定：如果a原本在b的前面，而a=b，排序之后a可能会出现在b的后面。时间复杂度：对排序数据的总操作次数。反映当n变化时，操作次数呈现什么规律。空间复杂度：是指算法在计算机内执行时所需存储空间的度量，它也是数据规模n的函数。排序算法时间复杂度-最好时间复杂度-最差时
ES6--《每日学习》 Oswaldhs es6 学习 javascript
一、ES6相关介绍1.1、什么是ES61995年的美国，有一家名为netscape(网景)的公司打造了一款主要用于check验证的脚本语言，而恰在此时，Sun公司的java语言火的一塌糊涂，netscape公司为蹭其热度，便将该脚本语言命名为JavaScript。不料JavaScript居然被越来越多的人使用，后效仿大秦的货币统一政策将其提交给国际标准组织ECMA。该组织发布的标准被称做ECMAS
总融资超8700万美元，日均互动超30次，ElliQ如何以AI陪伴机器人驱动，重塑养老格局？ AgeClub 人工智能机器人银发产业热点
干货抢先看1.IntuitionRobotics公司自主研发的ElliQ机器人，深度集成了生成式人工智能技术，为老年用户提供个性化、贴心的陪伴服务，深受用户喜爱。2.该公司新一轮融资金额高达2500万美元，将用于进一步加强AI技术研发、扩大生产规模并加速市场推广，以满足全球范围内老年人对智能陪伴的迫切需求。3.ElliQ及其他陪伴式机器人在满足老年人情感需求、提升生活质量方面具有显著优势，其市场潜
【Python机器学习】NLP词频背后的含义——隐性语义分析 zhangbin_237 Python机器学习 python 机器学习自然语言处理人工智能开发语言
隐性语义分析基于最古老和最常用的降维技术——奇异值分解（SVD）。SVD将一个矩阵分解成3个方阵，其中一个是对角矩阵。SVD的一个应用是求逆矩阵。一个矩阵可以分解成3个最简单的方阵，然后对这些方阵求转置后再把它们相乘，就得到了原始矩阵的逆矩阵。它为我们提供了一个对大型复杂矩阵求逆的捷径。SVD适用于桁架结构的应力和应变分析等机械工程问题，它对电气工程中的电路分析也很有用，它甚至在数据科学中被用于基
Java LinkedList 深入解析 wjs2024 开发语言
JavaLinkedList深入解析概述JavaLinkedList是Java集合框架中的一部分，实现了List接口和Deque接口。与ArrayList相比，LinkedList在插入和删除操作上提供了更好的性能，但在随机访问元素方面则相对较慢。LinkedList由一系列的双向链表节点组成，每个节点都包含数据和两个指针，分别指向前一个节点和后一个节点。主要特性双向链表结构LinkedList的
Lianwei 安全周报|2024.07.15 联蔚盘云安全
新的一周又开始了，以下是本周「Lianwei周报」，我们总结推荐了本周的政策/标准/指南最新动态、热点资讯和安全事件，保证大家不错过本周的每一个重点！政策/标准/指南最新动态01《人工智能全球治理上海宣言》发布我们强调共同促进人工智能技术发展和应用的必要性，同时确保其发展过程中的安全性、可靠性、可控性和公平性，促进人工智能技术赋能人类社会发展。我们相信，只有在全球范围内的合作与努力下，我们才能充分
深度学习赋能数据分析，联蔚盘云引领业务革新联蔚盘云深度学习数据分析人工智能
一、引言随着大数据时代的到来，深度学习技术正逐渐成为企业数据分析的新引擎。联蔚盘云凭借其在深度学习领域的深厚积累，为企业提供高效、精准的数据分析解决方案，助力企业实现业务革新与增长。二、深度学习与数据分析的完美结合联蔚盘云运用深度学习技术，对海量数据进行深度挖掘，揭示数据背后的价值。我们利用先进的算法和模型，为企业提供精准的市场预测、消费者行为分析、业务优化等解决方案，帮助企业实现决策的科学化和智
Python编码—掌握Python与Kubernetes：构建高效微服务架构学步_技术 Python编码架构 python kubernetes
欢迎来到我的技术小筑，一个专为技术探索者打造的交流空间。在这里，我们不仅分享代码的智慧，还探讨技术的深度与广度。无论您是资深开发者还是技术新手，这里都有一片属于您的天空。让我们在知识的海洋中一起航行，共同成长，探索技术的无限可能。探索专栏：学步_技术的首页——持续学习，不断进步，让学习成为我们共同的习惯，让总结成为我们前进的动力。技术导航：人工智能：深入探讨人工智能领域核心技术。自动驾驶：分享自动
There is no getter for property named 'sn' in 'class java.lang.String' 在下小保
结果selectidfromtableandsn=#{sn}报错的情况只有一个String参数用了<where<iftest标签，没用_parameter没用<iftest，也没用wheresn=#{value}
统计机器学习第十三章极大似然估计的性质——图解MLE的渐进正态性 cui_hao_nan 统计机器学习导论机器学习
n=10;t=10000;s=1/12/n;x=linspace(-0.4,0.4,100);y=1/sqrt(2*pi*s)*exp(-x.^2/(2*s));z=mean(rand(t,n)-0.5,2);figure(1);clf;holdonb=20;hist(z,b);h=plot(x,y*t/b*(max(z)-min(z)),'r-');这段代码的功能是生成随机数并进行直方图和曲线的
Vue.js项目构建彭于晏“ vue.js
Vue.js是一个流行的JavaScript框架，用于构建用户界面。下面是使用Vue.js构建项目的详细方法：安装Vue.js：首先，你需要在项目中安装Vue.js。你可以通过在终端中运行以下命令来安装Vue.js：npminstallvue创建Vue实例：在项目的入口文件中，创建一个Vue实例。你可以使用以下代码创建一个简单的Vue实例：importVuefrom'vue';newVue({el
sqllabs游戏 Vanilla-li web安全
文章目录总体思路：less-1:less-2:less-3:less-4:less-5:less-6:less-7:less-8:布尔盲注less-9:时间盲注less-21:less-24:总体思路：1、第一件事情逃脱出单引号的控制闭合单引号2、单双引号需要成对出现在pythonphpJava中3、2个办法继续把多出来的单引号闭合，要么注释掉单引号4、MySQL注释符–#/***/*/url会编
动手学深度学习（pytorch）学习记录20-自定义层[学习记录] walfar pytorch 深度学习 pytorch 学习
在深度学习中，自定义层是指开发者根据特定需求编写的神经网络层，而不是使用深度学习框架（如PyTorch、TensorFlow等）提供的现成层。自定义层可以让模型更加灵活，以适应特定的任务或数据集。目录没有参数的自定义层带参数的层没有参数的自定义层下面的CenteredLayer类要从其输入中减去均值。要构建它，只需继承基础层类并实现前向传播功能。importtorchimporttorch.nn.
读书笔记 || 探索人工智能社会治理的中国方案冉淑会
读书笔记||探索人工智能社会治理的中国方案微信公众号-城市清凉地2020/03/3014:34:381.作为引领未来的战略性技术，人工智能的迅猛发展将进一步释放历次科技革命和产业变革积蓄的巨大能量，给全球经济发展、国家治理、社会建设和人民生活带来重大而深远的影响，推动人类迈入以科技进步与产业革新为基础的智能社会。2.科技进步使得生产力得以飞速发展，为人们的生产和生活都带来了极大的便利。但科技创新带
高职院校生成式人工智能（AIGC）实训教室建设解决方案武汉唯众智创生成式人工智能
一、引言近年来，人工智能技术以其强大的数据处理能力和智能化决策机制，在诸多领域展现出巨大的潜力和价值。尤其是在教育领域，人工智能生成内容（ArtificialIntelligenceGeneratedContent,AIGC）技术的应用日益凸显其重要性。AIGC不仅能够帮助学生更好地理解和掌握复杂的概念和技术，还能根据学生的个性化需求提供定制化的学习资源和支持，从而极大地丰富了教学方式，提升了教学
动手学深度学习（pytorch）学习记录21-读写文件(模型与参数)[学习记录] walfar pytorch 深度学习 pytorch 学习
目录加载和保存张量加载和保存模型参数保存模型的好处众多，涵盖了从开发到部署的整个机器学习生命周期。节省资源：训练模型可能需要大量的时间和计算资源。保存模型可以避免重复训练，从而节省时间和计算资源。快速部署：一旦模型被训练并保存，它可以迅速部署到生产环境中，加速产品上市时间。版本控制：保存不同版本的模型有助于跟踪模型的迭代过程，便于比较和回滚到之前的版本。离线使用：保存的模型可以在没有网络连接的情况
Java刷题随笔---137.只出现一次的数字Ⅱ Dunponsion Leetcode刷题随笔 java leetcode 算法
137.只出现一次的数字II-力扣（LeetCode）(leetcode-cn.com)难度：中等题目描述：给你一个整数数组nums，除某个元素仅出现一次外，其余每个元素都恰出现三次。请你找出并返回那个只出现了一次的元素。分析：分析：1-这类题可以简单的使用HashMap进行存储，key值为数组元素，value值为元素出现的次数，最后遍历一遍，输出value为1的key即可。2-进阶方法可以使用位
PyTorch深度学习实战（26）—— PyTorch与Multi-GPU shangjg3 PyTorch深度学习实战深度学习 pytorch 人工智能
当拥有多块GPU时，可以利用分布式计算（DistributedComputation）与并行计算（ParallelComputation）的方式加速网络的训练过程。在这里，分布式是指有多个GPU在多台服务器上，并行指一台服务器上的多个GPU。在工作环境中，使用这两种方式加速模型训练是非常重要的技能。本文将介绍PyTorch中分布式与并行的常见方法，读者需要注意这二者的区别，并关注它们在使用时的注意
PyTorch 基础学习（14）- 归一化花千树-010 PyTorch pytorch 学习人工智能
系列文章：《PyTorch基础学习》文章索引概述归一化是数据预处理中的重要步骤之一，它可以将数据调整到特定的范围或分布，有助于加速训练并提高模型的性能。在机器学习中，不同的归一化方法适用于不同的场景。本文将详细介绍scikit-learn中的常见归一化方法及其应用。1.Min-Max归一化MinMaxScalerMin-Max归一化将数据缩放到指定范围，通常是[0,1]。这种方法保留了数据的相对关
《深度学习走向核心素养小学数学》读书第四期 Lethe不迷糊
逻辑推理：让学生学会“用数学的思维想”义务教育数学课程标准的核心词还提到运算能力和推理能力，这都属于逻辑推理。数学内部的发展依赖的就是逻辑推理。逻辑推理是指从一些事实和命题出发，依据规则推出其他命题的思维过程。它主要包括两类：一类是从特殊到一般的推理，推理形式主要有归纳、类比；一类是从一般到特殊的推理，推理形式主要有演绎。演绎推理是从大范围内成立的命题推断小范围内命题也成立，只能用来验证知识，不能
第 004 期提高页面渲染速度的 3 个 CSS 技巧前端GoGoGo7
提到提高页面渲染速度，我们第一想到的是优化JavaScript。其实通过优化CSS也能提高页面渲染速度。优化方案1.延时渲染屏幕外的内容-content-visibility:auto很长的页面会有大量的内容在屏幕外。如果只渲染屏幕内的内容，屏幕外的内容在出现时才渲染，能大大的节约渲染时间。CSSContainmentModuleLevel2模块新增了content-visibility属性。这个
js字符串方法速览---字符串的静态方法，实例方法和属性合集，各包含一个示例 I_am_shy javascript 前端开发语言
tips：本文仅作为查找和基本使用的展示，需要深入了解这些方法的使用请参考：String-JavaScript|MDN(mozilla.org)可以通过目录快速锁定需要查找的方法和查看它的使用目录tip：新建一个字符串字符串实例属性字符串静态方法String.fromCharCode(...nums)String.fromCodePoint(...nums)String.raw({raw:arr}
JavaScript防抖函数喂！大掌柜 javascript 开发语言 ecmascript
在JavaScript中，你可以使用函数闭包来创建一个防抖函数。下面是一个简单的实现示例：functiondebounce(func,delay){lettimeoutId;returnfunction(){clearTimeout(timeoutId);timeoutId=setTimeout(func,delay);};}使用这个防抖函数时，你需要将需要防抖的函数和延迟时间作为参数传递给deb
停止在 TypeScript 中使用“any”类型喂！大掌柜 typescript typescript javascript 前端前端框架
有更好的TS类型和接口可用。为什么你不应该在TypeScript中使用“any”类型TypeScript是Web开发人员最常用的编程语言之一。它具有出色的语言功能，可让您轻松设计可扩展的应用程序。因此，开发人员倾向于为他们的项目选择TypeScript而不是JavaScript。但是，在使用TypeScript时，我们需要避免一些常见错误，以最大限度地发挥其功能。例如，过度使用any类型是我们经常
Android 12.0 App全屏时通过系统属性控制上划下拉是否显示虚拟导航栏和状态栏 VaporRuby android
遇到问题厂测App触摸屏测试，需要全屏显示，禁止出现状态栏和导航栏，以免影响测试。参考资料https://zhuanlan.zhihu.com/p/440810585Android12系统源码_SystemUI（九）WindowInsetsController源码解析-CSDN博客解决方案1、framework修改点+++b/frameworks/base/services/core/java/c
如何在小程序中实现页面之间的返回那维莱特小程序 apache
在小程序中实现页面之间的返回，通常有以下几种方法，这些方法各有特点，适用于不同的场景：1.使用wx.navigateBack方法描述：wx.navigateBack是微信小程序中用于关闭当前页面，返回上一页面或多级页面的API。使用方式：javascript复制代码wx.navigateBack({delta:1//表示返回上一级，如果delta大于1则表示返回多级});特点：可以根据delta的
android11 状态栏导航栏控制显示隐藏 Optimus●Prime android frameworks 状态栏控制 statusbar navigationbar 导航栏控制
目录1.添加Intent广播2.设置全局KEY3.设置默认开关4.配置默认状态保存5.状态栏关闭时禁止下拉6.根据默认值设置显示隐藏7.配置广播控制8.使用方式通过自定义广播的形式将系统的状态栏，导航栏显示隐藏，分别控制，也可以在配置文件中默认设置显示隐藏。(效果图)1.添加Intent广播frameworks/base/core/java/android/content/Intent.java
Windows 设置环境变量 kylinholmes windows powershell 环境变量
环境变量是什么环境变量是一种在系统里的变量，可以理解成一种属性，就放在那，有需要的程序就会去读，类似写代码里的全局变量通常用作，程序运行时的一些参数环境变量分为用户，系统。举个经典的栗子，Java安装的时候，需要自己手动配置环境变量，非常头大但其实Windows可以通过命令行一句话设置。假设我们需要设置JAVA_HOME这个环境变量PowerShell中的Env在powershell里有3个环境变
log4j对象改变日志级别 3213213333332132 java log4j level log4j对象名称日志级别
log4j对象改变日志级别可批量的改变所有级别，或是根据条件改变日志级别。 log4j配置文件： log4j.rootLogger=ERROR,FILE,CONSOLE,EXECPTION #log4j.appender.FILE=org.apache.log4j.RollingFileAppender log4j.appender.FILE=org.apache.l
elk+redis 搭建nginx日志分析平台 ronin47 elasticsearch kibana logstash
elk+redis 搭建nginx日志分析平台 logstash,elasticsearch,kibana 怎么进行nginx的日志分析呢？首先，架构方面，nginx是有日志文件的，它的每个请求的状态等都有日志文件进行记录。其次，需要有个队列，redis的l
Yii2设置时区 dcj3sjt126com PHP timezone yii2
时区这东西，在开发的时候，你说重要吧，也还好，毕竟没它也能正常运行，你说不重要吧，那就纠结了。特别是linux系统，都TMD差上几小时，你能不痛苦吗？win还好一点。有一些常规方法，是大家目前都在采用的1、php.ini中的设置，这个就不谈了，2、程序中公用文件里设置，date_default_timezone_set一下时区3、或者。。。自己写时间处理函数，在遇到时间的时候，用这个函数处理（比较
js实现前台动态添加文本框，后台获取文本框内容 171815164 文本框
<%@ page language="java" import="java.util.*" pageEncoding="UTF-8"%> <!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Transitional//EN" "http://w
持续集成工具 g21121 持续集成
持续集成是什么？我们为什么需要持续集成？持续集成带来的好处是什么？什么样的项目需要持续集成？... 持续集成(Continuous integration ,简称CI)，所谓集成可以理解为将互相依赖的工程或模块合并成一个能单独运行
数据结构哈希表(hash)总结永夜-极光数据结构
1.什么是hash 来源于百度百科: Hash，一般翻译做“散列”，也有直接音译为“哈希”的，就是把任意长度的输入，通过散列算法，变换成固定长度的输出，该输出就是散列值。这种转换是一种压缩映射，也就是，散列值的空间通常远小于输入的空间，不同的输入可能会散列成相同的输出，所以不可能从散列值来唯一的确定输入值。简单的说就是一种将任意长度的消息压缩到某一固定长度的消息摘要的函数。
乱七八糟程序员是怎么炼成的
eclipse中的jvm字节码查看插件地址： http://andrei.gmxhome.de/eclipse/ 安装该地址的outline 插件后重启，打开window下的view下的bytecode视图 http://andrei.gmxhome.de/eclipse/ jvm博客： http://yunshen0909.iteye.com/blog/2
职场人伤害了“上司” 怎样弥补 aijuans 职场
由于工作中的失误，或者平时不注意自己的言行“伤害”、“得罪”了自己的上司，怎么办呢？　　在职业生涯中这种问题尽量不要发生。下面提供了一些解决问题的建议：　　一、利用一些轻松的场合表示对他的尊重　　即使是开明的上司也很注重自己的权威，都希望得到下属的尊重，所以当你与上司冲突后，最好让不愉快成为过去，你不妨在一些轻松的场合，比如会餐、联谊活动等，向上司问个好，敬下酒，表示你对对方的尊重，
深入浅出url编码 antonyup_2006 应用服务器浏览器 servlet weblogic IE
出处：http://blog.csdn.net/yzhz 杨争 http://blog.csdn.net/yzhz/archive/2007/07/03/1676796.aspx 一、问题：编码问题是JAVA初学者在web开发过程中经常会遇到问题，网上也有大量相关的
建表后创建表的约束关系和增加表的字段百合不是茶标的约束关系增加表的字段
下面所有的操作都是在表建立后操作的,主要目的就是熟悉sql的约束,约束语句的万能公式 1,增加字段(student表中增加姓名字段) alter table 增加字段的表名 add 增加的字段名增加字段的数据类型 alter table student add name varchar2(10); &nb
Uploadify 3.2 参数属性、事件、方法函数详解 bijian1013 JavaScript uploadify
一.属性属性名称默认值说明 auto true 设置为true当选择文件后就直接上传了，为false需要点击上传按钮才上传。 buttonClass ” 按钮样式 buttonCursor ‘hand’ 鼠标指针悬停在按钮上的样子 buttonImage null 浏览按钮的图片的路
精通Oracle10编程SQL(16)使用LOB对象 bijian1013 oracle 数据库 plsql
/* *使用LOB对象 */ --LOB(Large Object)是专门用于处理大对象的一种数据类型，其所存放的数据长度可以达到4G字节 --CLOB/NCLOB用于存储大批量字符数据，BLOB用于存储大批量二进制数据，而BFILE则存储着指向OS文件的指针 /* *综合实例 */ --建立表空间 --#指定区尺寸为128k,如不指定，区尺寸默认为64k CR
【Resin一】Resin服务器部署web应用 bit1129 resin
工作中，在Resin服务器上部署web应用，通常有如下三种方式：配置多个web-app 配置多个http id 为每个应用配置一个propeties、xml以及sh脚本文件配置多个web-app 在resin.xml中,可以为一个host配置多个web-app <cluster id="app&q
red5简介及基础知识白糖_ 基础
简介 Red5的主要功能和Macromedia公司的FMS类似，提供基于Flash的流媒体服务的一款基于Java的开源流媒体服务器。它由Java语言编写，使用RTMP作为流媒体传输协议，这与FMS完全兼容。它具有流化FLV、MP3文件，实时录制客户端流为FLV文件，共享对象，实时视频播放、Remoting等功能。用Red5替换FMS后,客户端不用更改可正
angular.fromJson boyitech AngularJS AngularJS 官方API AngularJS API
angular.fromJson 描述: 把Json字符串转为对象使用方法: angular.fromJson(json); 参数详解: Param Type Details json string JSON 字符串返回值: 对象, 数组, 字符串或者是一个数字示例: <!DOCTYPE HTML> <h
java-颠倒一个句子中的词的顺序。比如： I am a student颠倒后变成：student a am I bylijinnan java
public class ReverseWords { /** * 题目：颠倒一个句子中的词的顺序。比如： I am a student颠倒后变成：student a am I.词以空格分隔。 * 要求： * 1.实现速度最快,移动最少 * 2.不能使用String的方法如split,indexOf等等。 * 解答：两次翻转。 */ publ
web实时通讯 Chen.H Web 浏览器 socket 脚本
关于web实时通讯，做一些监控软件。由web服务器组件从消息服务器订阅实时数据，并建立消息服务器到所述web服务器之间的连接，web浏览器利用从所述web服务器下载到web页面的客户端代理与web服务器组件之间的socket连接，建立web浏览器与web服务器之间的持久连接；利用所述客户端代理与web浏览器页面之间的信息交互实现页面本地更新，建立一条从消息服务器到web浏览器页面之间的消息通路
[基因与生物]远古生物的基因可以嫁接到现代生物基因组中吗? comsci 生物
大家仅仅把我说的事情当作一个IT行业的笑话来听吧..没有其它更多的意思如果我们把大自然看成是一位伟大的程序员,专门为地球上的生态系统编制基因代码,并创造出各种不同的生物来,那么6500万年前的程序员开发的代码,是否兼容现代派的程序员的代码和架构呢?
oracle 外部表 daizj oracle 外部表 external tables
oracle外部表是只允许只读访问，不能进行DML操作，不能创建索引，可以对外部表进行的查询，连接，排序，创建视图和创建同义词操作。 you can select, join, or sort external table data. You can also create views and synonyms for external tables. Ho
aop相关的概念及配置 daysinsun AOP
切面(Aspect): 通常在目标方法执行前后需要执行的方法（如事务、日志、权限），这些方法我们封装到一个类里面，这个类就叫切面。连接点（joinpoint） spring里面的连接点指需要切入的方法，通常这个joinpoint可以作为一个参数传入到切面的方法里面（非常有用的一个东西）。通知（Advice）通知就是切面里面方法的具体实现，分为前置、后置、最终、异常环
初一上学期难记忆单词背诵第二课 dcj3sjt126com english word
middle 中间的，中级的 well 喔，那么；好吧 phone 电话，电话机 policeman 警察 ask 问 take 拿到；带到 address 地址 glad 高兴的，乐意的 why 为什么 China 中国 family 家庭 grandmother (外)祖母 grandfather (外)祖父 wife 妻子 husband 丈夫 da
Linux日志分析常用命令 dcj3sjt126com linux log
1.查看文件内容 cat -n 显示行号 2.分页显示 more Enter 显示下一行空格显示下一页 F 显示下一屏 B 显示上一屏 less /get 查询"get"字符串并高亮显示 3.显示文件尾 tail -f 不退出持续显示 -n 显示文件最后n行 4.显示头文件 head -n 显示文件开始n行 5.内容排序 sort -n 按照
JSONP 原理分析 fantasy2005 JavaScript jsonp jsonp 跨域
转自 http://www.nowamagic.net/librarys/veda/detail/224 JavaScript是一种在Web开发中经常使用的前端动态脚本技术。在JavaScript中，有一个很重要的安全性限制，被称为“Same-Origin Policy”（同源策略）。这一策略对于JavaScript代码能够访问的页面内容做了很重要的限制，即JavaScript只能访问与包含它的
使用connect by进行级联查询 234390216 oracle 查询父子 Connect by 级联
使用connect by进行级联查询 connect by可以用于级联查询，常用于对具有树状结构的记录查询某一节点的所有子孙节点或所有祖辈节点。来看一个示例，现假设我们拥有一个菜单表t_menu，其中只有三个字段：
一个不错的能将HTML表格导出为excel,pdf等的jquery插件 jackyrong jquery插件
发现一个老外写的不错的jquery插件，可以实现将HTML 表格导出为excel,pdf等格式，地址在： https://github.com/kayalshri/ 下面看个例子，实现导出表格到excel,pdf <html> <head> <title>Export html table to excel an
UI设计中我们为什么需要设计动效 lampcy UI UI设计
关于Unity3D中的Shader的知识首先先解释下Unity3D的Shader，Unity里面的Shaders是使用一种叫ShaderLab的语言编写的，它同微软的FX文件或者NVIDIA的CgFX有些类似。传统意义上的vertex shader和pixel shader还是使用标准的Cg/HLSL 编程语言编写的。因此Unity文档里面的Shader，都是指用ShaderLab编写的代码，
如何禁止页面缓存 nannan408 html jsp cache
禁止页面使用缓存~ ------------------------------------------------ jsp:页面no cache： response.setHeader("Pragma","No-cache"); response.setHeader("Cache-Control","no-cach
以代码的方式管理quartz定时任务的暂停、重启、删除、添加等 Everyday都不同定时任务管理 spring-quartz
【前言】在项目的管理功能中，对定时任务的管理有时会很常见。因为我们不能指望只在配置文件中配置好定时任务就行了，因为如果要控制定时任务的 “暂停” 呢？暂停之后又要在某个时间点 “重启” 该定时任务呢？或者说直接 “删除” 该定时任务呢？要改变某定时任务的触发时间呢？ “添加” 一个定时任务对于系统的使用者而言，是不太现实的，因为一个定时任务的处理逻辑他是不
EXT实例 tntxia ext
（1）增加一个按钮 JSP: <%@ page language="java" import="java.util.*" pageEncoding="UTF-8"%> <% String path = request.getContextPath(); Stri
数学学习在计算机研究领域的作用和重要性 xjnine Math
最近一直有师弟师妹和朋友问我数学和研究的关系，研一要去学什么数学课。毕竟在清华，衡量一个研究生最重要的指标之一就是paper,而没有数学，是肯定上不了世界顶级的期刊和会议的，这在计算机学界尤其重要！你会发现，不论哪个领域有价值的东西，都一定离不开数学！在这样一个信息时代，当google已经让世界没有秘密的时候，一种卓越的数学思维，绝对可以成为你的核心竞争力. 无奈本人实在见地

按字母分类： A B C D E F G H I J K L M N O P Q R S T U V W X Y Z 其他