- linux学习100篇112:查看安装的软件之间的依赖关系
Seurat_
mamba可以很方便的查看安装的软件之间的依赖关系mamba可以很方便的查看安装的软件之间的依赖关系谁依赖我mambarepoquerywhoneeds-tpython(rnaseq)root13:13:05~$mambarepoquerywhoneeds-tpython________/\/\/\/\/\/\/\/\███████████████//██//██//██//███████████
- TCGA数据下载系列之二:RTCGA
白云梦_7
library(RTCGA)library(RTCGA.clinical)library(RTCGA.rnaseq)library(RTCGA.mRNA)library(RTCGA.mutations)all_TCGA_cancers=infoTCGA()DT::datatable(all_TCGA_cancers)#指定任意基因从任意癌症里面获取芯片表达数据(这里是MRNA)expr3.9&`x
- RNAseq终极篇章qPCR
天道昭然
RNAseq对于生信达人来说已经烂熟了,但是相信好多人分析做好了,最后验证却验证不出来,愁的不行!呵呵,今天好了,小编给你一弹,做好验证工作的基本功-荧光定量PCR介绍。一、实时荧光定量PCR简介聚合酶链式反应(PCR)是分子生物学领域功能最强大的技术之一,在实时荧光定量PCR中,每次循环结束后通过荧光染料检测DNA的量,荧光染料产生的荧光信号与生成的PCR产物分子(扩增片段)数直接成正比。利用反
- lncRNA,组织特异性与泛癌差异-20200826
纪伟讲测序
许多老师会通过RNAseq寻找差异表达的lncRNA,mRNA进行机制研究,但RNAseq会筛选出非常多的差异分子,这就遇到一个普遍的问题,如何从众多分子出找出一个合适的基因进行后续研究。小编从事RNAseq实验分析服务多年,常被问起这个问题。挑选分子要挑选有重要功能的,与机制关联起来的分子。那么如何判断这个基因是否有重要功能呢?本期我们跟大家聊聊组织特异性分析和泛癌差异分析,比如以下的图是文章中
- 转录组测序1-测序原始数据说明
纪伟讲测序
转录组测序是最常用的组学实验,对全谱基因定量,找到差异表达基因。RNAseq涉及到原始数据,数据质控,基因组比对,差异基因鉴定,差异基因功能富集分析,重要基因如转录因子激酶的靶基因预测等,我们用10讲的时间,全面讲解转录组测序报告,及在上百个项目中遇到的近百个常见问题。本节视频是第1讲,从测序原始下机数据开始讲起。样品制备到产出测序数据过程,是RNA提取建库和测序的试验环节。在使用Illumina
- TCGA数据库与数据下载
吴小玥
TCGA数据库:主要储存关于各类肿瘤的一个基本信息,包括RNAseq,miRNAseq,DNA甲基化,CNV,SNP等信息,是目前为止可以获得的公开数据库里面数据相对全面的一个,33种癌症类型,在各个领域得到了广泛的应用,为肿瘤基础医学和转化医学研究者提供了海量的基因组数据和与其关联的临床数据。网址:https://portal.gdc.cancer.gov/TCGA只对授权的用户开放Level1
- 学习小组day3笔记-徐妙
番番番茄小姐
今天正式进入安装软件安装完成如图完成RNAseq分析软件的安装操作以及注意事项为学习笔记成就感满满,感谢编者的用心教程
- GRNdb:解码不同人类和小鼠条件下的基因调控网络
生信小鹏
文献阅读论文阅读
这是利用scenic计算并制作的数据库,可以学习并使用一下摘要由转录因子(TF)及其下游靶基因形成的基因调控网络(GRN)在基因表达调控中发挥着重要作用。此外,GRN可以在不同条件下动态变化,这对于理解疾病发病机制的潜在机制至关重要。然而,现有的数据库还没有提供单细胞水平上各种人类和小鼠正常组织和疾病的全面GRN信息。基于已知的TF-靶点关系和从公共数据库收集的大规模单细胞RNAseq数据以及癌症
- 临床开展RNA-seq送测序前你应当考虑到几个因素
伍鸿荣
DNA层面的测序问题已经不能完全满足临床的需要,当下,美国一些医院在临床已经开展DNA测序+RNA测序联合分析,更好的为临床服务。在临床病理方面,对于肉瘤的诊断,不是很明确的话,最好是送全基因组+RNAseq,不建议先就开一大堆免疫组化及分子,最后还是没有结果。1、首先你应当知道,RNA-seq测序能做什么?如下图所示,可以了解到不同条件下的基因表达变化。比如说,老年人和小孩,不同时期的头发生长相
- 2021-05-11 转录组分析学习笔记:关于ENSEMBL 转换 ENTREZID的一点心得
范旭_d6fc
两年来,参加了无数线上和线下的生信学习班,但是一直都没能学明白。这次参加完生信技能树举办的为期一个月的线上生信入门班课程,仿佛醍醐灌顶一样,瞬间打通了我的任督二脉,在此由衷的感谢生信技能书的各位老师们。因工作太忙的缘故,上完课都一个多月了,才有时间来分析自己的RNAseq测序数据。凭着从生信技能树各位老师那里学来的技能,很快就顺利完成从数据质控和过滤、比对到参考基因组、到基因表达定量的全套上游分析
- 生信数据挖掘 单细胞测序
概普生信
单细胞RNAseq揭示存在EGFR突变的早期肺腺癌中的肿瘤异质性和免疫细胞群今天解读的这篇9+的文章也是刊登在《Oncogene》杂志上,该期刊是生化与分子生物学”子行业的优秀级杂志,居于一线期刊。其收稿要求涵盖了癌基因的结构和功能的各个方面,尤其是:细胞癌基因及其激活机制,其编码蛋白的结构和功能,DNA和RNA的癌基因,肿瘤病毒,人类肿瘤的分子肿瘤学,肿瘤抑制基因,生长调控基因,细胞周期控制生长
- 转录组测序3-序列基因组比对
纪伟讲测序
转录组测序是最常用的组学实验,对全谱基因定量,找到差异表达基因。RNAseq涉及到原始数据,数据质控,基因组比对,差异基因鉴定,差异基因功能富集分析,重要基因如转录因子激酶的靶基因预测等,我们用10讲的时间,全面讲解转录组测序报告,及在上百个项目中遇到的近百个常见问题。前两期视频,我们讨论了测序原始数据,原始数据的质控和过滤。我们拿到cleandata数据,在分析样品的基因表达信息前需要做基因组比
- GEO RNAseq与chip seq数据整合
像鸟一样飞过你的高山
GEO数据有芯片数据,也有RNAseq数据,芯片数据一般是经过背景校正、标准化过的。如果表达量较小,说明是经过log2转化。qx100)||(qx[6]-qx[1]>50&&qx[2]>0)||(qx[2]>0&&qx[2]1&&qx[4]<2)if(LogC){exprset[which(exprset<=0)]<-NaNexprset<-log2(exprset)}RNAseq数据有count
- sva ComBat去除GEO数据批次效应
像鸟一样飞过你的高山
批次效应批次效应是测量结果中的一部分,它们因为实验条件的不同而具有不同的表现形式,并且与我们研究的变量没有关系。不同平台的数据,同一平台的不同时期的数据,同一个样品不同试剂的数据,以及同一个样品不同时间的数据等等都会产生一种batcheffect。校正批次效应的目的是减少batch之间的差异,从而更好的获取不同生物学状态之间的差异。载入包、GEO数据数据为GEO芯片与RNAseq数据。BiocMa
- 1130转录组分析(三)--王通老师讲解
不如好好学生信吧
1130RNAseq生物信息分析(王通老师)01课程介绍[if!supportLists]1.[endif]RNAseq测序定义[if!supportLists]2.[endif]为什么要进行RNA测序机体DNA是一个相对静态的过程,RNA是一个动态变化的过程,其在生理病理或者外在条件下,会发生相应变化,影响调控疾病发生。所以解释RNA变化在生命科学中是非常重要而这时候就需要RNAseq了。DNA
- 1128 转录组分析 B站up主天马行空的坦克兵 (讲解清晰易懂)
不如好好学生信吧
1128转录组分析B站up主天马行空的坦克兵(讲解清晰易懂)09删除conda下的某一款软件删除名为rnaseq1环境下的比对软件STAR:remove-nrnaseqSTARCtrl+C停止运行程序(删前删后注意查看,查看有两种,去所属环境删除与直接指定环境用命令删除)删除名为rnaseq1环境下所有软件:remove-nrnaseq--all10安装mamba-conda的左右手conda网站
- GTEx:基因型和基因表达量关联数据库
生信修炼手册
数据库可视化大数据数据可视化java
欢迎关注”生信修炼手册”!GTEx全称如下Genotype-TissueExpression该项目对来自人体多个组合和器官的样本,同时进行了转录组测序和基因分型分析,构建了一个组织特异性的基因表达和调控的数据库。网址如下https://gtexportal.org/home/包含的组织类型和样本个数如下图所示对于所有的样本,主要进行了以下三种分析1.RNAseq通过illuminaTruseq试剂
- 2019-10-02-学习使用limma、Glimma和edgeR,RNA-seq数据分析记录
程凉皮儿
资料来源https://www.bioconductor.org/packages/devel/workflows/vignettes/RNAseq123/inst/doc/limmaWorkflow_CHN.html摘自原文:在这篇工作流程文章中,我们通过分析来自小鼠乳腺的RNA测序数据,示范了如何使用流行的edgeR包载入、整理、过滤和归一化数据,然后用limma包的voom方法、线性模型和经
- 字符串拆分
Kururu1799
字符串拆分原始数据第二列只想保留第一个解决方法(感谢我师妹)CCLE_data<-data.table::fread("CCLE_RNAseq_rsem_genes_tpm_20180929.txt.gz",data.table=F)transcript_id<-CCLE_data$transcript_idslibrary(tidyverse)transcript_id<-strsplit(tr
- 基因表达分析聚类&分析
丸丸丸子w
生物信息聚类php支持向量机
基因表达分析聚类&分析1.IntroductiontogeneexpressionanalysisTechnology:microarraysvs.RNAseq.ResultingdatamatricesSupervised(Clustering)vs.unsupervised(classification)learning微阵列技术:制备DNA探针阵列并进行互补性杂交。变化:每个基因使用一个长探
- RNA_seq生物分析学习--RNA-seq介绍
Drone_xjw
生物信息学机器学习其他
目录第一课课程介绍第二课RNAseq技术第三课RNAseq发展历史第四课关于基因的概念第一课课程介绍RNAseq捕获了细胞某一状态下所有的转录信息DNA是静态信息、RNA是动态信息,是某一时刻DNA表达谱的快照课程大纲RNAseq的应用第二课RNAseq技术转录组概念中心法则(高通量测序验证了中心法则是正确的)mRNA是编码RNA、其余RNA称为非编码RNA。(非编码RNA由基因组上非基因区转录出
- linux学习100篇37:转录组分析用软件及安装samtools
Seurat_
安装(rnaseq)root11:51:32~$condainstall-ysamtoolsCollectingpackagemetadata(current_repodata.json):doneSolvingenvironment:done==>WARNING:Anewerversionofcondaexists.[options]Commands:--Indexingdictcreateas
- RNAseq教程(4.4)
周小钊
目录1.Module1-IntroductiontoRNAsequencingInstallationReferenceGenomesAnnotationsIndexingRNA-seqDataPre-AlignmentQC2.Module2-RNA-seqAlignmentandVisualizationAdapterTrimAlignmentIGVAlignmentVisualizationA
- 10x RNAseq Cellranger结果的对应关系:
11的雾
10xRNAseq数据在用cellranger跑完10xRNaseq数据分析后,会生成一个outs目录,这个目录下还有一个/filtered_feature_bc_matrix目录,里面放着三个文件:matrix.mtx.gzfeatures.tsv.gzbarcodes.tsv.gz这三个文件的对应关系是什么样的呢?今天我们来一探究竟:(一)matrix.mtx.gz文件:image.png(二
- linux学习100篇106:查看conda版本conda -V
Seurat_
查看conda版本(rnaseq)root12:55:08~$conda-Vconda4.9.2
- 单细胞转录组学生物标志物和靶点挖掘的新方法
felix108
单细胞转录组学(sc-RNAseq)研究,可以更加有效的解释组织的异质性,从单个细胞分辨率来解释更多bulk水平上难以解释的生物学问题。已经广泛用于肿瘤异质性、细胞发育、免疫微环境等课题研究。其产生的海量数据以及个性化分析越来越受到重视,并需要新的方法来挖掘背后的生物学意义。生物标志物以及候选基因的挖掘在肿瘤免疫和细胞发育等研究中一直是研究的重点和热门。已有的生物标志物是基于差异分析或者无尺度网络
- RNAseq教程(4.2)
周小钊
1.Module1-IntroductiontoRNAsequencingInstallationReferenceGenomesAnnotationsIndexingRNA-seqDataPre-AlignmentQC2.Module2-RNA-seqAlignmentandVisualizationAdapterTrimAlignmentIGVAlignmentVisualizationAli
- R试题 可视化
煎饼果子再来一套
Q1:一行行的运行:https://github.com/jmzeng1314/5years/blob/master/learn-R/tasks/top50ggplot.Rmd代码Q2:对RNAseq_expr挑选MAD值最大的100个基因的表达矩阵绘制热图load('../view_new.Rdata')tmp0)>1,]tmp1)>5),]#RNAseq_expr=RNAseq_expr[ro
- RNAseq教程(3.1)
周小钊
目录1.Module1-IntroductiontoRNAsequencingInstallationReferenceGenomesAnnotationsIndexingRNA-seqDataPre-AlignmentQC2.Module2-RNA-seqAlignmentandVisualizationAdapterTrimAlignmentIGVAlignmentVisualizationA
- 一行命令完成RNAseq数据标记重要基因
邓老师呦
前面介绍了怎么一行命令完成RNAseq差异分析加作图,那如果我们已经有自己重点关注的基因,并且想把这些基因在差异结果里展示出来怎么弄呢?今天再来介绍一下,做完差异分析之后怎么在差异基因热图中标记自己关注的基因!一、准备2个文件:1、差异基因表达文件:diff_gene_exp.txt如果是已经跟着做完前面分享的RNAseq差异基因分析,可以直接把差异基因的表达值从总的表达文件中提取出来,生成差异表
- 辗转相处求最大公约数
沐刃青蛟
C++漏洞
无言面对”江东父老“了,接触编程一年了,今天发现还不会辗转相除法求最大公约数。惭愧惭愧!
为此,总结一下以方便日后忘了好查找。
1.输入要比较的两个数a,b
忽略:2.比较大小(因为后面要的是大的数对小的数做%操作)
3.辗转相除(用循环不停的取余,如a%b,直至b=0)
4.最后的a为两数的最大公约数
&
- F5负载均衡会话保持技术及原理技术白皮书
bijian1013
F5负载均衡
一.什么是会话保持? 在大多数电子商务的应用系统或者需要进行用户身份认证的在线系统中,一个客户与服务器经常经过好几次的交互过程才能完成一笔交易或者是一个请求的完成。由于这几次交互过程是密切相关的,服务器在进行这些交互过程的某一个交互步骤时,往往需要了解上一次交互过程的处理结果,或者上几步的交互过程结果,服务器进行下
- Object.equals方法:重载还是覆盖
Cwind
javagenericsoverrideoverload
本文译自StackOverflow上对此问题的讨论。
原问题链接
在阅读Joshua Bloch的《Effective Java(第二版)》第8条“覆盖equals时请遵守通用约定”时对如下论述有疑问:
“不要将equals声明中的Object对象替换为其他的类型。程序员编写出下面这样的equals方法并不鲜见,这会使程序员花上数个小时都搞不清它为什么不能正常工作:”
pu
- 初始线程
15700786134
暑假学习的第一课是讲线程,任务是是界面上的一条线运动起来。
既然是在界面上,那必定得先有一个界面,所以第一步就是,自己的类继承JAVA中的JFrame,在新建的类中写一个界面,代码如下:
public class ShapeFr
- Linux的tcpdump
被触发
tcpdump
用简单的话来定义tcpdump,就是:dump the traffic on a network,根据使用者的定义对网络上的数据包进行截获的包分析工具。 tcpdump可以将网络中传送的数据包的“头”完全截获下来提供分析。它支 持针对网络层、协议、主机、网络或端口的过滤,并提供and、or、not等逻辑语句来帮助你去掉无用的信息。
实用命令实例
默认启动
tcpdump
普通情况下,直
- 安卓程序listview优化后还是卡顿
肆无忌惮_
ListView
最近用eclipse开发一个安卓app,listview使用baseadapter,里面有一个ImageView和两个TextView。使用了Holder内部类进行优化了还是很卡顿。后来发现是图片资源的问题。把一张分辨率高的图片放在了drawable-mdpi文件夹下,当我在每个item中显示,他都要进行缩放,导致很卡顿。解决办法是把这个高分辨率图片放到drawable-xxhdpi下。
&nb
- 扩展easyUI tab控件,添加加载遮罩效果
知了ing
jquery
(function () {
$.extend($.fn.tabs.methods, {
//显示遮罩
loading: function (jq, msg) {
return jq.each(function () {
var panel = $(this).tabs(&
- gradle上传jar到nexus
矮蛋蛋
gradle
原文地址:
https://docs.gradle.org/current/userguide/maven_plugin.html
configurations {
deployerJars
}
dependencies {
deployerJars "org.apache.maven.wagon
- 千万条数据外网导入数据库的解决方案。
alleni123
sqlmysql
从某网上爬了数千万的数据,存在文本中。
然后要导入mysql数据库。
悲剧的是数据库和我存数据的服务器不在一个内网里面。。
ping了一下, 19ms的延迟。
于是下面的代码是没用的。
ps = con.prepareStatement(sql);
ps.setString(1, info.getYear())............;
ps.exec
- JAVA IO InputStreamReader和OutputStreamReader
百合不是茶
JAVA.io操作 字符流
这是第三篇关于java.io的文章了,从开始对io的不了解-->熟悉--->模糊,是这几天来对文件操作中最大的感受,本来自己认为的熟悉了的,刚刚在回想起前面学的好像又不是很清晰了,模糊对我现在或许是最好的鼓励 我会更加的去学 加油!:
JAVA的API提供了另外一种数据保存途径,使用字符流来保存的,字符流只能保存字符形式的流
字节流和字符的难点:a,怎么将读到的数据
- MO、MT解读
bijian1013
GSM
MO= Mobile originate,上行,即用户上发给SP的信息。MT= Mobile Terminate,下行,即SP端下发给用户的信息;
上行:mo提交短信到短信中心下行:mt短信中心向特定的用户转发短信,你的短信是这样的,你所提交的短信,投递的地址是短信中心。短信中心收到你的短信后,存储转发,转发的时候就会根据你填写的接收方号码寻找路由,下发。在彩信领域是一样的道理。下行业务:由SP
- 五个JavaScript基础问题
bijian1013
JavaScriptcallapplythisHoisting
下面是五个关于前端相关的基础问题,但却很能体现JavaScript的基本功底。
问题1:Scope作用范围
考虑下面的代码:
(function() {
var a = b = 5;
})();
console.log(b);
什么会被打印在控制台上?
回答:
上面的代码会打印 5。
&nbs
- 【Thrift二】Thrift Hello World
bit1129
Hello world
本篇,不考虑细节问题和为什么,先照葫芦画瓢写一个Thrift版本的Hello World,了解Thrift RPC服务开发的基本流程
1. 在Intellij中创建一个Maven模块,加入对Thrift的依赖,同时还要加上slf4j依赖,如果不加slf4j依赖,在后面启动Thrift Server时会报错
<dependency>
- 【Avro一】Avro入门
bit1129
入门
本文的目的主要是总结下基于Avro Schema代码生成,然后进行序列化和反序列化开发的基本流程。需要指出的是,Avro并不要求一定得根据Schema文件生成代码,这对于动态类型语言很有用。
1. 添加Maven依赖
<?xml version="1.0" encoding="UTF-8"?>
<proj
- 安装nginx+ngx_lua支持WAF防护功能
ronin47
需要的软件:LuaJIT-2.0.0.tar.gz nginx-1.4.4.tar.gz &nb
- java-5.查找最小的K个元素-使用最大堆
bylijinnan
java
import java.util.Arrays;
import java.util.Random;
public class MinKElement {
/**
* 5.最小的K个元素
* I would like to use MaxHeap.
* using QuickSort is also OK
*/
public static void
- TCP的TIME-WAIT
bylijinnan
socket
原文连接:
http://vincent.bernat.im/en/blog/2014-tcp-time-wait-state-linux.html
以下为对原文的阅读笔记
说明:
主动关闭的一方称为local end,被动关闭的一方称为remote end
本地IP、本地端口、远端IP、远端端口这一“四元组”称为quadruplet,也称为socket
1、TIME_WA
- jquery ajax 序列化表单
coder_xpf
Jquery ajax 序列化
checkbox 如果不设定值,默认选中值为on;设定值之后,选中则为设定的值
<input type="checkbox" name="favor" id="favor" checked="checked"/>
$("#favor&quo
- Apache集群乱码和最高并发控制
cuisuqiang
apachetomcat并发集群乱码
都知道如果使用Http访问,那么在Connector中增加URIEncoding即可,其实使用AJP时也一样,增加useBodyEncodingForURI和URIEncoding即可。
最大连接数也是一样的,增加maxThreads属性即可,如下,配置如下:
<Connector maxThreads="300" port="8019" prot
- websocket
dalan_123
websocket
一、低延迟的客户端-服务器 和 服务器-客户端的连接
很多时候所谓的http的请求、响应的模式,都是客户端加载一个网页,直到用户在进行下一次点击的时候,什么都不会发生。并且所有的http的通信都是客户端控制的,这时候就需要用户的互动或定期轮训的,以便从服务器端加载新的数据。
通常采用的技术比如推送和comet(使用http长连接、无需安装浏览器安装插件的两种方式:基于ajax的长
- 菜鸟分析网络执法官
dcj3sjt126com
网络
最近在论坛上看到很多贴子在讨论网络执法官的问题。菜鸟我正好知道这回事情.人道"人之患好为人师" 手里忍不住,就写点东西吧. 我也很忙.又没有MM,又没有MONEY....晕倒有点跑题.
OK,闲话少说,切如正题. 要了解网络执法官的原理. 就要先了解局域网的通信的原理.
前面我们看到了.在以太网上传输的都是具有以太网头的数据包. 
- Android相对布局属性全集
dcj3sjt126com
android
RelativeLayout布局android:layout_marginTop="25dip" //顶部距离android:gravity="left" //空间布局位置android:layout_marginLeft="15dip //距离左边距
// 相对于给定ID控件android:layout_above 将该控件的底部置于给定ID的
- Tomcat内存设置详解
eksliang
jvmtomcattomcat内存设置
Java内存溢出详解
一、常见的Java内存溢出有以下三种:
1. java.lang.OutOfMemoryError: Java heap space ----JVM Heap(堆)溢出JVM在启动的时候会自动设置JVM Heap的值,其初始空间(即-Xms)是物理内存的1/64,最大空间(-Xmx)不可超过物理内存。
可以利用JVM提
- Java6 JVM参数选项
greatwqs
javaHotSpotjvmjvm参数JVM Options
Java 6 JVM参数选项大全(中文版)
作者:Ken Wu
Email:
[email protected]
转载本文档请注明原文链接 http://kenwublog.com/docs/java6-jvm-options-chinese-edition.htm!
本文是基于最新的SUN官方文档Java SE 6 Hotspot VM Opt
- weblogic创建JMC
i5land
weblogicjms
进入 weblogic控制太
1.创建持久化存储
--Services--Persistant Stores--new--Create FileStores--name随便起--target默认--Directory写入在本机建立的文件夹的路径--ok
2.创建JMS服务器
--Services--Messaging--JMS Servers--new--name随便起--Pers
- 基于 DHT 网络的磁力链接和BT种子的搜索引擎架构
justjavac
DHT
上周开发了一个磁力链接和 BT 种子的搜索引擎 {Magnet & Torrent},本文简单介绍一下主要的系统功能和用到的技术。
系统包括几个独立的部分:
使用 Python 的 Scrapy 框架开发的网络爬虫,用来爬取磁力链接和种子;
使用 PHP CI 框架开发的简易网站;
搜索引擎目前直接使用的 MySQL,将来可以考虑使
- sql添加、删除表中的列
macroli
sql
添加没有默认值:alter table Test add BazaarType char(1)
有默认值的添加列:alter table Test add BazaarType char(1) default(0)
删除没有默认值的列:alter table Test drop COLUMN BazaarType
删除有默认值的列:先删除约束(默认值)alter table Test DRO
- PHP中二维数组的排序方法
abc123456789cba
排序二维数组PHP
<?php/*** @package BugFree* @version $Id: FunctionsMain.inc.php,v 1.32 2005/09/24 11:38:37 wwccss Exp $*** Sort an two-dimension array by some level
- hive优化之------控制hive任务中的map数和reduce数
superlxw1234
hivehive优化
一、 控制hive任务中的map数: 1. 通常情况下,作业会通过input的目录产生一个或者多个map任务。 主要的决定因素有: input的文件总个数,input的文件大小,集群设置的文件块大小(目前为128M, 可在hive中通过set dfs.block.size;命令查看到,该参数不能自定义修改);2. 
- Spring Boot 1.2.4 发布
wiselyman
spring boot
Spring Boot 1.2.4已于6.4日发布,repo.spring.io and Maven Central可以下载(推荐使用maven或者gradle构建下载)。
这是一个维护版本,包含了一些修复small number of fixes,建议所有的用户升级。
Spring Boot 1.3的第一个里程碑版本将在几天后发布,包含许多