- 找不到某些GEO数据的表达矩阵肿么办
小洁忘了怎么分身
举个栗子,GSE99410和GSE78200。library(GEOquery)gse="GSE78200"eSet<-getGEO(gse,destdir='.',getGPL=F)exp<-exprs(eSet[[1]])#Errorinexp[1:4,1:4]:subscriptoutofboundsexp[1:4,1:4]boxplot(exp)#Errorinnames(groups)<
- R语言学习-GEO数据挖掘
米粥的味道
根据教程准备试着处理一下GSE的其他数据,发现对于多组数据很难简单的复现,待后续探索完善再补更;先复习LINUX;(1)下载数据及读取rm(list=ls())options(stringsAsFactors=F)library(GEOquery)eSet<-getGEO("GSE94648",destdir='.',getGPL=F)exp<-exprs(eSet[[1]])exp[1:4,1:
- 7+非肿瘤+WGCNA+机器学习+诊断模型,构思巧妙且操作简单
生信风暴
论文阅读
今天给同学们分享一篇生信文章“Platelets-relatedsignaturebaseddiagnosticmodelinrheumatoidarthritisusingWGCNAandmachinelearning”,这篇文章发表在FrontImmunol期刊上,影响因子为7.3。结果解读:DEGs和血小板相关基因的鉴定作者通过R的“GEOquery”和“limma”包,在数据预处理后获得了
- GEOquery 下载 GEO 数据
名本无名
前言NCBIGeneExpressionOmnibus(基因表达综合数据库,GEO)公开了很多高通量基因组学数据集。尽管名字很好听,但这个数据库并不是专门针对基因表达数据的。NCBIGEONCBIGEO是以样本的形式组织起来的,这些样本被归入series。对于较大的实验,有SubSeries和SuperSeries两种一个SuperSeries就是一篇论文的所有实验,一个SuperSeries可以
- 2018-10-11
一路向前_莫问前程_前程似锦
使用GEOquery包if(T){source("http://bioconductor.org/biocLite.R")options(BioC_mirror="http://mirrors.ustc.edu.cn/bioc/")biocLite("GEOquery")library(GEOquery)eSeteSet$GSE62832_series_matrix.txt.gzExpressio
- R 报错:ERROR: failed to lock directory XXX 00LOCK
11的雾
Error:install.packagesfailedtolockdirectory在使用bioconductor安装一些包的时候,比如我安装GEOquery时,会有ErrorinunpackPkgZip(foundpkgs[okp,2L],foundpkgs[okp,1L],lib,libs_only,:ERROR:failedtolockdirectory‘C:\ProgramFiles\R
- GEO通用
pedagogoose
数据下载:可以通过GEOquery这个R包进行下载,或者直接在网页上下载---下载的内容包括:==表达矩阵==和==注释文件==rm(list=ls())#一键清空环境中的对象options(stringsAsFactors=F)#默认的设置library(GEOquery)gse="GSE107943"#需要找到需要下载的数据的GSE号eSet<-getGEO(gse,destdir='.',g
- aglient芯片原始数据处理
小洁忘了怎么分身
本文讲的是aglient芯片原始数据的处理,参考资料是limma的userguide文档。GEO数据库下载的表达矩阵不符合预期,比如是空的,或者是有负值的,那我们就处理一下它的原始数据。aglient的芯片应用也很广泛,举个OSCC的栗子:GSE23558,跟着学习学习。1.下载和读取数据1.1获取临床信息数据从前,提到GEO数据下载,我们只有GEOquery,神功盖世,但是死于网速。后来就有了中
- GEO数据挖掘--下载数据的3种方式
Seurat_
rm(list=ls())##魔幻操作,一键清空~当前环境中对象全部删除options(stringsAsFactors=F)#在调用as.data.frame的时,将stringsAsFactors设置为FALSE可以避免character类型自动转化为factor类型数据下载下载方式1GEOquery#library(GEOquery)gse_number="GSE42872"#修改号码#eS
- GEO生信数据挖掘(五)提取临床信息构建分组,分组数据可视化(绘制层次聚类图,绘制PCA图)
人工智能学术前沿(真)
数据挖掘人工智能生信分析GEO数据挖掘基因数据分析
检索到目标数据集后,开始数据挖掘,本文以阿尔兹海默症数据集GSE1297为例上节做了很多的基因数据清洗(离群值处理、低表达基因、归一化、log2处理)操作,本节介绍构建临床分组信息。我们已经学习了提取表达矩阵的临床信息#安装并加载GEOquery包library(GEOquery)#指定GEO数据集的IDgse_id与是一致的。需要的分组信息已经提取完毕。分组后箱线图可视化上一节保存了数据清洗后的
- GEO生信数据挖掘(一)数据集下载和初步观察
人工智能学术前沿(真)
生信分析GEO数据挖掘基因数据分析
检索到目标数据集后,开始数据挖掘,本文以阿尔兹海默症数据集GSE1297为例目录GEOquery简介安装并加载GEOquery包getGEO函数获取数据(联网下载)更换下载数据源对数据集进行初步观察处理GEOquery简介GEOquery是一个在生物信息学中常用的R语言包,用于从NCBIGeneExpressionOmnibus(GEO)数据库中获取和分析基因表达数据。以下是GEOquery包的简
- 数据挖掘学习笔记——GEO数据库:芯片数据分析
福旺旺
生物信息学数据挖掘学习数据库
数据挖掘数据挖掘学习笔记——GEO数据库:芯片数据分析文章目录数据挖掘一、芯片基础知识1.1、背景二、GEO数据库概述2.1、基础简介2.2、检索页面展示三、GSE项目的三种下载方式3.1、主页下载原始数据3.2、主页下载表达矩阵3.3、GEOquery包下载表达量四、基因名与探针ID的转换技巧4.1、获取对照关系4.1.1、利用Bioconductor中汇总的R包4.1.2、利用平台的数据4.1
- 190304 用GEOquery从GEO数据库下载数据
森尼啊
①下载得到对象gds858<-getGEO(‘GDS858’,destdir=“.”)##根据GDS号来下载数据,下载soft文件gpl96<-getGEO(‘GPL96’,destdir=“.”)##根据GPL号下载的是芯片设计的信息!gse1009<-getGEO(‘GSE1009’,destdir=“.”)##根据GSE号下载数据,下载_series_matrix.txt.gz下载的文件都会
- 从GEO数据库下载数据并处理
刘大帅1
rm(list=ls())Versioninfo:R3.2.3,Biobase2.30.0,GEOquery2.40.0,limma3.26.8RscriptsgeneratedSunAug1123:08:50EDT2019################################################################rm(list=ls())#使用limma包对数
- 从GEO数据库下载数据
YTXu
从GEO数据库下载数据有很多种方法,主要用的是jimmy在生信技能树里给出的和果子老师现成的代码。Jimmy的更变通,果子老师的就只教了一种傻瓜式方法。下面是jimmy的,Ref:http://www.bio-info-trainee.com/bioconductor_China/software/GEOquery.html只需要记住三个函数,以及每个函数返回的对象该如何处理即可getGEO/ge
- R GEOquery: Timeout of 60 seconds was reached 解决办法
生信摆渡
`感谢各位简友一直的关注。请关注:感谢陪伴``RgetOption("timeout")options(timeout=1000)默认下载时限为60秒,修改为1000秒即可
- GEO数据挖掘
看远方的星
复现此篇文章:https://mp.weixin.qq.com/s/5Bdx7YyAk8InYs2MFIUUVQ下载相应的R包options(BioC_mirror="http://mirrors.ustc.edu.cn/bioc/")#设置镜像BiocManager::install('stringi')BiocManager::install('GEOquery')BiocManager::i
- GEOquery包、affy包、DESeq2包的加载
研平方
GEOquery包的加载library(Biobase)library(BiocGenerics)library(parallel)library(GEOquery)affy包的加载library(BiocGenerics)library(parallel)library(Biobase)library(affy)DESeq2包的加载library(S4Vectors)library(stats4
- 2019-12-15小白新手笔记 GEO下载数据及初步处理可视化,差异表达
海阔天空周
今天介绍另外一种方式具体哪种好用,我还在检测中rm(list=ls())options(stringsAsFactors=F)library(GEOquery)setwd("C:\\Users\\zhouwenqing789\\Desktop\\DFEF")eset1<-getGEO("GSE83521",destdir=".",getGPL=F)#下载了平台注释文件以及不是矩阵的形式,list。
- 2020-12-28 GEO下载代码
海阔天空周
setwd("D:\\GSE140358衰弱")library(GEOquery)getGEO(GEO="GSE140358",)gset140358<-getGEO('GSE140358',GSEMatrix=TRUE,destdir=".",AnnotGPL=T,getGPL=T)save(gset140358,file="GSE140358.Rdata")#取列表中的元素a=gset1403
- 2019-07-06学习总结
桃浪桃浪
GEOquery包使用说明书https://www.jianshu.com/p/0d32fd410bcf作业6>rm(list=ls())##魔幻操作,一键清空~>options(stringsAsFactors=F)>f#https://www.ncbi.nlm.nih.gov/geo/query/acc.cgi?acc=GSE17215>library(GEOquery)>#这个包需要注意两个
- linux学习100篇8:ERROR: configuration failed for package 'curl'
Seurat_Satija
ERROR:dependencies'httr','xml2'arenotavailableforpackage'GEOquery'*removing'/usr/local/lib/R/site-library/GEOquery'Thedownloadedsourcepackagesarein'/tmp/RtmpkVS6KY/downloaded_packages'Warningmessages:
- 【install.packages(“openssl“)不成功,提示tools/version.c:1:10: fatal error: openssl/opensslv.h: 不存在】
weixin_42001274
ubuntulinux运维
问题描述:安装GEOquery这个R包过程中,显示依赖的openssl的R包安装不成功.环境中已经有安装openssl.错误信息如下:BiocManager::install("GEOquery")tryingURL'https://bioconductor.org/packages/3.10/bioc/src/contrib/GEOquery_2.54.1.tar.gz'Contenttype'
- 2020-02-10
Clouddong
GSE125042+WGCNA数据下载+预处理rm(list=ls())options(stringsAsFactors=F)library(GEOmirror)library(AnnoProbe)library(WGCNA)library(GEOquery)gset1)idxhead(g_l)#gene_idlength#11000096001842#21000096092538#3100009
- Ubuntu20.04 安装 DeSeq2报错解决
Angeladaddy
问题描述ubuntu20.04,安装好了R(4.2.0)和RstudioServer,按照如下脚本安装包时报错:if(!requireNamespace("BiocManager",quietly=TRUE))install.packages("BiocManager")BiocManager::install("DESeq2")BiocManager::install("GEOquery")Bi
- 通过3个数据集取差异基因的交集复现一篇文中的韦恩图
小梦游仙境
老大让复现的是一张韦恩图,来自3个数据集,分别找每个数据集的差异基因,然后取UP和DOWN的交集。原文链接:https://www.ncbi.nlm.nih.gov/pmc/articles/PMC6054764/#.原文中的图片如下image-20191121212758565想先用循环下载含有表达矩阵和临床信息的一个list,然后试着用循环library(GEOquery)ls2]=2n[n0
- 2019-12-13 小白新手笔记 GEO数据库下载及ID转换
海阔天空周
GEO数据库下载library(Biobase)library(BiocGenerics)library(parallel)library(GEOquery)gest<-getGEO("GSE9579",destdir=".",GSEMatrix=T,AnnotGPL=FALSE,getGPL=F)#"."可填保存的路径从GPL平台直接下载平台基因信息gpl570=read.delim("C:\\
- limma | 分层样本的差异分析这样搞!(二)
生信漫卷
后端
1写在前面上期介绍了用limma包做配对样本的差异分析。本期介绍一下Multi-level如何处理吧。应用场景:Control和Diseased的T细胞和B细胞分层对比。2用到的包rm(list=ls())library(tidyverse)library(limma)library(GEOquery)3示例数据这里我们还是利用上期介绍的GEO数据库上的dataset。在3个样本中对T细胞和B细胞
- 生信技能树——GEO芯片数据的合并
一指流年,一纸沙
生信技能树r语言
GSE83521和GSE89143数据合并1.下载数据rm(list=ls())library(GEOquery)library(stringr)gse="GSE83521"eSet1<-getGEO("GSE83521",destdir='.',getGPL=F)eSet2<-getGEO("GSE89143",destdir='.',getGPL=F)#(1)提取表达矩阵expexp1<-ex
- 5. 生信技能树——GEO转录组RNA_seq_GSE162550
一指流年,一纸沙
生信技能树R语言GEOr语言
和生信技能树GEO转录组“GSE150392“分析类似,唯一区别就是在数据处理和ID转换这一环节略微有区别1.数据下载最方便的是xena。可以网页下载,也可以用代码下载。proj="DHA"2.生存信息与临床信息这里仅仅是查看一下,到生存信息部分再整理。library(GEOquery)eSet=getGEO("GSE162550",destdir=".",getGPL=F)eSet=eSet[[
- 面向对象面向过程
3213213333332132
java
面向对象:把要完成的一件事,通过对象间的协作实现。
面向过程:把要完成的一件事,通过循序依次调用各个模块实现。
我把大象装进冰箱这件事为例,用面向对象和面向过程实现,都是用java代码完成。
1、面向对象
package bigDemo.ObjectOriented;
/**
* 大象类
*
* @Description
* @author FuJian
- Java Hotspot: Remove the Permanent Generation
bookjovi
HotSpot
openjdk上关于hotspot将移除永久带的描述非常详细,http://openjdk.java.net/jeps/122
JEP 122: Remove the Permanent Generation
Author Jon Masamitsu
Organization Oracle
Created 2010/8/15
Updated 2011/
- 正则表达式向前查找向后查找,环绕或零宽断言
dcj3sjt126com
正则表达式
向前查找和向后查找
1. 向前查找:根据要匹配的字符序列后面存在一个特定的字符序列(肯定式向前查找)或不存在一个特定的序列(否定式向前查找)来决定是否匹配。.NET将向前查找称之为零宽度向前查找断言。
对于向前查找,出现在指定项之后的字符序列不会被正则表达式引擎返回。
2. 向后查找:一个要匹配的字符序列前面有或者没有指定的
- BaseDao
171815164
seda
import java.sql.Connection;
import java.sql.DriverManager;
import java.sql.SQLException;
import java.sql.PreparedStatement;
import java.sql.ResultSet;
public class BaseDao {
public Conn
- Ant标签详解--Java命令
g21121
Java命令
这一篇主要介绍与java相关标签的使用 终于开始重头戏了,Java部分是我们关注的重点也是项目中用处最多的部分。
1
- [简单]代码片段_电梯数字排列
53873039oycg
代码
今天看电梯数字排列是9 18 26这样呈倒N排列的,写了个类似的打印例子,如下:
import java.util.Arrays;
public class 电梯数字排列_S3_Test {
public static void main(S
- Hessian原理
云端月影
hessian原理
Hessian 原理分析
一. 远程通讯协议的基本原理
网络通信需要做的就是将流从一台计算机传输到另外一台计算机,基于传输协议和网络 IO 来实现,其中传输协议比较出名的有 http 、 tcp 、 udp 等等, http 、 tcp 、 udp 都是在基于 Socket 概念上为某类应用场景而扩展出的传输协
- 区分Activity的四种加载模式----以及Intent的setFlags
aijuans
android
在多Activity开发中,有可能是自己应用之间的Activity跳转,或者夹带其他应用的可复用Activity。可能会希望跳转到原来某个Activity实例,而不是产生大量重复的Activity。
这需要为Activity配置特定的加载模式,而不是使用默认的加载模式。 加载模式分类及在哪里配置
Activity有四种加载模式:
standard
singleTop
- hibernate几个核心API及其查询分析
antonyup_2006
html.netHibernatexml配置管理
(一) org.hibernate.cfg.Configuration类
读取配置文件并创建唯一的SessionFactory对象.(一般,程序初始化hibernate时创建.)
Configuration co
- PL/SQL的流程控制
百合不是茶
oraclePL/SQL编程循环控制
PL/SQL也是一门高级语言,所以流程控制是必须要有的,oracle数据库的pl/sql比sqlserver数据库要难,很多pl/sql中有的sqlserver里面没有
流程控制;
分支语句 if 条件 then 结果 else 结果 end if ;
条件语句 case when 条件 then 结果;
循环语句 loop
- 强大的Mockito测试框架
bijian1013
mockito单元测试
一.自动生成Mock类 在需要Mock的属性上标记@Mock注解,然后@RunWith中配置Mockito的TestRunner或者在setUp()方法中显示调用MockitoAnnotations.initMocks(this);生成Mock类即可。二.自动注入Mock类到被测试类 &nbs
- 精通Oracle10编程SQL(11)开发子程序
bijian1013
oracle数据库plsql
/*
*开发子程序
*/
--子程序目是指被命名的PL/SQL块,这种块可以带有参数,可以在不同应用程序中多次调用
--PL/SQL有两种类型的子程序:过程和函数
--开发过程
--建立过程:不带任何参数
CREATE OR REPLACE PROCEDURE out_time
IS
BEGIN
DBMS_OUTPUT.put_line(systimestamp);
E
- 【EhCache一】EhCache版Hello World
bit1129
Hello world
本篇是EhCache系列的第一篇,总体介绍使用EhCache缓存进行CRUD的API的基本使用,更细节的内容包括EhCache源代码和设计、实现原理在接下来的文章中进行介绍
环境准备
1.新建Maven项目
2.添加EhCache的Maven依赖
<dependency>
<groupId>ne
- 学习EJB3基础知识笔记
白糖_
beanHibernatejbosswebserviceejb
最近项目进入系统测试阶段,全赖袁大虾领导有力,保持一周零bug记录,这也让自己腾出不少时间补充知识。花了两天时间把“传智播客EJB3.0”看完了,EJB基本的知识也有些了解,在这记录下EJB的部分知识,以供自己以后复习使用。
EJB是sun的服务器端组件模型,最大的用处是部署分布式应用程序。EJB (Enterprise JavaBean)是J2EE的一部分,定义了一个用于开发基
- angular.bootstrap
boyitech
AngularJSAngularJS APIangular中文api
angular.bootstrap
描述:
手动初始化angular。
这个函数会自动检测创建的module有没有被加载多次,如果有则会在浏览器的控制台打出警告日志,并且不会再次加载。这样可以避免在程序运行过程中许多奇怪的问题发生。
使用方法: angular .
- java-谷歌面试题-给定一个固定长度的数组,将递增整数序列写入这个数组。当写到数组尾部时,返回数组开始重新写,并覆盖先前写过的数
bylijinnan
java
public class SearchInShiftedArray {
/**
* 题目:给定一个固定长度的数组,将递增整数序列写入这个数组。当写到数组尾部时,返回数组开始重新写,并覆盖先前写过的数。
* 请在这个特殊数组中找出给定的整数。
* 解答:
* 其实就是“旋转数组”。旋转数组的最小元素见http://bylijinnan.iteye.com/bl
- 天使还是魔鬼?都是我们制造
ducklsl
生活教育情感
----------------------------剧透请原谅,有兴趣的朋友可以自己看看电影,互相讨论哦!!!
从厦门回来的动车上,无意中瞟到了书中推荐的几部关于儿童的电影。当然,这几部电影可能会另大家失望,并不是类似小鬼当家的电影,而是关于“坏小孩”的电影!
自己挑了两部先看了看,但是发现看完之后,心里久久不能平
- [机器智能与生物]研究生物智能的问题
comsci
生物
我想,人的神经网络和苍蝇的神经网络,并没有本质的区别...就是大规模拓扑系统和中小规模拓扑分析的区别....
但是,如果去研究活体人类的神经网络和脑系统,可能会受到一些法律和道德方面的限制,而且研究结果也不一定可靠,那么希望从事生物神经网络研究的朋友,不如把
- 获取Android Device的信息
dai_lm
android
String phoneInfo = "PRODUCT: " + android.os.Build.PRODUCT;
phoneInfo += ", CPU_ABI: " + android.os.Build.CPU_ABI;
phoneInfo += ", TAGS: " + android.os.Build.TAGS;
ph
- 最佳字符串匹配算法(Damerau-Levenshtein距离算法)的Java实现
datamachine
java算法字符串匹配
原文:http://www.javacodegeeks.com/2013/11/java-implementation-of-optimal-string-alignment.html------------------------------------------------------------------------------------------------------------
- 小学5年级英语单词背诵第一课
dcj3sjt126com
englishword
long 长的
show 给...看,出示
mouth 口,嘴
write 写
use 用,使用
take 拿,带来
hand 手
clever 聪明的
often 经常
wash 洗
slow 慢的
house 房子
water 水
clean 清洁的
supper 晚餐
out 在外
face 脸,
- macvim的使用实战
dcj3sjt126com
macvim
macvim用的是mac里面的vim, 只不过是一个GUI的APP, 相当于一个壳
1. 下载macvim
https://code.google.com/p/macvim/
2. 了解macvim
:h vim的使用帮助信息
:h macvim
- java二分法查找
蕃薯耀
java二分法查找二分法java二分法
java二分法查找
>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>>
蕃薯耀 2015年6月23日 11:40:03 星期二
http:/
- Spring Cache注解+Memcached
hanqunfeng
springmemcached
Spring3.1 Cache注解
依赖jar包:
<!-- simple-spring-memcached -->
<dependency>
<groupId>com.google.code.simple-spring-memcached</groupId>
<artifactId>simple-s
- apache commons io包快速入门
jackyrong
apache commons
原文参考
http://www.javacodegeeks.com/2014/10/apache-commons-io-tutorial.html
Apache Commons IO 包绝对是好东西,地址在http://commons.apache.org/proper/commons-io/,下面用例子分别介绍:
1) 工具类
2
- 如何学习编程
lampcy
java编程C++c
首先,我想说一下学习思想.学编程其实跟网络游戏有着类似的效果.开始的时候,你会对那些代码,函数等产生很大的兴趣,尤其是刚接触编程的人,刚学习第一种语言的人.可是,当你一步步深入的时候,你会发现你没有了以前那种斗志.就好象你在玩韩国泡菜网游似的,玩到一定程度,每天就是练级练级,完全是一个想冲到高级别的意志力在支持着你.而学编程就更难了,学了两个月后,总是觉得你好象全都学会了,却又什么都做不了,又没有
- 架构师之spring-----spring3.0新特性的bean加载控制@DependsOn和@Lazy
nannan408
Spring3
1.前言。
如题。
2.描述。
@DependsOn用于强制初始化其他Bean。可以修饰Bean类或方法,使用该Annotation时可以指定一个字符串数组作为参数,每个数组元素对应于一个强制初始化的Bean。
@DependsOn({"steelAxe","abc"})
@Comp
- Spring4+quartz2的配置和代码方式调度
Everyday都不同
代码配置spring4quartz2.x定时任务
前言:这些天简直被quartz虐哭。。因为quartz 2.x版本相比quartz1.x版本的API改动太多,所以,只好自己去查阅底层API……
quartz定时任务必须搞清楚几个概念:
JobDetail——处理类
Trigger——触发器,指定触发时间,必须要有JobDetail属性,即触发对象
Scheduler——调度器,组织处理类和触发器,配置方式一般只需指定触发
- Hibernate入门
tntxia
Hibernate
前言
使用面向对象的语言和关系型的数据库,开发起来很繁琐,费时。由于现在流行的数据库都不面向对象。Hibernate 是一个Java的ORM(Object/Relational Mapping)解决方案。
Hibernte不仅关心把Java对象对应到数据库的表中,而且提供了请求和检索的方法。简化了手工进行JDBC操作的流程。
如
- Math类
xiaoxing598
Math
一、Java中的数字(Math)类是final类,不可继承。
1、常数 PI:double圆周率 E:double自然对数
2、截取(注意方法的返回类型) double ceil(double d) 返回不小于d的最小整数 double floor(double d) 返回不大于d的整最大数 int round(float f) 返回四舍五入后的整数 long round