如何采用TCGAbiolinks 去下载TCGA临床数据

发布时间:2022-03-18 14:56:19 作者:小新
来源:亿速云 阅读:827

小编给大家分享一下如何采用TCGAbiolinks 去下载TCGA临床数据,相信大部分人都还不怎么了解,因此分享这篇文章给大家参考一下,希望大家阅读完这篇文章后大有收获,下面让我们一起去了解一下吧!

采用TCGAbiolinks 去下载TCGA临床数据,并对数据进行整合

下载和处理TCGA的临床信息非常的麻烦,不同的癌症,格式还不一样,处理起来不容易。

采用TCGAbiolinks 包去下载和处理临床信息就非常的方便。

那么我们以下载胃癌病人的临床数据的为例,看看如何下载数据。

#  加载需要的包
library(SummarizedExperiment)
library(TCGAbiolinks)

###########################################################
# GDC: https://portal.gdc.cancer.gov/
###########################################################

# 设置程序参数
work_dir <- "/Users/zhangqiuxue/Documents/Train/TCGA/lab/Download_Data/Clinical" 

# 设置需要下载癌症对应的project 和数据类型
project <- "TCGA-STAD"
data_category <- "Clinical"
data_type <- "Clinical Supplement"
legacy <- FALSE

# 设置工作目录
setwd(work_dir)

# 下载临床数据的结果
DataDirectory <- paste0(work_dir,"/GDC/",gsub("-","_",project))

# 查询可以下载的数据
query <- GDCquery(project = project,
                  data.category = data_category,
                  data.type = data_type, 
                  legacy = legacy)

# 该癌症总样品数量
samplesDown <- getResults(query,cols=c("cases"))
cat("Total Clinical sample to down:", length(samplesDown))

# 下载数据
GDCdownload(query = query,
            directory = DataDirectory,files.per.chunk=6, method='client')

# 用专门的函数去整合下载好的数据
clinical <- GDCprepare_clinic(query, clinical.info = "patient",directory = DataDirectory)

# 将数据保存到文件,方便后面的进一步分析
clinical_file <- paste0(DataDirectory, "_","clinical",".txt")
write.csv(clinical, file = clinical_file, row.names = F, quote = F)

以上是“如何采用TCGAbiolinks 去下载TCGA临床数据”这篇文章的所有内容,感谢各位的阅读!相信大家都有了一定的了解,希望分享的内容对大家有所帮助,如果还想学习更多知识,欢迎关注亿速云行业资讯频道!

推荐阅读:
  1. Tivoli_oracle采用客户端远程监控问题
  2. MySQL 采用Xtrabackupex进行全库备份过程汇总

免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:is@yisu.com进行举报,并提供相关证据,一经查实,将立刻删除涉嫌侵权内容。

tcgabiolinks tcga

上一篇:如何利用GEOquery并结合Biobase下载GEO数据库多种数据

下一篇:python如何将字符串拆分为子字符串列表

相关阅读

您好,登录后才能下订单哦!

密码登录
登录注册
其他方式登录
点击 登录注册 即表示同意《亿速云用户服务条款》