热门标签 | HotTags
当前位置:  开发笔记 > 编程语言 > 正文

下载的长数据怎么分开R语言_TCGA数据库单基因gsea作业之COADREAD

我前面写过单基因GSEA分析策略(数据分析免费做活动继续),然后马上就碰到了一个求助,复现下面的图表!发表在C

我前面写过 单基因GSEA分析策略(数据分析免费做活动继续) ,然后马上就碰到了一个求助,复现下面的图表!

发表在Cancer Management and Research的简单数据挖掘杂志:Apolipoprotein C1 (APOC1) promotes tumor progression via MAPK signaling pathways in colorectal cancer,仔细下载文献学习。

数据下载

关于TCGA数据下载,我挑选了部分,写了6个数据下载系列教程:

  • TCGA的28篇教程- 使用R语言的cgdsr包获取TCGA数据(cBioPortal)
  • TCGA的28篇教程- 使用R语言的RTCGA包获取TCGA数据 (离线打包版本)
  • TCGA的28篇教程-使用R语言的RTCGAToolbox包获取TCGA数据(FireBrowse portal)
  • TCGA的28篇教程- 批量下载TCGA所有数据 ( UCSC的 XENA)
  • TCGA的28篇教程-数据下载就到此为止吧
  • TCGA的28篇教程-整理GDC下载的xml格式的临床资料

但是,建议你选择UCSC的xena数据库下载方式。

b933ea1e9baf0248fe5d8f604140db8d.png

首先看表达差异

(A) APOC1 was highly expressed in CRC (n=380) samples compared to adjacent normal (n=50) samples based on The Cancer Genome Atlas (TCGA) database (unpaired t-test, P=0.012). (B) APOC1 was highly expressed in colorectal cancer samples compared to the adjacent normal samples of a matched paired group (n=25) based on The Cancer Genome Atlas (TCGA) database (paired t-test, P=0.002).

1bbceb3c9b0fe67efad1a589df809c2b.png

然后看生存效果

我已经在生信技能树多次介绍过生存分析:

  • 集思广益-生存分析可以随心所欲根据表达量分组吗
  • 生存分析时间点问题
  • 寻找生存分析的最佳基因表达分组阈值
  • apply家族函数和for循环还是有区别的(批量生存分析出图bug)
  • TCGA数据库生存分析的网页工具哪家强

而且使用TCGA数据库来看感兴趣基因的生存情况非常简单,一个网页工具即可,都无需R语言了

(F) and (G) Kaplan– Meier survival analysis according to APOC1 expression in 140 patients with CRC. The overall survival (OS) and disease-free survival (DFS) for patients with high versus low APOC1 expression. The difference is statistically significant based on the log-rank test (both P<0.001).

f0e0113a9110a75c29e7031fc17d9ddd.png

单基因的GSEA

首先需要根据感兴趣的基因表达量高低&#xff0c;对病人进行分组。

(A) GSEA-generated heatmap for highly enriched genes in the MAPK signaling pathway in the APOC1-higher expression group compared to the APOC1-lower expression group from the TCGA COAD-READ dataset.

6e3620538a5ee47f0bba2b7d126ffa6c.png

运行GSEA&#xff0c;需要指定感兴趣的通路进行可视化

(B) GSEA on the TCGA COAD-READ dataset identified MAPK signaling pathways as a regulatory target of APOC1. The GSEA enrichment plot shows values for normalized enrichment score (NES) &#61;1.87 and nominal P-value &#61;0.004.

91a938ef60af103d0e513bf683ab6034.png

如果大家感兴趣GSEA分析原理和用法&#xff0c;看合辑

  • GSEA的统计学原理试讲
  • 用GSEA来做基因集富集分析
  • 批量运行GSEA&#xff0c;命令行版本
  • 费九牛二虎之力也无法重现的GSEA图
  • GSEA分析合理性讨论
  • 做GSEA分析你的基因到底该如何排序
  • 重复不出来我费九牛二虎之力重复不出来的GSEA文章&#xff1f;
  • 数据挖掘任务-根据前面教程复现ssGSEA热图


推荐阅读
  • 如何高效启动大数据应用之旅?
    在前一篇文章中,我探讨了大数据的定义及其与数据挖掘的区别。本文将重点介绍如何高效启动大数据应用项目,涵盖关键步骤和最佳实践,帮助读者快速踏上大数据之旅。 ... [详细]
  • 在安装并配置了Elasticsearch后,我在尝试通过GET /_nodes请求获取节点信息时遇到了问题,收到了错误消息。为了确保请求的正确性和安全性,我需要进一步排查配置和网络设置,以确保Elasticsearch集群能够正常响应。此外,还需要检查安全设置,如防火墙规则和认证机制,以防止未经授权的访问。 ... [详细]
  • 如何使用 `org.apache.tomcat.websocket.server.WsServerContainer.findMapping()` 方法及其代码示例解析 ... [详细]
  • 深入解析 Android 中 EditText 的 getLayoutParams 方法及其代码应用实例 ... [详细]
  • javascript分页类支持页码格式
    前端时间因为项目需要,要对一个产品下所有的附属图片进行分页显示,没考虑ajax一张张请求,所以干脆一次性全部把图片out,然 ... [详细]
  • 原文网址:https:www.cnblogs.comysoceanp7476379.html目录1、AOP什么?2、需求3、解决办法1:使用静态代理4 ... [详细]
  • DVWA学习笔记系列:深入理解CSRF攻击机制
    DVWA学习笔记系列:深入理解CSRF攻击机制 ... [详细]
  • 在对WordPress Duplicator插件0.4.4版本的安全评估中,发现其存在跨站脚本(XSS)攻击漏洞。此漏洞可能被利用进行恶意操作,建议用户及时更新至最新版本以确保系统安全。测试方法仅限于安全研究和教学目的,使用时需自行承担风险。漏洞编号:HTB23162。 ... [详细]
  • 本文深入探讨了如何利用Maven高效管理项目中的外部依赖库。通过介绍Maven的官方依赖搜索地址(),详细讲解了依赖库的添加、版本管理和冲突解决等关键操作。此外,还提供了实用的配置示例和最佳实践,帮助开发者优化项目构建流程,提高开发效率。 ... [详细]
  • NOIP2000的单词接龙问题与常见的成语接龙游戏有异曲同工之妙。题目要求在给定的一组单词中,从指定的起始字母开始,构建最长的“单词链”。每个单词在链中最多可出现两次。本文将详细解析该题目的解法,并分享学习过程中的心得体会。 ... [详细]
  • 计算机视觉领域介绍 | 自然语言驱动的跨模态行人重识别前沿技术综述(上篇)
    本文介绍了计算机视觉领域的最新进展,特别是自然语言驱动的跨模态行人重识别技术。上篇内容详细探讨了该领域的基础理论、关键技术及当前的研究热点,为读者提供了全面的概述。 ... [详细]
  • 在 Kubernetes 中,Pod 的调度通常由集群的自动调度策略决定,这些策略主要关注资源充足性和负载均衡。然而,在某些场景下,用户可能需要更精细地控制 Pod 的调度行为,例如将特定的服务(如 GitLab)部署到特定节点上,以提高性能或满足特定需求。本文深入解析了 Kubernetes 的亲和性调度机制,并探讨了多种优化策略,帮助用户实现更高效、更灵活的资源管理。 ... [详细]
  • 在C#中开发MP3播放器时,我正在考虑如何高效存储元数据以便快速检索。选择合适的数据结构,如字典或数组,对于优化性能至关重要。字典能够提供快速的键值对查找,而数组则在连续存储和遍历方面表现优异。根据具体需求,合理选择数据结构将显著提升应用的响应速度和用户体验。 ... [详细]
  • 本文深入探讨了CGLIB BeanCopier在Bean对象复制中的应用及其优化技巧。相较于Spring的BeanUtils和Apache的BeanUtils,CGLIB BeanCopier在性能上具有显著优势。通过详细分析其内部机制和使用场景,本文提供了多种优化方法,帮助开发者在实际项目中更高效地利用这一工具。此外,文章还讨论了CGLIB BeanCopier在复杂对象结构和大规模数据处理中的表现,为读者提供了实用的参考和建议。 ... [详细]
  • 探索聚类分析中的K-Means与DBSCAN算法及其应用
    聚类分析是一种用于解决样本或特征分类问题的统计分析方法,也是数据挖掘领域的重要算法之一。本文主要探讨了K-Means和DBSCAN两种聚类算法的原理及其应用场景。K-Means算法通过迭代优化簇中心来实现数据点的划分,适用于球形分布的数据集;而DBSCAN算法则基于密度进行聚类,能够有效识别任意形状的簇,并且对噪声数据具有较好的鲁棒性。通过对这两种算法的对比分析,本文旨在为实际应用中选择合适的聚类方法提供参考。 ... [详细]
author-avatar
别想着摆脱_525
这个家伙很懒,什么也没留下!
PHP1.CN | 中国最专业的PHP中文社区 | DevBox开发工具箱 | json解析格式化 |PHP资讯 | PHP教程 | 数据库技术 | 服务器技术 | 前端开发技术 | PHP框架 | 开发工具 | 在线工具
Copyright © 1998 - 2020 PHP1.CN. All Rights Reserved | 京公网安备 11010802041100号 | 京ICP备19059560号-4 | PHP1.CN 第一PHP社区 版权所有