商品详情
本书是一本系统介绍生物多组学数据分析原理与实战的专业教材。全书共8章,内容涵盖从基因组学到医学影像处理的前沿技术与核心算法。首先,书中详细介绍了基因组学数据分析,包括新一代测序技术原理、序列比对及变异检测流程;随后,深入讲解了转录组学领域的三大核心技术――Bulk RNA_Seq、单细胞转录组测序及空间转录组测序的数据处理与分析方法;接着,系统阐述了质谱蛋白质组学和代谢组学的数据采集、定性定量分析及多变量统计分析;此外,本书还特别增设了医学影像处理与分析章节,探讨了多模态数据融合及深度学习在医学影像中的应用;最后,本书第8章专门介绍了R语言在生物多组学中的基础架构与应用。 本书理论与实践并重,通过原理概述、工具介绍、代码实战(涵盖Linux、R和Python)及结果解读等模块,全方位展示了生物信息学数据分析的全流程。通过学习本书,读者能够掌握多组学数据分析的核心技能,为开展系统生物学研究奠定坚实基础。 本书可作为生物信息学、医学、生命科学等相关专业高年级本科生及研究生的教材,也可供从事生命科学研究的科研人员及临床医生参考。赵天意,哈尔滨工业大学哈尔滨工业大学计算学部生物信息学研究中心教授、博士生导师、生物信息学系主任、生物信息技术研究院副院长。研究方向为单细胞数据分析算法、生物网络分析算法,旨在通过对深度学习、机器学习算法的创新突破解决生物学问题。主持国家重点研发计划课题1项、国家自然基金1项、哈工大青年人才项目1项、医工交叉项目1项。第1章 基因组学数据分析11.1 基因组学核心概念与技术体系21.1.1 新一代测序技术原理31.1.2 参考基因组的概念与应用41.1.3 基因组序列比对原理与算法41.1.4 基因组变异检测方法51.1.5 基因组学常用数据格式71.1.6 序列比对核心算法101.1.7 核心算法实战(Python实现)141.2 DNA序列比对实战181.2.1 安装Conda和比对工具集181.2.2 下载参考基因组201.2.3 下载FASTQ文件231.2.4 BWA序列比对与结果处理241.3 GATK变异检测与注释实战281.3.1 GATK的安装与配置291.3.2 输入数据说明291.3.3 去除PCR重复291.3.4 识别变异291.3.5 变异质量过滤与SnpEff注释301.3.6 使用IGV进行可视化31课后习题32第2章 Bulk转录组学数据分析332.1 Bulk RNA_seq分析概述342.2 数据处理方法352.2.1 原始测序数据格式352.2.2 初始质量控制352.2.3 序列修剪与序列过滤352.2.4 预处理阶段的质量控制要点362.3 序列比对与表达定量362.3.1 参考基因组的获取与索引构建362.3.2 比对方法概述372.3.3 主流比对工具372.3.4 无比对定量382.3.5 基因表达矩阵构建382.3.6 比对结果评估与质量控制392.4 差异表达分析392.4.1 数据归一化与校正392.4.2 通过PCA与聚类评估样本关系402.4.3 差异表达统计模型412.4.4 常用差异表达分析工具412.4.5 分析流程与参数设置422.4.6 差异表达基因结果解读422.4.7 结果可视化432.5 功能富集与通路分析442.5.1 基因列表与背景集准备442.5.2 GO功能富集分析442.5.3 通路富集分析452.5.4 基因集富集分析452.5.5 富集结果的可视化与综合解释462.6 数据分析的可视化总结472.6.1 质量评估结果可视化472.6.2 表达数据分布和样本可视化472.6.3 差异表达结果可视化472.6.4 富集分析结果可视化482.6.5 其他可视化工具482.7 可变剪接分析492.7.1 可变剪接事件类型492.7.2 剪接分析方法与工具492.7.3 差异剪接分析流程502.7.4 剪接结果解读与实例502.8 基因共表达网络分析512.8.1 WGCNA原理简介512.8.2 WGCNA网络构建步骤512.8.3 模块与表型性状的关联分析522.8.4 模块功能注释与枢纽基因识别522.9 Bulk转录组数据分析实战532.9.1 实验背景与数据集介绍532.9.2 数据预处理和比对方法542.9.3 差异表达基因分析结果572.9.4 功能/通路富集分析结果612.9.5 共表达网络分析结果642.9.6 结果整合与生物学意义70课后习题71第3章 单细胞转录组学数据分析723.1 单细胞转录组测序技术概述733.1.1 转录组学基础733.1.2 技术背景及实验流程733.1.3 测序技术分类与对比753.2 单细胞转录组数据结构763.2.1 数据构成与数据格式763.2.2 Python中的AnnData对象773.2.3 R中的Seurat对象813.3 单细胞转录组基础分析流程853.3.1 数据预处理方法853.3.2 降维与聚类分析903.3.3 细胞类型注释923.3.4 差异表达分析933.3.5 功能富集分析953.3.6 拟时序轨迹推断953.3.7 常用分析工具概览963.4 单细胞数据整合973.4.1 Seurat锚点整合法973.4.2 Harmony算法993.4.3 ComBat算法100课后习题102第4章 空间转录组学数据分析1034.1 空间转录组学概述1044.2 技术分类与核心原理1064.2.1 基于NGS的空间转录组技术1064.2.2 基于成像的空间转录组技术1074.3 基础分析流程1084.3.1 基于测序平台的数据分析1084.3.2 基于成像平台的数据分析1224.4 进阶空间分析方法1284.4.1 细胞类型反卷积分析1284.4.2 空间邻域分析1334.4.3 细胞通信推断1364.5 数据与工具资源1384.5.1 综合性资源库1384.5.2 疾病专项数据库1404.5.3 技术导向型资源库141课后习题143第5章 质谱蛋白质组学数据分析1445.1 基本概念1455.1.1 质谱测量与分析整体流程1455.1.2 各分析环节的方法学1455.1.3 数据采集类型1465.1.4 定量标记类型1465.2 蛋白质定量分析1465.2.1 DDA LFQ数据定量1465.2.2 DIA LFQ数据定量1535.2.3 TMT数据定量1545.3 蛋白质表达矩阵类型1565.3.1 DDA LFQ数据的表达矩阵1565.3.2 DIA LFQ数据的表达矩阵1565.3.3 TMT FragPipe数据的表达矩阵1565.3.4 TMT MaxQuant数据的表达矩阵1565.4 定量数据预处理1565.4.1 数据输入与MSnSet对象的构建1575.4.2 数据插补方法1595.4.3 数据标准化方法1615.4.4 差异蛋白表达分析162课后习题164第6章 代谢组学数据分析1656.1 代谢组学概述1666.2 代谢组学的研究方法1666.3 代谢组学数据结构1676.3.1 质谱分析核心概念1676.3.2 常用数据格式1686.4 常用数据库及检索工具1696.4.1 综合性数据库1706.4.2 质谱图预测平台1716.4.3 化学结构检索工具1726.5 数据处理与分析平台1726.5.1 原始数据格式转换1746.5.2 在线统计分析可视化178课后习题184第7章 医学影像处理与分析1857.1 医学影像概述与多模态融合1867.1.1 医学影像的研究价值1867.1.2 多模态数据融合策略1877.2 数据获取与预处理1897.2.1 医学影像的获取途径与存储格式1897.2.2 影像读取与标准化流程1917.3 深度图像特征提取与分析1947.3.1 深度学习特征提取模型1947.3.2 特征处理与建模1967.4 大模型在医学影像中的应用1977.4.1 图文匹配与检索1977.4.2 图像分割与区域分析1997.4.3 医学影像语义生成与报告分析200课后习题201第8章 R语言在生物信息学中的应用2028.1 走入R语言2038.1.1 R语言简介2038.1.2 CRAN与Bioconductor2038.1.3 BiocManager的安装2038.2 R语言数据结构与编程范式2048.2.1 R语言中的S4对象2048.2.2 SingleCellExperiment结构2048.3 数据预处理流程2058.3.1 PBMC 3k数据集背景2058.3.2 加载可重复数据2058.3.3 子集选取与数据访问2068.3.4 质量控制2068.4 数据核心分析流程2078.4.1 数据标准化与高变基因选择2078.4.2 数据降维分析2088.5 数据可视化与解释2088.5.1 质量控制与预处理结果可视化2088.5.2 UMAP/t_SNE聚类结果可视化2098.6 细胞聚类与注释2098.6.1 无监督聚类方法2098.6.2 标记基因鉴定与差异表达分析2108.6.3 细胞类型注释2118.7 高级生物信息学R包2128.7.1 基因组数据结构化2128.7.2 Bulk RNA_seq差异表达分析2128.7.3 原始测序数据处理2138.7.4 高级基因组可视化2138.7.5 计算性能优化213课后习题213
- 新华一城书集 (微信公众号认证)
- 上海新华书店官方微信书店
- 扫描二维码,访问我们的微信店铺
- 随时随地的购物、客服咨询、查询订单和物流...