样本收集与多组学数据生成
获取并处理来自不同种族/族裔个体的死后脑组织样本,生成单核RNA测序和ATAC测序数据,以覆盖多种细胞类型。
从ROSMAP、MARS和Latino核心研究队列中选取167名个体,解剖出三个脑区(DLPFC、STG、AC)的组织样本,提取细胞核后进行snRNA-seq和snATAC-seq建库和测序。
Cell-type signatures of Alzheimer's disease shared across population groups
研究包含多人群(非裔美国人、拉丁裔、白人)死后脑组织的单核多组学(RNA+ATAC)分析,并用Xenium空间转录组验证了关键细胞比例关联,属于多证据层级综合。
死后脑组织样本(背外侧前额叶皮层、颞上回、尾状核) 单核RNA测序数据(约190万核) 单核ATAC测序数据 Xenium原位杂交组织切片(33位供体)
样本来源:ROSMAP、MARS和Latino Core研究队列的自报种族/族裔分组(非裔美国人、拉丁裔、白人) 脑区:背外侧前额叶皮层、颞上回、前尾状核 数据类型:snRNA-seq和snATAC-seq,共399个样本 关联分析:使用ANCOM-BC、quasibinomial logistic regression、LINDA和sccomp四种方法,meta分析FDR调整P<0.1,I2<50%,至少两种方法一致 验证:Xenium平台33个供体的组织验证,标记基因面板包含259个基因
提炼研究问题、关键发现与证据,快速把握文章的核心贡献。
按研究推进顺序梳理实验设计、验证步骤与关键观察。
获取并处理来自不同种族/族裔个体的死后脑组织样本,生成单核RNA测序和ATAC测序数据,以覆盖多种细胞类型。
从ROSMAP、MARS和Latino核心研究队列中选取167名个体,解剖出三个脑区(DLPFC、STG、AC)的组织样本,提取细胞核后进行snRNA-seq和snATAC-seq建库和测序。
识别主要的细胞类型和亚群,并确定其在不同脑区和个体中的组成。
对snRNA-seq数据使用Seurat进行迭代聚类,首先区分主要细胞类别,然后对每个主要类别进行二次聚类以确定亚群。最终确定了61个亚群,包括神经元、胶质细胞和血管细胞等。
评估不同细胞亚群的比例与阿尔茨海默病病理和认知表型之间的关联,并确定跨种族/族裔群体的共享特征。
对每个种簇,分别使用ANCOM-BC、quasibinomial logistic regression、LINDA和sccomp四种方法检验其比例与临床和病理变量的关联,然后进行元分析以确定跨群体的一致性。
识别离散聚类未能捕获的、与疾病表型相关的连续基因表达模式,特别是少突胶质细胞和星形胶质细胞中的因子。
使用scHPF算法在每个主要细胞类别中提取连续表达因子,并检验因子得分与临床和病理变量的关联。
探索染色质可及性差异,识别可能驱动聚类或因子身份的转录因子,并评估AD风险位点的开放性。
对snATAC-seq峰进行差异分析,比较不同转录组定义的亚群间的染色质开放性,并富集转录因子结合基序。在AD相关GWAS位点计算染色质开放性,比较不同群体间的差异。
使用Xenium原位杂交技术验证snRNA-seq中发现的细胞类型比例与疾病表型的关联。
设计包含259个基因的针对面板,对来自33个供体的死后DLPFC组织切片进行原位杂交。将snRNA-seq聚类标签映射到细胞,计算组织中的细胞比例,并使用ANCOM-BC检验其与临床和病理变量的关联。
通过与以往两项主要包含白人个体的snRNA-seq研究(Mathys et al. 2023和Green et al. 2024)的结果进行比较,验证本研究的发现。
将本研究的聚类标签用MapMyCells工具映射到两个外部数据集,检验关键聚类(如GPNMB+小胶质细胞)的比例关联是否一致。同时,将外部聚类的标签映射回本研究,验证其关联。
在认知障碍个体中探索基于细胞组成和基因表达因子的分子亚组,并分析其与临床和病理特征的关系。
基于所有细胞亚群比例和因子得分,对MCI或AD个体的STG样本进行层次聚类,确定六个亚组,并评估其组成与临床、病理、种群和遗传特征的关联。
按研究目的归类文中使用的方法,便于定位所需技术。
| 实验环节 | 名称 | 品牌 | 货号 |
|---|---|---|---|
| 组织处理 | 杜恩斯匀浆器 | Sigma | D8938 |
| RNA酶抑制 | RNA酶抑制剂 | Takara | 2313B |
| 缓冲液配制 | 牛血清白蛋白 | NEB | B9000S |
| 细胞过滤 | 预分离过滤器(20μm) | Miltenyi | 130-101-812 |
| 细胞计数 | Cellometer Vision细胞计数仪 | Nexcelom | -- |
| 细胞计数板 | Nexcelom | CHT4-SD100-002 | |
| 单核多组学 | Chromium Next GEM单细胞Multiome ATAC+基因表达试剂盒 | 10x Genomics | PN-1000283 |
| Chromium Next GEM J芯片 | 10x Genomics | PN-2000264 | |
| 测序 | NovaSeq 6000测序仪 | Illumina | -- |
| 数据分析 | CellRanger ARC v2.0.2 | 10x Genomics | -- |
| CellBender v0.2.0 | -- | -- | |
| 单核RNA测序分析 | Seurat v.4 | -- | -- |
| 数据分析 | popscle (freemuxlet) | -- | -- |
| 单核ATAC测序分析 | Signac | -- | -- |
| 空间转录组分析 | Seurat v.5 | -- | -- |
| RCTD(稳健细胞类型分解) | -- | -- | |
| 单核RNA测序分析 | MapMyCells | Allen Institute for Brain Science | -- |
| 空间验证 | Xenium分析仪 | -- | -- |
| 数据分析 | DESeq2 | -- | -- |
| 基序富集分析 | XSTREME | -- | -- |
汇总复现实验时建议重点确认的条件及原文阅读提示。
| 环节 | 核对要点 |
|---|---|
| 研究参与者选择 | 参与者自报种族/族裔(非洲裔美国人、拉丁裔、白人),来源队列(ROSMAP、MARS、Latino Core),纳入标准为拥有至少两个脑区的冷冻组织且具有完整的病理表征 阅读提示:Methods 的 Study participants, ethics and clinicopathological characterization |
| 脑区取样与组织处理 | 脑区(DLPFC、STG、AC),组织重量(约50-100mg灰质),裂解缓冲液成分,匀浆次数(25次A、25次B),离心条件(500g,5分钟),过滤孔径(20μm) 阅读提示:Methods 的 Generation of snRNA-seq and snATAC-seq (multiome) data 下的 Tissue preparation |
| 单核多组学建库和测序 | 每批混合三个样本(来自不同脑区和种族/族裔),目标细胞数(约20,000个核),使用的试剂盒(Chromium Next GEM Single Cell Multiome ATAC+Gene Expression Reagent Bundle)和芯片(Chromium Next GEM Chip J),RT反应条件(45分钟37°C,30分钟25°C),测序平台和覆盖度(NovaSeq 6000,约645M reads/样本) 阅读提示:Methods 的 Generation of snRNA-seq and snATAC-seq (multiome) data 下的 Library preparation and sequencing |
| 数据预处理和质量控制 | 比对和定量使用CellRanger ARC v2.0.2默认参数,使用CellBender去除背景,过滤标准(UMI > 500,线粒体UMI百分比 < 5%),聚类参数(PC数、分辨率),迭代聚类流程,双细胞去除方法(freemuxlet) 阅读提示:Methods 的 Primary processing of sequencing data, Demultiplexing of sample barcodes and assignment to donors, and Clustering of nuclei |
| 差异丰度分析模型 | 统计方法(ANCOM-BC, quasibinomial, LINDA, sccomp),模型公式(比例 ~ 变量 + 年龄 + 性别 + 尸检间隔,认知变量另加教育),元分析方法(固定效应模型),显著性标准(FDR调整P < 0.1,方向一致,I2 < 50%,至少两种方法) 阅读提示:Methods 的 Associations of cell-type proportions with clinical and pathological traits 和 Meta-analysis across populations |
| 连续因子分析 | scHPF的因子数量选择标准,基因选择(权重最高前50个基因),因子得分计算(每个供体/区域的中位数),关联分析用线性模型,协变量同前,显著性标准同聚类分析 阅读提示:Methods 的 Identifying cell-type factors through scHPF |
| 染色质可及性分析 | snATAC-seq峰的计算和统一,差异峰分析使用DESeq2,亚群比较的协变量(批次、尸检间隔、年龄),AD风险位点的选择(GWAS队列),染色质开放性的归一化方法,群体间差异的统计检验(Kruskal-Wallis,事后Mann-Whitney) 阅读提示:Methods 的 snATAC-seq visualization and differential peak analysis 和 Open chromatin quantification for AD risk loci |
| 空间验证实验 | Xenium平台,基因面板包含259个基因,组织切片厚度(10μm),探针杂交条件(50°C过夜,浓度10 nM),连接条件(37°C 2小时),扩增条件(1小时4°C,2小时37°C),图像采集循环数(15轮),信号处理参数(默认),细胞分割参数(XOA v3.0默认) 阅读提示:Methods 的 Xenium multiplexed ISH experiments |
| 个体分子亚组分析 | 聚类特征(细胞比例和因子得分),输入样本(MCI或AD供体的STG样本),层次聚类方法(距离1-Pearson相关,Ward最小方差),最佳簇数通过轮廓系数,评估稳定性方法(添加噪声和扰乱,计算Jaccard相似度) 阅读提示:Methods 的 Donor clustering based on cell subcluster frequencies and median factor scores |
| 遗传分析 | WGS数据使用条件,质量控制标准(变异缺失<2%,MAF>1%,HWE P>1e-6),LD剪除参数(r2>0.2,窗口200 SNP,步进50),PC计算,ADMIXTURE分析的k值选择(k=3),多基因风险评分计算使用Bellenguez et al.汇总统计和PLINK 阅读提示:Methods 的 Genetic ancestry estimation and modelling 和 Polygenic risk scoring |