文献名:Fast and accurate bacterial species identification in urine specimens using LC-MS/MS mass spectrometry and machine learning(利用质谱技术和机器学习模型在尿液样本中快速准确地进行菌种鉴定)

doi: 10.1074/mcp.TIR119.001559

期刊名:Mol Cell Proteomics

作者:Florence Roux-Dalvai

通讯作者:Arnaud Droit

单位:

  1. 拉瓦尔大学
  2. 赛默飞世尔科技有限公司

一、 概述:

本研究主要目的是利用现有的技术对临床尿液样本中的特定细菌进行快速准确的鉴定。研究采用了新的策略来找到每个细菌对应的LC-MC/MC肽段标签。首先是通过DIA的方法得到每种细菌的特征肽段,利用机器学习分类预测,挑选出每个物种特有的肽段标签。然后,采用靶向蛋白质组的方法,利用这些标签肽段对未知样本进行菌种的鉴定。利用这种方法,可以在4小时内对尿路感染的15种致病菌进行快速准确的鉴定。

二、 研究背景:

在临床上,准确地鉴定致病菌对患者的治疗和用药具有非常重要的指导意义,针对致病菌采取合适的治疗方案可以防止抗生素的滥用。因此,如何快速地鉴定致病菌至关重要。基因型的方法,例如16S和宏基因组测序,可以用于对复杂样本的致病菌鉴定。16S测序一般可以在24小时内完成快速鉴定。但由于16S基因序列在物种间的保守性高,导致该方法的鉴别分辨率较低,只能局限在属的水平。宏基因组测序虽然可以做到菌株水平的区分,但它需要较高的预算和时间成本,不适合于临床的快速鉴定。质谱技术可以在较短的时间内对单菌进行鉴定,目前也已经应用到临床研究中。但是细菌的质谱鉴定存在以下几个问题:1)需要对细菌进行分离纯化培养;2)由于样本量少,低丰度的细菌可能难以鉴定到;3)目前的鉴定方法无法给出致病菌的定量信息。针对这些问题,临床质谱细菌鉴定技术做了一些改进。本研究采用Nano LC-MS/MS方法,结合DIA采集模式以及机器学习模型,对尿液样本中的致病菌进行鉴定,确定每种菌特异的标志肽段。然后利用这些标志肽段在组成未知的尿液样本中进行靶向蛋白质组学鉴定致病菌。通过这种方法,共建立了15种尿道感染致病菌的肽段标志物。这15种致病菌覆盖了84%以上的尿道感染病例,是最常见的几种致病菌。利用这些标志物,可以在4小时之内实现对尿液样本的快速鉴定,根据肽段标志物的种类和丰度判断其致病菌的类型。

三、 实验设计:

本研究主要分两个阶段,训练阶段和鉴定阶段。在训练阶段,首先是对15种菌进行DDA鉴定,得到每种菌的谱图库,然后对包含该菌的尿液进行DIA分析,利用构建好的谱图库来匹配DIA结果。DIA样本中包括15种菌的尿液样本,每种菌存在两种浓度差异,9个高浓度重复和3个低浓度重复,共180个样本。此外还存在10个空白对照。通过肽段强度信息以及二级谱图信息等对肽段进行进一步过滤,最终得到4319条候选肽段。然后将这些肽段合并,采用机器学习分类模型,利用这些肽段作为feature来区分不同致病菌数据集,最终筛选出82条具有区分度的肽段。第二部分是致病菌的鉴定。将82条肽段的母离子与子离子信息收集构建离子对,用于对未知样本的靶向蛋白质组学分析。通过对目标肽段的鉴定和定量结果模式来判断未知样本中存在哪种致病菌。

四、研究成果:

 

热图展示了82个肽段标志物在15种细菌中的分布情况。每种菌均有6个生物重复。可以看出,不同菌株存在不同的肽段标志物强度信息。因此,通过这些肽段以及其强度信息,可以在复杂样本中准确的鉴定出某个致病菌株的存在与否。

图a展示了对于4种常见的致病菌,结合肽段标志物的PRM预测结果。结果表明,在不同的浓度下,利用已有的肽段标志物都能很好地鉴定出4种目标菌株。可以看出,即使致病菌浓度在临床的检测线以下,每个菌株仍能被鉴定出来。图b表明,每个菌株的肽段标志物的丰度是与该菌丰度呈显著正相关的,可以结合肽段标志物的定量信息来判断致病菌浓度。图c说明4个生物样本之间致病菌丰度是显著相关的,生物重复性高。

五、文章亮点:

本文结合了DIA与机器学习的方法来寻找致病菌的标志肽段,实现了对复杂样本中特定物种的快速鉴定。其方法的巧妙结合为今后的研究提供了更加丰富的科研思路。而且具有很好的应用前景,推进了临床质谱的应用价值。

阅读人:闫克强

Fast and accurate bacterial species identification in urine specimens using LC-MS/MS mass spectrometry and machine learning (解读人:闫克强)的更多相关文章

  1. DART: a fast and accurate RNA-seq mapper with a partitioning strategy DART:使用分区策略的快速准确的RNA-seq映射器

    DART: a fast and accurate RNA-seq mapper with a partitioning strategyDART:使用分区策略的快速准确的RNA-seq映射器 Abs ...

  2. Fauce:Fast and Accurate Deep Ensembles with Uncertainty for Cardinality Estimation 论文解读(VLDB 2021)

    Fauce:Fast and Accurate Deep Ensembles with Uncertainty for Cardinality Estimation 论文解读(VLDB 2021) 本 ...

  3. Fast and Accurate Traffic Matrix Measurement Using Adaptive Cardinality Counting

    paper-CaiPan.pdf http://conferences.sigcomm.org/sigcomm/2005/paper-CaiPan.pdf

  4. Journal of Proteome Research | SAAVpedia: identification, functional annotation, and retrieval of single amino acid variants for proteogenomic interpretation | SAAV的识别、功能注释和检索 | (解读人:徐洪凯)

    文献名:SAAVpedia: identification, functional annotation, and retrieval of single amino acid variants fo ...

  5. Mol Cell Proteomics. | Identification of salivary biomarkers for oral cancer detection with untargeted and targeted quantitative proteomics approaches (解读人:卜繁宇)

    文献名:Identification of salivary biomarkers for oral cancer detection with untargeted and targeted qua ...

  6. 解读人:董鑫,Disease Development Is Accompanied by Changes in Bacterial Protein Abundance and Functions in a Refined Model of Dextran Sulfate Sodium (DSS)-Induced Colitis

    文章中文名:在葡聚糖硫酸钠(DSS)诱导下的结肠炎模型伴随着细菌蛋白质丰度和功能的改变 单位: 1 Helmholtz-Centre for Environmental Research - UFZ, ...

  7. 解读人:林山云,Proteomic Identification of Protein Glutathionylation in Cardiomyocytes(心肌细胞蛋白质谷胱甘肽修饰的蛋白质组鉴定)

    发表时间:(2019年4月) IF:3.950 单位:韦恩州立大学化学系 物种:小鼠心肌细胞 技术:谷胱甘肽修饰蛋白组学 一. 概述: 本研究采用化学选择性蛋白组学方法,鉴定出过氧化物诱导HL-1小鼠 ...

  8. FAST特征点检测&&KeyPoint类

    FAST特征点检测算法由E.Rosten和T.Drummond在2006年在其论文"Machine Learning for High-speed Corner Detection" ...

  9. 5 Ways AI is Transforming the Finance Industry

    https://marutitech.com/ways-ai-transforming-finance/ As global technology has evolved over the years ...

随机推荐

  1. 教你如何将txt复制到excel的各个单元格;并解决科学计数法显示问题及导致的个位数变0问题

    1.如果你的txt或log等文件中的数据每个数据刚好都回车了,那么直接粘贴到excel即可: 2.如果你的txt或log等文件中数据较多,回车之后的每一行数据仍需再次分列,那么要求:每一行中需要分列的 ...

  2. win+E 出现“未指定错误“修复方案

    windows7 (win7) win+E 出现"未指定错误----"解决方法 出现该问题的原因:大家使用某种注册表优化所致,如使用优化大师等优化注册表-- 解决方法: 1.如果优 ...

  3. 内核融合:GPU深度学习的“加速神器”

    ​编者按:在深度学习"红透"半边天的同时,当前很多深度学习框架却面临着共同的性能问题:被频繁调用的代数运算符严重影响模型的执行效率. 本文中,微软亚洲研究院研究员薛继龙将为大家介绍 ...

  4. 斑马难题Step by Step

    问题描述 分析 代码 在exercism.io被这个 Zebra Puzzle 难住了.这里一步一步的解决... 1.There are five houses. 2.The Englishman l ...

  5. AndroidStudio实现AIDL

    AIDL的使用步骤 aidl远程调用传递的参数和返回值支持Java的基本类型(int long booen char byte等)和String,List,Map等.当然也支持一个自定义对象的传递. ...

  6. 使用python模拟登录网易邮箱网站

    环境要求 python 3.6 chromedriver.exe 文件 人工登录 人工登录某个网站,首先需要用浏览器打开登录页面,然后在输入框中输入对应的账号和密码,最后点击登录,以下使用代码模拟以上 ...

  7. [工具] Docker安装及portainer GUI

    一.Docker Engine安装 1.安装流程 1)移除旧版本(如果有旧版本) yum remove docker \ docker-client \ docker-client-latest \ ...

  8. CSS3实现一个旋转的花朵

    要效果图如下: 实现原理:其实很简单,就是中间的圆圈定位在中间,其他的6个圆圈,进行不同的绝对定位,然后进行旋转!代码: <!DOCTYPE html> <html lang=&qu ...

  9. uWSGI, send_file and Python 3.5

    当你的Flask项目通过Nginx+uWSGI成功部署的时候,当你很高兴你Flask里面的接口成功跑通的时候,你会发现真高兴!好牛逼! 然后当你写了其他几个接口的时候,在启动uWSGI服务的时候,死活 ...

  10. 峰哥说技术:06-手撸Spring Boot自定义启动器,解密Spring Boot自动化配置原理

    Spring Boot深度课程系列 峰哥说技术—2020庚子年重磅推出.战胜病毒.我们在行动 06  峰哥说技术:手撸Spring Boot自定义启动器,解密Spring Boot自动化配置原理 Sp ...