Cell综述深度解读!机器学习如何带来生物医学研讨的变革!
作者头像
  • 柳栋栋
  • 2020-04-23 17:37:26 5

近日,一篇发表在《细胞》杂志上的综述文章探讨了机器学习技术在改善疾病诊断和治疗方面的应用。该研究由俄勒冈健康与科学大学的研究人员完成,详细介绍了机器学习在生物医学领域的三大应用领域,分别是临床诊断、个性化治疗和健康监测。研究指出,机器学习的应用旨在通过监测各种疾病的发展和正常的衰老过程,来维护人类健康。对于每个领域,研究人员列举了一些机器学习的成功案例及其面临的机遇与挑战。如果这些挑战能够得到有效解决,机器学习将成为一种可靠的医学工具,能够根据个体和环境的差异,更准确地诊断疾病并制定有效的治疗策略。

机器学习技术利用复杂的算法处理大规模且多样化的数据集,从而发现那些即使是经验丰富的研究人员也难以识别的重要模式。这种技术已经在多个领域得到广泛应用,如游戏、产品推荐和自动驾驶汽车等。在生物医学领域,人类基因组计划、癌症全基因组项目和国际机器学习竞赛等项目均展示了巨大的潜力。通过分析大量与医疗治疗和患者预后相关的数据集,医学可以转变为一种更加数据驱动和以结果为导向的学科,这对疾病的检测和诊断具有深远影响。

目前,收集分子和表型数据变得越来越普遍,包括个性化癌症治疗中的基因组检测、器官的高分辨率二维和三维成像、组织活检的病理学分析以及监测心率的智能手表等。这些数据对于实现未来早期准确诊断、个性化治疗和持续监测以促进健康至关重要。

为了使机器学习在诊断和治疗中发挥革命性作用,研究人员需要开发高质量且精心管理的数据集。高质量的数据集有助于提升机器学习方法的预测能力,减少训练所需的数据量和学习的复杂性。例如,当ImageNet技术被引入时,机器学习在图像识别方面的速度显著提升。同样,在生物医学领域和其他适用机器学习的领域,也需要类似的改进。要创建高质量的数据集用于诊断和治疗,必须解决技术、法律和经济问题,而联邦学习等技术手段可以在不移动实际数据的情况下保护个人隐私。可穿戴设备和家用设备提供了收集准确数据的方法,机器学习可以作为预处理步骤,从电子健康记录和文献等非结构化来源中提取精确的分析和临床数据。此外,必须鼓励生物医学机构和个人参与数据标准化和共享,保险公司、制药公司和资助生物医学研究的机构也将投资基础设施,以获取和管理高质量的数据。

同时,还需要促进用于学习的数据集的多样性和数据共享方法及激励措施,包括国家和国际数据共享标准,这将使主要医疗机构和社区诊所能够获取数据。例如,在主要医疗机构中改善患者治疗反应的机器学习应用可能在社区环境中表现不佳,但通过收集更多样化的患者群体数据,可以开发更准确的机器学习模型,并推广到不同的人群中。研究人员还必须考虑多种因素,如患者在治疗前的状态、治疗方案、年龄、性别、种族、民族和环境暴露等变量。

机器学习在生物医学领域的应用需要严格的评估方法,特别是在需要持续学习的环境中。研究人员认为,机器学习系统的性能最好通过其预测准确性来衡量。为此,研究人员提出了一个迭代的机器学习方法,包括使用回顾性数据进行训练、锁定算法并部署,然后根据部署期间获得的预测评估应用程序的准确性。在部署期间收集的数据,连同附加或更大的回顾性数据集,可用于重新训练和优化算法,随后进入下一个部署评估周期。为了适应健康状况或习惯的变化,评价过程需要持续进行。除了准确性之外,还需要评估置信区间,因为某些机器学习应用比其他应用更能容忍不准确的预测。置信区间可以帮助医生做出决策,因为大多数诊断和治疗测试的模型和数据往往是固定的,因此迭代训练和部署机器学习应用程序可能会带来监管方面的挑战。当模型可以根据新数据进行更新或适应新的诊断和治疗方法时,研究人员需要评估以确保预测的准确性。为了确保对生物医学机器学习应用的有效评估,研究人员需要多形式、可扩展和纵向的真实或模拟数据集。

尽管上述挑战十分艰巨,但研究人员对克服这些困难持乐观态度。此外,他们认为这些努力是值得的,因为成功将带来一个严谨、以结果为导向的医学未来,通过机器学习手段,检测、诊断和治疗策略将能够不断适应个体和环境的差异,从而实现全面的健康管理。

    本文来源:图灵汇
责任编辑: : 柳栋栋
声明:本文系图灵汇原创稿件,版权属图灵汇所有,未经授权不得转载,已经协议授权的媒体下载使用时须注明"稿件来源:图灵汇",违者将依法追究责任。
    分享
变革综述研讨深度解读带来机器生物医学如何
    下一篇