浙大团队将化学知识引入机器学习,提出可外推、可解释的分子图模型预测反应性能

简介: 浙大团队将化学知识引入机器学习,提出可外推、可解释的分子图模型预测反应性能



编辑 | 绿萝

化学反应的预测建模在药物发现和材料科学等各个行业中起着至关重要的作用。然而,由于化学转化的复杂性和多样性,实现具有所需外推能力和化学可解释性的合成转化预测模型具有挑战性。

为了弥补丰富的化学领域知识与先进的分子图模型之间的差距,来自浙江大学洪鑫课题组提出了一种嵌入数字化空间和电子信息的基于知识的分子图模型:SEMG-MIGNN。此外,还开发了分子相互作用模块,以了解反应组分的协同影响。

该研究证明了这种基于知识的图模型可以很好地预测反应产率和空间选择性,其外推能力得到了实验证实。由于局部环境的嵌入,该模型可以在原子水平上解释空间和电子对整体合成性能的影响,这为分子工程实现目标合成功能提供了有用的指导。该模型为反应性能预测提供了一种外推和可解释的方法,指出了化学知识约束反应建模对于合成目的的重要性。

该研究以「Reaction performance prediction with an extrapolative and interpretable graph model based on chemical knowledge」为题,于 2023 年 6 月 15 日发布在《Nature Communications》上。

SPR 预测

对化学的理解和对反应性和选择性的准确预测,为合理、高效地探索大规模合成空间提供了基础。结构-性能关系(Structure–performance Relationship,SPR)的建立主要集中在反应机理的研究和决定性过渡态模型的阐明。

利用过渡态模型,化学家可以阐明观察到的反应性/选择性趋势的来源,并根据化学理论和经验进行合成判断。但在没有明确的机制基础和解析方程的情况下处理高维 SPR 是一个挑战。

数据驱动的方法最近已成为 SPR 建立的强大策略。通过利用合成数据中的相互关系,现代机器学习(ML)算法可以为合成预测创建强大的模型。然而,人工合成转化的机器学习预测和设计还远未成熟。主要瓶颈之一是适合 SPR 预测的分子编码方法和 ML 框架的可用性。

除了人类指定的分子编码工程之外,化学预测领域对表征学习的兴趣也越来越大。通过表征学习的创新和应用,数据驱动的分子性质和反应性能预测取得了重大进展。

特别是在 SPR 预测方面,MIT 的 Coley 及其同事将经典的图神经网络(GNN)模型与选定的反应位点量子化学描述符相结合,开发了一种名为 QM-GNN 的融合模型。这种融合模型将特定于位点的电子信息嵌入到 ML 建模中,从而提高了对一系列转换的区域选择性和反应性的预测能力。QM-GNN 模型的成功表明,增强局部化学信息的表达可以为约束合成建模提供有价值的支持。

受 QM-GNN 模型的启发,研究人员推测可以通过丰富化学环境的局部编码和加强反应组分之间的信息相互作用来进一步改进 SPR 预测。

图 1:合成性能和分子特性的机器学习预测。(来源:论文)

基于化学知识的 ML 模型用于预测合成性能

在此,研究人员开发了一种名为「基于分子相互作用图神经网络的空间和电子嵌入分子图」(Sterics-and Electronics-embedded Molecular Graph with Molecular Interaction Graph Neural Network,SEMG-MIGNN)的基于化学知识的 ML 模型,用于预测合成性能。SEMG-MIGNN 有两个主要创新设计:首先,空间和电子效应的局部化学环境被数字化并嵌入到图表示中。这显著丰富了模型对原子环境的表征,并提高了模型对新分子结构的外推能力。此外,分子相互作用模块可以有效地学习多个反应组分的协同控制,从而使分子建模有效地扩展到 SPR 建模领域。

具体而言,该研究引入了一种称为空间和电子嵌入分子图(SEMG)的分子图模型,该模型结合了外部化学知识,以提高模型对局部化学环境的区分能力。该知识增强分子图的设计的关键是在节点中嵌入空间和电子环境的原子信息。图 2 以 1-氯-4-(三氟甲基)苯为例,展示了设计的分子图模型的生成工作流程。

图 2:SEMG 的生成工作流程。(来源:论文)

基于 SEMG 丰富的化学信息,接下来,研究人员修改了 GNN 的框架,使其适用于 SPR 预测。特别是,开发了分子相互作用模块以增强模型训练过程中反应组分之间的信息交换。与超图不同,研究人员设计的分子相互作用 GNN(MIGNN)依赖于矩阵运算来实现信息交换。

图 3:分子相互作用图神经网络(MIGNN)的框架和相互作用模块的设计。(来源:论文)

MIGNN 的交互模块为 ML 模型提供了捕捉反应组分协同效应的机会,这对传统的 SPR 预测 ML 框架具有挑战性。在 MIGNN 中,相互作用矩阵允许具有物理意义的反应组分的所有可能组合充分交换它们的编码信息,从而支持模型在反应组分交织的高维合成空间中的预测。

模型性能预测

该模型在一系列具有挑战性的任务中获得了出色的产率和空间选择性预测。

在 Pd 催化的 C-N 交叉偶联反应的产率预测和手性磷酸(CPA)催化的硫醇加成 N-酰基亚胺的对映选择性预测中发现了很好的预测。对额外的 CPA 催化剂的进一步实验测试证实了该模型在新催化剂预测中的外推能力。特别是,研究发现 SEMG-MIGNN 模型在基于支架的拆分任务中表现出卓越的外推能力,考虑到需要扩展可用 SPR 数据的领域,这对于合成预测来说是非常可取的。

图 4:SEMG-MIGNN 模型(空间和电子嵌入分子图与分子相互作用图神经网络)预测反应产率。(来源:论文)

图 5:SEMG-MIGNN 模型预测对映体选择性。(来源:论文)

除了出色的预测能力外,空间和电子效应的物理意义编码还提供了原子级的化学解释。对训练模型的分析表明,电子效应对 C-N 交叉偶联的产率预测起着至关重要的作用,而对映体选择性预测则严重依赖于空间效应。

此外,该模型能够识别分子结构的热点,用于确定合成性能,为未来的设计提供有用的见解。该模型的有效性表明,将表示学习与数字化化学知识相结合可以支持化学空间中可泛化模型的开发,为数据驱动的合成转换设计提供机会。

论文链接:https://www.nature.com/articles/s41467-023-39283-x

相关文章
|
7月前
|
人工智能 自然语言处理 IDE
模型微调不再被代码难住!PAI和Qwen3-Coder加速AI开发新体验
通义千问 AI 编程大模型 Qwen3-Coder 正式开源,阿里云人工智能平台 PAI 支持云上一键部署 Qwen3-Coder 模型,并可在交互式建模环境中使用 Qwen3-Coder 模型。
1186 109
|
8月前
|
人工智能 自然语言处理 运维
【新模型速递】PAI-Model Gallery云上一键部署Kimi K2模型
月之暗面发布开源模型Kimi K2,采用MoE架构,参数达1T,激活参数32B,具备强代码能力及Agent任务处理优势。在编程、工具调用、数学推理测试中表现优异。阿里云PAI-Model Gallery已支持云端部署,提供企业级方案。
495 0
【新模型速递】PAI-Model Gallery云上一键部署Kimi K2模型
|
9月前
|
机器学习/深度学习 算法 安全
差分隐私机器学习:通过添加噪声让模型更安全,也更智能
本文探讨在敏感数据上应用差分隐私(DP)进行机器学习的挑战与实践。通过模拟DP-SGD算法,在模型训练中注入噪声以保护个人隐私。实验表明,该方法在保持71%准确率和0.79 AUC的同时,具备良好泛化能力,但也带来少数类预测精度下降的问题。研究强调差分隐私应作为模型设计的核心考量,而非事后补救,并提出在参数调优、扰动策略选择和隐私预算管理等方面的优化路径。
595 3
差分隐私机器学习:通过添加噪声让模型更安全,也更智能
|
8月前
|
人工智能 自然语言处理 运维
【新模型速递】PAI-Model Gallery云上一键部署gpt-oss系列模型
阿里云 PAI-Model Gallery 已同步接入 gpt-oss 系列模型,提供企业级部署方案。
|
9月前
|
机器学习/深度学习 人工智能 算法
Post-Training on PAI (4):模型微调SFT、DPO、GRPO
阿里云人工智能平台 PAI 提供了完整的模型微调产品能力,支持 监督微调(SFT)、偏好对齐(DPO)、强化学习微调(GRPO) 等业界常用模型微调训练方式。根据客户需求及代码能力层级,分别提供了 PAI-Model Gallery 一键微调、PAI-DSW Notebook 编程微调、PAI-DLC 容器化任务微调的全套产品功能。
|
10月前
|
存储 人工智能 运维
企业级MLOps落地:基于PAI-Studio构建自动化模型迭代流水线
本文深入解析MLOps落地的核心挑战与解决方案,涵盖技术断层分析、PAI-Studio平台选型、自动化流水线设计及实战构建,全面提升模型迭代效率与稳定性。
448 6
|
9月前
|
机器学习/深度学习 分布式计算 Java
Java 大视界 -- Java 大数据机器学习模型在遥感图像土地利用分类中的优化与应用(199)
本文探讨了Java大数据与机器学习模型在遥感图像土地利用分类中的优化与应用。面对传统方法效率低、精度差的问题,结合Hadoop、Spark与深度学习框架,实现了高效、精准的分类。通过实际案例展示了Java在数据处理、模型融合与参数调优中的强大能力,推动遥感图像分类迈向新高度。
|
9月前
|
机器学习/深度学习 存储 Java
Java 大视界 -- Java 大数据机器学习模型在游戏用户行为分析与游戏平衡优化中的应用(190)
本文探讨了Java大数据与机器学习模型在游戏用户行为分析及游戏平衡优化中的应用。通过数据采集、预处理与聚类分析,开发者可深入洞察玩家行为特征,构建个性化运营策略。同时,利用回归模型优化游戏数值与付费机制,提升游戏公平性与用户体验。
|
9月前
|
机器学习/深度学习 算法 Java
Java 大视界 -- Java 大数据机器学习模型在舆情分析中的情感倾向判断与话题追踪(185)
本篇文章深入探讨了Java大数据与机器学习在舆情分析中的应用,重点介绍了情感倾向判断与话题追踪的技术实现。通过实际案例,展示了如何利用Java生态工具如Hadoop、Hive、Weka和Deeplearning4j进行舆情数据处理、情感分类与趋势预测,揭示了其在企业品牌管理与政府决策中的重要价值。文章还展望了多模态融合、实时性提升及个性化服务等未来发展方向。