arXiv发布SMILESGNN:基于跨注意力融合的临床毒性预测模型
文 / Mr.Xu
发布时间:
摘要:arXiv近日发布了一种名为SMILESGNN的新型多模态架构,用于药物毒性预测。该模型融合了SMILES Transformer编码器和GATv2图编码器,通过跨注意力机制实现高效特征融合,并支持基于GNNExplainer的子结构分析。其在ClinTox数据集上的表现优异,AUC-ROC达到0.987,F1分数为0.906,参数仅400万,展现出与更大规模模型相媲美的竞争力。此外,SMILESGNN-PT版本在Tox21数据集上的表现也验证了其跨任务的适用性。该研究为药物发现中的毒性预测提供了更高效、更具解释性的解决方案。
核心突破
- 多模态融合架构:SMILESGNN结合了SMILES Transformer和GATv2图神经网络,通过跨注意力机制实现分子结构的多层次特征融合。
- 高效性与可解释性:模型参数仅400万,在ClinTox数据集上表现优异(AUC-ROC 0.987,F1 0.906),同时支持基于GNNExplainer的子结构分析,提升了预测结果的可解释性。
- 跨任务适用性:SMILESGNN-PT版本在Tox21数据集上的表现验证了其跨任务的适用性,展示了其在不同毒性预测任务中的潜力。
技术亮点
- 跨注意力融合机制:通过融合SMILES序列和图结构信息,模型能够更全面地捕捉分子特征。
- 轻量化设计:在保证高性能的同时,模型参数规模较小,适合资源受限的应用场景。
- 可解释性支持:保留显式的图分支,支持基于GNNExplainer的子结构分析,为临床应用提供更可靠的解释。
行业影响
药物毒性预测是药物发现中的关键环节,SMILESGNN的发布为该领域提供了新的思路和方法。其高效性和可解释性使其在临床前研究中具有广泛的应用前景,能够帮助研究人员更准确地评估药物安全性,加速新药研发进程。
开发者建议
- 应用场景拓展:开发者可以将SMILESGNN应用于其他需要多模态数据融合和可解释性支持的领域,如材料科学和化学工程。
- 模型优化:进一步优化模型架构,探索更高效的跨注意力机制,以提升模型在不同任务中的表现。
- 数据增强:结合更多高质量的毒理学数据,提升模型的泛化能力和预测精度。
—— 完 ——消息来源:ArXiv Machine Learning (cs.LG) (2026-09-25)
主题标签: #多模态模型 #药物毒性预测 #跨注意力机制 #GNNExplainer #轻量化模型
社区整体评论区