Recent progress in predicting RNA modification site-disease associations is summarized, with a focus on common modifications such as m6A, m1A, and m7G, and key challenges in this field are highlighted.
Abstract
Abstract With the development of epitranscriptomics, studies have shown that RNA modification sites are closely related to many diseases. Because experimental validation is time-consuming and labor-intensive, an increasing number of studies have developed computational methods to predict potential associations between RNA modification sites and diseases. In this review, we summarize recent progress in predicting RNA modification site-disease associations, with a focus on common modifications such as m6A, m1A, and m7G. First, we systematically summarize commonly used databases and data sources and outline approaches for constructing similarity information for modification sites and diseases. We then review existing prediction methods—including network-based strategies, matrix completion, and machine learning—and discuss their typical advantages and limitations. Finally, we highlight key challenges in this field, including limited known associations, data imbalance, unclear definitions of negative samples, inconsistent evaluation standards across studies, and limited interpretability and experimental validation. We also suggest future directions, such as expanding high-quality datasets, integrating multi-omics data, establishing unified evaluation pipelines, and strengthening experimental validation. We hope this review provides a clear overview and practical guidance for studies on the associations between modification sites and diseases and supports the development of more reliable prediction methods.
This work provides a foundation for applications that link epigenome variation to gene expression in human cells, by benchmarking methods on a per-gene basis, illustrating their use in a disease context and making trained models available to the community.
Fatemeh Behjati Ardakani, Shamim Ashrafiyan, Laura Rumpf et al.· Genome Biology· 0 citations
A comprehensive and up-to-date overview of AI-driven PTM site prediction across more than ten PTM classes, covering single-PTM site prediction, multiple-PTM site prediction, inter-site crosstalk prediction, and functional prediction of modification sites is provided.
Jia-Yi Ran, Xiaohan Zhang, Yunze Wang et al.· Genomics, Proteomics & Bioin...· 0 citations
Case studies further validated predicted circRNA-drug associations, including cisplatin, enzalutamide, and sorafenib, against published experimental findings, demonstrating HMCDSP's capacity to reveal clinically relevant biomarkers and inform personalized therapeutic strategies.
Yongtian Wang, Wen-Kai Shen, Jiahao Li et al.· Interdisciplinary Sciences C...· 0 citations
DFM-ac4C, a novel computational framework designed for the accurate prediction of ac4C modification sites, significantly outperforms existing models, achieving outstanding predictive metrics, and underscores DFM-ac4C's effectiveness as a robust and efficient tool for RNA ac4C site identification.
Yiming Wang, Fan Mo, Yun Sha et al.· Interdisciplinary Sciences C...· 0 citations
BAMPDA is developed, a matrix refactoring framework with heterogeneous inference designed to enhance the inference of PTM-disease associations and rigorous 5-fold cross-validation demonstrates that BAM PDA significantly outperforms five recent baseline methods.
Xinting Zhang, Jie Ni, Zihao Song et al.· IEEE transactions on computa...· 0 citations
A novel computational framework based on network fusion and matrix completion for miRNA-disease association prediction, which integrates heterogeneous biological information, including miRNA-disease, lncRNA-disease, and miRNA-lncRNA associations, together with disease semantic similarity and miRNA/lncRNA functional similarity is proposed.
A. Toprak· Journal of Computer-Aided Mo...· 0 citations