PulseExploreJournal ClubDebatesTrendingResearchersJournals
Instagram
HomeExploreJournal ClubTrending
Synapse
⌘+K
Synapse
April 5, 2026Cancer Research0 citations

Abstract 1116: A scalable multimodal framework for unbiased risk biomarker discovery across multiple cancer types

View Full Paper
CPConstantin Cezar PetrescuLSLisa SchmunkJMJack Monahan

Key Result

A multimodal framework integrating genetics, proteomics, and clinical data was deployed on 502,505 UK Biobank participants with >46,000 incident cancers across 22 types for biomarker discovery.

Key Points

  • To create a scalable framework for discovering unbiased cancer risk biomarkers using various health data streams.
  • Developed a multi-modal biomarker discovery engine capable of integrating genetics, proteomics, and clinical data.
  • Utilized machine learning models including gradient boosting and neural networks.
  • Applied the framework on the UK Biobank with over 502,000 participants.
  • Demonstrated improved performance of multimodal ensembles compared to single modalities.
  • Identified cancer-specific patterns of modality contribution.
  • Showed effectiveness of time-window filtering in enhancing predictive signal separation.

Study Design

Type

Observational (n=502,505)

Multicenter

Yes

Structured PICO

Does a multimodal biomarker discovery engine improve cancer risk prediction compared to individual modalities in a large population cohort?

P
Population
UK Biobank participants (n = 502,505; >46,000 incident cancers across 22 cancer types)
I
Intervention
Multi-modal biomarker discovery engine integrating germline genetics, plasma proteomics, and deep clinical phenotyping using machine-learning models
C
Comparator
Individual modalities
O
Outcome
Cancer risk modelling performance (comparative performance of individual modalities versus multimodal ensembles)

A scalable multimodal machine-learning framework integrating genetics, proteomics, and clinical data has been developed for unbiased cancer risk biomarker discovery.

Abstract

Abstract Background: Most existing cancer risk models are built on single modalities and hand-selected features. Systematic, unbiased integration of germline genetics, plasma proteomics, and deep clinical phenotyping holds promise for revealing novel risk biomarkers across diverse cancer types. Methods: We developed a multi-modal biomarker discovery engine that can be used for discovering risk, diagnostic, prognostic, predictive and monitoring biomarkers. Currently the framework handles: • Germline genetics and polygenic risk scores • High-dimensional plasma proteomics (Olink) • Longitudinal primary-care records, hospital episodes, laboratory results, lifestyle questionnaires, and cancer registry linkages Key design features include modular cohort handling, automated data preprocessing, and machine-learning models (including: gradient boosting and neural networks). Application: The platform is currently deployed on the UK Biobank (n = 502,505 participants; 46,000 incident cancers across 22 cancer types) with active model training and biomarker discovery in progress. The architecture is cohort-agnostic and ready for direct application to emerging large-scale resources including Our Future Health and the All of Us Research Program. Poster presentation: We will demonstrate the platform’s configurability through examples of cancer-risk modelling in the UK Biobank, showcasing: (i) comparative performance of individual modalities versus multimodal ensembles, (ii) cancer-specific patterns of modality contribution, and (iii) the effect of time-window filtering on separating true predictive signals from prevalent disease effects. Conclusions: By eliminating bias in feature engineering and supporting seamless integration of diverse health data streams, this scalable framework provides a robust foundation for data-driven discovery of multimodal cancer risk biomarkers, paving the way for next-generation precision prevention strategies. Citation Format: Constantin Petrescu, Lisa Schmunk, Jack Monahan, Abbas Salami, Thomas M. Stubbs. A scalable multimodal framework for unbiased risk biomarker discovery across multiple cancer types abstract. In: Proceedings of the American Association for Cancer Research Annual Meeting 2026; Part 1 (Regular Abstracts); 2026 Apr 17-22; San Diego, CA. Philadelphia (PA): AACR; Cancer Res 2026;86(7 Suppl):Abstract nr 1116.

Ask AI
Helpful
Bookmark
Share
View Full Paper

Cite This Study

Petrescu et al. (2026) conducted an observational in Cancer (n=502,505). Multimodal biomarker discovery framework vs. Individual modalities was evaluated on Comparative performance of individual modalities versus multimodal ensembles. A multimodal framework integrating genetics, proteomics, and clinical data was deployed on 502,505 UK Biobank participants with >46,000 incident cancers across 22 types for biomarker discovery.

synapsesocial.com/papers/69d1fd13a79560c99a0a2eb0https://doi.org/10.1158/1538-7445.am2026-1116
Ask AI
Helpful
Bookmark
Share
View Full Paper

Also Consider

Synapse has enriched 5 closely related papers on similar clinical questions. Consider them for comparative context:

  1. 1Abstract 1251: Real-world evaluation of multimodal AI: Foundation model-driven multimodal AI for GBM, NSCLC, and PDAC.2026
  2. 2Abstract 3586: Validation and population projection of multi-cancer risk incorporating polygenic risk scores and non-genetic factors.2026
  3. 3Abstract 33: A healthcare system scale multimodal whole patient temporal foundation model.2026
  4. 4Abstract 1482: A deep learning-based multimodal integration framework for clinical outcome prediction2026
  5. 5Abstract 890: Multimodal modeling of digitized histopathology slides improves risk stratification in hormone receptor-positive breast cancer patients2024 · 1 citations