Related Experiment Video
Updated: May 5, 2026

Performing Data Mining And Integrative Analysis Of Biomarker in Breast Cancer Using Multiple Publicly Accessible Databases
Published on: May 17, 2019
Database integration of 4923 publicly-available samples of breast cancer molecular and clinical data
Catherine R Planey1, Atul J Butte
1Stanford Biomedical Informatics; Stanford, CA.
Abstract:
We outline a paradigm for meta-microarray database creation and integration with clinical variables. We use as our implementation example a breast cancer database linking RNA expression measurements (by microarray) and clinical variables, such as survival metrics and tumor size. Such an endeavor involves integrating across different microarray datasets as well as clinical parameters. To this end, we created a data curation and processing pipeline, formal database ontology, and SQL schema to optimally query, analyze and visualize data from over 30 publicly available breast cancer microarray studies listed in the Gene Expression Omnibus (GEO). We demonstrate several pilot examples using this database. This methodology serves as a model for future meta-analyses of complex public clinical datasets, in particular those in the field of cancer.
More Related Videos
09:08Integration of Bioinformatics Approaches and Experimental Validations to Understand the Role of Notch Signaling in Ovarian Cancer
Published on: January 12, 2020
09:40Author Spotlight: Unveiling the Role of TMOD3 in Platinum Resistance and Immune Infiltration in Ovarian Cancer
Published on: August 2, 2024