Related Experiment Video
Updated: Apr 15, 2026

Performing Data Mining And Integrative Analysis Of Biomarker in Breast Cancer Using Multiple Publicly Accessible Databases
Published on: May 17, 2019
Big data in medical science--a biostatistical view
Harald Binder1, Maria Blettner
1Institute of Medical Biostatistics, Epidemiology and Informatics (IMBEI) at the University Medical Center of the Johannes Gutenberg University Mainz.
Big data analysis in medical science requires specialized techniques to interpret large datasets. Machine learning and careful weighting of patient characteristics are crucial for extracting meaningful insights and understanding potential causal effects.
Area of Science:
- Medical research
- Data science
- Biostatistics
Background:
- Advancements in data acquisition and storage generate vast medical datasets (terabytes).
- Traditional analysis methods are insufficient for handling these large-scale "big data" sets.
- The utility and significance of big data in medical science remain under active investigation.
Purpose of the Study:
- To illustrate the application of big data analytical techniques in medical research.
- To review the literature on big data analysis in medicine.
- To highlight critical considerations for accurate analysis of large datasets.
Main Methods:
- Illustrative examples of big data analytical techniques.
- Selective literature review.
- Discussion of critical aspects to avoid errors in big data analysis.
Main Results:
- Machine learning facilitates pattern recognition in big data.
- Differential weighting of patient characteristics (e.g., age, sex) is essential before similarity detection.
- Conventional data analysis experience can inform causal inference from big data.
Conclusions:
- Big data techniques, including clustering, can analyze population-level observational data and identify patient subgroups.
- Big data analysis offers complementary insights to traditional clinical trials.
- Emerging statistical methods for causal analysis in big data will benefit medical science with necessary adaptations.
More Related Videos
09:43Databases to Efficiently Manage Medium Sized, Low Velocity, Multidimensional Data in Tissue Engineering
Published on: November 22, 2019
08:51Author Spotlight: Integrated Multi-Omics Analysis for Unveiling Multicellular Immune Signatures in Clinical Heart Attack Cohorts
Published on: September 20, 2024
Related Concept Videos
Biostatistics: Overview
Discrete variables are...
Overview of Biostatistics in Health Sciences
Data: Types and Distribution
Distributions in...
Statistical Software for Data Analysis and Clinical Trials
Statistical Methods for Analyzing Epidemiological Data
Statistical Inference Techniques in Hypothesis Testing: Parametric Versus Nonparametric Data
Parametric statistics, as the name suggests, assumes that data follow a specific distribution, often a normal distribution. This assumption enables robust hypothesis testing and estimation. Parametric methods, like the Student's t-test or Goodness-of-fit test, are frequently employed in biostatistics due to their robustness. For instance,...