Related Experiment Videos
Generalisability: a key to unlock professional assessment.
Jim Crossley1, Helena Davies, Gerry Humphris
1Department of Paediatric Medicine, Sheffield Children's Hospital, Sheffield, UK.
Medical Education
|October 23, 2002
Summary
Generalisability theory offers a robust method for assessing measurement reliability, overcoming limitations of classical approaches. It quantizes factors influencing results, providing a true reflection of reliability for single or multiple observations.
Area of Science:
- Psychometrics
- Educational Measurement
- Professional Assessment
Background:
- Reliability is crucial for accurate measurement, indicating consistency across potential measurements.
- Assessing complex professional roles is challenging due to intangible aspects and performance variability.
- Traditional reliability methods have limitations in capturing these complexities.
Purpose of the Study:
- To critically evaluate the classical approach to reliability assessment.
- To introduce Generalisability Theory as a superior alternative.
- To demonstrate how Generalisability Theory addresses the limitations of classical methods.
Main Methods:
- The study reviews classical reliability evaluation techniques.
- It introduces Generalisability Theory (G-theory) and its application.
- Variance component analysis is used within G-theory to dissect sources of error.
Main Results:
- Generalisability theory quantifies contributions from various factors (observer, situation, case, etc.) to measurement variance.
- It enables calculation of reliability for single observations against a universe of generalizations.
- Reliability for combined observations and required sample sizes for desired reliability can be estimated.
Conclusions:
- Generalisability theory provides a more comprehensive and accurate measure of reliability than classical methods.
- It allows for nuanced understanding of measurement error in complex professional settings.
- This approach facilitates optimized test design for achieving specific reliability targets.