Stratified Sampling for Classification

Easy
machine-learning Microsoft Uber LinkedIn

Your dataset has 5% positive examples. After a random train/test split, the test set contains only 2% positive examples. How can you prevent this distributional shift?

Multiple Choice

Correct!
Incorrect — try again next time!