Stratified Sampling for Classification
Easy
machine-learning
Microsoft
Uber
LinkedIn
Your dataset has 5% positive examples. After a random train/test split, the test set contains only 2% positive examples. How can you prevent this distributional shift?
Multiple Choice
Correct!
Incorrect — try again next time!