Back to Data Scientist Mind Map
中文·English
📈 Data ScientistID: ds-multiple-testing-fwer-fdr-bh

Multiple Comparisons: FWER vs FDR-BH

多重比较校正:Bonferroni vs FDR
🎯Core Definition
The Multiple Comparisons in Experimentation (FWER vs FDR-BH Corrections) framework formalizes decision protocols when evaluating multi-arm variants (A/B/n testing), multi-metric dashboards, or multidimensional subgroup drilldowns; 2 governing statistical philosophies: 1) Family-Wise Error Rate (FWER): strictly controlling the probability of committing even a single Type-I error across all KK tests (P(V1)αP(V \ge 1) \le \alpha), implemented via conservative Bonferroni (α=α/K\alpha' = \alpha / K) or step-down Holm-Bonferroni (αi=α/(Ki+1)\alpha_i = \alpha / (K - i + 1)), mandatory for mission-critical core revenue decisions; 2) False Discovery Rate (FDR): controlling the expected proportion of false discoveries among all rejected nulls (E[V/R]q\mathbb{E}[V / R] \le q), implemented via the Benjamini-Hochberg (BH) step-up ranking procedure (p(i)iKqp_{(i)} \le \frac{i}{K} q), dramatically boosting statistical power for exploratory multi-metric dashboards.
💡Use Cases
Multi-arm bandit/A/B/n feature launches, automated metric dashboard anomaly detection, and subgroup heterogeneity audits.
Key Problems Solved
Testing 50 guardrail metrics guarantees spurious false discoveries without correction; FWER/FDR corrections eliminate false-alarm noise while preserving discovery power.
🎯5 High-Frequency Exam Points
1
Contrast Bonferroni, Holm-Bonferroni, and Benjamini-Hochberg (BH) across ranking algorithms, statistical conservatism, and Type-II error rates?
2
Write the complete algorithm for Benjamini-Hochberg step-up procedure determining the cutoff index kk^* such that p(k)kKqp_{(k^*)} \le \frac{k^*}{K} q?
3
Map FWER vs FDR to business scenarios: mission-critical GMV safety vs marketing tag discovery vs multi-armed bandits?
4
Explain how post-hoc subgroup cherry-picking triggers both multiple testing bias and Simpson's Paradox?
5
Explain how Benjamini-Yekutieli (BY) generalizes FDR control under arbitrary positive dependence and correlation across metrics?
🔗Foundational Prerequisite Cards (Click to Review)
Updated 2026-08-14
🎯
Test Your Knowledge: Practice Questions for "Multiple Comparisons: FWER vs FDR-BH"
Single choice pitfall questions with instant feedback and mistake tracking.
🚀 Start Card Practice
Previous CardP-hacking, Peeking & mSPRT SequentialNext CardBootstrap Resampling & Empirical CI

🔗 More Data Scientist Knowledge Cards

Hypothesis Testing, Type I/II & PowerSample Size Derivation & MDE BudgetCUPED Variance Reduction DerivationSRM Detection & Chi-Square Diagnostics