Microsoft
Azure AI, Copilot, Bing. Production LLM systems, RAG, and enterprise AI.
58 problems tagged for Microsoft.
Sign in to track your progress0%
Solve a problem (pass its tests) and it's checked off here automatically — your progress is saved, so it stays checked when you come back.
- The RAG run: search → ground → answerMedium
- Full self-attention from XMedium
- Which transformer family?Easy
- Bayesian A/B Test (Beta-Binomial)Medium
- Bootstrap Confidence Interval (Percentile)Medium
- Brier Score + Reliability DecompositionMedium
- Conv2D forward (naive, stride 1, no pad)Medium
- Conv2D forward (padding + stride)Medium
- Scaled dot-product self-attentionMedium
- Causal mask: build + applyEasy
- LayerNorm forwardEasy
- Chi-Square Test of IndependenceMedium
- Clipped Inverse Propensity WeightingMedium
- CUPED Variance ReductionMedium
- Delta Method for Ratio Metric VarianceHard
- Difference-in-DifferencesMedium
- Overfitting — read the learning curvesEasy
- Expected Calibration Error (ECE)Medium
- Expected Reciprocal Rank (ERR)Medium
- F1 score (binary classification)Easy
- Generate random subsets (bootstrap)Easy
- Pre-LN vs post-LN blockMedium
- Gradient Boosting: One Round (Stump)Medium
- Hash Bucket A/B AssignmentEasy
- Histogram Split Finding (GBM)Hard
- Holt-Winters Exponential SmoothingMedium
- Team-Draft Interleaving (Online Ranking Eval)Medium
- Isotonic Regression (PAVA)Hard
- Jensen-Shannon Divergence (Drift)Medium
- K-means: one iterationMedium
- Knowledge-Distillation LossMedium
- Kolmogorov-Smirnov StatisticMedium
- LambdaMART Lambda GradientsHard
- ListNet Listwise Ranking LossMedium
- Logistic regression — gradient descentMedium
- Logistic regression — binary cross-entropy lossEasy
- Logistic regression — probability from a scoreEasy
- Longest Common SubsequenceMedium
- Mann-Whitney U TestMedium
- Mean Average Precision (MAP)Medium
- Multiple-Testing Correction (Bonferroni / BH-FDR)Medium
- pass@k Unbiased EstimatorMedium
- Platt ScalingMedium
- Population Stability Index (PSI)Medium
- PPO clipped objectiveMedium
- Recursive Chunking with OverlapMedium
- ROC-AUC from scratchMedium
- Sample Ratio Mismatch (SRM) CheckMedium
- Sample Size for Statistical PowerMedium
- Self-Consistency Majority VoteEasy
- Sequential Test (mSPRT-Style Always-Valid p-Value)Hard
- Shadow / Canary Rollback DecisionMedium
- Softmax from scratchEasy
- Thompson Sampling (Bernoulli-Beta)Medium
- Two-Sample Test + p-valueMedium
- UCB1 multi-armed banditEasy
- Wilson Confidence Interval (Proportion)Easy
- WordPiece Tokenization (Greedy Longest-Match)Medium