Prof by Lex AI Labs — home
Profby Lex AI
CurriculumPracticeFor OrganizationsPricing
Sign In
Start Your AI JourneyFree to start · No credit card required
← Practice

Fine Tuning

8 problems

  • DPO lossMedium
  • Generalised Advantage Estimation (GAE)Medium
  • GRPO objectiveHard
  • Knowledge-Distillation LossMedium
  • LoRA forward passEasy
  • ORPO Loss (Odds-Ratio Preference Optimisation)Medium
  • PPO clipped objectiveMedium
  • Reward-Model Margin LossMedium