AI Evals
Run red-team programs and prompt safety benchmarks, calibrate safety judges, monitor fairness in production, and ship audit-ready governance artifacts.
Run red-team programs and prompt safety benchmarks, calibrate safety judges, monitor fairness in production, and ship audit-ready governance artifacts. A advanced-level course for responsible ai practitioners, about 10 hours.