Interactive AI Agent & LLM Evaluation Labs
Explore seven hands-on experiments covering confidence intervals, precision and recall, cost tradeoffs, agent traces, context, retrieval, and retries.
Labs use clearly labeled synthetic data. JavaScript is required to adjust inputs and run experiments.