Choose Your Approach
There are three ways to evaluate your LLM outputs with LangWatch:Built-in Evaluators
Use LangWatch’s library of evaluators directly in your code.
Saved Evaluators
Create reusable evaluator configs on the platform.
Custom Scoring
Send scores from your own evaluation logic.
Which should I use?
Decision flowchart
Decision flowchart
What is an Evaluator?
An evaluator takes inputs (like the user question, LLM response, and optionally context or expected output) and returns a score indicating quality along some dimension.Built-in Evaluator Categories
LangWatch provides a library of ready-to-use evaluators:
Browse all evaluators →
Quick Examples
Using a Built-in Evaluator
Using a Saved Evaluator
Sending Custom Scores
Using Evaluators
In Experiments
Run evaluators on each row of your test dataset for batch evaluation:In Online Evaluation (Monitors)
Run evaluators automatically on production traces:- Create a monitor in LangWatch
- Select evaluators to run
- Configure when to trigger (all traces, sampled, filtered)
- Scores appear on traces and dashboards
As Guardrails
Use evaluators to block harmful content in real-time:Evaluator Inputs
Different evaluators require different inputs:
Check each evaluator’s documentation for required and optional inputs.