- Provides visibility into LLM inputs, outputs, latency, and cost in production
- Helps detect quality issues like hallucination or degraded responses
- Surfaces cost and usage trends to keep AI spend under control
- Supplies the traces and data needed to debug and improve prompts