Back
G
LLM Eval & Observability

Galileo AI

An enterprise-grade AI observability and evaluation platform for LLM applications, enabling developers to run offline evaluations, auto-tune metrics, and deploy optimized low-latency guardrails using compact Luna models.

Visit site Open source via landscape-sweepLast verified · 2026-07-17

AFIT Review

Accuracy
4.0
Privacy
4.0
Value
2.0
Multilingual
n/a
Ease of use
n/a
Scalability
5.0

Lab Verdict

Suitable for enterprise development teams building and scaling complex LLM applications, RAG systems, and autonomous agents that require real-time observability, hallucination detection, and safety guardrails. The catch is that it is a commercial platform (SaaS/VPC/On-Premise) without a fully open-source tier, though it reduces LLM-as-judge costs by distilling evaluations into smaller Luna models.

llm-judge · website review · 2026-07-17

Pricing

No pricing captured.

Capabilities

observabilityevaluationllmopsguardrailsrag-evaluationagent-observability