"Deberia usar Prometheus o Grafana?" es una de las preguntas mas comunes, y revela un malentendido. No son alternativas. Hacen trabajos diferentes.
Que hace cada uno
| Prometheus | Grafana | |
|---|---|---|
| Funcion | Recoleccion + almacenamiento de metricas | Visualizacion + dashboards |
| Storage | TSDB integrado | No almacena, consulta fuentes externas |
| Query | PromQL | Depende de la fuente |
| Alertas | Alertmanager (basico) | Grafana Alerting (multi-fuente) |
Cuando usar el stack Prometheus + Grafana
Kubernetes, cero costos de vendor, metricas custom, equipo que sabe PromQL.
Cuando NO usar este stack
Si no queres manejar infraestructura, si necesitas logs + traces + metricas en un solo tool, o si corres Next.js en Vercel.
Para Next.js en Vercel
Registrá OpenTelemetry en el hook instrumentation.ts de Next.js para tener latencia P50/P95/P99 y error rate por ruta, mandá los datos a un backend gestionado (Grafana Cloud acepta OpenTelemetry, igual que la mayoria de los APM) y sumá un check de uptime externo para las alertas. Sin servidor de Prometheus que mantener.
