observability-engineer
sickn33/agentic-awesome-skills
This skill enables building production-ready monitoring, logging, and tracing systems for enterprise applications. It covers implementing observability strategies, managing SLIs and SLOs, and handling incident response workflows. Expertise includes distributed tracing, log management, alerting, and reliability engineering practices using tools like Prometheus, Grafana, and OpenTelemetry to ensure system stability and performance.