Search

Prometheus · By sickn33

5 skills found.
Search results
#SkillRepositoryStarsUsed inTokensAuto-checkLicenceUpdated
1

Set up and manage NVIDIA GPU servers for AI workloads. An agent skill from sickn33/agentic-awesome-skills.

sickn33/agentic-awesome-skills47k2 repos~2kAutomated safety check: NotesMIT2 days ago
2

Build AI-focused SRE incident response practices for LLM outages, degraded quality, runaway cost events, and safety regressions.

sickn33/agentic-awesome-skills47k2 repos~3kAutomated safety check: PassMIT2 days ago
3

Set up alerting rules, configure on-call rotations, and manage incident response workflows.

sickn33/agentic-awesome-skills47k1 repo~2.8kAutomated safety check: PassMIT2 days ago
4

Auto-scale LLM inference clusters on Kubernetes using KEDA, custom GPU metrics, and horizontal pod autoscaling.

sickn33/agentic-awesome-skills47k1 repo~2.1kAutomated safety check: PassMIT2 days ago
5

Set up metrics collection and visualization with Prometheus and Grafana.

sickn33/agentic-awesome-skills47k1 repo~2.7kAutomated safety check: PassMIT2 days ago