Reliability

Entdecke Reliability Agent Skills in Sicherheit und vergleiche verwandte Workflows, Tools und Einsatzfaelle.

15 Skills
C
uptimerobot-automation

von ComposioHQ

uptimerobot-automation unterstützt AI Agents dabei, UptimeRobot-Monitoring-Workflows über Composio Rube MCP auszuführen. Nutzen Sie den Skill, um ihn zu installieren, Rube MCP zu verbinden, die UptimeRobot-Verbindung zu prüfen, aktuelle Tool-Schemas mit RUBE_SEARCH_TOOLS zu finden und Monitor-Aufgaben sicher auszuführen.

Monitoring
Favoriten 0GitHub 67.5k
C
updown-io-automation

von ComposioHQ

updown-io-automation hilft Agents, Updown.io-Monitoring-Aufgaben über Composio Rube MCP auszuführen. Der Guide erklärt Einrichtungsvoraussetzungen, RUBE_SEARCH_TOOLS-Discovery, Verbindungsprüfungen und sichere Nutzungsmuster.

Monitoring
Favoriten 0GitHub 67.5k
W
error-handling-patterns

von wshobson

error-handling-patterns unterstützt Teams dabei, zwischen Exceptions und Result-Typen zu wählen, Fehler sauber zu klassifizieren, Kontext weiterzugeben und Graceful Degradation für zuverlässigere APIs und Services zu gestalten.

Reliability
Favoriten 1GitHub 32.6k
W
python-resilience

von wshobson

python-resilience ist ein Guidance-Skill für eine robustere Fehlerbehandlung in Python mit Retries, exponentiellem Backoff, Jitter, Timeouts und begrenzten Retry-Fenstern. Nutze ihn, um praxistaugliche Resilience-Patterns für externe Aufrufe einzusetzen und tenacity-ähnliche Wrapper mit klareren Retry-Regeln umzusetzen.

Reliability
Favoriten 0GitHub 32.6k
W
slo-implementation

von wshobson

Mit dem Skill slo-implementation definieren Teams SLIs, SLOs, Error Budgets und Burn-Rate-Alerts für Reliability-Arbeit. Er hilft dabei, Service-Ziele in messbare Vorgaben zu übersetzen, mit PromQL-nahen Beispielen und praxisorientierter Anleitung aus SKILL.md.

Reliability
Favoriten 0GitHub 32.6k
W
istio-traffic-management

von wshobson

istio-traffic-management unterstützt Teams dabei, Istio-Traffic-Policies wie VirtualService, DestinationRule, Gateway und ServiceEntry für Canary-Releases, Retries, Circuit Breaking und Mirroring auszuarbeiten. Nutzen Sie die Skill, um Deployment-Absichten in klare Routing- und Resilience-Manifeste mit praxisnahen Prompts und Review-Prüfpunkten zu übersetzen.

Deployment
Favoriten 0GitHub 32.6k
W
linkerd-patterns

von wshobson

linkerd-patterns unterstützt Teams dabei, Linkerd-Muster für Kubernetes-Workloads anzuwenden, darunter mTLS, Sidecar Injection, Traffic Splits, Retries, Timeouts, Service Profiles und die Multi-Cluster-Planung für Deployment-basierte Rollouts.

Deployment
Favoriten 0GitHub 32.6k
W
on-call-handoff-patterns

von wshobson

Lernen Sie die Skill on-call-handoff-patterns für zuverlässige Schichtübergaben kennen. Nutzen Sie sie, um Incident-Übergaben zu strukturieren sowie aktive Probleme, aktuelle Änderungen, den Eskalationsstatus und nächste Schritte für Reliability-Teams festzuhalten.

Reliability
Favoriten 0GitHub 32.5k
W
incident-runbook-templates

von wshobson

incident-runbook-templates unterstützt Teams dabei, strukturierte Incident-Response-Runbooks mit klaren Schritten für Triage, Eindämmung, Eskalation, Kommunikation und Wiederherstellung bei Ausfällen und operativen Playbooks zu erstellen.

Playbooks
Favoriten 0GitHub 32.5k
A
runbook-generator

von alirezarezvani

runbook-generator erstellt Entwürfe für Betriebs-Runbooks zu Services über eine Python CLI und Vorlagen für Deployment, Health Checks, Rollback, Incident Response, Wartung und Validierung. Nützlich für SRE-, DevOps- und Technical-Writing-Teams, die On-Call-Abläufe standardisieren möchten.

Technical Writing
Favoriten 0GitHub 22.2k
A
observability-designer

von alirezarezvani

observability-designer unterstützt SRE- und Plattformteams dabei, Observability für APIs und Services zu entwerfen – mit Dashboard-Generierung, Analyse von Alert-Rauschen und schlanken SLI/SLO-Gerüsten auf Basis der enthaltenen Python-Skripte, Beispiele und Referenzen.

Observability
Favoriten 0GitHub 22.2k
A
feature-flags-architect

von alirezarezvani

feature-flags-architect hilft Teams dabei, Feature Flags für Progressive Delivery zu planen, zu prüfen und aufzuräumen. Geeignet für Rollout-Pläne, Kill-Switch-Checks, Scans nach veralteten Flags, Provider-Vergleiche und Lifecycle-Guidance für LaunchDarkly, GrowthBook, Statsig, Unleash, Flipt oder eigene DIY-Systeme.

Deployment
Favoriten 0GitHub 22.2k
A
feature-flags-architect

von alirezarezvani

feature-flags-architect ist ein Software-Architecture-Skill zum Entwerfen, Ausrollen, Auditieren und Stilllegen von Feature Flags. Er enthält stdlib Python-Skripte für Flag-Debt-Scanning, Rollout-Planung und Kill-Switch-Audits sowie Referenzen zu Flag-Taxonomie, Lifecycle, Rollout-Strategien und Provider-Abwägungen.

Software Architecture
Favoriten 0GitHub 22.1k
A
vpe-advisor

von alirezarezvani

vpe-advisor ist ein Skill für operative VP-of-Engineering-Beratung zu Delivery-Durchsatz in Startups, Zustand des Hiring Funnels, Teamstruktur und Production Discipline. Nutze die Referenzen und Python-Tools, um DORA metrics, Hiring-Lücken, Manager-Trigger, On-Call-Praktiken und strategische Planungs-Trade-offs zu analysieren.

Strategic Planning
Favoriten 0GitHub 22.1k
S
upgrade-stripe

von stripe

upgrade-stripe Guide zum Aktualisieren von Stripe-API-Versionen, serverseitigen SDKs, Stripe.js und mobilen SDKs in realen Codebasen – mit praxisnahen Schritten für die Backend-Entwicklung.

Backend Development
Favoriten 0GitHub 1.5k