可靠性

浏览 安全 下与 可靠性 相关的 Agent Skill,并比较相近工作流、工具与使用场景。

15 个技能
C
uptimerobot-automation

作者 ComposioHQ

uptimerobot-automation 可帮助 AI agent 通过 Composio Rube MCP 运行 UptimeRobot Monitoring 工作流。你可以用它安装该 skill、连接 Rube MCP、验证 UptimeRobot 连接、通过 RUBE_SEARCH_TOOLS 发现当前工具 schema,并安全执行监控任务。

监控
收藏 0GitHub 67.5k
C
updown-io-automation

作者 ComposioHQ

updown-io-automation 可帮助 agent 通过 Composio Rube MCP 执行 Updown.io 监控任务。了解设置要求、RUBE_SEARCH_TOOLS 发现流程、连接检查以及更安全的使用模式。

监控
收藏 0GitHub 67.5k
W
error-handling-patterns

作者 wshobson

error-handling-patterns 可帮助团队在 exceptions 与 Result types 之间做出选择,对失败进行分类,传递上下文,并设计优雅降级方案,从而打造更可靠的 API 和服务。

可靠性
收藏 1GitHub 32.6k
W
python-resilience

作者 wshobson

python-resilience 是一项用于提升 Python 故障处理安全性的指导型技能,覆盖重试、指数退避、jitter、超时和有边界的重试窗口。适合用来安装实用的韧性模式,以保护外部调用,并通过 tenacity 风格的包装器应用更清晰的重试规则。

可靠性
收藏 0GitHub 32.6k
W
slo-implementation

作者 wshobson

使用 slo-implementation 来定义面向 Reliability 工作的 SLI、SLO、错误预算和 burn-rate 告警。它可帮助团队把服务目标转化为可衡量的指标,并结合类似 PromQL 的示例与来自 SKILL.md 的实用指导推进落地。

可靠性
收藏 0GitHub 32.6k
W
istio-traffic-management

作者 wshobson

istio-traffic-management 可帮助团队起草 Istio 流量策略,如 VirtualService、DestinationRule、Gateway 和 ServiceEntry,用于金丝雀发布、重试、熔断和流量镜像。适合将部署意图转化为清晰的路由与弹性配置清单,并提供实用提示与审查检查点。

部署
收藏 0GitHub 32.6k
W
linkerd-patterns

作者 wshobson

linkerd-patterns 帮助团队将 Linkerd 模式应用到 Kubernetes 工作负载,涵盖 mTLS、sidecar 注入、流量拆分、重试、超时、service profiles,以及基于 Deployment 的多集群发布规划。

部署
收藏 0GitHub 32.6k
W
on-call-handoff-patterns

作者 wshobson

了解 on-call-handoff-patterns 技能,帮助值班交接更可靠。可用于规范事故交接,记录当前问题、近期变更、升级状态和后续行动,适合 Reliability 团队使用。

可靠性
收藏 0GitHub 32.5k
W
incident-runbook-templates

作者 wshobson

incident-runbook-templates 可帮助团队创建结构化的事故响应 runbook,为故障处理和运维 Playbook 提供清晰的分诊、缓解、升级、沟通与恢复步骤。

操作手册
收藏 0GitHub 32.5k
A
runbook-generator

作者 alirezarezvani

runbook-generator 通过 Python CLI 和模板,为服务生成运维 runbook 草稿,覆盖部署、健康检查、回滚、incident response、维护和验证等场景。适合 SRE、DevOps 和技术写作团队用来标准化 on-call 流程。

技术写作
收藏 0GitHub 22.2k
A
observability-designer

作者 alirezarezvani

observability-designer 可帮助 SRE 和平台团队为 API 与服务设计可观测性,依托内置 Python 脚本、示例和参考资料,生成 dashboard、分析告警噪声,并搭建轻量级 SLI/SLO 脚手架。

可观测性
收藏 0GitHub 22.2k
A
feature-flags-architect

作者 alirezarezvani

feature-flags-architect 可帮助团队规划、审计并清理 feature flags,用于支持 progressive delivery。它适合用于 rollout plans、kill-switch 检查、stale flag 扫描、provider 对比,以及在 LaunchDarkly、GrowthBook、Statsig、Unleash、Flipt 或 DIY systems 中制定生命周期管理建议。

部署
收藏 0GitHub 22.2k
A
feature-flags-architect

作者 alirezarezvani

feature-flags-architect 是一个面向软件架构的 skill,用于设计、发布、审计和退役 feature flags。它包含基于 stdlib Python 的脚本,可用于 flag debt 扫描、rollout 规划和 kill-switch 审计,并提供 flag taxonomy、生命周期、rollout 策略以及 provider 取舍等参考内容。

软件架构
收藏 0GitHub 22.1k
A
vpe-advisor

作者 alirezarezvani

vpe-advisor 是面向 VP of Engineering 的运营建议 skill,适用于创业公司的交付吞吐、招聘漏斗健康度、团队结构和生产纪律管理。可利用其中的参考资料和 Python 工具分析 DORA metrics、招聘缺口、管理者触发时机、on-call 实践以及战略规划取舍。

战略规划
收藏 0GitHub 22.1k
S
upgrade-stripe

作者 stripe

upgrade-stripe 用于在真实代码库中升级 Stripe API 版本、服务端 SDK、Stripe.js 和移动端 SDK,提供面向后端开发的实用步骤。

后端开发
收藏 0GitHub 1.5k