beacon
仓库创建 2026年1月7日最近提交 2 天前SkillHot 收录 21 天前
▸ 精选理由
适合 SRE 与架构团队规范可靠性并自动化监控策略
这个 Skill 做什么
为系统设计 SLO/SLI、追踪、告警与容量规划,提升可观测性与可靠性
帮你从 SLO/SLI、分布式追踪到告警与容量规划把系统可观测性搭好,做出合理的错误预算和告警策略并画出监控仪表盘。用于定义可靠性指标、埋点/追踪规范(OpenTelemetry)或做可靠性评审时。特别之处在于把 SLO/错误预算、tail-based tracing 和容量规划连起来,能同时考虑多窗口多速率的告警策略。
▸ 展开 SKILL.md 英文原文
Engineering observability and reliability through SLO/SLI design, distributed tracing, alerting, dashboards, capacity planning, toil automation, and reliability review. Use when designing observability instrumentation, defining SLOs/SLIs, building dashboards/alerts, or reviewing reliability posture.
66
Stars
14
Forks
40
仓库内 Skill
+6
7 日增星
安装 / 使用
给你的 Agent 一句话(通用)
帮我安装这个 skill:https://raw.githubusercontent.com/simota/agent-skills/main/beacon/SKILL.md或 curl 直取 SKILL.md
curl -fsSL "https://raw.githubusercontent.com/simota/agent-skills/main/beacon/SKILL.md"SKILL.MD 节选查看完整文件 ↗
<!-- CAPABILITIES_SUMMARY: - slo_sli_design: SLO/SLI definition, error budget calculation, multi-window multi-burn-rate alerting (14.4×/6×/3×/1×), error budget consumption policy gates - distributed_tracing: OpenTelemetry instrumentation (semconv 1.28+ stable, tracking 1.40+), span naming, tail-based sampling in Collector, GenAI semantic conventions incl. agent spans (experimental — dual-emission opt-in) - telemetry_pipeline: OpAMP fleet management, OTel Collector orchestration, Declarative Configuration, OTel Profiles (4th pillar, Alpha) strategy assessment - alerting_strategy: Alert hierarchy design, runbooks, escalation policies, alert fatigue reduction, burn rate thresholds - dashboard_d
via SKILL·HOT · 数据来自 GitHub 公开信息 · 原文版权归作者所有