简诗 AI 运维流程自动化
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_fccf428b/devops-automation。
技能介绍
解决什么问题
DevOps 流程常被分散在 GitHub Actions、告警平台、工单群和基础设施脚本里,团队很难统一回答“部署失败后谁处理、告警发给谁、复盘怎么记录”。这个技能把 CI/CD、监控告警、事件管理和基础设施运维放到同一套工作流里,便于从触发、通知到处理形成闭环。
技能如何工作
它围绕 n8n 风格 IT Ops 模板组织常见流程:
- CI/CD 自动化:对接
GitHub Actions,处理workflow_run事件,生成部署开始、成功、失败通知。 - 监控告警:设计告警路由、告警模板,并在失败时
mention_on_failure指定负责人。 - 事件管理:提供 incident workflow 和 postmortem 模板,便于记录故障阶段、影响与恢复步骤。
- 基础设施与 K8s:覆盖服务器开通、计划内维护、Kubernetes 工作流等运维动作。
适用边界
该技能偏重 流程编排和模板化,不会自动安装依赖、修改系统权限、创建持久化任务或执行下载内容。涉及发送、发布、删除、付款、部署等外部写入时,应展示目标与影响并确认。命令和代码默认作为参考,只有用户明确要求执行且目标范围清楚时才适合运行。
使用场景
- 在 GitHub Actions 部署流水线中,为成功、失败和开始事件生成群通知模板。
- 给告警平台设计路由规则和通知模板,失败时提醒指定负责人。
- 线上服务故障后,按事件工作流整理时间线、影响范围和复盘模板。
- 维护 Kubernetes 集群时,把服务扩缩容和维护窗口整理成可复用工作流。
适合人员
- 运维工程师:把 GitHub Actions 部署结果和失败日志整理成团队通知流程。
- SRE:设计告警路由、失败提醒和事故复盘模板,减少口头交接。
- 平台工程师:将服务器开通、维护窗口和 K8s 操作沉淀成可复用模板。
- DevOps 负责人:统一 CI/CD、监控、事件管理流程,便于跨团队落地。