Agent Skills
返回列表
简诗 AI 运维流程自动化

简诗 AI 运维流程自动化

IT 运维与安全 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_fccf428b/devops-automation。

技能介绍

解决什么问题

DevOps 流程常被分散在 GitHub Actions、告警平台、工单群和基础设施脚本里,团队很难统一回答“部署失败后谁处理、告警发给谁、复盘怎么记录”。这个技能把 CI/CD、监控告警、事件管理和基础设施运维放到同一套工作流里,便于从触发、通知到处理形成闭环。

技能如何工作

它围绕 n8n 风格 IT Ops 模板组织常见流程:

  • CI/CD 自动化:对接 GitHub Actions,处理 workflow_run 事件,生成部署开始、成功、失败通知。
  • 监控告警:设计告警路由、告警模板,并在失败时 mention_on_failure 指定负责人。
  • 事件管理:提供 incident workflow 和 postmortem 模板,便于记录故障阶段、影响与恢复步骤。
  • 基础设施与 K8s:覆盖服务器开通、计划内维护、Kubernetes 工作流等运维动作。

适用边界

该技能偏重 流程编排和模板化,不会自动安装依赖、修改系统权限、创建持久化任务或执行下载内容。涉及发送、发布、删除、付款、部署等外部写入时,应展示目标与影响并确认。命令和代码默认作为参考,只有用户明确要求执行且目标范围清楚时才适合运行。

使用场景

  • 在 GitHub Actions 部署流水线中,为成功、失败和开始事件生成群通知模板。
  • 给告警平台设计路由规则和通知模板,失败时提醒指定负责人。
  • 线上服务故障后,按事件工作流整理时间线、影响范围和复盘模板。
  • 维护 Kubernetes 集群时,把服务扩缩容和维护窗口整理成可复用工作流。

适合人员

  • 运维工程师:把 GitHub Actions 部署结果和失败日志整理成团队通知流程。
  • SRE:设计告警路由、失败提醒和事故复盘模板,减少口头交接。
  • 平台工程师:将服务器开通、维护窗口和 K8s 操作沉淀成可复用模板。
  • DevOps 负责人:统一 CI/CD、监控、事件管理流程,便于跨团队落地。