TencentOS Server 全栈运维诊断专家
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_7ac3e421/tencentos-expert。
技能介绍
问题场景
TencentOS Server 故障往往跨磁盘、网络、性能、内存、系统、安全和 CVE 多个层面,单一检查脚本容易覆盖不全,而把所有运维文档一次性塞进上下文又会迅速占用 token。这个技能把诊断流程拆成按需加载的文档模块,先根据现象匹配能力索引,再只打开相关参考文档,适合在服务器异常时做结构化排查。
工作方式
触发后按固定顺序加载 guides/workflow.md、guides/capability-index.md、guides/scenario-routing.md 和 guides/doc-map.md。workflow.md 负责依赖安装与诊断步骤,capability-index.md 用于模块匹配,scenario-routing.md 按现象路由到对应模块,doc-map.md 用于查找子文档路径。匹配到具体模块后,技能只加载用户问题相关的 1~3 个 references/ 文档,而不是一次性展开全部参考资料。性能分析优先使用 perf-prof,不可用时再按文档中的降级方案使用 perf 原生命令;索引没有匹配时,可以在 references/ 中搜索关键词。
边界与注意
该技能仅用于 TencentOS Server 运维诊断,覆盖磁盘、网络、性能、内存、系统、安全、CVE 等 24 项能力。若请求属于 Web/小程序/移动端开发、前端优化、网站建设、CMS、SEO、业务代码、数据建模、应用 SQL 设计、AI 模型训练、通用数据分析(GPU 故障诊断除外)、编程教学或产品需求讨论,应拒绝进入子文档。凭证约束方面,AI 不应读取 ~/.ssh/id_*、复述用户粘贴的密码或私钥,也不应把凭证写入脚本、日志或 commit。用户自行完成 ssh 登录,AI 只生成 ssh user@host 模板;出现明文凭证时应立即提示已泄漏并建议轮换密钥。
使用场景
- TencentOS Server 磁盘写满导致服务不可用,需定位大文件并释放空间
- CPU 持续跑满影响线上业务,需用 perf-prof 定位热点函数与调用栈
- 收到 CVE 安全告警,需评估对当前 TencentOS 版本的影响及补丁可用性
- 线上服务网络延迟升高,需排查路由表、DNS 解析及网卡丢包
适合人员
- 负责 TencentOS Server 集群的 SRE,遇到磁盘、内存或 CPU 异常需快速定位根因
- 安全运维工程师,收到 CVE 告警后需评估影响范围并确认补丁状态
- 应用运维工程师,线上出现 OOM 或网络延迟时需按模块逐项排查
- DevOps 工程师,需要对生产节点做性能 profiling 并对比历史基线