SkillGuard Agent 安全扫描器
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_fee73aa5/skillguard。
技能介绍
要解决的问题
Agent 生态里,Skill 常携带提示词、代码片段、权限声明和网络依赖。直接安装后,风险可能在运行阶段才暴露:prompt injection、密钥泄漏、危险命令、敏感文件访问、异常外联或记忆投毒。SkillGuard 的目标是在安装前给出可解释的安全检查结果。
工作方式
它按 OWASP ASI Top 10 组织 8 个检测器:
- Prompt 注入:识别越狱、诱导话术和中文绕过尝试。
- 密钥与执行风险:检查 API Key、Token、密码,以及
eval、exec、subprocess等调用。 - 依赖与权限:审计依赖包安全,并交叉验证权限声明与实际行为。
- 数据与网络:检测敏感文件访问、数据外泄和 URL 白名单网络请求。
- 记忆风险:识别记忆投毒和认知攻击线索。
检测完成后,输出 TRACE 五维评分:Trust、Reliability、Authenticity、Compliance、Exposure,便于在发布、审核或接入前做取舍。
适用边界
SkillGuard 更适合做安装前静态审查和准入检查,不应替代沙箱运行、人工代码审计或运行时网络隔离。评分和检测结果可作为风险参考,最终仍需结合业务敏感度和 Agent 权限边界判断。
使用场景
- 在把第三方 Agent Skill 接入生产工作区前,运行静态扫描并导出 TRACE 评分。
- 在准入评审中检查候选技能是否有提示注入、越狱话术和中文诱导提示。
- 排查技能包中的 API Key、Token、密码以及 eval、exec、subprocess 调用。
- 对即将上架的技能做权限声明与实际行为、网络白名单和敏感文件访问交叉验证。
适合人员
- 负责 Agent 工作区准入的工程师:需要在发布前拦截高风险第三方 Skill。
- 做安全评审的平台运营:需要按 OWASP ASI 风险项输出可核查的扫描结果。
- 管理私有技能仓库的维护者:需要比较候选技能的 TRACE 五维评分再做上架决定。
- 接入外部 Agent 能力的团队负责人:需要把提示注入和密钥泄漏作为上线门槛。