Agent Skills
返回列表
任务边界审计

任务边界审计

AI Agent 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_15292d5a/yjkj-task-boundary-auditor。

技能介绍

它解决的问题

LLM 的越界不一定表现为报错,而常表现为格式完整、逻辑通顺但结论错误的“精致幻觉”。当任务涉及反事实推理、零遗漏审计、精确验证、实时闭环或物理直觉时,模型仍可能给出看似专业的答案,却缺少必要的因果模型、形式化工具或人工责任。该技能用于在执行前识别这类边界风险,避免把高风险子任务直接交给 LLM 主责。

技能如何工作

技能将任务划分为 安全区、受限区 和 禁止区,并围绕三类信号做审计:

  • 禁止区:反事实推理、精确验证、实时闭环、物理直觉、概念外推、伦理裁决、零遗漏审计、极端预测。
  • 安全区:文本生成、翻译转换、信息抽取、摘要压缩、格式整理。
  • 受限区:短链因果、数量级估算、草稿建议、已知模式匹配。

对混合任务,它会先分解为子任务,再逐个分类,并输出 违规拦截、受限路由 或 安全放行 结论。

适用边界

该技能适合用于审计高风险请求、拆解复杂任务、标注 LLM 可承担与不可承担的部分。它不替代专业工具、规则引擎、统计模型或人工判断;法律、医疗、金融等场景即使技术可行,也应保留人工复核。审计结论不应因用户催促、措辞模糊或“只要一个结果”而降级。

使用场景

  • 审核用户要求“找出 200 页合同所有隐藏条款并保证零遗漏”的高风险请求,判断是否拦截并路由规则引擎与律师。
  • 分析销售数据归因与下季度预测混合任务,拆成因子抽取、统计模型判断、历史描述子任务。
  • 处理翻译英文合同并提取付款条款的安全任务,放行 LLM 执行并提示人工抽查金额日期。
  • 审查“如果某公司从未上市会怎样”的反事实推理请求,标记禁止区并建议专家推理。

适合人员

  • AI Agent 安全工程师,希望拦截越界请求并给出人机分工。
  • 处理合同、审计或合规请求的业务运营,希望区分 LLM 可执行和必须人工复核。
  • 搭建客服或知识库 Agent 的平台工程师,希望为混合任务设置路由规则。
  • 审查模型输出风险的评测工程师,希望用统一边界分类表复核案例。