Agent Skills
返回列表
百度一见视觉助手

百度一见视觉助手

AI Agent 更新于 2026.08.29

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_eb2b0784/wtf。

技能介绍

解决什么问题

监控视频和现场图片常需要判断人员摔倒、车辆进出、区域占用或 OCR 等事件。直接把原始画面交给模型并不稳定,检测范围、统计规则和结果展示也需要结构化。该技能把百度一见平台的视觉检测能力接到本地工作流中,用于把图像/视频帧转换成可复核的结构化结果。

如何工作

  • 技能注册与筛选:先读取平台技能列表,按用户意图匹配检测能力,例如人员、车辆、OCR、姿态、跟踪。
  • 调用检测:使用 YIJIAN_API_KEY 环境变量,将图片或视频帧输入已注册技能,脚本输出 JSON 到标准输出,错误到标准错误。
  • 区域约束:通过 ROI 电子围栏 限制检测范围,或用 绊线 Tripwire 统计穿越事件。
  • 可视化:绘制边框、生成网格参考、预览 ROI/绊线,便于确认坐标和检测效果。

适用边界

需要能访问百度一见平台并具备可用 YIJIAN_API_KEY。它面向已有视觉检测接口的场景,不负责部署模型、存储业务数据或替代完整监控后端;视频场景通常需要先提取帧再逐帧处理。

使用场景

  • 在走廊摄像头画面中设置 ROI 围栏,只统计进入指定房间的人员数量。
  • 拿到 30 秒监控视频后提取视频帧,逐帧检测并跟踪人员移动轨迹。
  • 在监控图像上定义绊线,统计车辆或人员穿越检测线的次数。
  • 面对模糊需求先读取一见技能列表,按“检测摔倒人员”筛选可用技能并调用。

适合人员

  • 负责视频接入的算法工程师:需要把一见检测能力封装成本地可调用的 JSON 工具。
  • 做安全运营的值班分析人员:想快速划定 ROI 或绊线并预览事件结果。
  • 巡检平台工程师:需要为图片、视频帧选择 OCR、人员或车辆检测技能。
  • 应用集成工程师:希望按用户意图筛选技能并输出标准 JSON 结果。