本地视频分析处理
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_1a470ba8/video-analyzer-local。
技能介绍
解决什么问题
视频内容通常分散在语音、画面文字、场景切换和平台传播数据中,人工做字幕、切片、高光定位和剪辑建议成本很高。video-analyzer-local 把本地视频或可下载链接解析为结构化结果,适合需要离线、可复查、可接入剪辑流程的分析场景。
如何工作
输入后,工具围绕音视频流做多路解析:语音转文字可生成带时间戳的转录,--diarize 可区分多人说话人;视觉侧做场景边界检测、物体识别和 OCR,并用 --slice-chapters 按章节切片输出片段与 SRT/VTT。分析结果会做声音、画面、文字的时间对齐,生成精华摘要、剪辑建议、EDL/CSV/JSON 时间线,以及 HTML/JSON/Markdown 报告。对抖音、快手、B站、视频号等链接,可提取标题、作者、互动数据,并做前 3 秒、完播、节奏和带货关键词等分析。
适用边界
该工具依赖 ffmpeg,且只处理视频文件;纯音频、损坏文件、可执行文件会被拒绝。大模型识别和 OCR 可选依赖会改变精度与资源占用;超长视频、低内存机器建议限制内存并关闭视觉/OCR。说话人分离、高光检测和场景切分仍受音频噪声、渐变转场、平台视频可用性影响,输出适合作为编辑参考而非最终判断。
使用场景
- 会议录像需要区分发言人并导出可复核的字幕文件时
- 从B站教程提取时间戳、场景切片和高光片段以便二次剪辑
- 需要复盘抖音短视频的开场钩子、节奏与带货关键词
- 旧笔记本离线分析本地视频,只生成转录和场景结果
适合人员
- 负责会议或访谈视频字幕与说话人标注的视频编辑
- 做短视频选题、脚本拆解与平台复盘的内容运营
- 需要在内网离线处理本地录像的音视频工程师
- 制作教学视频并希望获得剪辑点与字幕的教研人员