dLazy 多模态生成
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,将 @user_f95f21b8/dlazy-generate 安装到 AI 助手中。
技能介绍
解决什么问题
在多模态生成场景里,常用工具往往把图像、视频、音频拆成不同命令、参数和服务入口,使用者需要先判断任务类型、模型能力和 CLI 参数。dLazy 多模态生成把这一层封装为单一技能:用户表达生成一张海报、一段叙事短片或一段配音/音乐后,技能负责选择 dlazy CLI 中更合适的模型,并执行生成命令。
如何工作
技能是 dLazy 托管 API 的薄客户端。调用时会按意图路由到不同模型类别:图像可选 realism、sketch、text-to-image、SVG/vector、Midjourney style 等;视频覆盖 cinematic clips、narrative shorts、image-to-video 与 action transfer;音频覆盖 TTS、music 与 sound effects。执行路径通常是:
- 判断媒体类型;
- 从可用模型中选最匹配项;
- 用
dlazy -h查看该模型参数; - 运行类似
dlazy seedream-4.5 --prompt ...的命令。
本地文件路径会上传到 dLazy 媒体存储,API 返回的生成结果 URL 由 dLazy 托管。
适用边界
它适合已有 dLazy API key、接受云生成流程的工程与内容任务。若需要离线、私有推理或严格本地文件不出机器,不适合。遇到 insufficient_balance 需充值,unauthorized 需配置 API key,502 通常是本地文件读取失败,504 可能来自后端异步任务失败或安全策略。
使用场景
- 接到产品发布会海报图需求时,把提示词路由到合适图像模型并生成候选图。
- 需要把一段剧情描述变成短叙事视频片段时,选择视频模型并检查所需参数。
- 要把英文脚本转成配音或生成背景音乐时,调用 TTS 或音乐模型获取输出 URL。
- 已有本地图片需要生成图生视频或动作迁移片段时,上传文件并运行对应视频模型。
适合人员
- 需要快速产出海报、短片或配音的内容创作者,不想逐个查图像、视频、音频模型参数。
- 集成多模态生成能力的工程师,希望用一个 CLI 技能统一调用图像、视频和音频模型。
- 负责营销素材生产的项目负责人,需要把任务拆成海报图、短视频和旁白配音。
- 已有 dLazy API key 的自动化工程师,希望把模型选择和生成命令纳入脚本流程。