back
loading skill details...
轻量短视频一键生成工具,支持画面规划、AI素材生成、TTS配音与视频渲染,适合个人创作者快速出片。
---
name: "video-producer-tool-free"
description: "轻量短视频一键生成工具,支持画面规划、AI素材生成、TTS配音与视频渲染,适合个人创作者快速出片。"
license: Proprietary
allowed-tools: read exec
compatibility: "Requires LLM with tool-use capability"
metadata:
displayName: "短视频生成-免费版"
version: "1.0.0"
summary: "轻量短视频一键生成工具,支持画面规划、AI素材生成、TTS配音与视频渲染,适合个人创作者快速出片。"
tags:
- "Creative"
- "视频生成"
- "短视频"
- "免费版"
- "AI创作"
source: "SkillHub"
converted_at: "2026-07-22T17:58:36"
---
# 短视频生成工具 - 免费版
## 概述
短视频生成免费版是一款面向个人创作者的轻量级视频生产工具。它将「画面规划 → AI 素材生成 → TTS 配音 → 视频渲染 → 音视频合成」整合为一条流水线,用户只需提供主题与口播文案,即可获得完整 MP4 成片。
免费版聚焦核心生产流程:单视频生成、基础动画效果、中文 TTS 配音。配置简单,适合以下用户:
- 短视频博主快速生产日常内容
- 知识科普创作者批量产出教学视频
- 自媒体运营人员制作简易宣传内容
- 个人用户尝试 AI 视频创作
> 免费版限制:单次生成 1 个视频,最多 10 个场景,仅支持中文 TTS。如需批量生产、多语言配音、自定义动画模板等能力,请使用 PRO 版本。
## 核心能力
### 能力清单
| 能力 | 描述 | 免费版 |
|:-----|:-----|:-------|
| 画面规划 | 自动生成分镜表 | 支持 |
| AI 素材生成 | 按关键词生成画面素材 | 支持 |
| TTS 配音 | 场景级配音 | 支持(仅中文) |
| 视频渲染 | Remotion 动画渲染 | 支持 |
| 音视频合成 | 输出 MP4 | 支持 |
| 场景数量 | 单视频场景上限 | ≤10 个 |
| 多语言配音 | 英文/日文等 | 不支持 |
| 批量生产 | 多视频并行 | 不支持 |
| 自定义模板 | 自定义动画效果 | 不支持 |
| A/B 变体 | 多版本对比 | 不支持 |
| 品牌一致性 | Logo/水印/配色 | 不支持 |
**输入**: 用户提供能力清单所需的指令和必要参数。
**处理**: 按照skill规范执行能力清单操作,遵循单一意图原则。
**输出**: 返回能力清单的执行结果,包含操作状态和输出数据。
### 工作流程
```text
用户输入主题 + 口播文案
↓
画面规划(生成分镜表 JSON)
↓
AI 素材生成(按关键词匹配)
↓
TTS 配音(每场景独立配音)
↓
视频代码生成(Remotion 组件)
↓
渲染 + 合成 MP4
↓
输出成片到 out/final.mp4
```
**输入**: 用户提供工作流程所需的指令和必要参数。
**处理**: 按照skill规范执行工作流程操作,遵循单一意图原则。
**输出**: 返回工作流程的执行结果,包含操作状态和输出数据。
- 执行此能力时使用`input_params`参数,支持创建/查询/导出操作
### 技能协作架构
本技能采用「协调者 + 规划专家」协作模式:
```text
用户输入
↓
video-producer-tool-free(协调者)
↓
调用画面规划模块(分镜表生成)
↓
返回分镜表(JSON 格式)
↓
video-producer-tool-free 继续执行
↓
AI 生图 → TTS 配音 → 视频渲染 → 合成输出
```
**协作优势:**
- **职责分离**:规划模块专注画面设计,执行模块专注渲染
- **独立使用**:规划模块可单独用于画面设计
- **灵活调整**:用户可手动修改分镜表后再生成视频
- **易于维护**:设计规则与执行逻辑分离
**输入**: 用户提供技能协作架构所需的指令和必要参数。
**处理**: 按照skill规范执行技能协作架构操作,遵循单一意图原则。
**输出**: 返回技能协作架构的执行结果,包含操作状态和输出数据。
**能力覆盖范围**:本skill的核心能力覆盖以下场景关键词:轻量短视频一键生、成工具、支持画面规划、配音与视频渲染、适合个人创作者快、速出片、短视频生成免费版、为个人创作者提供、从文案到成片的轻、量化生产流程、核心能力、分镜表自动生成、按文案智能匹配、单场景配音、音视频合成输出等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持。
### 核心功能执行
执行核心功能执行操作,使用`input_params`参数进行配置。
**输入**: 用户提供核心功能执行所需的指令和必要参数。
**处理**: 按照skill规范执行核心功能执行操作,遵循单一意图原则。
**输出**: 返回核心功能执行的执行结果,包含操作状态和输出数据。
- 执行此能力时使用`input_params`参数,支持创建/查询/导出操作
## 使用场景
### 场景 1:知识科普短视频
小张是一名科普博主,想制作一期关于「AI 如何改变工作」的 10 秒短视频。
**操作步骤:**
1. 告诉 Agent:「帮我生成一个 10 秒短视频,主题是 AI 改变工作」
2. 提供口播文案:`[{"text":"AI 正在改变我们的工作","emoji":"🤖","title":"AI 时代"}]`
3. Agent 自动完成:分镜表 → AI 素材 → 配音 → 渲染
4. 输出成片至 `/out/final.mp4`
**示例命令:**
```bash
node produce.js "AI 改变工作" '[{"text":"AI 正在改变我们的工作","emoji":"🤖","title":"AI 时代"}]'
```
### 场景 2:社交媒体宣传视频
小李需要为自己的小店制作一个简易宣传视频。
**操作步骤:**
1. 告诉 Agent:「帮我生成一个 15 秒的店铺宣传视频」
2. 提供文案内容(4-5 个场景)
3. Agent 生成分镜表,用户确认后继续
4. 自动生成 AI 素材并配音
5. 渲染输出 MP4
**示例命令:**
```bash
node produce.js "小店宣传" '[
{"text":"发现你的专属好物","emoji":"🛍️","title":"精选好店"},
{"text":"品质保证 价格实惠","emoji":"💰","title":"品质保证"},
{"text":"立即进店选购","emoji":"🎉","title":"欢迎光临"}
]'
```
### 场景 3:教学要点视频
小王想将一段学习笔记转化为视频分享给同学。
**操作步骤:**
1. 告诉 Agent:「把这段学习要点做成 20 秒视频」
2. 提供要点文案(6 个场景,每场景一句口播)
3. Agent 自动生成分镜与素材
4. 输出教学短视频
**示例命令:**
```bash
node produce.js "学习要点" '[
{"text":"第一步 理解基础概念","emoji":"📚","title":"基础概念"},
{"text":"第二步 掌握核心方法","emoji":"💡","title":"核心方法"},
{"text":"第三步 实际应用练习","emoji":"✏️","title":"实践练习"}
]'
```
## 不适用场景
以下场景短视频生成-免费版不适合处理:
- 版权受保护的媒体内容处理
- 实时直播推流
- 专业影视后期
## 触发条件
需要视频处理、音频编辑、媒体转换、配音生成时使用。不适用于非本工具能力范围的需求。
## 快速开始
### 第一步:环境准备
```bash
# 检查 Node.js 版本(需 16+)
node --version
# 依赖说明
npx remotion --version
```
### 第二步:生成第一个视频
最简单的用法 - 单场景视频:
```bash
node produce.js "测试视频" '[{"text":"这是一个测试","emoji":"✨","title":"测试"}]'
```
### 第三步:多场景视频
生成包含 5 个场景的短视频:
```bash
node produce.js "AI 主题" '[
{"text":"AI 时代已经到来","emoji":"🤖","title":"AI 时代"},
{"text":"它正在改变各行各业","emoji":"💼","title":"行业变革"},
{"text":"从编程到设计","emoji":"🎨","title":"创作升级"},
{"text":"从数据到决策","emoji":"📊","title":"智能决策"},
{"text":"未来已来 你准备好了吗","emoji":"🚀","title":"未来已来"}
]'
```
### 第四步:查看输出
```bash
# 输出目录结构
ls -la test-video/
```
## 示例
### 分镜表格式
```markdown
**总时长:** 10秒
| 场景 | 时间 | 类型 | 口播 | 素材 |
|:----:|------|------|------|------|
| 0 | 0-2s | 开场 | 主题... | 科技背景 |
| 1 | 2-7s | 核心观点 | 口播... | AI, 工作 |
| 2 | 7-10s | 结尾 | 口播... | 未来科技 |
```
### 素材清单格式
```markdown
| 元素 | 类型 | Prompt | 尺寸 | 保存路径 |
|------|------|--------|------|----------|
| 科技背景 | 背景 | 抽象科技背景 | 9:16 | s00_科技背景.png |
| AI | 素材 | AI机器人头像 | 1:1 | s01_AI.png |
```
### 关键词映射表
免费版内置常用关键词到素材的映射:
| 关键词 | 素材描述 |
|:-------|:---------|
| AI / 机器人 | 逼真的 AI 机器人头像 |
| 数据 / 录入 | 数据流动画 |
| 设计 / 创意 | 设计师工作场景 |
| 程序员 / 代码 | 编程工作场景 |
| 赚钱 / 收入 | 金币增长图表 |
| 时间 / 倒计时 | 沙漏时钟 |
| 技能 / 升级 | 技能树图标 |
| 取代 / 替代 | 人类 vs AI 对比图 |
| 裁员 | 空荡办公室 |
| 实习生 | 年轻人使用 AI |
### 输出文件结构
```text
test-video/
├── storyboard.md # 画面设计方案(含素材路径)
├── materials/ # AI 素材
│ ├── s00_科技背景.png
│ ├── s01_AI.png
│ └── ...
├── audio/ # TTS 配音
│ ├── s0.mp3
│ ├── s1.mp3
│ └── ...
├── src/Video.js # 视频代码
└── out/final.mp4 # 最终视频
```
## 最佳实践
### 1. 文案设计建议
- 每场景口播控制在 5-15 字
- 总时长建议 10-30 秒(社交媒体友好)
- 每场景搭配一个 Emoji 增强表现力
- 开场场景用「疑问句」吸引注意
- 结尾场景用「行动号召」收尾
### 2. 素材关键词使用
```javascript
// 视频代码自动引用素材路径
import img0_科技背景 from 'materials/s00_科技背景.png';
import img1_AI from 'materials/s01_AI.png';
// 在场景中使用
<img src={img0_科技背景} style={{ position: 'absolute', ... }} />
```
### 3. 分镜表手动调整
生成分镜表后,用户可手动修改再渲染:
```bash
# 步骤 1:生成画面设计方案(暂停等待确认)
node produce.js --plan-only "AI 主题" '...'
# 步骤 2:手动修改 storyboard.md
# 步骤 3:基于修改后的分镜表继续渲染
node produce.js --from-storyboard test-video/storyboard.md
```
### 4. 场景时长建议
| 视频总时长 | 建议场景数 | 每场景时长 |
|:-----------|:-----------|:-----------|
| 10 秒 | 3-4 个 | 2-3 秒 |
| 15 秒 | 4-5 个 | 3 秒 |
| 20 秒 | 5-6 个 | 3-4 秒 |
| 30 秒 | 6-8 个 | 3-5 秒 |
## 常见问题
### Q1:生成的视频只有一句配音?
**A:** 这是已知问题,免费版已内置重试逻辑:
- TTS 生成最多重试 3 次
- 自动验证音频文件大小(>1KB)
- 缺失文件会输出警告提示
如果仍有问题,请检查 TTS 服务可用性。
### Q2:AI 素材生成失败怎么办?
**A:** 可能原因:
1. AI 生图服务不可用,请稍后重试
2. 关键词未在映射表中,请使用同义词
3. 网络问题,检查网络连接
### Q3:能否手动修改分镜表后再生成?
**A:** 可以。先生成分镜表(`--plan-only`),手动编辑 `storyboard.md`,再用 `--from-storyboard` 继续。
### Q4:免费版支持哪些语言配音?
**A:** 免费版仅支持中文 TTS。如需英文、日文等多语言配音,请使用 PRO 版本。
### Q5:视频渲染很慢如何优化?
**A:** 优化建议:
- 减少场景数量(每场景渲染独立计算)
- 降低素材分辨率
- 关闭不必要的动画效果
- 确保 CPU 资源充足
### Q6:输出目录在哪里?
**A:** 默认输出到 `test-video/` 目录,包含 `storyboard.md`、`materials/`、`audio/`、`src/` 和 `out/final.mp4`。
## 依赖说明
### 运行环境
- **Agent 平台**:支持 SKILL.md 规范的任意 AI Agent(Claude Code / Cursor / Codex / Gemini CLI 等)
- **操作系统**:Windows / macOS / Linux
- **Node.js**:16+(Remotion 渲染依赖)
- **内存**:建议 8GB+(渲染高分辨率视频)
### 第三方依赖
| 依赖项 | 类型 | 是否必需 | 获取方式 | 版本要求 |
|:-------|:-----|:---------|:---------|:---------|
| Node.js | 运行时 | 必需 | nodejs.org | 16+ |
| Remotion | npm 包 | 必需 | `npm install remotion` | 4.0+ |
| FFmpeg | 命令行工具 | 必需 | 系统包管理器 | 4.0+ |
| AI 生图 API | API | 必需 | 参考 PRO 版本说明 | - |
| TTS API | API | 必需 | 参考 PRO 版本说明 | - |
| LLM API | API | 必需 | 由 Agent 内置 LLM 提供 | - |
#### 安装命令
```bash
# 安装 Node.js 与 Remotion
npm install -g remotion
npm install
# 验证安装
node --version
npx remotion --version
ffmpeg -version
```
### API Key 配置
免费版需要以下 API Key:
| API 类型 | 环境变量 | 用途 | 获取方式 |
|:---------|:---------|:-----|:---------|
| AI 生图 | `IMAGE_GEN_API_KEY` | 生成画面素材 | 对应 AI 生图服务商 |
| TTS 服务 | `TTS_API_KEY` | 场景配音 | 对应 TTS 服务商 |
```bash
# 配置环境变量(示例)
export IMAGE_GEN_API_KEY="your_image_gen_key"
export TTS_API_KEY="your_tts_key"
```
### 可用性分类
- **分类**:MD+EXEC(Markdown 指令 + 命令行执行 + Node.js 脚本)
- **说明**:通过自然语言指令驱动 Agent 调用 `produce.js` 完成短视频生成
- **离线可用**:部分(渲染本地完成,素材生成与配音需网络)
- **隐私等级**:中(文案与素材需上传至 AI 服务)
## 版本说明
- **当前版本**:1.0.0
- **版本类型**:FREE(免费版)
- **升级路径**:如需批量生产、多语言配音、自定义模板、A/B 变体等能力,请使用 `video-producer-tool-pro`
## 错误处理
| 错误场景 | 原因 | 处理方式 |
|---------|------|---------|
| 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 |
| 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 |
| 网络错误 | 连接超时或不可达 | 执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案 |
## 已知限制
- 需LLM支持,无LLM环境不可用
- 复杂业务场景建议结合人工经验判断
- 执行效率受模型能力与网络环境影响
don't have the plugin yet? install it then click "run inline in claude" again.