back
loading skill details...
轻量级AI图片生成工具,支持单图生成与基础提示词,适合个人用户快速创作视觉内容。
---
name: "doubao-image-gen-tool-free"
description: "轻量级AI图片生成工具,支持单图生成与基础提示词,适合个人用户快速创作视觉内容。"
license: Proprietary
allowed-tools: read exec
compatibility: "Requires LLM with tool-use capability"
metadata:
displayName: "豆包图片生成-免费版"
version: "1.0.0"
summary: "轻量级AI图片生成工具,支持单图生成与基础提示词,适合个人用户快速创作视觉内容。"
tags:
- "Creative"
- "AI绘图"
- "图片生成"
- "免费版"
source: "SkillHub"
converted_at: "2026-07-22T17:58:36"
---
# 豆包图片生成工具 - 免费版
## 概述
豆包图片生成免费版是一款面向个人用户的轻量级 AI 图片生成工具。它通过标准化的生成流程(确认需求 → 输入提示词 → 设置比例 → 生成 → 截图确认 → 下载保存),帮助用户快速将创意想法转化为视觉作品。
免费版聚焦核心生成场景:单张图片生成、基础比例选择、生成结果确认与下载。配置简单,适合以下用户:
- 个人用户快速生成创意图片
- 社交媒体创作者制作配图
- 设计师快速预览设计灵感
- AI 绘图初学者入门体验
> 免费版限制:单次生成 1 张图片,默认 3:4 比例,不支持批量生成、多比例输出、风格预设、提示词增强等高级能力。如需这些能力,请使用 PRO 版本。
## 核心能力
### 能力清单
| 能力 | 描述 | 免费版 |
|:-----|:-----|:-------|
| 单图生成 | 生成一张 AI 图片 | 支持 |
| 提示词输入 | 自定义提示词 | 支持 |
| 比例选择 | 选择图片比例 | 支持(3:4 默认) |
| 截图确认 | 生成后截图供用户选择 | 支持 |
| 图片下载 | 下载原图到本地 | 支持 |
| 简易提示词优化 | 基础提示词建议 | 支持 |
| 批量生成 | 多图同时生成 | 不支持 |
| 多比例输出 | 同时生成多比例 | 不支持 |
| 风格预设 | 预设风格模板 | 不支持 |
| 提示词增强 | AI 增强提示词 | 不支持 |
| 参考图生成 | 基于参考图生成 | 不支持 |
| 工作流自动化 | 批量自动化 | 不支持 |
**输入**: 用户提供能力清单所需的指令和必要参数。
**处理**: 按照skill规范执行能力清单操作,遵循单一意图原则。
**输出**: 返回能力清单的执行结果,包含操作状态和输出数据。
### 工作流程
```text
询问用户生成需求
↓
用户确认提示词与比例
↓
输入提示词到生成页面
↓
设置图片比例(默认 3:4)
↓
点击生成按钮
↓
等待生成完成
↓
截图 4 张候选图发给用户
↓
用户选择并确认
↓
下载图片到本地
↓
复制到指定目录
```
**输入**: 用户提供工作流程所需的指令和必要参数。
**处理**: 按照skill规范执行工作流程操作,遵循单一意图原则。
**输出**: 返回工作流程的执行结果,包含操作状态和输出数据。
- 执行此能力时使用`input_params`参数,支持创建/查询/导出操作
### 生成流程关键步骤
1. **需求确认**:先询问用户想要什么样的图片
2. **提示词输入**:用户确认后输入提示词
3. **比例设置**:默认 3:4,用户可选其他比例
4. **生成触发**:点击发送按钮(向上箭头),不按回车
5. **结果截图**:生成完成后立即截 4 张图
6. **用户选择**:通过 message 工具发给用户选择
7. **确认下载**:用户选好后点开大图确认
8. **保存图片**:点击下载原图保存
9. **复制到目标目录**:复制到指定文件夹
**输入**: 用户提供生成流程关键步骤所需的指令和必要参数。
**处理**: 按照skill规范执行生成流程关键步骤操作,遵循单一意图原则。
**输出**: 返回生成流程关键步骤的执行结果,包含操作状态和输出数据。
**能力覆盖范围**:本skill的核心能力覆盖以下场景关键词:轻量级、图片生成工具、支持单图生成与基、适合个人用户快速、创作视觉内容、豆包图片生成免费、为个人用户提供轻、量化的、图片生成能力、核心能力、单张图片生成、按提示词创作、基础比例选择、生成结果截图确认、图片下载与保存等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持。
### 核心功能执行
执行核心功能执行操作,使用`input_params`参数进行配置。
**输入**: 用户提供核心功能执行所需的指令和必要参数。
**处理**: 按照skill规范执行核心功能执行操作,遵循单一意图原则。
**输出**: 返回核心功能执行的执行结果,包含操作状态和输出数据。
- 执行此能力时使用`input_params`参数,支持创建/查询/导出操作
## 使用场景
### 场景 1:社交媒体配图创作
小张需要为社交媒体帖子生成一张配图。
**操作步骤:**
1. Agent 询问:「您想要什么样的图片?有什么提示词要求?」
2. 用户回答:「想要一张温馨的咖啡店场景,暖色调」
3. Agent 输入提示词,设置 3:4 比例
4. 生成完成后截图 4 张候选图
5. 通过 message 工具发给用户选择
6. 用户选择后下载保存
**示例交互:**
```text
Agent: 您想要什么样的图片?有什么提示词要求?
用户: 想要一张温馨的咖啡店场景,暖色调
Agent: 好的,我将为您生成一张温馨咖啡店场景的图片,比例 3:4
[生成中...]
Agent: 已生成 4 张候选图,请选择您喜欢的一张
[发送 4 张截图]
用户: 我选第二张
Agent: 好的,已为您下载第二张图片并保存
```
### 场景 2:设计灵感预览
小李是设计师,希望快速预览某个设计概念。
**操作步骤:**
1. Agent 询问需求
2. 用户提供设计概念提示词
3. Agent 生成图片
4. 设计师查看候选图获取灵感
**示例提示词:**
```text
提示词:现代简约风格客厅,大面积落地窗,木质地板,米色沙发,绿植点缀,自然光照明亮
比例:3:4
```
### 场景 3:学习 AI 绘图入门
小王想学习 AI 绘图,从简单的提示词开始尝试。
**操作步骤:**
1. Agent 询问想要什么样的图片
2. 用户输入简单提示词(如「一只可爱的橘猫」)
3. Agent 给出提示词优化建议
4. 生成图片并展示结果
**示例提示词优化:**
```text
原始提示词:一只可爱的橘猫
优化建议:一只毛茸茸的橘色猫咪,坐在窗台上,阳光洒在身上,大眼睛,可爱表情,柔和色调,3:4 比例
```
## 不适用场景
以下场景豆包图片生成-免费版不适合处理:
- 3D建模和动画制作
- 照片级写实渲染
- 手绘原创插画
## 触发条件
需要设计创作、UI设计、海报制作、品牌视觉时使用。不适用于非本工具能力范围的需求。
## 快速开始
### 第一步:需求确认
收到任务后,**第一步**必须是询问用户:
```text
Agent: 您想要生成什么样的图片?
- 主题内容是什么?
- 风格偏好(写实/卡通/油画等)?
- 比例要求(默认 3:4)?
- 其他特殊要求?
```
### 第二步:输入提示词
用户确认需求后,输入提示词到生成页面:
```text
[打开豆包 AI 创作页面]
[输入用户确认的提示词]
[设置比例为 3:4(或用户指定比例)]
```
### 第三步:生成图片
点击发送按钮(向上箭头)触发生成:
```text
[点击发送按钮 - 不要按回车]
[等待图片生成完成]
```
### 第四步:截图与选择
生成完成后立即截图 4 张候选图:
```bash
# 示例
# 通过 message 工具发送图片给用户选择
message --image /tmp/candidate-1.jpg --text "候选图 1"
message --image /tmp/candidate-2.jpg --text "候选图 2"
message --image /tmp/candidate-3.jpg --text "候选图 3"
message --image /tmp/candidate-4.jpg --text "候选图 4"
```
### 第五步:下载与保存
用户选择后,点开大图确认并下载:
```bash
# 下载用户选择的图片
# 复制到指定目录
cp /tmp/selected-image.png /target/directory/
```
## 配置示例
### 生成参数说明
| 参数 | 类型 | 默认值 | 说明 |
|:-----|:-----|:-------|:-----|
| 提示词 | 字符串 | 必需 | 描述要生成的图片内容 |
| 比例 | 字符串 | 3:4 | 图片宽高比 |
| 数量 | 整数 | 4 | 候选图数量 |
| 保存路径 | 字符串 | /tmp/ | 下载保存目录 |
### 支持的比例
免费版支持以下比例:
| 比例 | 适用场景 |
|:-----|:---------|
| 3:4(默认) | 竖版社交媒体 |
| 1:1 | 方形头像 |
| 4:3 | 横版配图 |
| 16:9 | 宽屏壁纸 |
### 提示词建议格式
```text
[主体描述] + [风格] + [色调] + [细节] + [比例]
示例:
一只毛茸茸的橘猫(主体)
写实风格(风格)
暖色调(色调)
坐在窗台上 阳光洒在身上(细节)
3:4 比例
```
## 最佳实践
### 1. 提示词撰写技巧
```text
# 推荐:详细具体
一只可爱的橘色猫咪,坐在窗台上,阳光洒在身上,大眼睛,可爱表情,柔和色调
# 不推荐:过于简单
猫
```
### 2. 比例选择建议
| 用途 | 推荐比例 |
|:-----|:---------|
| 朋友圈/小红书 | 3:4 |
| 头像 | 1:1 |
| 公众号配图 | 4:3 |
| 手机壁纸 | 9:16 |
### 3. 生成流程规范
1. **必须先询问用户需求**,不要直接生成
2. 用户确认后再输入提示词
3. 点击发送按钮(向上箭头),不要按回车
4. 等待图片完全生成后再截图
5. 用户选好后要点开大图确认
6. 用户确认后才能下载保存
7. 每步必须拿到结果才能进行下一步
### 4. 截图与发送规范
- 截图必须用 message 工具发送图片给用户
- 不要使用虚拟路径
- 截图路径使用实际路径
## 常见问题
### Q1:为什么必须先询问用户?
**A:** 询问用户需求可以:
- 明确生成方向,避免浪费
- 了解用户的风格偏好
- 确认比例要求
- 提升用户满意度
### Q2:点击发送还是按回车?
**A:** 必须点击发送按钮(向上的箭头),不要按回车。按回车可能导致提示词格式错误。
### Q3:生成的图片不满意怎么办?
**A:** 可以:
1. 重新生成(调整提示词)
2. 从 4 张候选图中选择最接近的
3. 优化提示词后再生成
### Q4:免费版支持哪些比例?
**A:** 支持常见比例:3:4、1:1、4:3、16:9。默认使用 3:4。如需更多比例或同时输出多比例,请使用 PRO 版本。
### Q5:能否批量生成多张图片?
**A:** 免费版仅支持单次生成。如需批量生成,请使用 PRO 版本。
### Q6:图片保存在哪里?
**A:** 默认保存到 `/tmp/` 目录。建议复制到指定目录长期保存:
```bash
cp /tmp/generated-image.png /your/directory/
```
### Q7:能否使用参考图生成?
**A:** 免费版仅支持文本提示词生成。如需基于参考图生成,请使用 PRO 版本。
## 依赖说明
### 运行环境
- **Agent 平台**:支持 SKILL.md 规范的任意 AI Agent(Claude Code / Cursor / Codex / Gemini CLI 等)
- **操作系统**:Windows / macOS / Linux
- **浏览器**:需要浏览器访问豆包 AI 创作页面
- **网络**:需要网络连接(访问豆包服务)
### 依赖详情
| 依赖项 | 类型 | 是否必需 | 获取方式 | 版本要求 |
|:-------|:-----|:---------|:---------|:---------|
| 浏览器 | 应用 | 必需 | 系统自带 | Chrome 100+ |
| message | 平台工具 | 必需 | Skill 平台安装 | - |
| 豆包账号 | 服务 | 必需 | 豆包平台注册 | - |
| LLM API | API | 必需 | 由 Agent 内置 LLM 提供 | - |
#### 环境准备
```bash
# 验证浏览器
google-chrome --version
# 验证 message 工具
which message
# 验证工作区目录
ls ~/.skill-platform/workspace/
```
### API Key 配置
免费版需要以下配置:
| 配置项 | 环境变量 | 用途 | 获取方式 |
|:-------|:---------|:-----|:---------|
| 豆包账号 | 浏览器登录 | 访问豆包 AI 服务 | 豆包平台注册 |
| Skill 平台 Token | 平台配置 | 平台认证 | Skill 平台控制台 |
```bash
# 浏览器登录豆包账号即可
# Skill 平台通常会自动配置认证
```
### 可用性分类
- **分类**:MD+EXEC(Markdown 指令 + 命令行执行 + 浏览器自动化)
- **说明**:通过自然语言指令驱动 Agent 操作浏览器完成图片生成
- **离线可用**:否(需要网络访问豆包服务)
- **隐私等级**:中(提示词需上传至豆包服务)
## 版本说明
- **当前版本**:1.0.0
- **版本类型**:FREE(免费版)
- **升级路径**:如需批量生成、多比例输出、风格预设、提示词增强、参考图生成等能力,请使用 `doubao-image-gen-tool-pro`
## 错误处理
| 错误场景 | 原因 | 处理方式 |
|---------|------|---------|
| 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 |
| 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 |
| 网络错误 | 连接超时或不可达 | 执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案 |
## 已知限制
- 需LLM支持,无LLM环境不可用
- 复杂业务场景建议结合人工经验判断
- 执行效率受模型能力与网络环境影响
## 示例
### 基本用法
**输入**:用户提供操作指令和必要参数
**输出**:返回执行结果,包含操作状态和输出数据
```text
用户: 执行核心功能
Skill: 正在执行核心功能...
Skill: 执行完成,结果如下: 操作成功
```
don't have the plugin yet? install it then click "run inline in claude" again.