豆包图片生成-免费版
轻量级AI图片生成工具,支持单图生成与基础提示词,适合个人用户快速创作视觉内容。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。
天轰穿
@thcjp
What This Skill Does
轻量级AI图片生成工具,支持单张图片生成、基础提示词输入和比例选择,通过截图确认和下载保存完成创作流程。
Replaces manual image sourcing or basic graphic design tools by providing a quick, guided AI generation workflow for personal visual content.
When to Use It
- Generate a social media post image with a warm coffee shop scene
- Preview a design concept for a modern minimalist living room
- Create a simple AI illustration for a blog or article header
- Experiment with AI image generation using basic prompts like 'a cute orange cat'
- Quickly produce a 3:4 ratio image for a personal project or mood board
- Try out AI drawing as a beginner with guided prompt suggestions
Install
$ openclaw skills install @thcjp/doubao-image-gen-tool-free功能说明: 本技能涵盖 中文交互、与基础提示词、化工作流场景 等核心能力。
豆包图片生成工具 - 免费版
概述
豆包图片生成免费版是一款面向个人用户的轻量级 AI 图片生成工具。它通过标准化的生成流程(确认需求 → 输入提示词 → 设置比例 → 生成 → 截图确认 → 下载保存),帮助用户快速将创意想法转化为视觉作品。
免费版聚焦核心生成场景:单张图片生成、基础比例选择、生成结果确认与下载。配置简单,适合以下用户:
- 个人用户快速生成创意图片
- 社交媒体创作者制作配图
- 设计师快速预览设计灵感
- AI 绘图初学者入门体验
免费版限制:单次生成 1 张图片,默认 3:4 比例,不支持批量生成、多比例输出、风格预设、提示词增强等高级能力。如需这些能力,请使用 PRO 版本。
核心能力
能力清单
| 能力 | 描述 | 免费版 |
|---|---|---|
| 单图生成 | 生成一张 AI 图片 | 支持 |
| 提示词输入 | 自定义提示词 | 支持 |
| 比例选择 | 选择图片比例 | 支持(3:4 默认) |
| 截图确认 | 生成后截图供用户选择 | 支持 |
| 图片下载 | 下载原图到本地 | 支持 |
| 简易提示词优化 | 基础提示词建议 | 支持 |
| 批量生成 | 多图同时生成 | 不支持 |
| 多比例输出 | 同时生成多比例 | 不支持 |
| 风格预设 | 预设风格模板 | 不支持 |
| 提示词增强 | AI 增强提示词 | 不支持 |
| 参考图生成 | 基于参考图生成 | 不支持 |
| 工作流自动化 | 批量自动化 | 不支持 |
输出: 返回能力清单的执行结果,包含操作状态和输出数据。
工作流程
询问用户生成需求
↓
用户确认提示词与比例
↓
输入提示词到生成页面
↓
设置图片比例(默认 3:4)
↓
点击生成按钮
↓
等待生成完成
↓
截图 4 张候选图发给用户
↓
用户选择并确认
↓
下载图片到本地
↓
复制到指定目录
输出: 返回工作流程的执行结果,包含操作状态和输出数据。
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
生成流程关键步骤
- 需求确认:先询问用户想要什么样的图片
- 提示词输入:用户确认后输入提示词
- 比例设置:默认 3:4,用户可选其他比例
- 生成触发:点击发送按钮(向上箭头),不按回车
- 结果截图:生成完成后立即截 4 张图
- 用户选择:通过 message 工具发给用户选择
- 确认下载:用户选好后点开大图确认
- 保存图片:点击下载原图保存
- 复制到目标目录:复制到指定文件夹
输出: 返回生成流程关键步骤的执行结果,包含操作状态和输出数据。 能力覆盖范围:本skill的核心能力覆盖以下场景关键词:轻量级、图片生成工具、支持单图生成与基、适合个人用户快速、创作视觉内容、豆包图片生成免费、为个人用户提供轻、量化的、图片生成能力、核心能力、单张图片生成、按提示词创作、基础比例选择、生成结果截图确认、图片下载与保存等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持。
核心功能执行
执行核心功能执行操作,使用input_params参数进行配置。
输出: 返回核心功能执行的执行结果,包含操作状态和输出数据。
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
使用场景
场景 1:社交媒体配图创作
小张需要为社交媒体帖子生成一张配图。
操作步骤:
- Agent 询问:「您想要什么样的图片?有什么提示词要求?」
- 用户回答:「想要一张温馨的咖啡店场景,暖色调」
- Agent 输入提示词,设置 3:4 比例
- 生成完成后截图 4 张候选图
- 通过 message 工具发给用户选择
- 用户选择后下载保存
示例交互:
Agent: 您想要什么样的图片?有什么提示词要求?
用户: 想要一张温馨的咖啡店场景,暖色调
Agent: 好的,我将为您生成一张温馨咖啡店场景的图片,比例 3:4
[生成中...]
Agent: 已生成 4 张候选图,请选择您喜欢的一张
[发送 4 张截图]
用户: 我选第二张
Agent: 好的,已为您下载第二张图片并保存
场景 2:设计灵感预览
小李是设计师,希望快速预览某个设计概念。
操作步骤:
- Agent 询问需求
- 用户提供设计概念提示词
- Agent 生成图片
- 设计师查看候选图获取灵感
示例提示词:
提示词:现代简约风格客厅,大面积落地窗,木质地板,米色沙发,绿植点缀,自然光照明亮
比例:3:4
场景 3:学习 AI 绘图入门
小王想学习 AI 绘图,从简单的提示词开始尝试。
操作步骤:
- Agent 询问想要什么样的图片
- 用户输入简单提示词(如「一只可爱的橘猫」)
- Agent 给出提示词优化建议
- 生成图片并展示结果
示例提示词优化:
原始提示词:一只可爱的橘猫
优化建议:一只毛茸茸的橘色猫咪,坐在窗台上,阳光洒在身上,大眼睛,可爱表情,柔和色调,3:4 比例
不适用场景
以下场景豆包图片生成-免费版不适合处理:
- 3D建模和动画制作
- 照片级写实渲染
- 手绘原创插画
触发条件
需要设计创作、UI设计、海报制作、品牌视觉时使用。不适用于非本工具能力范围的需求。
快速开始
领先步:需求确认
收到任务后,领先步必须是询问用户:
Agent: 您想要生成什么样的图片?
- 主题内容是什么?
- 风格偏好(写实/卡通/油画等)?
- 比例要求(默认 3:4)?
- 其他特殊要求?
第二步:输入提示词
用户确认需求后,输入提示词到生成页面:
[打开豆包 AI 创作页面]
[输入用户确认的提示词]
[设置比例为 3:4(或用户指定比例)]
第三步:生成图片
点击发送按钮(向上箭头)触发生成:
[点击发送按钮 - 不要按回车]
[等待图片生成完成]
第四步:截图与选择
生成完成后立即截图 4 张候选图:
# 示例
# 通过 message 工具发送图片给用户选择
message --image /tmp/candidate-1.jpg --text "候选图 1"
message --image /tmp/candidate-2.jpg --text "候选图 2"
message --image /tmp/candidate-3.jpg --text "候选图 3"
message --image /tmp/candidate-4.jpg --text "候选图 4"
第五步:下载与保存
用户选择后,点开大图确认并下载:
# 下载用户选择的图片
# 复制到指定目录
cp /tmp/selected-image.png /target/directory/
配置示例
生成参数说明
| 参数 | 类型 | 默认值 | 说明 |
|---|---|---|---|
| 提示词 | 字符串 | 必需 | 描述要生成的图片内容 |
| 比例 | 字符串 | 3:4 | 图片宽高比 |
| 数量 | 整数 | 4 | 候选图数量 |
| 保存路径 | 字符串 | /tmp/ | 下载保存目录 |
支持的比例
免费版支持以下比例:
| 比例 | 适用场景 |
|---|---|
| 3:4(默认) | 竖版社交媒体 |
| 1:1 | 方形头像 |
| 4:3 | 横版配图 |
| 16:9 | 宽屏壁纸 |
提示词建议格式
[主体描述] + [风格] + [色调] + [细节] + [比例]
示例:
一只毛茸茸的橘猫(主体)
写实风格(风格)
暖色调(色调)
坐在窗台上 阳光洒在身上(细节)
3:4 比例
优选实践
1. 提示词撰写技巧
# 推荐:详细具体
一只可爱的橘色猫咪,坐在窗台上,阳光洒在身上,大眼睛,可爱表情,柔和色调
# 不推荐:过于简单
猫
2. 比例选择建议
| 用途 | 推荐比例 |
|---|---|
| 朋友圈/小红书 | 3:4 |
| 头像 | 1:1 |
| 公众号配图 | 4:3 |
| 手机壁纸 | 9:16 |
3. 生成流程规范
- 必须先询问用户需求,不要直接生成
- 用户确认后再输入提示词
- 点击发送按钮(向上箭头),不要按回车
- 等待图片完全生成后再截图
- 用户选好后要点开大图确认
- 用户确认后才能下载保存
- 每步必须拿到结果才能进行下一步
4. 截图与发送规范
- 截图必须用 message 工具发送图片给用户
- 不要使用虚拟路径
- 截图路径使用实际路径
常见问题
Q1:为什么必须先询问用户?
A: 询问用户需求可以:
- 明确生成方向,避免浪费
- 了解用户的风格偏好
- 确认比例要求
- 提升用户满意度
Q2:点击发送还是按回车?
A: 必须点击发送按钮(向上的箭头),不要按回车。按回车可能导致提示词格式错误。
Q3:生成的图片不满意怎么办?
A: 可以:
- 重新生成(调整提示词)
- 从 4 张候选图中选择最接近的
- 优化提示词后再生成
Q4:免费版支持哪些比例?
A: 支持常见比例:3:4、1:1、4:3、16:9。默认使用 3:4。如需更多比例或同时输出多比例,请使用 PRO 版本。
Q5:能否批量生成多张图片?
A: 免费版仅支持单次生成。如需批量生成,请使用 PRO 版本。
Q6:图片保存在哪里?
A: 默认保存到 /tmp/ 目录。建议复制到指定目录长期保存:
cp /tmp/generated-image.png /your/directory/
Q7:能否使用参考图生成?
A: 免费版仅支持文本提示词生成。如需基于参考图生成,请使用 PRO 版本。
依赖说明
运行环境
- Agent 平台:支持 SKILL.md 规范的任意 AI Agent(Claude Code / Cursor / Codex / Gemini CLI 等)
- 操作系统:Windows / macOS / Linux
- 浏览器:需要浏览器访问豆包 AI 创作页面
- 网络:需要网络连接(访问豆包服务)
依赖详情
| 依赖项 | 类型 | 是否必需 | 获取方式 | 版本要求 |
|---|---|---|---|---|
| 浏览器 | 应用 | 必需 | 系统自带 | Chrome 100+ |
| message | 平台工具 | 必需 | Skill 平台安装 | - |
| 豆包账号 | 服务 | 必需 | 豆包平台注册 | - |
| LLM API | API | 必需 | 由 Agent 内置 LLM 提供 | - |
环境准备
# 验证浏览器
google-chrome --version
# 验证 message 工具
which message
# 验证工作区目录
ls $HOME/.skill-platform/workspace/
API Key 配置
免费版需要以下配置:
| 配置项 | 环境变量 | 用途 | 获取方式 |
|---|---|---|---|
| 豆包账号 | 浏览器登录 | 访问豆包 AI 服务 | 豆包平台注册 |
| Skill 平台 Token | 平台配置 | 平台认证 | Skill 平台控制台 |
# 本技能的核心实现逻辑
# 请参考上方使用说明进行配置和调用
echo "implementation_ready"
可用性分类
- 分类:MD+EXEC(Markdown 指令 + 命令行执行 + 浏览器自动化)
- 说明:通过自然语言指令驱动 Agent 操作浏览器完成图片生成
- 离线可用:否(需要网络访问豆包服务)
- 隐私等级:中(提示词需上传至豆包服务)
版本说明
- 当前版本:1.0.0
- 版本类型:FREE(免费版)
- 升级路径:如需批量生成、多比例输出、风格预设、提示词增强、参考图生成等能力,请使用
doubao-image-gen-tool-pro
错误处理
| 错误场景 | 原因 | 处理方式 |
|---|---|---|
| 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 |
| 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 |
| 网络错误 | 连接超时或不可达 | 执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案 |
已知限制
- 需LLM支持,无LLM环境不可用
- 复杂业务场景建议结合人工经验判断
- 执行效率受模型能力与网络环境影响
示例
基本用法
输出:返回执行结果,包含操作状态和输出数据
用户: 执行核心功能
Skill: 正在执行核心功能...
Skill: 执行完成,结果如下: 操作成功
安全注意事项
| 风险类型 | 防范措施 |
|---|---|
| API密钥泄露 | 通过环境变量配置,禁止硬编码到代码或配置文件中 |
| 命令执行风险 | 仅执行白名单命令,避免拼接用户输入到命令行参数中 |
| 网络通信安全 | 使用HTTPS协议,验证SSL证书有效性 |
| 敏感数据暴露 | 输出结果中不包含密钥、令牌等敏感信息 |
使用前请确认已阅读依赖说明章节,确保运行环境满足安全要求。
核心功能
- 自动化执行: 基于指令驱动的自动化流程
- 文件处理: 支持多种文件格式的读取、解析和写入操作
- API集成: 通过标准化接口调用外部服务并处理响应
- 命令执行: 在安全沙箱中执行系统命令并收集结果
- 信息检索: 快速搜索和过滤目标数据
核心功能
- 自动化执行: 基于指令驱动的自动化流程
- 文件处理: 支持多种文件格式的读取、解析和写入操作
- API集成: 通过标准化接口调用外部服务并处理响应
- 命令执行: 在安全沙箱中执行系统命令并收集结果
- 信息检索: 快速搜索和过滤目标数据
Top skills in this category
simmer
@simmerThe prediction market interface for AI agents. Trade Polymarket and Kalshi through one API with self-custody wallets, safety rails, and smart context.
Self-Improving + Proactive Agent
@ivangdavilaSelf-reflection + Self-criticism + Self-learning + Self-organizing memory. Agent evaluates its own work, catches mistakes, and improves permanently. Use when...
YouTube Watcher
@michaelgatharaFetch and read transcripts from YouTube videos. Use when you need to summarize a video, answer questions about its content, or extract information from it.
Self Improving Agent
@xiuchengSelf-improving agent system that analyzes conversation quality, identifies improvement opportunities, and continuously optimizes response strategies.
Proactive Agent Lite
@bestrockyTransform AI agents from task-followers into proactive partners with memory architecture, reverse prompting, and self-healing patterns. Lightweight version f...