AI图像生成-免费版
通过文本描述生成图片,支持多种比例与标准分辨率,适合个人创作者快速出图。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。
天轰穿
@thcjp
What This Skill Does
Generates images from text descriptions using the Gemini Flash Image model. Supports 10 aspect ratios (1:1, 16:9, 9:16, etc.) and standard resolution output, with optional 2K for select ratios. No image editing or style transfer capabilities in the free version.
Replaces manual image creation or stock photo searches by turning text prompts into original images in seconds.
When to Use It
- Create a 1:1 avatar for social media profiles
- Generate a 16:9 cover image for a YouTube or TikTok video
- Visualize a creative concept or mood board idea as an image
- Produce a 9:16 phone wallpaper from a text description
- Make a 3:2 horizontal photo for a blog post or presentation
- Generate a 4:5 Instagram post image without design software
Install
$ openclaw skills install @thcjp/ai-image-gen-tool-free核心功能: 本技能提供中文交互、化工作流场景等能力。
AI图像生成工具 - 免费版
概述
AI图像生成免费版是一款面向个人用户的文本生成图像工具。通过自然语言描述即可生成高质量图片,支持多种画幅比例与标准分辨率,无需绘画基础,几秒钟即可获得原创图像。
本版本依托 Gemini Flash Image 模型能力,提供基础的文生图功能,支持社交媒体头像、配图、创意灵感等多种场景,适合个人创作者快速产出图像内容。
核心能力
| 能力项 | 免费版支持 | 说明 |
|---|---|---|
| 文本生成图片 | 是 | 输入描述生成图像 |
| 多比例支持 | 是 | 1:1/3:2/16:9 等 10 种 |
| 标准分辨率 | 是 | 基础清晰度 |
| 2K 分辨率 | 限制 | 部分比例支持 |
| 4K 分辨率 | 否 | PRO 版支持 |
| 图生图(图+文) | 否 | PRO 版支持 |
| 风格转换 | 否 | PRO 版支持 |
| 批量生成 | 否 | PRO 版支持 |
技术实现要点:核心能力基于input_params参数与output_format配置实现,支持创建/查询/修改/删除等操作模式,通过config_options进行运行时配置。 |
核心功能执行
用input_params参数进行配置。
输出: 返回核心功能执行的执行结果,包含操作状态和输出数据。
- 执行此能力时使用
input_params参数,支持创建/查询/导出操作
参数配置与调用
用config_options参数进行配置。
输出: 返回参数配置与调用的执行结果,包含操作状态和输出数据。
- 执行此能力时使用
config_options参数,支持修改/重置/导入操作
结果处理与输出
用output_format参数进行配置。
输出: 返回结果处理与输出的执行结果,包含操作状态和输出数据。
- 执行此能力时使用
output_format参数,支持导出/保存/转换操作 能力覆盖范围:本skill的核心能力覆盖以下场景关键词:通过文本描述生成、支持多种比例与标、适合个人创作者快、速出图、图像生成免费版、面向个人用户的文、本生成图像工具、文本描述生成图片、文生图、等多种比例、标准分辨率输出、满足社交媒体与基、础设计需求、多风格支持、赛博朋克、写实摄影等等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持。
使用场景
场景一:社交媒体头像
用户需要一个独特的社交媒体头像,生成一张 1:1 的艺术风格图片。
python3 scripts/generate_image.py \
"一只戴着圆框眼镜的橘猫,水彩风格,柔和色调,简洁背景" \
--model gemini-3.1-flash-image \
--output avatar.png
场景二:短视频封面图
内容创作者为短视频制作 16:9 横版封面图。
"未来都市夜景,霓虹灯光,赛博朋克风格,雨后湿润街道反射,电影感构图" \
--model gemini-3.1-flash-image-16x9 \
--output video_cover.png
场景三:创意灵感可视化
设计师希望快速将一个创意概念可视化,用于灵感记录。
"一座漂浮在云端的图书馆,书籍如瀑布般倾泻而下,暖色调,梦幻氛围,吉卜力风格" \
--model gemini-3.1-flash-image-3x2 \
--output inspiration.png
不适用场景
以下场景AI图像生成-免费版不适合处理:
- 需要100%确定性的关键决策
- 医疗诊断
- 法律判决
触发条件
需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于非本工具能力范围的需求。
快速开始
领先步:配置 API Key
export IMAGE_GEN_API_KEY="${API_KEY:?请设置环境变量}"
export IMAGE_GEN_BASE_URL="https://code.newcli.com/gemini"
第二步:执行生成命令
"你的提示词描述" \
--model gemini-3.1-flash-image \
--output output.png
第三步:查看结果
生成的图片保存在 --output 指定路径,直接展示给用户即可。
示例
基础配置项说明:
# 环境变量
IMAGE_GEN_API_KEY=your_key # 必填
IMAGE_GEN_BASE_URL=https://code.newcli.com/gemini # 默认值
# 常用参数组合
# 1:1 头像
--model gemini-3.1-flash-image
# 16:9 横版
--model gemini-3.1-flash-image-16x9
# 9:16 竖版(手机壁纸)
--model gemini-3.1-flash-image-9x16
# 2K 高清(部分比例)
--model gemini-3.1-flash-image-2k-16x9
可用模型(标准分辨率)
| 模型 ID | 比例 | 适用场景 |
|---|---|---|
| gemini-3.1-flash-image | 1:1 | 社交媒体头像 |
| gemini-3.1-flash-image-3x2 | 3:2 | 横版照片 |
| gemini-3.1-flash-image-2x3 | 2:3 | 竖版海报 |
| gemini-3.1-flash-image-4x5 | 4:5 | |
| gemini-3.1-flash-image-9x16 | 9:16 | 手机壁纸/短视频 |
| gemini-3.1-flash-image-16x9 | 16:9 | 电脑壁纸/视频 |
| gemini-3.1-flash-image-21x9 | 21:9 | 超宽屏 |
优选实践
- 提示词要具体:描述主体、场景、光线、风格、色调,例如"一位老匠人在木工作坊中雕刻,暖黄光线,写实摄影风格"
- 指定艺术风格:水彩、油画、赛博朋克、吉卜力、写实摄影、中国工笔等
- 说明构图:视角(俯视/仰视)、景深、焦点位置
- 色彩指定:主色调与配色方案,如"以深红、金色、墨黑为主"
- 比例匹配用途:头像用 1:1,视频封面用 16:9,手机壁纸用 9:16
常见问题
Q1:生成的图片质量不够清晰?
A:免费版默认标准分辨率,可尝试使用 2K 模型(如 gemini-3.1-flash-image-2k-16x9)。如需 4K 超高清,请使用 PRO 版。
已知限制
A:建议控制在 500 字以内,过长的提示词可能影响生成效果。核心元素前置描述。
Q3:可以生成人物肖像吗?
A:可以,但请避免生成真实公众人物的肖像,以免涉及版权与肖像权问题。
Q4:生成失败怎么办?
A:检查 API Key 是否正确;确认网络可访问 API 地址;尝试简化提示词后重试。
Q5:免费版有调用次数限制吗?
A:API 调用受服务商配额限制,免费版配额较低。如需高频调用或批量生成,请使用 PRO 版。
- 当前为免费版本,如需完整功能请升级到付费版获取全部能力
依赖说明
运行环境
- Agent平台: 支持 SKILL.md 的任意 AI Agent(Claude Code / Cursor / Codex / Gemini CLI 等)
- 操作系统: Windows / macOS / Linux
- 运行时: Python 3.8+
依赖详情
| 依赖项 | 类型 | 是否必需 | 获取方式 |
|---|---|---|---|
| Gemini Image API | 外部 API | 必需 | 服务商申请 |
| Python 3.8+ | 运行时 | 必需 | 官方安装 |
| requests | Python 库 | 必需 | pip install requests |
| Pillow | 图像处理 | 推荐 | pip install Pillow |
API Key 配置
- 环境变量名:
IMAGE_GEN_API_KEY - 附加变量:
IMAGE_GEN_BASE_URL(可选,有默认值) - 获取方式: 通过 API 服务商申请
- 存储建议: 写入
.env文件或系统环境变量,避免硬编码到脚本
可用性分类
- 分类: MD+execute(纯 Markdown 指令,核心功能需要 exec 命令行执行能力)
- 说明: 基于Markdown的AI Skill,通过Python脚本调用外部API生成图像
错误处理
| 错误场景 | 原因 | 处理方式 |
|---|---|---|
| 配置错误 | 参数缺失或格式错误 | 检查依赖说明中的配置要求 |
| 运行时错误 | 运行环境不满足 | 确认运行环境符合依赖说明 |
| 网络错误 | 连接超时或不可达 | 执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案 |
安全注意事项
| 风险类型 | 防范措施 |
|---|---|
| API密钥泄露 | 通过环境变量配置,禁止硬编码到代码或配置文件中 |
| 命令执行风险 | 仅执行白名单命令,避免拼接用户输入到命令行参数中 |
| 网络通信安全 | 使用HTTPS协议,验证SSL证书有效性 |
| 敏感数据暴露 | 输出结果中不包含密钥、令牌等敏感信息 |
使用前请确认已阅读依赖说明章节,确保运行环境满足安全要求。
效率量化分析
| 操作场景 | 手动耗时 | 自动化耗时 | 效率提升 |
|---|---|---|---|
| 文件解析与提取 | 5-10分钟/个 | <5秒/个 | 60-120x |
| 批量文件处理(100个) | 8-16小时 | <5分钟 | 96-192x |
| API调用与响应解析 | 2-3分钟/次 | <1秒/次 | 120-180x |
| 多接口数据聚合 | 15-30分钟 | <10秒 | 90-180x |
| 命令执行与结果收集 | 3-5分钟/次 | <2秒/次 | 90-150x |
| 重复任务批量执行 | 因任务而异 | 线性缩减 | 5-50x |
| 错误排查与修复 | 10-30分钟 | <30秒 | 20-60x |
差异化对比
| 对比维度 | 本技能 | 传统手动方式 | 通用脚本工具 |
|---|---|---|---|
| 自动化程度 | 全流程自动 | 完全手动 | 部分自动 |
| 错误处理 | 内置错误恢复 | 依赖人工经验 | 基本try-catch |
| 可复用性 | 参数化配置 | 一次性脚本 | 模板化 |
| 安全合规 | 内置安全检查 | 无安全保障 | 无安全保障 |
| 适用场景 | 核心功能 | 通用场景 | 通用场景 |
Top skills in this category
Nano Banana Pro
@steipeteGenerate/edit images with Nano Banana Pro (Gemini 3 Pro Image). Use for image create/modify requests incl. edits. Supports text-to-image + image-to-image; 1K/2K/4K; use --input-image.
AdMapix
@fly0pantsAdMapix raw data layer for ad creatives, apps, rankings, downloads/revenue, and market metadata. Returns structured JSON from the AdMapix API; the calling ag...
YouTube Watcher
@michaelgatharaFetch and read transcripts from YouTube videos. Use when you need to summarize a video, answer questions about its content, or extract information from it.
SuperDesign
@mpociotExpert frontend design guidelines for creating beautiful, modern UIs. Use when building landing pages, dashboards, or any user interface.
Video Frames
@steipeteExtract frames or short clips from videos using ffmpeg.