AI图像生成-免费版

通过文本描述生成图片,支持多种比例与标准分辨率,适合个人创作者快速出图。Use when 需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于需要100%确定性的关键决策。适用于独立开发者、企业团队和自动化工作流场景。支持中文交互,无需复杂配置即开即用。输出结果可直接使用,减少二次加工成本。

天轰穿

@thcjp

What This Skill Does

Generates images from text descriptions using the Gemini Flash Image model. Supports 10 aspect ratios (1:1, 16:9, 9:16, etc.) and standard resolution output, with optional 2K for select ratios. No image editing or style transfer capabilities in the free version.

Replaces manual image creation or stock photo searches by turning text prompts into original images in seconds.

When to Use It

  • Create a 1:1 avatar for social media profiles
  • Generate a 16:9 cover image for a YouTube or TikTok video
  • Visualize a creative concept or mood board idea as an image
  • Produce a 9:16 phone wallpaper from a text description
  • Make a 3:2 horizontal photo for a blog post or presentation
  • Generate a 4:5 Instagram post image without design software

Install

$ openclaw skills install @thcjp/ai-image-gen-tool-free

核心功能: 本技能提供中文交互、化工作流场景等能力。

AI图像生成工具 - 免费版

概述

AI图像生成免费版是一款面向个人用户的文本生成图像工具。通过自然语言描述即可生成高质量图片,支持多种画幅比例与标准分辨率,无需绘画基础,几秒钟即可获得原创图像。

本版本依托 Gemini Flash Image 模型能力,提供基础的文生图功能,支持社交媒体头像、配图、创意灵感等多种场景,适合个人创作者快速产出图像内容。

核心能力

能力项免费版支持说明
文本生成图片输入描述生成图像
多比例支持1:1/3:2/16:9 等 10 种
标准分辨率基础清晰度
2K 分辨率限制部分比例支持
4K 分辨率PRO 版支持
图生图(图+文)PRO 版支持
风格转换PRO 版支持
批量生成PRO 版支持
技术实现要点:核心能力基于input_params参数与output_format配置实现,支持创建/查询/修改/删除等操作模式,通过config_options进行运行时配置。

核心功能执行

input_params参数进行配置。

输出: 返回核心功能执行的执行结果,包含操作状态和输出数据。

  • 执行此能力时使用input_params参数,支持创建/查询/导出操作

参数配置与调用

config_options参数进行配置。

输出: 返回参数配置与调用的执行结果,包含操作状态和输出数据。

  • 执行此能力时使用config_options参数,支持修改/重置/导入操作

结果处理与输出

output_format参数进行配置。

输出: 返回结果处理与输出的执行结果,包含操作状态和输出数据。

  • 执行此能力时使用output_format参数,支持导出/保存/转换操作 能力覆盖范围:本skill的核心能力覆盖以下场景关键词:通过文本描述生成、支持多种比例与标、适合个人创作者快、速出图、图像生成免费版、面向个人用户的文、本生成图像工具、文本描述生成图片、文生图、等多种比例、标准分辨率输出、满足社交媒体与基、础设计需求、多风格支持、赛博朋克、写实摄影等等。这些关键词对应description中声明的使用场景,均已在上述能力点中提供对应的操作支持。

使用场景

场景一:社交媒体头像

用户需要一个独特的社交媒体头像,生成一张 1:1 的艺术风格图片。

python3 scripts/generate_image.py \
  "一只戴着圆框眼镜的橘猫,水彩风格,柔和色调,简洁背景" \
  --model gemini-3.1-flash-image \
  --output avatar.png

场景二:短视频封面图

内容创作者为短视频制作 16:9 横版封面图。

  "未来都市夜景,霓虹灯光,赛博朋克风格,雨后湿润街道反射,电影感构图" \
  --model gemini-3.1-flash-image-16x9 \
  --output video_cover.png

场景三:创意灵感可视化

设计师希望快速将一个创意概念可视化,用于灵感记录。

  "一座漂浮在云端的图书馆,书籍如瀑布般倾泻而下,暖色调,梦幻氛围,吉卜力风格" \
  --model gemini-3.1-flash-image-3x2 \
  --output inspiration.png

不适用场景

以下场景AI图像生成-免费版不适合处理:

  • 需要100%确定性的关键决策
  • 医疗诊断
  • 法律判决

触发条件

需要AI模型调用、智能对话、Agent编排、LLM应用时使用。不适用于非本工具能力范围的需求。

快速开始

领先步:配置 API Key

export IMAGE_GEN_API_KEY="${API_KEY:?请设置环境变量}"
export IMAGE_GEN_BASE_URL="https://code.newcli.com/gemini"

第二步:执行生成命令

  "你的提示词描述" \
  --model gemini-3.1-flash-image \
  --output output.png

第三步:查看结果

生成的图片保存在 --output 指定路径,直接展示给用户即可。

示例

基础配置项说明:

# 环境变量
IMAGE_GEN_API_KEY=your_key                    # 必填
IMAGE_GEN_BASE_URL=https://code.newcli.com/gemini  # 默认值

# 常用参数组合
# 1:1 头像
--model gemini-3.1-flash-image

# 16:9 横版
--model gemini-3.1-flash-image-16x9

# 9:16 竖版(手机壁纸)
--model gemini-3.1-flash-image-9x16

# 2K 高清(部分比例)
--model gemini-3.1-flash-image-2k-16x9

可用模型(标准分辨率)

模型 ID比例适用场景
gemini-3.1-flash-image1:1社交媒体头像
gemini-3.1-flash-image-3x23:2横版照片
gemini-3.1-flash-image-2x32:3竖版海报
gemini-3.1-flash-image-4x54:5Instagram
gemini-3.1-flash-image-9x169:16手机壁纸/短视频
gemini-3.1-flash-image-16x916:9电脑壁纸/视频
gemini-3.1-flash-image-21x921:9超宽屏

优选实践

  1. 提示词要具体:描述主体、场景、光线、风格、色调,例如"一位老匠人在木工作坊中雕刻,暖黄光线,写实摄影风格"
  2. 指定艺术风格:水彩、油画、赛博朋克、吉卜力、写实摄影、中国工笔等
  3. 说明构图:视角(俯视/仰视)、景深、焦点位置
  4. 色彩指定:主色调与配色方案,如"以深红、金色、墨黑为主"
  5. 比例匹配用途:头像用 1:1,视频封面用 16:9,手机壁纸用 9:16

常见问题

Q1:生成的图片质量不够清晰?

A:免费版默认标准分辨率,可尝试使用 2K 模型(如 gemini-3.1-flash-image-2k-16x9)。如需 4K 超高清,请使用 PRO 版。

已知限制

A:建议控制在 500 字以内,过长的提示词可能影响生成效果。核心元素前置描述。

Q3:可以生成人物肖像吗?

A:可以,但请避免生成真实公众人物的肖像,以免涉及版权与肖像权问题。

Q4:生成失败怎么办?

A:检查 API Key 是否正确;确认网络可访问 API 地址;尝试简化提示词后重试。

Q5:免费版有调用次数限制吗?

A:API 调用受服务商配额限制,免费版配额较低。如需高频调用或批量生成,请使用 PRO 版。

  • 当前为免费版本,如需完整功能请升级到付费版获取全部能力

依赖说明

运行环境

  • Agent平台: 支持 SKILL.md 的任意 AI Agent(Claude Code / Cursor / Codex / Gemini CLI 等)
  • 操作系统: Windows / macOS / Linux
  • 运行时: Python 3.8+

依赖详情

依赖项类型是否必需获取方式
Gemini Image API外部 API必需服务商申请
Python 3.8+运行时必需官方安装
requestsPython 库必需pip install requests
Pillow图像处理推荐pip install Pillow

API Key 配置

  • 环境变量名: IMAGE_GEN_API_KEY
  • 附加变量: IMAGE_GEN_BASE_URL(可选,有默认值)
  • 获取方式: 通过 API 服务商申请
  • 存储建议: 写入 .env 文件或系统环境变量,避免硬编码到脚本

可用性分类

  • 分类: MD+execute(纯 Markdown 指令,核心功能需要 exec 命令行执行能力)
  • 说明: 基于Markdown的AI Skill,通过Python脚本调用外部API生成图像

错误处理

错误场景原因处理方式
配置错误参数缺失或格式错误检查依赖说明中的配置要求
运行时错误运行环境不满足确认运行环境符合依赖说明
网络错误连接超时或不可达执行ping命令测试网络连通性,检查防火墙和代理设置连接后执行ping命令测试网络连通性,检查防火墙和代理设置连接后重新执行命令,参考国内替代方案

安全注意事项

风险类型防范措施
API密钥泄露通过环境变量配置,禁止硬编码到代码或配置文件中
命令执行风险仅执行白名单命令,避免拼接用户输入到命令行参数中
网络通信安全使用HTTPS协议,验证SSL证书有效性
敏感数据暴露输出结果中不包含密钥、令牌等敏感信息

使用前请确认已阅读依赖说明章节,确保运行环境满足安全要求。

效率量化分析

操作场景手动耗时自动化耗时效率提升
文件解析与提取5-10分钟/个<5秒/个60-120x
批量文件处理(100个)8-16小时<5分钟96-192x
API调用与响应解析2-3分钟/次<1秒/次120-180x
多接口数据聚合15-30分钟<10秒90-180x
命令执行与结果收集3-5分钟/次<2秒/次90-150x
重复任务批量执行因任务而异线性缩减5-50x
错误排查与修复10-30分钟<30秒20-60x

差异化对比

对比维度本技能传统手动方式通用脚本工具
自动化程度全流程自动完全手动部分自动
错误处理内置错误恢复依赖人工经验基本try-catch
可复用性参数化配置一次性脚本模板化
安全合规内置安全检查无安全保障无安全保障
适用场景核心功能通用场景通用场景

Top skills in this category