技能imagen
I

imagen

该技能使用 Google Gemini 的图像生成模型(gemini-3-pro-image-preview)来生成图像。它支持在任何 Claude Code 会话中无缝创建图像——无论你是在构建前端 UI、编写文档,还是需要将概念进行可视化呈现。

Imagen - AI 图片生成技能

技能概述

Imagen 是一个专为 Claude Code 打造的 AI 图片生成技能,通过调用 Google Gemini 的图像生成模型,让你在编码过程中直接生成所需的图片,无需切换到其他工具。

适用场景

  1. 前端开发 开发网页或应用时,需要快速的占位图、Hero 图片或演示素材,无需等待设计师提供资源。

  2. 文档编写 为技术文档、README 或博客文章生成示意图、架构图或概念插图,让文档更直观易懂。

  3. UI 资产创作 生成应用图标、Logo 初稿、用户头像占位图等 UI 元素,加速原型设计过程。

核心功能

  1. 文本生成图片 输入简单的文字描述,即可生成对应的 AI 图像,支持自然语言提示词,无需专业的绘图技能。

  2. 跨平台支持 基于 Python 标准库实现,无需额外依赖,在 Windows、macOS 和 Linux 上都能直接运行。

  3. 灵活的输出控制 支持自定义输出路径和图片尺寸(如 2K 分辨率),生成的图片保存为 PNG 格式,方便直接用于项目。

常见问题

Imagen 技能支持哪些操作系统?

Imagen 支持 Windows、macOS 和 Linux 三大主流操作系统,只要是能运行 Python 3.6+ 的环境都可以使用。

如何配置 Gemini API Key?

需要设置环境变量 GEMINI_API_KEY,将你的 Google Gemini API 密钥配置后即可使用。获取 API Key 需要前往 Google Cloud Console 或 Gemini API 官网申请。

生成的图片是什么格式?

所有生成的图片默认保存为 PNG 格式,这是一种广泛支持的图片格式,可以直接用于网页、文档或其他项目中。

可以自定义图片尺寸吗?

可以。使用 --size 参数可以指定分辨率,例如 --size 2K 可以生成高分辨率图片,适合需要更清晰图像的场景。

Imagen 技能免费使用吗?

Imagen 技能本身是开源免费的,但底层调用的是 Google Gemini API,使用时会产生 API 调用费用,具体计费标准参考 Google Cloud 的定价。