技能baoyu-danger-gemini-web
B
baoyu-danger-gemini-web
通过逆向工程Gemini网络API实现图像与文本生成。支持文本生成、提示词转图像、视觉参考图输入及多轮对话功能。适用于其他技能需调用图像生成后端、用户明确要求"用Gemini生成图像"或"Gemini文本生成",以及需要视觉AI生成能力的场景。
baoyu-danger-gemini-web
技能概述
通过逆向工程的 Gemini Web API 实现 AI 内容生成,支持文本生成、图像创建、参考图像视觉理解和多轮对话会话。
适用场景
- Claude 技能图像后端:当其他技能需要图像生成功能时,可作为后端服务集成
- 免费 AI 内容创作:需要生成文本或图像但希望避免官方 API 费用的场景
- 多模态 AI 交互:需要同时处理文本和视觉输入,并保持会话上下文的应用
核心功能
- 图像生成:通过文本描述生成图片,支持参考图像进行图生图变体创建
- 文本生成:利用 Gemini 模型进行高质量文本生成,支持多模型选择(gemini-3-pro、gemini-2.5-pro、gemini-2.5-flash)
- 会话管理:支持多轮对话,自动保存和恢复会话状态,保持对话上下文连续性
常见问题
baoyu-danger-gemini-web 是什么?
这是一个通过逆向工程 Gemini Web API 实现的 AI 生成工具,提供了文本生成、图像创建、视觉输入参考等功能,无需使用官方 API 即可调用 Gemini 模型能力。
如何使用 Gemini 生成图片?
运行 npx -y bun ${SKILL_DIR}/scripts/main.ts --prompt "你的描述" --image 输出.png 命令即可生成图片,首次使用会自动打开浏览器完成 Google 登录认证。
Gemini Web API 需要付费吗?
该技能使用逆向工程的方式调用 Gemini Web 界面,不直接使用官方付费 API。但请注意这属于非官方使用方式,首次使用需要阅读并同意相关免责声明。