Token导航 LogoToken导航TokenDH.com
图像处理敏感数据github未标认证来源可访问clear审计异常

image-gen图像生成器

Agent Skill

用于辅助图像生成、图片编辑、视觉素材处理或图像模型工作流。它适合让 Agent 根据文本生成图片、处理背景、整理视觉提示词或调用相关图像工具。使用时需要确认输入图片、版权来源、输出格式和模型限制;涉及人物、品牌、商品或公开展示素材时,应额外核对授权、真实性和内容合规边界。

总安装

1,454

周安装

60

GitHub Stars

公开资料未说明

下载量

475
CodexClaudeCursorGemini CLI

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

3

许可证

MIT

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:image-gen(图像生成器)
来源仓库:https://github.com/infquest/vibe-ops-plugin
仓库路径:skills/image-gen
安装命令:
npx skills add https://github.com/infquest/vibe-ops-plugin --skill image-gen
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。不同来源提供的安装方式可能略有差异;本站展示可直接复制的安装命令,安装前请核对来源页面。

skills.shnpx skills
npx skills add https://github.com/infquest/vibe-ops-plugin --skill image-gen

简介

用于图像生成与视觉素材处理,适合在内容创作中根据文本提示生成图片。

  • 可调用图像模型、调整背景或优化提示词,提升视觉产出质量。
  • 通过 npx skills add 命令从 GitHub 仓库安装,需确认输出格式与版权来源。
  • 涉及人物、品牌或公开展示素材时,应额外核对授权与真实性边界。
  • image-gen 属于图像处理类 Skill,可作为该场景下的辅助能力补充。

SKILL.md

Image Generator

使用 AI 生成图片,支持多种模型和自定义选项。也支持传入图片进行二次编辑。

Prerequisites

  1. MAX_API_KEY 环境变量(Max 自动注入)
  2. Bun 1.0+(Max v0.0.27+ 内置,无需额外安装)

Instructions

你是一个 AI 图片生成助手。请按以下步骤操作:

Step 1: 检查环境变量

首先验证 MAX_API_KEY 是否已设置:

[ -n "$MAX_API_KEY" ] && echo "API_KEY_SET" || echo "API_KEY_NOT_SET"

如果未设置,告诉用户:「请在 Max 设置中配置 Max API Key。」

Step 2: 检查 Bun 安装

which bun && bun --version || echo "NOT_INSTALLED"

Bun 已内置于 Max 中,通常不需要额外安装。如果未找到,告诉用户重启 Max 应用。

Step 3: 收集用户需求

⚠️ 必须:使用 AskUserQuestion 工具收集用户的图片生成需求。不要跳过这一步。

使用 AskUserQuestion 工具收集以下信息:

  1. 输入图片(可选):是否基于现有图片进行编辑

- 选项: - "不需要 - 纯文本生成新图片 (Recommended)" - "有图片 - 我想编辑一张现有图片" - 如果用户选择编辑图片,询问图片路径

  1. 图片描述(Prompt):让用户描述想要生成/编辑的图片

- 让用户手动输入详细描述 - 如果是编辑模式,提示用户描述想要的修改效果 - 提示用户:描述越详细,生成效果越好

  1. 模型选择:选择使用哪个 AI 模型

- 选项: - "Gemini 2.5 Flash Image - Google 图片生成模型 (Recommended)" - "Seedream 4.5 - 字节跳动高质量模型"

  1. 图片比例:选择输出比例

- 选项: - "1:1 - 正方形 (Recommended)" - "4:3 - 横向" - "3:4 - 纵向" - "16:9 - 横向宽屏" - "9:16 - 纵向竖屏"

  1. 生成数量:生成几张图片?

- 选项: - "1 张 (Recommended)" - "2 张" - "4 张"

  1. 保存位置:图片保存到哪里?

- 建议默认:当前目录,文件名为 generated_image_时间戳.png - 让用户可以自定义路径

Step 4: 执行脚本

使用 skill 目录下的 image-gen.js 脚本:

bun /path/to/skills/image-gen/image-gen.js "MODEL" "PROMPT" "ASPECT_RATIO" NUM_IMAGES "OUTPUT_DIR" "INPUT_IMAGE"

参数说明:

  • MODEL: gemini-pro / seedream
  • PROMPT: 用户的图片描述
  • ASPECT_RATIO: 图片比例(1:1, 4:3, 3:4, 16:9, 9:16)
  • NUM_IMAGES: 生成数量
  • OUTPUT_DIR: 保存目录
  • INPUT_IMAGE: (可选)输入图片路径,用于图片编辑模式

示例(纯文本生成):

bun skills/image-gen/image-gen.js "gemini-pro" "一只在星空下的猫" "1:1" 1 "."

示例(图片编辑):

bun skills/image-gen/image-gen.js "gemini-pro" "把背景换成海边" "1:1" 1 "." "/path/to/input.jpg"

Step 5: 展示结果

生成完成后:

  1. 告诉用户图片保存的完整路径
  2. 显示生成的图片(如果系统支持): # macOS 上打开图片 open "OUTPUT_PATH"
  3. 报告使用的 tokens/credits(如果 API 返回)

常见问题处理

API Key 无效

  • 请在 Max 设置中检查 Max API Key 是否正确配置

生成失败

  • 检查 prompt 是否包含违规内容
  • 尝试换一个模型
  • 检查网络连接

图片打不开

  • 确认文件完整下载
  • 尝试使用其他图片查看器

示例交互

用户:帮我生成一张图片,一只在星空下的猫

助手:

  1. 检查环境变量和 Bun ✓
  2. 使用 AskUserQuestion 询问用户偏好
  3. 根据选择执行脚本
  4. 展示生成的图片

交互风格

  • 使用简单友好的语言
  • 帮助用户优化 prompt(如果描述太简单,建议添加更多细节)
  • 如果遇到错误,提供清晰的解决方案
  • 生成成功后给予积极反馈

适合场景

01

用户想查找某类 Agent Skill 时

02

需要根据任务场景推荐可安装能力包时

03

需要对比不同来源的安装命令和来源信息时

04

需要参考平台分布和安装热度时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

Claude Code

26.75%
按下载量换算127

OpenCode

25.87%
按下载量换算123

Codex

17.31%
按下载量换算82

Gemini CLI

13.38%
按下载量换算64

windsurf

8.84%
按下载量换算42

trae

3.66%
按下载量换算17

安全审计

Gen Agent Trust Hub

未通过

Socket

通过

Snyk

通过

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。

来源信息

继续浏览同类 Skills