Token导航 LogoToken导航TokenDH.com
图像处理敏感数据clawhub未标认证来源可访问clear审计通过

ernie-image-gen厄尼图像生成器

Agent Skill

用于辅助图像生成、图片编辑、视觉素材处理或图像模型工作流。它适合让 Agent 根据文本生成图片、处理背景、整理视觉提示词或调用相关图像工具。使用时需要确认输入图片、版权来源、输出格式和模型限制;涉及人物、品牌、商品或公开展示素材时,应额外核对授权、真实性和内容合规边界。

总安装

685

周安装

28

GitHub Stars

公开资料未说明

下载量

222
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:ernie-image-gen(厄尼图像生成器)
来源仓库:https://github.com/aiwork4me/ernie-image-gen
安装命令:
openclaw skills install ernie-image-gen
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install ernie-image-gen

简介

ernie-image-gen 兼容 OpenAI API 格式,调用百度 ERNIE-Image 系列模型生成图片。

  • 适合在 OpenClaw 中批量产出电商配图、信息图表或 UI 视觉提示时使用。
  • 通过 clawhub 安装,支持七种尺寸输出,需控制 token 消耗与并发请求。
  • 建议缓存高频结果,减少重复调用以提升效率与成本可控性。
  • 适用宿主包括 OpenClaw,接入前应确认版本、权限和运行环境要求。

SKILL.md

name
ernie-image
description
>-
homepage
https://github.com/AIwork4me/ernie-image-skill
metadata
openclaw
emoji
\F3A8
requires
env
primaryEnv
AI_STUDIO_API_KEY

ERNIE-Image Generation

Generate images using Baidu AI Studio's ERNIE-Image models through the OpenAI-compatible API. Two models are available:

  • ERNIE-Image-Turbo (default): Fast generation, excellent for most use cases
  • ERNIE-Image: Higher quality, slower generation for when detail matters

Both models understand Chinese prompts particularly well.

Prerequisites

  • Python 3.11+ with uv installed
  • AI_STUDIO_API_KEY environment variable set to your Baidu AI Studio access token
  • Get a token at: https://aistudio.baidu.com/account/accessToken

Generation Workflow

Step 1 -- Compose the prompt

Write a descriptive prompt (max 1024 characters, ~150 words). Chinese and English both work well. Be specific about subject, style, composition, and mood.

Good: "A golden retriever puppy sitting in a sunflower field at sunset, warm golden light, shallow depth of field, professional photography" Bad: "dog"

Step 2 -- Choose parameters

ParameterValuesDefault
modelERNIE-Image-Turbo, ERNIE-ImageERNIE-Image-Turbo
size1024x1024, 768x1376, 1376x768, 896x1200, 1200x896, 848x1264, 1264x8481024x1024
n1-41
seedany integerrandom
steps4-208
guidance1.0-7.51.0
use-peflagoff

Select size based on content: portraits and posters use vertical (768x1376, 848x1264, 896x1200), landscapes and covers use horizontal (1376x768, 1264x848, 1200x896), general use 1024x1024.

Step 3 -- Run the generation script

Execute the bundled script with uv run:

uv run {baseDir}/scripts/generate.py "<PROMPT>" --model ERNIE-Image-Turbo --size 1024x1024

For batch generation:

uv run {baseDir}/scripts/generate.py "<PROMPT>" --n 4 --output ./output_dir

For higher quality with more inference steps and stronger guidance:

uv run {baseDir}/scripts/generate.py "<PROMPT>" --model ERNIE-Image --steps 16 --guidance 3.5

For reproducible results:

uv run {baseDir}/scripts/generate.py "<PROMPT>" --seed 42

Step 4 -- Output

The script saves images as PNG files to the output directory and prints:

Saved: ernie_20260430_110100.png (1.7 MB)
MEDIA:/absolute/path/to/ernie_20260430_110100.png

The MEDIA: line enables automatic image attachment in compatible environments.

For JSON output, add --json to get structured results:

{
  "success": true,
  "model": "ERNIE-Image-Turbo",
  "files": [{"path": "/abs/path/ernie_20260430_110100.png", "size_bytes": 1715660}],
  "prompt": "...",
  "parameters": {"size": "1024x1024", "seed": 42}
}

Quick Triggers

When the user says any of these, treat the text after the trigger as the prompt and generate immediately with defaults:

  • Chinese: "生成图片:xxx" / "文生图:xxx" / "百度生图:xxx" / "ERNIE生图:xxx"
  • English: "generate image: xxx" / "ernie image: xxx" / "baidu image: xxx"

Defaults: model=ERNIE-Image-Turbo, size=1024x1024, n=1, b64_json format.

Notes

  • Images are saved locally as PNG files with MEDIA:<path> for auto-attach.
  • Chinese prompts work particularly well with ERNIE models.
  • Prompt enhancement (--use-pe) lets the model expand simple prompts into richer descriptions before generation. Enable for short prompts, disable for precise control.
  • For full API reference, model comparison, all size options, parameter details, and troubleshooting, read {baseDir}/references/api-guide.md.

适合场景

01

文本生成图片

02

图片风格化

03

产品图和创意图

04

需要 FLUX 模型时

能力概览

能力 1

调用 FLUX 图像模型

能力 2

支持文本生图和图像改写

能力 3

覆盖 LoRA 或风格适配

能力 4

适合创意视觉生成

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

77.35%
按下载量换算172

安全审计

VirusTotal

未展示

ClawScan

通过

Static analysis

通过

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills