Token导航 LogoToken导航TokenDH.com
图像处理敏感数据clawhub未标认证来源可访问clear审计提醒

kay-image凯图片

Agent Skill

用于辅助图像生成、图片编辑、视觉素材处理或图像模型工作流。它适合让 Agent 根据文本生成图片、处理背景、整理视觉提示词或调用相关图像工具。使用时需要确认输入图片、版权来源、输出格式和模型限制;涉及人物、品牌、商品或公开展示素材时,应额外核对授权、真实性和内容合规边界。

总安装

3,340

周安装

142

GitHub Stars

1

下载量

1,170
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:kay-image(凯图片)
来源仓库:https://github.com/papayalove/kay-image
安装命令:
openclaw skills install kay-image
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install kay-image

简介

AI 图片生成与理解工具 - 支持文生图、图生图、图片理解、视频理解。 基于 KIE AI API,支持 4K 输出、多种宽高比和参考图。 **所需凭证**: 需要 KIE_API_KEY 环境变量(从 https://kie.ai/ 获取)

SKILL.md

name
kay-image
description
|
metadata
openclaw
requires
env
bins
[]
emoji
🎨

Kay Image - AI 图片生成与理解

基于 KIE AI API 的图片生成与理解工具。

⚠️ 必需凭证

使用本工具前,必须配置 API Key:

获取 KIE API Key

  1. 访问 https://kie.ai/
  2. 注册并登录账号
  3. 进入控制台 → API 管理
  4. 创建 API Key 并复制

配置环境变量

export KIE_API_KEY="your-kie-api-key-here"

或在 skill 目录创建 .env 文件:

# 创建 .env 文件
nano skills/kay-image/.env

.env 文件内容:

KIE_API_KEY=your-kie-api-key-here

注意: 没有 API Key 将无法使用本工具的任何功能。


特性

  • 文生图: 根据文本描述生成图片
  • 图生图: 基于参考图进行编辑/变换
  • 图片理解: 分析图片内容(使用 GPT-5/Gemini)
  • 视频理解: 分析视频内容(使用 Gemini)
  • 多分辨率: 支持 1K/2K/4K 输出
  • 多宽高比: 支持 1:1, 3:4, 4:3, 9:16, 16:9, 21:9 等

使用方法

基本文生图

kay-image --prompt "一只可爱的橘猫在草地上玩耍" --output cat.png

指定宽高比和分辨率

kay-image --prompt "上海外滩夜景" --output shanghai.png --ar 16:9 --resolution 2K

图生图

kay-image --prompt "转换成动漫风格" --input https://example.com/photo.jpg --output anime.png

图片理解

kay-image --understand --image https://example.com/photo.jpg --prompt "描述这张图片"

视频理解

kay-image --understand --video https://example.com/video.mp4 --prompt "分析这个视频"

参数说明

参数简写说明默认值
--prompt-p提示词-
--output-o输出路径-
--input-i参考图路径-
--ar-宽高比1:1
--resolution-r分辨率1K
--understand-u理解模式false
--image-图片路径-
--video-视频路径-

环境变量

变量名必需说明
KIE_API_KEY✅ 是KIE AI API 密钥
KIE_UNDERSTANDING_API_KEY❌ 否理解功能 API 密钥(默认使用 KIE_API_KEY)
LAOZHANG_API_KEY❌ 否LaoZhang API 密钥(可选)

价格参考

  • 1K 图片: ~$0.04
  • 2K 图片: ~$0.06
  • 4K 图片: ~$0.09
  • 图片理解: ~$0.005-0.01/张

支持的宽高比

  • 1:1 - 正方形
  • 3:4 - 小红书/Instagram 竖版
  • 4:3 - 标准横版
  • 9:16 - 手机竖屏
  • 16:9 - 宽屏
  • 21:9 - 超宽屏

示例

生成小红书封面

kay-image -p "清新风格护肤品封面,粉色渐变背景" -o cover.png --ar 3:4 -r 2K

生成头像

kay-image -p "动漫风格女生头像,粉色头发" -o avatar.png --ar 1:1

图片风格迁移

kay-image -p "转换成油画风格" -i photo.jpg -o painting.png

OCR 文字提取

kay-image -u --image document.jpg --prompt "提取所有文字"

脚本位置

${SKILL_DIR}/scripts/main.ts


注意事项

  • 视频理解: 仅 Gemini 模型支持
  • 图片格式: 支持 JPG、PNG、WebP
  • 视频格式: 支持 MP4、MOV
  • 文件大小: 建议图片 < 10MB,视频 < 100MB

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

90.67%
按下载量换算1,061

安全审计

VirusTotal

通过

ClawScan

可疑

Static analysis

可疑

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills