Token导航 LogoToken导航TokenDH.com
图像处理敏感数据clawhub未标认证来源可访问clear审计提醒

bigmodel-image-video大模型图像视频

Agent Skill

用于辅助图像生成、图片编辑、视觉素材处理或图像模型工作流。它适合让 Agent 根据文本生成图片、处理背景、整理视觉提示词或调用相关图像工具。使用时需要确认输入图片、版权来源、输出格式和模型限制;涉及人物、品牌、商品或公开展示素材时,应额外核对授权、真实性和内容合规边界。

总安装

2,446

周安装

104

GitHub Stars

公开资料未说明

下载量

857
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:bigmodel-image-video(大模型图像视频)
来源仓库:https://github.com/156554395/bigmodel-image-video
安装命令:
openclaw skills install bigmodel-image-video
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install bigmodel-image-video

简介

用于辅助图像生成和视频制作流程。bigmodel-image-video 属于图像处理类 Skill,可作为该场景下的辅助能力补充。

  • 适合在 OpenClaw 中需要创建视觉内容时使用。
  • 可结合来源仓库和 README 核验具体用法,安装前需确认权限和维护状态。
  • 建议检查是否会触发联网、命令执行或文件读写操作。
  • 适用于使用 BigModel API 生成高质量图片和视频的场景。

SKILL.md

name
bigmodel-image-video
description
使用 BigModel (CogView/CogVideoX) API 生成高质量图片和视频。当用户需要"生成图片"、"制作视频"、"AI 绘画"、"创建封面"、"设计海报"、"视觉内容生成"、或任何需要创建图像/视频内容的场景时使用此技能。即使没有明确提到"生成",只要用户需要创建、设计或制作视觉内容(如小说封面、产品图片、宣传图、短视频等),都应该主动使用此技能。

BigModel 生成图片和视频

使用智谱 AI 的 BigModel API 生成高质量图片和视频。支持单张/批量图片生成、视频生成(含 AI 音频)。


🚀 快速开始

1. 设置 API Key

必需步骤 - 只需设置一次:

# 临时设置(当前会话)
export BIGMODEL_API_KEY=your_api_key_here

# 永久设置(推荐)
echo 'export BIGMODEL_API_KEY=your_api_key_here' >> ~/.zshrc
source ~/.zshrc
获取 API Key:访问 智谱 AI BigModel 开放平台

2. 快速使用

最简单的方式 - 使用提供的脚本:

# 生成图片
python scripts/generate.py "一只可爱的橘猫"

# 生成视频
python scripts/generate.py "海边日落" --video

# 批量生成
python scripts/generate.py "日出 日落 星空 彩虹" --batch

# 查看所有选项
python scripts/generate.py --help

编程方式 - 在 Python 代码中使用:

import sys
sys.path.insert(0, '.claude/skills/image-video-generation/lib')

from image_video import generate_image

result = generate_image(prompt="描述内容")
print(result["data"][0]["url"])

📖 使用场景与示例

场景 1:小说/书籍封面

# 武侠小说封面(竖版)
python scripts/generate.py "中国武侠小说封面,水墨画风格,远山如黛,云雾缭绕,一把长剑插在岩石上,月光洒下" --size 1024x1792

# 言情小说封面
python scripts/generate.py "浪漫的粉色花瓣飘落,温柔的夕阳,温暖的色调" --size 1024x1792

# 科幻小说封面
python scripts/generate.py "未来城市,霓虹灯光,赛博朋克风格,高科技感" --size 1024x1792

场景 2:社交媒体内容

# 小红书风格图片
python scripts/generate.py "清新文艺风格,自然光线,极简构图,高饱和度"

# 朋友圈配图
python scripts/generate.py "生活记录,温馨日常,柔和光线"

# 头像生成
python scripts/generate.py "可爱的卡通风格猫咪头像,简洁背景"

场景 3:电商产品图

# 产品展示
python scripts/generate.py "白色背景上的蓝色运动鞋,专业产品摄影,柔和光线" --quality hd

# 场景展示
python scripts/generate.py "产品放在木质桌面上,温馨的家居环境,自然光"

场景 4:短视频制作

# 5秒短视频
python scripts/generate.py "一朵花在阳光下缓缓开放" --video --duration 5

# 10秒高质量视频
python scripts/generate.py "城市夜景,车流穿梭,灯光流动" --video --duration 10 --quality hd

场景 5:批量生成

# 批量生成不同风格的图片
python scripts/generate.py "日出时的山景 蓝色大海的海滩 秋天的森林小路 雪后的村庄" --batch

# 批量生成产品变体
python scripts/generate.py "红色款产品 蓝色款产品 黑色款产品 白色款产品" --batch

🎯 参数选择指南

图片模型选择

模型速度质量适用场景推荐指数
cogview-3-flash⚡⚡⚡⭐⭐⭐快速测试、大量生成、预览🌟🌟🌟
cogview-4-250304⚡⚡⭐⭐⭐⭐日常使用、平衡质量与速度🌟🌟🌟🌟
cogview-4⭐⭐⭐⭐⭐专业级、高质量输出🌟🌟🌟🌟🌟

建议:

  • 快速测试 → cogview-3-flash
  • 日常使用 → cogview-4-250304
  • 最终输出 → cogview-4 + --quality hd

视频模型选择

模型速度质量适用场景推荐指数
cogvideox-flash⚡⚡⚡⭐⭐⭐快速预览、测试效果🌟🌟🌟
cogvideox-2⚡⚡⭐⭐⭐⭐标准视频、日常使用🌟🌟🌟🌟
cogvideox-3⭐⭐⭐⭐⭐高质量长视频🌟🌟🌟🌟🌟

建议:

  • 快速测试 → cogvideox-flash
  • 日常使用 → cogvideox-2
  • 高质量输出 → cogvideox-3

尺寸选择

尺寸比例适用场景
1024x10241:1正方形、头像、社交媒体
1024x17929:16竖版、封面、海报
1792x102416:9横版、横幅、风景

💡 Prompt 编写技巧

好的 Prompt 特征

具体明确 - 描述主体、风格、场景 ✅ 细节丰富 - 包含光线、角度、氛围 ✅ 风格明确 - 指定艺术风格、质量要求

示例对比

❌ 不好:一只猫

✅ 好:一只橘色的短毛猫,坐在窗台上晒太阳,温暖的下午光线,柔和的景深效果,专业摄影

常用风格关键词

风格类:

  • 水墨画、油画、水彩、素描、卡通、写实
  • 赛博朋克、极简主义、复古、现代、传统

光线类:

  • 自然光、柔和光线、强烈对比、逆光、侧光

氛围类:

  • 温馨、神秘、浪漫、科技感、清新、厚重

质量类:

  • 专业摄影、高清、8K、电影级、精细细节

⚙️ 高级用法

直接使用 Python API

import sys
sys.path.insert(0, '.claude/skills/image-video-generation/lib')

from image_video import generate_image, batch_generate_images, generate_video, wait_for_video

# 单张图片
result = generate_image(
    prompt="描述内容",
    model="cogview-3-flash",
    quality="standard",
    size="1024x1024",
)
url = result["data"][0]["url"]

# 批量图片
prompts = ["描述1", "描述2", "描述3"]
results = batch_generate_images(prompts, max_concurrent=3)

# 视频生成
video = generate_video(prompt="描述内容", duration=5)
task_id = video["id"]
final = wait_for_video(task_id)
video_url = final["video_result"][0]["url"]

自定义并发控制

批量生成时控制并发数以优化性能:

results = batch_generate_images(
    prompts,
    max_concurrent=5  # 增加并发数(建议不超过 5)
)

📚 完整参考文档

详细的 API 文档和更多示例请参考:

  • 完整 API 参考:见 lib/image_video.py 中的函数文档
  • 示例代码:见 examples/ 目录
  • README:见 README.md 获取快速入门

❓ 故障排除

常见问题

Q: 提示 "需要设置 BIGMODEL_API_KEY 环境变量"

  • A: 未设置 API Key,参考"快速开始"第1步设置

Q: 生成速度很慢

  • A: 尝试使用 cogview-3-flashcogvideox-flash 模型

Q: 视频生成失败

  • A: 简化 prompt 或更换模型,检查网络连接

Q: 批量生成时中断

  • A: 降低并发数,使用 --concurrent 2

Q: 图片质量不够高

  • A: 使用 --quality hdcogview-4 模型

获取帮助

# 查看脚本帮助
python scripts/generate.py --help

# 测试 API Key 是否有效
python scripts/generate.py "test"  # 如果有效会生成测试图片

🎯 最佳实践

  1. 先快速测试 - 使用 flash 模型快速验证效果
  2. 再精细调整 - 满意后用高质量模型生成最终版本
  3. 保存好 Prompt - 记录有效的 prompt 供后续复用
  4. 批量处理 - 相似需求的图片使用批量生成
  5. 合理选择尺寸 - 根据用途选择合适的尺寸比例

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

76.76%
按下载量换算658

安全审计

VirusTotal

通过

ClawScan

可疑

Static analysis

通过

权限和风险

敏感数据

该 Skill 可能接触密钥、Token、环境变量或敏感配置,应进入高风险复核队列,默认不自动发布。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills