Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

视频生成Runway稳定版

Runway Gen-4 Aleph

Runway 当前公开的 Gen-4 Aleph 视频重绘模型,适合基于现有视频做风格或内容变换。

计费价格

公开资料未说明

生成形式

video_to_video

视频重绘镜头改造创意后期
视频生成Runway旧版

Runway Gen-3 Alpha Turbo

Runway 仍在官方价格页、用量限制页和 API schema 中公开保留的 Gen-3 Alpha Turbo 视频模型。

计费价格

公开资料未说明

生成形式

image_to_video

历史兼容旧链路维护低成本视频
视频生成Runway稳定版

Runway Act Two

Runway 当前公开的角色表演控制模型,可用参考视频驱动角色的表情和肢体动作。

计费价格

公开资料未说明

生成形式

character_performance

角色驱动表演迁移数字人视频
视频生成Runway稳定版

Runway GWM-1 Avatars

Runway Characters 使用的 GWM-1 头像视频模型,支持文本或音频驱动的会话式数字人输出。

计费价格

公开资料未说明

生成形式

avatar_video / realtime_avatar

数字人客服品牌角色实时对话
视频生成NVIDIA稳定版

Cosmos H Dreams

Cosmos H Dreams 是 NVIDIA 于 2026 年 7 月发布的交互式视频世界模型,面向医疗机器人仿真、策略评估和 Physical AI。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / video_to_video

视频世界模型机器人仿真Physical AI
视频生成NVIDIA稳定版

Cosmos 3 Nano

Cosmos 3 Nano 是 NVIDIA 面向 Physical AI 的物理感知视频生成模型,支持文本或图像提示生成物理一致视频。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video

视频生成Physical AI仿真数据
多模态模型NVIDIA稳定版

Cosmos 3 Nano Reasoner

Cosmos 3 Nano Reasoner 是 NVIDIA 面向视频和图像物理世界理解的视觉语言推理模型。

输入价格

公开资料未说明

输出价格

公开资料未说明

视频理解物理世界推理Physical AI
多模态模型NVIDIA预览版

Nemotron 3 Nano Omni Reasoning

Nemotron 3 Nano Omni Reasoning 是 NVIDIA 面向全模态推理的模型,支持图像、视频、语音和文本理解,适合多模态 Agent 与复杂场景分析。

输入价格

公开资料未说明

输出价格

公开资料未说明

多模态推理视频理解语音理解
视频生成Luma稳定版

Luma Ray3.2

Ray3.2 是 Luma 面向专业视频工作流的新一代视频模型,强调多关键帧、视频改写、动作迁移、角色一致性和 1080p 输出。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / video_modify / video_reframe

视频生成视频编辑角色一致性
视频生成Luma稳定版

Luma Ray 2

Luma 当前主力 Ray 2 视频模型,适合强调镜头运动、自然动态和成片质量的视频生成。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / video_modify / video_reframe

高质量视频镜头运动概念短片
视频生成Luma稳定版

Luma Ray Flash 2

Luma 当前公开的 Ray Flash 2 视频模型,主打更快生成速度和更低单价。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / video_modify / video_reframe

高性价比视频快速出片批量创作
图像生成Stability AI即将下线

Stable Video Diffusion API

Stable Video Diffusion API 已被官方下线,当前仅保留历史记录与迁移说明。

计费价格

公开资料未说明

生成形式

image_to_video

历史链路排查退役模型记录迁移梳理
语音模型Pika稳定版

Pika Soundtrack

Pika Soundtrack 是 Pika 于 2026 年 8 月发布的视频配乐生成模型,可根据视频内容生成同步的音乐和声音设计。

计费价格

公开资料未说明

输入形式

文本 / 视频

视频配乐声音设计音画同步
多模态模型小米稳定版

MiMo-V2.5

MiMo 当前主力全模态理解模型,支持图像、视频、音频与文本输入,并具备原生 Agent 执行能力和 1M 上下文。

输入价格

¥2.80 / 1M Tokens

输出价格

¥14.00 / 1M Tokens

多模态问答Agent内容理解
多模态模型Microsoft稳定版

Mage-VL

Mage-VL 是 Microsoft 发布的高效流式多模态基础模型,面向视频理解和连续视觉语言交互。

输入价格

公开资料未说明

输出价格

公开资料未说明

视频理解流式多模态视觉语言
视频生成Pika稳定版

Pika 2.5

Pika 当前公开主力视频模型,覆盖文生视频、图生视频与 Pikaframes 多关键帧工作流。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / keyframe_video

通用视频生成关键帧控制创作者短片
视频生成Pika稳定版

Pika Turbo

Pika 当前公开的 Turbo 视频型号,主要用于 Pikascenes、Pikadditions、Pikaswaps 与 Pikatwists 等高性价比工作流。

计费价格

公开资料未说明

生成形式

scene_video / addition_video / swap_video / twist_video

高性价比视频快速出片视频特效玩法
视频生成Pika稳定版

Pika Pro

Pika 当前公开的 Pro 视频型号,偏向更高质量的视频编辑、替换和扭转效果。

计费价格

公开资料未说明

生成形式

addition_video / swap_video / twist_video / template_video

高质量视频编辑角色替换重度特效
视频生成Pika稳定版

Pikaformance

Pika 当前公开的表演驱动视频模型,适合音频驱动的人像表演与角色演绎视频。

计费价格

公开资料未说明

生成形式

performance_video

数字人表演音频驱动视频角色口播
视频生成华为盘古稳定版

Pangu-MM-M2-Text2Video

2025年4月发布的版本,支持16:9、9:16、1:1、4:3、3:4等5种长宽比、时长5s的视频生成,需要8个推理单元部署。

计费价格

公开资料未说明

生成形式

text_to_video

视频生成宣传内容企业接入