Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

音乐生成Udio旧版

Udio v1

Udio v1 是 v1.5 之前的基线歌曲模型,当前仍作为旧结果与旧工作流的参照口径保留。

计费价格

公开资料未说明

生成模式

lyrics_to_music

历史兼容旧项目复现基线对照
音乐生成Udio稳定版

Udio v1.5

Udio v1.5 是当前仍公开保留的主力歌曲模型版本,重点提升音质、调性控制和多语言结果。

计费价格

公开资料未说明

生成模式

lyrics_to_music

高质量歌曲调性控制多语言歌曲
音乐生成Udio稳定版

Udio Allegro v1.5

Allegro v1.5 是 Udio 的更快生成分支,主打更短等待时间,同时保持与 v1.5 接近的声音质量。

计费价格

公开资料未说明

生成模式

lyrics_to_music

更快生成迭代打样高频试错
音乐生成Udio稳定版

Udio Audio Uploads

Audio Uploads 是 Udio 的自有音频引导创作能力,可基于上传音频继续扩写、重塑或延展歌曲。

计费价格

公开资料未说明

生成模式

remix

音频续写旧歌扩写片段成歌
音乐生成Udio稳定版

Udio Inpainting

Inpainting 是 Udio 的局部音乐编辑能力,适合对已有歌曲片段做定点重写和替换。

计费价格

公开资料未说明

生成模式

remix

局部修歌片段重写精修编辑
音乐生成Udio稳定版

Udio Styles

Styles 是 Udio 的风格参考工作流,可用一首或两首参考歌曲的 vibe 快速生成新歌。

计费价格

公开资料未说明

生成模式

remix

风格参考快速起稿风格混搭
音乐生成Udio稳定版

Udio Sessions

Sessions 是 Udio 的时间线编辑视图,允许围绕歌曲结构做更精确的编辑、延展与编排。

计费价格

公开资料未说明

生成模式

remix

时间线编辑精细编排延展修歌
音乐生成Udio稳定版

Udio Voices

Voices 是 Udio 的声线控制能力,可在创作时指定参考声音并用 Voice Control 引导人声表现。

计费价格

公开资料未说明

生成模式

remix

声线控制人声一致性个性化演唱
语音模型Cartesia稳定版

Sonic 3.5

Sonic 3.5 是 Cartesia 当前公开的新一代流式文本转语音模型,适合实时语音 Agent、低延迟交互和高自然度语音生成。

计费价格

公开资料未说明

输入形式

文本

实时语音 Agent低延迟 TTS高自然度语音
语音模型Cartesia稳定版

Ink-2

Ink-2 是 Cartesia 于 2026 年 7 月 9 日发布的语音识别模型,重点优化实时语音 Agent 的转写、端点检测和上下文理解。

计费价格

公开资料未说明

输入形式

音频

实时语音 Agent低延迟转写端点检测
多模态模型Reka稳定版

Reka Edge 2

Reka Edge 2 是 Reka 当前官网列出的轻量多模态模型,面向低延迟文本、图像、视频和音频理解。

输入价格

公开资料未说明

输出价格

公开资料未说明

低延迟多模态理解成本敏感
多模态模型Reka稳定版

Reka Core

Superior capabilities for complex tasks

输入价格

公开资料未说明

输出价格

公开资料未说明

复杂任务多模态问答视频理解
多模态模型Reka稳定版

Reka Flash

Fast and cost-efficient model for most tasks

输入价格

公开资料未说明

输出价格

公开资料未说明

通用助手多模态聊天成本敏感
语音模型Reka稳定版

Reka Tiny ASR

Introduction to Reka's Speech API for audio transcription and translation

计费价格

公开资料未说明

输入形式

音频

语音转写音频翻译轻量语音接口
语音模型Reka稳定版

Reka Spark

Introduction to Reka's Speech API for audio transcription and translation

计费价格

公开资料未说明

输入形式

音频

语音翻译高精度翻译语音到语音
视频生成PixVerse稳定版

PixVerse C1

C1 是 PixVerse 当前强调角色一致性、复杂镜头和长时视频能力的现役旗舰版本。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / transition / fusion_reference_to_video

角色一致性复杂镜头长时视频
视频生成PixVerse稳定版

PixVerse V6

V6 是 PixVerse 当前主力高阶视频版本,覆盖文生、图生、转场和延展等主流程。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / transition / extend

主力视频生成长时视频多段叙事
视频生成PixVerse稳定版

PixVerse V5.6

V5.6 是 PixVerse 仍公开计费的现役版本,支持音频开关并覆盖主流视频生成工作流。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / transition / fusion_reference_to_video

现役通用视频带音频视频Fusion 参考生成
视频生成PixVerse稳定版

PixVerse V5.5

V5.5 是 PixVerse 仍公开计费的多段视频版本,支持单段 / 多段和音频开关。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / transition / fusion_reference_to_video / extend

多段叙事带音频视频旧版兼容
视频生成PixVerse稳定版

PixVerse Speech Lip Sync

Speech Lip Sync 是 PixVerse 的独立视频口型同步工作流,可用外部音频或 TTS 让视频人像对口型。

计费价格

公开资料未说明

生成形式

text_to_video / video_to_video

口型同步视频配音人物说话视频