Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

语音模型Reka稳定版

Reka Tiny ASR

Introduction to Reka's Speech API for audio transcription and translation

计费价格

公开资料未说明

输入形式

音频

语音转写音频翻译轻量语音接口
语音模型Reka稳定版

Reka Spark

Introduction to Reka's Speech API for audio transcription and translation

计费价格

公开资料未说明

输入形式

音频

语音翻译高精度翻译语音到语音
视频生成PixVerse稳定版

PixVerse C1

C1 是 PixVerse 当前强调角色一致性、复杂镜头和长时视频能力的现役旗舰版本。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / transition / fusion_reference_to_video

角色一致性复杂镜头长时视频
视频生成PixVerse稳定版

PixVerse V6

V6 是 PixVerse 当前主力高阶视频版本,覆盖文生、图生、转场和延展等主流程。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / transition / extend

主力视频生成长时视频多段叙事
视频生成PixVerse稳定版

PixVerse V5.6

V5.6 是 PixVerse 仍公开计费的现役版本,支持音频开关并覆盖主流视频生成工作流。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / transition / fusion_reference_to_video

现役通用视频带音频视频Fusion 参考生成
视频生成PixVerse稳定版

PixVerse V5.5

V5.5 是 PixVerse 仍公开计费的多段视频版本,支持单段 / 多段和音频开关。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / transition / fusion_reference_to_video / extend

多段叙事带音频视频旧版兼容
视频生成PixVerse稳定版

PixVerse V5

V5 是 PixVerse 仍公开保留的旧主力版本,适合兼顾旧项目兼容和较低复杂度的视频生成。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / transition / fusion_reference_to_video / extend / effects

旧项目兼容通用视频Fusion 参考生成
视频生成PixVerse旧版

PixVerse V4.5

V4.5 是 PixVerse 仍公开保留的 legacy 视频版本,可作为旧链路对照和兼容型号。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / transition / fusion_reference_to_video / extend / effects

历史兼容旧链路对照Fusion 参考生成
视频生成PixVerse旧版

PixVerse V4

V4 是 PixVerse 仍公开保留的 legacy 视频版本,主要用于旧项目和历史结果兼容。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / transition / extend / effects

历史兼容旧项目维护旧版视频结果对照
视频生成PixVerse旧版

PixVerse V3.5

V3.5 是 PixVerse 当前仍公开可选的最早一批 legacy 视频版本,用于老链路兼容。

计费价格

公开资料未说明

生成形式

text_to_video / image_to_video / transition / extend / effects

历史兼容最旧链路旧结果复现
视频生成PixVerse稳定版

PixVerse Speech Lip Sync

Speech Lip Sync 是 PixVerse 的独立视频口型同步工作流,可用外部音频或 TTS 让视频人像对口型。

计费价格

公开资料未说明

生成形式

text_to_video / video_to_video

口型同步视频配音人物说话视频
语音模型Cartesia稳定版

Sonic-3

Sonic-3 是 Cartesia 当前最新的流式 TTS 主力模型,强调更自然的表达、更细的情绪与速度控制,以及实时语音交互。

计费价格

公开资料未说明

输入形式

文本

实时语音 Agent电话机器人高自然度语音
语音模型Cartesia旧版

Sonic-2

Sonic-2 是 Cartesia 上一代主力流式 TTS 模型,当前仍公开提供给兼容旧链路和历史项目使用。

计费价格

公开资料未说明

输入形式

文本

旧链路兼容实时语音历史项目维护
语音模型Cartesia旧版

Sonic-Turbo

Sonic-Turbo 是 Cartesia 公开保留的更低时延老型号,适合强实时、成本更敏感的语音交互。

计费价格

公开资料未说明

输入形式

文本

极低时延语音对话成本敏感实时语音
语音模型Cartesia旧版

Sonic

Sonic 是 Cartesia 第一代流式 TTS 模型,当前仅适合老项目兼容和历史结果对照。

计费价格

公开资料未说明

输入形式

文本

历史兼容旧项目维护老链路对照
语音模型Cartesia稳定版

Ink-Whisper

Ink-Whisper 是 Cartesia 当前公开主推的语音转写模型,支持 base model 自动路由到最新快照,也支持固定快照版本。

计费价格

公开资料未说明

输入形式

音频

实时转写批量转写多语言语音识别
语音模型Cartesia稳定版

Voice Changer

Voice Changer 是 Cartesia 的语音变声工作流,可保留输入语调与节奏,只替换输出说话人的声音。

计费价格

公开资料未说明

输入形式

音频

变声配音替换保留语调
语音模型Cartesia稳定版

Infilling

Infilling 是 Cartesia 的语音补写工作流,可在已有音频上下文里插入新文本,并尽量保持音色与节奏连续。

计费价格

公开资料未说明

输入形式

音频 / 文本

语音编辑补写台词已有音频修补
图像生成Adobe稳定版

Firefly Generate Image

Adobe Firefly 的标准图片生成能力,适合营销图、插画和多地区创意素材生成。

计费价格

公开资料未说明

生成形式

text_to_image

标准文生图营销素材多地区创意图
图像生成Adobe稳定版

Adobe Firefly Image Model 5

Adobe Firefly Image Model 5 是 Adobe 于 2026 年 4 月公开的新一代图像生成模型,重点提升真实感和细节表现,并支持新版 Generate Image API。

计费价格

公开资料未说明

生成形式

text_to_image / image_to_image

真实感图像营销素材商业创意