Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

视频生成Pika稳定版

Pika Pro

Pika 当前公开的 Pro 视频型号,偏向更高质量的视频编辑、替换和扭转效果。

计费价格

公开资料未说明

生成形式

addition_video / swap_video / twist_video / template_video

高质量视频编辑角色替换重度特效
视频生成Pika稳定版

Pikaformance

Pika 当前公开的表演驱动视频模型,适合音频驱动的人像表演与角色演绎视频。

计费价格

公开资料未说明

生成形式

performance_video

数字人表演音频驱动视频角色口播
音乐生成Udio旧版

Udio v1

Udio v1 是 v1.5 之前的基线歌曲模型,当前仍作为旧结果与旧工作流的参照口径保留。

计费价格

公开资料未说明

生成模式

lyrics_to_music

历史兼容旧项目复现基线对照
音乐生成Udio稳定版

Udio v1.5

Udio v1.5 是当前仍公开保留的主力歌曲模型版本,重点提升音质、调性控制和多语言结果。

计费价格

公开资料未说明

生成模式

lyrics_to_music

高质量歌曲调性控制多语言歌曲
音乐生成Udio稳定版

Udio Allegro v1.5

Allegro v1.5 是 Udio 的更快生成分支,主打更短等待时间,同时保持与 v1.5 接近的声音质量。

计费价格

公开资料未说明

生成模式

lyrics_to_music

更快生成迭代打样高频试错
音乐生成Udio稳定版

Udio Audio Uploads

Audio Uploads 是 Udio 的自有音频引导创作能力,可基于上传音频继续扩写、重塑或延展歌曲。

计费价格

公开资料未说明

生成模式

remix

音频续写旧歌扩写片段成歌
音乐生成Udio稳定版

Udio Inpainting

Inpainting 是 Udio 的局部音乐编辑能力,适合对已有歌曲片段做定点重写和替换。

计费价格

公开资料未说明

生成模式

remix

局部修歌片段重写精修编辑
音乐生成Udio稳定版

Udio Styles

Styles 是 Udio 的风格参考工作流,可用一首或两首参考歌曲的 vibe 快速生成新歌。

计费价格

公开资料未说明

生成模式

remix

风格参考快速起稿风格混搭
音乐生成Udio稳定版

Udio Sessions

Sessions 是 Udio 的时间线编辑视图,允许围绕歌曲结构做更精确的编辑、延展与编排。

计费价格

公开资料未说明

生成模式

remix

时间线编辑精细编排延展修歌
音乐生成Udio稳定版

Udio Voices

Voices 是 Udio 的声线控制能力,可在创作时指定参考声音并用 Voice Control 引导人声表现。

计费价格

公开资料未说明

生成模式

remix

声线控制人声一致性个性化演唱
语音模型Cartesia稳定版

Sonic 3.5

Sonic 3.5 是 Cartesia 当前公开的新一代流式文本转语音模型,适合实时语音 Agent、低延迟交互和高自然度语音生成。

计费价格

公开资料未说明

输入形式

文本

实时语音 Agent低延迟 TTS高自然度语音
语音模型Cartesia稳定版

Ink-2

Ink-2 是 Cartesia 于 2026 年 7 月 9 日发布的语音识别模型,重点优化实时语音 Agent 的转写、端点检测和上下文理解。

计费价格

公开资料未说明

输入形式

音频

实时语音 Agent低延迟转写端点检测
visionPaddlePaddle稳定版

PP-OCRv6

PP-OCRv6 是 PaddlePaddle 于 2026 年 6 月发布的新一代开源 OCR 模型线,覆盖文字检测与识别,适合中文文档处理和本地部署。

输入价格

公开资料未说明

输出价格

公开资料未说明

OCR文字检测本地部署
visionPaddlePaddle稳定版

HPD-Parsing

HPD-Parsing 是 PaddlePaddle 于 2026 年 7 月公开的文档解析模型,面向复杂版面、表格和视觉文档结构化提取。

输入价格

公开资料未说明

输出价格

公开资料未说明

文档解析表格理解版面分析
语言模型零一万物 Yi稳定版

Yi Lightning

零一万物当前公开的高性价比文本模型,文档说明会根据输入智能路由到 DeepSeek-V3、Qwen3-30B-A3B、Yi-Lightning 等能力。

输入价格

公开资料未说明

输出价格

公开资料未说明

实时交互高性价比复杂推理
多模态模型零一万物 Yi稳定版

Yi Vision V2

零一万物当前公开的复杂视觉任务模型,支持单张或多张图片理解、图表分析、OCR 与视觉推理。

输入价格

公开资料未说明

输出价格

公开资料未说明

图片问答图表理解OCR
语言模型华为盘古稳定版

Pangu-NLP-N2-32K-5.0.3.2

N2快慢思考融合版本,支持模型推理及训练。工具能力进一步加强,RAG幻觉降低。

输入价格

公开资料未说明

输出价格

公开资料未说明

RAG 问答复杂分析企业知识工作流
语言模型华为盘古稳定版

Pangu-NLP-N2-32K-5.0.3.1

N2快慢思考合一模型在ModelArts Studio平台上首次支持,支持32K序列长度训练及推理,通过system prompt进行快慢思考推理方式切换。

输入价格

公开资料未说明

输出价格

公开资料未说明

RAG 问答复杂分析企业知识工作流