计费价格
公开资料未说明
输入形式
音频
官方模型目录与价格对比
按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。
先缩小候选,再进详情页看接口、计费和能力边界。
已收录模型
1,303
覆盖厂商
63
带价格信息
355
计费价格
公开资料未说明
输入形式
音频
计费价格
公开资料未说明
输入形式
文本
计费价格
公开资料未说明
输入形式
音频
计费价格
公开资料未说明
输入形式
音频
计费价格
公开资料未说明
输入形式
音频
计费价格
公开资料未说明
输入形式
音频
计费价格
公开资料未说明
输入形式
文本
计费价格
公开资料未说明
生成模式
remix
计费价格
公开资料未说明
生成模式
lyrics_to_music
计费价格
公开资料未说明
输入形式
文本
计费价格
公开资料未说明
输入形式
文本
计费价格
公开资料未说明
输入形式
文本
计费价格
公开资料未说明
输入形式
文本
LongCat 官方更新日志显示该旧模型已于 2026 年 5 月 29 日停止调用,正式接入应迁移到 LongCat 2.0。
输入价格
公开资料未说明
输出价格
公开资料未说明
Deepgram Flux TTS 是 2026 年 8 月发布的面向实时语音 Agent 的对话式文本转语音模型,支持跨轮上下文、打断处理和流式输出。
计费价格
公开资料未说明
输入形式
文本
计费价格
公开资料未说明
输入形式
文本 / 音频
计费价格
公开资料未说明
输入形式
文本 / 音频
真正具有声音表演能力的语音合成模型,首次将语境理解能力引入语音生成全流程。通过 Global Context(全局语境)+ Inline Context(文中语境)双档控制,配合 Zero-shot Clone,让合成语音有呼吸感、轻重主次和情绪弧线,适合有声书、短剧配音、广告旁白、情感叙事等高表现力场景。
计费价格
¥5.8 / 10K characters
输入形式
文本
支持中、英、日语、粤语、四川话,提供19种官方音色,兼具出色的音色复刻能力,支持中、英、日语复刻。适合客服外呼、情感陪伴、智能助手语音交互等对发音真人感要求高的场景。
计费价格
¥0.9 / 10K characters
输入形式
文本
阶跃新一代流式语音识别模型,基于 4B MTP 架构,在识别准确率与响应延迟之间取得良好平衡。支持中英文识别与 ITN 文本规范化,适合实时字幕、语音输入、会议记录等对识别速度与准确率均有要求的场景。
计费价格
0.15元/小时
输入形式
音频