Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

语音模型OpenAI稳定版

gpt-realtime-1.5

OpenAI 当前最新语音旗舰,适合语音助手、客服和实时语音 Agent。

计费价格

$4.00 / 1M Tokens

输入形式

文本 / 图像 / 音频

语音交互实时对话Agent
语音模型OpenAI稳定版

gpt-audio-1.5

OpenAI 当前最新 Chat Completions 音频主力,适合音频输入输出和语音交互工作流。

计费价格

$2.50 / 1M Tokens

输入形式

文本 / 音频

语音交互音频内容Agent
语音模型OpenAI稳定版

gpt-realtime

OpenAI 当前首个 GA 实时模型,支持 WebRTC、WebSocket 或 SIP 下的实时文本和音频交互。

计费价格

$4.00 / 1M Tokens

输入形式

文本 / 图像 / 音频

语音交互实时对话Agent
语音模型OpenAI稳定版

gpt-realtime-mini

GPT Realtime 的低成本版本,适合成本敏感的实时文本与语音交互场景。

计费价格

$0.60 / 1M Tokens

输入形式

文本 / 图像 / 音频

语音交互实时对话成本敏感
语音模型OpenAI稳定版

gpt-audio

OpenAI 当前通用音频输入输出模型,适合音频对话和音频到文本流程。

计费价格

公开资料未说明

输入形式

文本 / 音频

语音交互音频内容Agent
语音模型OpenAI稳定版

gpt-audio-mini

GPT Audio 的低成本版本,适合更便宜的语音输入输出和语音自动化流程。

计费价格

$0.60 / 1M Tokens

输入形式

文本 / 音频

语音交互成本敏感音频内容
语音模型OpenAI稳定版

GPT-4o mini TTS

由 GPT-4o mini 驱动的文本转语音模型,适合低成本 TTS 场景。

计费价格

公开资料未说明

输入形式

文本

语音合成配音内容成本敏感
视频生成OpenAI即将下线

Sora 2

OpenAI 的视频生成模型,适合广告素材、产品演示和带音频的视频内容制作。

计费价格

$0.10 / second (720p)

生成形式

text_to_video / image_to_video

视频生成广告素材品牌短片
视频生成OpenAI即将下线

Sora 2 Pro

OpenAI 的高质量视频生成模型,适合更高规格的广告片、品牌短片和动态内容制作。

计费价格

$0.30 / second (720p), $0.50 / second (1024p)

生成形式

text_to_video / image_to_video

视频生成品牌短片广告素材
语音模型OpenAI稳定版

GPT-4o Audio

GPT-4o Audio 是 OpenAI 的音频交互模型,适合语音助手、实时对话和多模态语音工作流。

计费价格

公开资料未说明

输入形式

文本 / 音频

语音交互音频内容Agent
语音模型OpenAI稳定版

GPT-4o mini Audio

GPT-4o mini Audio 是 OpenAI 的音频交互模型,适合语音助手、实时对话和多模态语音工作流。

计费价格

公开资料未说明

输入形式

文本 / 音频

语音交互音频内容Agent
语音模型OpenAI稳定版

GPT-4o Realtime

GPT-4o Realtime 是 OpenAI 的音频交互模型,适合语音助手、实时对话和多模态语音工作流。

计费价格

公开资料未说明

输入形式

文本 / 音频

实时对话语音助手Agent
语音模型OpenAI稳定版

GPT-4o mini Realtime

GPT-4o mini Realtime 是 OpenAI 的音频交互模型,适合语音助手、实时对话和多模态语音工作流。

计费价格

公开资料未说明

输入形式

文本 / 音频

实时对话语音助手Agent
语音模型OpenAI稳定版

TTS-1

TTS-1 是 OpenAI 的文本转语音模型,适合配音内容、语音助手和低延迟语音输出场景。

计费价格

公开资料未说明

输入形式

文本

语音合成配音内容语音助手
语音模型OpenAI稳定版

TTS-1 HD

TTS-1 HD 是 OpenAI 的文本转语音模型,适合配音内容、语音助手和低延迟语音输出场景。

计费价格

公开资料未说明

输入形式

文本

语音合成配音内容语音助手
语音模型OpenAI稳定版

Whisper

Whisper 是 OpenAI 的语音转文字模型,适合转写、字幕生成和音频理解流程。

计费价格

公开资料未说明

输入形式

音频

语音转写字幕生成音频理解
语音模型Google稳定版

Magenta RealTime 2

Magenta RealTime 2 是 Google DeepMind 于 2026 年 5 月发布的实时音乐生成模型。

计费价格

公开资料未说明

输入形式

音频 / 文本

音乐生成实时音频开放模型