Token导航 LogoToken导航TokenDH.com
语音模型OpenAI / ChatGPT语音对话稳定版

GPT-4o Audio

调用名:gpt-4o-audio-preview

GPT-4o Audio 是 OpenAI 的音频交互模型,适合语音助手、实时对话和多模态语音工作流。

128K 上下文
时间戳不支持

适合

语音交互 / 音频内容

语音对话

价格

公开资料未说明

1M Tokens

输入

文本 / 音频

可做实时交互

输出

文本 / 音频

支持结构化输出

规格

支持实时

上下文 128K

语音交互音频内容Agent函数调用结构化输出长上下文语音输入语音输出

所属厂商:OpenAI / ChatGPT

详细参数

模型类型

语音对话

适合场景

语音交互 / 音频内容

计费价格

公开资料未说明

计费方式

公开资料未说明

计费单位

未标注

输入形式

文本 / 音频

输出形式

文本 / 音频

能力与信息

交互链路

实时

支持

语音输入

支持

语音输出

支持

语音理解

转写

支持

翻译

不支持

时间戳

不支持

语音生成

TTS

支持

说话人区分

不支持

开发接入

工具调用

支持

接入信息

调用名

gpt-4o-audio-preview

API 基础地址

https://api.openai.com/v1

调用协议

Responses API

主接口

/responses

接口说明

音频输入输出可通过 Responses API 调用;低延迟双工语音更适合走 Realtime API。

发布时间

公开资料未说明

价格与计费

计费摘要

输入价

公开资料未说明

输出价

公开资料未说明

缓存输入

公开资料未说明

币种

未标注

计费单位

1M Tokens

单位类型

未标注

价格说明

原始价格文案

未收录

补充说明

暂无

发布时间

未公开

官方入口