Token导航 LogoToken导航TokenDH.com

OpenAI 发布 GPT Realtime 2.1 系列模型:P95 延迟直降 25%,Mini 版支持工具调用与可调推理强度

更新时间 2026-07-08来源 牛新网正文 881字阅读约 3分钟1 张图片

ITCOW牛新网 7月8日消息,OpenAI 于昨日(7月7日)通过官方公告宣布,在其 API 中正式上线 gpt-realtime-2.1 及 gpt-realtime-2.1-mini 两款新模型。官方宣称,通过优化缓存机制,新模型的 P95 延迟(即 95% 的请求响应时间均低于该值)较上一代至少降低 25%,主要面向对实时性要求极高的低延迟语音智能体与多模态交互场景。

OpenAI 发布 GPT Realtime 2.1 系列模型

据ITCOW牛新网了解,gpt-realtime-2.1-mini 在支持实时音频与文本输入的基础上,进一步开放了工具调用(Tool Use)与函数调用(Function Calling)能力,模型可在执行具体动作前先完成内部推理,并通过口头前置说明保持对话的连贯性。而定位更高的 gpt-realtime-2.1 则在字母数字识别、静音与噪声处理、中断处理、指令遵循等方面做了增强,并引入可配置的推理强度选项,提供 minimal、low、medium、high、xhigh 共五档,默认档位为 low,OpenAI 建议生产环境的语音代理从低档开始调试。

定价方面,gpt-realtime-2.1 文本输入每 100 万 Tokens 收费 4 美元(缓存输入仅 0.40 美元),文本输出每 100 万 Tokens 收费 24 美元;

音频输入每 100 万 Tokens 收费 32 美元(缓存输入 0.40 美元),音频输出每 100 万 Tokens 收费 64 美元;

图片输入每 100 万 Tokens 收费 5 美元(缓存输入 0.50 美元)。

gpt-realtime-2.1-mini 的价格更为亲民:

文本输入每 100 万 Tokens 收费 0.6 美元(缓存输入 0.06 美元),文本输出每 100 万 Tokens 收费 2.4 美元;

音频输入每 100 万 Tokens 收费 10 美元(缓存输入 0.30 美元),音频输出每 100 万 Tokens 收费 20 美元;

图片输入每 100 万 Tokens 收费 0.8 美元(缓存输入 0.08 美元)。

两款模型目前已向开发者开放调用,有望进一步降低实时语音 AI 应用的部署门槛与响应时延。

文章导航

2026 世界人工智能大会 7 月 17 日上海启幕:展览首破 10 万平米,全球首发超 300 款 AI 新品
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多