OpenAI 更新 2.1 系列 GPT Realtime AI 模型,p95 延迟至少降低 25%
最新 7 月 8 日消息,OpenAI 昨日(7 月 7 日)发布公告,宣布在其 API 调用中,新增 gpt-realtime-2.1 和 gpt-realtime-2.1-mini 两款模型,官方表示 p95 延迟至少下降 25%。
最新注:p95 延迟(Percentile 95 Delay)是衡量系统速度的重要指标,表明系统 95% 的请求都比这个时间快。
这两款模型主要面向低延迟语音智能体与多模态交互,OpenAI 官方表示通过优化缓存机制,Realtime 语音模型的 p95 延迟至少下降 25%。

在调用价格方面,上述两款模型的费用如下:
gpt-realtime-2.1
文本:
每 100 万 Tokens 输入费用为 4 美元,缓存输入为 0.40 美元
每 100 万 Tokens 输出费用为 24 美元
音频:
每 100 万 Tokens 输入费用为 32 美元,缓存输入为 0.40 美元
每 100 万 Tokens 输出费用为 64 美元
图片:
每 100 万 Tokens 输入费用为 5 美元,缓存输入为 0.50 美元
gpt-realtime-2.1-mini 模型
文本:
每 100 万 Tokens 输入费用为 0.6 美元,缓存输入为 0.06 美元
每 100 万 Tokens 输出费用为 2.4 美元
音频:
每 100 万 Tokens 输入费用为 10 美元,缓存输入为 0.30 美元
每 100 万 Tokens 输出费用为 20 美元
图片:
每 100 万 Tokens 输入费用为 0.8 美元,缓存输入为 0.08 美元
能力方面,gpt-realtime-2.1-mini 支持实时音频与文本输入,也支持工具调用(Tool Use)与函数调用(Function Calling)。
报道显示,该模型可在执行动作前先完成内部推理,并通过口头前置说明保持对话连续。gpt-realtime-2.1 则进一步增强字母数字识别、静音与噪声处理、中断处理、指令遵循和可配置推理强度方面。
推理强度支持 minimal、low、medium、high、xhigh 5 档。默认档位为 low,OpenAI 建议生产环境语音代理先从低档开始。

《OpenAI 更新 2.1 系列 GPT Realtime AI 模型,p95 延迟至少降低 25%》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。
相关图文
-
华为昇腾 950 超节点荣获 2026 世界人工智能大会最高荣誉 SAIL 奖
@华为中国 昨日(7 月 18 日)发布博文,宣布昇腾 950 超节点(Atlas 950 SuperPoD)荣获 2026 世界人工智能大会(WAIC)最高荣誉 SAIL 奖。... -
“反 AI”情绪愈演愈烈,多家头部 AI 公司加强高管安保
《华尔街日报》报道称,针对 AI 行业的敌意不断上升,开发先进 AI 模型的人员和企业正面临越来越多的威胁与袭击企图。多家头部 AI 公司已经加强安保,部分高管出行时甚至由武装保镖随行,另一些人则选择降低曝光度,减少公开活动。... -
OpenAI 回应 GPT-5.6 Sol AI 意外删除用户文件:已采取措施降低风险
OpenAI 核心产品负责人蒂博 · 索蒂奥(Tibo Sottiaux)于 7 月 16 日在 X 平台发布推文,回应 GPT-5.6 Sol 会擅自删除用户文件问题。... -
面向手机的 AI 游戏创作工具,《Roblox》移动版将更新“Build”功能
Roblox 为移动版客户端推出“Build”功能,用户通过简单提示词即可生成基础游戏,无需编程技能。该功能由多种 AI 模型驱动,支持生成玩法、环境、角色等。将于 7 月 28 日开启 Alpha 测试,首先面向新西兰用户开放。#Roblox #AI 游戏创作 #移动游戏开发#... -
歌曲生成平台 Suno 部分源码泄露,被发现全网爬取数百万歌曲训练 AI
科技媒体 404Media 昨日(7 月 16 日)发布博文,报道称基于黑客披露的 Suno 内部源代码,该 AI 歌曲生成平台从 YouTube Music、Deezer 和 Genius 等平台抓取数百万首歌曲来构建其核心模型。...












