AI大模型
OpenAI 2.1版 GPT Realtime AI 模型延迟减少25%
OpenAI 昨日(7 月 7 日)发布公告,宣布在其 API 调用中,新增 gpt-realtime-2.1 和 gpt-realtime-2.1-mini 两款模型,官方表示 p95 延迟至少下降 25%。
IT人网注:p95 延迟(Percentile 95 Delay)是衡量系统速度的重要指标,表明系统 95% 的请求都比这个时间快。
这两款模型主要面向低延迟语音智能体与多模态交互,OpenAI 官方表示通过优化缓存机制,Realtime 语音模型的 p95 延迟至少下降 25%。

在调用价格方面,上述两款模型的费用如下:
gpt-realtime-2.1
文本:
每 100 万 Tokens 输入费用为 4 美元,缓存输入为 0.40 美元
每 100 万 Tokens 输出费用为 24 美元
音频:
每 100 万 Tokens 输入费用为 32 美元,缓存输入为 0.40 美元
每 100 万 Tokens 输出费用为 64 美元
图片:
每 100 万 Tokens 输入费用为 5 美元,缓存输入为 0.50 美元
gpt-realtime-2.1-mini 模型
文本:
每 100 万 Tokens 输入费用为 0.6 美元,缓存输入为 0.06 美元
每 100 万 Tokens 输出费用为 2.4 美元
音频:
每 100 万 Tokens 输入费用为 10 美元,缓存输入为 0.30 美元
每 100 万 Tokens 输出费用为 20 美元
图片:
每 100 万 Tokens 输入费用为 0.8 美元,缓存输入为 0.08 美元
能力方面,gpt-realtime-2.1-mini 支持实时音频与文本输入,也支持工具调用(Tool Use)与函数调用(Function Calling)。
报道显示,该模型可在执行动作前先完成内部推理,并通过口头前置说明保持对话连续。gpt-realtime-2.1 则进一步增强字母数字识别、静音与噪声处理、中断处理、指令遵循和可配置推理强度方面。
推理强度支持 minimal、low、medium、high、xhigh 5 档。默认档位为 low,OpenAI 建议生产环境语音(D-L)先从低档开始。

相关阅读
-
《Fairgames》内测反响不佳玩家直言不如《星鸣特攻》
据InsiderGaming报道,索尼旗下多人射击游戏《Fairgames》最近又传出了不太乐观的消息。据称,该作在代号为“espresso”的最新一轮Alpha测试中,被玩家普遍评价为“无聊”,甚至有人调侃这游戏比
-
英伟达黄仁勋:“龙虾”OpenClaw 是人类史上最成功开源项目 绝对是下
本周二在美国加州GTC大会期间接受CNBC采访时,英伟达首席执行官黄仁勋高度赞扬开源AI项目“龙虾”OpenClaw,并断言其“绝对是下一个ChatGPT”。黄仁勋将OpenClaw誉为“人类历史上规模最大、最受
-
阿里发布神秘AI视频模型‘欢乐马’官方微信账号上线
北京时间今天午间,近期突然走红的AI视频模型HappyHorse开通官方微博“@HappyHorse_AI”,并发布首条内容。我是HappyHorse,非常感谢大家的关注!HappyHorse是阿里ATH创新事业部正在内测中的产品
-
提示注入是否构成漏洞?微软与安全专家的AI漏洞定义争议
科技媒体bleepingcomputer昨日(1月6日)发布博文,报道称微软近日驳回了一名安全工程师提交的关于Copilot的四项安全漏洞报告,引发了行业关于“AI漏洞”定义的激烈争论。


