Realtime-2

general · 首次出现 2026-06-13 · 最近出现 2026-09-11 · 累计提及 14

综述

Realtime-2是OpenAI开发的低延迟语音交互模型,能够实现近乎实时的语音对话体验。该模型系列最新发布的版本包括GPT-Realtime-2.1和GPT-Realtime-2.1-mini,专注于提升语音交互的响应速度和功能性。

Realtime-2 近期进展

2026年7月,OpenAI发布了GPT-Realtime-2.1和GPT-Realtime-2.1-mini低延迟语音模型,进一步提升了实时语音交互的能力。这一更新标志着OpenAI在语音AI领域的持续投入和技术突破。OpenAI 发布 GPT-Realtime-2.1 和 GPT-Realtime-2.1-mini 低延迟语音模型

GPT-Realtime-2.1-mini API已正式上线,支持推理功能和工具使用,为开发者提供了更强大的实时语音交互能力。这一API的推出使得开发者能够更容易地将实时语音功能集成到自己的应用中。GPT-Realtime-2.1-mini API 上线,支持推理与工具使用

阿里近期也发布了实时语音交互对话模型Qwen-Audio-3.0-Realtime,声称其模型"更聪明",这表明科技巨头们在实时语音交互领域的竞争正在加剧。阿里发布实时语音交互对话模型Qwen-Audio-3.0-Realtime,声称更聪明

当前焦点与观察点

OpenAI在半年内发布了30+模型与工具升级,Realtime-2系列作为其中的重要组成部分,展示了公司在实时交互技术上的战略布局。WebRTC Audio Session的更新进一步支持了文档上下文和GPT-Realtime-2模型,这表明实时语音交互正朝着更自然、更智能的方向发展。OpenAI WebRTC Audio Session 更新,支持文档上下文和 GPT-Realtime-2 模型

随着GPT-Realtime-2语音控制操作系统教程的发布,普通用户也开始探索如何利用这一技术提升人机交互体验。Realtime-2技术的普及可能会重塑人们与数字设备交互的方式,特别是在需要即时反馈的场景中,如客户服务、虚拟助手和教育培训等领域。GPT-Realtime-2 语音控制操作系统教程

相关报道

8 条在档