## 事件概述
OpenAI 于 2026 年 9 月 10 日宣布 GPT-Live-1 在 API 中正式可用,将 ChatGPT 的全双工语音交互带给开发者。模型可以同时听和说,并在需要时把更深层的推理与工具调用交给后端文本模型。
## 模型与开发者
- 模型:GPT-Live-1
- 开发者:OpenAI
- 官方发布日期:2026 年 9 月 10 日
## 关键能力与改动
- 单一模型处理输入和输出音频,支持自然打断、停顿和背景噪声,减少传统 STT→LLM→TTS 串联系统的延迟与上下文丢失。
- 可通过系统提示词控制语气、语速和交流风格,并把推理、工具调用委派给 GPT-6 Astra 等后端模型或第三方模型。
- 原生提供 ASR 转写和回复文本,支持关键词偏置、轮次检测及电话部署,适合客服、预约、教育和现场语音助手。
## 适用对象
需要低延迟、可打断语音体验的 API 开发者,以及搭建电话客服、语言学习、语音操作和企业工作流的团队。
## 实际影响与限制
GPT-Live-1 可以简化实时语音架构,让前端语音交互与后端复杂任务并行进行;官方 API 价格为语音层每分钟 0.05 美元,按秒计费,后端模型与工具费用另计。它本身不承担全部深度推理,仍需配置后端模型、工具权限和持久化任务状态;视频和屏幕共享不在当前模型能力范围内,语言与声音选项也会持续扩展。
## 官方来源
https://openai.com/index/introducing-gpt-live-1-in-the-api/ |