摘要
9/8-9/10 OpenAI API 密集更新:GPT-Live 1 语音会话(v1/live/sessions)正式 GA——全双工对话在后台模型或 agent 推理、调用工具时持续进行,支持 Responses 委托或委托到自己的后端,按 $0.05/分钟、按秒计费(后端模型/工具用量单独计费)。Prompt Cache Diagnostics 在 Responses(GPT-5.6+)上 GA:对比两次响应间的缓存复用、定位未命中原因并给出排障指引。项目 API key 支持设置过期时间,管理员可在组织或项目级强制最长生命周期。两个图像模型(9/8):GPT Image 2.5 Sunburst 主打编辑精度、Flare 主打快速日常生成,均新增 xhigh/max 质量档、按 GPT Image 2 token 费率计费。
为什么重要
GPT-Live 1 的「边说边想」原语是实时语音 agent 的门槛能力——对话不再为工具调用停顿,后端委托意味着语音循环可以直接包住你已有的 agent。缓存诊断则针对长 agent 循环里最常见的成本与调试痛点。
技术细节
| GPT-Live 1 | 2026-09-10 GA;v1/live/sessions;全双工;后台模型/agent 推理与工具调用期间对话不中断;Responses 委托或自有后端;$0.05/分钟按秒计费;后端用量单独计费 |
|---|---|
| Prompt Cache 诊断 | 2026-09-08 GA;Responses API,GPT-5.6+;对比当前与上一次响应的缓存复用、定位未命中原因、给排障指引 |
| API Key | 2026-09-10:项目 key 可设过期时间;管理员可按组织或项目强制最长生命周期 |
| GPT Image 2.5 | 2026-09-08:Sunburst(编辑精度)+ Flare(快速日常生成);xhigh/max 质量档;按 GPT Image 2 token 费率 |
标签
apivoiceprompt-cachingkey-managementimage-models