独立售卖页

OpenAI 开放 GPT-Live-1 API:每分钟 0.05 美元,把 ChatGPT 同款语音能力交给开发者

OpenAI向开发者开放GPT-Live-1语音模型API,可将ChatGPT语音功能集成到应用中,构建全双工语音助手,支持实时听说并自然处理打断与停顿。语音前端每分钟0.05美元,后台复杂

单篇购买单篇购买文章2026-09-11 14:48:00
售卖与权益说明

当前内容支持公开查看。

人工智能www.chinaz.com购买后会立即写入“我的已购内容”,后续退款也回到统一内容权益链处理。
OpenAI 开放 GPT-Live-1 API:每分钟 0.05 美元,把 ChatGPT 同款语音能力交给开发者

GPT-Live-1 是 OpenAI 今年推出的新一代实时语音模型,最大特点是采用全双工架构。传统语音 AI 通常依次完成语音识别、语言模型推理和语音合成三个步骤,用户说完话系统才能处理并生成回答;而 GPT-Live-1 能在听取用户讲话的同时生成语音输出,因此可更自然地处理打断、停顿、附和以及快速的来回对话,还能判断何时该继续说话、暂停、倾听或调用工具。

OpenAI 表示,这种架构明显降低了语音交互延迟,解决了传统流水线容易出现的衔接问题,开发者无需再自行协调多个独立模型之间的复杂切换。测试中,GPT-Live-1 在 Full Duplex Bench 上比 GPT-Realtime-2.1 高出 30 个百分点,尤其在轮流发言延迟与交互行为方面提升明显;与 GPT-6 Astra 以中等推理强度配合时,在评估端到端语音智能体任务的 Tau3 测试中也取得第一名。

GPT-Live-1 并不负责所有复杂推理。OpenAI 将负责实时听说交互的语音模型与负责深度推理的后台模型分离:当用户提出需要搜索、复杂分析或较长任务的问题时,GPT-Live-1 会把工作交给后台模型,同时继续维持自然语音交流。开发者因此可按业务选择后台模型——简单任务用更快更便宜的模型,复杂问题交给更强的推理模型。

应用方面,GPT-Live-1 原生支持电话场景,可用于餐厅预约、客户支持等全双工语音智能体。早期案例中,语言学习平台 Speak 发现,相比此前基于轮次的系统,GPT-Live-1 使系统主动打断学习者的情况减少接近 80%。模型还提供原生语音识别转写与响应文本,支持关键词偏置、轮次检测,并针对嘈杂环境做了优化;OpenAI 同时扩大了可用声音,覆盖更丰富的口音、方言和语言。开发者还可将 GPT-Live-1 与 Codex 等工具结合,由语音模型接收任务、后台工具处理,再回到语音对话。

本期AI日报:OpenAI上线GPT-Live-1 API,支持打断与工具调用;DeepSeek V4.1-Flash登陆WorkBuddy免费试用;谷歌推出Gemini Windows应用;蚂蚁集团称智能体商业“ChatGPT时刻”已至;环球音乐联手ElevenLabs共建正版AI音乐平台;SpaceX AI直播用Grok Bot三天建公司;商汤“小浣熊”移动端上线;支付宝升级AI钱包与三大“AI收”能力。

DeepSeek V4.1 Flash多模态超Pro;Suno v6支持图/视频/语音转音乐与精准编辑;AMD PRO 495将推超20款迷你主机;Prime Video上线AI口型同步;原神声音被仿冒获赔75万;OpenAI调整ChatGPT广告屏蔽竞品并开放GPT-5.6/6语音;Kimi联合金山云等进军企业市场。

OpenAI发布Images 2.5,提升图像细节并新增草图标注;曹操出行联合豆包在京杭苏提供AI打车;达芬奇21.1接入Claude Code和ChatGPT Codex;智元布局触觉赛道,京东推物理AI加速计划;联通魅族发布99克全语音AI手机;DeepSeek Flash系列降价;首部AIGC武侠片《山竹刀》上线。

跨境电商流量正从SEO转向AI生成式引擎,卖家被AI Overview“静默下架”成常态。AI推荐流量暴涨且转化更高,但面临排名≠被引用、AI信源不可知、负面信息无警报、归因难四大死局。出路在GEO四步:建AI问题库、做可抽取段落、经营信源、监测心智份额,用GEOBase量化AI能见度。

本期AI日报:DeepSeek开源3050亿视觉模型;Runway发布界面世界模型Solaris;讯飞星火X2.5端侧开源,支持百万Token;MiniMax新模型带动股价涨超20%;ChatGPT Ads年化收入破10亿美元;Instagram要求AI内容标注;化工大模型3.0 Pro发布;1200+智能体越狱攻击开源社区。

OpenAI正式推出品牌史上能力最强大模型GPT-6 Astra,官方将其定义为全球智能水平最高、对齐效果最优的生成式AI模型。 其训练工作在美国德州Stargate超算基地完成,动用超过10万张GPU完成预训练,也是OpenAI首次大规模使用前代模型参与监督训练的旗舰产品。 该模型上下文窗口达到105万token,最大输出128000 token,知识截止时间为2026年4月30日。

OpenAI发布GPT-6 Astra,称迈向通用AI;英伟达129亿美元收购Hugging Face;小红书清理近12万条AI虚假医美探店内容;奥特曼证实自研人形机器人,强调“机器人大脑”;谷歌Workspace接入Gemini语音;GPT Image 2.5未发先热;阿里千问办公首月用户破3000万,开源上下文底座;Oura智能戒指提交IPO申请。

vivo开发者大会定档9月16日,将发布OriginOS 7与自研蓝河操作系统4。OriginOS 7基于Android 17,引入液态动效并重构渲染,速度较前代提升14%;蓝河4基于Rust内核,强化跨设备协同与AI意图框架。大会还将公布蓝心AI战略及端侧大模型、生态扶持规划。