首页 > 业界 > 关键词  > OpenAI最新资讯  > 正文

像真人聊天!OpenAI发布GPT-Live:AI可同步听与说

2026-07-09 13:53 · 稿源: 快科技

7月9日消息,据媒体报道,OpenAI正式推出了新一代语音系统GPT-Live,旨在提供宛如真人交谈般的自然对话体验。

据了解,目前全球每周有超过1.5亿人使用ChatGPT的语音与听写功能,应用场景十分广泛,例如免提式日常帮辅、语言练习、睡前故事讲述,以及通勤时的闲聊陪伴。

此前,ChatGPT的语音交互基于较为呆板的回合制模式,在回应准确性和对话流畅度上存在不足,有时难以维持自然的交互节奏。

GPT-Live则实现了边听边说的能力,并能通过“嗯哼”一类简短反馈传达倾听状态,让交流更具真实感。该系统专为持续对话设计,每秒可多次在继续聆听、开口说话、暂停、被中断和调用工具等状态间灵活切换,反应十分灵敏。

OpenAI称,GPT-Live是目前旗下最先进的语音系统,融合了最新的GPT-5.5前沿基础引擎,支持联网搜索、深度推理和复杂任务处理。它在执行任务时可保持对话不间断,并在完成后立即报告结果。此外,该系统还支持实时翻译,并能够借助信息卡片展示天气、股票、体育等资讯。

在交互细节上,当使用者停顿思考时,ChatGPT Voice会耐心等候,而不是抢话;即便环境中传来车辆经过或旁人交谈等背景噪声,系统也能更好地聚焦在使用者话音上,抗干扰能力显著增强。

OpenAI宣布,自周三起面向全球ChatGPT用户递送两个版本:GPT-Live-1与GPT-Live-1 mini。其中,GPT-Live-1将默认提供给Plus和Pro用户,而免费用户则默认得到GPT-Live-1 mini。

用户仅需点击语音按钮即可开启GPT-Live对话功能。需要注意的是,该版本目前暂不支持ChatGPT内的语音通话与屏幕共享,OpenAI表示相关功能正在加速研发,争取早日上线。

举报

  • 相关推荐
  • OpenAI为免费用户升级至GPT-5.6 Luna,开放更多功能权限

    OpenAI宣布对ChatGPT进行更新,在提升日常对话体验的同时,为免费用户开放更多功能权限。对于Plus和Pro用户,OpenAI更新了聊天界面,优化了交互体验。 此次升级的核心是GPT-5.6 Luna模型的推出。与上一代模型相比,Luna在逻辑推理、多轮对话和创造性写作方面均有提升。免费用户无需订阅即可体验新模型,这被视为OpenAI吸引和留住用户的重要举措。此前,OpenAI曾因DeepSeek等低成本A

  • AI日报:商汤甩出8B小钢炮 U1.5-Lite-Preview;MiniMax H3开源排除美国;微软自研全双工AI语音模型曝光

    微软推出支持16语言的全双工语音模型MAI Realtime;MiniMax开源视频模型H3但限制部分地区使用;商汤发布轻量统一多模态模型U1.5-Lite-Preview;面壁智能开源ForgeStencil实现工业软件自动化优化;Teams新增“举报会议”功能防AI诈骗;ChatGPT Atlas浏览器将停服;苹果诉OpenAI案曝内部数据管理漏洞;高德升级世界模型ABot-World-0,实现24小时连续稳定推理。

  • 理想AI眼镜Livis升级:接入小红书Agent 逛街不用掏手机

    理想汽车放出Livis 更新内容,这次更新带来两大全新功能,同时优化四项使用体验。 小龙虾OpenClaw终端可以直接用眼镜语音操控,还接入小红书智能助手,日常出行、办公都更省事。 这次更新后眼镜能和OpenClaw直连,开启优先响应开关,只需要开口说话,就能远程操控小龙虾处理本地文件、运行脚本、调取各类数据,不用守在电脑屏幕前操作,跨设备办公效率提升不少。 交�

  • AI日报:火山引擎上线豆包搜索开放服务;WorkBuddy上线人机双写;OpenAI 推出GPT-5.6模型家族

    火山引擎上线豆包搜索服务,强化企业智能体信息基座;WorkBuddy推“人机双写”让AI融入文档协作。OpenAI发布GPT-5.6模型家族,性能与效率大幅提升。腾讯视频内测WorkSolo,布局AI短剧与互动影游。DeepMind新一代音乐模型Lyria 3.5及腾讯开源AngelSpec框架,分别在AI音乐创作与大模型推理吞吐上取得关键进展。字节跳动整合豆包、飞书、火山引擎,加速AI To B战略。

  • AI日报:Fish Audio发布S2.1Pro实时对话语音模型;Grok4.6定档8月7日;360发布企业智能体平台“纳米Work”

    AI日报速递:Fish Audio发布实时对话语音模型S2.1Pro;360推出企业智能体平台“纳米Work”,首批赠1亿Token;马斯克公布Grok 4.6/4.7路线图;亚马逊停研多数Nova自研模型;闲鱼AI服务半年售近千万单,四线卖家最多;阿里“阿福”上线AI拍饮食功能;OpenRouter推LangChain集成,一行接400+款模型;OpenAI开源Codex安全CLI。

  • 京东外卖发布 AI 智能头盔:语音接单、路线导航一步到位

    京东外卖今日官宣推出 AI 智能头盔,将于近期陆续上岗。首批头盔将免费发放给京东全职骑手,后续再逐步向全体骑手开放。 这款头盔搭载了 AI 语音助手,支持全流程语音操作。在恶劣天气下,骑手无需掏出湿滑的手机,只要动动嘴就能完成接单、给用户打电话等一系列操作,从而解放双手、提升骑行安全。 针对配送中容易迷路的痛点,头盔内置了"单王路线"功能�

  • 腾讯元宝上线Hy ASR 3.0 preview语音识别模型:各种方言、复杂环境都能听清

    腾讯混元日前正式推出Hy ASR 3.0 preview语音识别模型,已率先落地腾讯元宝App面向全部用户免费使用。 依托Hy3基座大模型打通声学识别与语义理解,彻底摆脱传统语音识别生硬转写短板,在多方言口音、嘈杂收音、远距离拾音等复杂场景稳定输出精准文本。 模型完成10大方言片区、20余个细分方言覆盖,粤语、吴语、西南官话、中原官话等日常口语均可直接对话交互,用户不需

  • 阿里发布 Qwen-Audio-3.0-ASR-Flash 语音识别大模型

    阿里发布新一代语音识别大模型 Qwen-Audio-3.0-ASR-Flash,重点优化了专业词汇的识别表现。该模型已在医疗等垂直场景中展现出较高准确率,相关听写准确率突破九成五。 语音识别在通用对话中已相对成熟,但在医学、法律、工业等专业领域,由于术语密集且发音相近词多,模型常常出现误判。此次新模型强化了对专业词的处理能力,使其更贴合真实行业场景的需求。

  • AI语音对话与18000mAh大电池加持,Bigme发布彩色墨水屏AI电子相框F13!

    Bigme推出F13彩色墨水屏AI电子相框,采用13英寸E Ink Spectra6屏和18000mAh电池,画面接近印刷品且无光污染。产品支持AI语音对话、语音生图,通过App可展示照片、经典画作,同步日历天气及备忘记录。F13兼具低功耗与环保特性,并正以239美元预售,将传统相框升级为更自然、智能的空间显示终端。

  • 千问 App 集中上新:定时任务、办公助理、语音通话一起到位

    千问 App 今天宣布一批新功能上线,涵盖思考研究、定时任务、办公助理、语音通话和智能体广场,同时支持最新的旗舰模型 Qwen3.8-MAX。 思考研究是在原有深度思考基础上升级来的,复杂推理、工具调用、信息整合和结构化输出的能力都有加强。比如周会前把一堆资料丢进去,它能按工作背景、目标、成果概览和总结的结构,直接整理出一份完整文档。 定时任务面向的是那�

今日大家都在搜的词: