快速阅读: 据OpenAI消息,该公司正加速音频AI技术研发,计划于2026年一季度推出新一代语音模型,显著提升自然度、情感表现及“边听边说”实时交互能力,为其明年面世的语音优先设备系列奠定基础。
OpenAI近期正加快音频人工智能技术研发,旨在为即将推出的语音优先智能设备奠定技术基础。由于当前语音模型在准确性和响应速度上仍落后于文本模型,该公司在过去两个月内已整合多个工程、产品与研究团队,集中攻关音频交互关键技术。
据悉,OpenAI计划于2026年第一季度发布新一代音频模型。新模型将显著提升语音输出的自然度与情感表现,并优化对实时打断和互动场景的处理能力。其中,“边听边说”功能将成为重要突破——设备可在用户发言尚未结束时即开始响应,实现更流畅的实时对话体验。
此次技术升级不仅聚焦语音体验优化,也与其即将发布的语音优先个人设备紧密关联。该设备预计约一年后面世,可能并非单一产品,而是一个涵盖无屏智能眼镜、极简屏幕语音助手等形态的系列。其设计理念在于减少用户对屏幕的依赖,通过自然语音交互提升使用效率。
整体来看,OpenAI正加速向“以语音为核心接口”的未来布局。这一战略调整既体现其自身产品演进方向,也呼应了科技行业对人机交互模式变革的积极探索。
(以上内容均由Ai生成)
引用自:AIbase人工智能资讯平台