标签:语音交互

阿里千问发布 Qwen-Audio-3.1 系列语音大模型,并下调全线产品价格

9 月 23 日消息,今天,千问正式发布 Qwen-Audio-3.1 系列语音大模型。本次升级不仅对语音识别、语音合成和实时语音交互三大核心模型进行了全面进化,更重磅...

阶跃发布 StepAudio 3 系列语音大模型,拿下多个全球第一

9 月 15 日消息,今日阶跃正式发布 StepAudio3 系列模型,包括 StepAudio3Realtime、StepAudio3ASR、StepAudio3TTS、StepAudio3Gen 和 StepAudio3Music,其中...

OpenAI 扩大实时语音模型能力:GPT-Live-1 上线 API,支持打断处理、工具调用和电话语音智能体

9 月 11 日消息,OpenAI 今日宣布将 GPT-Live-1 引入 API,开发者可据此打造支持实时语音交互的应用和业务流程。该模型支持全双工对话,能够同时听取和输出语...

谷歌为Gmail、Docs和Keep推出AI语音对话功能

谷歌正在为其生产力套件引入AI语音交互能力,用户现在可以通过说话来管理Gmail、Docs和Keep。这些实时对话功能分别被称为Gmail Live、Docs Live和Keep Live,...

阿里Qoder上线“眼镜版”,将接入千问与乐奇AI眼镜

9月3日,阿里智能体编程平台Qoder推出“Qoder眼镜版”,首批将接入千问AI眼镜和乐奇AI眼镜。用户无需操作手机或触屏,即可通过语音交互让AI Agent执行任务。 Q...

Google助理将退,Siri们集体被淘汰,但语音交互依然是AI交互刚需

Google宣布Google助理9月4日停止服务,由Gemini接替。用户对语音助手依赖程度变化,AI Agent时代语音交互成新刚需。国产手机厂商在AI Agent化改造上领先,语...

OpenAI高管:ChatGPT与Codex将融合为个人AGI,Codex用户已达2000万

OpenAI正推动一场深层次的产品整合,其目标不仅是合并两款应用,而是要让“ChatGPT”与“Codex”这两个概念彻底消失,最终收敛为一个长期理解用户、自主完成任务...

快手创始人宿华押注的 Voice Cursor,语音输入又卷起来了

语音成为了AI交互的新方式。 手机输入法里按住麦克风说几句话,电脑听写负责把声音转成文字,遇到识别错误再自己改,类似功能存在了很多年。 大模型加入后改...

识别、合成、实时交互全球第一,Qwen-Audio-3.0 系列语音模型上线阿里千问 AI 平台

8 月 17 日消息,今天(17 日)下午,阿里云通过公众号宣布,Qwen-Audio-3.0 系列语音模型正式上线千问 AI 平台和阿里云百炼平台。开发者可以通过 API 服务调...

最高每秒生成 750 个词元:OpenAI 推 Ultrafast 模式,GPT-5.6 Sol AI 提速 14 倍

8 月 14 日消息,OpenAI 公司今天(8 月 14 日)发布公告,宣布以预览形式,针对其最强 AI 模型 GPT-5.6 Sol 推出 Ultrafast(超高速)模式,是标准处理速度...
123…79