标签:语音交互

New快手创始人宿华押注的 Voice Cursor,语音输入又卷起来了

语音成为了AI交互的新方式。 手机输入法里按住麦克风说几句话,电脑听写负责把声音转成文字,遇到识别错误再自己改,类似功能存在了很多年。 大模型加入后改...

New识别、合成、实时交互全球第一,Qwen-Audio-3.0 系列语音模型上线阿里千问 AI 平台

8 月 17 日消息,今天(17 日)下午,阿里云通过公众号宣布,Qwen-Audio-3.0 系列语音模型正式上线千问 AI 平台和阿里云百炼平台。开发者可以通过 API 服务调...

最高每秒生成 750 个词元:OpenAI 推 Ultrafast 模式,GPT-5.6 Sol AI 提速 14 倍

8 月 14 日消息,OpenAI 公司今天(8 月 14 日)发布公告,宣布以预览形式,针对其最强 AI 模型 GPT-5.6 Sol 推出 Ultrafast(超高速)模式,是标准处理速度...

语音输入法,叩响AI世界大门?

谁能想到,在市场格局几乎已经是铁板一块的情况下,输入法这个基本没什么存在感的“小众赛道”,竟然会在AI时代再次掀起新的波澜。 2025年下半年以来,豆包输...

福特海外推出新 AI 助手:可以检查油量,还能教你保养

8 月 10 日消息,据外媒 The Verge 今天(10 日)晚间报道,海外的福特、林肯车型正陆续获得一款 AI 助手,车主可以直接询问下次长途旅行需要准备多少燃油,...

Neon 开源 4B 模型:文档搜索能力超 GPT-5.6 Sol,成本仅为 1/100

8 月 7 日消息,Neon 昨日(8 月 6 日)发布博文,宣布携手 Castform 公司,披露一套面向检索模型的训练方案。 注:Neon 是一款完全托管的无服务器(Serverle...

阿里推出国内首个 AI 语音平台 CosyVoice Studio,限时免费体验

8 月 7 日消息,阿里巴巴今日宣布推出国内首个一站式 AI 语音生产力平台 CosyVoice Studio。 官方表示,该平台基于自研语音模型 Qwen-Audio 打造,包含语音记...

京东开源实时视频编辑模型JoyAI-Video-Edit

8月5日,京东宣布开源自研的实时流式视频编辑模型JoyAI-Video-Edit,用户可一边观看视频一边修改人物与场景,将视频创作从“先有素材再修改”变为实时互动编辑...

通义千问(Qwen)— 阿里巴巴的AI大模型全家桶

一、产品概览 项目 信息 全称 通义千问 / Qwen 开发方 阿里云 / 阿里巴巴集团 定位 全模态AI大模型家族 + AI原生应用生态 最新版本 Qwen3.5 / Q...

医疗大模型,最核心的十家公司!

2025年以来,医疗人工智能迈入“大模型驱动” 的新发展阶段。 过去十年,医疗AI主要集中在医学影像识别、辅助诊断等单点场景,而以GPT、Gemini、Claude等大模...
12378