标签:语音交互
New快手创始人宿华押注的 Voice Cursor,语音输入又卷起来了
语音成为了AI交互的新方式。 手机输入法里按住麦克风说几句话,电脑听写负责把声音转成文字,遇到识别错误再自己改,类似功能存在了很多年。 大模型加入后改...
New识别、合成、实时交互全球第一,Qwen-Audio-3.0 系列语音模型上线阿里千问 AI 平台
8 月 17 日消息,今天(17 日)下午,阿里云通过公众号宣布,Qwen-Audio-3.0 系列语音模型正式上线千问 AI 平台和阿里云百炼平台。开发者可以通过 API 服务调...
最高每秒生成 750 个词元:OpenAI 推 Ultrafast 模式,GPT-5.6 Sol AI 提速 14 倍
8 月 14 日消息,OpenAI 公司今天(8 月 14 日)发布公告,宣布以预览形式,针对其最强 AI 模型 GPT-5.6 Sol 推出 Ultrafast(超高速)模式,是标准处理速度...
语音输入法,叩响AI世界大门?
谁能想到,在市场格局几乎已经是铁板一块的情况下,输入法这个基本没什么存在感的“小众赛道”,竟然会在AI时代再次掀起新的波澜。 2025年下半年以来,豆包输...
福特海外推出新 AI 助手:可以检查油量,还能教你保养
8 月 10 日消息,据外媒 The Verge 今天(10 日)晚间报道,海外的福特、林肯车型正陆续获得一款 AI 助手,车主可以直接询问下次长途旅行需要准备多少燃油,...
Neon 开源 4B 模型:文档搜索能力超 GPT-5.6 Sol,成本仅为 1/100
8 月 7 日消息,Neon 昨日(8 月 6 日)发布博文,宣布携手 Castform 公司,披露一套面向检索模型的训练方案。 注:Neon 是一款完全托管的无服务器(Serverle...
阿里推出国内首个 AI 语音平台 CosyVoice Studio,限时免费体验
8 月 7 日消息,阿里巴巴今日宣布推出国内首个一站式 AI 语音生产力平台 CosyVoice Studio。 官方表示,该平台基于自研语音模型 Qwen-Audio 打造,包含语音记...
京东开源实时视频编辑模型JoyAI-Video-Edit
8月5日,京东宣布开源自研的实时流式视频编辑模型JoyAI-Video-Edit,用户可一边观看视频一边修改人物与场景,将视频创作从“先有素材再修改”变为实时互动编辑...
通义千问(Qwen)— 阿里巴巴的AI大模型全家桶
一、产品概览 项目 信息 全称 通义千问 / Qwen 开发方 阿里云 / 阿里巴巴集团 定位 全模态AI大模型家族 + AI原生应用生态 最新版本 Qwen3.5 / Q...
医疗大模型,最核心的十家公司!
2025年以来,医疗人工智能迈入“大模型驱动” 的新发展阶段。 过去十年,医疗AI主要集中在医学影像识别、辅助诊断等单点场景,而以GPT、Gemini、Claude等大模...
津公网安备12011002023007号