标签:音频

New阿里发布 Qwen3.8-Omni-Flash 全模态模型:音视频能力提升,百万 Token 图文音视频输入 0.8 元

9 月 18 日消息,阿里千问今日正式上线新一代原生全模态模型 Qwen3.8-Omni-Flash,并已在千问 AI 平台提供。该模型可同时处理文本、图像、音频和视频输入,支...

谷歌推出 Gemini 3.8 Live 和 3.8 Live Extended Thinking 实时对话模型,支持 97 种语言切换

9 月 16 日消息,当地时间 9 月 15 日,谷歌宣布推出 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking。谷歌称这是其迄今最先进的实时对话模型,在智...

阶跃发布 StepAudio 3 系列语音大模型,拿下多个全球第一

9 月 15 日消息,今日阶跃正式发布 StepAudio3 系列模型,包括 StepAudio3Realtime、StepAudio3ASR、StepAudio3TTS、StepAudio3Gen 和 StepAudio3Music,其中...

苹果新 CEO 特努斯谈 Meta“变态眼镜”风波:AI 智能设备需要让旁人安心

 9 月 14 日消息,据《商业内幕》前天报道,苹果新任首席执行官约翰 · 特努斯最近接受媒体采访,谈及 Meta 公司最近陷入的“变态眼镜”风波,以及苹果如何看待 ...

小米开源工业级目标说话人语音识别大模型 Xiaomi-CocktailASR-1

9 月 11 日消息,小米技术今日发文宣布,小米正式发布并开源工业级目标说话人语音识别大模型 Xiaomi-CocktailASR-1。 官方表示,Xiaomi-CocktailASR-1 旨在解...

环球音乐与 ElevenLabs 达成合作,共同打造授权人工智能音乐平台

9 月 11 日消息,环球音乐集团 (UMG) 美国当地时间 10 日宣布与人工智能音频研究和产品公司 ElevenLabs 达成一项多年许可协议和更广泛的战略合作。这也是后者...

米哈游《原神》角色声音被“偷”获赔 75 万元,上海首例涉 AI 声音仿冒不正当竞争案宣判

9 月 10 日消息,据《案件聚焦》节目公众号,近日,上海市浦东新区人民法院宣判了上海市首例涉 AI 声音仿冒不正当竞争纠纷案。 米哈游公司于 2025 年发现,一...

Suno 发布 v6 系列 AI 音乐模型,新增多项能力

9 月 9 日消息,据科技媒体 Engadget 今天报道,Suno 现已推出 v6 系列 AI 音乐模型,同时与华纳音乐、BMG 等唱片公司达成合作。 据了解,v6 系列一共包含三...

不注册、不花钱,10秒出一条带声音的AI视频,这家公司要干啥?

最近,AI 视频生成领域有一个备受瞩目的变化:视频的生成速度,已经比你看视频的速度都要快了。 这一切还要从一个名叫 H3 Max 的模型说起。它是 fal(一个生...

谷歌最强音乐 AI Lyria 3.5 塞进 Gemini:一键生成 3 分钟完整歌曲

谷歌发布公告,宣布在 Gemini 应用和 Gemini API 中上线最新音乐生成模型 Lyria 3.5,标志着谷歌音乐 AI 从内部实验工具(Google Flow Music)走向主流用户与...
123315