标签:音频
New小米开源工业级目标说话人语音识别大模型 Xiaomi-CocktailASR-1
9 月 11 日消息,小米技术今日发文宣布,小米正式发布并开源工业级目标说话人语音识别大模型 Xiaomi-CocktailASR-1。 官方表示,Xiaomi-CocktailASR-1 旨在解...
New环球音乐与 ElevenLabs 达成合作,共同打造授权人工智能音乐平台
9 月 11 日消息,环球音乐集团 (UMG) 美国当地时间 10 日宣布与人工智能音频研究和产品公司 ElevenLabs 达成一项多年许可协议和更广泛的战略合作。这也是后者...
米哈游《原神》角色声音被“偷”获赔 75 万元,上海首例涉 AI 声音仿冒不正当竞争案宣判
9 月 10 日消息,据《案件聚焦》节目公众号,近日,上海市浦东新区人民法院宣判了上海市首例涉 AI 声音仿冒不正当竞争纠纷案。 米哈游公司于 2025 年发现,一...
Suno 发布 v6 系列 AI 音乐模型,新增多项能力
9 月 9 日消息,据科技媒体 Engadget 今天报道,Suno 现已推出 v6 系列 AI 音乐模型,同时与华纳音乐、BMG 等唱片公司达成合作。 据了解,v6 系列一共包含三...
不注册、不花钱,10秒出一条带声音的AI视频,这家公司要干啥?
最近,AI 视频生成领域有一个备受瞩目的变化:视频的生成速度,已经比你看视频的速度都要快了。 这一切还要从一个名叫 H3 Max 的模型说起。它是 fal(一个生...
谷歌最强音乐 AI Lyria 3.5 塞进 Gemini:一键生成 3 分钟完整歌曲
谷歌发布公告,宣布在 Gemini 应用和 Gemini API 中上线最新音乐生成模型 Lyria 3.5,标志着谷歌音乐 AI 从内部实验工具(Google Flow Music)走向主流用户与...
合成器大厂罗兰 Roland 进军 AI 生成音乐领域,主打“旋律创作”
合成器大厂罗兰(Roland)正式进军生成式 AI 音乐领域,新推出了一款数字音频工作站(DAW)插件 Melody Flip。 该插件内置约 250 种按照不同音乐类型整理的主...
微软最强转录 AI 模型:MAI-Transcribe-2 登场,60 语种平均词错误率 5.2%
9 月 4 日消息,微软昨日(9 月 3 日)发布博文,宣布推出 MAI-Transcribe-2,宣称是其最快、最准确、最便宜的 AI 语音转文字模型。 在定价方面,MAI-Transcr...
Meta 发布首个实时音频感知 AI 模型,支持 20 余人分轨转写
9 月 2 日消息,科技媒体 9to5Mac 昨日(9 月 1 日)发布博文,报道称 Meta 公司推出 Muse Voice Transcribe,这是其首个实时音频感知模型。 开发者可通过 Me...
复制完脸,AI 开始复制专家的大脑
资本押注AI分身,转向复制人的知识、思维模式和工作流程。专家私有语料成产品壁垒,但需解决合规、留存和能力边界问题。数字人竞争分两条路线,人的经验被重...
津公网安备12011002023007号