标签:音频

NewMiniMax-Music3 音乐模型发布:AI 生成最长 5 分钟歌曲

8 月 14 日消息,AI 公司 MiniMax 今天(8 月 14 日)推出音乐生成模型 MiniMax-Music3,可根据歌词和音乐描述生成最长 5 分钟的完整歌曲。 架构方面,MiniMa...

New神秘生图模型“mona-lisa-1”曝光:含 OpenAI 来源信号,GPT-Image-2 发布三个月仍稳坐第一

8 月 13 日消息,8 月 9 日有一款代号为“mona-lisa-1”的图像生成模型出现在 AI 竞技场的盲测列表中。 爆料者 AiBattle 称,他将该模型生成的图片提交至 OpenA...

威联通为 Qsirch 推出 AI 模式:利用 VLM / LLM 优化 NAS 内容搜索体验

8 月 12 日消息,威联通 (QNAP) 今日宣布为其 NAS 核心搜索应用 Qsirch 进行升级,推出整合 VLM 与 LLM 的 Qsirch AI Mode,优化用户的搜索体验。 得益于这一...

LTX-2.5 模型登场:AI 生成 10 秒 720P 视频仅需 6.8 秒,原生集成 ComfyUI

8 月 12 日消息,开放世界模型公司 LTX 昨日(8 月 11 日)宣布推出 LTX-2.5 模型,原生集成 ComfyUI,在 2 张英伟达 GB200 配置下生成 10 秒 720P 视频只需...

阿里推出国内首个 AI 语音平台 CosyVoice Studio,限时免费体验

8 月 7 日消息,阿里巴巴今日宣布推出国内首个一站式 AI 语音生产力平台 CosyVoice Studio。 官方表示,该平台基于自研语音模型 Qwen-Audio 打造,包含语音记...

Suno 平台将为 AI 生成音乐添加隐水印,防止滥用现象发生

8 月 7 日消息,据科技媒体 Engadget 今天报道,Suno 将为平台内生成的 AI 音乐添加隐藏式水印。目前该公司正面临多起法律纠纷,音乐行业也在不断对其施压。 ...

FLUX 3 视频 AI 生成模型正式上线:最长 20 秒原生 1080p,跑分优于 Seedance 2.0

8 月 6 日消息,Black Forest Labs 昨日(8 月 5 日)发布公告,宣布正式上线 FLUX 3 视频生成模型,最长 20 秒,原生 1080p 分辨率,其性能要优于字节跳动的...

阿里全新一代视频生成模型 Wan3.0 公测:单次生成能 30 秒,号称万物皆可生视频

8 月 6 日消息,“阿里云”公众号今天(6 日)晚间宣布,全新一代视频生成模型 Wan3.0 开启公测。 Wan3.0 在生成时长、万能创作、全能参考与真实感等维度全面升...

腾讯元宝上线Hy ASR 3.0 preview语音识别模型:各种方言、复杂环境都能听清

8月6日消息,腾讯混元日前正式推出Hy ASR 3.0 preview语音识别模型,已率先落地腾讯元宝App面向全部用户免费使用。 依托Hy3基座大模型打通声学识别与语义理...

FLUX 3 视频 AI 生成模型正式上线:最长 20 秒原生 1080p,跑分优于 Seedance 2.0

8 月 6 日消息,Black Forest Labs 昨日(8 月 5 日)发布公告,宣布正式上线 FLUX 3 视频生成模型,最长 20 秒,原生 1080p 分辨率,其性能要优于字节跳动的...
123313