标签:音频

New阿里推出国内首个 AI 语音平台 CosyVoice Studio,限时免费体验

8 月 7 日消息,阿里巴巴今日宣布推出国内首个一站式 AI 语音生产力平台 CosyVoice Studio。 官方表示,该平台基于自研语音模型 Qwen-Audio 打造,包含语音记...

NewSuno 平台将为 AI 生成音乐添加隐水印,防止滥用现象发生

8 月 7 日消息,据科技媒体 Engadget 今天报道,Suno 将为平台内生成的 AI 音乐添加隐藏式水印。目前该公司正面临多起法律纠纷,音乐行业也在不断对其施压。 ...

NewFLUX 3 视频 AI 生成模型正式上线:最长 20 秒原生 1080p,跑分优于 Seedance 2.0

8 月 6 日消息,Black Forest Labs 昨日(8 月 5 日)发布公告,宣布正式上线 FLUX 3 视频生成模型,最长 20 秒,原生 1080p 分辨率,其性能要优于字节跳动的...

New阿里全新一代视频生成模型 Wan3.0 公测:单次生成能 30 秒,号称万物皆可生视频

8 月 6 日消息,“阿里云”公众号今天(6 日)晚间宣布,全新一代视频生成模型 Wan3.0 开启公测。 Wan3.0 在生成时长、万能创作、全能参考与真实感等维度全面升...

New腾讯元宝上线Hy ASR 3.0 preview语音识别模型:各种方言、复杂环境都能听清

8月6日消息,腾讯混元日前正式推出Hy ASR 3.0 preview语音识别模型,已率先落地腾讯元宝App面向全部用户免费使用。 依托Hy3基座大模型打通声学识别与语义理...

NewFLUX 3 视频 AI 生成模型正式上线:最长 20 秒原生 1080p,跑分优于 Seedance 2.0

8 月 6 日消息,Black Forest Labs 昨日(8 月 5 日)发布公告,宣布正式上线 FLUX 3 视频生成模型,最长 20 秒,原生 1080p 分辨率,其性能要优于字节跳动的...

Runware 推出集装箱式 AI 推理 Pod,加速 GPU 部署

AI 推理与原生计算公司 Runware 于 2026 年 8 月 4 日发布 Sonic Inference Pod,这是一种集装箱式模块化数据中心,旨在快速扩充面向模型提供商的 AI 推理基...

字节跳动 SeedRealtime 音视频全双工大模型发布:支持边看、边听、边说,已上线豆包

8 月 5 日消息,字节跳动 Seed 今日宣布推出原生音视频全双工大模型 SeedRealtime,走向全模态自然交互。 SeedRealtime 用统一架构原生融合音频、视频与文本...

禁掉所有工具后,Opus 5和GPT-5.6的差距终于藏不住了

且不论性能,自Claude Opus 5发布以后有一件事让AI圈特别在意,就是Anthropic在提示词上的改进。 AI投资人玛特·夏默(Matt Shumer)在X上发了一条视频,播放...

欧盟 AI 透明度新规生效:企业需明确标注 AI 生成内容,违者将被重罚

8 月 4 日消息,欧盟推出了一系列新规定,旨在帮助公众更容易识别网络上的聊天机器人和 AI 深度伪造内容。作为欧盟《人工智能法案》(AI Act)重要组成部分的...
123312