标签:视频
3000元博20万的时代过去了,AI漫剧不是捡钱的风口
今年以来,AI生成技术的大幅成熟,让行业呼喊工业化拐点已至。AI漫剧赛道悄然升温,大量中小工作室乃至个人蜂拥而至,企图用AI漫剧分一杯羹。加之《霍去病》...
DeepSeek Harness 之后,重读最早定义开源的一群人
8 月 19 日,OpenAI 全面开源 Codex Harness。一周前,DeepSeek Harness 也以极快速度冲过 10 万 GitHub Stars。 走向开源,它们主动把自己放进了一个更大的...
因使用主播内容训练亚马逊 AI,Twitch 面临集体诉讼
8 月 24 日消息,Twitch 正面临一场集体诉讼,原因是其将主播的内容用于训练亚马逊的 AI。 一名 Twitch 主播已针对该平台及其母公司亚马逊提起拟议的集体诉讼...
阿里云视频生成模型 Wan3.0 正式上线,支持单次生成 30 秒视频、文档输入
8 月 24 日消息,阿里云消息,今天,视频生成模型 Wan3.0 正式上线。官方称,Wan3.0 在生成时长、万能创作、全能参考以及真实世界还原等维度全面升级,单次可...
月之暗面第一代万亿参数多模态模型 Kimi K2.5 官宣月底结束服役
8 月 24 日消息,月之暗面 Kimi 官方微博今日宣布,其第一代万亿参数多模态模型 —— Kimi K2.5 本月底即将结束服役。 据此前报道,今年 1 月,月之暗面宣布推...
Gen1.5 模型带来重要进展:物理 AI 正在接近 GPT3 时刻
如果物理 AI 也能 scaling,意味着什么? 研究人员先教机器人拿起刷子,把桌上的积木扫进碗里。 然后,他们把刷子拿走,换成一根香蕉。 机器人抓起香蕉,...
谷歌发布 Gemma 4 系列开源模型,含 MTP 草稿模型与多模态能力
谷歌 DeepMind 于近日发布 Gemma 4 系列开源模型,涵盖五种尺寸(E2B、E4B、12B、26B A4B、31B),支持文本、图像、音频与视频输入,并输出文本。该系列模型...
Adobe Firefly 扩充 AI 音频服务,可生成音乐、配音和音效
8 月 21 日消息,Adobe 昨日(8 月 20 日)发布博文,宣布其创意 AI 工作室服务 Adobe Firefly 扩充 3 项音频功能,目前已面向所有用户开放。 Adobe 邀请用...
阿里云:GLM-5.3、Deepseek-V4-Pro 等多款模型上线千问 AI 平台
8 月 21 日消息,今日,阿里云 MaaS 再次扩充模型服务矩阵:GLM-5.3 和 DeepSeek-V4-Pro 正式版现已接入千问 AI 平台,相关 API 服务同步开放,开发者可直接...
机器人初创 Generalist AI 发布 GEN-1.5:单次演示即可学会新任务
机器人初创公司 Generalist AI 于 8 月 20 日发布了新一代 AI 模型 GEN-1.5,宣称该模型能让机器人仅凭一段 3 至 12 秒的演示视频学会新任务,且无需任何额外...
津公网安备12011002023007号