标签:多模态
阿里达摩院开放 15 项芯片与 AI 研究课题,启动“阿里星”顶尖人才招募
8 月 6 日消息,阿里达摩院今日宣布了面向 2027 届毕业生的“阿里星”顶尖人才招募培养计划。 达摩院今年已开放 15 项研究课题,涉及 AI 芯片、新型 CPU 架构、...
京东开源实时视频编辑模型JoyAI-Video-Edit
8月5日,京东宣布开源自研的实时流式视频编辑模型JoyAI-Video-Edit,用户可一边观看视频一边修改人物与场景,将视频创作从“先有素材再修改”变为实时互动编辑...
微软发布 Mage-VL:从零训练的流式多模态模型,视频理解提速 3.5 倍
微软近日在 Hugging Face 平台发布了 Mage-VL,一款面向图像与视频理解的流式多模态基础模型。该模型的核心创新在于其视觉编码器 Mage-ViT 完全从零训练,规...
全球首个千亿级MoE视频模型开源!Sand.ai给视频生成Scaling找了条新路
8月的第一周,国内视频生成赛道格外热闹。 7月31日,MiniMax发布首款开源多模态生成模型H3;同一天,字节跳动推出Seedance 2.5,将单次生成时长从15秒拉长至...
LibTV — LiblibAI 推出的专业影视级 AI 视频创作平台
一、产品概览 项目 信息 全称 LibTV 开发方 LiblibAI(北京奇点星宇科技有限公司) 定位 专业影视级 AI 视频创作工作流平台 发布时间 2025年下...
114B参数、6B激活,Sand.ai刚刚开源全球首个千亿MoE视频生成模型
从今年 6 月到 8 月初,短短不到 60 天时间,有一件事几乎同时在新 BAT 发生。 先是 6 月,阿里率先开启内部 Agent 的产品线与能力大整合,到 8 月 3 日,官...
中国大模型周调用量全球登顶,Kimi K3引爆价格战
长久以来,海外闭源模型一直把持高价市场并独占高端评测榜单,但这一局面随着7月27日月之暗面开放旗舰模型K3的完整权重而被彻底打破。 近日,在国际权威评测...
书生发布Intern-S2-Mobius:35B模型实现近4倍推理加速
书生团队(InternLM)在 Hugging Face 上发布了 Intern-S2-Mobius,一个基于 Mobius-v0 架构的 35B 参数多模态基础模型(支持图像-文本到文本任务)。该模型...
IDC全球基础模型评估:阿里云成唯一入选领导者象限中国厂商
国际数据公司(IDC)近日发布《IDC MarketScape:全球基础模型软件厂商评估》报告,在入选的11家全球厂商中,阿里云凭借千问(Qwen)模型家族与千问AI平台跻...
办公 Agent 爆火,模型大战进入下一阶段
从今年 6 月到 8 月初,短短不到 60 天时间,有一件事几乎同时在新 BAT 发生。 先是 6 月,阿里率先开启内部 Agent 的产品线与能力大整合,到 8 月 3 日,官...
津公网安备12011002023007号