标签:Transformer
New阿里发布Qwen3.8-27B:原生多模态,支持百万级上下文
阿里通义千问团队今日在 Hugging Face 平台发布了新一代开源模型 Qwen3.8-27B,这是 Qwen 开源家族截至目前能力最强的一代。该模型为紧凑型稠密架构,拥有 27...
NewJeff Dean离开谷歌,与数名AI研究员创办Discovery Loop
当地时间8月5日,在谷歌工作约27年的Jeff Dean在社交平台宣布离职,将与数名谷歌AI研究人员共同创办AI公司Discovery Loop。此前,他担任谷歌Research和谷歌De...
下一场AI革命,要取代Transformer?
2017 年夏天,Google 的 AI 研究人员发表了影响深远的论文《Attention Is All You Need》,提出了一种新的神经网络架构——Transformer。九年过去,Transformer...
手掌、桌面与车轮,端侧AI打响“入口之战”
当行业还在为云端大模型的参数规模、训练算力争论不休时,一场更具决定性的战争,已经在离用户最近的终端设备上悄然打响。 从车企密集发布搭载端侧大模型的...
谷歌创始人布林紧急接管Gemini团队,但“3.5 Pro已被取消
郑重提示!大伙儿别等Gemini 3.5 Pro了,不然你就是在机场苦等一艘轮船。 今年5月的GoogleI/O,主演讲PPT有这么一张: Gemini 3.5 Pro——Coming next month。...
智谱发布 GLM-5:参数增至 744B,集成 DeepSeek 稀疏注意力
智谱 AI 于近日发布新一代开源大模型 GLM-5,目标直指复杂系统工程与长周期智能体任务。据官方介绍,GLM-5 在参数规模上从 GLM-4.5 的 355B(32B 激活)大幅...
谷歌AI核心团队出走创办Discovery Loop,专注自动化科研
8月5日,谷歌宣布AI部门重大调整:Google DeepMind CEO Demis Hassabis转任董事长,并出任Alphabet首席科学家;效力谷歌近27年的首席科学家Jeff Dean则与Sanj...
微软发布 Mage-VL:从零训练的流式多模态模型,视频理解提速 3.5 倍
微软近日在 Hugging Face 平台发布了 Mage-VL,一款面向图像与视频理解的流式多模态基础模型。该模型的核心创新在于其视觉编码器 Mage-ViT 完全从零训练,规...
全球首个千亿级MoE视频模型开源!Sand.ai给视频生成Scaling找了条新路
8月的第一周,国内视频生成赛道格外热闹。 7月31日,MiniMax发布首款开源多模态生成模型H3;同一天,字节跳动推出Seedance 2.5,将单次生成时长从15秒拉长至...
离开OpenAI和Google后,两位大模型核心负责人决定卷下一代架构
曾经最相信强化学习的人之一,如今却认为:强化学习没有把我们带到 AGI。 Jerry Tworek 曾是 OpenAI 内部坚定的「强化学习最大主义者」。在 GPT-3、GPT-4 之...
津公网安备12011002023007号