标签:预训练

蚂蚁百灵发布Ling-3.0-flash:124B总参5.1B激活,性能对标前代旗舰

蚂蚁集团旗下百灵团队于今日发布了新一代原生混合推理模型 Ling-3.0-flash。该模型总参数量为 124B,激活参数仅 5.1B,分别约为其前代 1T 级旗舰模型 Ring-2....

智谱发布GLM-5.3-Flash:320B参数原生多模态模型

智谱AI(Z.ai)于Hugging Face发布GLM-5系列首个原生多模态模型GLM-5.3-Flash。该模型总参数达320B,但激活参数仅18B,在多项基准测试和真实工作负载中超越前...

蚂蚁百灵发布LLaDA-Image-Turbo开源图像模型

蚂蚁集团旗下百灵实验室于2026年9月4日发布LLaDA-Image系列开源图像生成与编辑模型,并同步公开模型权重与推理代码。该系列包含LLaDA-Image(Base版)与LLaDA...

沙特 HUMAIN 公布前沿阿语模型 humain-m3,由 MiniMax 受托开发

9 月 3 日消息,沙特阿拉伯主权财富基金 PIF 旗下人工智能企业 HUMAIN 当地时间今日公布了前沿阿拉伯语模型 humain-m3。该模型由 MiniMax 受托开发。 humain-...

OpenAI GPT-6 Astra 发布:首次达到“关键”级网络安全能力门槛,布罗克曼认为 AGI 时代已经到来

9 月 4 日消息,当地时间 9 月 3 日,OpenAI 宣布推出新一代 GPT-6 Astra 模型,这是该公司迄今为止最强大、部署最广泛的大语言模型。 据介绍,Astra 是 Open...

Gemini 3.8 Flash 来了,结果惨遭对手嘲讽

好好好,谷歌也开始按月更大模型了。 就在刚刚,距离 Gemini 3.7 Flash 发布仅仅过去三周,Google Gemini 3.8 Flash 和专攻网络安全的 Gemini 3.8 Flash Cyb...

阿里发布 Qwen-Drive-1.0-4B 自动驾驶视觉语言基础模型

阿里通义千问团队在 Hugging Face 上发布了 Qwen-Drive-1.0-4B,这是首个在预训练阶段就统一 3D 感知与视觉问答的自动驾驶视觉语言基础模型,并进一步扩展至...

全球首个多模态世界模型:李飞飞 World Labs 发布 Atlas,像素级精度控制镜头、拍出“子弹时间”大片

9 月 2 日消息,“AI 教母”李飞飞的创企 World Labs 今日发布了“全球首个多模态世界模型”—— Atlas,宣称该模型能够以像素级精确的相机控制生成图像和视频帧,...

编程能力追赶 OpenAI 与 Anthropic:谷歌 Gemini 3.8 Flash 最快当地时间周三上线,内部代号“Skimaki”

9 月 2 日消息,据《华尔街日报》当地时间 9 月 1 日报道,谷歌即将发布一款编程能力大幅升级的新模型 Gemini 3.8 Flash,内部代号为“Skimaki”。该模型最早可...

谷歌发布 TimesFM-3,3.3 亿参数即可进行零样本多变量时间序列预测

9 月 1 日消息,谷歌今天发布 TimesFM-3 模型,这是该公司时间序列基础模型系列的第三代产品。拥有原生多变量预测、双注意力机制、连续补丁掩码等特性,可进...
123495