标签:transformers
New腾讯发布WeMM-Embedding-9B多模态嵌入模型,MMEB-v2得分80.6
腾讯旗下混元团队于Hugging Face平台发布了WeMM-Embedding-9B,一个通用多模态嵌入模型。该模型基于Qwen3.5-9B构建,能够处理文本、图像、视频、视觉文档以及...
Cohere 发布 Command A+ W4A4 量化版,单块 B200 可运行
Cohere 与 Cohere Labs 于今日发布 Command A+ 的 W4A4 量化版(模型 ID:CohereLabs/command-a-plus-05-2026-w4a4),该版本在保持模型质量的同时,将硬件需...
OpenBMB 发布 MathForm-8B:将自然语言数学题转为 Lean 4 形式化证明
OpenBMB 团队近日发布 MathForm-8B,一个专门用于数学自动形式化的 8B 参数模型,能够将自然语言描述的数学命题转换为 Lean 4 形式化代码。该模型基于 Qwen3-...
阿里发布Qwen3.8-27B:原生多模态,支持百万级上下文
阿里通义千问团队今日在 Hugging Face 平台发布了新一代开源模型 Qwen3.8-27B,这是 Qwen 开源家族截至目前能力最强的一代。该模型为紧凑型稠密架构,拥有 27...
智谱发布 GLM-5:参数增至 744B,集成 DeepSeek 稀疏注意力
智谱 AI 于近日发布新一代开源大模型 GLM-5,目标直指复杂系统工程与长周期智能体任务。据官方介绍,GLM-5 在参数规模上从 GLM-4.5 的 355B(32B 激活)大幅...
每一次AI问答 都藏着一门暴涨千倍的生意
2026年,AI行业的关键词正在从“模型参数”悄然转向“Token(词元)消耗”。 今年3月,中国日均Token调用量就突破140万亿大关,较两年前增长超千倍。当大模型...
AI写知乎盐选故事,未来写作的革命性变革
在数字技术迅猛发展的今天,AI 正在以惊人的速度重塑传统内容创作的边界。以“AI写知乎盐选故事”为题,我们探讨的不仅仅是技术本身,更是它如何影响内容创作的...
通义千问插件到本地怎么用,全面解析与实操指南
随着大模型技术的快速发展,通义千问(Qwen)作为阿里巴巴集团推出的领先大语言模型,凭借其强大的文本生成、理解与推理能力,已成为众多企业和开发者的重要...
千问AI本地部署教程,从入门到实战
随着人工智能技术的快速发展,AI模型的本地部署变得愈发重要。在企业级应用中,模型的部署不仅关乎性能,更影响数据安全和系统稳定性。而千问AI作为阿里巴巴...
千问开源模型32B要什么配置才好
随着大语言模型的快速发展,开源模型的普及为开发者提供了更多选择。其中,通义千问32B作为一款高性能的大规模语言模型,其开源版本在推理和训练方面具有显著...
津公网安备12011002023007号