标签:transformers

New阿里发布Qwen3.8-27B:原生多模态,支持百万级上下文

阿里通义千问团队今日在 Hugging Face 平台发布了新一代开源模型 Qwen3.8-27B,这是 Qwen 开源家族截至目前能力最强的一代。该模型为紧凑型稠密架构,拥有 27...

智谱发布 GLM-5:参数增至 744B,集成 DeepSeek 稀疏注意力

智谱 AI 于近日发布新一代开源大模型 GLM-5,目标直指复杂系统工程与长周期智能体任务。据官方介绍,GLM-5 在参数规模上从 GLM-4.5 的 355B(32B 激活)大幅...

每一次AI问答 都藏着一门暴涨千倍的生意

2026年,AI行业的关键词正在从“模型参数”悄然转向“Token(词元)消耗”。 今年3月,中国日均Token调用量就突破140万亿大关,较两年前增长超千倍。当大模型...

AI写知乎盐选故事,未来写作的革命性变革

在数字技术迅猛发展的今天,AI 正在以惊人的速度重塑传统内容创作的边界。以“AI写知乎盐选故事”为题,我们探讨的不仅仅是技术本身,更是它如何影响内容创作的...

通义千问插件到本地怎么用,全面解析与实操指南

随着大模型技术的快速发展,通义千问(Qwen)作为阿里巴巴集团推出的领先大语言模型,凭借其强大的文本生成、理解与推理能力,已成为众多企业和开发者的重要...

千问AI本地部署教程,从入门到实战

随着人工智能技术的快速发展,AI模型的本地部署变得愈发重要。在企业级应用中,模型的部署不仅关乎性能,更影响数据安全和系统稳定性。而千问AI作为阿里巴巴...

千问开源模型32B要什么配置才好

随着大语言模型的快速发展,开源模型的普及为开发者提供了更多选择。其中,通义千问32B作为一款高性能的大规模语言模型,其开源版本在推理和训练方面具有显著...

少样本学习,AI工具驱动下的高效数据探索

在人工智能快速发展的今天,数据成为驱动模型训练的核心资源。然而,面对海量数据的挑战,传统机器学习模型往往需要大量标注数据才能达到较高的准确率。因此...

零样本学习,AI工具如何突破数据限制,实现高效模型训练

在当今人工智能快速发展的背景下,模型训练的效率和效果始终是技术探索的核心。传统的机器学习方法依赖于大量标注数据进行训练,但随着数据获取的昂贵性和标...

增量学习,AI模型的持续进化与高效优化策略

在人工智能迅猛发展的今天,模型的训练与优化一直是技术探索的核心议题。其中,“增量学习”(Incremental Learning)作为一种重要的机器学习方法,正逐渐成为A...
12313