标签:预训练
New腾讯发布7B参数HiLS-Attention模型,实现高效长文本稀疏注意力训练
腾讯混元团队在Hugging Face平台正式开源了HiLS-Attention-7B模型。该模型的核心创新在于其采用的HiLS-Attention(分层稀疏注意力)机制,这是一种分块稀疏注...
NewAI手机大战,终点是没有AI手机
几乎所有行业都在讨论“用AI重做一遍”,手机也不例外。 苹果推出Apple智能,三星持续加码Galaxy AI,华为、小米、OPPO、vivo也陆续把大模型接入手机系统。 ...
New书生发布 404B 参数多模态模型 Intern-S2-Preview-397B,专攻科学智能与长周期智能体
上海人工智能实验室书生团队(InternLM)近日发布了其最新的多模态基础模型 Intern-S2-Preview-397B,总参数量达到 404B,定位为面向科学智能和长周期智能体...
New蚂蚁百灵发布Ling-3.0-Flash,124B参数激活仅5.1B
蚂蚁百灵正式发布新一代原生混合推理模型 Ling-3.0-Flash。该模型总参数量为 124B,但单次计算仅激活 5.1B 参数,在大幅压缩计算开销的同时,在基础推理、指...
谷歌 DeepMind 发布 GenCeption:基于阿里 Wan2.1,打破计算机视觉桎梏
7 月 21 日消息,科技媒体 The Decoder 昨日(7 月 20 日)发布博文,报道称谷歌 DeepMind 发布 GenCeption 模型,将预训练的视频生成器重新用于深度估计和分...
NVIDIA 联手日本政经界发布全球首个国家级人工智能基础设施
7 月 16 日消息,NVIDIA(英伟达)当地时间今日宣布联手日本政治、经济两界发布全球首个国家级人工智能基础设施。 NVIDIA 将与 Noetra 合作基于 DSX 平台打...
面壁智能融资超50亿,估值超200亿
投资界从知情人士处获悉,面壁智能已完成新一轮融资,投资方包括国家级基金、央企、汽车制造商等各类产业方、知名财务投资人等。 至此,面壁智能2026上半年...
开源模型 vs 商业模型,AI小说创作的两种路径
在AI技术迅猛发展的今天,AI小说的创作正逐渐从实验室走向市场。而在这股浪潮中,开源模型与商业模型成为两种主要的开发路径。它们在技术实现、商业模式、应...
深度学习写故事,AI小说的创作逻辑与工具应用
在人工智能迅速发展的今天,深度学习技术正逐步渗透到文学创作领域,催生出一种全新的写作方式——AI小说。通过深度学习模型,作家能够借助算法生成具有逻辑性...
AI写小说卡文怎么办,高效解决AI生成小说卡顿的实用指南
随着人工智能技术的迅速发展,AI写小说已成为越来越多创作者的新选择。然而,在使用AI写作工具时,用户常常会遇到“卡文”问题,即AI在生成内容时停滞不前,无...
津公网安备12011002023007号