标签:LLM
威联通为 Qsirch 推出 AI 模式:利用 VLM / LLM 优化 NAS 内容搜索体验
8 月 12 日消息,威联通 (QNAP) 今日宣布为其 NAS 核心搜索应用 Qsirch 进行升级,推出整合 VLM 与 LLM 的 Qsirch AI Mode,优化用户的搜索体验。 得益于这一...
DeepSeek涨价30倍仍最便宜,工程师称租赁GPU也能复现低价
DeepSeek 近期宣布涨价,幅度高达 30 倍,但第三方平台 OpenCode 工程师 dax 在帖子中表示,即便租赁 GPU 也能复现其当前价格,并推测这次涨价并非因为亏损,...
国内已知最大规模!消息称字节跳动正讨论训练超 5 万亿参数模型
8 月 6 日消息,晚点 LatePost 今天(6 日)晚间爆料称,字节跳动正在讨论训练一个参数规模超 5 万亿的模型,超过阿里的 Qwen 3.8-Max(2.4 万亿参数)和月之...
清华唐杰团队揭示大模型记忆全景
近年来,大语言模型(LLMs)的突破很大程度上归功于Scaling Laws(参数、数据、算力)。 然而,在模型演进的过程中,一个同等重要的维度正变得愈发关键——记...
Runware 推出集装箱式 AI 推理 Pod,加速 GPU 部署
AI 推理与原生计算公司 Runware 于 2026 年 8 月 4 日发布 Sonic Inference Pod,这是一种集装箱式模块化数据中心,旨在快速扩充面向模型提供商的 AI 推理基...
书生发布Intern-S2-Mobius:35B模型实现近4倍推理加速
书生团队(InternLM)在 Hugging Face 上发布了 Intern-S2-Mobius,一个基于 Mobius-v0 架构的 35B 参数多模态基础模型(支持图像-文本到文本任务)。该模型...
DeepSeek内测招募帖引爆Agent开源生态:769人报名、712个仓库、超120万Stars
DeepSeek的Agent Harness团队负责人崔添翼在社交平台发文,公开招募DeepSeek Harness内测人员,要求申请者参与过开源Agent项目的建立和维护,并提交GitHub仓...
博导称月之暗面 Kimi 创始人杨植麟有很多机会留在美国,但他毅然拒绝苹果、坚持回国创业
8 月 4 日消息,Kimi K3 模型发布后蝉联前端开发榜全球第一,月之暗面这家中国 AI 创企成为了人们关注的焦点。 月之暗面创始人杨植麟的卡内基梅隆大学博士生...
谷歌DeepMind发布机器人大脑Gemini Robotics 2,用VLA从头控到脚
谷歌:在LLM圈里我唯唯诺诺,在机器人圈里我直接大打出手! 刚刚,谷歌DeepMind发布了新一代的机器人大脑Gemini Robotics 2。 从官方放出的Demo来看,这一...
华为昇腾 0day 适配开源 Kimi K3,支持训练与推理部署
7 月 28 日消息,2026 年 7 月 27 日,月之暗面正式开源 Kimi K3。该模型总参数量达 2.8 万亿,是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和...
津公网安备12011002023007号