New多会话语音记忆基准VoxMem,专治音频大模型记不住「谁说的、怎么说」
在语音助手、多用户共享的家庭助理等长期对话场景中,模型需要跨越多次会话记住用户的信息,但现有评测常遭遇两大难题: 一是语音中的关键信息不止于文字,...
New字节找到了DeepSeek时强时弱的原因
DeepSeek的神鬼二象性被字节Seed团队逮到了。 同一道题,什么都没改,只在前面多塞几个无关紧要的字符,模型突然就不会了??? 而且还不是偶尔抽风。 See...
New最快今日发布!谷歌Gemini 4 Argon已对部分用户开放
就在刚刚,海外科技圈爆料:谷歌下一代重磅模型 Gemini 4 Argon 已密集现身多个平台,甚至已经对部分 Pro 用户开放! 这不是捕风捉影的画大饼,也不是停留在...
New短短 10 个月几乎翻倍,AI 模型评测平台 Arena 估值升至 31 亿美元
10 月 9 日消息,当地时间 8 日,AI 模型评测平台 Arena 竞技场宣布完成 2 亿美元(注:现汇率约合 13.43 亿元人民币) B 轮融资,估值达到 31 亿美元(现汇...
NewJetBrains 编程 AI 模型 Mellum2.1 发布:高负载推理吞吐量近 Qwen3.5-9B 两倍
10 月 9 日消息,JetBrains 昨日(10 月 8 日)发布博文,宣布上线 Mellum2.1 模型,重点增强智能体编程能力。该模型延续 Mellum2 的 12B 混合专家架构,拥有...
NewAnthropic 推出 OSS Scanner:用 AI 为开源软件免费扫漏洞
10 月 9 日消息,当地时间 10 月 8 日,Anthropic 宣布正式推出面向开源软件的可选接入型漏洞检测服务 OSS Scanner,加入该项目的开源软件将由 Anthropic 最...
NewLiquid AI 开源 d1 系列决策模型:单次判断仅 8 毫秒,支持图像输入
10 月 9 日消息,Liquid AI 于 10 月 7 日发布博文,宣布推出 d1 系列两款开放权重决策模型:d1-3B 支持 31.2 亿参数的文本与图像判断,d1-omni-600M 以 5.87...
NewAnthropic Claude 现已支持数据仪表板与解释性动画功能
10 月 9 日消息,Anthropic 当地时间昨日宣布 Claude 人工智能现已支持 Dashboards 数据仪表板、Motion 解释性动画两项新的功能。 Claude Dashboards:连接至...
New刚刚,GPT-6.1 Sol Ultrafast 来了!
今天是 Tibo 大神「连续 28 天发布或重置」的第四天,重磅的来了! 昨天,OpenAI 决定向所有用户(包括免费和付费用户)开放 GPT-6 ,今天就推出了全新的...
New伍德喊话「跟随AI代理」,ARK持仓文件却显示另一条路径
ARK Invest 首席执行官凯西·伍德在 Robinhood 主办的休斯顿峰会上提出一个新说法:投资者未来会越来越多地讨论「跟随 AI 代理」。但据 24/7 Wall St. 报道,A...
津公网安备12011002023007号