标签:大模型

离开OpenAI和Google后,两位大模型核心负责人决定卷下一代架构

曾经最相信强化学习的人之一,如今却认为:强化学习没有把我们带到 AGI。 Jerry Tworek 曾是 OpenAI 内部坚定的「强化学习最大主义者」。在 GPT-3、GPT-4 之...

清华唐杰团队揭示大模型记忆全景

近年来,大语言模型(LLMs)的突破很大程度上归功于Scaling Laws(参数、数据、算力)。 然而,在模型演进的过程中,一个同等重要的维度正变得愈发关键——记...

听说一些公司开始做员工skills了

我一个朋友,干企业陪跑的,五六年了。 前阵子他跟我说了个事,他陪跑的一家客户,把他做成Skills了。 他这几年给客户沉淀了一整套打法,怎么诊断,怎么拆...

超7万亿,DeepSeek V4 Flash单周调用量登顶全球第一

多模型聚合平台OpenRouter发布的全球AI大模型调用量周榜单(7月27日至8月2日)显示,DeepSeek V4 Flash以7.22万亿Token的调用量位居第一。 另据开源项目团队...

中国大模型周调用量全球登顶,Kimi K3引爆价格战

长久以来,海外闭源模型一直把持高价市场并独占高端评测榜单,但这一局面随着7月27日月之暗面开放旗舰模型K3的完整权重而被彻底打破。 近日,在国际权威评测...

最高估值5000亿,DeepSeek和Kimi被抢疯了

八月的一级市场,罕见的燃了一下。 据《财经》杂志报道,DeepSeek第二轮融资已重启,本轮计划募资500亿元,投前估值约5000亿元。另有参与交易的人士称,首轮...

DeepSeek重启第二轮融资,投前估值5000亿元

据《财经》援引多名交易人士消息,大模型公司DeepSeek已重启第二轮融资,本轮计划募资500亿元,投前估值约5000亿元,并计划在8月下旬完成签约。这一消息标志...

书生发布Intern-S2-Mobius:35B模型实现近4倍推理加速

书生团队(InternLM)在 Hugging Face 上发布了 Intern-S2-Mobius,一个基于 Mobius-v0 架构的 35B 参数多模态基础模型(支持图像-文本到文本任务)。该模型...

Om AI联汇获数亿元融资,前海母基金领投并开源VLX-Seek 1.5模型

杭州联汇科技股份有限公司(简称Om AI联汇)宣布完成新一轮数亿元融资,本轮由前海母基金领投,杭州政府产业基金及多方资本参投。公司同时正式开源VLX-Seek 1...

IDC全球基础模型评估:阿里云成唯一入选领导者象限中国厂商

国际数据公司(IDC)近日发布《IDC MarketScape:全球基础模型软件厂商评估》报告,在入选的11家全球厂商中,阿里云凭借千问(Qwen)模型家族与千问AI平台跻...
12728293031499