标签:大模型
刚刚,Gemini 3.7 Flash 正式发布,谷歌真的急了
Gemini 新官上任后的第一把火,来了。 距离 3.6 Flash 发布才过去 3 周,Google 又端上了 Gemini 3.7 Flash。 刚刚接掌 Google DeepMind 的 Koray Kavukcuo...
一夜之间,GPT-5.6 Sol被OpenAI加速了14倍
AI 开始卷信息不对等了? 8 月 14 日凌晨,OpenAI 联合 AI 芯片厂商 Cerebras 正式预览了其旗舰模型 GPT-5.6 Sol 的全新服务层级「超高速模式」(Ultrafast ...
xAI 发布 Grok 4.6,主打智能体与性价比,Grok 4.7 已在训练
xAI 于 8 月 11 日发布新一代大模型 Grok 4.6,官方称其在同等价格下相较 4.5 实现“重大升级”,并确认模型参数规模为 1.5T。该模型被定位为面向“长期运行的智...
腾讯称53亿美元硬件投入可即时获利,但选择自研模型
腾讯在最新季度财报电话会上透露,公司本季度资本开支高达530亿美元,但管理层明确表示,尽管将这部分算力资源对外出租可以“几乎立即”收回成本,公司仍选择将...
Cisco高管:训练前沿大模型需烧30至50亿美元,数月后或过时
Cisco总裁兼首席产品官Jeetu Patel近日表示,AI巨头们正陷入一场极其疯狂的算力赌局。据他观察,当前训练一个前沿大模型需要烧掉30至50亿美元,而要收回成本...
智源FlagOS完成Qwen3.8-2.4T在9款芯片的Day0适配
阿里巴巴近日开源了其超大规模MoE(混合专家)模型Qwen3.8-2.4T-A95B,与此同时,智源研究院的Flag OS社区宣布已完成该模型的Day0多芯片适配。这意味着,在模...
张一鸣定调:字节大模型不依赖蒸馏,自研优先
字节跳动创始人张一鸣罕见打破沉默,为大模型研发定下新基调。据《The Information》8月5日报道,在7月举行的Seed全员会上,张一鸣明确要求,即使Seed暂时落...
Claude团队构造668阶哈达玛矩阵,扫清2000阶以下全部悬案
Anthropic研究员、数学家Levent Alpöge近日报告,他与两位人类合作者Philippe Voinov、Saul Reynolds-Haertle,以及Anthropic的AI模型Claude,成功构造出668...
阿里开源2.4T参数Qwen3.8,国产超大模型架构趋同
8月13日,阿里正式开放了Qwen3.8-2.4T的模型权重,这是继Kimi K3开源半个月后,国产超大模型开源领域的又一重磅动作。此次开源不仅是参数规模达到2.4T的大模...
中美开源模型大横评:Kimi K3领跑,DeepSeek性价比突出
7月底至8月中旬,开源大模型迎来一波密集发布潮:国内Kimi K3、Qwen3.8-Max先后放出权重,DeepSeek V4 Pro正式版上线;沉寂一年多的美国开源阵营也强势回归,...
津公网安备12011002023007号