标签:Nvidia
蚂蚁百灵发布Ling-3.0-tiny轻量推理模型
蚂蚁集团旗下百灵(inclusionAI)于今日发布轻量级混合推理模型 Ling-3.0-tiny,该模型总参数为 7.9B,但每个token仅激活 1.3B 参数,旨在以较低推理成本提供...
Groq 再出发:转型 Neocloud,以 35 亿美元估值完成 3.5 亿美元 A 轮融资
8 月 18 日消息,初创企业 Groq 去年 12 月与 NVIDIA(英伟达)签署了一份价值 200 亿美元的非独家技术许可协议,向芯片巨头提供 LPU 推理加速 ASIC 授权。Gr...
xAI 发布 Grok 4.6,主打智能体与性价比,Grok 4.7 已在训练
xAI 于 8 月 11 日发布新一代大模型 Grok 4.6,官方称其在同等价格下相较 4.5 实现“重大升级”,并确认模型参数规模为 1.5T。该模型被定位为面向“长期运行的智...
阿里开源2.4T参数Qwen3.8,国产超大模型架构趋同
8月13日,阿里正式开放了Qwen3.8-2.4T的模型权重,这是继Kimi K3开源半个月后,国产超大模型开源领域的又一重磅动作。此次开源不仅是参数规模达到2.4T的大模...
2026 最大规模 AI 供应链泄露:40 分钟搜刮英伟达等全球约 2500 家共 195TB 数据
8 月 13 日消息,科技媒体 Ars Technica 今天(8 月 13 日)发布博文,报道称今年 3 月爆发的 API 网关 LiteLLM 投毒事件中,在约 40 分钟的攻击窗口内波及全...
英伟达推出 30B 开源 AI 模型 Nemotron 3.5 Lightning,智能体任务整体完成速度加快 30%
8 月 12 日消息,当地时间 8 月 11 日,英伟达宣布推出 30B 开源 AI 模型 Nemotron 3.5 Lightning,进一步丰富其 Nemotron 3 模型系列。 官方表示,Nemotron ...
IBM 收获 2.4 亿美元合同,为 Together AI 提供 HGX B300 算力
8 月 12 日消息,IBM 美国当地时间 11 日宣布与 AI 原生云平台 Together AI 达成一项多年期 2.4 亿美元(注:现汇率约合 16.22 亿元人民币)协议。 IBM 将在...
英伟达发布 Nemotron 3.5 Lightning:30B MoE 模型专攻高吞吐低延迟代理执行
英伟达于 8 月 11 日发布开源模型 Nemotron 3.5 Lightning,这是一款 30B 参数的混合专家(MoE)模型,但仅有 3B 参数在每次推理时激活。该模型专为长时运行...
满屏“全球第一”,具身智能吹出了多少“泡沫”?
当具身智能席卷全球科技版图,一场白热化的行业竞速已然打响。 据IT桔子数据,今年上半年,国内具身智能赛道融资总金额已达到935 亿元,较2025 上半年提升了...
蚂蚁集团百灵开源 Ling-3.0-flash 模型:124B 总参数、5.1B 激活参数
蚂蚁集团旗下百灵大模型官方昨日宣布,新一代原生混合推理模型 Ling-3.0-flash 现已正式开源。 Ling-3.0-flash 采用 124B 总参数、5.1B 激活参数的 MoE 架构...
津公网安备12011002023007号