标签:预训练

月之暗面开源Kimi K3,揭秘401人贡献者团队

7月27日,月之暗面正式开源满血版2.8T参数模型Kimi K3,并在技术报告末尾首次公开了该模型的贡献者名单,共计401位成员。这一举动被视为月之暗面人才团队的全...

菜鸟前CTO李强创业入局Physical AI,昆腾动力获超亿元种子轮融资

成立仅月余的Physical AI企业昆腾动力(Quantum Dynamics)宣布完成超亿元种子轮融资,由云启资本与商汤科技联合投资。公司创始人兼CEO李强此前在阿里体系任...

余承东说到做到,华为盘古 openPangu-2.0-Pro 模型及技术报告开源上线

 7 月 31 日消息,华为今日官宣,开源盘古 5050 亿参数的 openPangu-2.0-Pro 模型(模型权重、基础推理代码)及技术报告正式开源上线。 开源盘古 openPangu ...

300 微秒调平 MoE 专家负载!小红书 UltraEP 逼近 94.3% 理想训推吞吐

AI 算力的下一个浪费重灾区,可能就在价值数百万美元的整柜系统内部。 过去,GPU 集群让人担心的是带宽不足、通信太慢。现如今,华为 Atlas 900 A3 SuperPoD...

7 个判断,重新理解 AI 基础设施

越来越便宜的 Token,越来越昂贵的竞赛 近期,SemiAnalysis 创始人 Dylan Patel 先后做客红杉资本的《Training Data[1]》和 WisdomTree 的《The Next Big ...

10人团队登顶视觉推理榜,Chance AI 超过GPT、Gemini和人类专家

过去两年,多模态模型的竞争看起来像一场“造眼睛”的竞赛:更高的图像分辨率、更多的视觉 token、更大的模型,以及更昂贵的训练。行业似乎默认,只要第一次看...

2026上半年世界模型赛道融资超百亿元,仅3-5家真做预训练

2026年上半年,世界模型赛道成为AI领域最吸金的细分方向之一,全球累计融资额已超过百亿元。在中国,大约有100家公司公开宣称正在布局“世界模型”。然而,一位...

谷歌发布三款Gemini Flash模型,旗舰模型延期致市值蒸发2000亿美元

谷歌在旗舰模型延期、竞争对手密集发布新模型的压力下,于近日一口气推出三款 Gemini Flash 系列模型,全部聚焦于降低 token 消耗和推理延迟,以“效率优先于...

腾讯发布7B参数HiLS-Attention模型,实现高效长文本稀疏注意力训练

腾讯混元团队在Hugging Face平台正式开源了HiLS-Attention-7B模型。该模型的核心创新在于其采用的HiLS-Attention(分层稀疏注意力)机制,这是一种分块稀疏注...

AI手机大战,终点是没有AI手机

几乎所有行业都在讨论“用AI重做一遍”,手机也不例外。 苹果推出Apple智能,三星持续加码Galaxy AI,华为、小米、OPPO、vivo也陆续把大模型接入手机系统。 ...
1789101195