标签:预训练

DeepSeek V4 Flash公测,价格仅为Gemini 3.6 Flash约1/19

7月31日,DeepSeek将V4 Flash官方版本API推向公测。该版本未扩大参数规模,也未更换底层架构,官方披露的主要变化来自后训练,但Terminal Bench 2.1等Agent指...

Liquid AI 发布 LFM2.5-2.6B 端侧小模型,支持智能手机本地运行

8 月 5 日消息,人工智能初创企业 Liquid AI 当地时间昨日发布 LFM2.5-2.6B 开源智能体模型。仅 26 亿的参数使得 LFM2.5-2.6B 非常适合在设备端本地部署,即...

马斯克预告下周将推 Grok 4.6 模型,改进 AI 监督微调和强化学习

8 月 5 日消息,在今天(8 月 5 日)召开的 SpaceX 公司 2026 年第 2 季度(截至 6 月 30 日)财报电话会议上,马斯克预告将于下周发布 Grok 4.6 模型。 在财...

Kimi K3与DeepSeek V4之间,隔着原生多模态的时间差

“长链任务如果只通过代码层面的反馈,误差可能会不断累积,最终效果会非常差。”谈及原生多模态的意义,一位多模态研究员表示,“视觉是一种更准确的反馈,也更...

消息称蚂蚁灵波启动首轮融资,拟募资 15 亿元

8 月 3 日消息,今日,据《科创板日报》从知情人士处获悉,蚂蚁集团旗下具身智能公司灵波科技已启动首轮融资,首轮拟募资 15 亿元,目标在今年年底完成二轮融...

ChatGPT突发封杀令!全球AI写手一夜断粮

AI写作的黄金时代,正在崩塌! 进入,模型一代比一代强,文章却一篇比一篇烂。 它知道什么时候列出几条建议,在哪里塞进小标题,也不会忘记在结尾补上一句...

讯飞首发实时生成技术!像真人主播一样临场应变,表情动作实时刷新

数字人已成为企业新的交互入口。 一块屏、一位数字人,AI线下新物种诞生了! 下面屏幕里的数字人不仅能走动带路、实时讲解,还能无缝切换多国语言,按需更...

MiniMax H3:打破任务和模态边界的开放模型

今天,我们正式发布 MiniMax H3。这是一款通用的全模态生成模型,支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力、能够输出具备原生双声道的...

AI 3D七大前沿模型同场竞技,竟被比特无限发布的4B模型 Arko-T拿下8项第一

如今的 AI,已经很会「画」3D 了。 输入一句话,模型可以生成一个足够逼真的耳机盒或咖啡杯。材质、光影、甚至连轮廓都像模像样,放进宣传片里几乎挑不出毛...

翁荔刚回OpenAI,Thinking Machines反手发布新模型Inkling-Small

首个模型Inkling亮相之后,全新AI又刷屏了! 今天,Thinking Machines正式发布第二款重磅模型——Inkling-Small。 276B总参数、12B激活参数,原生多模态,100...
167891095