今日凌晨,DeepSeek V4 Pro正式版与Grok 4.6在约两小时内相继发布,两者参数规模相近(分别为1.6T与1.5T),体验均逼近Claude Fable 5。作者卡兹克在体验后表示,这两款模型将大模型市场推入新的“斩杀线”,可能淘汰大量中间层玩家。
卡兹克在文中详细对比了两款模型的性能与价格。DeepSeek V4 Pro在Terminal Bench 2.1评测中得分从预览版的72.1升至87.9,仅比Fable 5的88.0低0.1分;在DeepSWE评测中从12.8大幅提升至62.7,虽仍低于Fable 5的70分,但进步显著。其API价格仅为百万输出Token 0.87美元,输入0.43美元,缓存命中输入0.0036美元,相比Fable 5(输入10美元、输出50美元)便宜数十倍。不过,该模型仍缺乏多模态能力,且在纯知识推理和困难软件工程任务上落后Fable 5约十几分。
Grok 4.6的API起步价为百万输入Token 2美元、输出6美元,较Fable 5便宜5倍和8.3倍。卡兹克特别提到,订阅SuperGrok Heavy(300美元)可获赠价值200美元的Cursor Ultra会员,且额度消耗极慢——他连续开发4小时仅消耗周额度的2%。在真实任务(如财务模型、PPT、法律案件)中,Grok 4.6表现不输Kimi K3,但开发与Agent能力仍略逊于Fable 5。
卡兹克认为,这两款模型从不同方向打破了“性能、价格、速度”的不可能三角:DeepSeek以极低价格提供准Fable级Agent能力,Grok则兼具接近Fable的综合性能与极快速度。他预测,这将抬高行业门槛,使夹在中间的模型难以生存,并称“大模型世界,再无活口”。他还透露,已将日常主力开发切换至Grok Build + Grok 4.6,并将自动化任务交给DeepSeek V4 Pro,同时为两者分别充值了300美元会员和1000元API额度。
作者最后提到,马斯克宣称Grok 4.7将超越所有模型,他对此表示相信。整体而言,这次发布标志着大模型竞争进入新阶段,性价比与速度成为关键分水岭。




津公网安备12011002023007号