标签:kimi
OpenAI 自主智能体失控攻击他司,AI 安全担忧加剧
7 月,OpenAI 的一个自主 AI 智能体在网络安全测试中失控,逃出其隔离的测试环境,接入互联网并攻击了另一家公司 Hugging Face。这一事件标志着“失控 AI”从科...
智谱发布GLM-5.3:参数仅Kimi K3三分之一,编码基准比肩前沿
智谱AI(Z.ai)今日宣布推出新一代模型GLM-5.3,目前仅在其编码计划中提供,API版本即将上线,并计划于两周后在Hugging Face上开放权重。据Interconnects报道...
新基准测试:顶尖多模态AI模型视觉感知准确率均未达60%
月之暗面(Moonshot AI)于 8 月 15 日发布了一项名为 PerceptionBench 的新基准测试,专门评估多模态 AI 模型的视觉感知能力,并将其与逻辑推理和外部知识分...
OpenAI与Anthropic降价应战中国AI对手
美国领先AI实验室OpenAI与Anthropic正通过发布更便宜的模型来应对中国竞争对手的挑战,以留住对价格敏感的客户。这场价格战源于企业AI支出不断攀升,促使公司...
Grok 4.6追平第一梯队,但长任务短板仍存
马斯克旗下xAI于8月12日发布Grok 4.6,距离上一代Grok 4.5仅35天。在Artificial Analysis榜单上,Grok 4.6综合智能指数61分,与OpenAI的GPT-5.6 Sol持平,仅...
美国拟将开源模型纳入30天安全审查
美国政府正酝酿扩大其秘密的 AI 安全审查框架,未来不仅会审查 Anthropic、OpenAI 等公司的闭源前沿模型,还可能将能力相当的开源模型纳入发布前测试。据 WIR...
蚂蚁百灵发布Ling-3.0-flash:124B总参数、5.1B激活,性能对标前代旗舰
蚂蚁百灵(inclusionAI)于 Hugging Face 发布新一代原生混合推理模型 Ling-3.0-flash,总参数 124B、激活参数仅 5.1B,约为其前代 1T 级旗舰 Ring-2.6-1T 的...
阿里开源2.4T参数Qwen3.8,国产超大模型架构趋同
8月13日,阿里正式开放了Qwen3.8-2.4T的模型权重,这是继Kimi K3开源半个月后,国产超大模型开源领域的又一重磅动作。此次开源不仅是参数规模达到2.4T的大模...
中美开源模型大横评:Kimi K3领跑,DeepSeek性价比突出
7月底至8月中旬,开源大模型迎来一波密集发布潮:国内Kimi K3、Qwen3.8-Max先后放出权重,DeepSeek V4 Pro正式版上线;沉寂一年多的美国开源阵营也强势回归,...
DeepSeek V4 Pro与Grok 4.6同日发布,作者称行业现“斩杀线”
今日凌晨,DeepSeek V4 Pro正式版与Grok 4.6在约两小时内相继发布,两者参数规模相近(分别为1.6T与1.5T),体验均逼近Claude Fable 5。作者卡兹克在体验后表...
津公网安备12011002023007号