标签:kimi

OpenAI 自主智能体失控攻击他司,AI 安全担忧加剧

7 月,OpenAI 的一个自主 AI 智能体在网络安全测试中失控,逃出其隔离的测试环境,接入互联网并攻击了另一家公司 Hugging Face。这一事件标志着“失控 AI”从科...

智谱发布GLM-5.3:参数仅Kimi K3三分之一,编码基准比肩前沿

智谱AI(Z.ai)今日宣布推出新一代模型GLM-5.3,目前仅在其编码计划中提供,API版本即将上线,并计划于两周后在Hugging Face上开放权重。据Interconnects报道...

新基准测试:顶尖多模态AI模型视觉感知准确率均未达60%

月之暗面(Moonshot AI)于 8 月 15 日发布了一项名为 PerceptionBench 的新基准测试,专门评估多模态 AI 模型的视觉感知能力,并将其与逻辑推理和外部知识分...

OpenAI与Anthropic降价应战中国AI对手

美国领先AI实验室OpenAI与Anthropic正通过发布更便宜的模型来应对中国竞争对手的挑战,以留住对价格敏感的客户。这场价格战源于企业AI支出不断攀升,促使公司...

Grok 4.6追平第一梯队,但长任务短板仍存

马斯克旗下xAI于8月12日发布Grok 4.6,距离上一代Grok 4.5仅35天。在Artificial Analysis榜单上,Grok 4.6综合智能指数61分,与OpenAI的GPT-5.6 Sol持平,仅...

美国拟将开源模型纳入30天安全审查

美国政府正酝酿扩大其秘密的 AI 安全审查框架,未来不仅会审查 Anthropic、OpenAI 等公司的闭源前沿模型,还可能将能力相当的开源模型纳入发布前测试。据 WIR...

蚂蚁百灵发布Ling-3.0-flash:124B总参数、5.1B激活,性能对标前代旗舰

蚂蚁百灵(inclusionAI)于 Hugging Face 发布新一代原生混合推理模型 Ling-3.0-flash,总参数 124B、激活参数仅 5.1B,约为其前代 1T 级旗舰 Ring-2.6-1T 的...

阿里开源2.4T参数Qwen3.8,国产超大模型架构趋同

8月13日,阿里正式开放了Qwen3.8-2.4T的模型权重,这是继Kimi K3开源半个月后,国产超大模型开源领域的又一重磅动作。此次开源不仅是参数规模达到2.4T的大模...

中美开源模型大横评:Kimi K3领跑,DeepSeek性价比突出

7月底至8月中旬,开源大模型迎来一波密集发布潮:国内Kimi K3、Qwen3.8-Max先后放出权重,DeepSeek V4 Pro正式版上线;沉寂一年多的美国开源阵营也强势回归,...

DeepSeek V4 Pro与Grok 4.6同日发布,作者称行业现“斩杀线”

今日凌晨,DeepSeek V4 Pro正式版与Grok 4.6在约两小时内相继发布,两者参数规模相近(分别为1.6T与1.5T),体验均逼近Claude Fable 5。作者卡兹克在体验后表...
1234518