标签:代码

北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

过去几年,大模型推理系统优化的核心目标一直围绕一个问题展开:如何让 GPU 更高效地计算权重、激活、KV Cache 等高维张量?从并行策略、请求调度、显存管理...

Claude水印已被破解,斩获11k Star,但会被拒绝安装

Claude 的水印政策在前些天引起了轩然大波。 我们曾报道过,包括 OpenAI、Anthropic、Google、Meta、Microsoft 在内的一大批公司,签署了欧盟《AI 生成内容...

豆包“工作任务”模式功能上新,支持手机远程操作电脑

8 月 17 日消息,豆包官方今日宣布,“工作任务”模式功能上新,支持手机远程控制电脑。 据介绍,完成授权后,用户在豆包手机端也能远程接管电脑,执行桌面端...

AI 大模型周榜:Anthropic 多款新模型密集入榜,国产 kimi-k3-max 稳定头部

8 月 17 日消息,Arena(arena.ai)平台发布 2026 年第 33 周(8 月 10 日 ~8 月 16 日)AI 大模型盲测排名,本期最大看点是 Anthropic 多款 claude-opus-4 ...

DeepSeek V4涨价生效,中国模型开启定价权实验

8月17日零点,DeepSeek V4全系列新的峰谷价格正式生效,这是中国头部模型厂商罕见的一次向上调价。以V4 Pro输出为例,每百万Token价格从6元升至闲时13.5元、...

智谱发布GLM-5.3,称漏洞发现能力超越Anthropic与OpenAI

中国AI公司智谱(Zhipu)上周发布新模型GLM-5.3,声称其漏洞发现能力可与美国顶尖模型相媲美。根据公司公告,GLM-5.3在CyberGym基准测试中击败了Anthropic的F...

OpenBMB 发布 MathForm-8B:将自然语言数学题转为 Lean 4 形式化证明

OpenBMB 团队近日发布 MathForm-8B,一个专门用于数学自动形式化的 8B 参数模型,能够将自然语言描述的数学命题转换为 Lean 4 形式化代码。该模型基于 Qwen3-...

研究:Claude与GPT智能体独立科研失败,论文遭拒

普林斯顿大学与英国AI安全研究所联合发布的一项新研究,对Anthropic和OpenAI宣称的“自主AI研究已触手可及”提出了直接反驳。在这项名为“影子评估”的实验中,使...

DeepSeek开源AI模型与智能体间缺失层

DeepSeek 本周开源了名为 Harness 的智能体构建框架,并同步发布了旗舰模型 V4-Pro-0813。与以往聚焦于基础模型不同,此次 DeepSeek 将重心放在了模型之外的“...

新基准测试:顶尖多模态AI模型视觉感知准确率均未达60%

月之暗面(Moonshot AI)于 8 月 15 日发布了一项名为 PerceptionBench 的新基准测试,专门评估多模态 AI 模型的视觉感知能力,并将其与逻辑推理和外部知识分...
17891011303