标签:强化学习

揭秘 OpenAI 的“终极野心”:让智能体像人类一样熟练操作电脑

8 月 20 日消息,据《商业内幕》今天(20 日)报道,OpenAI 员工乐观估计,公司正接近实现从创立之初就设定的目标:让 AI 智能体像人类一样熟练地操作电脑,...

学会看、写、生成之后,AI还能做什么?

从读懂图片的“视觉”,到写出文字的“表达”,再到创造视频画面的“想象”,当下,AI正持续“进化”。 学会看、写、生成之后,AI还能做什么?近年来,科技界正在探索...

OpenAI主动放慢AI开发节奏,安全与竞争如何平衡

OpenAI在周二宣布,将放缓部分AI开发进度,以加强安全防护措施。这一决定包括暂停其“用于部署的最新模型”的强化学习训练两周,并推迟“最大计划前沿强化学习运...

入侵 Hugging Face 事件后,OpenAI 放缓模型训练并加强安全监控

8 月 19 日消息,当地时间周二,OpenAI 宣布了一批新的安全政策,重点是控制模型在测试期间可能发生的安全事件。新的安全措施包括在模型开发过程中进行更加细...

OpenAI 回应少量 Codex 用户调用 GPT-5.6 系列 AI 模型误删文件问题

8 月 19 日消息,OpenAI Codex 团队负责人蒂博 · 索蒂奥(Thibault Sottiaux)今天在 X 平台发布长推文,回应在 Codex 中调用 GPT-5.6 系列模型后,误删部分...

AI 模型混战:Grok 4.6 智力跃升、Gemini 3.7 Flash 速度称王、DeepSeek 涨价引争议

AI 模型市场再度迎来密集发布潮。xAI 推出 Grok 4.6,Google 带来 Gemini 3.7 Flash,DeepSeek 则发布 V4 Pro 0813。三家公司的模型几乎同时登场,围绕智慧、...

杰富瑞实测八款AI Agent:千问办公夺冠,Harness比模型更关键

华尔街投行杰富瑞(Jefferies)近期对八款主流中美AI Agent进行了一次系统性实测,结果颠覆了“模型越强,Agent越强”的直觉。在总分排名中,阿里巴巴的千问办...

北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

过去几年,大模型推理系统优化的核心目标一直围绕一个问题展开:如何让 GPU 更高效地计算权重、激活、KV Cache 等高维张量?从并行策略、请求调度、显存管理...

摩根大通上调智谱与MiniMax目标价,看好能力内生驱动

摩根大通在8月16日发布的研究报告中指出,中国AI模型层竞争正迎来两大催化剂:智谱发布GLM-5.3,以及DeepSeek于8月17日生效的API提价。该行认为,这两大事件...

OpenBMB 发布 MathForm-8B:将自然语言数学题转为 Lean 4 形式化证明

OpenBMB 团队近日发布 MathForm-8B,一个专门用于数学自动形式化的 8B 参数模型,能够将自然语言描述的数学命题转换为 Lean 4 形式化代码。该模型基于 Qwen3-...
1234104